跳到正文

#具身智能

今日 1 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
今天10月8日周四
10月7日周三
  1. TechCrunch · AI5

    TechCrunch Disrupt 2026 互动圆桌完整阵容公布

    TechCrunch Disrupt 2026 距开幕七天,将于10月13日至15日在旧金山Moscone West举办,预计吸引超过10,000名创始人、投资人和科技从业者参会。大会设置两处专用圆桌空间,议题涵盖Physical AI、企业SaaS、IPO财务准备、AI专项数据、传统行业AI改造、agentic AI落地、量子计算投资等十余场深度讨论。门票现可立省100美元,第二张门票五折。

10月6日周二
  1. Reddit · r/artificial11

    开源可视化 Agent 画布工具:用涂鸦和标注直接引导 AI 智能体

    开发者开源了一款可视化 Agent 画布工具,用户可在工作区中对画面进行指点、涂鸦和注释,直接以视觉方式引导 AI 智能体完成视觉编辑任务。该工具在 fullstack 开发、仿真和机器人场景中均验证可用,开发者认为视觉工具栏和画布注释应成为 Agent 平台的标配高层抽象层,并按领域定制。项目已在 GitHub 开源。

  2. Product Hunt · AI 分类23

    The Sentient World:AI 角色在虚拟岛屿上自主生活的 24 分钟观察项目

    The Sentient World 是一个虚拟岛屿项目,AI 角色在其中自主生活,没有人操控或编写对白;它们会感到寒冷、回忆前一天、彼此寻找,并主动向世界请求火、灯笼、独木舟等尚未拥有的事物。所有请求以它们自己的语言公开呈现,岛上一天对应现实 24 分钟,用户只能旁观无法交流。

  3. The Decoder24

    Reka AI 发布全能模型 Rho-1,单一网络处理文本、图像、视频与机器人控制

    Reka AI 发布研究预览版全能模型 Rho-1,采用 190 亿参数(19-billion-parameter)单一神经网络,同时处理和生成文本、图像、视频与机器人控制动作,所有模态作为 token 在同一上下文窗口中运行,无需工具调用。模型可实时生成连续视频并即时响应新指令,同一批权重既预测摄像头图像又驱动机器人运动;训练在 320 块 H100 GPU 上历时约三个月完成。

10月5日周一
10月3日周六
  1. Product Hunt · AI 分类47

    Meta 发布 Muse Gadgets 开源硬件工具包

    Meta 发布 Muse Gadgets 开源硬件工具包,将 AI 助手 Muse 带入物理世界。支持连接 ESP32、Raspberry Pi 或 Linux 设备至显示器、麦克风、扬声器、按钮、传感器等硬件,可构建口袋 AI 伴侣、电子墨水简报显示器、智能家居控制器等产品。SDK 和固件基于 Apache 2.0 开源许可。

  2. Reddit · r/LocalLLaMA59

    Unitree 发布 UnifoLM-WLA-1.0:6B 参数人形机器人模型支持 64 项任务

    Unitree 发布 UnifoLM-WLA-1.0,6B 参数,在约 2500 小时真实机器人数据上训练,可完成 64 项任务(10 项全身 + 54 项桌面)。支持并行夹爪和两种灵巧手,空间推理能力优于多数开源模型。架构基于 Qwen3-VL 的 UnifoLM-ER-1,结合光流、VQ-VAE 和 MMDiT,在 Unitree G1 机器人上演示了整理床铺、洗衣服、折叠衣物等任务。

  3. Reddit · r/MachineLearning33

    机器人演示数据中手部追踪丢失插入阶段时的评估方法讨论

    机器人演示数据收集时,手部追踪器常在电缆插入瞬间因遮挡而丢失追踪,导致姿态标签出现关键间隙。论文MEgoVista提供了检测精度、召回率、F1和重建误差等评估指标,并采用将错误分配给漏检而非排除的协议;HaPTIC在多人捕捉场景中未能产生有效输出。作者建议按接近、接触、撤回阶段分别报告覆盖范围及接触期间最长连续间隙,以更全面评估数据可用性。

9月30日周三
  1. Reddit · r/ChatGPT35

    GPT-6 Astra 如何创建可变形模拟物体

    GPT-6 Astra 在 RobotGym 中实现了高保真可变形物体模拟,以挤压水瓶为例展示物理仿真能力。水瓶采用 0.3mm PET 壳体,材料参数为 3 GPa 刚度和 55 MPa 屈服强度,通过自定义塑性核使瓶身凹陷后保持形变。模拟包含 32,000 粒子水体,使用 GPU 加速的 Newton VBD solver 计算,在全路径追踪的公寓场景中呈现透明 PET 材质与折射水体效果。

9月29日周二
9月26日周六
9月24日周四
9月22日周二
  1. NVIDIA Blog73

    NVIDIA Isaac ROS 5.0 发布,增强 Agent 能力并推进开源机器人开发

    NVIDIA 发布 Isaac ROS 5.0,这是一个基于 ROS 的 GPU 加速机器人开发工具包。新版本支持 ROS Lyrical 和 Ubuntu 24.04,引入了新的 agentic 工作流程。

    推荐理由:原文给出了具体能力变化(FoundationPose 5.5x 提升、CuMotion 2-5ms 路径规划)和多个合作方集成信息,读者可以据此判断这个版本对机器人开发工作流的具体影响。

8月27日周四
8月26日周三
8月24日周一
  1. The Rundown AI58

    中国人形机器人百米赛跑超博尔特纪录

    北京世界人形机器人运动会上,天宫Ultra以9.39秒跑完100米,超越博尔特9.58秒的人类纪录;荣耀闪电以9.47秒获第二。今年的获胜成绩比去年快2.3倍。同期新闻包括Waymo为无人驾驶汽车定制5nm AI芯片、FDA批准首款自主抽血机器人、MIT升级挖掘机控制器等。

8月14日周五
7月28日周二
  1. Google DeepMind76

    Google DeepMind 发布 Gemini Robotics 2,为机器人带来全身智能控制

    Google DeepMind 发布 Gemini Robotics 2,推出了三个模型:高级 VLA 模型可控制完整人形机器人从脚到指尖的运动,实现灵巧操作如系扣子;ER 2 推理模型可处理多步骤任务并协调多机器人协作;On-Device 2 模型可在几小时内适应全新机器人形态。

    推荐理由:原文给出了三个模型的具体能力描述和可用入口,读者可以据此判断 Gemini Robotics 2 与前代及竞品的具体差异。

7月27日周一
  1. Hugging Face Blog70

    NVIDIA 发布 Cosmos-H-Dreams:面向手术机器人的实时生成式模拟器

    NVIDIA 发布 Cosmos-H-Dreams,一款实时的、动作条件的手术机器人生成式模拟器。该系统基于 Cosmos-H-Surgical-Simulator,通过师生蒸馏和自强制学习将模型精简为因果few-step模型,并在 FlashDreams 加速库支持下,在单张 RTX PRO 6000 GPU 上实现约 160 FPS 的交互式帧生成。

    推荐理由:原文给出了性能数据(160 FPS、单卡运行)和技术实现路径,读者可以据此评估它对手术机器人训练和模拟的实际价值。

7月1日周三
6月29日周一
6月9日周二