NVIDIA 如何教机器人组装 GB300 测试托盘
NVIDIA 分享了教机器人组装 Grace Blackwell GB300 超级芯片测试托盘的经验,并由此探讨机器人学习、机械智能与传统工程实践。GB300 是支撑现代基础模型训练与推理的引擎,其托盘组装此前依赖全球工厂中的熟练体力劳动。
NVIDIA 分享了教机器人组装 Grace Blackwell GB300 超级芯片测试托盘的经验,并由此探讨机器人学习、机械智能与传统工程实践。GB300 是支撑现代基础模型训练与推理的引擎,其托盘组装此前依赖全球工厂中的熟练体力劳动。
Jim Fan 认为,人类解决黎曼猜想可能早于通过"物理图灵测试"——即狂欢派对后回到整洁的家,却分不清是人还是机器人打扫的。他称我们对莫拉维克悖论的认识还不够。
Datawhale 十月组队学习开放报名,共 11 门课程,首次开设围绕 JEV Cookbook 的共学课程,讲解 Choice / Score / Noul 三种核心问题原语。课程覆盖 LLM 专题、Agent 专题、具身智能专题和 AI Infra 专题,其中 LLM 算法与系统教程按推理优化、性能优化、后训练优化三个方向分设。各学习时间重叠,每人限报 1 门,报名后需本周内扫码进群。
慕尼黑工业机器人公司 RobCo 于 10 月 5 日宣布估值超过 10 亿美元成为独角兽,此次为员工向新老投资人转让股份的二级交易,规模超 4,000 万美元,公司自身未获新资金。
至简动力强化学习负责人冯宗宝在 IROS 2026 介绍,其团队让机器人单机自主值守两台 CNC 机床,在工件与卡盘间隙仅 0.5 毫米的条件下完成抓取、上料、插入、取件与放置,精密插入任务成功率达 100%,训练仅用 600 条真实机器人轨迹。
李飞飞在Huberman Lab等播客访谈中判断,未来十年职场上更有竞争力的是把一件事做到极致的专才和什么都能上手的通才,两者共同的能力是主动性。她创办的World Labs正探索空间智能,让机器理解并生成三维空间;她认为AI的下一个前沿在语言之外,机器人落地仍需更长时间。
Pollen Robotics 的 Microduck 机器人换上首款完全自研的 SBC,取代原型阶段 Radxa 加扩展板的"三明治"方案。该板由 Seeed 基于同款 Rockchip CPU 打造,配备更大内存、更好的 WiFi/BT、双 NFC 天线、面向用户的状态 LED、RGB 手电筒,并大幅改进散热、理线与启动速度。首版硬件到手当天即全部跑通,被视为产品出货路上的重要里程碑。
Multiply Labs 完成 7500 万美元 B 轮融资,其机器人用于生产基因疗法、mRNA 治疗等复杂药物。这些机器人已在 AstraZeneca 和 Legend Biotech 的设施内运行。部分基因疗法手工生产单剂成本可超 100 万美元,且速度慢、易受污染。
加州叫停 REK 的人机对战,Boston Dynamics 则对 Atlas 的小指做了改动。机器人"大脑"公司 FieldAI 接近以 100 亿美元估值融资。此外,外骨骼正迎来自己的高光时刻。
魔芯科技在华为Mate 90系列发布会上亮出鸿蒙独占应用摸小宠,用户拍几张猫的照片即可生成可从任意角度观看的4D数字猫,其技术底座是MoWorld世界模型。该链路端云协同:云端在昇腾NPU上用扩散模型生成3D高斯模型,约6亿参数的MoWorld-2.0-Flash经量化裁剪跑在麒麟芯片上完成端侧渲染。
VA-Bench 以观察、推理、行动、修正的闭环测试 12 个多模态模型,覆盖 14 类机器人操作任务共 280 个基础场景。表现最好的模型在目标识别与定位上达到 100%、操作语义理解达到 99.6%—100%,但 Qwen3.8-max、Opus-5 和 GPT-5.6-sol 的完整任务成功率分别只有 53.93%、52.86% 和 51.55%。
太空算力初创企业一苇宇航自2025年7月至今完成四轮融资,最近一轮为超亿元天使轮系列融资,投资方包括北京市空天基金、浩瀚深度、世纪金源等。公司成立于2025年2月,主攻高性能太空算力载荷,产品分极宇、登云、天衍和太空算力服务平台四条线,登云面向大模型推理。其第一台太空服务器由三大运营商之一购买,已拿下规模化商业订单。
IROS 2026 于 9 月 27 日至 10 月 1 日在匹兹堡举行,展商密集围绕“数据”“触觉”“全栈”布局,灵巧手配采集设备、夹爪加触觉指尖,硬件厂商也带来操作模型。
Yann LeCun 指出,两年过去人类级 AI 依然遥远:AI 虽在数学、编程和已知答案问答等任务上超越人类,但 Level-5 自动驾驶、能像 17 岁少年练 20 小时就学会开车的系统、以及能完成 8 岁儿童任务的家用机器人都还不存在。他强调 AI 仍难以应对物理世界的复杂与混乱,并指出 Tesla FSD 仅为 Level 2、Waymo 为 Level 4。
斯坦福大学助理教授吴佳俊在 IROS 2026 的 RoBoWoMo 研讨会上发表《Building Physical Agents via Structured Representations》报告,提出用结构化表征搭建物理世界智能体。他介绍了从演示中学习谓词与原子动作、让模型自行提出 DSL、并用演示标签对视觉判据做后训练等路径,并透露最近投稿的工作已将规划器也换成后训练的开源视觉模型。
论文 EgoTools 提出面向真实第一人称视频的工具中心推理,论文已在 HuggingFace 上线(编号 2609.39…)。目前仅有论文链接与演示视频,未披露模型规模、benchmark 分数或开源情况。
The Bot Company 联合创始人兼 CTO Paril Jain 与 Physical Intelligence 联合创始人 Quan Vuong 在 Runway AI Summit 同台,讨论真实环境评测、机器人在现场的部署以及三年后机器人行业的走向。
官方详细解释了 Atlas 新机器手为什么只设计四根手指,并附上 best.xiaohu.ai 的完整文章链接。
波士顿动力为 Atlas 换上新一代机器手 GR3,自由度从上一代的 7 个提升到 13 个,大拇指 4 个自由度、其余三根手指各 3 个,没有小指。官方理由是增加小指带来的灵巧度不值得多出 3 个自由度以及由此增加的复杂度、体积和功耗,团队 CTO 还曾让成员把小指与邻指缠在一起生活一天来验证。新手采用统一类型的全封闭执行器直接驱动,指尖与手掌配压力触觉传感器,关节可在外力下退让。
Yann LeCun 在 X 上发问:"我的家用机器人在哪?我的 L5 自动驾驶汽车在哪?"他指出,可以把 LLM 微调成能回答任何物理世界问题的模型,但这并不意味着它拥有足够的理解力和物理直觉,去预测一个 6 岁儿童就能预测的事情。
晚点聊「AI季报26Q3」由主播程曼祺与 MoE Capital 创始合伙人 Henry Yin 对谈,梳理 GPT-6 Astra 进入机器人、Opus 5.5 与个人助理产品 Muse、Instinct 的进展,以及 OpenAI ARR 猛增、Anthropic 招股书透露 5180 亿美元承诺。
Harvard 的 Julian Simcock 与 Google DeepMind 的 Rick Ingram 在 Runway AI Summit 上讨论物理 AI 的监管、政策制定以及与中国的竞赛。
MBZUAI、Caltech 等机构发布综述《World-Action Models for Robot Learning and Control: A Survey》,系统梳理世界—动作模型(WAMs)的概念、架构、训练与评测,核心是把未来世界预测与可执行动作生成连接起来。论文按语言接口、视觉编码器、预测骨干与动作解码器拆解 WAM,并区分联合预测与逆动力学两条路径,覆盖操作、导航与自动驾驶。
今日机器人领域多条动态:DoorDash 自研配送无人机;Dyna 的机器人可完成整套洗衣流程;ETH 让无实体机械手学会爬行;MIT 则把活体肌肉装进纸片般薄的机器人中。
小互发布了一段 Figure 02 人形机器人的视频,配文称其为"最后的挣扎"。原帖互动数据为 0 条评论、0 次转发、2 个点赞、2337 次浏览。视频内容本身未附带更多文字说明。
Figure 02 被训练自主跳入钢水。相关视频发布后获得 6563 次观看。原文未披露训练方法与目的等更多细节。
Figure 把退役的第二代人形机器人 Figure 02 送进钢厂熔炉销毁,并设定它自主跳入熔炉,官方称这是致敬《终结者2》名场面。团队在加州圣何塞总部架设气囊采集特技演员动作数据,并在仿真环境中训练全新 AI 动作模型,让机器人从二楼起跳跳入未曾实地勘测的熔炉桶。寻找多家钢厂无果后,仅芬兰伊马特拉一家铸造厂愿承接;目前绝大部分 F.02 已销毁,仅留少数几台在总部展陈。
Runway Research 团队在一场深度 Q&A 中讨论了实时模型、生成式界面,以及机器人领域的下一步方向。原文未披露具体模型版本、参数或性能数字。
Runway 机器人业务负责人 Andy Chen 阐述了 Runway 在机器人领域的独特路线,并首次发布开放权重的世界动作模型 Praxis-1。Praxis-1 已在 runway.com/praxis-1 开放提前访问申请。
Innate 是一支 7 人团队,正在打造面向日常生活的实用机器人。联合创始人 Vignesh Anand 称"我们这 7 个人干着 50 个人的活"。Cursor 团队探访该团队,记录下他们对"构建"的理解。
Runway 发布 Praxis-1,一个开放权重的世界动作模型(World Action Model),把其在视频预训练上的积累用于机器人真实世界控制。该模型基于大规模视频预训练和实时基础设施构建,定位为可跨任意具身形态与环境的策略模型,面向机器人开发者和研究者。
Sharpa 在 IROS 2026 上一口气发布三款自研硬件:一体式触觉感知机器人本体 D01、新一代全触觉灵巧手 W02、外骨骼触感数据手套 AE01。D01 手臂载荷自重比接近 1:1,最大末端执行器速度超 10.5 m/s,通信频率 1000 Hz,单臂负载 5 公斤,电子皮肤支持 100 Hz 触觉采样、0.1–20 N 力感知范围和 0.2 N 力分辨率。
AMD 宣布李飞飞加入,出任执行副总裁兼首席科学家,直接向董事长兼 CEO 苏姿丰汇报。她联合创办的空间智能公司 World Labs 将并入 AMD,交易以股票支付,规模约 82 亿美元。
在2026网易未来大会上,灵初智能陈源培、OriginFlow秦深涛、万格智元王冠博三位00后创业者对话,谈具身智能落地瓶颈从算法转向算法工程化,创业公司真正的"死亡谷"在50到150人之间,端侧AI可用4G内存推理35B模型、10G内存推理80B模型。
影溯科技发布并上线新一代世界模型 InSpatio-World 1.5,支持单图、多图、全景图和视频等不同输入,强化实时场景探索与时空一致性,并已开放试用与开源代码,同时即将邀测世界模拟器 Topos-Pro 1.0。
SpatialClaw 提出重新思考智能体空间推理的动作接口,相关论文已发布在 Hugging Face Papers。原文未披露模型规模、benchmark 分数或开源情况。
星源智创始人刘东(前京东智能驾驶负责人)选择只做具身智能“大脑”不做本体,产品包括具身“大脑”模型与端侧算力平台,成立两个月后即开始交付,目前已与70%以上的头部机器人公司建立合作,预计今年实现数亿元收入。
2026外滩大会·AI2C论坛在上海举行,12位创业者与投资人围绕AI如何从消费入口走向交易展开讨论。影眸科技Hyper3D现场演示Rodin 2.5,4秒生成基础3D模型、80秒生成千万级面数高精度资产,并已为劳氏3万多个SKU重建3D资产、将单件建模成本从100美金压到1美金以下。下半场焦点转向Agent代理搜索与支付,FluxA提出支付需感知用户意图、进入Agent执行上下文。
临界点让旗舰灵巧手 OmniHand 3 Ultra 向苏绣传承人学习上绷、劈丝、穿针、捻线、挑线与合绣,全程实拍无 CG。OmniHand 3 Ultra 具备 21 个主动自由度,触觉覆盖指尖、指腹和掌面,每个指尖内置米粒大小相机;所用真实绣花针针孔关键尺寸不超过 0.15 毫米,劈丝则从一根蚕丝分到十六股。前段劈丝由它自主完成,线股变细后由老师手把手带做,合绣时人手与机器在同一绷面交替落针。
Dextac-WAM 项目网站新增真机演示、世界模型预测、触觉可视化、消融实验与详细说明,网址为 dextacwam.github.io。