如何把触觉世界建模扩展到十指?一种手指与姿态感知的触觉压缩器
一种手指与姿态感知的触觉压缩器将10路指尖数据流映射为2个手部级潜变量,同时保留89.4%的融合前接触召回率,使训练速度提升2.26倍、推理速度提升1.29倍。该工作面向十指触觉世界建模的规模化问题。
一种手指与姿态感知的触觉压缩器将10路指尖数据流映射为2个手部级潜变量,同时保留89.4%的融合前接触召回率,使训练速度提升2.26倍、推理速度提升1.29倍。该工作面向十指触觉世界建模的规模化问题。
Berkeley AI 人类智能中心发布 DexTacWAM,一个将预训练视频世界模型通过持续视触觉学习改造而成的视触觉世界-动作模型,用于多指接触预测与动作生成。
博登智能在 IROS 2026 发表主题演讲,介绍第一人称视角手部重建算法 ChronoHand,在 ARCTIC 评测中五项重建精度全面超越 SOTA,MPJPE-p 降至 17.04,CT-p 降低 34.0%。该公司已在宁波、湖州、马鞍山建成超 3 万平方米创新中心,具备年产 50 万小时真机训练数据产能,并开源 RW-RL-HIL-Dataset,完成数据出境备案。
前黑芝麻智能首席市场营销官杨宇欣以联合创始人身份加入正行创新(Striding AI)并出任总裁,全面负责全球市场拓展、产业生态建设与商业化落地。正行创新成立于2026年初,由姚颂、正大集团与清华学者于超联合发起,主攻世界动作模型与强化学习,推动人形机器人部署至真实商业与工业场景,今年6月已完成近亿美元天使轮系列融资。
具身智能数据竞争正从比拼数据时长转向衡量数据带来的模型能力增益,无问智科以「世界模型×数据工厂×世界模拟器」构建 Real2Sim2Real 闭环。其数据从 Raw Data 到 Model-Ready 的处理效率提升 500% 至 1000%,Sim-Ready 资产构建从 3 天缩短至 5 分钟,已建百万级资产库。
AMD 正式官宣以全股票方式收购李飞飞创立仅两年的 AI 公司 World Labs,作价约 82 亿美元,双方已签署最终协议,预计 2026 年底前完成交易,仍须获得监管批准。
这笔交易给出了芯片厂商押注空间智能的完整逻辑,读者可据此判断下一代 AI 计算负载的走向。
AMD 与 World Labs 达成收购协议,交易金额 82 亿美元,交易预计今年年底前完成,仍需获得监管批准;World Labs 创始人李飞飞将加入 AMD 担任执行副总裁兼首席科学家,直接与 CEO 苏姿丰及团队合作。
交易把世界模型团队接入芯片研发链条,读者可以了解空间智能路线与硬件协同的动因。
AMD 与李飞飞创办的 World Labs 签署收购协议,交易全部以股票支付,作价约 82 亿美元,预计年底前完成交割,仍需获得监管批准。交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报,World Labs 将继续研究模型。
通过这笔交易可以了解空间智能模型的算力需求,以及芯片厂商为何向模型层延伸。
Justine Moore 公开祝贺李飞飞、Johnsson、Mildenhall、Casado 及整个 World Labs 团队,称其以出色的模型持续开拓空间智能前沿,并称赞这支团队是难得友善且周到的一群人。
Tensr 正在建设由机器人造机器人的自动化工厂,其 12000 平方英尺工厂已投产,制造人形机器人、末端执行器和供国际空间站使用的机器人。每一笔订单都会转化为训练数据,用于让工厂把下一台造得更好。
机器人3D视觉公司奥比中光于9月24日向香港联交所提交上市申请,拟发行H股并在港交所主板上市,其A股已于2022年7月登陆上交所科创板。招股书显示,奥比中光2023年至2025年营收分别为3.60亿元、5.64亿元和9.41亿元,净利润从亏损2.76亿元、亏损6289万元转为2025年盈利1.28亿元;2026年上半年营收4.38亿元、净利润4079万元。
阿里巴巴携手清华大学、上海交通大学发布 RoboFlywheel,围绕数据生产、处理、验证与复用建设具身智能开放数据基础设施。
马斯克在央视财经约26分钟专访中表示,Anthropic 让 AI 擅长了软件工程,但还没人让 AI 真正擅长现实世界工程。他计划用 SpaceX 和 Tesla 的工程数据训练 Grok,让模型进入汽车、机器人和火箭系统;并称按每单位算力性能看中国可能明显领先。
Aditya Bhatt 等人的最新博士论文提出 Blind Dexterity,首次仅靠关节编码器实现抗推的人形机器人行走,无需 IMU 和力/力矩(F/T)传感器。该工作由 DFKI 与达姆施塔特工业大学(@ias_tudarmstadt)团队完成,论文已被 IROS 2026 接收。
MIT 教授 Philip Isola 提出,AI 可能正进入 robot-use agents 时代:通用模型能控制不同机器人、编写策略,并在几乎无需机器人专项训练的情况下学习新物理任务。
华为联合中国信通院、中科院沈阳自动化研究所等发布《物理智能云边端协同架构研究报告》,提出"三域协同·一网贯通"架构,让端侧负责微秒/毫秒级实时控制、边缘侧负责区域自治与多机协作、云端负责大模型训练与全局规划。报告将落地划分为三阶段,中期(2028—2030年)走向区域自治,并已在WAIC发布全国首个异构人形机器人具身智能训练场"麒麟训练场"作为样板点。
microagi 与 ElevenLabs 合作,为人形机器人赋予语音能力,让人无需屏幕或控制面板即可直接开口对话。双方称目标是让向机器人求助像向身边人求助一样自然,目前处于早期案例研究阶段,展示了未来机器人与人交流的可能形态。
Runway 联合创始人兼联合 CEO Anastasios Germanidis 阐述 AI 视频的终局是世界模型:Sora 曾触发 Runway 内部的生死冲刺,而扩大视频模型规模或许足以学到物理规律。他进一步提出实时生成可让世界模型充当机器人模拟器,软件的未来可能是直接以像素而非 HTML 和代码生成的界面,Runway 正朝完全神经操作系统推进。
沈亚楠创立具身公司恩戈罗(NGORO),第一款机器人放弃双足和拟人造型,用轮式底盘、最小转弯半径 30cm,第一批产品做洗衣、房屋清洁、物品归位与递送,2027 年将作为栖息地智能住宅标配交付真实用户,首批约 2000 台。他判断家庭是最接近通用也最难的场景,恩戈罗要借栖息地的半结构化住宅与仿真、真机数据先启动数据飞轮。
阿里巴巴在云栖大会上发布开放具身数据基础设施项目 RoboFlywheel,首发的仿真板块与清华大学赵昊团队联合打造,覆盖百万级仿真资产底座与跨引擎仿真平台。首批包含 52 万刚体、40 万铰链物体和 10 万柔性体,资产补充质量、惯量、摩擦与关节等物理属性。
Jeff Dean 分享称可从真实大鼠神经元的计算中获得有趣发现,并称赞 Alex Ksendzovsky 及 BioComputingCo 团队的工作。Ksendzovsky 表示神经元与硅结合会催生新世界,该团队正与亚马逊合作将其推向客户,可通过私信申请早期访问。
非侵入 AI 脑机接口公司华超神控(BCI-Sonics)完成2亿元人民币 Pre-A 轮融资,由红杉中国与云启资本联合领投,老股东经纬创投持续加注,成立至今累计融资近3亿元。
Microsoft Research 新研究显示,将 AI 推理从机器人本体移出可提升任务成功率、提高效率,并支撑更先进的物理 AI 工作负载。该结论指向机器人硬件与智能增长不匹配的问题,即算力从机器人端外移是可行路径。
微软研究发现,将物理 AI 推理从机器人板载 GPU 卸载到边缘或云端 GPU,可显著提升移动操作任务的成功率、响应速度与电池续航。测试显示,较轻 GPU 下建图与规划最多变慢 383%,导航障碍及时检测下降 30%,VLA 模型准确率下降 50%;用树莓派 5 替代板载 GPU 后,Jetson Thor 一类板载 GPU 曾使续航最多减少 160%。
Earendil Robotics 正在打造自主拦截无人机,配套提供从零建立该能力所需的软件与训练。其系统能自主起飞、转场并拦截目标,把原本数月的飞行员训练缩短为几次点击。目标是让防空系统足够便宜以大规模部署,同时简单到可规模化操作。
Earendil Robotics 正在研发可自主起飞、转场并拦截目标的自主拦截器,配套软件与训练体系可从零搭建防空能力,把原本数月的飞行员训练压缩到几次点击。其目标是把防空系统做到足够便宜、可大规模部署,同时足够简单、能规模化操作。
2026网易科技未来大奖获奖名单揭晓,梁文锋(DeepSeek CEO)、杨植麟(月之暗面kimi CEO)等10人获评"AI创新先锋人物"。宇树科技、智元等10家企业获"具身智能先锋企业",京东JoyAI、蚂蚁百灵、理想VLA、百川智能、水木分子、面壁智能CPM for Legal入选"行业大模型应用标杆"。
2026网易未来大会9月23日在杭州举行,作为第五届全球数字贸易博览会同期核心活动,以"碳硅相逢,万象启元"为主题,彭先觉、王江舟、焦李成、吴信东、刘煜辉等院士与经济学家纵论AI与未来。
Runway AI Summit 将于一周后举行,官方公布的首批议程为“Grounding Intelligence in the Physical World”,嘉宾包括 Nvidia 的 Ming-Yu Liu、Google DeepMind 的 Jon Barron 和 Wayve 的 Alex Toshev。更多场次信息尚未披露。
一篇论文提出把视觉语言模型(VLM)的智能迁移到机器人控制中,论文页面已发布在 Hugging Face Papers(编号 2609.22…)。原帖未披露所用模型、参数规模或评测结果。
NVIDIA 介绍如何借助 AI Agent 与 Isaac ROS 加速 ROS 2 节点:即使 CUDA kernel 很快,消息在节点间仍可能经 CPU 内存序列化或拷贝,抵消 GPU 上感知与 AI 负载的收益。此次通过上游抽象与 NVIDIA 近期推出的 CUDA buffer 后端来消除这一瓶颈。
关停的初创公司 eidon.ai 将 1,274 小时第一人称视角机器人数据开源,包含 13,451 段人类完成日常任务的录制,作为送给机器人社区的礼物。数据已发布在 Hugging Face 上。
微亿智造董事长兼CEO张志琦表示,公司不做人形机器人本体,而是以“眼-手-脑”架构把物理AI落到工业场景,形态由环境决定,轮式底盘在平整工厂地面比双足更高效。客户只为结果买单,能否规模化取决于两年内收回成本的ROI账,微亿智造已完成超25家世界五百强及行业龙头客户交付,其方案目标为产线50%~60%自动化、30%~40%具身智能、5%~10%人工。
侵入式脑机接口公司智冉医疗完成新一轮融资,估算金额超6亿元,顺禧基金、君联资本、红杉资本、美团龙珠等参与投资,累计融资已超12亿元。其128通道脑机接口系统今年5月启动多中心GCP注册临床,计划年内完成30至40例患者入组,预计明年提交三类证注册申请,下一代1024通道产品已定型。
清华交叉信息研究院助理教授徐梦迪的核心研究方向是机器人的 in-context learning:让机器人到新环境后通过一两次交互当场学会新任务,且越学越快。节目录制后第二周,Generalist 发布 GEN-1.5,仅给机器人看一段 3-12 秒动作示范作为 physical prompt,不做微调、不更新参数即可当场尝试新任务,10 项任务平均成功率约 59%。
Founder Park 编译 YC 播客《The Lightcone》内容,YC CEO Garry Tan 与合伙人 Diana Hu、Jared Friedman、Harj Taggar 复盘过去 12 到 18 个月的批次数据。
Snap 将 Spectacles 演进为 SPECS,售价 2195 美元,重量从上一代 226 克降至 132/136 克,FOV 提升到 51 度,并首次作为消费者产品出售。节目邀请现场体验者泽霖和 AR/XR 开发者脑潘,讨论 130 多克重量与高价为何仍让它离日常佩戴很远。话题延伸至苹果、Meta、Snap 各自技术路线下,下一代计算平台尚无「灯塔」的 XR 行业现状。
Thomas Wolf 展示了机器人头部的迭代进展,推文获 247 个点赞、16125 次浏览,互动数据由 xgo.ing 提供。
Mishig 在 MuJoCo 中复现实验,让 gpt6 astra 控制 so101 机械臂与画笔,在仿真里画出埃菲尔铁塔,完整实验已发布在 Hugging Face。
Citrini Research 分析师用一周时间在旧金山湾区走访十余家机器人实验室,实地观察 AI 机器人操作,重新评估了机器人形态、神经网络与商业化时间表。文章以 GeneralistAI GEN-1.5 和 Skild AI S1 的"in-context"学习演示为例,指出当前机器人多处于开发训练与遥操作演示阶段,真正的落地部署仍接近试点。