跳到正文

#Meta

今日 12 条
9月29日周二
  1. 网易科技AI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AMD 以约 82 亿美元收购 World Labs,李飞飞将任执行副总裁兼首席科学家

    AMD 与李飞飞创办的 World Labs 签署收购协议,交易全部以股票支付,作价约 82 亿美元,预计年底前完成交割,仍需获得监管批准。交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报,World Labs 将继续研究模型。

    为什么值得看

    通过这笔交易可以了解空间智能模型的算力需求,以及芯片厂商为何向模型层延伸。

  2. Julien Chaumond(@julien_c)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Julien Chaumond 调侃 Meta 新 CTO:至少他不是 Anthropic 的 MTS

    针对 Mark Zuckerberg 宣布 Chirantan "CJ" Desai 加入 Meta 担任 Chief Enterprise Platform Officer 并直接向其汇报,Julien Chaumond 调侃称"至少他不是 Anthropic 的 MTS"。

  3. Replit ⠕(@Replit)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 上线 Meta Quest VR 应用开发,接入 GPT-Sol 6、GPT-6 Luna 与 Opus 5.5

    Replit 一次性上线多项更新:支持构建 Meta Quest VR 应用、通过 Muse 创建 Replit 应用,并接入 GPT-Sol 6、GPT-6 Luna 和 Opus 5.5 三款新模型。同时新增 Airwallex 支付链接、在聊天中直接绘制数据图表,企业版则可在工作流内申请和控制访问权限。

9月28日周一
  1. 稀土掘金技术社区AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 预告 DevDay 发布代号 "O" 的 Agent,瞄准 Meta Muse

    Meta 的 Muse 刚登上 Assistant Benchmark 最强 Agent 位置,OpenAI 随即预告将在 29 号 DevDay(北京时间 30 日凌晨)发布代号为 "O" 的 Agent。传言称 "O" 拥有独立身份、可无中断执行长程任务,并可能由 GPT-6 Astra 变体驱动。

  2. NVIDIA AI(@NVIDIAAI)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 与 Meta 合作优化 Muse Realtime Avatar 模型效率

    NVIDIA 与 Meta 团队合作提升了 Muse Realtime Avatar 的模型效率,让虚拟形象在实时对话时能够跟上节奏。Meta 在 Connect 大会上发布 Muse Realtime Avatar,这项实时化身技术将 Muse Realtime Voice 转化为可表达、可交互的虚拟形象,并为 Muse 带来实时对话等全新交互方式。

9月26日周六
  1. Replit ⠕(@Replit)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit Agent 新增 GPT-6 Sol、GPT-6 Luna Fast 和 Claude Opus 5.5 三款模型

    Replit Agent 本周接入 GPT-6 Sol、GPT-6 Luna Fast 和 Claude Opus 5.5 三款新模型,供用户试用并匹配自己的工作流。

  2. Yann LeCun(@ylecun)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 回顾 Galactica:Meta 1200 亿参数科学写作 LLM 遭围攻下架,三周后 ChatGPT 却受追捧

    Yann LeCun 重提 2022 年 10 月 Meta-FAIR 开源的 120b 参数 LLM 系统 Galactica,它用于帮助科研人员写论文,却因被指危险、有毒并会毁掉科学而遭围攻,团队被迫下线演示网站,仅保留 GitHub 和论文。他称三周后 ChatGPT 发布却被奉为救世主,当初发难者则陷入沉默。

9月25日周五
  1. 深思圈AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 开放 Muse Connector 接口,AI 智能体迎来应用商店时刻?

    Meta 宣布向开发者开放个人 AI 智能体 Muse,并推出 Connector 机制,允许开发者把外部服务接入,由 Muse 在对话中按需调用。深思圈结合 Greg Isenberg 的分析,将这一步类比 2008 年 App Store 开放,并梳理了本地商业获客、上门维修调度、运动场地匹配、家庭晚餐规划四个创业方向。

  2. Replit ⠕(@Replit)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 支持用一句话为 Meta 设备构建 VR 应用

    Replit 在 Meta Connect 上宣布,用户只需描述应用需求,Replit 就能为 @Meta 设备构建出 VR 应用。开发者现已可通过 replit.com/partners/meta 开始构建。

  3. DeepLearning.AI(@DeepLearningAI)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta AI 用专用记忆智能体缓解长上下文遗忘,Claude Sonnet 4.5 基准从 37.6% 升至 45.9%

    Meta AI 将主行动智能体与专用记忆智能体配对,以解决长上下文导致 AI 智能体忘记早期错误的问题。记忆智能体保存关于工具和过往错误的结构化笔记,只在关键时机注入简短提醒。该方案把 Claude Sonnet 4.5 的基准从 37.6% 提升到 45.9%。

  4. Justine Moore(@venturetwins)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Zuck 收购消费级团队与产品的 N=1 天赋:IG、WhatsApp 与 Muse

    Zuck 在收购消费级团队与产品方面堪称 N=1 天赋,IG 和 WhatsApp 都是传奇收购,Muse 在 Alexandr 与 Nat 带领下开局强劲,预计前三周 DAU 将突破 100 万,并已连续 7 天位居 App Store 榜首。

9月24日周四
  1. Founder ParkAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 复盘 Muse:Agent 怎么才能像「一个人」长期存在?

    Meta 的 Muse 团队公开了 Personal Agent 的产品设计与安全架构复盘,扎克伯格也在播客中谈到自己如何使用 Muse。Muse 采用持续长对话界面,跨对话保留记忆,具备文件系统、终端与完整浏览器,可后台持续推进任务,只在出现有意义进展或需要用户参与时通知。

  2. 甲子光年AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    电力成算力新约束,华为如何用“源网荷储AIDC”解题

    华为数字能源首次公布源网荷储AIDC解决方案,围绕“3+1”创新重构,目标是让每一瓦特产出更多Token。方案包括MIMO供电架构、泰山UPS(单柜1280kVA、双变换效率最高98%)、恒山直流UPS(支持270V/400V/800V)和SmartLi 5.0、LUNA2000多层混合储能。商汤项目采用工厂预制与室外部署,45天完成18MW供配电系统全流程交付。

  3. 硅谷科技评论AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 四巨头 90 亿美元押注 FDE,争夺 Palantir 的企业交付位置

    5 月至 7 月,OpenAI、Anthropic、亚马逊云科技和微软各自成立或组建企业 AI 交付实体,按公开口径合计投入约 90 亿美元。

  4. ElevenLabs(@elevenlabsio)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 接入 Meta 个人 AI 智能体 Muse,对话即可生成配音、配乐和视频

    ElevenLabs 宣布接入 Meta 的个人 AI 智能体 Muse,用户在该智能体内发一条消息就能生成配音、配乐和视频。该消息由 ElevenLabs 官方账号发布,未披露具体上线时间与功能细节。

  5. AI Engineer(@aiDotEngineer)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sarvam 文档模型处理 13 万亿 token 文本,上线四个月数字化 3500 万页

    前沿模型所学习的网页抓取数据中,印度语言内容占比远低于 1%;Sarvam 的文档模型在见到第一张图像前已读取 13 万亿 token 文本,上线四个月即数字化 3500 万页。Perceptron AI 用模型自主决定读取哪些 token,以应对一小时视频约百万视觉 token 中仅约 2% 有真值标注的问题。Meta 则在其三智能体审核流程中过滤大部分视频,压缩相似帧并对热门视频缓存判定结果。

  6. AI Engineer(@aiDotEngineer)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI Engineer World's Fair 2026 视觉与 OCR 专场:模型能看见,但还在学习如何观察

    AI Engineer World's Fair 2026 的 Vision & OCR Track 正在直播,核心观点是"模型能看见了,但仍在学习如何观察"。

9月23日周三
  1. 乌鸦智能说AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    中国没跑通的 AI 助理,为什么在美国突然爆了?

    Meta 的 Muse 上线 12 天总安装量接近 280 万,美国移动端日活 64.2 万,冲上美国 App Store 免费榜第一,同期下载量超过 ChatGPT。

  2. 字节跳动技术团队AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TWIST 入选 ACM CCS 2026:面向云上大模型服务的隐私保护新方案

    字节跳动安全研究团队与香港城市大学联合研究的 TWIST 被 ACM CCS 2026 接收,该方案用密钥将输入 Token 与模型权重映射到同一变换空间,使云端可沿用标准推理流程处理混淆态数据。

  3. 架构师之路AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 裁员 22000 人转向 AI,赔偿 N+4

    据外媒报道,Meta 本轮裁员约涉及 8000 人,约占员工总数 10%,今年预计裁员将达 22000 人,赔偿方案为 N+4。裁员并非因经营困难,而是将资源从人力成本大规模转向 AI 基础设施投资,并重组约 7000 名员工至新成立的 AI 部门。

  4. Citrini ResearchAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Citrini Research:Meta 消费级智能体 Muse 或成智能体拐点

    Meta 消费级智能体 Muse 以每周 1 亿 token 免费额度上线,首日下载量超过 70 万并登上 App Store 榜首。Citrini Research 认为,Muse 的意义不在技术能力,而在于触达规模,标志着大众首次真正从消费级智能体中获益。该机构同时复盘其 2023 年 6 月提出的“AI 冲击”框架,认为由智能体消除摩擦带来的商业模式颠覆正在逐步被市场定价。

9月22日周二
  1. Jerry Liu(@jerryjliu0)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jerry Liu 推出 DocJev:比 gpt-5.6-luna 快 6 倍的文档分类与切分开源库

    Jerry Liu 发布开源库 DocJev,用于文档分类与切分,速度比 gpt-5.6-luna 快 6 倍且精度相当。用户只需给出文档和自然语言类别规则,Jev 即可预测文档类别或子文档边界,并支持 liteparse 与 LlamaParse 两种 OCR 后端。

  2. Thomas Wolf(@Thom_Wolf)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Thomas Wolf 列举 Dylan Patel 访谈以来的开源模型发布:Kimi K3、Qwen3.8-Max、DeepSeek V4-Pro 等

    Thomas Wolf 列出 Dylan Patel 访谈后约 10 周内的开源模型发布,包括 Thinking Machines Inkling、Moonshot Kimi K3、DeepSeek V4-Flash-0731 与 V4-Pro-0813、Qwen3.8-Max、Z.ai GLM-5.3、Meta Muse Spark 1.2 等。

  3. Aadit Sheth(@aaditsh)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 被亚马逊切断:互联网即将上演机器人持饼干互砍的混战

    亚马逊切断了对 Meta 旗下 Muse 的接入。在作者看来,各方都不愿在这一局里被商品化或沦为被叠加的一层,一场数字领域的"持饼干机器人互砍"混战即将开始。

  4. DeepLearning.AI(@DeepLearningAI)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepLearning.AI 解读 Meta Muse 智能体的系统级提示词注入防御

    DeepLearning.AI 分享对 Meta Muse 智能体的分析,指出提示词注入防御不应只依赖模型自身训练。Muse 假设模型会被骗,改在操作系统层构建安全机制:模型不接触真实凭证、工具运行在隔离的 Linux 容器中,并由独立把关程序验证对外调用。全文分析见原文链接。

9月21日周一
  1. Yann LeCun(@ylecun)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 否认曾要求停止 LLM 研发,称自己一直支持 Meta 的 LLM 工作

    Yann LeCun 公开否认曾"要求"停止 LLM 研发,称自己在 Meta 一直支持 LLM 工作,并列举 Galactica(2022 年 11 月)、OPT-175B 开源(2022 年 5 月)和 Llama 系列开源(2023 年中)为证。

  2. 乱翻书AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    拆解 Town、Instinct、Grok Bot 与 Meta Muse:AI 办公未散场,个人 Agent 战争已开始

    硅谷正围绕 Personal Agent 展开新一轮入口争夺,Town、Instinct、Grok Bot 和 Meta Muse 走出四条不同路线:Town 先做深邮箱,Instinct 取消独立 App 并把交代任务压缩成一条消息、进一步接管支付,Grok Bot 给每个人组一支 Bot 队伍,Muse 则靠免费、分发和专用虚拟机培养市场。

9月20日周日
  1. Yangyi(@Yangyixxxx)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Oppenheimer 预计 Meta 旗下 Muse 到 2027 年实现 280 亿美元 AI 智能体收入

    Oppenheimer 预计 Meta 旗下 Muse 到 2027 年将实现 280 亿美元 AI 智能体收入,来自 1.15 亿付费用户,转化率与 ChatGPT 相同均为 6%。该预测隐含 80% 的 Agentic AI 运营利润率,被认为高于 Meta 核心广告业务的盈利能力,引发对 Agentic AI 利润率合理性的质疑。

9月18日周五
  1. What's Next|科技早知道AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Snap 做了十年眼镜,终于等到它的时代了吗?|S10E30

    Snap 将 Spectacles 演进为 SPECS,售价 2195 美元,重量从上一代 226 克降至 132/136 克,FOV 提升到 51 度,并首次作为消费者产品出售。节目邀请现场体验者泽霖和 AR/XR 开发者脑潘,讨论 130 多克重量与高价为何仍让它离日常佩戴很远。话题延伸至苹果、Meta、Snap 各自技术路线下,下一代计算平台尚无「灯塔」的 XR 行业现状。

  2. 印记中文AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JavaScript 中文周刊 #253:函数式编程术语全景图与 React 19.3 发布

    React 19.3 正式发布,View Transitions 与 Fragment Refs 转为稳定,并加入 Trusted Types 支持。

9月16日周三
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google、Meta、Microsoft 竞逐语音识别头名,The Batch 解读对 AI 开发的影响

    语音识别领域的竞争正在升温,Google、Meta 和 Microsoft 正通过发布新的强力模型争夺头名位置。DeepLearning.AI 在 The Batch 中解读了这一趋势对 AI 开发者的意义,指出在生成式文本模型占据话题中心的当下,语音识别正迎来属于自己的时刻。

9月15日周二
  1. Yann LeCun(@ylecun)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:LLM 本身并非通向人类级 AI 的路径

    Yann LeCun 表示,基于 LLM 的 AI 工具虽然非常有用、人人都在用,但它们本身并不是通向人类级 AI 的路径。他指出,能够理解真实世界的架构并非 LLM,让当前 LLM 系统得以解读图像、视频等真实世界信号的架构组件也不属于 LLM。他同时提到有一场 1 小时的演讲,用结果和证据支撑上述结论。

  2. Amjad Masad(@amasad)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Brian Chau 称一家以色列 Effective Altruism 公司幕后策划 OpenAI、Anthropic 与 Meta 网络攻击

    Brian Chau 发推称,一家以色列 Effective Altruism 公司是 OpenAI、Anthropic 和 Meta 三起网络攻击的幕后推手,并称 @lumpenspace 参与协助。该推文附带长线程,获 278 次转发和 3984 次点赞。上述指控目前仅为该推文单方说法。

  3. AI Breakfast(@AiBreakfast)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mark Zuckerberg 称 AI 发展需要更快,呼吁支持 AI 与数据中心的周边产品

    Mark Zuckerberg 表示 AI 发展需要更快推进。相关讨论同时呼吁推出支持 AI 和数据中心的周边产品。

9月14日周一
  1. 夕小瑶科技说AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测5款国产世界模型:蚂蚁 LingBot-World 2.0、阿里 HappyOyster 1.0、腾讯混元 HY-World 2.1、爱诗 R1 与开源 Zing-0.5 各有什么能耐

    夕小瑶科技说实测了5款已开放体验的国产世界模型:蚂蚁 LingBot-World 2.0、阿里 HappyOyster 1.0、腾讯混元 HY-World 2.1、爱诗 R1 和 8月26日开源的 Zing-0.5,从漫游、导演、联合控制三类能力评估输入还原度、运动一致性、物理合理性与导演表现。

9月13日周日
  1. Yann LeCun(@ylecun)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 评论 AI 模型"逃逸":或源于严重疏忽与刻意为之

    Yann LeCun 认同 @kchonyc 的观点,称 AI 模型的"逃逸"要么源于严重疏忽,要么是刻意为之,并列举了营销、对监管俘获的错误期待等可能动机。该帖获 4050 次点赞、539 次转发、158 条回复,浏览量约 48.9 万。

9月12日周六
  1. Paul Couvert(@itsPaulAi)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 被称为目前最佳智能体实现

    Meta 的 Muse 被评价为目前最佳的智能体实现,特点是操作极其简单、直观且功能强大,并且免费。该内容来自 Paul Couvert 的推文,未披露具体模型参数或评测数据。

  2. SemiAnalysisAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nvidia 的兜底宇宙:我赢,输的是谁?

    Nvidia 在 10-Q 中披露的资产负债表外担保总额已达 530B 美元,较上季度的 184B 大幅跳升。增量主要来自三项:供应与产能承诺从 119B 升至 279B(以内存为主),担保从 3.5B 升至 108.5B(涉及 SB Energy 在俄亥俄州的 4.25 GW 园区,租给 OpenAI 二十年),并首次出现 36B 的 AI 云协议和 20B 的数据中心租约。

9月11日周五
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 时代工程师技能变革:GPT-6 Astra、Claude Fable 5.1 等本周要点

    OpenAI 发布 GPT-6 Astra,支持 1M+ 输入 token 和 5 档推理级别;Anthropic 更新 Claude Fable 5.1,在 Artificial Analysis Intelligence Index v4.3 上并列最高分,放宽网络安全任务限制并减少冗余输出。

  2. Aadit Sheth(@aaditsh)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Alex Heath 追问扎克伯格为何重回 X 发帖

    Alex Heath 就扎克伯格为何再次在 X 上发帖向其提问,相关内容附有视频。该帖获得 4 条回复、1 次转发、67 个点赞和 27788 次浏览,标题称 "Nobody uses Threads"。