跳到正文

#Meta

今日 3 条
今天10月10日周六
  1. 国际大厂AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    田渊栋:与 GPT-5 合写最后一篇论文后,我意识到自己 5 年内会失业

    田渊栋在播客中透露,他在 Meta 的最后一篇论文以 GPT-5 作为合作者完成,效率提升约 6 到 10 倍,这让他意识到自己的工作大概五年内会被取代,于是联合创办 Recursive Superintelligence,该公司以 46.5 亿美元估值完成超 6.5 亿美元融资。他认为当前模型仍需人类发起问题和验证方案,最难自动化的是提出想法,而递归自我改进的监管边界本身就模糊。

  2. 硅星人ProAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苹果发布会为何不再是“科技春晚”:AI 大会也还没接住这个位置

    苹果发布会正逐渐失去“科技春晚”的光环:供应链爆料让新品提前曝光,2020 年后转为提前录制,智能手机进入成熟期后创新更多体现为性能与体验优化。与此同时注意力转向 AI 发布会,2024 年 5 月 OpenAI 发布 GPT-4o、DeepSeek R1 发布都引发大范围讨论。

  3. 腾讯科技AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苹果发布会的光环为何褪去:AI 开发者大会接棒“科技春晚”

    苹果发布会的“科技春晚”地位正在消退,OpenAI、Google、Anthropic 等 AI 开发者大会成为新的关注中心。2026 年 9 月 OpenAI DevDay 发布二十多项更新,重点推出可长期运行的个人 Agent Dots,并新增每月 500 美元会员档位、调整 GPT-6.1 Sol 价格体系,但新能力增量有限、悬念减弱。

10月9日周五
  1. 知行小酒馆AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    知行小酒馆 E253:AI 会改变世界,可它真的有让世界变好吗?

    知行小酒馆第 253 期邀请益盒 CharityBox 联合创始人治霖,讨论 AI 是否真正改善了弱势群体的生活。节目引用数据显示,截至 2026 年第一季度全球劳动年龄人口 AI 使用率为 17.8%,仍有 6.55 亿人缺乏电力;2026 年美国四大科技企业在 AI 领域投入预计超过 6500 亿美元,而将全球贫困率降至 1% 每年需 3040 亿美元。

  2. 国际大厂AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Alexandr Wang:别指望 Meta 的 Muse 能神奇地帮你赚到 1 万美元

    Meta 首席 AI 官 Alexandr Wang 表示,不要指望 Muse 能神奇地帮用户赚到 1 万美元,公司希望继续改进 Muse 的记忆能力。

10月8日周四
  1. 笔记侠AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前亚马逊搜索广告成员:AI 正把购物从流量为王推向意图为王,亚马逊已上线 7 款 AI 购物功能

    前亚马逊搜索广告成员在笔记侠 PPE 课程美国站分享中指出,AI 正让购物从"流量为王"转向"意图为王":消费者不必先想好搜索词,只需描述需求,购物研究、比较、决策逐步由 AI 接手,消费者从决策者变成推荐的批准者。

  2. Yann LeCun(@ylecun)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 反驳"所有 AI 都是垃圾"论:医学影像、防撞、反诈与无障碍也在其中

    Yann LeCun 公开反驳"所有形式的 AI 都是垃圾"的说法,列举 AI 在乳腺 X 光检查中筛查肿瘤、道路障碍物检测并将碰撞减少 40%、过滤邮件与社交平台上的垃圾信息和诈骗、识别外国干预民主进程的企图、帮助视障者听取视觉环境描述、以及机器翻译连接不同文化等用途。他称不应把孩子和洗澡水一起倒掉。

  3. 极客公园AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测 Today AI 十天:国产个人 AI 助手能做什么、卡在哪

    作者用十天体验 Teambition 创始人齐俊元打造的 Today AI,其国内版于 9 月 24 日上线,已接入飞书、钉钉、腾讯文档和邮箱;绑定微信后可直接在微信里发语音、图片和文件与它交互。

  4. Ben Thompson - 科技分析师和评论员AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前 Facebook 全球选举负责人 Katie Harbath 谈《Disrupting Politics》与 Facebook 2010 年代的转变

    前 Facebook 全球选举负责人 Katie Harbath 接受访谈,谈其新书《Disrupting Politics》,以及 Facebook 在 2010 年代经历的变化。访谈围绕她在该公司任职期间的经历展开。

  5. AI科技大本营AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    奥特曼《名利场》专访:证实 OpenAI 曾单方面叫停前沿模型训练

    在《名利场》专访中,OpenAI 首席执行官 Sam Altman 证实公司近期主动叫停了一项前沿模型训练任务,原因是能力跃升速度超过了安全对齐、可监控性与可解释性的进展。

  6. 有机大橘子AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Personal Agent 大战:OpenAI Dots、Meta Muse、Instinct 各自走到了哪一步

    OpenAI 在 DevDay 发布的 Dots 回到 ChatGPT 式聊天形态,但存在记忆不共享、语音聊天要响两声才接、云电脑完全不开放等缺口;Meta 的 Muse 则提供 SDK 和适配 ESP32 的 AgentReady 通用固件,可直刷设备。

10月7日周三
  1. 笔记侠AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前亚马逊 Rufus 创始成员:5年后手机购物 App 会消失

    前亚马逊 Rufus 项目创始成员判断,5年后手机上的购物 App 会消失,入口交给能自己完成搜索、比较、下单的购物 Agent。亚马逊 Rufus 2023 年启动时仅七八人、约两个月做出演示版本,团队后扩至数百人;其公式为 Agent = 强模型 + 上下文 + 多步执行。

10月6日周二
  1. Gary Marcus(@GaryMarcus)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 IPO 会建立在它最好的季度还是现实之上?

    Gary Marcus 质疑 Anthropic 的 IPO 是否建立在其最佳季度表现之上。据 The Information,Microsoft 已将内部 Claude 支出削减超过三分之一,Meta 的 Claude Code 用户数也已减半;Microsoft 此前为 Copilot 功能每年在 Anthropic 模型上的支出预计至少 20 亿美元。

  2. 数字生命卡兹克AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    聊聊 A16Z 两份 AI 报告,以及一些反常识的真相

    作者卡兹克解读 A16Z 第七版《Top 100 消费级 AI 应用》与 9 月底更新的《市场状况 II》两份报告,整理出其中的反常识数据。

10月4日周日
  1. 掘金本周最热AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Muse 登顶 App Store 第一并开源 Muse Gadget SDK,AI Agent 开始进入下一个阶段

    Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。

  2. Yann LeCun(@ylecun)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:AI 进展让系统神经科学更有意思,物理直觉与世界模型仍是短板

    Yann LeCun 认为 AI 的进展反而让系统神经科学变得更有意思,因为当前 AI 在物理直觉、常识、世界模型、规划/推理、动机/驱动力和情感等方面都还没有特别好的解法。他表示,现在我们或许已经拥有实现并检验认知架构的工具。

  3. 有机大橘子AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    深入讨论 Muse:最火的 Personal Agent

    播客 Next Token 第四期讨论 Meta 的 Personal Agent 产品 Muse,认为它把云端电脑和易用性结合,让 Agent 从小众极客走向大众。

10月3日周六
  1. 跨国串门儿计划AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ben Thompson 谈 Apps、Agents 与聚合:AI Agent 会成为你办事的唯一界面

    Ben Thompson 在 Stratechery 播客中提出,AI Agent 要真正普及,除了模型还需要一台自己的电脑,Meta 发布 Muse 时就为用户配置了虚拟机。

  2. Yann LeCun(@ylecun)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:两年过去,我们离人类级 AI 仍然很远

    Yann LeCun 指出,两年过去人类级 AI 依然遥远:AI 虽在数学、编程和已知答案问答等任务上超越人类,但 Level-5 自动驾驶、能像 17 岁少年练 20 小时就学会开车的系统、以及能完成 8 岁儿童任务的家用机器人都还不存在。他强调 AI 仍难以应对物理世界的复杂与混乱,并指出 Tesla FSD 仅为 Level 2、Waymo 为 Level 4。

10月2日周五
  1. Latent.Space(@latentspacepod)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Airbnb CTO Ahmad Al-Dahle 谈 Inside-Out AI:先改内部流程,再改客户体验

    曾负责 Meta Llama 系列模型的 Airbnb CTO Ahmad Al-Dahle 正在实践"Inside-Out AI"思路,即先改变公司内部运作方式,再影响客户体验。其内部工具 Everest 已帮助加快一次产品发布。相关内容发布于 Latent.Space。

  2. Yann LeCun(@ylecun)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:能微调 LLM 回答物理世界问题,不等于具备 6 岁儿童的物理直觉

    Yann LeCun 在 X 上发问:"我的家用机器人在哪?我的 L5 自动驾驶汽车在哪?"他指出,可以把 LLM 微调成能回答任何物理世界问题的模型,但这并不意味着它拥有足够的理解力和物理直觉,去预测一个 6 岁儿童就能预测的事情。

10月1日周四
  1. 晚点LatePostAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    晚点 AI 季报:Meta Muse 与 OpenAI Dots 引爆个人助理,GPT-6 Astra 展现物理 AI 潜力

    OpenAI 在 DevDay 发布个人助手 Dots,Meta 的 Muse 则于 9 月 8 日上线并在 16 天内突破 340 万下载,引爆个人助理热潮。OpenAI 的 GPT-6 Astra 在 OSWorld 2.0 上从 65% 升至 72%,任务耗时缩短 47%。OpenAI 的 ARR 在 1 个半月内从超 400 亿美元涨至近 700 亿美元,涨幅约 70%。

9月30日周三
  1. 晚点LatePostAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从编程到个人助理:更强大的 AI,更透明的你

    晚点LatePost 梳理了 AI 编程工具与个人助理带来的数据隐私风险:智谱 ZCode 因代码库索引功能默认打包上传项目数据致歉并删除数据、补偿 Token,xAI 的 Grok Build 也曾上传约 5.48GB 项目文件且未脱敏。

  2. 跨国串门儿计划AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扎克伯格的优势:不领先,也不肯停下来

    Colossus 撰稿人 Jeremy Stern 为扎克伯格撰写人物特写,采访了 36 位相关人士。文章讲述 Llama 4 发布后扎克伯格重组 AI 团队、成立 Meta Superintelligence Labs 并大幅增加投入,以及 Meta 押注 AI 眼镜、试图用广告收入和数据中心把 AI 推给数十亿现有用户的路径。

  3. 深思圈AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 深度对话:personal agent 的正确打开方式是什么

    a16z General Partner Anish Acharya 与 Assistant Benchmark 创始人 David Pawlan 在播客中讨论 personal AI agent:David 追踪到 122 个同类产品并亲自测试 26 个,他认为 proactivity(主动性)才是真正的护城河,而非功能多少或底层模型。

9月29日周二
  1. 人民公园说AIAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扎克用 Muse 踹开美国互联网大门:Meta 的个人 Agent 怎么就火了?

    Meta 的 Muse 在美国爆火,被解读为扎克伯格借个人 Agent 重做一次"微信"。这期讨论认为美国互联网越碎片化 Muse 越有价值,扎克第一个要踹的是 Amazon 的门,并追问它能否靠"百亿补贴"做成 Agent 版拼多多。

9月26日周六
  1. Yann LeCun(@ylecun)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 回顾 Galactica:Meta 1200 亿参数科学写作 LLM 遭围攻下架,三周后 ChatGPT 却受追捧

    Yann LeCun 重提 2022 年 10 月 Meta-FAIR 开源的 120b 参数 LLM 系统 Galactica,它用于帮助科研人员写论文,却因被指危险、有毒并会毁掉科学而遭围攻,团队被迫下线演示网站,仅保留 GitHub 和论文。他称三周后 ChatGPT 发布却被奉为救世主,当初发难者则陷入沉默。

9月25日周五
  1. Justine Moore(@venturetwins)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Zuck 收购消费级团队与产品的 N=1 天赋:IG、WhatsApp 与 Muse

    Zuck 在收购消费级团队与产品方面堪称 N=1 天赋,IG 和 WhatsApp 都是传奇收购,Muse 在 Alexandr 与 Nat 带领下开局强劲,预计前三周 DAU 将突破 100 万,并已连续 7 天位居 App Store 榜首。

9月24日周四
  1. AI Engineer(@aiDotEngineer)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sarvam 文档模型处理 13 万亿 token 文本,上线四个月数字化 3500 万页

    前沿模型所学习的网页抓取数据中,印度语言内容占比远低于 1%;Sarvam 的文档模型在见到第一张图像前已读取 13 万亿 token 文本,上线四个月即数字化 3500 万页。Perceptron AI 用模型自主决定读取哪些 token,以应对一小时视频约百万视觉 token 中仅约 2% 有真值标注的问题。Meta 则在其三智能体审核流程中过滤大部分视频,压缩相似帧并对热门视频缓存判定结果。

9月23日周三
  1. 乌鸦智能说AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    中国没跑通的 AI 助理,为什么在美国突然爆了?

    Meta 的 Muse 上线 12 天总安装量接近 280 万,美国移动端日活 64.2 万,冲上美国 App Store 免费榜第一,同期下载量超过 ChatGPT。

  2. Citrini ResearchAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Citrini Research:Meta 消费级智能体 Muse 或成智能体拐点

    Meta 消费级智能体 Muse 以每周 1 亿 token 免费额度上线,首日下载量超过 70 万并登上 App Store 榜首。Citrini Research 认为,Muse 的意义不在技术能力,而在于触达规模,标志着大众首次真正从消费级智能体中获益。该机构同时复盘其 2023 年 6 月提出的“AI 冲击”框架,认为由智能体消除摩擦带来的商业模式颠覆正在逐步被市场定价。

9月22日周二
  1. Aadit Sheth(@aaditsh)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 被亚马逊切断:互联网即将上演机器人持饼干互砍的混战

    亚马逊切断了对 Meta 旗下 Muse 的接入。在作者看来,各方都不愿在这一局里被商品化或沦为被叠加的一层,一场数字领域的"持饼干机器人互砍"混战即将开始。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepLearning.AI 解读 Meta Muse 智能体的系统级提示词注入防御

    DeepLearning.AI 分享对 Meta Muse 智能体的分析,指出提示词注入防御不应只依赖模型自身训练。Muse 假设模型会被骗,改在操作系统层构建安全机制:模型不接触真实凭证、工具运行在隔离的 Linux 容器中,并由独立把关程序验证对外调用。全文分析见原文链接。

9月21日周一
  1. Yann LeCun(@ylecun)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 否认曾要求停止 LLM 研发,称自己一直支持 Meta 的 LLM 工作

    Yann LeCun 公开否认曾"要求"停止 LLM 研发,称自己在 Meta 一直支持 LLM 工作,并列举 Galactica(2022 年 11 月)、OPT-175B 开源(2022 年 5 月)和 Llama 系列开源(2023 年中)为证。

  2. 乱翻书AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    拆解 Town、Instinct、Grok Bot 与 Meta Muse:AI 办公未散场,个人 Agent 战争已开始

    硅谷正围绕 Personal Agent 展开新一轮入口争夺,Town、Instinct、Grok Bot 和 Meta Muse 走出四条不同路线:Town 先做深邮箱,Instinct 取消独立 App 并把交代任务压缩成一条消息、进一步接管支付,Grok Bot 给每个人组一支 Bot 队伍,Muse 则靠免费、分发和专用虚拟机培养市场。

9月18日周五
  1. What's Next|科技早知道AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Snap 做了十年眼镜,终于等到它的时代了吗?|S10E30

    Snap 将 Spectacles 演进为 SPECS,售价 2195 美元,重量从上一代 226 克降至 132/136 克,FOV 提升到 51 度,并首次作为消费者产品出售。节目邀请现场体验者泽霖和 AR/XR 开发者脑潘,讨论 130 多克重量与高价为何仍让它离日常佩戴很远。话题延伸至苹果、Meta、Snap 各自技术路线下,下一代计算平台尚无「灯塔」的 XR 行业现状。

9月15日周二
  1. Yann LeCun(@ylecun)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:LLM 本身并非通向人类级 AI 的路径

    Yann LeCun 表示,基于 LLM 的 AI 工具虽然非常有用、人人都在用,但它们本身并不是通向人类级 AI 的路径。他指出,能够理解真实世界的架构并非 LLM,让当前 LLM 系统得以解读图像、视频等真实世界信号的架构组件也不属于 LLM。他同时提到有一场 1 小时的演讲,用结果和证据支撑上述结论。

  2. AI Breakfast(@AiBreakfast)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mark Zuckerberg 称 AI 发展需要更快,呼吁支持 AI 与数据中心的周边产品

    Mark Zuckerberg 表示 AI 发展需要更快推进。相关讨论同时呼吁推出支持 AI 和数据中心的周边产品。

9月13日周日
  1. Yann LeCun(@ylecun)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 评论 AI 模型"逃逸":或源于严重疏忽与刻意为之

    Yann LeCun 认同 @kchonyc 的观点,称 AI 模型的"逃逸"要么源于严重疏忽,要么是刻意为之,并列举了营销、对监管俘获的错误期待等可能动机。该帖获 4050 次点赞、539 次转发、158 条回复,浏览量约 48.9 万。

9月12日周六
  1. Paul Couvert(@itsPaulAi)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 被称为目前最佳智能体实现

    Meta 的 Muse 被评价为目前最佳的智能体实现,特点是操作极其简单、直观且功能强大,并且免费。该内容来自 Paul Couvert 的推文,未披露具体模型参数或评测数据。