跳到正文

#现象/趋势

今日 115 条
10月7日周三
  1. 向阳乔木(@vista8)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    硅谷很火的 instinct 体验与 WhatsApp 注册

    体验了硅谷很火的 instinct,并顺带注册了一个新 WhatsApp 账号,去年办的香港卡都派上了用途。建议有机会都办一张香港卡,体验一国两制的便利,虽然现在限制已经很多。

  2. Notion(@NotionHQ)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nat Eliason 的 Bot 系统:15 项自动化能力覆盖邮件、会议与编程智能体

    Nat Eliason 分享了其 @bot 系统的 15 项能力:一个"Chief of Staff"机器人每天从邮件和任务中梳理待办并给出建议,每约 2 小时扫描邮件自动起草回复。系统还包含按课程、工程、招聘等分工的专项机器人、云编码智能体(接手 Linear issue 并提 PR),以及基于 Notion 和 GitHub 持续更新的可分享知识库。

  3. Simon Willison(@simonw)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 如何"知道"《猴岛小英雄》的音乐?

    Simon Willison 提出疑问:Claude 为何能"知道"《Secret of Monkey Island》的音乐是什么样。他猜测 Anthropic 可能爬取了大量包含经典游戏音乐文字版描述的网络音乐讨论论坛。

  4. Thomas Wolf(@Thom_Wolf)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本·阿弗莱克自曝会写 Python、懂卷积神经网络,并借名人身份探访 Google 和 OpenAI 视频模型

    本·阿弗莱克称自己会写 Python 脚本,理解卷积神经网络、张量与 GPU 工作流程,并曾经营一家小型视觉特效公司。他还说自己凭借名人身份直接联系,得以私下参观 Google 和 OpenAI 在视频 Transformer 上的研究。

  5. Akshay Kothari(@akothari)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Akshay Kothari:直觉让我们在连点成线前先看懂全貌

    Akshay Kothari 提出,直觉能让人在把所有线索连接起来之前就先把握整体图景。该帖获 563 次点赞、34 条回复和 30269 次浏览,由 xgo.ing 提供数据支持。

  6. Gary Marcus(@GaryMarcus)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 与 Ed Zitron 等四人对话讨论「AI 泡沫」

    Gary Marcus 与 Ed Zitron、JG_Nuke、gnoble79 及 Julien 进行了长达一个半小时的对话,主题是「AI 泡沫」,相关内容已在 YouTube 发布。

  7. a16z(@a16z)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 跻身消费级 AI 应用支出榜前 10,流量却排在后 5 位

    a16z 分享的 Top 50 消费级 AI 应用收入榜单显示,Replit 按支出位列前 10,按流量却排在后 5 位。流量与收入呈现两套完全不同的排序,反映出 AI 重度用户的付费集中在轻度用户不活跃的地方。完整榜单由 @omooretweets 发布在 Cosign 上。

  8. a16z(@a16z)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z:AI 支出前 1% 用户在为什么付费?构建、自动化和交付工具

    a16z 数据显示,AI 支出前 1% 的用户平均每月花费 903 美元,而中位数用户仅 25 美元,前者总支出已超过后 50% 用户之和。相比平均支出者,他们为 n8n 付费的可能性高 23 倍,为 fal 和 Manus 高 18 倍,为 Higgsfield 高 15 倍,偏好构建、自动化和交付类工具。

  9. Sahil Lavingia(@shl)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如果 IRS 推出 MCP,你会用吗?

    Sahil Lavingia 发问:如果 IRS(美国国税局)推出 MCP,你会不会用?该帖获得 48 条回复、35 个点赞和 14151 次浏览,由 xgo.ing 提供数据支持。

  10. Justin Welsh(@thejustinwelsh)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Justin Welsh 每周六撰写关于收入、时间自主与工作平衡的短文

    Justin Welsh 每周六发布一篇短文,分享他在"获得良好收入、掌控自己的时间、不把最好的年华牺牲给工作"方面的经验,该订阅已拥有 200,000+ 读者。订阅地址为 justinwelsh.me/subscribe。

  11. elvis(@omarsar0)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用好 eval 构建能力,就能快速站上领域前沿

    有观点指出,如果能在现有模型之上构建出好的 eval,就能迅速在所属领域或任务上站到前沿,这正是 eval 能带来的优势。Garry Tan 此前表示,如今可以借助智能体编写 markdown 技能并挂到 cron job 上,几乎完成所有有用的知识工作类型。

  12. Julien Chaumond(@julien_c)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Beff(e/acc)回应欧洲朋友:我们终于回来了

    e/acc 支持者 Beff 发推称,今天给欧洲的朋友发消息,"就像他们赢了超级碗一样"。该推文引用了另一条推文,获 129 个点赞和 12136 次浏览。

  13. Lenny Rachitsky(@lennysan)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    团队用 AI「模拟」快速测试产品创意与流程调整

    有团队正用 AI「模拟」快速测试产品创意和流程调整,涉及 simile_ai、primitivelabsai、syntheticusers、trytenera.ai、Seldon.com 等产品。发帖者询问尝试过这类做法的人效果如何。

  14. Amjad Masad(@amasad)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Patrick Collison:下一个 Stripe 不在 AI 实验室,而在陈旧垂直软件

    Patrick Collison 被问及从头创业会做什么时,直接指向医疗、物流、建筑、金融等仍跑在 1990 年代基础设施上的传统垂直软件,而非 AI 实验室。他认为最具防御力的生意往往来自别人觉得无聊不愿碰的领域,并质疑硅谷是否正错过软件业当前最大的机会。

  15. a16z(@a16z)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z:Apple、AWS、Microsoft、Google 等 21 家软件巨头月均严重漏洞报告量从不足 100 升至 600+

    a16z 指出,Apple、AWS、Microsoft、Google 等 21 家主要软件公司过去四年每月报告的严重漏洞从未突破 100 个,但自今年春季以来已升至每月超过 600 个。该数据反映网络安全披露压力正快速上升。

  16. Gary Marcus(@GaryMarcus)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 追问:一个“好用的工具”值得冒 10% 灾难风险吗?

    Gary Marcus 以“一个‘好用的工具’是否值得冒 10% 灾难风险”发问,回应 Mark C. Massey 关于 Claude 的评论。Massey 称自己用 Claude 做出过一些有趣的东西,认为它是个好工具,但并非不可或缺,如果消失生活也会回归正常。

  17. Stack Overflow BlogAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 2026 开发者调查:AI 编程助手每日使用率压倒性,但信任问题依旧

    Stack Overflow 2026 年度开发者调查显示,AI 编程助手每日使用率呈压倒性态势,但开发者对其信任问题仍存。结构良好的文档被视为提供可验证上下文、缓解模型幻觉的关键,同时开发者正从主动社区发帖转向被动知识消费。

  18. Genspark(@genspark_ai)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark COO 桑文:企业 AI 需要前沿与低阶模型并存

    Genspark 联合创始人兼 COO 桑文在 NYSE 访谈中表示,AI 正在改变企业工作流与日常决策,前沿模型与低阶模型各有其作用,模型多样性是关键,并强调可及性的重要。

  19. Gary Marcus(@GaryMarcus)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 称其对 AI 的悲观预测已成真

    Gary Marcus 表示自己此前的"黑暗预测"又如期应验,并附上《纽约时报》2026 年 10 月 6 日的一篇报道链接。他未在推文中展开具体所指的预测内容或事件细节。

  20. elvis(@omarsar0)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 的一致性特性可用于构建智能体工作流的可靠评审器

    作者称 Jev 的一个有趣之处是其一致性(consistent property),这对为智能体工作流构建可靠的评审器很有用。目前作者正在做一个小型 benchmark,以更广泛地测试这一点,并与其他决策 API 进行比较,更多内容将很快公布。

  21. Replit ⠕(@Replit)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit Pro Series:如何打造病毒式增长引擎

    Replit 推出 Pro Series 新一期,主题为"打造病毒式增长引擎",并以直播形式发布。该内容在 X 上获得 33 次点赞、4 次转发与 6088 次浏览。

10月6日周二
  1. Simon Willison(@simonw)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 惊讶于 Opus 5.5 能作曲:让其为游戏配乐效果远超预期

    Simon Willison 让 Opus 5.5「写一些电脑游戏音乐」,结果远超预期,并由此发问模型是从何时开始能创作合格音乐的。

  2. Interconnects AI — Nathan LambertAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么"开源模型危险、闭源模型安全"的网络安全叙事是错的

    Anthropic 发布报告称 GLM-5.3 可作攻击性网络工具,Nathan Lambert 认为这类讨论回避了"禁用开源模型会怎样"等关键问题。他指出,迄今已记录的多数网络攻击由闭源模型导致,若因网络风险禁用开源权重模型,或许也应禁止前沿闭源模型的公开 API。

  3. 掘金本周最热AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    古代没有程序员,但蒲松龄们早就被"裁员"过了

    一位写了近十年代码的程序员在 AI 写代码、招聘卡 35 岁、大厂裁员的夹击下翻检古籍,把被时代冲击的人归纳为三种结局:卢德分子砸织机、《机动车法案》用红旗拦汽车,两拨人最终都失败;镖局倒闭后镖师转型当警察教官、富商护卫,VisiCalc 问世后记账员变成看数据的人;蒲松龄 71 岁才得贡生功名却写出《聊斋志异》,王阳明 34 岁被贬龙场后开创心学。

  4. Stack Overflow BlogAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 2026 开发者调查结果公布:Claude Code 成最常用编码智能体

    Stack Overflow 第 16 届开发者调查公布,超 3 万人参与,Claude Code(66%)和 GitHub Copilot(59%)是开发者最常用的编码智能体。Anthropic 与 OpenAI 的模型使用率并驾齐驱,Google 位列第三,但更多受访者愿意继续使用 Anthropic 模型。62% 的受访者对 AI 持正面看法,日活用户中这一比例升至 71%。

  5. 笔记侠AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    万维钢:未来几年,人只剩两件事可干

    万维钢在笔记侠PPE课程硅谷分享中提出,AI用法已历四轮演变,从生成内容到Claude Code、Codex直接操作本地文件,再到完成抽象任务,如今进入全天候个人助手阶段,他建议同时使用多个Agent、每件事配一个。

  6. Guillermo Rauch(@rauchg)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Guillermo Rauch:按这速度,AI 会先让我们玩上 GTA 7 再等到 GTA 6

    Vercel CEO Guillermo Rauch 发帖调侃:"按这速度,AI 会先让我们玩上 GTA 7,再等到 GTA 6。"该帖获 7295 次点赞、291 次转发、304 条回复,浏览量超 21 万。

  7. 掘金本周最热AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 时代,我们都将成为通才型开发者:只懂 Android 已经不够了

    Philipp Lackner 提出,AI 时代开发者将从单一领域专家转向 "Generalist with Expertise",即 T 型开发者:在一个领域保持深度,同时理解 Backend、AI、Cloud 等上下游。AI 降低了进入新领域的成本,但不替代真实项目经验,开发者的价值正从写代码上移到理解问题、选择工具、设计系统和解决真实问题。

  8. 向阳乔木(@vista8)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Claude Code Mod 实现隐私插件:资料进 LLM 前先做替换

    有人提出用 Claude Code Mod 实现一个隐私插件,在资料信息进入 LLM 前先做替换,并设想进一步把中文对话翻译成英文,以尽可能隐藏中国人身份。相关内容附带开源插件链接,发布者感慨 Anthropic 把大家都弄魔怔了。

  9. Anton Osika – eu/acc(@antonosika)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anton Osika 谈 2026 年如何创办公司

    Anton Osika 就"2026 年如何创办公司"发声,该帖获 2676 次点赞、208 次转发、106 条回复,浏览量达 181013。

  10. Viking(@vikingmute)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 频繁提示 Selected model is at capacity,用户讨论如何检查账号是否被风控

    有用户反映 ChatGPT 多次对话后出现 "Selected model is at capacity" 提示,等待时间翻倍,部分 case 还会从 sol 直接切换到 luna;该提示最近一小时未再出现,使用较为流畅。用户称自己的号已用很久且未使用第三方,仍不确定风控原因,并询问如何检查账号是否被风控,同时表示想念 Opus 5.5、只能从 Cursor 上使用。

  11. AI寒武纪AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 实测:200 美元档 Claude 的 API 等价 Token 价值约为 ChatGPT 的 5 倍

    SemiAnalysis 对 Anthropic、OpenAI、Meta、MiniMax、月之暗面、智谱等厂商的订阅套餐做极限压力测试,结论是同等月费下 Anthropic 给用户的 Token 实际价值是 OpenAI 的 5 倍以上。

  12. Viking(@vikingmute)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用户吐槽 ChatGPT 频繁提示 Selected model is at capacity,sol 到 luna 切换也崩了

    有用户反映 ChatGPT 最近体验急剧下滑:几次对话就出现 "Selected model is at capacity",等待时间翻倍,部分 case 还会从 sol 直接切换到 luna。

  13. 小互(@imxiaohu)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 订阅制被指赔本:Claude 会员占 40% 算力却只贡献 10% 收入

    据 SemiAnalysis 分析,Anthropic 的 Claude 会员订阅收入仅占总收入约 10%,但订阅用户消耗的推理算力超过 40%,明显拉低每兆瓦算力产生的收入。这意味着 20 美元或 200 美元的月费会员实际上由科技巨头大幅补贴。

  14. David Heinemeier HanssonAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHH:别再手写代码了,编程智能体时代已到来

    Rails 创始人 DHH 在 Rails World 上呼吁程序员放下铅笔,不再手写绝大部分代码,因为编程智能体已经足够强大,继续手写 Ruby、Rust、C++ 在经济上已不可行。现场调查显示,只有少数人每周仍大量手写代码。他认为 AI 更像新同事而非工具,拒绝协作的人才会被淘汰。

  15. andrew chen(@andrewchen)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智能体有网络效应吗?Muse、Town、Instinct、Grokbot 等消费级智能体新浪潮引发 AI 创业公司生存拷问

    一批通用消费级智能体——Muse、Town、Instinct、Grokbot 等——正把 Openclaw/Hermes 的能力包装成打磨完善、安全友好的消费体验,迫使数千家垂直领域 AI 创业公司重新审视自身定位。

  16. 新智元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 联创 Christian Szegedy 长文《数学何去何从?》:AI 让数学「毕业」,两千年英雄攀登史落幕

    xAI 联合创始人 Christian Szegedy 发长文《数学何去何从?》,宣告数学的「英雄探险时代」结束,AI 这架「飞机」已把旗插上无人登顶的山峰。

  17. Gary Marcus(@GaryMarcus)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 IPO 会建立在它最好的季度还是现实之上?

    Gary Marcus 质疑 Anthropic 的 IPO 是否建立在其最佳季度表现之上。据 The Information,Microsoft 已将内部 Claude 支出削减超过三分之一,Meta 的 Claude Code 用户数也已减半;Microsoft 此前为 Copilot 功能每年在 Anthropic 模型上的支出预计至少 20 亿美元。

  18. 十字路口CrossingAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    他们的新工作,是教 AI 取代自己:AI 训练数据供应链里的劳动者

    Mercor 等数据公司正以时薪低至 45 美元起的零工,雇人编写评分细则、标准答案和推理轨迹来训练 AI,部分项目任务量骤减、时薪下调 8 美元,劳动者还被 Insightful 软件逐秒监控。Mercor 由三名 19 岁创始人于 2023 年创办,去年估值达 100 亿美元,每周约 3 万名专业人士在其平台工作,OpenAI 和 Anthropic 都曾是客户。

  19. 硅星人ProAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一群计划"逃离"湾区的Anthropic研究员:AI末日论者的避难所与40%接管概率

    一些Anthropic研究员正考虑在美国偏远地区买地,作为AI失控后的避难选项。Anthropic前研究员Jacob Coxon今年9月初辞职,称构建AI的人"真诚地相信它可能在2030年前杀死我们所有人",该帖获1.74亿次浏览。