跳到正文

#Anthropic

今日 74 条
10月7日周三
  1. Vercel NewsAI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel AI Gateway 上线 Claude Haiku 5.5

    Vercel AI Gateway 现已上线 Anthropic 的 Claude Haiku 5.5,这一版本面向摘要、上下文压缩、数据库查询和分类等高频、成本敏感任务,也可作为子智能体配合更大的 Claude 模型处理编码工作。

  2. Epoch AIAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI 发布 InnovationEval:AI 能自动完成 AI 研发吗?

    Epoch AI 发布 InnovationEval 评测,用一篇已发表的在线策略自蒸馏(SDPO)论文作基准,测试 AI 能否独立提出有同等效果的新后训练算法。

  3. Simon Willison(@simonw)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 如何"知道"《猴岛小英雄》配乐是什么声音?

    Simon Willison 好奇 Claude 为何"知道"《猴岛小英雄》配乐听起来是什么样,并猜测 Anthropic 可能爬取了大量包含经典游戏音乐文字版描述的在线音乐讨论论坛。

  4. AI寒武纪AI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 推出扩展版网络验证计划,向认证用户开放 Claude 攻防能力

    Anthropic 正式推出扩展版网络验证计划,将 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Mythos 5.1 的网络安全攻防能力按防御、红队、特种三档权限开放给经过认证的机构。

    为什么值得看

    Anthropic 把网络安全能力按防御、红队、特种三档分级开放,并给出封锁解除前后的实测对比数据。

  5. 宝玉(@dotey)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    prompt-motion.com 收录 226 个 Claude Opus 5.5 动画视频案例与 Prompt

    有用户搭建了 prompt-motion.com,收集用 Claude Opus 5.5 制作的动效作品,每个案例旁附上生成它的 Prompt 或 Skill,目前已有 226 个,全部来自 X 上的帖子并标注原作者,多数 Prompt 可以直接运行。宝玉转发了这一网站,并提到大多数案例带有可运行的 Prompt 和对应的 X 链接。

  6. 宝玉(@dotey)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Boris Cherny 谈如何给 Claude 写提示词:给目标、定投入、说验证

    Claude Code 作者 Boris Cherny 表示,给 Claude 写提示词没有秘密,像对同事说话一样即可,大多数任务不必过度铺垫或规定步骤,给出目标模型会自己想办法。他认为在 Sonnet 3.5 时代提示词影响很大,如今更关键的是说清三件事:想让它做什么、希望投入多少精力、以及它该如何验证自己做对了。

  7. Claude(@claudeai)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 对话 Dan Shipper 与 Willie Williams:他们如何打造该产品

    Claude 官方账号分享了一段与 @danshipper 和 Willie Williams 的完整对话,主题是两人如何把它做出来。原文未披露该产品的具体名称、功能或参数,仅给出 YouTube 视频链接。

  8. Claude(@claudeai)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Every 团队基于 Claude Managed Agents 打造全员 Slack 公司智能体,并开放给订阅者

    The Every 团队把尽可能多的工作交给智能体处理,并在 Claude Managed Agents 上构建了一个全员在 Slack 中使用的公司智能体,用于在新模型发布时共享技能。该智能体在内部走红后,团队已将其发布给订阅者。

  9. Anthropic(@AnthropicAI)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 扩大 Cyber Verification Program,向安全专业人员开放 Claude Mythos 5.1、Opus 5.5 与 Sonnet 5.5

    Anthropic 扩大 Cyber Verification Program,通过该计划,经过验证的安全专业人员可访问 Claude Mythos 5.1、Opus 5.5 和 Sonnet 5.5,并获得为防御性工作设计的安全防护。同时新增层级,允许渗透测试、红队演练等经授权的攻击性安全工作。

  10. Lovable(@lovable_dev)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 加入 Claude 创业扶持计划 Startup Stack,会员可享 Business 套餐 4 个月减免

    Lovable 现已加入 Claude 的 Startup Stack,Claude Startups 会员可获得 Lovable Business 套餐 4 个月费用减免。Claude Startups 计划正向更多创始人扩展,会员还可获得一年的 Claude Team、API 额度、创业所需工具的专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。

  11. Firecrawl(@firecrawl_dev)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl 加入 Claude Startups 创业支持计划

    Firecrawl 宣布加入 Anthropic 的 Claude Startups 计划。该计划正向更多创始人扩展,成员可获得一年 Claude Team、API 额度、创业常用工具的专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。

  12. 歸藏(guizang.ai)(@op7418)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hark Pro 上线:由 Opus 5.5 和 Sonnet 5.5 驱动的 personal agent,早期用户送一个月 Pro 会员

    personal agent 产品 Hark Pro 已在 web、iOS 和 Android 上线,据称由 Opus 5.5 和 Sonnet 5.5 驱动。早期申请用户可获赠一个月 Pro 会员,其左侧卡片支持 AI 自定义,整体设计与动效细节获好评。

  13. Claude(@claudeai)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 支持在对话旁直接打开并协作编辑 Google 文档、表格和幻灯片

    Claude 现可在聊天窗口旁打开 Google 文档、表格和幻灯片:粘贴 Google 文件链接,或直接要求新建文档、表格或演示文稿,即可与 Claude 共同编辑。访问权限沿用用户原有的 Google 共享设置,该功能已在所有付费计划中以 beta 形式开放。

  14. Claude(@claudeai)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 接入 Google Docs、Sheets 和 Slides

    Claude 现可在 Google Docs、Sheets 和 Slides 内工作,这些文件也能在 Claude 中打开。在 Google Workspace 里,Claude 以侧边栏形式出现在文件旁,读取当前打开的内容并就地编辑,用户可逐条批准每次修改后再落地。

  15. Claude(@claudeai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 为初创公司提供最高 7000 美元产品与额度支持

    Claude 向初创公司提供最高 7000 美元的 Claude 产品与额度支持,包括为首次使用 Team 的公司提供一年免费 Claude Team,以及审批通过后即刻到账的 1000 美元 API 额度。

  16. Gary Marcus(@GaryMarcus)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 追问:一个“好用的工具”值得冒 10% 灾难风险吗?

    Gary Marcus 以“一个‘好用的工具’是否值得冒 10% 灾难风险”发问,回应 Mark C. Massey 关于 Claude 的评论。Massey 称自己用 Claude 做出过一些有趣的东西,认为它是个好工具,但并非不可或缺,如果消失生活也会回归正常。

  17. Claude(@claudeai)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 开放 Claude Startups 申请:可预约 Applied AI 团队线上办公时间

    Anthropic 面向成立五年内或近两年获得融资的初创公司开放 Claude Startups 申请,可预约其 Applied AI 团队的线上办公时间,并在名额允许时参加 Founder House、黑客松和 meetup 等活动,申请入口为 claude.com/resources/arti…。

  18. Claude(@claudeai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 推出最高 7500 美元产品与额度支持,含一年 Claude Team 免费

    Anthropic 为开发者提供最高 7500 美元的 Claude 产品与额度支持,其中包含面向首次使用 Team 的企业赠送一年 Claude Team,以及通过审核后即刻到账的 1000 美元 API 额度。

  19. Claude(@claudeai)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 推出 Startup Stack,整合 Linear、Lovable、ElevenLabs 等合作方优惠

    Claude 推出 Startup Stack,整合 Linear、Lovable、ElevenLabs、Granola 和 Hex 等基于 Claude 构建的公司的优惠,提供价值最高 45,000 美元的折扣与额度,覆盖销售、设计、数据工程等工具。

  20. Claude(@claudeai)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Startups 创业计划扩展:入选者可获一年 Claude Team 与 API 额度

    Anthropic 的 Claude Startups 计划扩大覆盖范围,入选创业者可获得一年 Claude Team、API 额度、创业工具专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。

10月6日周二
  1. Firecrawl(@firecrawl_dev)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl 在 Alexandria 上线梦幻体育数据,ChatGPT 与 Claude 可调用

    Firecrawl 在 Alexandria 上线梦幻体育数据,让 ChatGPT 或 Claude 接入球员与球队统计、梦幻分析、新闻和博彩赔率的数百万条数据点。官方称借助该 Firecrawl 插件可用 100 倍的研究量来构建阵容。

  2. Simon Willison(@simonw)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 惊讶于 Opus 5.5 能作曲:让其为游戏配乐效果远超预期

    Simon Willison 让 Opus 5.5「写一些电脑游戏音乐」,结果远超预期,并由此发问模型是从何时开始能创作合格音乐的。

  3. Interconnects AI — Nathan LambertAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么"开源模型危险、闭源模型安全"的网络安全叙事是错的

    Anthropic 发布报告称 GLM-5.3 可作攻击性网络工具,Nathan Lambert 认为这类讨论回避了"禁用开源模型会怎样"等关键问题。他指出,迄今已记录的多数网络攻击由闭源模型导致,若因网络风险禁用开源权重模型,或许也应禁止前沿闭源模型的公开 API。

  4. Stack Overflow BlogAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 2026 开发者调查结果公布:Claude Code 成最常用编码智能体

    Stack Overflow 第 16 届开发者调查公布,超 3 万人参与,Claude Code(66%)和 GitHub Copilot(59%)是开发者最常用的编码智能体。Anthropic 与 OpenAI 的模型使用率并驾齐驱,Google 位列第三,但更多受访者愿意继续使用 Anthropic 模型。62% 的受访者对 AI 持正面看法,日活用户中这一比例升至 71%。

  5. 向阳乔木(@vista8)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Claude Code Mod 做隐私插件:资料进 LLM 前先替换,Claude 防封新思路

    有人用 Claude Code Mod 实现了一个隐私插件,在资料信息进入 LLM 前先做替换,以此规避 Claude 封号。发帖者还提议进一步升级,把对话从中文翻译成英文,尽可能隐藏中国人身份,并称该插件已在评论区开源。

  6. Viking(@vikingmute)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 频繁提示 Selected model is at capacity,用户讨论如何检查账号是否被风控

    有用户反映 ChatGPT 多次对话后出现 "Selected model is at capacity" 提示,等待时间翻倍,部分 case 还会从 sol 直接切换到 luna;该提示最近一小时未再出现,使用较为流畅。用户称自己的号已用很久且未使用第三方,仍不确定风控原因,并询问如何检查账号是否被风控,同时表示想念 Opus 5.5、只能从 Cursor 上使用。

  7. AI寒武纪AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 实测:200 美元档 Claude 的 API 等价 Token 价值约为 ChatGPT 的 5 倍

    SemiAnalysis 对 Anthropic、OpenAI、Meta、MiniMax、月之暗面、智谱等厂商的订阅套餐做极限压力测试,结论是同等月费下 Anthropic 给用户的 Token 实际价值是 OpenAI 的 5 倍以上。

  8. Viking(@vikingmute)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用户吐槽 ChatGPT 频繁提示 Selected model is at capacity,sol 到 luna 切换也崩了

    有用户反映 ChatGPT 最近体验急剧下滑:几次对话就出现 "Selected model is at capacity",等待时间翻倍,部分 case 还会从 sol 直接切换到 luna。

  9. 小互(@imxiaohu)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 订阅制被指赔本:Claude 会员占 40% 算力却只贡献 10% 收入

    据 SemiAnalysis 分析,Anthropic 的 Claude 会员订阅收入仅占总收入约 10%,但订阅用户消耗的推理算力超过 40%,明显拉低每兆瓦算力产生的收入。这意味着 20 美元或 200 美元的月费会员实际上由科技巨头大幅补贴。

  10. 小互(@imxiaohu)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 调整 $200 套餐并新增 $500 档,单位 Token 性价比与 Anthropic 对比

    OpenAI 调整了套餐结构:$200 套餐价值腰斩,并新增 $500 档位;目前 $100、$200、$500 三档每花 1 美元买到的 Token 数几乎一样。作者称 Anthropic 在每美元性价比上仍全面优于 OpenAI。

  11. 小互(@imxiaohu)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 测试:Claude 等效 API 价值比 OpenAI 高出约 5 倍

    技术分析机构 SemiAnalysis 的测试显示,Claude 提供的"等效 API 价值"比 OpenAI 高出约 5 倍,即便不看价格、单看 Token 数量,Claude 给出的量也大幅胜出。该测试据此称 Anthropic 才是最大的慈善家,OpenAI 一直在耍小聪明。

  12. 小互(@imxiaohu)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Projects 云端会话可授权访问本地文件夹

    Anthropic 的 Claude Projects 云端会话现在可以连接用户在电脑上授权的文件夹,会话仍在云端运行,只在任务需要时读取其中的文件,并支持原地修改后保存回原位置。该功能从今天开始逐步开放,所有用户分批获得。

  13. 花叔AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    花叔发布 huashu-art-motion skill,可用代码生成配口播动画

    花叔发布 huashu-art-motion 这个 skill,装好后可按口播自动配动画,也能直接拆解参考视频。作者此前用 Claude Code 复刻了一段艺术史动画,模型还自行生成运动热力图,标出原片中哪些区域在动。

  14. freeCodeCamp.orgAI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 在 Docker 沙箱中能做什么:一次完整访问权限实测

    作者把 Claude Code 放进 Docker Sandboxes 的 microVM 沙箱中,让它在无需逐步批准命令的情况下完成给 Flask 应用添加 /health 端点、编写测试、构建镜像并通过全部三项测试。

  15. AINLPAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis:Anthropic 订阅比 OpenAI 提供 5 倍以上的价值

    SemiAnalysis 指出,Anthropic 订阅提供的价值是 OpenAI 的 5 倍以上。

  16. Latent.Space(@latentspacepod)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 如何实现 local hands

    @trq212 进一步介绍了 local hands 在 Claude Code 中的实现方式,更多内容见 latent.space/p/thariq。原文未披露具体功能细节与版本信息。

  17. 花叔AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    花叔开源动画 skill huashu-art-motion

    花叔发布并开源动画 skill huashu-art-motion,可让 agent 按指定画风生成动画、拆解复刻参考短片,或按口播做解说动画。该 skill 包含 8 种常见解说风格和几十张艺术风格卡,每张卡记录配色、笔触、动作做法及短板;动画由 Claude Code 中的 Opus 5.5 制作,形象帧由 codex 的 ImageGen 生成,配乐由代码合成。

  18. 新智元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 联创 Christian Szegedy 长文《数学何去何从?》:AI 让数学「毕业」,两千年英雄攀登史落幕

    xAI 联合创始人 Christian Szegedy 发长文《数学何去何从?》,宣告数学的「英雄探险时代」结束,AI 这架「飞机」已把旗插上无人登顶的山峰。

  19. Gary Marcus(@GaryMarcus)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 IPO 会建立在它最好的季度还是现实之上?

    Gary Marcus 质疑 Anthropic 的 IPO 是否建立在其最佳季度表现之上。据 The Information,Microsoft 已将内部 Claude 支出削减超过三分之一,Meta 的 Claude Code 用户数也已减半;Microsoft 此前为 Copilot 功能每年在 Anthropic 模型上的支出预计至少 20 亿美元。

  20. 宝玉(@dotey)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex Project 与 Claude Projects 有何不同:一个像论坛板块,一个像 Slack Channel

    Codex Project 与 Claude Projects 的组织方式被类比为论坛板块与 Slack Channel:前者像容器或分类,相关内容都放进来并可不断新开会话,但容易歪楼、上下文较乱;后者所有消息集中在一起,想深入某个子话题时新开 Thread 展开讨论,借此聚焦上下文。