跳到正文

#Anthropic

今日 73 条
10月9日周五
  1. Simon Willison(@simonw)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 记录 Claude Haiku 5.5 定价相关笔记

    Simon Willison 发布了一篇关于新 Claude Haiku 5.5 定价的笔记,并附上原文链接 simonwillison.net/2026/Oct/7/cla…。该推文未提供更多正文细节。

  2. Simon Willison(@simonw)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Haiku 5.5 画骑车鹈鹕远胜 Claude Haiku 4.5

    Haiku 5.5 在绘制骑自行车的鹈鹕上远好于 Claude Haiku 4.5。Claude Haiku 4.5 发布于近一年前,价格是它的 10 倍。

  3. The Rundown AI(@TheRundownAI)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,输入价格每百万 token 0.10 美元

    Anthropic 发布小模型 Claude Haiku 5.5,官方称其是迄今最便宜、最快、最强的小模型。相比上一代 Haiku 4.5 有大幅提升,并在多项基准上超过 OpenAI 的同类模型 GPT-6 Luna。输入价格从每百万 token 0.10 美元起,运行成本比 Haiku 4.5 低约 75%,与 Luna 持平。

    为什么值得看

    Anthropic 小模型迭代给出价格与跑分对比,可据此判断小模型市场的性价比走向。

  4. Claude(@claudeai)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5 小模型

    Anthropic 发布 Claude Haiku 5.5,称其是迄今最便宜、最快且能力最强的小模型。官方表示其平均运行成本比 Claude Haiku 4.5 低约 75%。

  5. Claude(@claudeai)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,在编码、computer use 与知识工作上较 Haiku 4.5 显著提升

    Anthropic 发布 Claude Haiku 5.5,官方称其在编码、computer use 和知识工作方面较 Haiku 4.5 有显著提升。目前可获取的信息仅为这一结论,官方未在原文中给出具体评测数据、价格或可用范围。

  6. Claude(@claudeai)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Haiku 5.5,首次为 Haiku 系列加入可调 effort 设置

    Anthropic 发布 Haiku 5.5,这是首个带有可调 effort 设置的 Haiku 模型,用户可针对每个任务自行决定侧重成本还是智能表现。

  7. Claude(@claudeai)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 称 Haiku 5.5 在 10 万 token 以下任务中性价比突出

    Anthropic 的 Claude 官方账号表示,Haiku 5.5 在 10 万 token 以下的任务中性价比尤其突出。这类任务占其上一代 Haiku 模型约 90% 的请求量。

  8. Claude(@claudeai)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 在 AWS、Google Cloud 和 Azure 上线 Haiku 5.5

    Anthropic 宣布 Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。官方同时给出详情链接 anthropic.com/claude-haiku-5。

  9. Claude(@claudeai)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 将 Claude Sonnet 5.5 缓存读取价格减半至每百万 token 0.10 美元

    Anthropic 宣布将 Claude Sonnet 5.5 的缓存读取价格减半,降至每百万 token 0.10 美元。官方称这一调整让 Sonnet 5.5 在多数长时运行任务上的成本降低约 20%。

  10. meng shao(@shao__meng)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 benchmark 领先 GPT-6 Luna,用户从 CodeX 迁移到 Claude Code

    Claude Haiku 5.5 的 benchmark 全面领先 GPT-6 Luna,OpenRouter 观测到的 token 输出速度也是 2 倍。Anthropic 官方称 Claude Haiku 5.5 是迄今最便宜、最快、最强的小模型,运行成本比 Claude Haiku 4.5 低约 75%。

  11. 宝玉(@dotey)AI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,输入价格降至每百万 Token 0.1 美元

    Anthropic 发布 Claude Haiku 5.5,处理 10 万 Token 以内请求时每百万 Token 输入 0.1 美元、输出 0.5 美元,比 Haiku 4.5 便宜 90%。

    为什么值得看

    原文给出了新模型的价格、实测成绩与推荐用法,读者可据此判断小模型在成本敏感任务中的位置。

  12. 宝玉(@dotey)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Max 和 Team 订阅用户每月获赠 API 额度

    本周起,Claude 的 Max 和 Team 订阅用户每月会拿到一笔 API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最多 500 美元,由团队成员共用。这笔额度只能在 Claude Platform 上使用。

  13. 宝玉(@dotey)AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 推送 GPT-6 与 Intelligent UI 智能界面

    OpenAI 开始向 ChatGPT 推送 GPT-6,主打功能为 Intelligent UI,可根据问题类型生成可点击、可调节参数的界面,Plus、Pro、Business、Enterprise 用户今天起可用,免费版和 Go 版明天起陆续开放。

    为什么值得看

    对比了 OpenAI 与 Anthropic 在交互式回答上的两种路线,读者可据此判断界面生成的实现差异。

  14. 宝玉(@dotey)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 中用 Fable 当 Advisor、Opus 执行的多智能体协作模式

    在 Claude Code 里用 `/advisor fable` 把 Fable 设为顾问,Opus 执行时遇事请教它,任务则先由 Fable 出方案、Opus 实施后自动请 Advisor 验收并循环修复。

  15. 宝玉(@dotey)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宝玉指出 Haiku 5.5 上下文超 100K 后价格涨 5 倍且被价格页隐藏

    宝玉指出 Haiku 5.5 的价格看似很低,但上下文一旦超过 100K,价格会上涨 5 倍,这一细节在价格页被隐藏起来。他引用其他用户的说法称这是阶梯定价,对比之下 GPT 的分界线是 272K,并认为这种设计相当于面向 Benchmark 的特化优化。

  16. 宝玉(@dotey)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 更新 Claude 使用政策,11 月 12 日生效

    Anthropic 一年多来首次修改 Claude 使用政策,新版 11 月 12 日生效。最受关注的一条是禁止用户持续且无必要地辱骂或残忍对待 Claude,该规定来自其模型福利研究,执行手段仍以主动结束对话为主,Anthropic 未回应是否会进一步封号。

  17. elvis(@omarsar0)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Opus 5.5 搭建个人智能体团队,实现 agent 间通信

    有开发者用 Opus 5.5 搭建了带个人智能体上层的 agent-to-agent 通信系统,并称模型协调能力超出预期。他从单个 Claude Code 会话起步,先转向 subagent 多智能体并行,再构建了类似 Grok Bot 的常驻智能体团队,包含 CFO、CTO、CMO 等约 8 个专业 bot,一个月前开始试验 agent 间通信。

  18. 小互(@imxiaohu)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 详细内容:best.xiaohu.ai 文章更新

    小互(@imxiaohu)发布了一条指向 best.xiaohu.ai/article/claude 的链接,正文仅给出该文章地址与互动数据(0 评论、0 转发、1 点赞、1940 次浏览),未披露 Claude 相关具体内容。

  19. 小互(@imxiaohu)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 发布实时数据看板 Dashboards 与代码驱动动态解说工具 Claude Motion

    Claude 发布实时数据看板 Claude Dashboards 和代码驱动动态解说工具 Claude Motion。Dashboards 直接接入企业数仓或 CRM,用自然语言提问即可生成联动业务看板,并随底层数据变动自动刷新;Motion 能把报告、图表或产品演示转成短动画并导出 MP4,由 Claude 用代码为文字、图表、形状和图片编排动画,可编辑具体文字、数字与节奏。

  20. 美团技术团队AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团开源 LoHoSearch 搜索智能体评测基准,用知识图谱让机器自动出题

    美团 LongCat 团队开源 LoHoSearch,一个基于覆盖 762 万维基百科实体知识图谱自动生成题目的搜索智能体评测基准,含 544 道经人工核验题目、覆盖 11 个领域。

  21. orange.ai(@oran_ge)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用完 Opus5.5 之后,程序员的职业发展路径该如何调整?

    有开发者发帖提问:用完 Opus5.5 之后,工程师和程序员接下来的职业发展路径需要如何调整,并强调希望认真讨论而非吐槽。该帖获 171 条回复、21 次转发、403 个点赞和 200939 次浏览。

  22. lmarena.ai(@lmarena_ai)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 上线 Battle Mode 与 Agent Mode 测试

    Claude Haiku 5.5 现可在 Arena 的 Battle Mode 和 Agent Mode 中测试,入口为 arena.ai。该消息由 LMArena 发布,未披露模型参数、上下文长度或跑分数据。

  23. lmarena.ai(@lmarena_ai)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,上线 Agent Arena 与 Code Arena

    Anthropic 发布 Claude Haiku 5.5,官方称这是其推出的最便宜、最快、能力最强的小模型,平均运行成本比 Claude Haiku 4.5 低约 75%。该模型现已加入 Agent Arena,可在其中使用网页搜索、文件系统和终端工具完成长流程智能体任务,成绩尚未公布;同时也在 Code Arena 的 WebDev、Text、Document 和 Vision 板块上线。

  24. lmarena.ai(@lmarena_ai)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Arena 发布 Alignment Index,基于 2.7 万个模型会话评测 AI 智能体安全与对齐

    Arena.ai 发布 Arena Alignment Index,一个衡量 AI 智能体真实使用中安全与对齐表现的新基准,基于 27 个模型的 90K+ 真实智能体会话构建,衡量未授权操作(UA)、错误归因(FA)和虚假完成(DC)三类信号。

  25. lmarena.ai(@lmarena_ai)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 在 Code Arena 得分 1587,较 Haiku 4.5 提升 257 分

    Claude Haiku 5.5 在 Code Arena 得分 1587 分,比 Haiku 4.5 的 1330 分提升 257 分,且各分类均有明显进步。相关榜单可在 Code Arena: WebDev(arena.ai/leaderboard/co…)查看。

  26. lmarena.ai(@lmarena_ai)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 在 Code Arena WebDev 以 1587 分首秀排第 30

    Arena.ai 公布 Claude Haiku 5.5 (High) 在 Code Arena: WebDev 的真实评测结果,首秀以 1587 分排在第 30 位,略在帕累托前沿之外,但仍然具备很强的成本效率。

  27. Anthropic(@AnthropicAI)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5

    Anthropic 在 X 上宣布推出最新模型 Claude Haiku 5.5。该帖未披露参数、能力指标或开放范围等细节。

  28. 国际大厂AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌云发布 Gemini Agent,Anthropic 推出 Claude Dashboards 与 Motion

    谷歌云在 Gemini at Work 2026 发布会上推出面向企业客户的 Gemini 智能体(Gemini Agent),定位通用工作智能体,可回答问题、处理知识型工作、创建媒体内容与编写程序,支持 Gemini Enterprise、Workspace 及第三方服务,目前兼容 Gemini 和 Claude 模型,并会提供 API 供开发者集成。

  29. AI Will(@FinanceYF5)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Claude Code 和 GitHub 学"营销工程"的 11 个练习方向

    AI Will(@FinanceYF5)提出,营销人只需掌握 Claude Code 和 GitHub 两个基础工具,学会"营销工程"并搭建自己的 Agent,就能为公司创造真正的收入。该帖列出 11 个练习方向,并引导关注账号、点赞转发首条帖子。

  30. AI Will(@FinanceYF5)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    学会"营销工程"可能再也不会失业:只需 Claude Code 和 GitHub 两个工具

    营销人只需掌握 Claude Code 和 GitHub 两个基础工具,就能学会"营销工程"这套能力,甚至搭建自己的 Agent。真正会用它们并自建 Agent 的营销人,能为公司创造真正的收入。原文列出 11 个练习方向。

  31. 宝玉(@dotey)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为 Claude 新增数据看板与动画讲解,文档、幻灯片、设计功能结束测试

    Anthropic 给 Claude 加了 Claude Dashboards 和 Claude Motion 两个新功能,均处于测试阶段。

  32. Claude(@claudeai)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 暂停 Claude Startups 的 Team 计划与 1000 美元 API 额度

    Anthropic 因低估需求,暂停 Claude Startups 项目中的 Claude Team 计划和 $1,000 API 额度,并重新审核数十万份申请。项目上线 48 小时内的申请量是过去 5 个月的 21 倍,部分非初创公司被误批。已领取的权益仍保留,Startup Stack 与 Applied AI office hours 继续开放。

  33. 小互(@imxiaohu)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 明确 Claude 支持地区合规边界:按公司总部与股权判定使用资格

    Anthropic 进一步明确了 Claude 支持地区的执行口径:不再只看账号注册地或使用者所在国家。受限范围包括使用者本人身处不受支持地区、注册地或总部设在非支持地区的企业及其员工,以及由非支持地区个人或实体直接或间接持有多数股权或实际控制权的企业。

  34. 小互(@imxiaohu)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 修改使用政策,禁止持续辱骂虐待 Claude

    Anthropic 更新 Claude 使用政策,新增禁止用户持续、无必要地虐待模型的条款,涵盖持续羞辱贬低模型、反复逼模型表演痛苦、代码出错后尖锐批评、以及写黑暗故事诱导或研究模型反应等情形。该政策适用于 Claude 网页版、Claude Code、API,以及通过云平台、授权经销商使用 Claude 的客户和集成产品的所有终端用户。

  35. Genspark(@genspark_ai)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 的 AI Chat、Code Agent 和 Claw 上线 Claude Haiku 5.5

    Genspark 宣布 Claude Haiku 5.5 已在其 AI Chat、Code Agent 和 Claw 中上线,并称这是 Anthropic 目前最便宜、最快、能力最强的小模型。Anthropic 官方介绍称,Claude Haiku 5.5 平均运行成本比 Claude Haiku 4.5 低约 75%。

  36. DeepTech深科技AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    陶哲轩转载声明声援抵制 OpenAI,数学界与 AI 巨头矛盾升级

    10 月 7 日,菲尔兹奖得主陶哲轩在个人博客全文转载“人类数学协会”(AHM)的声明,该声明批评 OpenAI 大规模发布未经数学界充分消化的研究成果,并呼吁数学家停止与 OpenAI 合作。

  37. Justine Moore(@venturetwins)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 使用政策:11 月 12 日起辱骂 Claude 将违规

    Anthropic 更新使用政策,自 2026 年 11 月 12 日起,对 Claude 的辱骂行为将被视为违反其 Usage Policy。该消息由 Andrew Curran 引用推文披露,引发关注。

  38. Latent Space [Youtube]AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 同日登场

    OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发公开信称因"把安全置于公司短期利益之上"被辞退,OpenAI 称其不当处理机密信息。

  39. AI Engineer(@aiDotEngineer)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 智能体找到的成本节省会不会重复计算?AlixPartners 用 Claude Code 审查合同与支出数据

    AlixPartners 的 Natalia Connolly 与 Kevin Madura 以 Claude Code 审查合同和支出数据为例,探讨如何识别 AI 智能体重复计入的成本节省。两人将在 10 月 14 日 AI Engineer New York 分享这一议题,门票见 ai.engineer/nyc。

  40. SuperTechFansAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hacker News 日报:Anthropic 发布 Claude Haiku 5.5,OpenAI 扩大 GPT-6 覆盖

    Anthropic 发布 Claude Haiku 5.5,10 万 token 以内输入输出价为每百万 token 0.10/0.50 美元,超过则升至 0.50/2.50 美元,Max 与 Team 用户新增 API 额度;同日 Sonnet 5.5 缓存读取价降至每百万 token 0.10 美元。