Hacker News 日报:Anthropic 发布 Claude Haiku 5.5,OpenAI 扩大 GPT-6 覆盖
Anthropic 发布 Claude Haiku 5.5,10 万 token 以内输入输出价为每百万 token 0.10/0.50 美元,超过则升至 0.50/2.50 美元,Max 与 Team 用户新增 API 额度;同日 Sonnet 5.5 缓存读取价降至每百万 token 0.10 美元。
Anthropic 发布 Claude Haiku 5.5,10 万 token 以内输入输出价为每百万 token 0.10/0.50 美元,超过则升至 0.50/2.50 美元,Max 与 Team 用户新增 API 额度;同日 Sonnet 5.5 缓存读取价降至每百万 token 0.10 美元。
Anthropic 推出 OSS Scanner,将用其前沿模型对主动加入的开源项目进行定期漏洞扫描,不收取费用。扫描报告会给出漏洞验证概念、说明以及修复建议。
Anthropic 宣布启动 Anthropic Cyber Mission,作为其让外界依赖的系统更安全、更具韧性整体工作的一部分。该项目将与公共和私营部门伙伴合作,并会随实践反馈持续扩展和调整,Anthropic 表示这一过程需要时间。
天体物理学家 Brice Ménard 与 Claude Science 合作,生成首张完整的紫外天图。射电到伽马射线波段此前已有完整天图,但大片天区从未在紫外波段被观测,Ménard 引导 Claude 寻找现有数据集、加以合并,并用统计推断补上缺口。这项工作原本需要人类数周,借助 Claude 只用几天,Ménard 期间还能处理其他项目。
Anthropic 为 Claude 上线 Claude Motion 与 Claude Dashboards 测试版,可让 Claude 将数据转为实时仪表盘、把想法做成动画解说。用户可用 Claude Motion 动画化图表、制作客户演示或短解说,再导入 Runway 生成视频与图像。
Anthropic 为 Claude 上线两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年来首次更新 Claude 使用政策,新增禁止用户对 Claude 进行“持续且不必要的辱骂或残忍行为”,违规者可被警告、限流、限制、暂停或终止访问。该政策称不适用于常见的用户挫败、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。更新还把虚假账号宣传、无人机武器化、未经同意的监控纳入限制,并承认政府合同可能存在例外。
Anthropic 宣布 Claude Docs、Slides 和 Design 三款工具结束 beta,从今天起在包括免费版在内的所有套餐中提供。用户与 Claude 可以在同一份文档、幻灯片或设计稿上协作编辑。
Claude 现在可以把仪表盘发送到你的分析工具做更深度的分析,也能把动画在视频编辑器中打开做最后的润色。官方公布了支持的工具完整清单,详情见 claude.com/resources/arti…。
Claude 发布 Claude Motion,可将报告、图表或产品演示转成短动画。每段动画由 Claude 以代码方式生成,不涉及视频模型,因此可修改任意文字、数字或时间点,并导出 MP4。目前面向 Team 和 Enterprise 套餐开放 beta。
Claude 推出 Claude Dashboards 和 Claude Motion 两项 beta 功能:前者可让 Claude 把数据转成实时仪表盘,后者能把想法变成动画讲解视频。两项功能目前均处于 beta 阶段。
AI 模型众包评测平台 Arena 宣布完成 2 亿美元 B 轮融资,估值达 31 亿美元,由 Lightspeed Venture Partners 和 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等参投。
Google 在 Cloud 活动上宣布将 Gemini 带入智能体阶段,推出统一智能体,既能回答问题也能代用户完成任务,初期面向企业、之后再向消费者开放。该智能体可接收目标而非指令,自行规划工作并调用自定义技能与工具;默认自动选择模型,用户也可手动切换,首批第三方模型为 Anthropic 的 Claude。
Google 把 Gemini 智能体先落到企业场景,文中给出的模型选择、系统连接与审计线索可供评估落地边界。
Anthropic 更新使用政策,明确禁止在极端情况下反复滥用 Claude,普通的不满与批评仍被允许。新规同时覆盖选举干预、欺骗性营销活动、武器软件与监控等用途。
Lightspeed Venture Partners 曾错过 OpenAI、ElevenLabs 和 Hugging Face 等 AI 公司,2023 年 4 月联合负责人 Ravi Mhatre 与 Bejul Somaia 要求全球合伙人清空日程,开了一场长达七小时的会议反思如何应对 AI 浪潮。如今该机构有望凭借对 Anthropic 的投资获得回报。
10月7日马斯克在X上宣布,Grok Bot 将根据具体任务选用最合适的后端模型,并点名 Claude Opus 5.5、Midjourney 和 Suno,标准是哪个最可能带来最好结果就用哪个。
Evolvent AI 推出 RSIGym,把训练、推理、评测与沙箱打包成研究智能体可调用的服务,并开源代码、实验配置、研究轨迹和评测日志。以 Opus 5 作为研究者,改进后的系统在 SWE-bench Verified 上从 17.67% 升至 50.33%。
Zeta Global 发布 Athena Inference Model(AIM),与 Fireworks AI 合作、使用 NVIDIA Nemotron 开发。同期推出企业智能操作系统 AthenaOS 和 Athena MCP,首日即集成 ChatGPT、Claude、Palantir 和 Gemini,并宣布与合作伙伴以轻资本方式推进专用芯片的早期工作。
Anthropic 承诺向 Genesis Mission 投入 1.5 亿美元,以深化对科学研究与技术发现的投入。同时,Claude 及技术支持将向 15 家以上美国联邦机构开放。
Google Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上以 53 分追平 GPT-6 Astra,单任务成本约为后者 60%。
针对归藏老师今日关于 A÷ 刻意压价的帖子,有观点指出连"压价"本身都是假的:Haiku 采用阶梯定价,但上下文一旦达到 100k,价格就翻 5 倍,而 gpt 的分界线是 272k。图片里看似很低的价格,实际使用成本要高得多,被认为是面向 Benchmark 的特化优化,并借此打榜到第一。
haiku 5.5 的定价被吐槽"太奇葩":超过 100k 的部分直接按 5 倍计价。发文者质疑哪有这种阶梯定价方式,该帖获得 146 点赞、38 条回复。
CrowdStrike 报告称,2026 年 9 月下旬至 10 月初韩国多家金融机构遭针对性网络攻击,新韩银行约 2.5 万名客户信息受影响,KB 国民银行、韩亚银行等也有不同程度泄露。
CrowdStrike 报告披露的攻击链细节,可供安全从业者观察 AI Agent 被用于真实金融渗透的方式。
Google Cloud 在 Gemini at Work 2026 上发布 Gemini agent,一个面向工作的统一智能体,可回答问题、处理知识工作、生成图像媒体并编写运行代码,全部通过单一提示框和单一 API 完成。
Google Cloud 把 Gemini 从模型入口升级为统一工作智能体,读者可据此判断企业级 Agent 平台的竞争格局与落地条件。
LangChain 为 Deep Agents 重构 Skills 支持,新增三项能力:绑定到技能的工具只在 agent 读取该技能后加载;用户显式请求(如输入 /meeting-prep)时可将技能固定,在下一次模型调用前载入指令;长会话线程无需重启即可拾取新增或变更的技能。
Anthropic 发布 Claude Haiku 5.5,OSWorld 2.1 评测从上一代 15.7% 提升到 72.4%,平均运行成本下降约 75%,并首次支持可调节推理强度的 Adaptive Thinking 与 100 万 Token 上下文。
Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。
一场科技圈聚会上的举手表决显示,几乎无人愿意在 Anthropic 3 万亿美元估值下买入其股票,现场只有 3 人举手。Business Insider 认为,Anthropic 的 IPO 将检验这轮 AI 热度能否承受公开市场的审视。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日 Sonnet 5.5 缓存读取价格减半并推出订阅 API 额度。
汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗代价,读者可据此判断小型模型在智能体工作流中的实际位置。
开发者吐槽 Claude、GPT 等模型在 Coding 场景输出"15/15全绿""单腿哑火"等黑话,语言能力明显倒退。Coding 过拟合与 CoT 压缩是主因:为省 Token,模型思维链被简化成"穴居语",Token 消耗量比白话文少 70%,Claude 自 Opus 4.6 后也改为非自然语言思维链。
Claude Code 团队公开向用户征集改进意见,邀请用户提出希望 Claude Code 改进的方向。该帖获得 39 条回复、57 次点赞和 7612 次浏览。
10月6日,Anthropic 宣布 Claude 接入 Google Docs、Sheets 和 Slides,向 Pro、Max、Team 和 Enterprise 全部付费计划开放公开 Beta。
《纽约时报》9月29日报道,Anthropic 过去一年邀请数十位宗教学者闭门讨论 Claude 内部状态与模型意识问题,联合创始人克里斯托弗·奥拉还于5月赴梵蒂冈出席活动。
OpenAI 宣布 GPT-6 面向全球推送,付费用户先行,10 月 8 日起免费用户也能使用,正式取代 GPT-5.6 Sol 和 Luna,并带来可自动生成图表、按钮、表单的 Intelligent UI。
Anthropic 为 Max 和 Team 订阅用户按月赠送 Claude Platform API 额度:Max 5x 每月 $100,Max 20x 每月 $200,Team 按席位 $20 或 $100 合并共享,整队上限 $500/月。
Anthropic 的 Haiku 5.5 定价低于 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash,在 Terminal Bench 4.0 上比 GLM 5.3 flash 高一分,与其他两个中国竞品相当或更高。Anthropic 还向每个 Max 和 Team 用户赠送对应额度的 API 金额,该 API 可在任何支持输入 API 的产品中使用。
OpenAI宣布搭载智能界面(Intelligent UI)的GPT-6面向全球ChatGPT用户推出,Plus、Pro、Business和Enterprise用户先行,Free和Go用户次日起可用;其作答改为边想边答,联网搜索问题平均比上一代提前44%开始作答。
Mistral 发布原生多模态 MoE 模型 Mistral Large 4(昵称“Le Chonk”)公开预览,总参数 1 万亿、激活约 490 亿,可通过 Mistral Studio API 试用,权重计划月底发布。
OpenAI在GitHub发布openai/math仓库,公开722份数学手稿、归为372组成果,覆盖数论、代数几何、组合数学等方向,全部来自一个未公开的内部模型。作者称这些成果平均每个花费约3小时ChatGPT Pro级思考算力,其中包含将准黎曼猜想推进到7/8、复数域矩阵乘法指数降到2.25等说法,同时记录了25位菲尔兹奖得主联名信等数学界的质疑与争议。
梳理OpenAI一次性公开722份数学手稿所引发的学界反应与争议,并讨论AI科研中评审环节的瓶颈。
Haiku 5.5 在 Browser Use Bench v2.1 上跑出与 Luna 相同的性能,但价格是后者的 2.8 倍。Haiku 在上下文超过 100k 后价格再涨 5 倍,且缓存 token 也计入其中;而 BU Bench 2.1 多为极长时程任务,会频繁触及该定价档位。