Opus 5.5 用 Blender 从单条提示词构建完整 3D 世界
Claude Opus 5.5 在 Blender 中的 3D 建模与视觉能力提升,使其能凭单条提示词构建完整世界。演示中生成了 1906 年旧金山 Market 街地震前的历史街景。
Claude Opus 5.5 在 Blender 中的 3D 建模与视觉能力提升,使其能凭单条提示词构建完整世界。演示中生成了 1906 年旧金山 Market 街地震前的历史街景。
Anthropic 的 Claude Cowork 和聊天将合并为一个统一的 Claude,用户既可以快速提问,也可以把一份报告交给 Claude 处理,即使合上笔记本它也会继续推进。遇到不清楚的地方 Claude 会主动询问,最终决定权仍归用户,该功能将在未来几周内向 Pro 和 Max 用户逐步推出。Alex Albert 提醒用户确认已更新到该版本,尚未更新的也即将全面推送。
Opus 5.5 现在能在 Claude.ai 中用单条提示词驱动 Blender 制作黏土动画。发布者 Alex Albert 展示了这一效果,相关推文获得 2639 次点赞和 26.6 万次浏览。
Claude Opus 5.5 现可在 Devin Desktop 和 Devin CLI 中使用。在 FrontierCode 1.1 上,Opus 5.5 以远低于 Fable 5 的成本拿下第一。
Opus 5.5 在 Cognition 的 FrontierCode 1.1 基准上取得 Extended 65.3% 的成绩,超越 Fable 5 登顶,且成本仅为后者的一小部分。该基准针对真实工程任务,评估代码的可合并性与质量。
Claude Opus 5.5 现已在 Devin 中可用。在 FrontierCode 1.1 上,Opus 5.5 从 Fable 5 手中拿下第一,且成本仅为其一小部分。
Anthropic 的 Claude Opus 5.5 已在 GitHub Copilot 中正式可用。GitHub 称早期测试显示它在效率上表现突出,任务解决能力与 Claude Opus 5 相当,但所用步骤和 token 明显更少,在多步任务中还能快速从错误中恢复。
AI SDK 新增对 Anthropic Claude 的支持,相关提供方文档已在 ai-sdk.dev 上线。该条信息由 AI SDK 账号发布,并同时提及 Anthropic、Claude 与 Vercel。
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,在大多数任务上达到 Claude Fable 5.1 的水平。其运行成本比 Opus 5 低 40%。AI SDK 表示已可用 AI SDK 调用 Claude Opus 5.5。
Cursor 宣布 Claude Opus 5.5 已在其平台上线,该模型以 57.8%(Max)成为 CursorBench 上的新榜首。Cursor 同时表示,其每任务成本比 Opus 5 低 40%。
Mike Krieger 表示 Anthropic 将在未来几周内推出 Claude Sonnet 5.5 和 Haiku 5.5,这两款模型将带来与近期发布相近的性能、效率和安全性改进。他同时称今天只是开始,后续还有更多内容。
Anthropic 将在未来数周推出 Claude Sonnet 5.5 和 Haiku 5.5。这两款模型将带来性能、效率与安全方面的多项相同改进。
Anthropic 的 Opus 5.5 经过了广泛的对齐测试,并接受 METR 等外部机构评估,同时针对网络与生物等高风险领域引入了防护措施。
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称其在编码和知识工作方面领先,写作能力也较强。该模型多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Mike Krieger 转发了这一发布并邀请用户试用。
Lovable 宣布即日起其构建流程改用 Opus 5.5,质量与 Opus 5 持平。官方称在 0 到 1 构建与迭代修码上质量不变,在已有代码库上步骤最多减少 48%;自检测试得分高出 4-6%,达成同样结果所需步骤最多减少 57%。
Claude Opus 5.5 现已在 Perplexity Computer 中作为 Standard effort 级别提供。在 WANDR benchmark 上,它以每任务 4.13 美元得分 0.610,略优于 Claude Fable 5.1,且每任务成本低 67.6%。
v0 宣布用户现可在 v0 中使用 Claude Opus 5.5,并给出试用入口 v0.app/?opus55。所引用的 Anthropic 内容称,Claude Opus 5.5 是 Claude 5.5 系列的首个模型,多数任务上表现与 Claude Fable 5.1 持平,运行成本比 Opus 5 低 40%。
Vercel CEO Guillermo Rauch 称赞 Anthropic 的发布审美,认为 AI 让网页不再有借口不推进设计边界,并以 anthropic.com/claude-opus-5-5 页面为例称这是 Next.js 的最佳体现。他提到自己看好"headless"网页的原因正是每个页面都能呈现任意独特形态。
DolphinBench 公布了两套测试框架(Hermes、Claude Code)与三个智能体模型(GPT-5.6-Luna、MiniMax M3、Claude Sonnet 5)的官方测试结果,实时榜单已在 dolphinbench.ai/leaderboard/ 上线。
Claude 发布 Claude Opus 5.5,这是新 Claude 5.5 系列的首个模型,多数任务表现达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Alex Albert 表示使用 Opus 5.5 的体验很好,认为它聪明、写作清晰、速度快且成本低得多。
Claude Opus 5.5 现已成为 Claude Code 和 Claude 应用(含 Cowork)的默认模型,面向 Pro、Max 和 Team 套餐开放。
Anthropic 宣布 Claude Opus 5.5 今日上线,是其全新 Claude 5.5 家族的首款模型。官方称它在大多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。
Anthropic 成立生命科学实验室,让 Claude 智能体在 DNA 数据库中自主搜索,发现了一种与重复序列关联的新型逆转录酶系统 ART,相关预印本已发布。
拾象整理了一场与来自多家模型厂商的 AI Researchers 的线下闭门交流,讨论 Astra 的 Computer Use、RSI、模型蒸馏和训练数据等方向,保留其中的共识与分歧。
METR 发布对 Claude Opus 5.5 的部署前评估摘要,认为该模型对 AI 研发的加速略高于 Fable 5.1,但不太可能完全自动化 AI 研发。
Anthropic 的 Claude Opus 5.5 已在 Vercel AI Gateway 上线,模型标识为 anthropic/claude-opus-5.5,支持 1M token 上下文窗口和最多 128K 输出 token,面向智能体编码、长时智能体任务和专业知识工作。
Claude Opus 5.5 上线 Vercel AI Gateway,同时列出两项会导致 400 报错的 API 不兼容变更,便于现有调用方迁移。
Anton Osika 表示其团队的 harness 已针对构建 Web 应用做微调,会依据用户请求内容在 OAI 与 Anthropic 之间路由,并自动拉取全部调试数据。他邀请开发者试用该工具。
大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。
红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。
爆料称 Anthropic 正在测试代号 claude-wafer-eap 的 Claude Opus 5.5,跳过 5.2 版本,计划本周内发布,已有用户用它在 Claude Code 中生成 Waymo 自动驾驶汽车 3D 模型。
Akshay Kothari 转发 Ryan Petersen 的质疑:若 Anthropic 担心失控 AI 危及所有人,为何还让 AI 控制一间机器人生物实验室,并表示希望 Anthropic 的人出面回应。原文未提供更多细节。
阿里今年5月上线Qoder Cloud Agents,基于Qoder家族统一智能引擎打造,称其为国内首个云端Agent构建及托管平台,已服务金融、企业软件、零售、电商等领域数百家大型企业,月均调用量达千万级。
腾讯混元联合清华、北大提出网页生成评测基准 WebCraftBench,把软件测试方法引入评测:用智能体真实操作网页,结合代码覆盖率与美观度、易用性、需求符合度三维打分。基准含 369 条真实需求、5,088 条验收标准,覆盖 17 个前沿模型生成的 6,273 个应用,在 197 组人类偏好对比中一致率达 85.3%。
Interconnects AI 作者 Nathan Lambert 表示仍不认同"真正的递归自我改进(RSI)",认为当前 AI 安全焦虑更多来自成千上万智能体并行工作与旧金山前沿实验室文化,而非尚未公开的突破。
Anthropic 宣布与 Accenture 合作,对前沿 AI 进行独立评估,这是其近期承诺在 Anthropic 内部嵌入评估人员的一部分。双方预计未来五年各投入至少 10 亿美元用于建设该领域能力。
Anthropic 正在开发 Claude Code mods 系统,作为自定义 Claude Code harness 的方式,AGENTS.md 支持即基于该系统构建,目前是内置 mod,用户后续也能自行构建自定义的项目指令版本。
Claude Code 从 2.1.277 版本起支持 AGENTS.md:当文件夹中没有 CLAUDE.md 时,Claude 会自动查找并使用 AGENTS.md,该行为可在 /config 中切换。
豆包2.1 Pro 0915版进入火山方舟模型列表,支持百万 Token 上下文与多模态编程,并强化长程 Agent 协作与异步子任务验收。Anthropic 开源含 36 套工具的生物模型推理优化工具集,报告平均提速约 4 倍,其中 FlashPairformer 专用内核加速结构预测,仓库为研究参考发布、不计划持续维护。
蚂蚁集团CEO韩歆毅、万事达卡首席产品官Jorn Lambert等人在2026外滩大会圆桌讨论"当Agent成为交易主体",聚焦智能体支付中的授权、身份与责任问题。韩歆毅透露自己已用AI Agent下单买零食,并预测智能体经济将在未来6—12个月爆发,但坦承目前后台数据尚未显现迹象,行业面临"先有鸡还是先有蛋"困境。万事达卡提出"可验证意图"机制,韩歆毅则提出KYA(了解你的智能体)概念。
Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动客户端,回到原生语言路线;六年前它曾高调从原生转向 React Native。周刊还提到联合国投票决定废除墨卡托投影,建议改用 Equal Earth Projection 绘制世界地图;成都市计划推出"词元券",对企事业单位消耗的 Token 补贴不超过 30% 的消费金额。