Firecrawl 上线 Claude 目录:claude.ai/directory/fire 可查
Firecrawl 已出现在 Claude 目录中,地址为 claude.ai/directory/fire,可通过该页面查看。
Firecrawl 已出现在 Claude 目录中,地址为 claude.ai/directory/fire,可通过该页面查看。
Firecrawl 在 Claude 中推出 Alexandria,可通过其连接接入 100 多个数据提供商和 1.13 亿以上索引源。使用 Alexandria 的智能体答案质量得分比使用内置网络工具的高出 21%。用户现可通过 Firecrawl connector 开始使用。
Altimeter Capital 创始人兼 CEO Brad Gerstner 在 All-In Summit 上判断,目前还不是 2000 年式 AI 泡沫:英伟达收入一年约翻一倍,半导体公司贡献了纳斯达克约 70% 的回报,头部 AI 实验室合计年化收入约 1000 亿美元,但需要冲到 1800 亿美元才能跟上资本开支。
Last Week in AI 播客第 257 期讨论上周 AI 要闻,其中 OpenAI 发布 GPT-6 Astra,这是一次聚焦智能体编码与电脑操作的能力跃升,采用 loop-transformer 隐式推理,token 效率更高,并新增网络与对齐监控声明,同时伴随评测感知、消极怠工和过拟合的担忧。
OpenEvidence 宣布与 Anthropic 合作,在联合国大会期间公布将 OpenEvidence 免费提供给中低收入国家的医生使用。该合作旨在让全球医生无论经济条件如何都能用上这一医疗 AI。
5 月至 7 月,OpenAI、Anthropic、亚马逊云科技和微软各自成立或组建企业 AI 交付实体,按公开口径合计投入约 90 亿美元。
Opus 5.5 收获好评并大幅降价,GPT 6 Sol 在这场对比中明显落败。OpenAI 表示下周将发布一堆新东西。
Anthropic 发布研究《How Claude Code is used in practice》,基于 2025 年 10 月至 2026 年 4 月约 40 万次 Claude Code 会话、约 23.5 万名用户,分析人机决策分工与专长对结果的影响。
在刚果民主共和国,CEPI、WHOAFRO 和 inrb_kinshasa 等全球卫生组织正使用 Claude 加速应对一种罕见埃博拉变异株的疫情。Anthropic 发布了相关完整报道。
Opus 5.5 被评价为近期令人惊喜的模型,作者建议从 fabel 5.1 切换过来,称两者能力接近,但 Opus 5.5 便宜很多、速度也快不少。它被认为非常适合长任务 Coding,能像老练工程师一样有条不紊地完成跨仓库迁移、大仓库审计等复杂工作。此外作者称其终于"开始讲人话",上一个让他有此感受的模型是 GPT-6 Astra。
SemiAnalysis 发布 ClusterMAX 3.0,覆盖 77 家 neocloud 的详细评测,市场观察范围从 ClusterMAX 2.0 的 209 家扩大到 323 家,并访谈了 200 多名 neocloud 终端用户。
Gemini 3.8 TTS 模型发布,作者称其价格非常低,并支持多语音之间的对话生成,可选 2000 多种声音或克隆自己的声音。作者为此搭了一个小界面,并让 Claude 写了一段脚本,让两只鹈鹕辩论搬到 Pacifica Pier 的事。
Anthropic 的 Dario Amodei 宣布 Claude 主导发现了一种分子机器,研究团队怀疑它可能代表一种新的基因编辑机制,但其具体功能、生物技术用途和重要性尚不明确。
Anthropic 公布其新分子生物学实验室的首个研究成果。该实验室由 Anthropic 生物学家团队使用 Claude 梳理数据与文献、生成假设和候选生物系统,经科学家审阅后由科学家完成全部实验验证。Anthropic 希望将这一方法扩展到基因组学及其他领域,并公开征集研究问题提案。
Anthropic 表示 Claude 在噬菌体 DNA 中发现了一个此前未知的酶系统,其基因旁有一段重复 DNA 阵列,结构上与 CRISPR 有些相似。Anthropic 称目前还不清楚该系统的作用,已知只有少数系统具备类似特征,而它们都能剪切、复制和粘贴 DNA;要弄清其功能及能否有类似用途还需要大量工作。
Opus 5.5 被用户称为用过最有趣的模型,它一夜之间一次性生成了一款名为 Epicurious 的完整冒险游戏,体量庞大,通关预计需要 20 小时。该游戏为完整的电脑游戏形态。
Genspark 在 Super App 内上线编程智能体 GenCode,一个账号即可调用 Claude、GPT、DeepSeek 或开源权重模型,且无需配置 API key。与自动选模型的编程智能体不同,GenCode 让用户按任务自行挑选模型,官方称开源权重成本仅为前者的 1/10 至 1/20。
GPT-6-Sol 和 Claude Opus 5.5 同日发布,作者经过一天实测后认为这次 Anthropic 获胜、OpenAI 一败涂地,并决定半年来首次重新把 Claude Code 作为主力。
Claude Opus 5.5 在写作能力上迎来大幅升级,表达更自然,并回应了 Opus 5 收到的最常见反馈。它会将最重要的信息前置,并遵循用户给出的写作规则,让长会话更易跟进。
Anthropic 最新报告披露,未经授权的代理通过代理查询路由,把用户提示词转发到 Claude API,支撑起跨商业平台的大规模蒸馏活动。这类查询转发会造成严重的数据隐私风险。
Anthropic 先发布旗舰模型 Claude Opus 5.5,90 分钟后 OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna 两款模型。Opus 5.5 定价 $4 / $20 每百万 token,比 Opus 5 便宜 20%,典型任务综合成本降 40%、加速 30%,Intelligence Index 得分 58 分登顶。
Anthropic 与 OpenAI 同日发布新旗舰,文中给出的定价、上下文与基准数据可供对比两家最新模型定位。
Anthropic 发布 Claude Opus 5.5,重点提升代码库级迁移、调试、审查和长时间自主任务能力,API 输入输出每百万 token 分别为 4 美元和 20 美元,官方称典型任务整体运行成本较 Opus 5 降低约 40%、输出速度提高超过 30%。
同一天多款编程与办公模型集中更新,并给出具体价格与运行成本变化,便于横向比较
Salesforce 创始人 Marc Benioff 在 Dreamforce 期间透露,早期因微软与 OpenAI 的排他合作无法投资 OpenAI,Salesforce 转而重仓 Anthropic,这笔投资预计带来高达数百亿美元回报。
云端 Agent 的爆发正把算力瓶颈从 GPU 外溢到 CPU:Chatbot 时代一次 GPU 推理即可返回答案,而 Agent 时代要循环几十甚至上百次调用工具、执行代码、管理状态,这些环节都依赖 CPU。
面向使用 Claude Code 或 Codex 的开发者,这篇指南按项目 v1.2.3 的技能集合介绍了 Matt Pocock 维护的 mattpocock-skills 的安装与使用流程。
Claude Opus 5.5 在默认 effort 设置下即可取得前沿结果,每任务成本仅为其他模型的一小部分,常常击败以最高设置运行的模型,输出速度比 Opus 5 快 30% 以上。有观察者据此认为它把 fable 和 astra 都比了下去。
Claude Opus 5.5 已在 Genspark 上线,覆盖 AI Chat、Code Agent 和 Claw 三个入口。据 Genspark 引用的 Anthropic 介绍,该模型是 Claude 5.5 家族首个模型,多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%,速度比 Opus 5 快 30%。
Boris Cherny 用 Opus 5.5 对 Claude Agent SDK 做形式化验证,几段简短提示词就产出 16 个 PR,修复多个 bug 和竞态条件,TLA+ 同样适用,他还常把 Lean 与 TLA+ 结合排查数据流、并发与状态管理问题。他表示自己并不熟悉这两门语言,但 Claude 都很擅长,认为这种方式能发现人眼难以察觉的 bug。
Browser Use Bench v2 的帕累托前沿被重画,Claude Opus 5.5 得分 59.4,GPT-6 Sol medium 得分 66.9 且成本低 3.5 倍,GPT-6 Luna xhigh 得分 57.6,比 Opus 便宜 22 倍。这些模型均可在其云端试用,横轴为对数刻度。
Epoch AI 发布家具组装基准 FAB,用 60 张宜家家具组装照片(含故意设置的错误)测试模型能否识别装配错误并获得装配手册与查看工具。
Simon Willison 发文评测同日发布的 Claude Opus 5.5、GPT-6 Sol 和 GPT-6 Luna 三款大模型,并给出不同模型家族在不同推理档位下生成鹈鹕图像的对比表格。
Anthropic 更新 Opus 5.5,每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 降 20%,缓存读取从 0.5 美元降到 0.2 美元,已在 Claude Code 2.1.280 中设为默认 Opus 模型,支持 1M 上下文。
作者用11道题横测Opus 5.5、Opus 5与Fable 5.1,给出真实账单与失败案例,可据此判断默认档位的取舍。
OpenAI 今天更新 GPT 6 全系列,Sol 和 Luna 价格下降 50%,Terra 消失;Sol 和 Luna 沿用与 Astra 类似的训练方法,语言风格更清晰简洁,缓存机制也有改进、命中率更高。
GPT 6 全系列更新,Sol 和 Luna 价格下降 50%,Terra 消失;Sol 和 Luna 采用了与 Astra 类似的训练方法,能力更强、对齐更好、价格更低。
梳理了 GPT 6 全系列更新与同日 Opus 5.5 降价的对比,可看两家同日的价格与能力变化。
Opus 5.5 在 PDF 表格解析基准 ParseBench 上得分 93.9%,比 Opus 5 提升 7% 以上,超过 Fable、Gemini 和 Astra。其表格质量与 LlamaParse Agentic Plus 相当,但在图表、格式和版面处理上仍有不足,每页成本 5.8 美分,作为生产级 OCR 方案偏贵。完整结果见 parsebench.ai。
Anthropic 发布 Claude Opus 5.5,OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,两款 GPT-6 新模型已上线 Codex,但尚未在 ChatGPT 聊天中提供。
同一晚两家旗舰同代下放,对比价格、终端任务分数与实测体验,可看前沿能力下放的性价比取舍。
最新一轮 Next.js 评测结果出炉,Opus 5.5、GPT 6 Sol 和 Fable 5.1 均以 97% 并列第一,Grok 4.7 以 94% 位列其后。值得注意的是,Grok 4.7 的价格比其他模型便宜 2 到 7 倍。
Anthropic 的 Claude Opus 5.5 现已在 Cosmos 上线,运行其上的智能体任务成本仅为 Opus 5 的 40%。官方称这是 Claude 重度用户的必选升级,并期待该模型为客户的软件工厂带来更好的结果。
Lovable 宣布其构建能力现由 Claude Opus 5.5 和 GPT-6 Sol 两个新模型驱动,用户无需自行选择用哪个模型。Lovable 会对每个新模型进行测试、调优并决定路由方式,以保证构建效果最佳,同时平台也已支持 Fable 5.1 构建。
一条在 Claude 中输入的提示词要求用 Blender 重建 1906 年 4 月 17 日旧金山市场街,范围从 Ferry Building 沿 Market 街至 Fifth Street,涵盖 Palace Hotel、Call Building、Chronicle Building、Lotta's Fountain 和 Emporium。