跳到正文
原文
METR·· 2026-05-20AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

METR 发布前沿 AI 风险报告:评估 Anthropic、Google、Meta、OpenAI 内部智能体的失控部署风险

前沿 AI 风险报告(2026 年 2–3 月)

AI 导读

METR 发布 2026 年 2 至 3 月前沿 AI 风险报告,对 Anthropic、Google、Meta 和 OpenAI 内部使用的 AI 智能体做了一次实体级(而非单模型)试点评估。

来源:METR · metr.org