METR·· 2025-06-27AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
METR 谈前沿 AI 模型风险披露:公司应共享哪些信息?
What should companies share about risks from frontier AI models?
AI 导读
METR 提出前沿 AI 风险透明度框架,认为仅靠公开部署时的 system card 不足以发现模型不对齐或后门,需披露训练与开发过程信息。该框架覆盖模型能力是否超过公开认知、内部与外部能力差距、不对齐证据等议题,并建议每 3 个月由外部风险审查团队出具报告、经可信中介匿名化后共享给董事会与相关政府机构。
来源:METR · metr.org