跳到正文
原文
DeepLearning.AI(@DeepLearningAI)· DeepLearning.AI (@DeepLearningAI)·· 2026-08-31AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

GLM-5.3 靠后训练追平开源模型榜首,CyberGym 得分 84.5% 引发安全暂缓

🛑 https://t.co/I9sL8TF3m4 just proved how powerful post-training can be for powering agents. GLM-5...

AI 导读

GLM-5.3 在 Artificial Analysis Intelligence Index 上得分 60,在开源权重模型中并列第一。其整体智能提升完全来自对 GLM-5.2 的微调,而非训练新的基础架构,通过在长时间运行的软件工程环境中训练,模型涌现出网络安全能力,在 CyberGym 上得分 84.5%。

来源:DeepLearning.AI(@DeepLearningAI) · x.com