Microsoft Research(@MSFTResearch)· Microsoft Research (@MSFTResearch)·· 2026-08-04AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
小语言模型用 SocialRL 学习谈判,PazaBench V2 扩展非洲语言语音 AI 评测
Small language models learn to negotiate with SocialRL, PazaBench V2 expands speech AI evaluation ac...
AI 导读
微软研究院介绍多项成果:小语言模型通过 SocialRL 学习谈判,PazaBench V2 将语音 AI 评测扩展到多种非洲语言,EvoLib 则帮助智能体把经验转化为知识。此外还包括更可靠的 A/B 测试方法以及 AI 驱动精准肿瘤学的进展。
来源:Microsoft Research(@MSFTResearch) · x.com