新智元·· 10 小时前AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
麻省理工 HugAgent 研究:访谈让 AI 模拟真人,条件一变就失灵?
EMNLP'26 Oral | 麻省理工:靠访谈让AI模拟真人,这条路能走多远?
AI 导读
麻省理工等机构提出 HugAgent,用 54 名真实参与者的访谈预测其在全民医疗、公共监控和住房增密等新情境下的回答,覆盖 1,742 个评测项,论文入选 EMNLP 2026 Main Oral。
来源:新智元 · mp.weixin.qq.com