Simon Willison(@simonw)· Simon Willison (@simonw)·· 5 天前AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
Simon Willison 复测 Qwen 3.8 27B 本地长数字加法,对比推理与非推理模式
I re-ran an experiment @colin_fraser ran against GPT-4o a while back to see how good it was at addin...
AI 导读
Simon Willison 重跑了 Colin Fraser 早前针对 GPT-4o 的长数字加法实验,这次改用本地运行的 Qwen 3.8 27B,并分别测试推理模式与非推理模式。原帖未给出具体得分,仅附上实验记录链接。
来源:Simon Willison(@simonw) · x.com