Perplexity(@perplexity_ai)· Perplexity (@perplexity_ai)·· 3 天前AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
GPT-OSS-120B 智能体用 9B 模型在 BrowseComp+ 上取得 64.0%
In agentic search, a GPT-OSS-120B agent using the 9B model answers 64.0% of BrowseComp+ questions co...
AI 导读
在智能体搜索中,GPT-OSS-120B 智能体调用 9B 模型正确回答了 BrowseComp+ 上 64.0% 的问题,比次优的 ColBERT 模型高出 4.9 个百分点,且搜索次数少于所有基线。
来源:Perplexity(@perplexity_ai) · x.com