跳到正文
原文
perplexity_ai· @perplexity_ai · X·· 2 天前AI 评分44

GPT-OSS-120B智能体BrowseComp+答对64%

AI 导读

在智能体搜索中,一个使用9B模型的GPT-OSS-120B智能体正确回答了64.0%的BrowseComp+问题,比下一个ColBERT模型高出4.9分,且搜索次数少于任何基线。

正文 · 原文

In agentic search, a GPT-OSS-120B agent using the 9B model answers 64.0% of BrowseComp+ questions correctly, 4.9 points ahead of the next ColBERT model, with fewer searches than any baseline.

来源:perplexity_ai · x.com