GPT-OSS-120B智能体BrowseComp+答对64%
先了解这件事
AI 综述
2026年10月8日,Perplexity在X上发布数据:在智能体搜索任务中,一个使用9B模型的GPT-OSS-120B智能体在BrowseComp+基准上正确回答了64.0%的问题,比排名第二的ColBERT模型高出4.9分,同时搜索次数少于任何基线模型。这是目前关于该智能体搜索表现的唯一报道。
报道时间线
10月8日
- GPT-OSS-120B智能体BrowseComp+答对64%
在智能体搜索中,一个使用9B模型的GPT-OSS-120B智能体正确回答了64.0%的BrowseComp+问题,比下一个ColBERT模型高出4.9分,且搜索次数少于任何基线。