OpenAI模型版本数量benchmark领先引讨论
先了解这件事
AI 综述
2026年10月2日,X用户Peter Steinberger(@steipete)发布一张按模型版本数量排名的benchmark图表,显示OpenAI继续以明显优势领先,发帖者称这只是一个benchmark。评论区提到Anthropic紧随其后,若发布Fable或Opus 6将只差0.1个版本点;也有人质疑该榜单把同一家模型混排、未对齐推理预算与采样次数。目前进展停留在图表发布与评论讨论阶段,尚无相关公司回应或榜单方法调整的报道。
报道时间线
10月2日
- OpenAI 在模型版本数量 benchmark 上继续领先
一张按模型版本数量排名的 benchmark 图表显示 OpenAI 继续以明显优势领先,发帖者称这只是一个 benchmark。评论区提到 Anthropic 紧随其后,若发布 Fable 或 Opus 6 将只差 0.1 个版本点,也有人质疑该榜单把同一家模型混排、未对齐推理预算与采样次数。