Overmind微调Qwen3.5 9B对比GPT5.6 Luna
先了解这件事
AI 综述
2026年10月7日,Rohan Paul在X上发布消息称,Overmind使用生产trace微调Qwen3.5 9B模型,并在法律合同任务上与GPT5.6 Luna进行对比。报告称微调后模型幻觉条款减少20至30倍,逐字引用条款准确率提升7倍。其可观测层与训练层共用同一数据,评测基于真实任务构建而非公开benchmark。产出为权重自有的小模型,可在Overmind托管或自行部署。
报道时间线
10月7日
- Overmind 微调 Qwen3.5 9B 对比 GPT5.6 Luna
Overmind 用生产 trace 微调 Qwen3.5 9B,在法律合同任务上对比 GPT5.6 Luna,报告幻觉条款减少 20 至 30 倍、逐字引用条款准确率提升 7 倍。其可观测层与训练层共用同一数据,evals 基于真实任务构建而非公开 benchmark。产出为权重自有的小模型,可在 Overmind 托管或自行部署。