OpenAI 发布 GPT-5.1 Instant 与 GPT-5.1 Thinking 系统卡附录
OpenAI 发布 GPT-5 系统卡附录,给出 GPT-5.1 Instant 和 GPT-5.1 Thinking 的更新安全指标。附录还新增了针对心理健康与情感依赖的评估。
推荐理由:OpenAI 公布 GPT-5.1 Instant 与 Thinking 的安全指标更新,并新增心理健康与情感依赖评估。
新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
OpenAI 发布 GPT-5 系统卡附录,给出 GPT-5.1 Instant 和 GPT-5.1 Thinking 的更新安全指标。附录还新增了针对心理健康与情感依赖的评估。
推荐理由:OpenAI 公布 GPT-5.1 Instant 与 Thinking 的安全指标更新,并新增心理健康与情感依赖评估。
OpenAI 发布 gpt-oss-safeguard,这是一组用于安全分类的开放权重推理模型。开发者可以应用并迭代自定义策略。
推荐理由:OpenAI 发布开放权重安全分类推理模型,开发者可据此了解自定义策略的应用方式。
OpenAI 发布视频生成模型 Sora 2,支持同步对白与音效。原文同时说明 Sora 产品已不再提供。
推荐理由:原文给出 Sora 2 在视频生成中同步对白与音效的能力方向,可据此了解视频模型的新进展。
OpenAI 发布新一代视频与音频生成模型 Sora 2,并公布其系统卡。相比此前的 Sora,新模型在物理准确性、真实感、音频同步、可控性和风格范围上有所提升,官方称这些能力是此前视频模型难以实现的。
推荐理由:官方系统卡披露 Sora 2 在物理准确性、同步音频与可控性上的能力变化,可据此了解视频生成的新边界。
OpenAI 发布 GPT-5 系统卡增补,介绍新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编码进一步优化的版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更长时间。
推荐理由:GPT-5 系统卡增补披露了面向 Codex 智能体编码优化的 GPT-5-Codex,可了解其动态思考机制。
Google 发布 EmbeddingGemma,一个 308M 参数、2K 上下文窗口、支持 100 多种语言的多语言嵌入模型,面向端侧场景,量化后内存占用低于 200MB。
推荐理由:原文给出 308M 参数、2K 上下文与量化后 200MB 内存等指标,可据此判断端侧多语言检索的落地空间。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API。新 API 能力包括 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:OpenAI 发布语音到语音新模型并扩展 Realtime API,读者可了解语音交互能力与接口支持的变化。
OpenAI 发布 GPT-5,称其为公司目前最先进的模型,面向企业 AI、自动化和劳动力生产力场景。
OpenAI 在 API 平台推出 GPT-5,主打高推理性能、面向开发者的新控制项,以及在真实编码任务上的领先结果。
推荐理由:OpenAI 在 API 平台上线 GPT-5,开发者可据此了解新模型在推理与真实编码任务上的定位。
OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。官方表示 GPT-5 在编码、数学、写作、健康、视觉感知等方面达到当前最优表现。
推荐理由:OpenAI 官方公布 GPT-5 的定位与能力覆盖范围,可据此了解其相对前代模型的提升方向。
OpenAI 发布 GPT-5,并展示一组领先开发者首次使用该模型的过程。
OpenAI 发布 GPT-5 系统卡,说明其通过统一模型路由系统实现快速与智能的响应。该系统调用 gpt-5-main、gpt-5-thinking 以及 gpt-5-thinking-nano 等轻量版本,针对不同任务和开发者用途做优化。
推荐理由:系统卡披露 GPT-5 用统一路由在 gpt-5-main、gpt-5-thinking 与轻量版本间分配任务,可了解其能力分层思路。
OpenAI 发布其能力最强的开放权重模型,称这是让先进 AI 更开放、灵活并覆盖全球的一步。官方表示,其使命是让尽可能多的人用上 AI,此次发布是朝这一方向的重要进展。
推荐理由:OpenAI 官方说明开放权重模型发布,读者可了解其开放与可及性主张。
OpenAI 发布 gpt-oss-120b 与 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可。官方称其在推理任务上优于同规模开放模型,具备较强工具调用能力,并针对消费级硬件的高效部署做了优化。
推荐理由:OpenAI 开放权重模型以 Apache 2.0 发布,读者可据此判断消费级硬件部署与工具调用的可行边界。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重推理模型,采用 Apache 2.0 许可,并适用 gpt-oss 使用政策。
推荐理由:OpenAI 公开两款开放权重推理模型的许可与使用政策,可据此了解其开放范围与使用条件。
Hugging Face 博客发文欢迎 OpenAI 推出新的开源模型家族 GPT OSS。
Mistral AI 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 协议开源并上线自家 API。模型支持 32k token 上下文,可处理最长 30 分钟音频转写或 40 分钟音频理解,具备内置问答与摘要、多语言自动检测和语音触发函数调用能力,并保留 Mistral Small 3.1 的文本能力。
推荐理由:官方给出两款语音理解模型的尺寸、开源协议与 API 定价,可对照 Whisper、GPT-4o mini 等基准判断其成本位置。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并升级 Devstral Small 1.1。
推荐理由:Mistral 与 All Hands AI 合作发布两款编码智能体模型,读者可据此了解开源编码模型在 SWE-Bench Verified 上的最新位置与定价。
Hugging Face 博客宣布 Gemma 3n 已在开源生态中全面开放。
Mistral AI 发布首款推理模型 Magistral,分为 24B 参数的开源版 Magistral Small 和企业版 Magistral Medium。
推荐理由:Mistral 首款推理模型同时给出开源权重与企业版,并公开训练与强化学习细节,便于对比其推理路线。