跳到正文

#模型发布

今日 0 条
12月11日周四
  1. OpenAI News70

    OpenAI 发布 GPT-5.2,在数学与科学基准上刷新成绩

    OpenAI 发布 GPT-5.2,称其为目前数学与科学能力最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上取得新的 SOTA 结果。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。

    推荐理由:原文给出 GPT-5.2 在 GPQA Diamond 与 FrontierMath 上的新结果,读者可据此了解其在数学与科研任务上的能力边界。

  2. OpenAI News66

    OpenAI 更新 GPT-5 系统卡,纳入 GPT-5.2

    OpenAI 发布 GPT-5 系统卡更新,将 GPT-5.2 纳入 GPT-5 系列,成为该系列最新模型家族。GPT-5.2 的综合安全缓解方案与 GPT-5 系统卡、GPT-5.1 系统卡中描述的基本一致。与 OpenAI 其他模型一样,GPT-5.2 的训练数据包括互联网公开信息、通过第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。

    推荐理由:GPT-5.2 系统卡更新说明其安全缓解方案延续 GPT-5 与 GPT-5.1 的框架,可对照前代了解安全策略的连续性。

  3. OpenAI News82

    OpenAI 发布 GPT-5.2 前沿模型

    OpenAI 发布 GPT-5.2,称其为面向日常专业工作最先进的前沿模型,具备最先进的推理、长上下文理解、编码和视觉能力。该模型可在 ChatGPT 和 OpenAI API 中使用,用于支撑更快、更可靠的智能体工作流。

    推荐理由:OpenAI 公布 GPT-5.2 在推理、长上下文、编码与视觉上的定位,读者可据此判断日常专业工作与智能体流程的升级方向。

12月9日周二
  1. Mistral AI78

    Mistral 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布新一代编码模型家族 Devstral 2,包含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者均为开源模型,分别采用修改版 MIT 和 Apache 2.0 许可。

    推荐理由:官方给出两款开源编码模型的参数、许可与 SWE-bench 成绩,并附与闭源模型的对比,便于判断开源编码模型的当前水位。

12月3日周三
11月24日周一
11月20日周四
  1. Google DeepMind74

    Google DeepMind 发布 Gemini 3 Pro Image(Nano Banana Pro)图像模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),这是基于 Gemini 3 Pro 构建的高保真图像生成与编辑模型,已在 Google AI Studio 和 Vertex AI 面向企业以付费预览形式逐步开放。

    推荐理由:Google DeepMind 发布 Gemini 3 Pro Image,开发者可据此了解其分辨率、文本渲染与 Google 搜索接地等能力边界。

  2. Google DeepMind84

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像生成与编辑模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建,主打更强推理与世界知识、图像内多语言文字渲染,以及最多融合 14 张图像、保持 5 人一致性的编辑能力,支持 2K 和 4K 分辨率与多种画幅。

    推荐理由:官方给出 Nano Banana Pro 的能力边界与各产品上线节奏,读者可据此判断图像生成在自身工作流中的可用性。

11月19日周三
  1. OpenAI News74

    OpenAI 发布 GPT-5.1-Codex-Max 智能体编码模型

    OpenAI 发布 GPT-5.1-Codex-Max,一款面向 Codex 的更快、更智能的智能体编码模型。该模型面向长时间、项目级任务设计,具备更强的推理能力和 token 效率。

    推荐理由:OpenAI 发布面向 Codex 的智能体编码模型,读者可了解其在长时任务与 token 效率上的定位。

  2. Google DeepMind92

    Google DeepMind 发布 Gemini 3 Pro,并推出 Gemini 3 Deep Think 与 Antigravity 平台

    Google DeepMind 发布 Gemini 3,首发 Gemini 3 Pro 预览版,同步上线 Gemini app、Search 的 AI Mode、AI Studio、Vertex AI、Gemini CLI 及新智能体开发平台 Google Antigravity。

    推荐理由:官方给出 Gemini 3 Pro 在推理、多模态与编码基准上的具体分数和上线渠道,可据此判断能力代际变化。

11月17日周一
11月13日周四
  1. OpenAI News78

    OpenAI 在 API 上线 GPT-5.1

    OpenAI 在 API 中上线 GPT-5.1,带来更快的自适应推理、扩展的提示词缓存和改进的编码表现。该版本还新增 apply_patch 和 shell 工具。

    推荐理由:GPT-5.1 在 API 上线,给出推理速度、缓存与编码能力变化,开发者可据此评估迁移。

11月12日周三
10月29日周三
10月28日周二
9月30日周二
  1. OpenAI News65

    OpenAI 发布 Sora 2 视频与音频生成模型系统卡

    OpenAI 发布新一代视频与音频生成模型 Sora 2,并公布其系统卡。相比此前的 Sora,新模型在物理准确性、真实感、音频同步、可控性和风格范围上有所提升,官方称这些能力是此前视频模型难以实现的。

    推荐理由:官方系统卡披露 Sora 2 在物理准确性、同步音频与可控性上的能力变化,可据此了解视频生成的新边界。

9月15日周一
  1. OpenAI News62

    OpenAI 发布 GPT-5 系统卡增补:GPT-5-Codex

    OpenAI 发布 GPT-5 系统卡增补,介绍新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编码进一步优化的版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂任务则独立工作更长时间。

    推荐理由:GPT-5 系统卡增补披露了面向 Codex 智能体编码优化的 GPT-5-Codex,可了解其动态思考机制。

9月12日周五
9月9日周二
9月4日周四
  1. Hugging Face Blog60

    Google 发布 EmbeddingGemma 多语言嵌入模型

    Google 发布 EmbeddingGemma,一个 308M 参数、2K 上下文窗口、支持 100 多种语言的多语言嵌入模型,面向端侧场景,量化后内存占用低于 200MB。

    推荐理由:原文给出 308M 参数、2K 上下文与量化后 200MB 内存等指标,可据此判断端侧多语言检索的落地空间。

8月28日周四
8月22日周五
8月21日周四
8月7日周四
  1. OpenAI News82

    OpenAI 在 API 平台推出 GPT-5

    OpenAI 在 API 平台推出 GPT-5,主打高推理性能、面向开发者的新控制项,以及在真实编码任务上的领先结果。

    推荐理由:OpenAI 在 API 平台上线 GPT-5,开发者可据此了解新模型在推理与真实编码任务上的定位。

  2. OpenAI News82

    OpenAI 发布 GPT-5

    OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。官方表示 GPT-5 在编码、数学、写作、健康、视觉感知等方面达到当前最优表现。

    推荐理由:OpenAI 官方公布 GPT-5 的定位与能力覆盖范围,可据此了解其相对前代模型的提升方向。

  3. OpenAI News82

    OpenAI 发布 GPT-5 系统卡,披露统一模型路由机制

    OpenAI 发布 GPT-5 系统卡,说明其通过统一模型路由系统实现快速与智能的响应。该系统调用 gpt-5-main、gpt-5-thinking 以及 gpt-5-thinking-nano 等轻量版本,针对不同任务和开发者用途做优化。

    推荐理由:系统卡披露 GPT-5 用统一路由在 gpt-5-main、gpt-5-thinking 与轻量版本间分配任务,可了解其能力分层思路。

8月5日周二
  1. OpenAI News62

    OpenAI 发布开放权重模型,推进 AI 普及

    OpenAI 发布其能力最强的开放权重模型,称这是让先进 AI 更开放、灵活并覆盖全球的一步。官方表示,其使命是让尽可能多的人用上 AI,此次发布是朝这一方向的重要进展。

    推荐理由:OpenAI 官方说明开放权重模型发布,读者可了解其开放与可及性主张。

  2. OpenAI News85

    OpenAI 发布 gpt-oss-120b 与 gpt-oss-20b 开放权重模型

    OpenAI 发布 gpt-oss-120b 与 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可。官方称其在推理任务上优于同规模开放模型,具备较强工具调用能力,并针对消费级硬件的高效部署做了优化。

    推荐理由:OpenAI 开放权重模型以 Apache 2.0 发布,读者可据此判断消费级硬件部署与工具调用的可行边界。

7月15日周二
  1. Mistral AI74

    Mistral 发布 Voxtral 语音理解模型,24B 与 3B 双版本 Apache 2.0 开源

    Mistral AI 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 协议开源并上线自家 API。模型支持 32k token 上下文,可处理最长 30 分钟音频转写或 40 分钟音频理解,具备内置问答与摘要、多语言自动检测和语音触发函数调用能力,并保留 Mistral Small 3.1 的文本能力。

    推荐理由:官方给出两款语音理解模型的尺寸、开源协议与 API 定价,可对照 Whisper、GPT-4o mini 等基准判断其成本位置。