#行业动态
#行业动态
arena@arenaAI 评分
The DecoderAI 评分Google 内部测试的 Gemini 4 Carbon 模型据称编码性能接近 Anthropic Opus 5.5
据 Business Insider 看到的文件、截图和内部聊天,Google 正在测试 Gemini 4 的 Argon、Barium、Carbon 多个变体,Carbon 已部署在内部编码平台 Jetski,据称在编程任务上胜过 Argon,有员工将其与 Anthropic 最强编码模型 Opus 5.5 相比,但仍需更多测试。
Latent SpaceAI 评分OpenAI 公开内部模型 722 篇数学论文,解决 90 个顶级开放问题
OpenAI 在公开 GitHub 仓库发布其内部前沿模型产出的 722 篇数学手稿,归为 372 组相关结果,据称解决了 top 500 开放数学问题中的约 90 个,其中 Result 003 即 Quasi-Riemann Hypothesis 被评为分量介于 Fields Medal 与数论 200 年最大成果之间。
rohanpaul_ai@rohanpaul_aiAI 评分
SemiAnalysis_@SemiAnalysis_精选AI 评分 我们此前在 WAIC 2026 总结中报道过真武 M890,当时更仔细地看了这款芯片的版图。真武 M890 芯片采用 4 组 HBM3E 12-Hi,配备 2 个计算 die。(2/3)
推荐理由:编辑精选:SemiAnalysis 报道给出真武 V900 的显存、互连规格及计划出货时间,便于跟踪国产 AI 算力进展;三倍性能属于厂商宣称,仍需独立实测验证。
arena@arena精选AI 评分 推荐理由:原文给出了排名、净提升幅度与单任务成本的对比,读者可据此权衡新模型的能力增益与代价。
OpenAI News精选AI 评分 OpenAI 将于 2026 年 2 月 13 日在 ChatGPT 中退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini
OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini,与此前已公布的 GPT-5(Instant、Thinking 和 Pro)退役同步进行。API 目前没有变化。
推荐理由:OpenAI 公布 ChatGPT 中多款旧模型的退役时间表,读者可据此安排现有应用的模型迁移。
OpenAI News精选AI 评分 OpenAI 回滚 GPT-4o 更新:因过度迎合用户
OpenAI 已回滚上周在 ChatGPT 中推送的 GPT-4o 更新,用户现在使用的是行为更平衡的早期版本。被移除的更新表现为过度奉承或迎合,常被描述为 sycophantic。
推荐理由:OpenAI 官方说明 GPT-4o 更新因过度迎合被回滚,读者可了解这次行为异常的处理方式。
OpenAI News精选AI 评分 OpenAI Five 基准赛三局两胜击败 99.95 百分位 Dota 玩家队伍
OpenAI Five 在与 Blitz、Cap、Fogged、Merlini、MoonMeander 组成的 99.95 百分位 Dota 玩家队伍的三局两胜比赛中获胜,其中四人曾打过职业 Dota。比赛在直播观众面前进行,同时在线观看人数达 10 万。