ArtificialAnlys@ArtificialAnlysAI 评分
Latent Space精选AI 评分Google DeepMind 发布 Gemini 4 Argon,支持 1M token 输出
Google DeepMind 推出 Gemini 4 Argon,面向编码、企业知识工作与网络防御,首批开放给 Fairwind 计划的政府用户与可信网络安全人员,后续再向开发者、企业和消费者开放。
推荐理由:汇总了 Gemini 4 Argon 的基准、定价与可用范围,并列出同期多家模型与工具的动态,便于横向比较。
arena@arenaAI 评分 dongxi_nlp@dongxi_nlpAI 评分 demishassabis@demishassabisAI 评分 thoughtfullab@thoughtfullabAI 评分 arena@arenaAI 评分 karinanguyen@karinanguyenAI 评分 Gemini 4 在 PostTrainBench 上达到 45.3%,是 Gemini 3.1 Pro 21.99% 的两倍多,并超过 GPT-6 Astra 🔥
joshwoodward@joshwoodwardAI 评分 arena@arenaAI 评分 Gemini 4 Argon (High) 在 Text Arena 以 1525 分排名第一,在 Code Arena: WebDev 以 1679 分排名第八。
aipulseda1ly@aipulseda1lyAI 评分 ArtificialAnlys@ArtificialAnlys精选AI 评分 推荐理由:原文给出智能指数、成本和幻觉率的横向对比,读者可据此判断新模型相对竞品的性价比位置。
Ars Technica · AIAI 评分Google 发布 Gemini 4 Argon 模型,暂未对外开放使用
Google 发布 Gemini 4 Argon 模型,宣称在编码、知识工作和网络安全方面具备行业领先性能,但目前仅限公司内部有限测试,外部用户尚不能使用。
andonlabs@andonlabsAI 评分 X:Ethan Mollick (@emollick)AI 评分 Gemini 4 Argon 发布,先向网络防御方开放
Gemini 4 Argon 作为新的前沿模型发布,从今天起先向网络防御方(cyber defenders)开放,之后会尽快扩大范围。介绍价定为输入 $2、输出 $10。发布者称竞争再次回到三方格局。
OfficialLoganK@OfficialLoganKAI 评分 Google 内部众多同事为打造这个模型付出了大量工作,看到这里的进展令人惊叹,而这仅仅是个开始!迫不及待想让更多人用上 Gemini 4 Argon。
ammaar@ammaarAI 评分 GoogleAI@GoogleAI精选AI 评分 推荐理由:原文说明了该模型面向的三类复杂工作流场景和输出上限,读者可据此判断它对长任务工作流的适配程度。
ValsAI@ValsAIAI 评分 Gemini 首次登上 Vals Index 榜首。 Gemini 4 Argon 以 68.9% 占据 Vals Index 第 1 名。
Google@Google精选AI 评分 Google 宣布 Gemini 4 Argon 是其前沿智能的下一个时代,在多项基准测试上取得显著提升,并在真实世界的长程软件工程任务上树立了新的 state of the art。
Google@GoogleAI 评分 Google@Google精选AI 评分 Google 宣布推出 Gemini 4 Argon,称其在复杂工作流中具备前沿性能,覆盖真实世界的软件工程、知识工作和网络安全防御,并拥有业界领先的 1M token 输出上限。
GoogleDeepMind@GoogleDeepMindAI 评分 GoogleDeepMind@GoogleDeepMindAI 评分 OfficialLoganK@OfficialLoganKAI 评分 Google 发布新前沿模型 Gemini 4 Argon,即日起向网络安全防御者(cyber defenders)开放,并将尽快更广泛推出。Argon 介绍期定价为输入 $2、输出 $10。
sundarpichai@sundarpichaiAI 评分
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 4 Argon 前沿模型
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后将逐步面向开发者、企业和消费者推出,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:Gemini 4 Argon 的 1M 输出 token 与多项基准成绩,展示了长程复杂任务上的能力边界变化。
Google DeepMind精选AI 评分Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使其在数字模型和合成出的实体蛋白质上均可验证,同时保持生物功能。
推荐理由:原文给出了水印嵌入方式与湿实验验证结果,读者可据此判断AI生成生物设计的溯源路径。
Latent SpaceAI 评分AINews:Opus 5.5 擅长生成讲解视频
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后在讲解视频生成上表现突出,SimpleBench 达 88.4%,被 @skalskip92 评为 Anthropic 迄今最强视觉模型。
GoogleAI@GoogleAIAI 评分
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色语音设计与逐行表演导演,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:官方给出两款 TTS 模型的语音设计、逐行导演能力与基准排名,可据此判断语音生成工作流的变化。
ArtificialAnlys@ArtificialAnlysAI 评分 OfficialLoganK@OfficialLoganKAI 评分 GoogleAI@GoogleAI精选AI 评分 Google 发布迄今最先进的 Gemini 音频模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。
推荐理由:原文区分了两个版本的定位差异,读者可据此判断日常对话与复杂任务该选哪一个。
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking
Google DeepMind 发布两款实时对话模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,前者面向规模化与成本效率,后者面向高复杂度任务与多步推理。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,可据此判断实时语音智能体的能力水位与成本取舍。
GoogleDeepMind@GoogleDeepMind精选AI 评分
Google DeepMind精选AI 评分Google DeepMind 发布 WeatherNext 3 全球天气 AI 模型
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为目前最先进的全球天气 AI 模型,可直接学习实时卫星观测数据,逐小时生成预报。
推荐理由:WeatherNext 3 把实时卫星数据与逐小时更新纳入全球天气预报,读者可据此了解 AI 气象模型在分辨率与降水精度上的进展。
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber
Google DeepMind 发布 Gemini 3.8,包含通用模型 Gemini 3.8 Flash 和网络安全模型 Gemini 3.8 Flash Cyber,定价与 3.7 Flash 相同,为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元。
推荐理由:官方给出 3.8 Flash 与 Cyber 两个变体的基准成绩、定价和开放入口,可据此判断长程编码与漏洞修复的可用性。
sundarpichai@sundarpichaiAI 评分 sundarpichai@sundarpichaiAI 评分