全部AI 动态
全部动态
arcprize@arcprizeAI 评分 arcprize@arcprizeAI 评分 arcprize@arcprizeAI 评分 ARC Prize 指出 GPT-6.1 Sol 与 GPT-6 Astra 类似,在 ARC-AGI-3 上推理等级越高决策越好,完成关卡所需动作越少,从而降低总推理成本。
ClaudeDevs@ClaudeDevsAI 评分 Claude.dev 是我们为使用 Claude 构建的开发者打造的新主页。 你将在这里找到工程深度解析、Claude Code 和 API 指南、Claude 构建团队的技巧,以及一些有趣的彩蛋。
Ars Technica · AIAI 评分Google 发布 Gemini 4 Argon 模型,暂未对外开放使用
Google 发布 Gemini 4 Argon 模型,宣称在编码、知识工作和网络安全方面具备行业领先性能,但目前仅限公司内部有限测试,外部用户尚不能使用。
andonlabs@andonlabsAI 评分 X:Ethan Mollick (@emollick)AI 评分 Gemini 4 Argon 发布,先向网络防御方开放
Gemini 4 Argon 作为新的前沿模型发布,从今天起先向网络防御方(cyber defenders)开放,之后会尽快扩大范围。介绍价定为输入 $2、输出 $10。发布者称竞争再次回到三方格局。
OfficialLoganK@OfficialLoganKAI 评分 Google 内部众多同事为打造这个模型付出了大量工作,看到这里的进展令人惊叹,而这仅仅是个开始!迫不及待想让更多人用上 Gemini 4 Argon。
ammaar@ammaarAI 评分 GoogleAI@GoogleAI精选AI 评分 推荐理由:原文说明了该模型面向的三类复杂工作流场景和输出上限,读者可据此判断它对长任务工作流的适配程度。
GoogleAI@GoogleAIAI 评分 ValsAI@ValsAIAI 评分 Gemini 首次登上 Vals Index 榜首。 Gemini 4 Argon 以 68.9% 占据 Vals Index 第 1 名。
Google@Google精选AI 评分 Google 宣布 Gemini 4 Argon 是其前沿智能的下一个时代,在多项基准测试上取得显著提升,并在真实世界的长程软件工程任务上树立了新的 state of the art。
Google@GoogleAI 评分 Google@Google精选AI 评分 Google 宣布推出 Gemini 4 Argon,称其在复杂工作流中具备前沿性能,覆盖真实世界的软件工程、知识工作和网络安全防御,并拥有业界领先的 1M token 输出上限。
GoogleDeepMind@GoogleDeepMindAI 评分 GoogleDeepMind@GoogleDeepMindAI 评分 OfficialLoganK@OfficialLoganKAI 评分 Google 发布新前沿模型 Gemini 4 Argon,即日起向网络安全防御者(cyber defenders)开放,并将尽快更广泛推出。Argon 介绍期定价为输入 $2、输出 $10。
sundarpichai@sundarpichaiAI 评分 sundarpichai@sundarpichaiAI 评分
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 4 Argon 前沿模型
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后将逐步面向开发者、企业和消费者推出,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:Gemini 4 Argon 的 1M 输出 token 与多项基准成绩,展示了长程复杂任务上的能力边界变化。
turbopuffer@turbopufferAI 评分 jameygannon@jameygannonAI 评分 LumaLabsAI@LumaLabsAIAI 评分 _akhaliq@_akhaliqAI 评分 我将于 10 月 16 日在旧金山 Midway 参加 Hugging Face Open Together 活动 报名地址:luma.com/OpenTogether
Ars Technica · AIAI 评分RFK Jr. 称 AI 将让美国人摆脱医学事实与专家权威的“暴政”
美国卫生部长 Robert F. Kennedy 在 MAHA 活动上称 AI 将让美国人摆脱医生和卫生专家的“医疗暴政”,并建议用 AI 获取医疗第二意见,声称 AI“比全国任何医生都更了解情况”。他举例称 AI 可能反驳口罩、社交距离和疫苗能预防传播的说法,但 Gemini 和 ChatGPT 均回答口罩和社交距离确实能减少传染病传播。
X:Peter Steinberger (@steipete)AI 评分 DevDay 未公开环节:可把 OpenAI 研究员"带回家"
DevDay 上有一项未广泛宣传的安排:参会者可以把 OpenAI 研究员"带回家",前提是你能搬得动。该内容由 @LLMJunky 于 9 月 30 日发布,Peter Steinberger 转发。
AravSrinivas@AravSrinivasAI 评分 ericzakariasson@ericzakariassonAI 评分 midjourney@midjourneyAI 评分 Midjourney 每周办公时间 - 9/30 x.lingyaoai.com/i/spaces/1nxeLMvZvQrJX
polynoamial@polynoamialAI 评分 perplexity_ai@perplexity_aiAI 评分 在 Hugging Face 上查看 pplx-embed-v2-context-9b-preview: huggingface.co/perplexity-ai…
perplexity_ai@perplexity_aiAI 评分 perplexity_ai@perplexity_aiAI 评分 bot@botAI 评分 我们还将工程团队的 Bots 作为模板分享,供你安装。 每个模板都附带技能、例程和连接器,助你快速上手。 x.ai/bot/marketplace/enginee…
bot@botAI 评分 Grok Bot 宣布增强软件构建能力,机器人可将编码任务交接给 Cursor,通过 GitHub 和 Origin 插件管理 PR,并分享其构建成果的视频演示。
OpenAI@OpenAIAI 评分 MiniMax_AI@MiniMax_AIAI 评分 X:Ethan Mollick (@emollick)AI 评分 Ethan Mollick:AI 智能体将用语音/聊天替用户谈判,客服系统面临冲击
Ethan Mollick 指出,各公司的客服智能体即将被 Dots & Muses 等 AI 智能体淹没,它们通过语音/聊天为用户争取更优价格。人们把这类工作交给智能体并省下钱的案例正在涌现,并将愈发病毒式传播。这些智能体可使用为人类搭建的渠道,忍受电话树、等待接通或被拒后反复重试。
claudeai@claudeaiAI 评分 报名旧金山:anthropic.com/events/claude-… 报名斯德哥尔摩:anthropic.com/events/claude-…