跳到正文

#编码

今日 18 条
10月3日周六
10月2日周五
  1. GitHub Blog · AI & ML22

    AI 正在改变开发者工作,GitHub 给出三项需要强化的技能

    GitHub 提出 AI 时代开发者应强化的三项技能:学会指挥 AI 智能体而非仅使用它、不轻信 AI 的首次回答、用 AI 节省的时间去解决更大的问题。文中以 GitHub Copilot 内置的 Rubber Duck agent 为例,说明它用第二个模型对计划、代码和测试进行批判性审查,以发现首个模型遗漏的问题。

10月1日周四
  1. GoogleAI74

    Google 官方宣布推出新前沿模型 Gemini 4 Argon,面向复杂、长周期工作流的持续深度推理,在真实软件工程、法律与金融等企业知识工作以及网络安全防御场景提供前沿性能。同时,该模型的输出 token 上限扩展至行业领先的 1M tokens。Argon 目前正向 Fairwind Program 中的一批可信网络安全防御者开放,将尽快扩大可用范围。

    推荐理由:原文说明了该模型面向的三类复杂工作流场景和输出上限,读者可据此判断它对长任务工作流的适配程度。

9月30日周三
  1. AWS Machine Learning Blog74

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,每任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比。