跳到正文

#编码

今日 14 条
8月7日周四
7月30日周三
  1. Mistral AI62

    Mistral 发布 Codestral 25.08 与企业级完整编码栈

    Mistral 发布 Codestral 25.08,并推出覆盖补全、语义检索与智能体工作流的企业级编码栈。Codestral 25.08 相比此前版本接受的补全增加 30%,建议后保留代码增加 10%,失控生成减少 50%。

    推荐理由:原文给出 Codestral 25.08 的补全提升数据与整套企业编码栈的部署方式,读者可据此判断私有化落地的可行路径。

7月11日周五
6月4日周三
  1. Mistral AI60

    Mistral 推出企业级编码助手 Mistral Code,开启 JetBrains 与 VSCode 私测

    Mistral 发布企业级 AI 编码助手 Mistral Code,将模型、IDE 插件、本地部署选项和企业工具打包为一体化方案,基于开源项目 Continue 构建,今日面向 JetBrains IDE 和 VSCode 开放私测,正式版计划随后推出。

    推荐理由:Mistral 把编码模型、IDE 插件与企业管控打包成可本地部署的方案,读者可据此判断企业级编码助手的落地路径。

5月28日周三
5月22日周四
5月21日周三
5月16日周五
  1. OpenAI News58

    OpenAI 发布 o3 与 o4-mini 系统卡补充文件:Codex

    OpenAI 发布 o3 和 o4-mini 系统卡的补充文件,对象是云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本,通过强化学习在多种环境的真实编码任务上训练,目标是生成贴近人类风格和 PR 偏好的代码、精确遵循指令,并反复运行测试直至通过。

5月7日周三
4月14日周一
  1. OpenAI News78

    OpenAI 在 API 中上线 GPT-4.1 系列模型

    OpenAI 在 API 中推出 GPT-4.1 系列模型,官方称其在编码、指令遵循和长上下文理解上全面提升,并同步发布首个 nano 模型,即日起面向全球开发者开放。

    推荐理由:OpenAI 在 API 上线 GPT-4.1 系列,并首次推出 nano 版本,可据此了解新模型在编码与长上下文上的能力定位。

2月18日周二
1月13日周一
9月12日周四
8月13日周二
7月24日周三
  1. Mistral AI78

    Mistral AI 发布 Mistral Large 2,123B 参数、128k 上下文

    Mistral AI 发布 Mistral Large 2,参数规模 123B,支持 128k 上下文窗口和数十种语言,可在单节点上以较大吞吐运行。官方称其在 MMLU 上准确率达 84.0%,代码与推理表现与 GPT-4o、Claude 3 Opus、Llama 3 405B 相当,并针对减少幻觉和遵循精确指令做了训练。

    推荐理由:原文给出 123B 参数、128k 上下文与多项基准对比,可据此判断单节点部署的成本与能力边界。

7月16日周二
6月18日周二
  1. OpenAI News18

    Paf 用自定义 GPT 提升开发者生产力

    Paf 在全公司部署 ChatGPT Enterprise,工程师每天用自定义 GPT 加速日常开发任务,并将 ChatGPT Enterprise 接入 grit:lab 编程学院,让学员从第一天起就以 AI 增强的系统架构思维学习。目前 Paf 有 70% 员工活跃使用 ChatGPT Enterprise,覆盖财务、HR、市场和客户支持等业务团队。

5月29日周三
  1. Mistral AI74

    Mistral 发布首个代码模型 Codestral,22B 参数支持 80+ 编程语言

    Mistral AI 发布首个代码模型 Codestral,这是一个 22B 的开源权重生成式模型,专门面向代码生成任务,支持 80+ 编程语言,包括 Python、Java、C、C++、JavaScript 和 Bash。

    推荐理由:Mistral 首个代码模型给出了 22B 参数、32k 上下文与多语言基准对比,可据此判断其代码补全定位。

5月24日周五
  1. Hugging Face Blog43

    Meta 发布 CyberSecEval 2:大语言模型网络安全风险与能力评估框架

    Meta 推出 CyberSecEval 2,从代码解释器滥用、攻击性网络安全能力和提示注入攻击三方面评估 LLM 的网络安全风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率已从 52% 降至 28%。测试显示提示注入仍是未解难题,LLM 目前也难以可靠完成端到端漏洞利用挑战。

4月29日周一
4月17日周三
4月16日周二
4月9日周二
  1. Hugging Face Blog62

    Google 发布 CodeGemma 系列代码模型,含 2B 与 7B 三个版本

    Google 发布 CodeGemma 系列开源代码模型,包含 2B 基础模型、7B 基础模型和 7B Instruct 三个版本,基于预训练的 2B 和 7B Gemma checkpoint 额外训练 5000 亿 token 的英文、数学和代码数据。

    推荐理由:Google 与 Hugging Face 联合发布三个开源代码模型,读者可对照 HumanEval 等基准数据判断其与同尺寸模型的差距。

3月15日周五
  1. Hugging Face Blog41

    Hugging Face 发布 WebSight 数据集,用截图生成 HTML 代码

    Hugging Face 推出 WebSight 数据集,用于训练 AI 将网页截图转换为 HTML 代码。该数据集从 v0.1 的 82.3 万对 HTML 与截图样本扩展至 v0.2 的 200 万例,改用真实图像截图并切换至 Tailwind CSS。基于该数据集微调的视觉语言模型 Sightseer 可将网页截图转为可用的 HTML 代码,并能在生成结果中嵌入与原截图相近的图像。

2月28日周三
8月25日周五
5月4日周四
5月24日周二
3月15日周二
8月10日周二