#编码
#编码
Azaliamirh@AzaliamirhAI 评分 bcherny@bchernyAI 评分 ClaudeDevs@ClaudeDevsAI 评分 cursor_ai@cursor_aiAI 评分 cursor_ai@cursor_aiAI 评分 cursor_ai@cursor_aiAI 评分 推出 Rollouts。 Rollouts 先编写监控计划,然后在部署时监控变更。 部署经过验证,回归问题会在用户看到之前被捕捉到。
cursor_ai@cursor_aiAI 评分 我们将 Cursor 的 token 成本降低了 7%,且智能体质量没有下降。 节省来自更紧凑的提示词、选择性工具加载、更好的缓存和压缩的文件读取。
cursor_ai@cursor_aiAI 评分
Latent Space精选AI 评分Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna 并降价 40-50%
Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 家族首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。
推荐理由:汇总了 Claude Opus 5.5 与 GPT-6 Sol/Luna 同日发布的价格、基准与第三方评测数据,便于横向比较两家新模型的定位差异。
Simon WillisonAI 评分 Simon Willison 与 Jesse Vincent 将于 10 月 14 日在旧金山举办 Agentic Engineering 交流活动
Simon Willison 与 Jesse Vincent 将于 10 月 14 日周三晚在旧金山举办一场面向 coding agent 构建者的 Birds of a Feather 交流活动。活动采用非正式 show-and-tell 形式,鼓励分享尚未公开的尝试、奇怪实验和没有明确市场前景的未完成项目,无需正式演讲,也不是产品推介。
bcherny@bchernyAI 评分 bcherny 用 Opus 5.5 借助 Lean 对 Claude Agent SDK 做形式化验证,几条简短提示词换来 16 个修复各类 bug 和竞态条件的 PR。
cursor_ai@cursor_ai精选AI 评分
TencentHunyuan@TencentHunyuanAI 评分 Ronny_MiniMax@Ronny_MiniMaxAI 评分 上一篇文章介绍了 MiniMax Code 背后的 harness。这次我想探讨一个更难的问题:改变 harness 之后,我们如何知道它变得更好了?
SpaceXAI@SpaceXAIAI 评分 Grok 4.7 现已在 Cursor、Grok Build 和 Grok API 上线,官方提供了更多信息链接 x.ai/news/grok-4-7。
SpaceXAI@SpaceXAIAI 评分
Simon WillisonAI 评分 工程师称所在大公司规格、代码与测试全部由 Claude Code 生成
一位工程师称自己入职某大公司半个月,发现这里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队里没人喜欢这种方式,只是被迫尽可能多地交付。管理层多次表示推代码不是瓶颈,质疑为何进度慢,而人们每天工作 12 到 13 个小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没有人阅读任何内容。
GitHub Blog · AI & MLAI 评分GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 代码、RAG 已死、Skills 杀死 MCP?
GitHub Podcast 最新一期逐条拆解了五个 AI 热梗:AI 生成的代码仍需人来负责,只是审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包好的经验,后者是连接工具与数据的标准;RAG 并未消亡,它让模型从训练数据之外获取文档、内部知识和代码库上下文,检索不佳会浪费 token、拖慢速度并增加答案不完整的概率。
RyanLeeMiniMax@RyanLeeMiniMaxAI 评分 MiniMax_AI@MiniMax_AIAI 评分 InfobipShift@InfobipShiftAI 评分 sherwinwu@sherwinwuAI 评分 ChatGPT@ChatGPTAI 评分 ChatGPT 现已集成到 Microsoft Word 中,用户无需离开文档即可把粗略笔记整理成初稿、理顺难写的段落、校对并获取修改建议,还能识别格式问题。
GitHub Blog · AI & ML精选AI 评分GitHub 用 Copilot 将 Copilot 运行时迁移到 Rust
GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体编写了大部分代码,跨 128 个 PR 增量落地,性能提升数个数量级。
推荐理由:GitHub 工程师复盘用 Copilot 把运行时从 TypeScript 迁到 Rust 的全过程,含提示缓存、子智能体分工等可迁移的工程经验。
MetaforDevs@MetaforDevsAI 评分
MSFTResearch@MSFTResearchAI 评分
grok@grokAI 评分 OpenAI NewsAI 评分 Cognition 借助 GPT-6 Astra 让 Devin 测试自己的工作
Cognition 用 GPT-6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付。
cursor_ai@cursor_aiAI 评分 Cursor 官方宣布 Projects 功能即日起开启 beta 并开始逐步推送,更多信息见 cursor.com/blog/projects。
cursor_ai@cursor_aiAI 评分 项目内的 Agents 共享记忆和生成的产物,如计划和演示。这些文件会自动在你的设备和 Agents 的计算机之间同步。
GitHub Blog · AI & MLAI 评分GitHub Copilot 应用新手指南:使用 diff、终端与浏览器面板
GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让开发者无需在编辑器、终端窗口和浏览器之间来回切换,即可完成审查、运行和预览 AI 生成代码的完整闭环。
leerob@leerobAI 评分 leerob@leerobAI 评分 我们刚刚推出了 CursorBench 4.0! 它新增了关于模型如何遵循指令、在长时间内处理复杂项目的任务,并且比以前更难(所以所有模型得分都更低)。
Mistral AIAI 评分
Mistral 如何用 AI 智能体现代化改造复杂遗留代码
Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 迁移至 C++,对象是一个无测试套件、无集中文档的物理密集型油藏模拟器。团队先构建数值一致性校验框架,再用 Vibe CLI 调度上百个智能体解析调用树并生成文档,最终采用人工介入的 coder、tester、reviewer 智能体工作流逐模块迁移。
kim__minseon@kim__minseonAI 评分 cursor_ai@cursor_aiAI 评分 OpenAI NewsAI 评分 GPT-5.6 Sol 如何助力运行量子计算实验
MIT 研究人员使用 GPT-5.6 Sol 配合 Codex 自主运行量子计算实验、分析结果并校准量子比特。
OpenAI NewsAI 评分 1Password 借助 Codex 提升工程效率 21%
1Password 的工程师使用 Codex 快速构建新功能和内部工具,在维持严格安全策略的同时达到生产就绪状态,工程效率提升 21%。