Reflection 发布开源模型 Beam,主打低算力下的编码与智能体能力
AI 公司 Reflection 发布首个免费开放模型 Beam,采用 501B 总参数、每 token 激活 23B 的 MoE 架构,主打编码、逻辑推理和智能体任务,以更低算力对标 DeepSeek 和 Qwen 等中国开源模型。
AI 公司 Reflection 发布首个免费开放模型 Beam,采用 501B 总参数、每 token 激活 23B 的 MoE 架构,主打编码、逻辑推理和智能体任务,以更低算力对标 DeepSeek 和 Qwen 等中国开源模型。
Reflection 宣布推出 Beam,一个 501B 总参数 / 23B 激活参数的纯文本 MoE 模型,面向编码、智能体和科学任务,从零训练,完整权重采用 Apache 2.0 并将于本月发布。
Z.ai(智谱 AI)的 GLM 5.3 现已上线 Amazon Bedrock,这是一款 753B 参数 MoE 模型,面向编码与长程智能体任务,可通过全托管 API 使用,支持跨区域推理、prompt caching 和服务层级。
推荐理由:原文给出接入方式、缓存配置和完整实测流程,可直接照做部署与成本优化。
如果你常驻终端,这条就是为你准备的。 看看如何用 Codex CLI 通过语音启动任务、跨项目管理智能体,以及在独立 worktree 中探索另一个方向。
Reflection AI 发布首个前沿开源权重模型 Beam,称其在高级推理基准上比肩 Z.ai 的 GLM-5.2 等中国领先开源模型,且推理算力消耗低 3-4 倍。
Computer 能构建一个简单的浏览器游戏来原型验证想法。 使用 Light effort 模式,它仅用 97 credits 就构建了这个飞行模拟器。
AWS 发布教程,介绍如何在 AWS GovCloud (US) 的 Amazon Bedrock 上使用 Claude Code 支撑带合规要求的工作负载。
后台子智能体现在会回传结果。 其结果会作为同一运行中的后续轮次返回给父智能体,因此 `stream()` 和 `wait()` 会持续执行,直到每个子智能体完成。
Cursor 官方宣布 SDK 智能体现在可在运行过程中被引导。新增的 run.steer() 会把用户消息加入下一轮执行;若子智能体正在执行任务,它会转入后台并继续工作。
Cursor 官方宣布用户可以用自己的提示词替换 Cursor 的系统提示词,Rules、skills 和 tool schemas 仍会照常加载。该功能正在按账号逐步开放。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放基准,研究预览版现已上线。
Ship 可以在 pull request 上运行,通过测试部署应用中受变更影响的用户流程,在发布前发现回归问题。 试用一下 👀 ship.contextqa.com
推荐理由:编辑精选:介绍通过共享工具协调的无中心编码智能体团队,具有明确的工程实现与评测场景。论文转述尚未提供大团队成本,不能仅凭得分判断性价比。
在接下来的28天里,我们每天要么发布一项对大多数 codex/work 用户有明显改进且相关的内容,要么进行一次全面重置。让改进开始吧。
DAIR.AI 推荐 Meta 关于可靠自动科研智能体的论文 RankEvolve:它用编译后的协议约束每个研究阶段与关卡,让 Claude Code 和 Codex 作为独立节点互相评审并修复改动。