跳到正文

#产品更新

今日 15 条
10月9日周五
  1. lifegetsdicey38

    OpenClaw 创始人 steipete 在炉边对谈中提出反对"快速频繁发布"的观点,指出早期版本体验不佳的用户很难被后续改进挽回。他强调首发质量门槛很重要,因为第一印象极其持久,人们倾向于坚持自己已有的看法。他以自己为例:尽管 @stanforcrearts 团队的 AI 视频编辑器 Stanley Studio 已大幅改进,他仍因早期试用时功能缺失而坚持手动剪辑视频。

  2. Weyaxi59

    Weyaxi 团队发布 TermGrade,这是一套面向终端智能体的高质量 RL 环境,完全开源,同时公开构建与评分的完整过程以及所用的 RL 训练配方。该数据集包含 1k 个可执行环境,每个都经执行验证并对照 6 个模型评分,附带支撑评分的全部 36k 条轨迹(含失败样本)。作者称用这些任务训练 gemma-4-31B-it,在其原本能解出一半的任务上使 Terminal-Bench 2.1 提升 +3.1。

  3. sundarpichai70

    Sundar Pichai 宣布在 Gemini at Work 活动上推出新的 Gemini agent,一个面向工作的统一智能体,可从单一提示框回答问题、处理知识工作、生成图像媒体并编写和运行代码,且接入个人工作流、记录系统和企业管控。

    推荐理由:原文逐条列出统一智能体、持久执行、多智能体编排等架构原则,读者可据此判断它与现有工作助手的差异。

  4. TechCrunch · AI58

    Anthropic 更新使用政策,禁止虐待模型与干预选举

    Anthropic 于周四更新使用政策,新增禁止干预选举、武器软件和监控相关用途,并明确禁止对模型进行长时间言语虐待。政策说明称该条款仅适用于用户反复无故残忍对待模型的极端情形,不涵盖常见的用户沮丧、反驳、暗黑创作主题或模型测试研究。政策另设章节禁止欺骗性行动、用 Claude 运营虚假账号或伪造新闻机构,以及欺骗选民或扰乱选举。