跳到正文

#xAI

今日 14 条
今天10月3日周六
  1. X:Testing Catalog (@testingcatalog)60

    Grok Bot 上线 Primary Bot,可主动管理其他 bot

    Grok Bot 新增 Primary Bot 功能,开始具备主动性,可自行给出建议。用户需要配置一个新的 Primary Bot,或从已有 Bot 中选一个作为 Primary,例如把 Chief of Stuff 设为 Primary。该功能正在逐步推送,Bot prime 已出现在最新的 iOS 应用中。

  2. X:Karina Nguyen(@karinanguyen)41

    Repovive 数学竞赛 AI 判卷评测:GPT 与 Claude 模型评判数学证明的能力对比

    Repovive 联合 IOI、IMO、ICPC 决赛选手评测 AI 判卷能力,从数学竞赛中选出 534 份可疑或边缘提交,建立统一评分标准与专家参考判断。模型整体偏严,更常拒绝有效提交;清晰指令让 GPT 模型平均提升约 2 个百分点,加入评分示例后 Claude 平均提升约 10 个百分点、GPT 约 5 个百分点。Grok 几乎拒绝一切,仅接受 1–5% 提交,而金标准接受 64.4%。

  3. X:Eric Zakariasson (@ericzakariasson)34

    xAI 发布实验性 TypeScript SDK,统一接入 Grok 文本、语音、图像与视频

    xAI 发布实验性 TypeScript SDK,可通过 `npm install @xai-official/sdk` 安装,在一个 SDK 中调用 Grok 最新模型的文本、语音、图像和视频能力。该 SDK 还支持运行在 xAI 服务器上的工具,包括实时 X 搜索、网页搜索、代码执行和远程 MCP。官方称目前仍处早期阶段,希望开发者反馈以持续迭代。

  4. X:Grok Bot (@bot)20

    Grok Bot 重置所有用户用量限制

    Grok Bot 宣布已为所有用户重置用量限制。用户此前反映用量百分比异常下降,重置后恢复至 1% 起始状态。官方同时提供注册入口 x.ai/bot,有用户建议改为 7 天内可用的单次重置额度以更公平。

10月2日周五
10月1日周四
9月30日周三
  1. X:Mark Zuckerberg (@finkd)62

    美国主要实验室负责人签署白宫超级智能协议,承诺内部管控与外部审计

    美国各大前沿实验室负责人签署白宫超级智能协议,承诺对产品安全开发负责,并引入新的内部管控与外部审计。马克·扎克伯格称这是重要积极进展,认为多层审计与审查能让公众更信任各实验室的技术会按预期运行。他还表示,这一由特朗普召集的协议比等待可能永远不会达成的国际协议更好,并称新一轮工业革命已创造一百万个新工作岗位。

9月29日周二
9月26日周六
  1. X:Tencent WorkBuddy (@WorkBuddy_AI)22

    Grok-4.7 上线 WorkBuddy 模型阵容

    Grok-4.7 现已加入 WorkBuddy 的模型阵容,用户可在下一次任务中直接调用。该消息由 WorkBuddy 官方账号发布,未披露参数规模、上下文长度或定价等细节。

9月23日周三
9月22日周二
  1. X:Grok (@grok)30

    在 Box 中试用 Grok 4.7

    Box 上线 Grok 4.7 试用,在 Box Agent 预览中处理一笔 200 万美元保险理赔,单是免赔额错误就让计算相差 14.3 万美元。该 Agent 对照保单与佐证记录核验,发现 8.2 万美元重复发票和 6.4 万美元缺失供应商抵扣,并解释为何 Business Income 等待期不适用于 Extra Expense。

  2. X:SpaceXAI (@SpaceXAI)78

    xAI 发布 Grok 4.7,上线 Cursor、Grok Build 与 Grok API

    xAI 发布 Grok 4.7,已在 Cursor、Grok Build 和 Grok API 上线,官方称这是其面向编码与知识工作的最强模型。官方还称其速度是同类模型的两倍、价格为同类模型的一半,详情见 x.ai/news/grok-4-7。

    推荐理由:官方给出 Grok 4.7 在 Cursor、Grok Build 与 API 的上线入口,并称其速度翻倍、价格减半,可据此判断编码场景的选型。

9月19日周六
9月18日周五
9月17日周四