OpenAI Python SDK 3.24.0 新增 Voices API,ChatGPT 上线虚拟试穿
OpenAI 的 Python SDK 3.24.0 静默新增 Voices API,可用文本提示词或音频样本创建自定义语音;ChatGPT 面向全球上线虚拟试穿,可在自己的照片上查看购物结果中的服装。
OpenAI 的 Python SDK 3.24.0 静默新增 Voices API,可用文本提示词或音频样本创建自定义语音;ChatGPT 面向全球上线虚拟试穿,可在自己的照片上查看购物结果中的服装。
Grok 4.7 正在 Grok 网页端和移动端推送,并成为所有模式的基础模型,包括 Fast、Expert、Build 和 Heavy。该消息由 Testing Catalog 转述,称其已进入 App。
Grok Bot 正在逐步推送 Primary Bot 功能,用户需配置一个新的 Primary Bot 或选择一个已有 Bot 作为 Primary,例如把 Chief of Stuff 设为 Primary。Primary Bot 定位为主 AI 助手,可以管理其他 Bot 并主动给出建议,相关入口已出现在最新 iOS 应用中。
Grok Bot 新增 Primary Bot 功能,开始具备主动性,可自行给出建议。用户需要配置一个新的 Primary Bot,或从已有 Bot 中选一个作为 Primary,例如把 Chief of Stuff 设为 Primary。该功能正在逐步推送,Bot prime 已出现在最新的 iOS 应用中。
Grok 4.7 正在 Grok 网页版和移动端推送,成为 Fast、Expert、Build、Heavy 全部模式的基座模型,并上线 Google 的 Gemini Enterprise Agent Platform;Grok Bot 逐步转向主动建议,Grok Build 新增 /dashboard 智能体面板。
据 Time 杂志报道,2025 年 12 月特朗普与马斯克举行秘密会面,其间特朗普花数小时与 Grok 聊天机器人对话,并询问委内瑞拉民众会如何回应抓捕其总统。
xAI 的 Grok Imagine Video 1.5 Lite 已在 fal 上线,这是 Grok Imagine 视频家族中的轻量级模型,支持文生视频和图生视频并带原生音频。该模型可生成 1 至 15 秒、480p/720p/1080p 分辨率的视频,覆盖从 16:9 到 9:16 的 7 种宽高比。
Grok Imagine Video 1.5 Lite 已在 fal 上线,是 Grok Imagine 视频家族中的轻量级模型。它支持文生视频与图生视频,可生成 1 至 15 秒、带原生音频的视频,输出 480p、720p 和 1080p,覆盖从 16:9 到 9:16 的 7 种宽高比。
Robotaxi 在奥斯汀的运营时间从晚 10 点延长至 11 点。其核心要解决的问题是夜间难以看清宠物、避免碾压,用马斯克的话说是"避免黑暗中灰色柏油路上的灰色小猫"。
Repovive 联合 IOI、IMO、ICPC 决赛选手评测 AI 判卷能力,从数学竞赛中选出 534 份可疑或边缘提交,建立统一评分标准与专家参考判断。模型整体偏严,更常拒绝有效提交;清晰指令让 GPT 模型平均提升约 2 个百分点,加入评分示例后 Claude 平均提升约 10 个百分点、GPT 约 5 个百分点。Grok 几乎拒绝一切,仅接受 1–5% 提交,而金标准接受 64.4%。
xAI 发布实验性 TypeScript SDK,可通过 `npm install @xai-official/sdk` 安装,在一个 SDK 中调用 Grok 最新模型的文本、语音、图像和视频能力。该 SDK 还支持运行在 xAI 服务器上的工具,包括实时 X 搜索、网页搜索、代码执行和远程 MCP。官方称目前仍处早期阶段,希望开发者反馈以持续迭代。
SpaceXAI 发布实验性 TypeScript SDK,可通过 npm install @xai-official/sdk 安装,在一个 SDK 中调用文本、语音、图像和视频能力,并接入最新 Grok 模型。该 SDK 还提供运行在官方服务器上的工具,包括实时 X 搜索、网页搜索、代码执行和远程 MCP。
Grok Bot 宣布已为所有用户重置用量限制。用户此前反映用量百分比异常下降,重置后恢复至 1% 起始状态。官方同时提供注册入口 x.ai/bot,有用户建议改为 7 天内可用的单次重置额度以更公平。
Ramp Router 已上线 Grok 4.7,并与 SpaceXAI 合作推出 API 五折优惠,活动持续至 10 月 6 日。用户可在 router.com 获取 API key,以更低的 token 成本调用该模型。
Grok Build 上线 Agent Dashboard,可将所有智能体集中在一个自上而下的视图中管理,并用 /dashboard 或 grok dashboard 命令调用。用户能从该视图派发新智能体、并行启动任务,或用 Ctrl+W 让智能体在各自的 git worktree 中运行。
Grok 4.7 已在 Gemini Enterprise Agent Platform 上线。该平台用户现可直接调用 Grok 4.7 模型。
Grok Bot 官方宣布,主 Bot 现在能主动发现可以接手的工作并提出代劳,无需用户先开口,该功能将在未来几小时内陆续推送。官方称这类主动建议不计入使用额度,并给出了下载入口 x.ai/bot。评论区用户反馈了额度限制、主 Bot 与其他 Bot 职责重叠、地区未上线等疑问。
Grok Bot 新增主动建议能力,无需用户开口,主 Bot 会识别可以接手的工作并主动提出代办。该功能将在接下来几小时内逐步推送,建议不计入用户用量,可通过 x.ai/bot 下载 Grok Bot。
Grok Bot 面向软件开发的能力增强,机器人可以把编码任务交接给 Cursor,并通过 GitHub 和 Origin 插件管理 PR,还能分享所构建内容的视频演示。作者同时给出 x.ai 机器人市场中的工程类机器人入口。
特朗普与二十余家AI企业达成自愿协议,企业承诺实施白宫建议的管控措施,包括接受独立安全审计,审查网络安全、生物安全、化学威胁及AI模型意外行为等风险,并定期会面制定共同安全标准与基准。
美国各大前沿实验室负责人签署白宫超级智能协议,承诺对产品安全开发负责,并引入新的内部管控与外部审计。马克·扎克伯格称这是重要积极进展,认为多层审计与审查能让公众更信任各实验室的技术会按预期运行。他还表示,这一由特朗普召集的协议比等待可能永远不会达成的国际协议更好,并称新一轮工业革命已创造一百万个新工作岗位。
Grok Imagine 与 AI 原生创意工作室 WonderStudiosX 合作,用 2,070 张图像和 1,558 段视频在 15 天内完成了荷马《奥德赛》试播集,全程无摄影机、无布景。两位电影人借助 @imagine 的影视级生成能力推进这一项目,创意负责人 Dev Walker 随后发帖分享了创作技巧。
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后在讲解视频生成上表现突出,SimpleBench 达 88.4%,被 @skalskip92 评为 Anthropic 迄今最强视觉模型。
Grok 4.7 现已上线 Amazon Bedrock。
Grok 正在征集用户分享如何将 @Bot 融入工作,活动还剩 4 天,将邀请一位 Grok Bot 用户前往 Starship 发射现场,邀请含一位同行名额。提交方式与官方示例已公布,形式为视频。
Grok iOS 应用现已支持添加多个 SpaceXAI 账号,用户可点击左上角的个人资料按钮切换或添加账号。该功能由 Evan Bacon 公布。
Grok-4.7 现已加入 WorkBuddy 的模型阵容,用户可在下一次任务中直接调用。该消息由 WorkBuddy 官方账号发布,未披露参数规模、上下文长度或定价等细节。
Grok 宣布特斯拉车辆现已支持 Grok Bot 和 Connectors。借助 Connectors,用户可在车内免手动管理收件箱、清理日历,或就已有文件、聊天和任务进行对话。
xAI 的 Grok 4.7 已在 Vercel AI Gateway、eve 和 fx 上线,自 9 月 21 日起一周内享 40% 折扣,优惠持续至 9 月 27 日。用户可通过 v0、eve 和 fx 调用该模型。
Box 上线 Grok 4.7 试用,在 Box Agent 预览中处理一笔 200 万美元保险理赔,单是免赔额错误就让计算相差 14.3 万美元。该 Agent 对照保单与佐证记录核验,发现 8.2 万美元重复发票和 6.4 万美元缺失供应商抵扣,并解释为何 Business Income 等待期不适用于 Extra Expense。
xAI 发布 Grok 4.7,已在 Cursor、Grok Build 和 Grok API 上线,官方称这是其面向编码与知识工作的最强模型。官方还称其速度是同类模型的两倍、价格为同类模型的一半,详情见 x.ai/news/grok-4-7。
推荐理由:官方给出 Grok 4.7 在 Cursor、Grok Build 与 API 的上线入口,并称其速度翻倍、价格减半,可据此判断编码场景的选型。
SpaceXAI 发布对比视频,展示 Grok 4.7 与 Grok 4.6 分别构建开放世界城市游戏的效果,Grok 4.7 排在第一位、4.6 排在第二位。
xAI 发布 Grok 4.7,称其在相同价格和速度下相较 Grok 4.6 有明显提升。官方未披露具体能力指标或开放范围。
Grok Imagine 展示了用 Grok @imagine 制作电影场景的案例:@PJaccetturo 及其工作室用 9 天完成该 pilot,生成 3,627 张图像和 3,043 段视频,总生成成本 2,677 美元。Grok Imagine 称好莱坞为这一 Odyssey 场景的花费会达到七位数。
SpaceXAI 在 Grok Voice API 中上线语音转文字模型 Transcribe 2.0,批量模式 $0.10/hr、流式模式 $0.20/hr。官方称其具备极高的准确率与成本效益。
SpaceXAI 发布 Grok Voice Transcribe 2.0,称其为全球最准确的语音转写模型。原文未给出更多技术细节与开放入口。
Neuralink 的 VOICE 试验中,植入者 Terry 正用其 Neuralink 植入体帮助微调一套脑到语音接口,供自己和无法说话的人使用。他先尽力模仿说话来训练算法,之后只需在脑中想词,就能听到以自己自然声音说出的内容。该功能由 @SpaceXAI 的 Grok Voice 提供支持。
xAI 为 Grok 推出 Grok Voice 语音功能,官方链接指向 x.ai/voice。Grok 是 xAI 打造的 AI 聊天机器人,具备语音对话、图像与视频生成、实时搜索和高级推理能力,可在 grok.com 体验。
Grok Voice 已在 fal 上线,这款来自 SpaceXAI 的最新语音模型响应仅需 0.70 秒,并能在句子结束前完成工具调用。它支持带词级时间戳的转录、25+ 种语言的 30+ 种音色文本转语音,以及用两分钟音频完成声音克隆。
Grok Build 现在会随使用次数增加而变得更懂你,可跨会话记住约定、决策和项目事实。用户可用 /memory 浏览这些记忆,用 /dream 把近期笔记整理成主题,详情见 x.ai/build。