Gemini Desktop 新增 Full Access 权限与 Additional sandbox options 设置
Gemini Desktop 将提供用于 computer use 的 Full Access 权限,可访问桌面任意文件并运行任意应用。
Gemini Desktop 将提供用于 computer use 的 Full Access 权限,可访问桌面任意文件并运行任意应用。
AI 家居设计工具 Maket 发布 V2,升级界面并补全功能,同时推出含 30 credits 的免费方案。Maket 自 2023 年 V1 公开发布以来注册用户已超过一百万。
Maket 推出 Maket 2.0,一个用于新房设计或旧房改造的一站式 AI 平台,用户提出增加卧室或扩大厨房等需求后,可在动工前快速获得户型图和 3D 视图。
Ideogram 发布新模型 Ideogram 4.5,称其只修改用户指定的区域,替换服装时人物身形与背景保持不变,可减少多次编辑后的画面瑕疵。
Tavus 推出 Griffin,公司称其为首个 Human Interaction Model(HIM),可在接收和生成视频的同时处理语音、面部表情、语调、手势和停顿。
AI 初创公司 Photon 完成 450 万美元种子轮融资,用于开发让开发者通过 iMessage、WhatsApp 等消息应用构建智能体的工具。该公司称已吸引超 4 万名开发者注册,四个月内收入增长 10 倍,消息量上月增长 5 倍。Photon 提供统一 API、可扩展渠道框架、CLI 和可观测性套件,其开源版本仍占使用量的 98%。
Airbnb 本周随秋季更新上线了新的 AI 搜索,CEO Brian Chesky 表示聊天机器人不适合电商与旅行浏览,因为一次只给几个选项、需要多轮交互。他透露公司未来三到六个月将探索支持多人同时使用的"multiplayer" AI 界面,并计划让 Airbnb 应用更"agentic",最终通过 MCP 与其他智能体互通。
Shopify 推出名为 Canvas 的建站工具,商家通过与 AI 智能体 Sidekick 对话即可搭建店铺,Canvas 实时渲染店铺背后的真实代码,可测试页面交互与动画并查看不同屏幕尺寸下的效果。
AWS 发布开源决策模型 Strands Decider 2B,基于 Qwen3.5-2B 构建,可在本地运行,用于在预设选项中快速做出选择并给出置信度评分。该模型由 AWS 杰出工程师 Marc Brooker 受 TypeSafe 的 Jev 启发开发,曾在同尺寸模型的 Jevbench 排名中登顶。
Graphite 研究发现 Claude Opus 5.5 的写作痕迹是“dependable”一词出现频率比人类样本高 23 倍,“this matters”高 116 倍;OpenAI Astra 则偏爱“another dimension”和“not simply X”式纠正性框架,后者出现频率超人类 100 倍。
据《华尔街日报》报道,OpenAI 已与三名安全团队研究人员解除关系,原因是他们涉嫌向第三方 AI 安全组织共享公司机密信息。OpenAI 发言人称内部调查确认这三人违反公司敏感信息处理政策,但报道未披露涉事人员、组织及具体信息。
Google 的轨道计算卫星搭乘 SpaceX 火箭从加州升空,首次将其 TPU 送入太空,用于验证芯片在轨供电、散热与运行模型的能力。
OpenAI 宣布在全球范围上线两项 ChatGPT 购物功能,包括虚拟试穿服装与配饰,以及把商品保存到应用内 Library 的 Favorites 收藏功能。
据 Time 杂志报道,2025 年 12 月特朗普与马斯克举行秘密会面,其间特朗普花数小时与 Grok 聊天机器人对话,并询问委内瑞拉民众会如何回应抓捕其总统。
Clay 联合创始人兼 CEO Kareem Amin 将在 TechCrunch Disrupt 2026 的 AI Stage 发表演讲,主题为“GTM 工程师:AI 如何创造科技业下一个大职位类别”。
教皇利奥十四世在 X 发帖称,AI 时代亟需区分人类艺术与机器产物,二者存在本体论差异,算法缺乏人性的火花。他曾在 5 月的通谕中详述 AI 与人类尊严问题。据《纽约时报》报道,Anthropic 曾游说梵蒂冈重新考虑其在非人类意识上的立场,但收效甚微。
美国联邦法官 Amit Mehta 驳回 Chegg 与 Rolling Stone 母公司 Penske Media Corporation 针对 Google AI 搜索功能的反垄断诉讼,两方此前指控 Google 以 AI Overviews 免费获取出版商内容并分流其网站流量。
Google 在 Gemini Live 中上线 Guided Vision,可在兼容 Android 设备上通过共享摄像头,对镜头所指向的内容提供实时语音描述,帮助读取小字、描述周围环境、寻找或识别物体。
Viggle Turbo v0.3 发布,这是面向 Qwen-Image-2.1 的加速模型,新增 9-step 模式,细节更精细、小文字渲染更好,颗粒感比 v0.2.1 更少、画面略柔和。该版本已在 ComfyUI 中提供 LoRA 或单文件 int8/fp8/GGUF 形式,模型权重发布于 Hugging Face。
Viggle AI 发布面向 Qwen Image 2.1 的 turbo lora 0.3 版本,@realrebelai 测试后称效果不错。该版本为 LoRA 微调权重,具体参数与可用性未在原文披露。
Viggle AI 公开致谢 Hugging Face 社区,称最精彩的部分是看到大家基于其模型构建的 ComfyUI 工作流、Gradio 演示和 GGUF 量化版本等成果。帖文点名感谢 @cocktailpeanut、@_akhaliq、@linoy_tsaban、@fffiloni、@realrebelai、@drbaph 以及所有参与、分享和二次创作的人。
商汤 SenseTime 在 X 上发布了一段青海门源的视频,画面为山峦之下的金色麦浪。
Cohere 发布了一段以 @1vnzh 的 10,000 名实习生为视角的视频。原文未提供更多关于该视频内容或实习生项目的具体细节。
Cohere 迎来成立 7 周年,公司于 2019 年创立,目标是打造赋能人们的 AI,至今仍专注于这一使命。三位联合创始人分享了公司下一步的发展方向。
Cohere 与国际象棋世界冠军 Magnus Carlsen 合作,帮助他减少繁忙的琐碎工作,把更多时间留给家人和所爱之人。Carlsen 表示,减少杂务意味着能有更多高质量陪伴时间,这正是 Cohere 发挥作用的地方。
Cohere 的 Embed 5 成为首个采用 RCP-nDCG@10 评测的模型系列,这是其最新评测方法,旨在改进对真实检索质量的评估。该系列基准测试结果因此呈现不同面貌。
Cohere 的 Embed 5 成为首个采用 RCP-nDCG@10 评估的模型家族,该新方法用于改进真实场景检索质量评估。传统 nDCG 只计算已在基准答案集中的结果,RCP-nDCG@10 则按每条结果的实际相关性打分,结果由人工评审和 MTEB 支撑。
Cohere 的 Embed 5 成为首个采用 RCP-nDCG@10 评估的模型家族,该新方法不再只认可基准答案键中已有的结果,而是对每条结果按实际相关性打分。Cohere 称 RCP-nDCG@10 的结果由人工评审和 MTEB 背书,并将于 10 月 8 日(周四)在 X Live 举办网络研讨会,讨论 RCP-nDCG@10、Embed 5 以及搜索与检索的未来。
MiniMax H3 在 MachGen 平台上线 30 秒连续视频生成,突破其原生 15 秒上限,且无需拼接片段,实现 100% 连续运动。该功能已在 UI 和 API 上开放公测,用户可选择 16-30 秒时长。
Google DeepMind 发布 SynthID Bio,这是一组面向 AI 生成生物设计的水印方法,可将不可感知的签名直接嵌入蛋白质序列而不影响其生物功能。该水印类似数字身份证,帮助 DNA 实验室验证合成蛋白质并保持序列数据库准确。这些工具以开放方式发布,供研究使用,以加强生物安全防护。
Google DeepMind 发布 SynthID Bio,这是一组面向 AI 生成生物设计的水印方法,可在不影响生物功能的前提下把不可感知的签名直接嵌入蛋白质序列。该水印类似数字身份证,可帮助 DNA 实验室验证合成蛋白质并保持序列数据库准确,相关工具以开放形式供研究使用。
推荐理由:原文给出 SynthID Bio 的嵌入方式与开放研究入口,读者可据此了解 AI 生物设计溯源的具体做法。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,并给出四种与电脑交互方式的早期预览:Portals、Visual Thinking、Responsive Video Interfaces 和 Interactive Worlds。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,并首次展示四种与电脑交互的新方式:Portals、Visual Thinking、Responsive Video Interfaces 和 Interactive Worlds。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,并首次展示四种与电脑交互的新方式:Portals、Visual Thinking、Responsive Video Interfaces 和 Interactive Worlds。
哈佛的 Julian Simcock 与 Google DeepMind 的 Rick Ingram 出席 Runway AI Summit,讨论物理 AI 的监管、政策制定以及与中国的竞赛。相关内容以视频形式发布。
Gamma 首席 AI 官 Deeni Fatiha、Adobe 总监 Morgan Prygrocki 与 Salesforce 全球品牌营销的 Shane Tapp 共同讨论了创意 AI 从实验阶段进入生产阶段后会发生哪些变化。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用。官方同时放出一段简短的演示走查视频。
The Bot Company 联合创始人兼 CTO Paril Jain 与 Physical Intelligence 联合创始人 Quan Vuong 在 Runway AI Summit 同台,讨论真实世界评测、机器人实地部署以及机器人技术三年后的走向。
Arena 将于 10/7 在新迁入的旧金山总部举办屋顶 Happy Hour 开放日,邀请研究者和开发者参加。活动面向 SF Tech Week 或 COLM 期间到访者及湾区 AI 从业者,提供 boba bar、轻食和饮品,名额有限需通过 Luma 注册申请。
Claude Sonnet 5.5 的 xHigh 推理档位进入 Code Arena WebDev 榜单,以 1786 分排名第 3,混合价格 $8/M tokens,距第 2 名 GPT-6 Astra 的 1788 分仅差 2 分,价格约为其 80%。