用 Amazon SageMaker HyperPod 实现多团队共享 GPU 集群的隔离与公平
AWS 提出一套基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群并保持隔离与资源公平。
AWS 提出一套基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群并保持隔离与资源公平。
Latent Space 播客邀请 Periodic Labs 的 Liam Fedus 和 Ekin Dogus Cubuk,阐述其“合成超智能”愿景:用以物理实验为基础的强化学习、AI 驱动的材料表征与高通量实验室,让模型从科学探索的完整过程而非仅发表结果中学习。
介绍 Streams:面向多模态模型的在线 RL,带实时人类反馈。 - 图像、音频和视频 - 1B+ 评分者随时可用 - 实时、持续的人类偏好 trydatapoint.com/online-rl/
Google 同一团队发布了 AI 会议笔记工具 Google AI Edge Foresight,对标 Granola,Mac 应用可完全离线运行,使用 740M 参数的端侧 EmbeddingGemma 2 模型跨应用记录会议笔记,包括线下会议。
AI 硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按一下手指即可让 AI agent 完成任务、记录想法,同时监测心率、HRV、睡眠和活动等健康指标。
NVIDIA 发布 Long-WAM,一个通过扩展视觉上下文实现机器人实时控制的世界动作模型。原文指出,能访问历史不等于会用历史,当视频基础模型采用自回归预训练时,更长的历史带来的收益会大得多。
ElevenLabs 推出 Brand Kit。 只需添加一次 logo、字体和颜色,之后你制作的所有内容都会自动调用。要求生成新品发布营销活动,返回的内容即符合品牌风格。
TII 在 Hugging Face 发布 Falcon-ASR,一个 1.6B 参数、面向阿拉伯语尤其是阿联酋方言的语音识别模型,同时支持英语、法语、西班牙语和葡萄牙语,五种语言共用同一权重且无需指定语言标志。
POV:Elon和Optimus刚登录WoW For Ever💀 暴风城毫无防备。⚔️🦾 用@grok Imagine一条提示词生成。 太炸了 🔥
有首歌?就能得到音乐视频。🎬 Solmi 会为你选角、为每个场景绘制分镜,并让人声对口型。已有 100,000+ 音乐人和创作者在使用。 由 PixVerse 及其自托管模型驱动。
X 现已支持 meme 搜索,Grok 的新 X 扫描功能在输入图片或视频截图后,可以找到梗图的起源、传播最广的推文,或特定类型的帖子,例如使用该图的 AI 相关推文。
NVIDIA 被 NeurIPS 2026 接收的论文发现,给多模态模型添加工具会削弱其拒绝有害请求的能力,在其测试的所有模型上均成立,拒绝失败率相对上升最高 68.7%,平均上升 17.7%。
微软在两年来首次线下活动上发布新款 Surface Laptop Ultra,起售价 $2,599,10 月 16 日开始发货并已开放预订。
Ben Affleck 谈到自己从小喜欢电脑,电影从胶片转向数字后更关注相关技术,视觉特效工作流多年来一直包含机器学习,他能写一些简单的 Python 脚本。他解释卷积神经网络是 Transformer 的前身,通过分析图像的 tensor(即图像的数值表示,包含批次号、帧号、每像素 RGB 值)识别模式,实现边缘检测与特征提取,从而更方便地抠掉绿幕并替换背景。
开发者 Brandon Thomas 宣布其项目 Artcraft 转向推出 7 款开源应用,复刻 Adobe Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
推荐理由:原文说明了 intelligent ui 的设计取向,读者可据此理解 ChatGPT 界面变化背后的思路。
有了 Intelligent UI,你可以这样提问: - 拆解自行车的设计 - 为我规划一顿晚餐 - 为我搭建一个衣柜 - 根据我的收据分摊晚餐账单 你会得到更易理解的可视化输出,用起来也更愉快。
OpenAI 在 ChatGPT 上线 Intelligent UI 功能,让回答可包含图表、示意图、表单和可点击按钮等交互式视觉元素,并随 GPT-6 一同推出。
OpenAI 随 GPT-6 向所有 ChatGPT 用户推出名为 Intelligent UI 的新功能,回答以图形、按钮、图表和表单等交互界面呈现,格式随问题自动调整,还可在聊天内直接生成储蓄计算器或小游戏等小工具。
Google DeepMind 宣布与 Chan Zuckerberg 的 Virtual Biology Initiative 合作,创建改进预测生物学模型所需的多模态数据集。
在 Atlas beta 中测试 Chisel。我们一直在向一批用户逐步开放 beta 权限,看到大家构建的内容真的很酷。
OpenAI 随新的 GPT-6 模型推出名为 Intelligent UI 的新界面,让 ChatGPT 在对话中加入大量可交互视觉元素,如可点击按钮、定制计算器、交互图表和可编辑图表等,目标是让学习复杂主题更容易。
推荐理由:原文交代了新界面的交互元素形态与分层推送节奏,读者可据此判断自己何时能用上以及会怎样改变提问方式。