推荐理由:原文给出智能指数、成本和幻觉率的横向对比,读者可据此判断新模型相对竞品的性价比位置。
#多模态
#多模态
ArtificialAnlys@ArtificialAnlys精选AI 评分 andonlabs@andonlabsAI 评分 OfficialLoganK@OfficialLoganKAI 评分 Google 内部众多同事为打造这个模型付出了大量工作,看到这里的进展令人惊叹,而这仅仅是个开始!迫不及待想让更多人用上 Gemini 4 Argon。
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 4 Argon 前沿模型
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后将逐步面向开发者、企业和消费者推出,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:Gemini 4 Argon 的 1M 输出 token 与多项基准成绩,展示了长程复杂任务上的能力边界变化。
runwayml@runwaymlAI 评分 ManusAI@ManusAIAI 评分 看看你在 Manus 中能玩出什么花样,我们与合作伙伴 @tripoai 合作 tripo3d.ai/blog/manus-2-0-me…
ManusAI@ManusAIAI 评分 用 Manus Game Dev 将想法变成有趣的 3D 赛车游戏。🏎️ 车辆?由我们的合作伙伴 @tripoai 生成的 3D 模型。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Vivix A1 Playground 发布:可实时打断、全身动作的 AI 角色
Vivix Labs 推出 Vivix A1 Playground + Agent,可构建能说话、全身动作并与用户实时互动的 AI 角色。角色支持在说话或行走中途被打断,无需重置场景即可改变路线,拿起物体也能保持形状。用户可自定义外观、性格与声音,还能与角色玩网页游戏、互动道具。
X:Suno (@suno)AI 评分 Suno v6 如何帮 banoffeemusic 融合曲风、探索新声音
Suno 发布视频展示音乐人 @banoffeemusic 使用 v6 创作:她从冷门影响中取材、融合多种曲风,把声音带到新方向。她认为一首歌直到让自己感到意外才算完成。
MSFTResearch@MSFTResearchAI 评分 极端空间天气事件会损坏地球上的电力系统,降低 GPS 精度和卫星运行。一个新的机器学习系统可以在风暴到来前 30-60 分钟预测损害可能发生的位置:msft.it/6019aYXwh
pushmeet@pushmeetAI 评分 vikingmute@vikingmuteAI 评分 X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)AI 评分 Perplexity Computer 可生成交互式 3D 示意图,辅助理解家具组装等流程
Perplexity 的 Computer 能生成交互式 3D 示意图,帮助用户直观理解家具组装等流程,把说明书变成可探索的内容。有用户指出类似工具两年前就已存在,只是并非由模型厂商实现;也有人追问 token 用量优化和 Grok 4.7 等最新模型的支持情况。
X:PixVerse (@PixVerse)AI 评分 PixVerse 与 GPT-6 Astra 联动:在 ChatGPT 中免费安装插件生成电影级视频
PixVerse 推出可在 ChatGPT 中免费安装的插件,与 GPT-6 Astra 联动生成电影级视频、动态图形和交互体验。用户下载 ChatGPT 后安装 PixVerse,即可探索 16:9 场景用例。
X:PixVerse (@PixVerse)AI 评分 PixVerse 联合 GPT-6 Astra 在 ChatGPT 内生成电影级视频
PixVerse 与 GPT-6 Astra 合作,可在 ChatGPT 内制作电影级视频、动态图形和交互体验,用户下载 ChatGPT 并安装 PixVerse 即可体验 16:9 用例。
GOROman@GOROmanAI 评分 在 ChatGPT Dots 里让它启动 Blender 建模、加骨骼,然后做了个跳舞的视频www 曲子不知怎么也进去了w
X:商汤 SenseTime (@SenseTime_AI)AI 评分 商汤 SenseNova 6.8 Flash 预览版推出 Dynamic Design,让静态图片动起来
商汤发布由 SenseNova 6.8 Flash 预览版驱动的 Dynamic Design,可将静态图片转为动态设计。该功能会理解文本、主体与视觉元素的关系,决定哪些保持静态、哪些做动画,并为每个元素选择 HTML/CSS、SVG、透明图片或视频等合适形式,再将文字显现、主体运动与环境响应编排成连贯节奏,并对照源设计检查修正输出。
MeshyAI@MeshyAIAI 评分 _akhaliq@_akhaliqAI 评分 ivy432hz@ivy432hzAI 评分 X:fal (@fal)AI 评分 Blendi 开源 Dioramas:可交互 3D 网站框架,含 20 个示例站点
Blendi 开源了 Dioramas,一个用于电影感交互式 3D 网站的框架,完全免费、无需注册,附带 20 个完整示例站点,每个围绕一个可触摸的交互(如提灯探索博物馆、启动机甲、敲开晶洞)。
Ars Technica · AIAI 评分AMD 以 82 亿美元收购李飞飞创办的 World Labs
AMD 与 World Labs 宣布,AMD 将在年底前收购这家世界模型公司,交易估值 82 亿美元,尚待监管批准。World Labs 由计算机视觉科学家李飞飞与 Justin Johnson、Christoph Lassner、Ben Mildenhall 于 2024 年创办,初始融资 2.3 亿美元,其中部分来自 AMD。
imagine@imagineAI 评分 Gemini_Notebook@Gemini_NotebookAI 评分 Gemini Notebook 官方宣布,Live Voice Chat 功能已在移动端 100% 推送给所有 Pro 用户,并邀请用户试用后反馈体验。
Viggle_PINOC@Viggle_PINOCAI 评分 haoailab@haoailabAI 评分 ChatGPT@ChatGPTAI 评分 MSFTResearch@MSFTResearchAI 评分 googlechrome@googlechromeAI 评分 小测验!别慌。在 Chrome 中让 @GeminiApp 把你的标签页、视频或 PDF 转成练习测验。完成测验后,你会得到个性化总结,帮助你集中精力学习。
AWS Machine Learning BlogAI 评分Condé Nast 如何用 Amazon Bedrock 构建多模态视频检索
Condé Nast 联合 AWS 生成式 AI 创新中心,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,将单次内容检索耗时从 250 分钟降至 2 分钟以内。该方案采用 TwelveLabs Marengo 嵌入模型,对视频转录文本、画面和音频联合编码,支持自然语言意图搜索、以图搜视频和时间戳定位,覆盖超 14 万条视频库。
X:Suno (@suno)AI 评分 Suno Studio:录制人声即可转换为任意乐器音色,电吉他只是开始
Suno 宣布 Suno Studio 支持录制人声并将其转换为任意音色,电吉他只是其中一种示例。该功能可将用户嗓音直接变成其他乐器的声音,官方以视频演示了这一能力。
Nin19536@Nin19536AI 评分 Microsoft Research精选AI 评分 微软研究院推出 Quine:面向生物学复杂性的 AI 研究系统
微软研究院推出 Quine,一个面向生物学复杂性的 AI 研究系统,由生物学世界模型和连接模型、科学工具、文献与研究者的交互式 harness 两部分组成。该系统与 Broad Institute 合作用于胰腺导管腺癌(PDAC)研究,从数千个化合物中筛选并优先排序可驱动肿瘤细胞状态转变的候选物,最高排名的化合物在湿实验中产生了最大的预期状态转变,整个流程仅用一个周末完成。
推荐理由:微软研究院公开 Quine 的生物学世界模型与实验编排框架,并给出胰腺癌化合物筛选的湿实验验证结果。
LumaLabsAI@LumaLabsAIAI 评分 OpenBMB@OpenBMBAI 评分 MiniCPM-o 4.5 现已登陆 SGLang Omni v0.1.7。 开发者在运行和构建该模型时将拥有更多灵活性。
Latent SpaceAI 评分AINews:Opus 5.5 擅长生成讲解视频
Latent Space 的 AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后在讲解视频生成上表现突出,SimpleBench 达 88.4%,被 @skalskip92 评为 Anthropic 迄今最强视觉模型。
onofumi_AI@onofumi_AIAI 评分 claudeai@claudeaiAI 评分 一系列 Claude Sonnet 5.5 的早期实验推文串。 @_re_pete 制作的秋叶模拟器,用 Sonnet 5 与 Sonnet 5.5 对比。
Google@GoogleAI 评分 Google@GoogleAI 评分 5️⃣ 用 City Guide 探索 27 个新目的地 文化不只在博物馆里。现在 City Guide 新增 27 个目的地,帮你发现隐藏的宝藏、地标、建筑奇观和本地热门去处。