#产品更新
#产品更新
PixVerse@PixVerseAI 评分 PixVerse@PixVerseAI 评分 X:Elon Musk (@elonmusk, xAI)AI 评分 xAI 的 Grok Bot 未来两周改进方向征集
xAI 的 Grok Bot 团队公开征集用户反馈,询问未来两周如何改进该产品,用户集中提出语音通话、HTML artifacts 浏览器可视化、Android 集成、用量限制透明化等需求。团队回应称通知同步问题将在两周内改进,并正在下线 instructions 功能。
AravSrinivas@AravSrinivasAI 评分 AravSrinivas@AravSrinivasAI 评分 perplexitydevs@perplexitydevsAI 评分 testingcatalog@testingcatalogAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 Artificial Analysis 为 Coding Agent Index 新增两项安全拒绝报告视图:拒绝时机(任务提示词即触发还是智能体开始工作后触发)与回退模型(拒绝后切换到哪个模型)。
ArtificialAnlys@ArtificialAnlysAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 Hailuo_AI@Hailuo_AIAI 评分 milichab@milichabAI 评分 mntruell@mntruellAI 评分 milichab@milichabAI 评分 milichab@milichabAI 评分 latentspacepod@latentspacepodAI 评分 Google@GoogleAI 评分 X:Suno (@suno)AI 评分 Suno Studio 2.0:从聊天栏完成分轨、加乐器与自动化
Suno Studio 2.0 支持在聊天栏中完成从一首歌开始、分离音轨、添加新乐器、效果与自动化的全流程操作。该功能将分轨与编曲编辑整合进对话式输入,用户无需离开聊天栏即可完成多步音乐制作。
X:Suno (@suno)AI 评分 Suno 上线 Speech 语音生成功能 Beta 版
Suno 推出 Speech 功能 Beta 版,用户可在 Suno 上生成语音内容。官方提示 Beta 阶段仍有不足,例如英式口音有时会听起来更像澳式口音,戏剧性停顿也可能过于夸张,这些问题将随时间改进。
X:Suno (@suno)AI 评分 Suno 演示用维多利亚英语劝室友洗碗
Suno 分享了一段用维多利亚时代英语劝说室友洗碗的音频演示,并附上 suno.com 的分享链接。该内容以回复 @suno 的形式发布,展示 Suno 在特定风格化人声与台词生成上的效果。
X:Suno (@suno)AI 评分 Suno 推出 Speech Beta,可生成带背景音乐的语音
Suno 宣布 Speech 功能进入 Beta 阶段,称其为首个能生成与背景音乐相匹配的语音音频的模型,用户更新应用即可使用。官方博客链接为 suno.com/blog/introducing-speech-beta。
X:Suno (@suno)AI 评分 Suno 展示语音与背景音乐单次生成:实时音频的新进展
Suno 分享了一段演示,展示语音与背景音乐在一次生成中同步产出。评论者 Gavin Guo 指出,两个生成器争夺同一时间线通常会互相干扰,而这段音乐能随人声自动避让、起伏和强调,而非事后贴附,对实时音频而言是实质性进展。
X:Suno (@suno)AI 评分 Suno 为语音功能征集命名:Speech 还是 Vocal Booth
Suno 就新语音功能的命名向用户征求意见,认为 Speech 这个名字"感觉不太对",并提出 Vocal Booth 作为替代方案。该讨论由用户 @OmnipotentCEO 在 X 上发起,目前尚未公布最终命名或功能细节。
ClaudeDevs@ClaudeDevsAI 评分 ClaudeDevs@ClaudeDevsAI 评分 ClaudeDevs@ClaudeDevsAI 评分 higgsfield@higgsfieldAI 评分 现在可以在 Higgsfield 上试用 FLUX 3 Image: higgsfield.ai/ai/image?model…
ElevenLabs@ElevenLabsAI 评分 mati@matiAI 评分 X:Jason Liu (@jxnlco)AI 评分 ChatGPT 的 dot 支持举机贴耳语音通话
ChatGPT 的 dot 新增语音通话功能:在 Settings → Voice 中开启后,打开 dot 并把手机举到耳边即可像打电话一样与 dot 对话。该功能需手动在设置里打开,发布者称这是其团队在 dots 中推出的最喜欢的小功能之一。
X:Jason Liu (@jxnlco)AI 评分 有人建议为 ChatGPT 开发插件
一条推文建议开发者做一个 ChatGPT 插件,并称这是其试过体验最好的插件扩展。评论者提到正在追踪 tldraw 以及插件/连接器在 ChatGPT 和 Claude 上的自然发现情况,还有人询问如何在应用内购买受限的情况下变现。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Qodo 3.0 发布 PR Triage:为编码智能体跨仓库 PR 提供整体审查
Qodo 推出 Qodo 3.0,新增 PR Triage 功能,将编码智能体跨不同仓库产生的相关 PR 归组为一个工作包,并按代码库影响、SLA 和未决问题打分。跨仓库地图展示工作包涉及的每个仓库,每项评分附有自身推理依据,Qodo 为整个工作包生成一份审查简报,让审查者一起审查 PR,人类仍负责最终批准代码。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Onepin 推出 AI 语音质检层:逐行检查发音,只修错词不重录
Onepin 发布 AI 语音质检层,在文本转语音之后逐行检查配音,用 400 万词发音词典核对人名与产品名,并提前拼读价格和日期。它按自然度、清晰度和词准确率给每行音频打分,出错时只修复那个词、不重新渲染整段。该工具兼容 ElevenLabs、OpenAI、Google 等 30 多家语音服务,免费起步、无需信用卡。
X:Elvis Saravia (@omarsar0, DAIR.AI)AI 评分 Kled V3 发布:72 小时内向 50 万+ 贡献者网络派发数据采集任务
Kled V3 允许实验室指定所需数据,并在 72 小时内将采集任务部署到其 50 万+ 自愿贡献者网络,覆盖图像、视频、音频、文本和标注的 108 个可配置模板。贡献者用手机按说明和合格示例完成采集,形成"定位模型失败点—转为采集任务—获取真实世界新样本—再训练评估"的更紧反馈闭环。
OpenRouter@OpenRouterAI 评分 OpenRouter@OpenRouterAI 评分 testingcatalog@testingcatalogAI 评分 "Daily AI Brief" 也将从周二到周六以邮件形式送达。 点击下方订阅 👀 testingcatalog.com/#/portal/…