Suno 为语音功能征集命名:Speech 还是 Vocal Booth
Suno 就新语音功能的命名向用户征求意见,认为 Speech 这个名字"感觉不太对",并提出 Vocal Booth 作为替代方案。该讨论由用户 @OmnipotentCEO 在 X 上发起,目前尚未公布最终命名或功能细节。
Suno 就新语音功能的命名向用户征求意见,认为 Speech 这个名字"感觉不太对",并提出 Vocal Booth 作为替代方案。该讨论由用户 @OmnipotentCEO 在 X 上发起,目前尚未公布最终命名或功能细节。
现在可以在 Higgsfield 上试用 FLUX 3 Image: higgsfield.ai/ai/image?model…
ChatGPT 的 dot 新增语音通话功能:在 Settings → Voice 中开启后,打开 dot 并把手机举到耳边即可像打电话一样与 dot 对话。该功能需手动在设置里打开,发布者称这是其团队在 dots 中推出的最喜欢的小功能之一。
一条推文建议开发者做一个 ChatGPT 插件,并称这是其试过体验最好的插件扩展。评论者提到正在追踪 tldraw 以及插件/连接器在 ChatGPT 和 Claude 上的自然发现情况,还有人询问如何在应用内购买受限的情况下变现。
Qodo 推出 Qodo 3.0,新增 PR Triage 功能,将编码智能体跨不同仓库产生的相关 PR 归组为一个工作包,并按代码库影响、SLA 和未决问题打分。跨仓库地图展示工作包涉及的每个仓库,每项评分附有自身推理依据,Qodo 为整个工作包生成一份审查简报,让审查者一起审查 PR,人类仍负责最终批准代码。
Onepin 发布 AI 语音质检层,在文本转语音之后逐行检查配音,用 400 万词发音词典核对人名与产品名,并提前拼读价格和日期。它按自然度、清晰度和词准确率给每行音频打分,出错时只修复那个词、不重新渲染整段。该工具兼容 ElevenLabs、OpenAI、Google 等 30 多家语音服务,免费起步、无需信用卡。
Kled V3 允许实验室指定所需数据,并在 72 小时内将采集任务部署到其 50 万+ 自愿贡献者网络,覆盖图像、视频、音频、文本和标注的 108 个可配置模板。贡献者用手机按说明和合格示例完成采集,形成"定位模型失败点—转为采集任务—获取真实世界新样本—再训练评估"的更紧反馈闭环。
"Daily AI Brief" 也将从周二到周六以邮件形式送达。 点击下方订阅 👀 testingcatalog.com/#/portal/…
Anthropic 为 Claude Code 发布 Mods 插件系统,本质是运行在工具内部的中间件,开发者可用 JavaScript 或 TypeScript 函数挂钩工具调用、用户提示词和 UI 渲染等事件,从而添加自定义面板、拦截工具调用或接入新命令。
每次创建设计、演示文稿或文档时自动生效,Pro、Max 和 Team 计划持续至 10 月 15 日。 运作方式及完整条款:support.claude.com/en/articl…
过去几周,大家用 Claude 做出了很多有创意的东西。我们最喜欢的一些: 一个能运转的水磨,用 Opus 5.5 搭建。
FLUX 3 Image 现已在 Krea 上线,支持多轮编辑而不改变其他像素、用 bounding box 排布图像、最高 4K 生成,以及最多 10 个参考图进行合成。
添加 PixVerse 插件,输入 `pixverse cinematic story`,然后描述你想象的故事、氛围或风格。 PixVerse 会为你处理镜头、视觉和节奏。
PixVerse 会员可无限使用 GPT Image 2.5 app.pixverse.ai/cli/gpt-imag…
PixVerse 上线 GPT Image 2.5 无限生成!探索热门预设 app.pixverse.ai/cli/gpt-imag…
用 PixVerse 将任意角色变成会说话的演讲者 添加新的 PixVerse 插件,选择你的角色。 他们会在镜头前自然地说话、反应和做手势,同时 PixVerse 为你生成视频片段。
所有软件都在变得可塑,因此在 Claude Code 中将其作为一等公民支持对我们很重要,我希望越来越多的软件能像这样变得可扩展! 以下是我对 mods 最期待的一些方面:
Claude 可以为你制作 mods! 只需给出提示词,阅读 @addyosmani 的博客文章了解更多:claude.dev/blog/getting-star…