当前环境没有静态搜索索引,结果会从工具 JSON 中匹配。
语音 AI 工具的价格、功能和政策变化,按时间倒序排列。
新增 Subtitle Edit,用于开源字幕编辑、校时和 Whisper 转写流程
新增 ACE-Step UI,用于 ACE-Step 1.5 本地音乐生成
新增 WellSaid,用于授权品牌旁白 Studio 工作流
新增 Murf AI,用于营销、培训和产品旁白工作流
新增 Resemble AI,用于声音克隆、按量 TTS 和治理工作流
新增 Chatterbox,作为开源自托管 TTS 与声音克隆路线
新增 Udio,用于 AI 音乐生成、stems 和创作者配乐探索
新增 Beatoven.ai,用于有授权记录的 AI 背景音乐和音效
新增 AudioCraft,作为音乐和音效生成的自托管研究路线
新增 WhisperX,用于自托管转写、词级时间戳和说话人分离
新增 Voicebox 作为本地优先的开源声音克隆 TTS 听写和 Agent 语音工作室
新增工具用于补齐分类覆盖
新增 RWS AI Dubbing 用于补齐分类覆盖
Suno 数据已根据官方来源页面复核
ElevenLabs 数据已根据官方来源页面复核
新增 Suno 条目:免费版不可商用,付费生成歌曲授予商业使用权
新增 Descript,用于播客清理、文字剪辑、字幕和 AI 补录
新增 Adobe Podcast,用于低门槛 Enhance Speech 人声清理流程
新增 OpusClip,用于创作者长内容拆短视频流程
新增 Riverside,用于录制、文字剪辑和 Magic Clips 工作流
新增 YouTube Auto Dubbing,用于 YouTube 原生多语言音轨
新增 Podcastle,用于浏览器播客录制、剪辑、AI voices 和托管
新增 Stable Audio Open,用于开放短音频和声音设计生成
新增 NotebookLM,用于基于资料来源的 Audio Overview 和知识简报
新增 VibeVoice,用于实验性长篇多说话人对话式 TTS
新增 Retell AI,用于托管式生产电话和网页 Voice Agent
新增 LiveKit,作为 Voice Agent 的开源实时音频基础设施
新增 Deepgram,用于低延迟流式语音识别链路
新增 Cartesia,用于 Voice Agent 的低延迟流式 TTS
新增 OpenAI Realtime API,用于原生 speech-to-speech Voice Agent
新增 Pipecat,作为开源实时语音 Agent 框架
新增 Silero VAD,用于开源语音活动检测工作流
Free tier 重申不可商用要求,违规账号会被限制
社区发布 OpenF5 TTS,基于 F5 框架训练,采用 Apache 2.0 许可
新增 burst pricing,允许 agent 临时突破并发上限至 3 倍
明确将 Twilio / Telnyx / Vonage telephony 费用单独标注,提升价格透明度
Creator tier 价格从 $11 调整为 $22,新订户首月仍享 50% 折扣
社区微调版本扩展到越南语、阿拉伯语、葡萄牙语、俄语
Generative Credits 重命名为 Premium Credits,新增 upfront 成本预估提示
Audio dubbing(无 lip-sync 翻译)对所有付费 tier 完全无限制
Team 套餐被 Business 套餐替代,老用户保留原价