- 语音查找器:搜索来自 MiniMax、Cartesia、Deepgram、Rime 以及通过 Together AI 提供的其他模型的 600 多种语音。
- 通过提示或音频搜索:描述您需要的语音,或上传一段简短的语音样本,以查找相似的语音并获得可播放的推荐。
- 模型感知元数据:每种语音都标记了 15 个以上的属性,包括音高、口音、语言、年龄、情感和说话风格。
为语音代理选择合适的语音仍然过于手动。供应商目录可能包含数十或数百种语音,而文档很少告诉您哪一种适合金融科技支持代理、冥想指导或游戏节目主持人。
语音查找器为开发者提供了一种更快的方式来搜索 Together AI 语音目录。输入您正在构建的内容或上传您心中语音的简短音频样本,然后比较排名推荐、内联收听,并根据对您的用例重要的属性进行筛选。
工作原理
语音查找器索引了 Together AI 上 10 个 TTS 模型的 600 多种语音。每种语音都可以直接在工具中播放。
在排名层背后,一个全能模型已经收听了每种语音,并生成了跨 15 个以上维度的结构化元数据,包括音高、性别、口音、语言、年龄、情感和说话风格。该元数据支持自然语言搜索和手动筛选。
一些示例搜索:
- “冥想应用的平静女性声音”
- “金融科技支持代理的自信声音”
- “游戏节目的充满活力的主持人”
- “客户服务的温暖双语声音”
目标很简单:从用例快速获得一个简短的语音列表,以便继续构建。
这对语音代理为何重要
语音代理不仅仅依赖于模型质量。语音必须适合产品、客户和场景。医疗保健接待代理、餐厅点餐代理和娱乐伴侣不应听起来可以互换。
Together AI 为团队提供了一个单一平台,用于构建跨 STT、LLM 和 TTS 的实时语音代理。整个流水线在同一云上协同运行,端到端延迟保持在 500 毫秒以下,足以实现实时轮换。语音查找器通过为开发者提供更快的方式来探索该堆栈中可用的语音,从而简化了模型选择步骤。
开始使用
→ 在 findtherightvoice.com 尝试语音查找器
→ 探索 Together AI 语音平台
→ 阅读语音代理文档
→ 联系销售以获取专用端点和生产部署
