Cosa 是一个用于转换文本和语音,以及注册和重复使用语音的语音 AI 系列。 用于服务公告、内容创作、无障碍服务和对话代理。
结合语音合成、语音克隆、语音设计、流式传输和语音识别,构建对话服务和语音界面。
精细控制语音合成
适用于需要精确控制的语音服务 以控制速度、语言和合成方法。
语音选择和自定义语音创建
创建一致的品牌或角色语音 并在您的内容中重复使用这些语音。
转录和语音识别
将通话、语音命令和客户对话转换为文本 并将其连接到 CIP 进行处理。
选择适合您服务的语音合成、克隆、设计和识别功能。
Cosa ASR 转录客户的话语,CIP 准备响应, 由 Cosa-A 或 Cosa-B 以语音形式生成。
根据描述或参考录音注册自定义语音, 然后以相同的声音生成对话和旁白。
在句子完成后逐句合成语音, 并控制播放,为引导和无障碍服务提供支持。
本页面介绍模型功能以及如何在不同模型之间进行选择。 在开发者文档中查找准确的模型 ID、输入和输出限制、支持的功能以及版本变更。
机器翻译的语言由 clevi/cip-5.5-im 翻译,并会标注为机器翻译。这适用于已发布网站内容包的语言。
136 种语言