COSA 模型

创建声音并理解您的用户。
认识 Cosa。

Cosa 是一个用于转换文本和语音,以及注册和重复使用语音的语音 AI 系列。
用于服务公告、内容创作、无障碍服务和对话代理。

面向对话服务的语音 AI

结合语音合成、语音克隆、语音设计、流式传输和语音识别,构建对话服务和语音界面。

Cosa-A

精细控制语音合成

TTS 语音克隆 语音设计 流式传输

适用于需要精确控制的语音服务
以控制速度、语言和合成方法。

Cosa-B

语音选择和自定义语音创建

预设 基于描述的生成 参考音色复现

创建一致的品牌或角色语音
并在您的内容中重复使用这些语音。

Cosa ASR

转录和语音识别

输入
实时 · 文件
输出
文本

将通话、语音命令和客户对话转换为文本
并将其连接到 CIP 进行处理。

使用 Cosa 构建语音体验

选择适合您服务的语音合成、克隆、设计和识别功能。

在开发者文档中查找最新的 Cosa 规格

本页面介绍模型功能以及如何在不同模型之间进行选择。
在开发者文档中查找准确的模型 ID、输入和输出限制、支持的功能以及版本变更。

模型 ID 输入和输出规格 API 示例 更新日志
Cosa 开发者文档

设计服务所需的语音体验

CLEVI

语言和地区

机器翻译的语言由 clevi/cip-5.5-im 翻译,并会标注为机器翻译。这适用于已发布网站内容包的语言。

136 种语言

推荐

1

东亚

7

东南亚

11

南亚

18

中亚

5

中东和高加索

10

西欧和南欧

16

英国和爱尔兰

4

北欧

10

中欧和巴尔干

14

东欧

5

东非

8

西非和中非

9

南部非洲

8

美洲

5

大洋洲

5