COSA MODELS

목소리를 만들고, 사용자의 말을 이해하는 모델,
Cosa를 소개합니다.

Cosa는 텍스트와 음성을 서로 변환하고, 목소리를 등록·재사용하는 음성 AI 제품군입니다.
서비스 안내, 콘텐츠 제작, 접근성 지원, 대화형 에이전트에 활용할 수 있습니다.

대화형 서비스를 위한 음성 AI

음성 합성 · 복제 · 디자인 · 스트리밍과 음성 인식을 조합해 대화 서비스와 음성 인터페이스를 구현합니다.

Cosa-A

세부 합성 제어

TTS 음성 복제 음성 디자인 스트리밍

속도와 언어, 합성 방식까지 세밀하게
제어해야 하는 음성 서비스에 적합합니다.

Cosa-B

목소리 선택·맞춤 음성 제작

프리셋 설명 기반 생성 참조 음성 재현

일관된 브랜드 보이스나 캐릭터 음성을 만들고
재사용할 때 적합합니다.

Cosa ASR

텍스트 변환·음성 인식

입력
실시간 · 파일
출력
텍스트

통화 기록, 음성 명령, 상담 내용을 텍스트로 전환해
CIP가 처리하도록 연결합니다.

Cosa로 만드는 음성 경험

음성 합성·복제·디자인·인식을 목적에 맞게 선택해 서비스에 적용해보세요.

Cosa의 최신 사양은 개발자 문서에서 확인하세요

홈페이지에서는 모델의 역할과 선택 기준을 설명합니다.
정확한 모델 ID, 입출력 길이, 지원 기능과 버전 변경 사항은 개발자 문서에서 관리합니다.

모델 ID 입출력 사양 API 예제 변경 이력
Cosa 개발자 문서

서비스에 맞는 음성 경험을 설계하세요

CLEVI

언어 및 지역 설정

기계 번역 언어는 clevi/cip-5.5-im으로 번역하여 별도로 표시되며 공개된 사이트 번들이 있는 언어에 적용됩니다.

136개 언어

추천

1

동아시아

7

동남아시아

11

남아시아

18

중앙아시아

5

중동·캅카스

10

서·남유럽

16

영국·아일랜드

4

북유럽·발트

10

중유럽·발칸

14

동유럽

5

동아프리카

8

서·중앙아프리카

9

남부 아프리카

8

미주

5

태평양

5
Cosa — CLEVI