Developer guide

Модели

Обобщение на моделите

Моделите на CLEVI са разделени на три продуктови линии: CIP, предназначена за общ интелект и автоматизация на работата; Cosa, предназначена за генериране и разпознаване на реч; и Cova, предназначена за извличане на информация от документи и изображения. Всеки продукт може да се използва самостоятелно или да бъде свързан в услуга, която обхваща разпознаване на документи, анализ, изпълнение на задачи и гласови инструкции.

ПродуктID на моделаОсновни спецификацииОсновна роля
CIP-5.5-SMcip-5.5-sm24B~40B конфигурируемАвтоматизация на локални задачи и задачи на edge сървъри
CIP-5.5-IMcip-5.5-im360B · вход 256K · изход 64K · мултимодаленОбработка на общи задачи. Приоритет на скоростта на отговор и пропускателната способност
CIP-5.5-MMcip-5.5-mm800B · вход 512K · изход 64K · мултимодаленАнализ на дълъг контекст и решаване на сложни проблеми
Cosa-Acosa-aСинтез·клониране·дизайн·стрийминг на речГенериране на реч с детайлен контрол на синтеза
Cosa-Bcosa-bСинтез·клониране·дизайн·стрийминг на речИзбор на глас и генериране на персонализирана реч
Cosa ASRcosa-asrРазпознаване на речПреобразуване на гласов вход в текст
Covacova-1Специализиран за OCR с визуален LLMИзвличане на текст, оформление и таблици, както и базово описание на изображения

CIP

CIP отговаря за общия интелект и автоматизацията на работата. Състои се от cip-5.5-im и cip-5.5-mm, които се извикват чрез шлюз, и cip-5.5-sm, който се разполага на edge сървъри и в локална инфраструктура.

cip-5.5-im и cip-5.5-mm

Категорияcip-5.5-imcip-5.5-mm
Размер360B800B
Лимит на входа256K512K
Максимален изход64K64K
Формат на входаТекст и визуални материали (документи, изображения на екрана, таблици и диаграми)Текст и визуални материали (интегриран преглед на код, документи и материали от екрана)
Насока на конфигурациятаОбработва ежедневни задачи, свързани със знания, и задачи по разработка, с фокус върху скоростта на отговор, икономичността и пропускателната способност.Обработва сложни задачи, които комбинират и анализират множество материали и условия и свързват резултатите от анализа с реални действия.
Предназначение на дългия входЕдновременно преглежда множество документи, кодови файлове и история на разговорите.Работи едновременно с обширни справочни материали и история на задачите и изпълнява агентни задачи, при които проучването, изпълнението и проверката протичат на няколко етапа.

cip-5.5-im е подходящ за задачи с ясни цели и обхват. Типични примери са извличане на необходимата информация от предоставени материали, изготвяне на резултати в зададен формат и промяна на код според изискванията. Максималният изход от 64K се използва за подробни отчети или резултати, състоящи се от множество части.

  • Помощ при разработката: създава функции и функционалности, поправя ясно дефинирани грешки и реализира решения в съответствие със съществуващите шаблони.
  • Създаване на тестове: изготвя чернови на тестове и случаи за проверка въз основа на изискванията и реализацията.
  • Обработка на документи: изпълнява обобщаване, класифициране, извличане на елементи, преобразуване на формати и изготвяне на чернови.
  • Мултимодален анализ: преглежда таблици и диаграми в изображения на екрани и документи заедно със свързаните описания.
  • Интерактивна работна поддръжка: отговаря на въпроси въз основа на работни материали и изготвя необходимите резултати.
  • Масова обработка: използва се за индивидуално обобщаване на множество документи, класифициране на заявки и преобразуване на данни.
  • Подагенти: изпълнява ясно ограничени подзадачи като проучване на код, преглед на конкретни файлове и организиране на материали.

Например използва се за получаване на функционални изисквания и свързан код, след което изготвя предложение за промени, тестове и описание на промените, или за класифициране на входящи документи и създаване на обобщение за отговорното лице.

cip-5.5-mm е подходящ за задачи, при които е необходимо да се разберат връзките между информацията и да се поддържа последователност на цялостната работа. При разработката проверява връзките между изискванията, дизайна, реализацията и тестовете, а при анализа на документи обобщава твърденията и доказателствата, разликите и противоречията в множество материали.

  • Реализация на комплексни функционалности: променя едновременно код, тестове и документация, като отчита договорите и поведението на множество модули.
  • Мащабен анализ на код: проверява връзките между извикванията, потока на данните и обхвата на въздействието на промените.
  • Анализ на причините за инциденти: съпоставя логове, конфигурации, код и резултати от изпълнението, за да структурира хипотези за причините и процедури за проверка.
  • Поддръжка на дизайна и вземането на решения: структурира изискванията и ограниченията и анализира влиянието на алтернативите за реализация.
  • Синтезиран анализ на множество документи: обобщава приликите, разликите и противоречията в отчети и техническа документация въз основа на доказателства.
  • Интегриран мултимодален преглед: интерпретира едновременно текстови и визуални материали, за да анализира проблеми и изисквания.
  • Многостепенни агенти: използва се за задачи, включващи проучване, планиране, изпълнение на инструменти и преглед на резултатите.
  • Изготвяне на специализирани документи: създава технически отчети, проектни предложения и подробни документи за преглед, отразяващи сложни условия и доказателства.

Например се използва за едновременен преглед на свързаните кодове за грешки и логове от няколко услуги или за задачи, които обхващат целия процес — от анализа на изискванията за сложна функционалност до прегледа на резултатите от реализацията и валидирането.

cip-5.5-sm

cip-5.5-sm извършва локално извеждане и автоматизация на задачи на edge сървъри и в локални среди. Тъй като размерът на модела може да се настройва в диапазона от 24B до 40B, конфигурацията може да бъде избрана според изчислителните ресурси на оборудването за внедряване и необходимата производителност на място. Обработката се извършва близо до мястото, където се генерират данните, затова моделът се използва за интеграция с локални системи и за използване на вътрешни данни. Ако необходимите модели и инструменти бъдат конфигурирани локално, той може да работи и в среди с ограничена външна свързаност.

Той интерпретира информацията, възникваща на място, и я свързва с процедурите за обработка. Класифицира логове и заявки, извлича необходимата информация от данните и изпълнява повтарящи се задачи чрез свързани вътрешни инструменти и скриптове.

  • Обработка на събития на място: Класифицира логовете на оборудването и информацията за състоянието и избира събитията, които изискват проверка.
  • Предварителна обработка на данни: Извлича ключови елементи от работните записи и ги класифицира, маркира и нормализира.
  • Маршрутизиране на заявки: Предава получените заявки към отговорната система или процедура за обработка.
  • Локален работен агент: Изпълнява повтарящи се задачи чрез справки във вътрешни системи и изпълнение на скриптове.
  • Поддръжка на задачи в локална среда: Отговаря на въпроси въз основа на вътрешни материали и обобщава работното съдържание.
  • Поддръжка на последващ анализ: Избира материалите, които изискват допълнителен преглед, и обобщава ключовото съдържание.

Например се използва за процес, който включва класифициране на оперативните логове на сървър на работното място, справка със свързаната история и изготвяне на обобщение на инцидента за отговорното лице.

Cosa

Cosa е продуктова линия за глас, която преобразува текст в реч, разпознава входящата реч като текст и позволява регистриране и повторно използване на желания глас. Използва се за сервизни указания, създаване на съдържание, поддръжка на достъпността и гласови интерфейси на разговорни агенти.

Генерирането на реч се извършва от cosa-a и cosa-b, а разпознаването на реч — от cosa-asr. cosa-a и cosa-b са отделни модели, всеки от които предоставя собствен списък с гласове и настройки за синтез, и се избират в един и същ сервизен интерфейс. Функциите, предоставяни общо от двата модела, са следните.

  • Синтезиране на текст в реч: Синтезирайте въведения текст с избран глас.
  • Клониране на глас: Регистрирайте глас въз основа на референтен запис, за който имате разрешение за използване, и синтезирайте нов текст.
  • Дизайн на глас: Създайте и регистрирайте глас, като опишете желаните му характеристики.
  • Повторно използване на глас: Използвайте регистриран глас за последващ синтез.
  • Настройки за синтез: Регулирайте скоростта на говорене, езика и други параметри.
  • Поточно предаване: Синтезирайте текста на фрази, веднага щом пристигне, и последователно предавайте аудиото.
  • Управление на възпроизвеждането: Поддържайте пауза, възобновяване, спиране и въвеждане на допълнителен текст.

С постепенното въвеждане на текст можете да започнете възпроизвеждането на речта, преди целият отговор да е завършен. Докато CIP съставя отговора, можете да конфигурирате услуга, в която Cosa прочита подготвените фрази.

cosa-a

cosa-a поддържа синтезиране на текст в реч, клониране на глас, дизайн на глас и поточен изход. В допълнение към основните функции за избор на глас, език и скорост на говорене, предлага допълнителни настройки за управление, като броя на стъпките при синтеза, силата на насочване и дължината на генерирания резултат. Използва се за настройване на параметрите по време на създаването на глас, преглед на резултата или прилагане на няколко набора от настройки към един и същ сценарий и избор на резултат.

  • Синтезирайте инструкции и известия за приложения, павилиони и работни системи.
  • Създавайте аудио материали и ръководства за употреба.
  • Създавайте narration за видео и аудио съдържание.
  • Създавайте повтарящо се съдържание с регистриран глас.
  • Използвайте го за поточен гласов изход на разговорни агенти.
  • Използвайте го за създаване на глас чрез регулиране на подробни настройки за синтез.

cosa-b

cosa-b поддържа избор на предварително зададени гласове, дизайн на глас въз основа на описание, клониране въз основа на референтен глас и поточен изход. Можете да изберете глас от собствения списък с гласове или да регистрирате нов глас за използване в услугата.

За клониране на глас се използват референтен запис и съответстващият му текст. Поддържа се и процес, при който референтният текст се генерира чрез разпознаване на реч по време на регистрацията, а регистрираният глас се използва повторно при последващ синтез.

  • Изграждайте гласови персони за услуги и герои.
  • Създавайте персонализирани гласове чрез описание или референтен запис.
  • Синтезирайте брандови инструкции, реплики на герои и narration за съдържание.
  • Използвайте го за гласови отговори на разговорни агенти.
  • Синтезирайте променящи се съобщения и сценарии с един и същ глас.

Когато избирате между cosa-a и cosa-b, се ръководете от желания глас, действителния резултат от синтеза и необходимите елементи за управление.

Елементcosa-acosa-b
Настройки за синтезВ допълнение към гласа, езика и скоростта на говорене включва настройки за броя стъпки на синтеза, силата на насочване и дължината на генерирания резултатОбщи настройки, като скорост на говорене и език
Вход за клониранеРеферентен запис, за който имате право на използванеРеферентен запис и съответстващ текст. При регистрацията референтният текст може да бъде генериран чрез разпознаване на реч
РоляГенериране на глас с детайлен контрол на синтезаИзбор на глас и генериране на персонализиран глас

cosa-asr

cosa-asr преобразува входящата реч в текст. Той документира записи или преобразува подадени с глас заявки във вход, който последващите работни системи могат да обработят.

  • Транскрибира гласови бележки и записи.
  • Преобразува въпроси и работни заявки, подадени с глас, във вход.
  • Генерира референтен текст за клониране на глас.
  • Използва се за обработка, която след транскрипцията включва обобщаване, класифициране и търсене.

Когато предадете резултатите от транскрипцията на CIP, процесът продължава с обобщаване на съдържанието, класифициране на заявките и изготвяне на работни чернови. Като синтезирате резултатите от обработката с cosa-a или cosa-b, получавате работна услуга с гласов вход и изход.

Cova

cova-1 е специализиран за визуален OCR модел, базиран на LLM. Той разпознава текст от документи и изображения, извлича оформлението и структурата на таблиците и предоставя кратки описания на визуалните елементи.

Преобразува документите, предназначени за преглед от хора, във формат, удобен за използване от агенти и работни системи. Основният текст и таблиците се извличат като структурирано съдържание, а изображенията в документа се предават с кратки описания, така че последващият агент да може да разбере едновременно съдържанието на документа и визуалния контекст. Като първо се запознаете с материалите чрез извлечения текст и описанията, а след това допълнително преглеждате само оригиналите, които изискват подробна проверка, можете да намалите необходимостта от многократно подаване на оригиналните изображения и да спестите контекстови токени.

ФункцияОписание
Разпознаване на текстИзвлича текст от сканирани или заснети документи.
Интерпретиране на оформлениетоРазделя съдържанието на блокове, като отчита оформлението на документа.
Предоставяне на информация за местоположениетоПредоставя местоположението на разпознатите блокове, за да свърже извлечените резултати с оригиналния текст.
Извличане на структурата на таблициСтруктурира съдържанието на таблиците за търсене и обработка на данни.
Кратко описание на изображенияКратко описва съдържанието на изображенията и визуалните елементи, за да предостави на агента насоки за интерпретация.
Оптимизиране на контекстаПредава информацията основно чрез текст, структура и описания на изображения, като намалява повторното подаване на оригиналните изображения.
Селективен подробен анализПомага на агента да прецени кои оригинални изображения трябва да провери допълнително.
Преобразуване на формата на документаПодрежда резултатите от разпознаването като HTML или Markdown.
  • Дигитализация на документи: Преобразува хартиени документи и сканирани материали в текстови материали.
  • Приемане на служебни документи: Извлича съдържание от заявления, доказателствени материали и отчети.
  • Обработка на таблични данни: Използва таблиците, включени в документите, за последваща обработка на данни.
  • Предварителна обработка за търсене на знания: Преобразува изображения на документи и визуални материали в текст и структура, които могат да се търсят.
  • Автоматизиране на прегледа на документи: Предава извлечените резултати на CIP за проверка на елементи, обобщаване и сравнение между материали.
  • Оптимизиране на входа за агента: Подрежда основния текст, таблиците и описанията на изображенията в дълги документи, за да предаде само необходимата информация.

Например извлича основния текст и таблиците от отчет, като описва включената графика като графика, показваща тримесечната тенденция на продажбите. С това описание агентът разбира наличието и предназначението на графиката и когато са необходими точни стойности или тенденции, проверява допълнително съответния оригинал.

Свързване на продуктови групи

Чрез свързване на продуктите можете да конфигурирате следния поток.

  • Работа на базата на документи: Cova извлича основния текст, таблиците и описанията на изображенията, CIP селективно проверява необходимите оригинали, за да извърши анализ и обработка на задачи, а Cosa предава резултатите чрез глас.
  • Работа на базата на глас: Cosa ASR преобразува гласовите заявки в текст, а cosa-a или cosa-b прочита отговорите, обработени от CIP.
  • Автоматизация на място: cip-5.5-sm класифицира данните на място и изпълнява локални задачи, а материалите, изискващи допълнителен цялостен анализ, се предават на cip-5.5-im или cip-5.5-mm.

Разрешени повиквания в шлюза

Планът на шлюза определя разрешените извиквания за всеки модел. Таблицата по-долу показва обхвата, отворен от плановете LLM_FREE, TTS_FREE и STT_FREE, които се прилагат автоматично без подаване на заявление. Моделите, отворени чрез други маршрути, не са включени.

ИД на моделаРазрешени извикванияПлан, предоставящ достъп
cip-5.5-imanthropic.messages · chat.completions · chat.completions.batch · completions · responsesLLM_FREE
cip-5.5-im-chatanthropic.messages · chat.completions · chat.completions.batch · completions · responsesLLM_FREE
cip-5.5-mmanthropic.messages · chat.completions · chat.completions.batch · completions · responsesLLM_FREE
cip-5.5-mm-hanthropic.messages · chat.completions · chat.completions.batch · completions · responsesLLM_FREE
cosa-aaudio.speech · audio.speech.clone · voices · voices.designTTS_FREE
cosa-baudio.speech · audio.speech.clone · voices · voices.designTTS_FREE
cosa-ttsaudio.speech · audio.speech.clone · voices · voices.designTTS_FREE
cosa-asraudio.transcriptionsSTT_FREE
ivy-4-embeddingembeddingsLLM_FREE
ivy-4-embedding-mmembeddingsLLM_FREE
ivy-4-mmanthropic.messages · chat.completions · chat.completions.batch · completions · responsesLLM_FREE

cip-5.5-sm и cova-1 не са включени в тази таблица с планове. cip-5.5-im-chat, cip-5.5-mm-h, cosa-tts, ivy-4-embedding, ivy-4-embedding-mm и ivy-4-mm в таблицата са идентификатори на модели, които не са включени в описанието на продуктите по-горе. В документацията за извършване на API повиквания е посочено към кой маршрут се отнася ключът за извикване.

CLEVI

Език и регион

Езиците, преведени машинно, са обозначени. Наличността следва публикувания пакет на сайта.

136 езика

Препоръчано

1

Източна Азия

7

Югоизточна Азия

11

Южна Азия

18

Централна Азия

5

Близък изток и Кавказ

10

Западна Европа и Южна Европа

16

Обединеното кралство и Ирландия

4

Северна Европа

10

Централна Европа и Балканите

14

Източна Европа

5

Източна Африка

8

Западна Афирка и Централна Африка

9

Южноафрикански регион

8

Америка

5

Океания

5