Developer guide
Model
Modelopsomming
CLEVI-modelle word in drie produkfamilies verdeel: CIP vir algemene intelligensie en werkvloei-outomatisering, Cosa vir stemskepping en -herkenning, en Cova vir die onttrekking van inligting uit dokumente en beelde. Elke produk kan onafhanklik gebruik word of aan dienste gekoppel word wat lei van dokumentherkenning, ontleding en werkuitvoering tot stemleiding.
| Produk | Model-ID | Belangrikste spesifikasies | Primêre rol |
|---|---|---|---|
| CIP-5.5-SM | cip-5.5-sm | 24B~40B, aanpasbaar | Randbedieners en plaaslike werkvloei-outomatisering |
| CIP-5.5-IM | cip-5.5-im | 360B · Invoer 256K · Uitvoer 64K · Multimodaal | Algemene werkverwerking. Prioritiseer reaksiespoed en deurset |
| CIP-5.5-MM | cip-5.5-mm | 800B · Invoer 512K · Uitvoer 64K · Multimodaal | Ontleding van lang kontekste en oplossing van komplekse probleme |
| Cosa-A | cosa-a | Spraaksintese · stemkloning · ontwerp · stroming | Stemgenerering met gedetailleerde beheer oor sintese |
| Cosa-B | cosa-b | Spraaksintese · stemkloning · ontwerp · stroming | Stemkeuse en gepersonaliseerde stemgenerering |
| Cosa ASR | cosa-asr | Spraakherkenning | Omskakeling van spraakinvoer na teks |
| Cova | cova-1 | LLM-gebaseerde visie-OCR-spesialis | Onttrekking van teks, uitleg en tabelle, plus eenvoudige beeldbeskrywings |
CIP
CIP is verantwoordelik vir algemene intelligensie en werkvloei-outomatisering. Dit bestaan uit cip-5.5-im en cip-5.5-mm, wat deur die gateway aangeroep word, en cip-5.5-sm, wat op randbedieners en plaaslik geïmplementeer word.
cip-5.5-im en cip-5.5-mm
| Item | cip-5.5-im | cip-5.5-mm |
|---|---|---|
| Skaal | 360B | 800B |
| Invoerlimiet | 256K | 512K |
| Maksimum uitvoer | 64K | 64K |
| Invoerformaat | Teks en visuele materiaal (dokumente, skermbeelde, tabelle en grafieke) | Teks en visuele materiaal (geïntegreerde hersiening van kode, dokumente en skermmateriaal) |
| Ontwerpbenadering | Verwerk alledaagse kenniswerk en ontwikkelingstake met die fokus op reaksiespoed, kostedoeltreffendheid en deurset. | Verwerk komplekse take wat verskeie bronne en voorwaardes kombineer en ontleed, en die ontledingsresultate in werklike werk omskakel. |
| Gebruik van lang invoer | Hersien verskeie dokumente, kode-lêers en gesprekgeskiedenis saam. | Hanteer uitgebreide verwysingsmateriaal en werkgeskiedenis saam, en voer agenttake uit waarin navorsing, uitvoering en validering oor verskeie stappe heen plaasvind. |
cip-5.5-im is geskik vir take met duidelike doelwitte en 'n duidelik afgebakende omvang. Tipiese take sluit in om die nodige inligting uit die verskafde materiaal te onttrek, uitsette in die gespesifiseerde formaat te skryf en kode volgens die vereistes aan te pas. Die maksimum uitset van 64K word gebruik om gedetailleerde verslae of resultate wat uit verskeie dele bestaan, te skryf.
- Ontwikkelingsbystand: Skryf funksies en kenmerke, herstel foute met 'n duidelik afgebakende omvang en implementeer volgens bestaande patrone.
- Toetsgenerering: Skryf toetskonsepte en verifikasiesake op grond van die vereistes en implementering.
- Dokumentverwerking: Hanteer opsomming, klassifikasie, itemonttrekking, formaatomskakeling en die opstel van konsepte.
- Multimodale ontleding: Hersien skermbeelde en tabelle en grafieke in dokumente saam met relevante verduidelikings.
- Interaktiewe werksondersteuning: Beantwoord vrae op grond van werksmateriaal en skep die nodige uitsette.
- Grootmaatverwerking: Gebruik dit vir individuele opsommings van talle dokumente, versoekklassifikasie en data-omskakeling.
- Subagent: Hanteer ondertake met duidelike grense, soos kodeverkenning, die hersiening van spesifieke lêers en die ordening van materiaal.
Dit word byvoorbeeld gebruik vir take soos om 'n funksionele vereiste en verwante kode te ontvang en 'n wysigingsvoorstel, toetse en 'n beskrywing van die veranderinge te skryf, of om ingediende dokumente te klassifiseer en 'n opsomming vir die verantwoordelike persoon te maak.
cip-5.5-mm is geskik vir take wat vereis dat verhoudings tussen inligting verstaan en konsekwentheid deur die hele taak gehandhaaf word. In ontwikkeling word die verband tussen vereistes, ontwerp, implementering en toetsing hersien, en in dokumentontleding word die stellings en bewyse, verskille en teenstrydighede in verskeie bronne geïntegreer.
- Implementering van komplekse kenmerke: Verander kode, toetse en dokumentasie saam met inagneming van die kontrakte en gedrag van verskeie modules.
- Grootskaalse kodeontleding: Hersien oproepverhoudings, datavloei en die omvang van die impak van veranderinge.
- Ontleding van die oorsaak van voorvalle: Vergelyk logs, instellings, kode en uitvoerresultate om oorsaakhipoteses en verifikasiestappe te organiseer.
- Ontwerp- en besluitnemingsondersteuning: Struktureer vereistes en beperkings en ontleed die impak van implementeringsalternatiewe.
- Omvattende ontleding van verskeie dokumente: Organiseer ooreenkomste, verskille en teenstrydighede in verslae en tegniese dokumente op grond van bewyse.
- Geïntegreerde multimodale hersiening: Interpreteer teks en visuele materiaal saam om probleme en vereistes te ontleed.
- Meerstap-agent: Gebruik dit vir take wat uit navorsing, beplanning, hulpmiddeluitvoering en die hersiening van resultate bestaan.
- Skryf van professionele dokumente: Skryf tegniese verslae, ontwerpvoorstelle en gedetailleerde hersieningsdokumente wat komplekse voorwaardes en bewyse weerspieël.
Dit word byvoorbeeld gebruik om die relevante kode en logs van foute wat in verskeie dienste voorkom, saam te ondersoek, of vir take wat strek van die ontleding van vereistes vir komplekse funksies tot implementering en die hersiening van verifikasieresultate.
cip-5.5-sm
cip-5.5-sm voer plaaslike inferensie en werkvloei-outomatisering op randbedieners en in plaaslike omgewings uit. Omdat die modelgrootte binne die reeks van 24B~40B aangepas kan word, kan die konfigurasie gekies word volgens die rekenaarhulpbronne van die ontplooiingstoerusting en die vereiste werkverrigting op die terrein. Omdat verwerking naby die punt waar data ontstaan plaasvind, word dit gebruik vir integrasie met terrein-stelsels en die benutting van interne data. Deur die nodige modelle en gereedskap plaaslik op te stel, kan dit ook bedryf word in omgewings met beperkte eksterne verbinding.
Dit speel die rol om inligting wat op die terrein ontstaan, te interpreteer en aan verwerkingsprosedures te koppel. Dit klassifiseer logs en versoeke, onttrek die nodige inligting uit data, en voer herhalende take uit met gekoppelde interne gereedskap en skripte.
- Verwerking van terrein-geleenthede: Klassifiseer toerustinglogs en statusinligting, en kies die geleenthede wat nagegaan moet word.
- Voorverwerking van data: Onttrek kernitems uit werkrekords en voer klassifikasie, merking en normalisering uit.
- Versoekroetering: Stuur ingediende versoeke na die verantwoordelike stelsel of verwerkingsprosedure.
- Plaaslike werkagent: Voer herhalende take uit deur interne stelsels te raadpleeg en skripte uit te voer.
- Ondersteuning vir plaaslike werk: Beantwoord vrae op grond van interne materiaal en organiseer werkinhoud.
- Ondersteuning vir opvolganalise: Kies materiaal wat verdere hersiening vereis en som die kerninhoud op.
Dit word byvoorbeeld gebruik in 'n werkvloei waar bedryfslogs op 'n besigheidsterrein se bediener geklassifiseer word, verwante geskiedenis geraadpleeg word, en daarna 'n gebeurtenisopsomming vir die verantwoordelike persoon opgestel word.
Cosa
Cosa is 'n reeks stemprodukte wat teks na spraak omskakel, ingevoerde spraak as teks herken, en gewenste stemme registreer sodat dit hergebruik kan word. Dit word gebruik vir diensleiding, inhoudskepping, toeganklikheidsondersteuning en stemkoppelvlakke vir gespreksagente.
cosa-a en cosa-b is verantwoordelik vir stemgenerering, terwyl cosa-asr verantwoordelik is vir spraakherkenning. cosa-a en cosa-b is afsonderlike modelle wat elk hul eie stemlys en sintese-instellings bied, en word binne dieselfde diens-koppelvlak gekies. Die funksies wat albei modelle gemeenskaplik bied, is soos volg.
- Teks-na-spraak-omskakeling: Sintetiseer die ingevoerde teks met die geselekteerde stem.
- Stemkloning: Registreer ’n stem op grond van ’n verwysingsopname waarvoor jy gebruiksregte het, en sintetiseer nuwe sinne.
- Stemontwerp: Skep en registreer ’n stem deur die gewenste stemkenmerke te beskryf.
- Hergebruik van stemme: Gebruik ’n geregistreerde stem vir daaropvolgende sintese.
- Sintese-instellings: Pas onder meer die praatspoed en taal aan.
- Stroomaflewering: Sintetiseer teks in frases soos dit aankom en lewer die oudio opeenvolgend.
- Afspeelbeheer: Ondersteun onderbreking, hervatting, stop en die invoer van bykomende sinne.
Deur geleidelike teksinvoer te gebruik, kan stemafspeel begin voordat die volledige antwoord voltooi is. Terwyl CIP die antwoord skryf, kan jy ’n diens opstel waarin Cosa die frases lees sodra hulle gereed is.
cosa-a
cosa-a ondersteun teks-na-spraak-omskakeling, stemkloning, stemontwerp en stroomuitvoer. Benewens basiese funksies waarmee jy die stem, taal en praatspoed kies, bied dit bykomende beheeropsies, soos instellings vir die aantal sintesestappe, die intensiteit van leiding en die lengte van die generering. Dit word gebruik om instellings tydens die stemproduksieproses aan te pas en die resultate te hersien, of om verskeie instellings op dieselfde manuskrip toe te pas en ’n resultaat te kies.
- Sintetiseer aankondigings en kennisgewings vir toepassings, kiosks en werkstelsels.
- Skep opleidingsmateriaal en gebruikershandleidings as oudio.
- Produseer vertelling vir video- en oudio-inhoud.
- Produseer herhalende inhoud met ’n geregistreerde stem.
- Gebruik dit vir stroomuitvoer van stem vir interaktiewe agente.
- Gebruik dit vir stemproduksie waarin gedetailleerde sintese-instellings aangepas word.
cosa-b
cosa-b ondersteun die keuse van voorafingestelde stemme, beskrywingsgebaseerde stemontwerp, kloning op grond van verwysingsstemme en stroomuitvoer. Kies ’n stem uit jou eie stemlys of registreer ’n nuwe stem om in ’n diens te gebruik.
Stemkloning gebruik ’n verwysingsopname en die ooreenstemmende teks daarvan. Dit ondersteun ook ’n proses waarin verwysingsteks deur spraakherkenning tydens registrasie gegenereer word, en geregistreerde stemme word in daaropvolgende sintese hergebruik.
- Stel die stem-persona van dienste en karakters saam.
- Skep ’n pasgemaakte stem met ’n beskrywing of verwysingsopname.
- Sintetiseer handelsmerkaankondigings, karakterdialoog en inhoudvertelling.
- Gebruik dit vir stemantwoorde van interaktiewe agente.
- Sintetiseer aankondigingsboodskappe en manuskripte wat met dieselfde stem verander.
Wanneer jy tussen cosa-a en cosa-b kies, gebruik die gewenste stem, die werklike sinteseresultaat en die nodige beheeropsies as riglyne.
| Item | cosa-a | cosa-b |
|---|---|---|
| Sintese-instellings | Benewens stem, taal en praatspoed, instellings vir die aantal sintesestappe, leidingsterkte en gegenereerde lengte | Algemene instellings soos praatspoed en taal |
| Kloningsinvoer | ’n Verwysingsopname waarvoor jy die gebruiksregte het | ’n Verwysingsopname en die ooreenstemmende teks. Die verwysingsteks kan tydens registrasie deur spraakherkenning gegenereer word |
| Rol | Stemgenerering met gedetailleerde sintesebeheer | Stemkeuse en pasgemaakte stemgenerering |
cosa-asr
cosa-asr skakel ingevoerde spraak na teks om. Dit dokumenteer opnames en omskep versoeke wat per stem ontvang is in invoer wat deur daaropvolgende werkstelsels verwerk kan word.
- Transkribeer stemnotas en opnames.
- Skakel stemgebaseerde vrae en werkversoeke na invoer om.
- Genereer verwysingsteks vir stemkloning.
- Gebruik dit vir verwerking wat ná transkripsie volg, soos opsomming, klassifikasie en soektogte.
Wanneer jy die transkripsieresultaat aan CIP deurgee, lei dit tot inhoudsomming, versoekklassifikasie en die opstel van werkskonsepte. Deur die verwerkingsresultaat met cosa-a of cosa-b te sintetiseer, word dit ’n werkdiens met steminvoer en -uitvoer.
Cova
cova-1 is ’n LLM-gebaseerde model wat spesifiek vir visuele OCR ontwerp is. Dit herken teks in dokumente en beelde, onttrek uitleg en tabelstrukture en verskaf kort beskrywings van visuele elemente.
Dit omskep dokumente soos mense dit sien in ’n vorm wat agente en werkstelsels maklik kan gebruik. Hoofteks en tabelle word as gestruktureerde inhoud onttrek, terwyl beelde in die dokument met kort beskrywings weergegee word. Opvolgende agente kan dus sowel die dokument se inhoud as sy visuele konteks verstaan. Deur ’n proses saam te stel waarin die materiaal eers met die onttrekte teks en beskrywings verstaan word en slegs die oorspronklikes wat nadere bevestiging vereis, daarna nagegaan word, kan jy die hoeveelheid kere wat oorspronklike beelde ingevoer word, verminder en kontekstekens bespaar.
| Funksie | Beskrywing |
|---|---|
| Teksherkenning | Onttrek teks uit dokumente wat geskandeer of gefotografeer is. |
| Uitleginterpretasie | Verdeel die inhoud in blokke met inagneming van die dokument se uitleg. |
| Verskaffing van liggingsinligting | Verskaf die liggings van die herkende blokke om die onttrekkingsresultate aan die oorspronklike teks te koppel. |
| Onttrekking van tabelstrukture | Struktureer die inhoud van tabelle vir soektogte en dataverwerking. |
| Eenvoudige beeldbeskrywing | Beskryf die inhoud van beelde en visuele elemente kortliks om die agent leidrade vir interpretasie te gee. |
| Konteksoptimalisering | Verminder herhaalde invoer van die oorspronklike beeld deur inligting hoofsaaklik via teks, struktuur en beeldbeskrywings oor te dra. |
| Selektiewe gedetailleerde ontleding | Help die agent om te bepaal watter oorspronklike beelde hy verder moet nagaan. |
| Omskakeling van dokumentformaat | Organiseer die herkenningsresultate as HTML of Markdown. |
- Digitalisering van dokumente: Skakel papierdokumente en geskandeerde materiaal om in teksgebaseerde materiaal.
- Ontvangs van sakedokumente: Onttrek inhoud uit aansoekvorms, bewysmateriaal en verslae.
- Verwerking van tabeldata: Gebruik tabelle in dokumente vir daaropvolgende dataverwerking.
- Voorverwerking vir kennisherwinning: Skakel dokumentbeelde en visuele materiaal om in soekbare teks en strukture.
- Outomatisering van dokumenthersiening: Stuur onttrekkingsresultate na CIP om items na te gaan, op te som en materiaal te vergelyk.
- Optimalisering van agentinvoer: Organiseer die hoofteks, tabelle en beeldbeskrywings van lang dokumente om slegs die nodige inligting oor te dra.
Byvoorbeeld, terwyl die hoofteks en tabelle van ’n verslag onttrek word, word ’n ingevoegde grafiek beskryf as ’n grafiek wat die kwartaallikse verkoopsneiging toon. Die agent bepaal met behulp van hierdie beskrywing dat die grafiek bestaan en wat die doel daarvan is, en hersien die betrokke oorspronklike beeld verder wanneer presiese syfers of neigings benodig word.
Produkverbinding
Deur produkte te verbind, kan die volgende vloei saamgestel word.
- Dokumentgebaseerde werk: Cova onttrek hoofteks, tabelle en beeldbeskrywings, CIP kontroleer selektief die nodige oorspronklike materiaal om ontleding en werkverwerking uit te voer, en Cosa lewer die resultate stemmatig.
- Stemgebaseerde werk: Cosa ASR skakel stemversoeke om in teks, en cosa-a of cosa-b lees die antwoorde wat deur CIP verwerk is, voor.
- Outomatisering op die terrein: cip-5.5-sm klassifiseer terreindata en voer plaaslike werk uit, terwyl materiaal wat verdere omvattende ontleding vereis, na cip-5.5-im of cip-5.5-mm aangestuur word.
Toegelate oproepe by die gateway
Die gateway se planne bepaal die oproepe wat vir elke model toegelaat word. Die tabel hieronder toon die omvang wat deur die LLM_FREE-, TTS_FREE- en STT_FREE-planne ontsluit word, en hierdie planne word outomaties toegepas sonder ’n aansoek. Modelle wat deur ander roetes ontsluit word, is nie ingesluit nie.
| Model-ID | Toegelate oproepe | Grondslagplan |
|---|---|---|
| cip-5.5-im | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-im-chat | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-mm | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-mm-h | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cosa-a | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-b | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-tts | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-asr | audio.transcriptions | STT_FREE |
| ivy-4-embedding | embeddings | LLM_FREE |
| ivy-4-embedding-mm | embeddings | LLM_FREE |
| ivy-4-mm | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
cip-5.5-sm en cova-1 is nie in hierdie plantabel nie. cip-5.5-im-chat, cip-5.5-mm-h, cosa-tts, ivy-4-embedding, ivy-4-embedding-mm en ivy-4-mm in die tabel is model-ID's wat nie in die produkbeskrywings hierbo ingesluit is nie. Watter roete met die oproepsleutel ooreenstem, word in die dokumentasie vir API-oproepe verduidelik.
