Developer guide
Model
Modelgearfetting
CLEVI-modellen binne ferdield yn trije produktfamyljes: CIP, foar algemiene yntelliginsje en automatisearring fan wurkprosessen; Cosa, foar it generearjen en werkennen fan spraak; en Cova, foar it ekstrahearjen fan ynformaasje út dokuminten en ôfbyldingen. Elk produkt kin selsstannich brûkt wurde of keppele wurde oan tsjinsten dy't liede fan dokumintwerkenning en analyze nei taakútfiering en spraakbegelieding.
| Produkt | Model-ID | Wichtichste spesifikaasjes | Haadrol |
|---|---|---|---|
| CIP-5.5-SM | cip-5.5-sm | 24B~40B oanpasber | Automatisearring fan lokale wurkprosessen op edgeservers en lokaal |
| CIP-5.5-IM | cip-5.5-im | 360B · ynfier 256K · útfier 64K · multimodaal | Algemiene taakferwurking. Prioriteit foar antwurdsnelheid en trochfier |
| CIP-5.5-MM | cip-5.5-mm | 800B · ynfier 512K · útfier 64K · multimodaal | Analyze fan lange konteksten en it oplossen fan komplekse problemen |
| Cosa-A | cosa-a | Spraaksynteze · replikaasje · ûntwerp · streaming | Spraakgeneraasje mei detaillearre kontrôle oer de synteze |
| Cosa-B | cosa-b | Spraaksynteze · replikaasje · ûntwerp · streaming | Seleksje fan stimmen en it generearjen fan oanpaste spraak |
| Cosa ASR | cosa-asr | Spraakwerkenning | It omsetten fan sprutsen ynfier nei tekst |
| Cova | cova-1 | LLM-basearre, spesjaal foar fisuele OCR | Ekstrahearjen fan tekst, yndieling en tabellen, en ienfâldige beskriuwingen fan ôfbyldingen |
CIP
CIP is ferantwurdlik foar algemiene yntelliginsje en automatisearring fan wurkprosessen. It bestiet út cip-5.5-im en cip-5.5-mm, dy't fia in gateway oanroppen wurde, en cip-5.5-sm, dat op edgeservers en on-premises ynset wurdt.
cip-5.5-im en cip-5.5-mm
| Item | cip-5.5-im | cip-5.5-mm |
|---|---|---|
| Skaal | 360B | 800B |
| Ynfierlimyt | 256K | 512K |
| Maksimale útfier | 64K | 64K |
| Ynfierformaten | Tekst en fisueel materiaal (dokuminten, ôfbyldingen fan skermen, tabellen en diagrammen) | Tekst en fisueel materiaal (yntegrearre beoardieling fan koade, dokuminten en skermmateriaal) |
| Untwikkelingsrjochting | Ferwurket deistich kenniswurk en ûntwikkelwurk, mei fokus op antwurdsnelheid, kosteneffisjinsje en trochfier. | Ferwurket komplekse taken dy't meardere boarnen en betingsten kombinearje en analyseresultaten ferbine mei echte wurktaken. |
| Doel fan lange ynfier | Beoardielet meardere dokuminten, koadebestannen en petearhistoarjes tagelyk. | Wurket tagelyk mei grutte hoemannichten referinsjemateriaal en taakskiednis, en fiert agenttaken út wêrby't ûndersyk, útfiering en ferifikaasje yn meardere stappen trochgeane. |
cip-5.5-im is geskikt foar taken mei dúdlike doelen en in dúdlik wurkberik. Typyske taken binne it heljen fan de nedige ynformaasje út it levere materiaal, it opstellen fan resultaten yn it oantsjutte formaat en it oanpassen fan koade neffens de easken. De maksimale útfier fan 64K wurdt brûkt foar it opstellen fan detaillearre rapporten of resultaten dy't út meardere dielen besteane.
- Untwikkelingsstipe: skriuwt funksjes en funksjonaliteit, reparearret bugs mei in dúdlik berik en ymplementearret neffens besteande patroanen.
- Testgeneraasje: stelt testûntwerpen en ferifikaasjegefallen op op basis fan de easken en de ymplemintaasje.
- Dokumintferwurking: fersoarget gearfetting, klassifikaasje, it ekstrahearjen fan items, opmaaktransformaasje en it opstellen fan konsepten.
- Multimodale analyze: beoardielet skermôfbyldingen en tabellen en diagrammen yn dokuminten, mei relevante útlis.
- Ynteraktive wurkstipe: beantwurdet fragen op basis fan wurkmateriaal en stelt de nedige resultaten op.
- Massale ferwurking: wurdt brûkt foar yndividuele gearfettings fan in grut tal dokuminten, it klassifisearjen fan fersiken en gegevenskonverzje.
- Subagent: fiert dúdlik ôfbeakene subtaken út, lykas it ferkennen fan koade, it beoardieljen fan spesifike bestannen en it oarderjen fan materiaal.
Bygelyks wurdt it brûkt om, op basis fan funksjonele easken en relevante koade, in foarstel foar oanpassingen, tests en in beskriuwing fan de wizigingen op te stellen, of om ynkommende dokuminten te klassifisearjen en in gearfetting foar de ferantwurdlike meiwurker te meitsjen.
cip-5.5-mm is geskikt foar taken wêrby't de relaasjes tusken ynformaasje begrepen wurde moatte en de gearhing fan it hiele wurk behâlden wurde moat. Yn ûntwikkeling omfettet dit it beoardieljen fan de ferbining tusken easken, ûntwerp, ymplemintaasje en tests; yn dokumintanalyse wurde stellingen en ûnderbouwing, ferskillen en tsjinstridichheden tusken meardere boarnen yntegrearre.
- Ymplemintaasje fan komplekse funksjonaliteit: feroaret koade, tests en dokumintaasje tagelyk, mei rekken mei de kontrakten en it gedrach fan meardere modules.
- Grutskalige koade-analyze: beoardielet oanroprelaasjes, gegevensstreamen en de omfang fan de ynfloed fan wizigingen.
- Analyze fan de oarsaak fan ynsidinten: fergeliket logs, ynstellingen, koade en útfieringsresultaten en bringt hypotezen oer de oarsaak en prosedueres foar ferifikaasje yn kaart.
- Stipe by ûntwerp en beslútfoarming: strukturearret easken en beheiningen en analysearret de gefolgen fan ymplemintaasjealternativen.
- Gearfoegjende analyze fan meardere dokuminten: bringt oerienkomsten, ferskillen en tsjinstridichheden yn rapporten en technyske dokuminten op basis fan bewiis yn kaart.
- Yntegrearre multimodale beoardieling: ynterpretearret tekst en fisueel materiaal tegearre om problemen en easken te analysearjen.
- Agint mei meardere stappen: wurdt brûkt foar wurk dat bestiet út ûndersyk, planning, útfiering fan ark en beoardieling fan resultaten.
- Opstellen fan spesjalistyske dokuminten: stelt technyske rapporten, ûntwerpfoarstellen en detaillearre beoardielingsdokuminten op dy't komplekse betingsten en ûnderbouwing reflektearje.
Bygelyks foar it tegearre besjen fan relevante koades en logs fan flaters yn meardere tsjinsten, of foar wurk dat rint fan it analysearjen fan easken foar komplekse funksjes oant de ymplemintaasje en it besjen fan de ferifikaasjeresultaten.
cip-5.5-sm
cip-5.5-sm fiert lokale inferinsje en wurkautomatisaasje út op edge-servers en yn on-premises-omjouwings. Om't de modelgrutte ynsteld wurde kin binnen it berik fan 24B oant 40B, kinne jo de konfiguraasje kieze dy't past by de rekkenboarnen fan de ynsetapparatuer en de fereaske prestaasjes op lokaasje. Om't gegevens ticht by it punt dêr't se ûntsteane ferwurke wurde, wurdt it brûkt foar de yntegraasje mei systemen op lokaasje en it brûken fan ynterne gegevens. As de nedige modellen en ark lokaal konfigurearre binne, kin it ek wurkje yn omjouwings mei beheinde eksterne ferbiningen.
It ferfollet de rol fan it ynterpretearjen fan ynformaasje dy't op lokaasje ûntstiet en dy ferbinen mei ferwurkingsprosedueres. It klassifisearret logs en oanfragen, hellet de nedige ynformaasje út gegevens en fiert weromkommend wurk út mei keppele ynterne ark en skripts.
- Ferwurking fan barrens op lokaasje: klassifisearret apparatuerlogs en statusynformaasje en selektearret barrens dy't kontrolearre wurde moatte.
- Foarferwurking fan gegevens: hellet kearnitems út wurkregisters en klassifisearret, tagget en normalisearret se.
- Rûting fan oanfragen: stjoert ûntfongen oanfragen troch nei it ferantwurdlike systeem of de passende ferwurkingsproseduere.
- Lokale wurkagent: fiert weromkommende taken út troch ynterne systemen te rieplachtsjen en skripts út te fieren.
- On-premises-wurkstipe: beantwurdet fragen op basis fan ynterne materialen en bringt wurkynhâld yn oarder.
- Stipe by ferfolchanalyse: selektearret materialen dy't fierdere beoardieling fereaskje en vat de kearnynhâld gear.
Bygelyks foar in proses wêryn operasjonele logs op in bedriuwslokaasje klassifisearre wurde, relevante histoarjes opsocht wurde en dêrnei in gearfetting fan it ynsidint foar de ferantwurdlike persoan opsteld wurdt.
Cosa
Cosa is in produktfamylje foar spraak dy't tekst yn spraak omset, ynfierde spraak as tekst werkent en winske stimmen registrearret foar werbrûk. It wurdt brûkt foar tsjinstynformaasje, it meitsjen fan ynhâld, stipe foar tagonklikens en spraakynterfaces foar konversaasje-aginten.
cosa-a en cosa-b binne ferantwurdlik foar spraakgeneraasje, en cosa-asr foar spraakwerkenning. cosa-a en cosa-b binne aparte modellen dy't elk in eigen stimlist en synteze-ynstellingen leverje, en wurde binnen deselde tsjinstynterface selektearre. De funksjes dy't beide modellen mienskiplik leverje, binne as folget.
- Tekst-nei-spraak: syntetisearje de ynfierde sinnen mei in keazen stim.
- Stimkloning: registrearje in stim op basis fan in referinsje-opname dêr’t jo tastimming foar hawwe, en syntetisearje nije sinnen.
- Stimûntwerp: meitsje en registrearje in stim troch de winske eigenskippen fan de stim te beskriuwen.
- Stim opnij brûke: brûk de registrearre stim foar folgjende syntheses.
- Syntese-ynstellingen: pas de spreksnelheid, taal en oare ynstellingen oan.
- Streaming-oerdracht: syntetisearje de tekst yn sinfolle parten sa gau’t dy binnenkomt en leverje de audio opfolgjend.
- Ôfspylkontrôle: stypje pauzearjen, trochgean, ûnderbrekken en it ynfieren fan ekstra sinnen.
Mei stadichoan ynfierde tekst kinne jo begjinne mei it ôfspyljen fan spraak foardat it folsleine antwurd klear is. Wylst CIP it antwurd skriuwt, kinne jo in tsjinst ynstelle wêryn Cosa de ree sinfolle parten al foarlêst.
cosa-a
cosa-a stipet tekst-nei-spraak, stimkloning, stimûntwerp en streaming-útfier. Njonken de basisfunksjes foar it kiezen fan in stim, taal en spreksnelheid biedt it ek ekstra kontrôle-opsjes, lykas ynstellingen foar it oantal synthese-stappen, de sterkte fan de begelieding en de lingte fan de generaasje. Jo brûke dit by it meitsjen fan spraak om ynstellingen oan te passen en resultaten te beoardieljen, of om ferskate ynstellingen op itselde manuskript ta te passen en in resultaat te kiezen.
- Syntetisearje begelieding en notifikaasjes foar apps, kiosken en bedriuwssystemen.
- Meitsje lesmateriaal en brûkershantliedingen as spraak.
- Produsearje voice-overs foar fideo- en audio-ynhâld.
- Meitsje weromkommende ynhâld mei in registrearre stim.
- Brûk it foar streaming-spraakútfier fan ynteraktive aginten.
- Brûk it foar it meitsjen fan spraak wêrby’t detaillearre synthese-ynstellingen oanpast wurde.
cosa-b
cosa-b stipet it kiezen fan foarôf ynstelde stimmen, stimûntwerp op basis fan in beskriuwing, kloning op basis fan in referinsjestim en streaming-útfier. Jo kinne in stim kieze út de eigen stimlist of in nije stim registrearje foar gebrûk yn de tsjinst.
Foar stimkloning brûke jo in referinsje-opname en de oerienkommende tekst. It stipet ek in proses wêryn de referinsjetekst by de registraasje mei spraakherkenning generearre wurdt. De registrearre stim wurdt letter opnij brûkt foar syntheses.
- Stel de stimpersoanlikheid fan tsjinsten en personaazjes gear.
- Meitsje in oanpaste stim mei in beskriuwing of referinsje-opname.
- Syntetisearje merkbegelieding, personaazjedialogen en voice-overs foar ynhâld.
- Brûk it foar stimantwurden fan ynteraktive aginten.
- Syntetisearje feroarjende begeliedingsberjochten en manuskripten mei deselde stim.
Kies tusken cosa-a en cosa-b op basis fan de winske stim, it werklike synthezeresultaat en de nedige kontrôle-opsjes.
| Item | cosa-a | cosa-b |
|---|---|---|
| Syntheze-ynstellingen | Neist stim, taal en spreksnelheid ek ynstellingen foar it oantal stappen yn it synthezeproses, de sterkte fan de begelieding en de lingte fan de generaasje | Mienskiplike ynstellingen lykas spreksnelheid en taal |
| Ynput foar klonen | In referinsje-opname dêr't jo gebrûksrjocht foar hawwe | In referinsje-opname en de byhearrende tekst. By registraasje kin de referinsjetekst mei spraakwerkenning generearre wurde |
| Rol | Stim generearje mei detaillearre kontrôle oer de syntheze | Stim selektearje en in oanpaste stim generearje |
cosa-asr
cosa-asr konvertearret ynfierlûd nei tekst. It dokumintearret opnamen of konvertearret fersiken dy't fia spraak binnenkomme nei ynput dy't troch folgjende wurksystemen ferwurke wurde kin.
- Stimnotysjes en opnamen transkribearje.
- Stim-basearre fragen en wurkfersiken omsette nei ynput.
- Referinsjetekst generearje foar stimklonen.
- Brûke foar ferwurking dy't nei transkripsje trochgiet mei gearfetting, klassifikaasje en sykjen.
Troch de transkripsjeresultaten oan CIP troch te jaan, kinne gearfettingen fan de ynhâld, klassifikaasje fan fersiken en it opstellen fan wurkûntwerpen folgje. As de ferwurkingsresultaten mei cosa-a of cosa-b synthetisearre wurde, ûntstiet in wurkservice mei spraakynput en -útfier.
Cova
cova-1 is in LLM-basearre model spesifyk foar fisuele OCR. It herkent tekst yn dokuminten en ôfbyldingen, ekstrahearret de opmaak en tabelstruktuer en jout koarte beskriuwingen fan fisuele eleminten.
It konvertearret dokuminten sa't minsken se sjogge nei in foarm dy't aginten en wurksystemen maklik brûke kinne. De haadtekst en tabellen wurde as strukturearre ynhâld ekstrahearre, wylst ôfbyldingen yn it dokumint mei koarte beskriuwingen trochjûn wurde. Sa kinne folgjende aginten sawol de ynhâld as de fisuele kontekst fan it dokumint begripe. Troch earst de materialen te begripen mei de ekstrahearre tekst en beskriuwingen en dêrnei allinnich de orizjinelen te kontrolearjen dy't in detaillearre ferifikaasje nedich hawwe, kin in workflow ynrjochte wurde dy't it werhelle ynfieren fan orizjinele ôfbyldingen ferminderet en sa konteksttokens besparret.
| Funksje | Beskriuwing |
|---|---|
| Tekstherkenning | Hellet tekst út dokuminten dy't skand of fotografearre binne. |
| Layout-ynterpretaasje | Dielt de ynhâld op yn blokken, mei rekkening mei de yndieling fan it dokumint. |
| Lokaasje-ynformaasje leverje | Jout de lokaasje fan de herkende blokken, sadat de útfier fan de ekstraksje oan de orizjinele tekst keppele wurde kin. |
| Tabelstruktuer ekstrahearje | Strukturearret de ynhâld fan tabellen foar sykjen en gegevensferwurking. |
| Koarte ôfbyldingsbeskriuwing | Beskriuwt de ynhâld fan ôfbyldingen en fisuele eleminten koart, sadat aginten oanwizingen krije foar de ynterpretaasje. |
| Kontekst effisjinter meitsje | Ferminderet werhelle ynfier fan 'e orizjinele ôfbylding troch ynformaasje foaral oer tekst, struktuer en ôfbyldingsbeskriuwingen troch te jaan. |
| Selektive detaillearre analyse | Helpt aginten te bepalen hokker orizjinele ôfbyldingen se fierder kontrolearje moatte. |
| Dokumintformaat konvertearje | Wurket de resultaten fan de herkenning út yn HTML of Markdown. |
- Dokumintdigitalisearring: Set papieren dokuminten en skande materialen om yn tekstbasearre materialen.
- Yntak fan wurkdokuminten: Ekstrahearret ynhâld út formulieren, bewizen en rapporten.
- Ferwurking fan tabelgegevens: Brûkt tabellen yn dokuminten foar fierdere gegevensferwurking.
- Foarferwurking foar kennis sykjen: Konvertearret dokumintôfbyldingen en fisuele materialen nei trochsykbere tekst en struktuer.
- Automatisearring fan dokumintbeoardieling: Stjoert de ekstraksjeresultaten nei CIP foar it kontrolearjen fan items, gearfetting en ferliking tusken materialen.
- Optimalisearring fan agintynfier: Organisearret de haadtekst, tabellen en ôfbyldingsbeskriuwingen fan lange dokuminten, sadat allinnich de nedige ynformaasje trochjûn wurdt.
Bygelyks wurde de haadtekst en tabellen fan in rapport ekstrahearre, wylst in ynfoege grafyk beskreaun wurdt as in grafyk dy't de trend yn 'e kwartaalomset toant. Mei dizze beskriuwing kin de agint it bestean en it doel fan 'e grafyk begripe, en de oarspronklike ôfbylding fierder kontrolearje as krekte sifers of trends nedich binne.
Produktfamyljes ferbine
Troch produkten te ferbinen kinne jo de folgjende stream konfigurearje.
- Dokumintbasearre wurk: Cova ekstrahearret de haadtekst, tabellen en ôfbyldingsbeskriuwingen, CIP kontrolearret selektyf de nedige orizjinele materialen om analyse en wurkferwurking út te fieren, en Cosa bringt de resultaten mei stim oer.
- Stimbasearre wurk: Cosa ASR konvertearret stimfersiken nei tekst, en cosa-a of cosa-b lêst de troch CIP ferwurke antwurden foar.
- Automatisearring op lokaasje: cip-5.5-sm klassifisearret gegevens op lokaasje en fiert lokale wurktaken út, wylst materialen dy't ekstra wiidweidige analyse nedich hawwe trochstjoerd wurde nei cip-5.5-im of cip-5.5-mm.
Tastiene oproppen by de gateway
De plannen fan de gateway bepale hokker oanroppen foar elk model tastien binne. De tabel hjirûnder toant it berik dat de plannen LLM_FREE, TTS_FREE en STT_FREE iepenstelle; dizze plannen wurde automatysk tapast sûnder oanfraach. Modellen dy't fia oare paden iepensteld binne, binne net opnommen.
| Model-ID | Tastiene oanroppen | Plannamme |
|---|---|---|
| cip-5.5-im | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-im-chat | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-mm | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cip-5.5-mm-h | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
| cosa-a | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-b | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-tts | audio.speech · audio.speech.clone · voices · voices.design | TTS_FREE |
| cosa-asr | audio.transcriptions | STT_FREE |
| ivy-4-embedding | embeddings | LLM_FREE |
| ivy-4-embedding-mm | embeddings | LLM_FREE |
| ivy-4-mm | anthropic.messages · chat.completions · chat.completions.batch · completions · responses | LLM_FREE |
cip-5.5-sm en cova-1 steane net yn dizze plantabel. cip-5.5-im-chat, cip-5.5-mm-h, cosa-tts, ivy-4-embedding, ivy-4-embedding-mm en ivy-4-mm binne model-ID’s dy’t net opnommen binne yn de produktbeskriuwing hjirboppe. Yn de dokumintaasje oer API-oproppen stiet hokker opropkaai mei hokker paad oerienkomt.
