Anthropic
3 modele
- mare
Claude Fable 5
Model de frontieră, coding autonom
- mediu
Claude Sonnet 4.6
Echilibru între calitate și cost
- mic
Claude Haiku 4.5
Ultra-rapid, task-uri ușoare
Un singur endpoint · toate modelele de frontieră
Îndreaptă-ți uneltele către codai. Routerul alege modelul de frontieră potrivit pentru fiecare task, verifică dacă a funcționat cu adevărat, iar tu plătești doar succesele verificate.
Se conectează la orice client compatibil OpenAI
# any OpenAI-compatible clientnpm i @codai/sdkbase_url: https://ai.codai.ro/v1model: codai
Același format de cerere, un singur nume de model. Fără să rescrii SDK-ul.
Funcționează în
Cum funcționează
Păstrezi clientul pe care îl folosești deja. codai se ocupă de rutare, verificare și contabilitate.
Setezi base URL la ai.codai.ro/v1 și modelul la codai. Copilot, Cursor, Claude Code, Codex CLI sau orice SDK OpenAI — nimic altceva nu se schimbă.
Fiecare cerere este clasificată și trimisă către modelul care câștigă pe acel tip de task — Claude, GPT sau Gemini — cu failover automat când un furnizor se degradează.
Un task se facturează doar când este verificat ca reușit — prin teste, prin harness sau prin confirmarea ta dintr-o atingere. Încercările eșuate nu te costă nimic.
Ce primești
Tot ce are nevoie un flux agentic, în spatele unui singur nume.
Selecție de model per task între Claude, GPT și Gemini, bazată pe benchmark-uri deschise și telemetrie live din producție.
HTTP, Python, shell și automatizare de browser rulează server-side în sandbox-uri — orice client le poate folosi, chiar și fără suport nativ de tool-uri.
Faptele, deciziile și convențiile din repo supraviețuiesc între sesiuni și dispozitive. Per utilizator, exportabile, ștergibile.
Conectezi o singură dată serverele tale Model Context Protocol și toți clienții codai primesc aceleași unelte.
Facturare pe rezultat: o taxă fixă per task reușit și verificat, în loc de un contor de token-uri imprevizibil.
Folosește cheile tale Anthropic, OpenAI sau Google prin același router și aceleași unelte, de la 5 € pe lună.
Găzduit în europe-west1 pe Google Cloud Run. Prompturile și datele de utilizare rămân în UE; fără antrenare pe datele tale, implicit.
Deciziile de rutare se sprijină pe rulări publice și reproductibile. Verifică cifrele înainte să te încrezi în router.
Lista de modele
codai alege între Claude, GPT și Gemini. Când apare un model nou, îl măsurăm și îl adăugăm în pool — tu nu redenumești niciodată nimic.
3 modele
Claude Fable 5
Model de frontieră, coding autonom
Claude Sonnet 4.6
Echilibru între calitate și cost
Claude Haiku 4.5
Ultra-rapid, task-uri ușoare
3 modele
GPT-5
Model de frontieră pentru raționament
GPT-5 mini
Rapid, cost redus
GPT-5 nano
Micro-task-uri în volum mare
3 modele
Gemini 2.5 Pro
Context lung, multimodal
Gemini Flash 2.5
Latență mică, throughput mare
Gemini Flash 2.0
Sub 10 ms, experimental
Folosește model="codai" în orice client compatibil OpenAI. De restul se ocupă codai.
Benchmark-uri
Fiecare decizie de rutare se bazează pe rulări publice de benchmark pe suite reale de task-uri — coding, unelte agentice, context lung. Același harness pentru fiecare model, rezultate publicate pe măsură ce apar.
Prețuri
Fiecare plan include un număr lunar de task-uri reușite verificate. Peste acest număr, un tarif fix de 1,20 € per succes verificat — niciodată un contor de tokeni.
Testează routerul cu task-uri reale.
Gratuit
5 sarcini incluse
1,20 € per sarcină reușită peste plan
Pentru un developer care livrează săptămânal.
40 €/lună
33 de sarcini incluse
1,20 € per sarcină reușită peste plan
Poți anula oricând
Pentru builderi care rulează agenți zilnic.
100 €/lună
83 de sarcini incluse
1,20 € per sarcină reușită peste plan
Poți anula oricând
Pentru echipe cu volume de producție.
300 €/lună
250 de sarcini incluse
1,20 € per sarcină reușită peste plan
Poți anula oricând
Ai propriile chei de provider? BYOK de la 5 €/lună, cu 7 zile de probă.
Vezi toate planurileÎncredere
Prompturile, cheile și datele tale de utilizare sunt tratate așa cum le-ai trata tu.
Gateway-ul, baza de date și memoria rulează pe Google Cloud Run în europe-west1 (Belgia). Nimic nu este stocat în afara UE.
Prompturile și răspunsurile nu sunt folosite niciodată la antrenarea modelelor decât dacă alegi explicit asta din contul tău.
Exportă tot ce deținem despre tine sau șterge-ți contul și datele direct din pagina contului — fără tichet la suport.
Autentifică-te cu passkeys; creează chei API cu buget și modele permise per cheie și revocă-le instant.
Fără card. Îndreaptă-ți clientul către codai și vezi unde îți trimite routerul prima cerere.
Rutare live
Trafic real din producție — distribuția reală a modelelor upstream alese de routerul codai. Actualizat la fiecare cinci minute.
13.053 de cereri rutate · ultimele 24 de ore · doar cereri codai reușite