Alegi modelul
Consulți catalogul actual și capabilitățile necesare aplicației.
API pentru modele AI Platformă
Acces API la modele AI printr-o interfață comună. LongDay este stratul tehnic pentru echipe care construiesc produse și au nevoie să conecteze modele la propriile aplicații.

LongDay
Consulți catalogul actual și capabilitățile necesare aplicației.
Integrezi accesul în aplicație, cu cheile păstrate pe server.
Gestionezi consumul și alegi modelul potrivit sarcinii.
Un punct de integrare pentru produse care folosesc modele de limbaj.
Evaluarea modelelor potrivite unei sarcini înainte de extinderea implementării.
O componentă tehnică ce poate susține agenți și fluxuri personalizate.
Modelele disponibile, tarifele și limitele se consultă în platforma LongDay la momentul utilizării.
LongDay în detaliu
LongDay e un gateway: o singură cheie și o singură adresă în locul unui cont separat la fiecare furnizor de modele. Endpointul e compatibil OpenAI, ceea ce în practică înseamnă că într-o aplicație existentă schimbi baseURL-ul și cheia, iar restul codului rămâne neatins — inclusiv în LangChain, LlamaIndex sau Vercel AI SDK.
Motivul pentru care există și nu e doar un proxy: o companie din Moldova care vrea să folosească modele AI se lovește de plată. LongDay ține portofelul în dolari, dar emite factură în lei prin e-Factura, cu cursul oficial BNM luat în ziua tranzacției. Contractul se semnează în română.
Prețul se formează dintr-o singură regulă, verificabilă în cod: costul real al furnizorului plus 70%, identic pe toate cele cinci planuri. Nu există planuri mai scumpe cu tokeni mai ieftini și nici invers. Suma se rotunjește în sus la nivel de micro-cent.
Catalogul interogat azi, 6 septembrie 2026, are 107 modele active. 78 fac chat și text, 48 au capacitate declarată de raționament, 17 audio, 7 imagine, 7 realtime, 3 embeddings, 2 video. Cheile emise poartă prefixul sk-longday-. Catalogul e servit public, fără autentificare, la longday.io/api/public/models — îl poți verifica înainte să deschizi un cont.
Gateway-ul e https://api.longday.io/v1. În Node schimbi baseURL, în Python base_url. Documentația proprie listează bibliotecile testate: OpenAI Node, OpenAI Python, LangChain JS și Python, LlamaIndex, Vercel AI SDK. Merge și din orice instrument no-code care poate trimite un header Authorization: Bearer.
Fiecare cheie poate avea plafon propriu de cheltuială, ciclu de resetare la 1, 7, 30 sau 90 de zile și o listă albă de modele. Asta înseamnă că un agent experimental și un flux de producție pot sta pe același cont fără ca primul să poată consuma bugetul celui de-al doilea.
Portofelul e în dolari; alimentarea se face prin Stripe, cu sume între 5 și 250 de dolari. Conversia în lei folosește cursul oficial BNM al zilei, citit direct din XML-ul băncii, cu o rezervă locală dacă serviciul nu răspunde în cinci secunde. Politica de credit e 1:1 absolut: orice sumă plătită devine exact aceeași sumă de credit, fără bonusuri și fără trecerea comisionului Stripe către client.
Free (fără abonament, plafon 10 cereri pe minut), Starter 5 $/lună, Pro 20 $/lună, Business 80 $/lună, Enterprise negociat. Fiecare plan plătit include credit lunar egal cu abonamentul. Marja e 70% pe toate cinci. Business și Enterprise au e-Factura lunară.
Date și funcționare
De la explorare la implementare
Un minut cu endpointul public. Dacă modelul pe care se bazează aplicația ta nu e acolo, restul discuției nu are rost — și e mai bine să afli înainte de integrare decât după.
Cheia primește un buget și, dacă e cazul, o listă albă de modele. Pentru un pilot, plafonul mic e o funcție, nu o limitare: transformă un bug într-o factură previzibilă.
Un model bun la redactare nu e automat bun la extragere structurată. Aceleași exemple, trecute prin mai multe modele din același cont și aceeași cheie, dau o comparație pe care o poți apăra. Costul comparației e vizibil în panoul de consum.
Pentru o companie din Moldova, alimentarea prin Stripe și factura în lei sunt două lucruri separate. Aici stabilim ce plan e necesar pentru e-Factura lunară și ce documente cere contabilitatea.
Am interogat catalogul public pe 6 septembrie 2026: 107 modele, toate marcate live. Familia GPT-5 e acoperită pe larg, de la nano la pro, inclusiv variantele codex și cele patru versiuni 5.6; există o1/o3/o4-mini, întreaga linie Gemini (2.0, 2.5, 3, 3.1 flash și flash-lite), Gemma 3 și 4, imagine (gpt-image-1/1.5/2, flux-2-pro, gemini flash image, mai-image-25), video (sora-2), audio și realtime (gpt-realtime până la 2.1, transcriere, elevenlabs-tts în trei variante), embeddings și deepseek-v4-flash. Un lucru pe care trebuie să-l spunem direct: în catalogul live nu există niciun model Anthropic Claude, deși README-ul nostru intern și pagini de prezentare încă promit „Anthropic Claude direct”. La fel lipsesc Llama, Qwen, Mistral, Voyage și Cohere, care apar în documentul nostru pentru crawlere. Catalogul public e sursa de adevăr; textele acelea sunt în urmă.
Costul real al furnizorului plus 70%, rotunjit în sus la micro-cent. Același procent pe toate cele cinci planuri — nu există tarif preferențial pe token la planurile scumpe. Regula e o invariantă verificată la execuție: dacă vreo cale de cod ar încerca sub 70%, aruncă eroare în loc să emită o factură. Planul plătit nu îți ieftinește tokenii; îți dă credit lunar egal cu abonamentul, e-Factura la Business și Enterprise, și trepte de suport.
Suprafața e OpenAI-compatibilă, servită de un proxy LiteLLM la https://api.longday.io/v1. În practică: în Node schimbi baseURL în constructorul OpenAI, în Python base_url, și restul codului rămâne identic. Documentația proprie listează ca testate OpenAI Node, OpenAI Python, LangChain JS, LangChain Python, LlamaIndex și Vercel AI SDK. Funcționează și din instrumente no-code care pot trimite un header Bearer.
Planul Free e plafonat la 10 cereri pe minut; celelalte patru planuri nu au plafon de plan definit în cod și sunt limitate de bugetul cheii. Alimentarea acceptă între 5 și 250 de dolari per tranzacție. Fiecare cheie poate avea buget propriu cu ciclu de 1, 7, 30 sau 90 de zile și listă albă de modele. Unele modele au limite proprii din amonte notate în catalog — gpt-image-2 la 10 cereri pe minut, gpt-realtime-2.1 la o cotă de 15 TPM.
Un document, nu o măsurătoare — și e important să știi diferența înainte să te bazezi pe cifră. Pagina noastră de SLA publică cinci trepte, de la 99,0% pe Free la 99,99% pe Enterprise, și spune că uptime-ul se calculează lunar din status.longday.io. Subdomeniul acela nu există: nu are înregistrare DNS și nu răspunde. În cod nu există niciun colector de disponibilitate — nici endpoint de metrici, nici monitor extern; ambele sunt taskuri neîncepute în propriul nostru backlog. Pagina de stare care există face trei sonde în timp real și nu păstrează istoric, deci nu poate produce un procent lunar. Cifra de 99,9% afișată pe pagina principală e un angajament contractual scris, nu o observație, iar produsul se autoetichetează BETA în antetul aceleiași pagini. Până când monitorul există, tratează procentul ca pe o clauză de contract cu credit de compensare, nu ca pe o performanță demonstrată.
Aici trebuie să fim exacți, pentru că e o diferență între ce e proiectat și ce e construit. Conversia valutară e reală și funcționează: cursul oficial BNM e citit din XML-ul băncii pentru ziua respectivă, cu rezervă locală dacă serviciul nu răspunde în cinci secunde. Clientul care depune factura la Serviciul Fiscal e însă încă un schelet — un înveliș peste fetch, cu comentariul propriu care spune că implementarea reală, cea care încarcă certificatul PKCS#12 al firmei și semnează fiecare cerere, urmează. Până atunci partea de e-Factura se rezolvă cu contabilitatea, nu automat din platformă.
Nu. E un strat de acces și de facturare peste modelele altora. Nu trebuie confundat cu Grai, care e proiectul nostru de cercetare pe voce în română și nu are legătură tehnică cu gateway-ul.
Exemplu ilustrativ
Un scenariu de utilizare, fără date de client sau rezultate comerciale atribuite.
O echipă are deja o integrare care merge pe SDK-ul OpenAI, plătită cu cardul personal al unuia dintre asociați, fără document care să intre în contabilitate.
Se schimbă baseURL-ul în https://api.longday.io/v1 și cheia. Se emite o cheie separată pentru producție, cu plafon lunar și listă albă doar pe modelele folosite efectiv, ca un ciclu greșit să nu poată consuma bugetul întregii luni. Alimentarea se face prin Stripe în dolari.
Codul rămâne identic — se schimbă două valori de configurare. Consumul e vizibil per cheie, iar planul Business include e-Factura lunară. Prețul per token e cel real al furnizorului plus 70%, același ca pe planul Free.
Ce este necesar:Modelul folosit trebuie să existe în catalogul live — se verifică în avans la longday.io/api/public/models. Dacă aplicația depinde de un model Anthropic Claude, astăzi nu e disponibil prin gateway.
Posibilități de colaborare
Conectarea surselor autorizate, organizarea informației și revizuirea acțiunilor de către echipă, cu acces separat pe roluri.
Definim un pilot în jurul unui proces real: utilizatori, date, integrări, costuri și criterii de acceptare. Extinderea urmează după evaluarea rezultatului.
Stabilim cerințele de accesibilitate, găzduire, protecție a datelor și interoperabilitate. Orice conexiune cu servicii AGE sau STISC necesită validarea eligibilității, accesului și aprobărilor.
Acestea sunt scenarii de adaptare, nu declarații despre contracte sau parteneriate existente. Funcțiile propuse se confirmă în domeniul de lucru al proiectului.
Discută un pilotUn asistent conectat la informațiile afacerii tale, în canalele în care îți scriu clienții.
PlatformăGrai este direcția noastră de cercetare pentru sinteză vocală și modele adaptate limbilor folosite aici.
Cercetare & dezvoltareWorld Agent este un demonstrator pentru interacțiunea în limbaj natural cu o scenă vizuală.
Demonstrator de cercetarePovestește-ne despre procesul tău. Împreună stabilim ce merită construit, ce putem conecta și cum verificăm rezultatul.