Vous choisissez le modèle
Vous consultez le catalogue actuel et les capacités nécessaires à l’application.
API pour modèles IA Platformă
Accès API aux modèles IA via une interface commune. LongDay est la couche technique pour les équipes qui construisent des produits et ont besoin de connecter des modèles à leurs propres applications.

LongDay
Vous consultez le catalogue actuel et les capacités nécessaires à l’application.
Vous intégrez l’accès dans l’application, avec les clés conservées sur le serveur.
Vous gérez la consommation et choisissez le modèle adapté à la tâche.
Un point d’intégration pour des produits qui utilisent des modèles de langage.
L’évaluation des modèles adaptés à une tâche avant l’extension du déploiement.
Une composante technique qui peut prendre en charge des agents et des flux personnalisés.
Les modèles disponibles, les tarifs et les limites se consultent dans la plateforme LongDay au moment de l’utilisation.
LongDay en détail
LongDay est une passerelle : une seule clé et une seule adresse au lieu d’un compte séparé chez chaque fournisseur de modèles. L’endpoint est compatible OpenAI, ce qui, en pratique, signifie que dans une application existante vous changez le baseURL et la clé, et le reste du code reste intact — y compris dans LangChain, LlamaIndex ou Vercel AI SDK.
La raison de son existence et du fait qu’il ne s’agit pas seulement d’un proxy : une entreprise de Moldavie qui veut utiliser des modèles IA se heurte au paiement. LongDay conserve le portefeuille en dollars, mais émet la facture en lei via e-Factura, avec le taux officiel de la BNM pris le jour de la transaction. Le contrat est signé en roumain.
Le prix se forme selon une seule règle, vérifiable dans le code : le coût réel du fournisseur plus 70%, identique sur les cinq plans. Il n’existe pas de plans plus chers avec des tokens moins chers, ni l’inverse. Le montant est arrondi au supérieur au niveau du micro-cent.
Le catalogue interrogé aujourd’hui, le 6 septembre 2026, compte 107 modèles actifs. 78 font du chat et du texte, 48 ont une capacité de raisonnement déclarée, 17 audio, 7 image, 7 realtime, 3 embeddings, 2 vidéo. Les clés émises portent le préfixe sk-longday-. Le catalogue est servi publiquement, sans authentification, à longday.io/api/public/models — vous pouvez le vérifier avant d’ouvrir un compte.
La passerelle est https://api.longday.io/v1. En Node, vous changez le baseURL, en Python, le base_url. La documentation propre liste les bibliothèques testées : OpenAI Node, OpenAI Python, LangChain JS et Python, LlamaIndex, Vercel AI SDK. Cela fonctionne aussi depuis tout outil no-code capable d’envoyer un header Authorization: Bearer.
Chaque clé peut avoir son propre plafond de dépenses, un cycle de réinitialisation à 1, 7, 30 ou 90 jours et une liste blanche de modèles. Cela signifie qu’un agent expérimental et un flux de production peuvent être sur le même compte sans que le premier puisse consommer le budget du second.
Le portefeuille est en dollars ; le rechargement se fait via Stripe, avec des montants entre 5 et 250 de dollars. La conversion en lei utilise le taux officiel de la BNM du jour, lu directement dans le XML de la banque, avec une réserve locale si le service ne répond pas en cinq secondes. La politique de crédit est 1:1 absolue : tout montant payé devient exactement le même montant de crédit, sans bonus et sans transfert de la commission Stripe au client.
Free (sans abonnement, plafond de 10 requêtes par minute), Starter 5 $/mois, Pro 20 $/mois, Business 80 $/mois, Enterprise négocié. Chaque plan payant inclut un crédit mensuel égal à l’abonnement. La marge est de 70 % sur les cinq. Business et Enterprise ont une e-Factura mensuelle.
Données et fonctionnement
De l'exploration à l'implémentation
Une minute avec l’endpoint public. Si le modèle sur lequel votre application s’appuie n’y figure pas, le reste de la discussion n’a pas de sens — et il vaut mieux le savoir avant l’intégration qu’après.
La clé reçoit un budget et, le cas échéant, une liste blanche de modèles. Pour un pilote, le petit plafond est une fonction, pas une limite : il transforme un bug en une facture prévisible.
Un modèle bon en rédaction n’est pas automatiquement bon en extraction structurée. Les mêmes exemples, passés par plusieurs modèles du même compte et de la même clé, donnent une comparaison que vous pouvez défendre. Le coût de la comparaison est visible dans le panneau de consommation.
Pour une entreprise en Moldavie, l’alimentation via Stripe et la facture en lei sont deux choses distinctes. Ici, nous définissons quel plan est nécessaire pour l’e-Factura mensuelle et quels documents la comptabilité demande.
J’ai interrogé le catalogue public le 6 septembre 2026 : 107 modèles, tous marqués live. La famille GPT-5 est largement couverte, de nano à pro, y compris les variantes codex et les quatre versions 5.6 ; il y a o1/o3/o4-mini, toute la ligne Gemini (2.0, 2.5, 3, 3.1 flash et flash-lite), Gemma 3 et 4, image (gpt-image-1/1.5/2, flux-2-pro, gemini flash image, mai-image-25), video (sora-2), audio et realtime (gpt-realtime jusqu’à 2.1, transcription, elevenlabs-tts en trois variantes), embeddings et deepseek-v4-flash. Une chose que nous devons dire clairement : dans le catalogue live, il n’existe aucun modèle Anthropic Claude, bien que notre README interne et les pages de présentation promettent encore « Anthropic Claude direct ». Il en va de même pour Llama, Qwen, Mistral, Voyage et Cohere, qui apparaissent dans notre document pour les crawlers. Le catalogue public est la source de vérité ; ces textes sont en retard.
Le coût réel du fournisseur plus 70 %, arrondi au micro-cent supérieur. Le même pourcentage sur les cinq plans — il n’existe pas de tarif préférentiel par token sur les plans coûteux. La règle est une invariant vérifiée à l’exécution : si une voie de code essayait de passer sous 70 %, elle déclenche une erreur au lieu d’émettre une facture. Le plan payant ne rend pas vos tokens moins chers ; il vous donne un crédit mensuel égal à l’abonnement, e-Factura pour Business et Enterprise, et des niveaux de support.
La surface est compatible OpenAI, servie par un proxy LiteLLM à https://api.longday.io/v1. En pratique : dans Node, vous changez baseURL dans le constructeur OpenAI, dans Python base_url, et le reste du code reste identique. La documentation propre liste comme testés OpenAI Node, OpenAI Python, LangChain JS, LangChain Python, LlamaIndex et Vercel AI SDK. Cela fonctionne aussi depuis des outils no-code capables d’envoyer un header Bearer.
Le plan Free est plafonné à 10 requêtes par minute ; les quatre autres plans n’ont pas de plafond de plan défini dans le code et sont limités par le budget de la clé. L’alimentation accepte entre 5 et 250 dollars par transaction. Chaque clé peut avoir son propre budget avec un cycle de 1, 7, 30 ou 90 jours et une liste blanche de modèles. Certains modèles ont leurs propres limites amont notées dans le catalogue — gpt-image-2 à 10 requêtes par minute, gpt-realtime-2.1 à un quota de 15 TPM.
Un document, pas une mesure — et il est important de connaître la différence avant de vous fier au chiffre. Notre page de SLA publie cinq niveaux, de 99,0 % sur Free à 99,99 % sur Enterprise, et indique que l’uptime est calculé mensuellement à partir de status.longday.io. Ce sous-domaine n’existe pas : il n’a pas d’enregistrement DNS et ne répond pas. Dans le code, il n’existe aucun collecteur de disponibilité — ni endpoint de métriques, ni moniteur externe ; les deux sont des tâches non commencées dans notre propre backlog. La page de statut qui existe effectue trois sondes en temps réel et ne conserve pas d’historique, donc elle ne peut pas produire un pourcentage mensuel. Le chiffre de 99,9 % affiché sur la page principale est un engagement contractuel écrit, pas une observation, et le produit s’auto-étiquette BETA dans l’en-tête de cette même page. Tant que le moniteur n’existe pas, traitez le pourcentage comme une clause de contrat avec crédit de compensation, pas comme une performance démontrée.
Ici, nous devons être exacts, car il y a une différence entre ce qui est conçu et ce qui est construit. La conversion monétaire est réelle et fonctionne : le taux officiel de la BNM est lu dans le XML de la banque pour le jour concerné, avec une réserve locale si le service ne répond pas en cinq secondes. Le client qui dépose la facture auprès du Service fiscal est toutefois encore une structure — une enveloppe au-dessus de fetch, avec son propre commentaire qui dit que l’implémentation réelle, celle qui charge le certificat PKCS#12 de l’entreprise et signe chaque requête, est à venir. D’ici là, la partie e-Factura se règle avec la comptabilité, pas automatiquement depuis la plateforme.
Non. C’est une couche d’accès et de facturation au-dessus des modèles d’autres fournisseurs. Il ne faut pas le confondre avec Grai, qui est notre projet de recherche sur la voix en roumain et n’a aucun lien technique avec la passerelle.
Exemple illustratif
Un scénario d’utilisation, sans données client ni résultats commerciaux attribués.
Une équipe a déjà une intégration qui fonctionne sur le SDK OpenAI, payée avec la carte personnelle de l’un des associés, sans document à intégrer dans la comptabilité.
On change baseURL en https://api.longday.io/v1 et la clé. Une clé séparée est émise pour la production, avec un plafond mensuel et une liste blanche uniquement sur les modèles effectivement utilisés, afin qu’un cycle erroné ne puisse pas consommer tout le budget du mois. Le rechargement se fait via Stripe en dollars.
Le code reste identique — deux valeurs de configuration changent. La consommation est visible par clé, et le plan Business inclut e-Factura mensuelle. Le prix par token est le coût réel du fournisseur plus 70 %, le même que sur le plan Free.
Ce este necesar:Modelul folosit trebuie să existe în catalogul live — se verifică în avans la longday.io/api/public/models. Dacă aplicația depinde de un model Anthropic Claude, astăzi nu e disponibil prin gateway.
Possibilités de collaboration
Connexion des sources autorisées, organisation de l’information et revue des actions par l’équipe, avec accès séparé par rôles.
Nous définissons un pilote autour d’un processus réel : utilisateurs, données, intégrations, coûts et critères d’acceptation. L’extension suit après l’évaluation du résultat.
Nous établissons les exigences d’accessibilité, d’hébergement, de protection des données et d’interopérabilité. Toute connexion avec des services AGE ou STISC nécessite la validation de l’éligibilité, de l’accès et des approbations.
Ce sont des scénarios d’adaptation, non des déclarations sur des contrats ou partenariats existants. Les fonctions proposées sont confirmées dans le périmètre de travail du projet.
Discuter d'un piloteUn assistant connecté aux informations de votre entreprise, dans les canaux où vos clients vous écrivent.
PlatformăGrai est notre direction de recherche pour la synthèse vocale et les modèles adaptés aux langues d'ici.
Cercetare & dezvoltareWorld Agent est un démonstrateur d'interaction en langage naturel avec une scène visuelle.
Demonstrator de cercetareRacontez-nous votre processus. Ensemble, nous décidons ce qui vaut la peine d'être construit, ce que nous pouvons connecter et comment nous vérifions le résultat.