Escolhe o modelo
Consulta o catálogo atual e as capacidades necessárias à aplicação.
API para modelos de IA Platformă
Acesso API a modelos AI através de uma interface comum. LongDay é a camada técnica para equipas que constroem produtos e precisam de ligar modelos às suas próprias aplicações.

LongDay
Consulta o catálogo atual e as capacidades necessárias à aplicação.
Integra o acesso na aplicação, com as chaves guardadas no servidor.
Gere o consumo e escolhe o modelo adequado à tarefa.
Um ponto de integração para produtos que usam modelos de linguagem.
A avaliação dos modelos adequados a uma tarefa antes da expansão da implementação.
Um componente técnico que pode suportar agentes e fluxos personalizados.
Os modelos disponíveis, as tarifas e os limites são consultados na plataforma LongDay no momento da utilização.
LongDay em detalhe
LongDay é um gateway: uma única chave e um único endereço em vez de uma conta separada em cada fornecedor de modelos. O endpoint é compatível com OpenAI, o que na prática significa que, numa aplicação existente, você altera o baseURL e a chave, e o restante código fica inalterado — incluindo em LangChain, LlamaIndex ou Vercel AI SDK.
A razão pela qual existe e não é apenas um proxy: uma empresa da Moldávia que quer usar modelos de IA depara-se com o pagamento. LongDay mantém a carteira em dólares, mas emite fatura em leu através da e-Factura, com a taxa oficial do BNM tomada no dia da transação. O contrato é assinado em romeno.
O preço forma-se a partir de uma única regra, verificável no código: o custo real do fornecedor mais 70%, idêntico em todos os cinco planos. Não existem planos mais caros com tokens mais baratos nem o contrário. O valor é arredondado por excesso ao nível de microcêntimo.
O catálogo consultado hoje, 6 de setembro de 2026, tem 107 modelos ativos. 78 fazem chat e texto, 48 têm capacidade declarada de raciocínio, 17 áudio, 7 imagem, 7 realtime, 3 embeddings, 2 vídeo. As chaves emitidas trazem o prefixo sk-longday-. O catálogo é servido publicamente, sem autenticação, em longday.io/api/public/models — você pode verificá-lo antes de abrir uma conta.
O gateway é https://api.longday.io/v1. Em Node você altera o baseURL, em Python o base_url. A documentação própria lista as bibliotecas testadas: OpenAI Node, OpenAI Python, LangChain JS e Python, LlamaIndex, Vercel AI SDK. Também funciona a partir de qualquer ferramenta no-code que possa enviar um header Authorization: Bearer.
Cada chave pode ter o seu próprio teto de despesa, ciclo de reposição a 1, 7, 30 ou 90 dias e uma lista branca de modelos. Isto significa que um agente experimental e um fluxo de produção podem estar na mesma conta sem que o primeiro possa consumir o orçamento do segundo.
A carteira é em dólares; o carregamento é feito por Stripe, com valores entre 5 e 250 dólares. A conversão em leu usa a taxa oficial do BNM do dia, lida diretamente do XML do banco, com uma reserva local se o serviço não responder em cinco segundos. A política de crédito é 1:1 absoluta: qualquer valor pago torna-se exatamente o mesmo valor em crédito, sem bónus e sem transferir a comissão da Stripe para o cliente.
Free (sem subscrição, limite de 10 pedidos por minuto), Starter 5 $/mês, Pro 20 $/mês, Business 80 $/mês, Enterprise negociado. Cada plano pago inclui crédito mensal igual à subscrição. A margem é 70% em todos os cinco. Business e Enterprise têm e-Factura mensal.
Dados e funcionamento
Da exploração à implementação
Um minuto com o endpoint público. Se o modelo em que a sua aplicação se baseia não estiver lá, o resto da conversa não faz sentido — e é melhor descobrir antes da integração do que depois.
A chave recebe um orçamento e, se for o caso, uma lista branca de modelos. Para um piloto, o limite baixo é uma função, não uma limitação: transforma um bug numa fatura previsível.
Um modelo bom a redigir não é automaticamente bom a extrair de forma estruturada. Os mesmos exemplos, passados por vários modelos da mesma conta e da mesma chave, dão uma comparação que você pode defender. O custo da comparação é visível no painel de consumo.
Para uma empresa da Moldávia, o carregamento através da Stripe e a fatura em lei são duas coisas separadas. Aqui definimos que plano é necessário para a e-Factura mensal e que documentos a contabilidade pede.
Interroguei o catálogo público em 6 de setembro de 2026: 107 modelos, todos marcados como live. A família GPT-5 está amplamente coberta, de nano a pro, incluindo as variantes codex e as quatro versões 5.6; existem o1/o3/o4-mini, toda a linha Gemini (2.0, 2.5, 3, 3.1 flash e flash-lite), Gemma 3 e 4, imagem (gpt-image-1/1.5/2, flux-2-pro, gemini flash image, mai-image-25), vídeo (sora-2), áudio e realtime (gpt-realtime até 2.1, transcrição, elevenlabs-tts em três variantes), embeddings e deepseek-v4-flash. Uma coisa que temos de dizer diretamente: no catálogo live não existe nenhum modelo Anthropic Claude, embora o nosso README interno e as páginas de apresentação ainda prometam “Anthropic Claude directo”. Também faltam Llama, Qwen, Mistral, Voyage e Cohere, que aparecem no nosso documento para crawlers. O catálogo público é a fonte de verdade; esses textos estão desatualizados.
O custo real do fornecedor mais 70%, arredondado para cima ao microcent. A mesma percentagem em todos os cinco planos — não existe tarifa preferencial por token nos planos caros. A regra é uma invariável verificada em execução: se algum caminho de código tentasse ficar abaixo de 70%, lança um erro em vez de emitir uma fatura. O plano pago não lhe baixa o preço dos tokens; dá-lhe crédito mensal igual à assinatura, e-Fatura no Business e Enterprise, e níveis de suporte.
A superfície é compatível com OpenAI, servida por um proxy LiteLLM em https://api.longday.io/v1. Na prática: em Node troca o baseURL no construtor do OpenAI, em Python o base_url, e o resto do código fica idêntico. A documentação própria lista como testados OpenAI Node, OpenAI Python, LangChain JS, LangChain Python, LlamaIndex e Vercel AI SDK. Também funciona a partir de ferramentas no-code que possam enviar um header Bearer.
O plano Free está limitado a 10 pedidos por minuto; os outros quatro planos não têm limite de plano definido no código e são limitados pelo orçamento da chave. O carregamento aceita entre 5 e 250 dólares por transação. Cada chave pode ter orçamento próprio com ciclo de 1, 7, 30 ou 90 dias e lista branca de modelos. Alguns modelos têm limites próprios a montante assinalados no catálogo — gpt-image-2 a 10 pedidos por minuto, gpt-realtime-2.1 a uma quota de 15 TPM.
Um documento, não uma medição — e é importante saber a diferença antes de se basear no número. A nossa página de SLA publica cinco níveis, de 99,0% no Free a 99,99% no Enterprise, e diz que o uptime é calculado mensalmente a partir de status.longday.io. Esse subdomínio não existe: não tem registo DNS e não responde. No código não existe qualquer coletor de disponibilidade — nem endpoint de métricas, nem monitor externo; ambos são tarefas por iniciar no nosso próprio backlog. A página de estado que existe faz três sondagens em tempo real e não guarda histórico, portanto não pode produzir uma percentagem mensal. A cifra de 99,9% mostrada na página principal é um compromisso contratual escrito, não uma observação, e o produto autoidentifica-se como BETA no cabeçalho dessa mesma página. Até que o monitor exista, trate a percentagem como uma cláusula contratual com crédito de compensação, não como um desempenho demonstrado.
Aqui temos de ser exatos, porque há uma diferença entre o que foi desenhado e o que foi construído. A conversão cambial é real e funciona: a taxa oficial do BNM é lida do XML do banco para o dia respetivo, com reserva local se o serviço não responder em cinco segundos. O cliente que submete a fatura ao Serviço Fiscal é, porém, ainda um esqueleto — uma camada sobre fetch, com o seu próprio comentário que diz que a implementação real, a que carrega o certificado PKCS#12 da empresa e assina cada pedido, está para vir. Até lá, a parte de e-Fatura resolve-se com a contabilidade, não automaticamente pela plataforma.
Não. É uma camada de acesso e de faturação sobre os modelos de terceiros. Não deve ser confundido com Grai, que é o nosso projeto de investigação sobre voz em romeno e não tem ligação técnica com o gateway.
Exemplo ilustrativo
Um cenário de utilização, sem dados de cliente nem resultados comerciais atribuídos.
Uma equipa já tem uma integração que funciona com o SDK da OpenAI, paga com o cartão pessoal de um dos sócios, sem documento que entre na contabilidade.
Altera-se o baseURL para https://api.longday.io/v1 e a chave. É emitida uma chave separada para produção, com teto mensal e lista branca apenas nos modelos efetivamente usados, para que um ciclo errado não possa consumir todo o orçamento do mês. O carregamento é feito via Stripe em dólares.
O código fica idêntico — mudam-se dois valores de configuração. O consumo é visível por chave, e o plano Business inclui e-Fatura mensal. O preço por token é o custo real do fornecedor mais 70%, o mesmo que no plano Free.
Ce este necesar:Modelul folosit trebuie să existe în catalogul live — se verifică în avans la longday.io/api/public/models. Dacă aplicația depinde de un model Anthropic Claude, astăzi nu e disponibil prin gateway.
Possibilidades de colaboração
A ligação das fontes autorizadas, a organização da informação e a revisão das ações pela equipa, com acesso separado por funções.
Definimos um piloto em torno de um processo real: utilizadores, dados, integrações, custos e critérios de aceitação. A expansão segue após a avaliação do resultado.
Estabelecemos os requisitos de acessibilidade, alojamento, proteção de dados e interoperabilidade. Qualquer ligação a serviços AGE ou STISC requer a validação da elegibilidade, do acesso e das aprovações.
Estes são cenários de adaptação, não declarações sobre contratos ou parcerias existentes. As funções propostas confirmam-se no âmbito de trabalho do projeto.
Fale sobre um pilotoUm assistente ligado à informação do seu negócio, nos canais por onde os clientes lhe escrevem.
PlatformăGrai é a nossa linha de investigação em síntese de voz e modelos adaptados às línguas que se falam aqui.
Cercetare & dezvoltareWorld Agent é um demonstrador de interação em linguagem natural com uma cena visual.
Demonstrator de cercetareConte-nos o seu processo. Em conjunto decidimos o que vale a pena construir, o que podemos ligar e como verificamos o resultado.