Saltar para o conteúdo
megapromotingVamos falar

Experiência · Agentes de voz

Um agente que fala — na sua página e por telefone — e que pode ser interrompido.

Construímos agentes de voz em Kallina: papel escrito, base de conhecimentos aprovada, ferramentas que chamam durante a conversa e um limite para além do qual passam a conversa para um humano. O romeno é a língua predefinida dos novos agentes.

Já construídoTrei implementări proprii, citate mai jos. (1) Platforma Kallina — 472 de funcții edge Deno și 559 de migrări de bază de date, numărate azi în depozit; `https://app.kallina.info` răspunde 200. (2) Componenta de pe acest site, `src/components/agents/KallinaVoiceAgent.tsx`, care implementează traseul corect de sesiune și documentează cele două moduri în care un agent vocal eșuează în tăcere. (3) Puntea `elevenlabs-bridge` și sesiunea `openai-realtime-session`, unde stau parametrii reali de întrerupere și de detecție a vorbirii. Rezerva pe care o spunem: partea de telefon depinde de o gazdă SIP, iar gazda prin care trec liniile noastre de test nu răspunde la data scrierii — vezi pagina de telefonie. Pe web, traseul e verificabil azi.

Para nós, um agente de voz não é «um bot que lê um guião». Tem quatro coisas escritas antes da primeira chamada: um papel, uma base de conhecimento aprovada por si, um conjunto de ferramentas que lhe é permitido chamar, e um limite para além do qual passa a conversa a um humano. O que sai da conversa não é apenas uma transcrição: a chamada tem duração, custo discriminado por fornecedor, gravação e análise, tudo ligado à conta da empresa.

O motor não é um só, e isso é uma decisão, não um acidente. Na configuração do agente, você escolhe entre ElevenLabs Conversational AI, OpenAI Realtime e Gemini Live, ou deixa em «auto» e a plataforma escolhe por língua, carga e disponibilidade. Por cima disso, você escolhe separadamente o cérebro textual, de um catálogo em que cada modelo tem a latência e o custo por minuto mostrados na interface. Quando alguém pergunta «porque responde devagar», a resposta tem números, não opiniões.

A parte que as pessoas sentem mais é a interrupção. No OpenAI Realtime, a deteção da fala é semântica, com limiar 0,5, uma margem de 300 ms antes e 500 ms de silêncio para considerar que você terminou de falar; o interruptor «permitir interrupções» está ligado por defeito. Na ElevenLabs, o evento de interrupção é passado para a central telefónica, para parar a reprodução de imediato. E o tempo depois do qual o agente considera que o seu silêncio é uma resposta é configurável por agente — num agente de vendas escrito por nós está fixado em 12 segundos, face aos 15 por defeito.

O agente vive em dois lugares diferentes, com constrangimentos diferentes. Na página web entra com uma única linha de script ou com um componente próprio, e a regra de ouro é que a página nunca guarda o identificador do agente nem qualquer chave de fornecedor — pede à plataforma uma sessão e recebe um URL assinado, de curta duração. Por telefone entra por um trunk SIP, e aí os constrangimentos são do operador e da central, não do agente; sobre isso escrevemos separadamente, na página de telefonia.

Agenți vocali AI în Republica Moldova — cum funcționează, concret · video în română, cu subtitrare și transcriere

Transcrierea completă

Bun, haideți să trecem direct la subiect. Astăzi facem o analiză tehnică extrem de precisă a modului în care agenții vocali funcționează cu adevărat în mediul de afaceri. Ne vom baza exclusiv pe arhitectura platformei Kallina, dezvoltată chiar în Republica Moldova, de MEGA PROMOTING S.R.L.. Fără limbaj de marketing, fără promisiuni umflate, doar fapte, infrastructură pură și, evident, realitatea operațională. Pentru orice echipă care conduce o afacere și se bazează pe procese clare, înțelegerea tehnologiei de sub capotă este, sincer, absolut esențială. Avem un parcurs foarte metodic astăzi. Trecem prin șase puncte. Întâi abordăm problema, apoi mecanismul de funcționare, urmează anatomia unui eșec, secțiunea de motoare și întreruperi, limitele tehnice și, în final, pasul următor. E o privire total transparentă asupra sistemului. Așadar, prima secțiune, problema, timpul și cererile. Să vedem exact de unde pornim. Aceasta este fix întrebarea care nu lasă managerii de operațiuni să doarmă noaptea. Unde se pierde mai exact timpul operațional și, foarte important, câte cereri neverificate dispar zilnic. Într-o companie obișnuită, timpul pur și simplu se evaporă printre apeluri pierdute, solicitări care nu sunt preluate la timp și tot felul de interacțiuni care, ei bine, pur și simplu nu pot fi verificate ulterior. Și nu e doar o mică problemă de disconfort. Vorbim de o resursă operațională uriașă care se pierde zi de zi într-un flux de lucru neoptimizat. Trecem la partea a doua, mecanismul, cum funcționează. Haideți să intrăm în ingineria propriu-zisă a platformei. Uitați-vă puțin la numărul ăsta, 472. Acesta este numărul exact de funcții Edge de nou care țin platforma în picioare în acest moment. Deci, clar, nu vorbim despre un prototip de weekend sau o interfață drăguță de fațadă. Este o infrastructură masivă pe un server real gândită să gestioneze rute și logici de business extrem de complexe. Și, pentru a sublinia nivelul de maturitate, există exact 559 de migrări de bază de date pe infrastructura PostgreSQL, care este găzduită prin Supabase. Aceste cifre ne arată o fundație supersolidă cu politici de securitate implementate la nivel de rând. Practic, este un sistem construit pentru a scala și pentru a ține datele într-o ordine impecabilă. Acum, uitați cum arată ordinea operațiunilor pe un agent web, pentru că detaliul ăsta e absolut genial. La pasul 1, pagina cere acces la microfon. La pasul 2, vizitatorul trebuie să accepte. Și abia la pasul 3 se trimite o cerere către server pentru a deschide o sesiune primind înapoi un URL semnat valabil doar pentru o perioadă scurtă. De ce e asta o mișcare strategică atât de importantă? Simplu, dacă la pasul 2 microfonul este refuzat, sistemul nu merge mai departe. Matematic asta înseamnă 0 minute consumate și 0 bani aruncați pe fereastră pentru sesiuni fantomă. Secțiunea a 3-a este probabil preferata mea. Anatomia unui eșec. Pentru că nimic nu construiește încrederea mai mult decât o transparență totală, nu-i așa? Imaginați-vă situația asta de coșmar. S-a implementat un agent vocal pe o pagină web, dar când apăsai pe buton nu se întâmpla absolut nimic. Fără sunet, fără vreun mesaj de avertizare, fără eroare în consola dezvoltatorului. Liniște completă. Pentru oricine, chiar și pentru un tehnician cu experiență, un astfel de defect părea imposibil de localizat la prima vedere. De ce? Pentru că nu exista niciun jurnal de eroare. Un eșec complet tăcut. Când s-a săpat mai adânc, analiza tehnică a scos la iveală doi inamici complet invizibili. În primul rând, serverul trimitea un antet care interzicea complet utilizarea microfonului. Browserul, fiind obedient, respecta regula și refuza cererea, dar o făcea fără să avertizeze interfața vizuală. În al doilea rând, o componentă de voce era importată static pe pagină. Fișierul pur și simplu nu era găsit, returnând o eroare 404. Din cauza asta, întregul script se prăbușea pe fundal, în tăcere, blocând orice configurare ulterioară. Dar uitați cât de elegantă a fost soluția. Problema, în mod evident, nu era la AI, ci direct la rețea. S-a modificat antetul serverului pentru a permite microfonul din propria sursă, vedeți acolo, la starea reparată, și s-a mutat importul de cod exact în interiorul acțiunii de apăsare a butonului. Defectul a dispărut complet. Acum, dacă cineva apasă butonul și microfonul este blocat de browser, eșecul nu mai este tăcut. Apare instantaneu un mesaj clar în limba română care îți explică exact ce trebuie să schimbi. Asta înseamnă inginerie făcută cu cap, eliminând total surprizele neplăcute. Mergem mai departe la secțiunea a patra, motoare, limbi și întreruperi. Este momentul să examinăm exact de ce este capabil acest sistem. Aici lăsăm la o parte părerile subiective și vorbim doar în milisecunde. Când folosești modelul Flash, de la ElevenLabs, latența este de doar 75 de milisecunde. Ca să vă faceți o idee, pentru urechea umană, asta este practic instantaneu. Pe de altă parte, dacă preferați o calitate vocală absolut premium, cum oferă modelul Turbo, latența ajunge pe la 250 de milisecunde. Într-o convorbire telefonică, fiecare milisecunde este critică, iar platforma îți permite să alegi exact ce motor vrei, strict în funcție de nevoile operaționale ale companiei. O întrebare super frecventă pe care o auzim este Bine, dar pot să întrerup agentul în timp ce vorbește? Răspunsul este un da ferm, doar că mecanismul diferă. De exemplu, pe OpenAI Realtime, detecția este semantică. Are un prag fixat la 0.5 și o pernă de siguranță tehnică de 300 de milisecunde. În schimb, pentru ElevenLabs, în secunda în care intervine o întrerupere, un eveniment pleacă direct către centrala telefonică, sistemul PBX, pentru a tăia instantaneu sunetul. Mai mult, perioada de tăcere pe care agentul o așteaptă înainte să răspunde la rândul lui, poate fi reglată foarte fin. Poate fi, de pildă, strânsă la 12 secunde în loc de valoarea implicită de 15, ceea ce face conversația mult mai naturală și alertă. Din punct de vedere a limbilor suportate, configurația oficială a agentului duce cu succes 32 de limbi diferite. Dar, un aspect operațional de maximă importanță pentru noi aici? Limba română este setată implicit pentru absolut toți agenții noi creați pe această platformă. Am ajuns la secțiunea a cincea, limite tehnice și responsabilități, pentru că, uneori, este la fel de important să știi ce nu poate face un sistem, ca să ai așteptările corecte. Haideți să trasăm o linie foarte clară. Agentul poate executa funcții externe, poate declanșa unelte interne direct pe server și poate transfera apelul către un coleg uman fără nicio problemă. Dar, sistemul interzice agenților să improvizeze în domenii strict reglementate. Gândiți-vă puțin. Un agent care începe să improvizeze acolo unde legislația este extrem de strictă devine un risc uriaș pentru companie, în niciun caz un avantaj. Mai mult, lucruri precum executarea automată a ștergerilor de date la un anumit termen nu sunt pur și simplu niște bife într-un meniu. Ele reprezintă proiecte procedurale separate care trebuie implementate dedicat de către organizație. Securitatea, pe de altă parte, este tratată cu o rigoare absolută. Paginile web care găzduiesc agenții primesc exclusiv acel URL semnat de care vorbeam. Niciodată, dar absolut niciodată, nu primesc un ID de agent sau o cheie API care ar putea fi furată și folosită pe banii companiei. Pe partea de voce, telefonia depinde 100% de un trunk SIP extern funcțional și, ca să fim cât se poate de transparenți privind limitările actuale, liniile externe SIP de test nu răspund în acest moment. Este o abordare extrem de sinceră din partea inginerilor care demonstrează că realitatea tehnică e mereu pe primul loc, dincolo de orice discuție comercială. Și iată-ne la secțiunea a șasea, ultima, de altfel, pasul următor în proces. Ce facem mai departe cu toate informațiile astea? Toată această disecție tehnică ar trebui să ne conducă la o evaluare super obiectivă a fluxurilor voastre de lucru. Asta e adevărata miză. Ce proces operațional din interiorul organizației are nevoie de fapt să funcționeze mai eficient? Nu implementăm inteligență artificială doar de dragul de a fi la modă, corect? Scopul este să identificăm locul ăla exact, logic, unde un agent vocal se poate integra rațional, poate scala și poate funcționa în condiții de maximă siguranță. Ca un punct final, aveți aici coordonatele operaționale ale companiei MEGA PROMOTING S.R.L. din Chișinău, inclusiv IDNO și adresa web? Asta pentru o eventuală discuție strict tehnică, menită să clarifice cum se pot integra aceste structuri complexe în sistemele pe care deja le folosiți în afacerea voastră. Înainte de orice decizie, aș lăsa o întrebare provocatoare la care să reflectăm cu toții. Oare procesele actuale de gestionare a clienților din companiile noastre ar rezista cu adevărat unei analize tehnice la fel de dure și transparente precum cea prin care a trecut acest sistem? Într-o piață definită de inovație constantă, o privire bazată strict pe fapte și cifre rămâne de departe cel mai puternic instrument pe care îl avem la dispoziție. Pe data viitoare!

Qué incluye

El trabajo, por componentes

A sessão é pedida à plataforma, não ao fornecedor de voz

A página envia `POST /functions/v1/widget-voice-session` com o identificador público do widget e recebe em troca um URL assinado. Nunca tem o identificador do agente nem qualquer chave. A variante errada — `startSession({ agentId })` diretamente em HTML — contorna completamente a camada de sessão, de crédito e de registo da plataforma, e expõe o agente a qualquer pessoa que abra a origem da página. É a primeira verificação que fazemos em qualquer implementação que assumimos.

O microfone é pedido antes da sessão, por isso uma recusa não custa nada

A ordem é fixa e importa: peça o microfone com `getUserMedia({audio:true})` e só depois, se a pessoa aceitar, peça a sessão. Se o visitante recusar, não é emitido qualquer URL assinado e não é consumido nenhum minuto. O pedido de microfone é feito dentro do clique no botão, antes de qualquer espera que possa ultrapassar o gesto — caso contrário o navegador ignora o pedido.

O agente pode ser interrompido, e isso regula-se com números

No OpenAI Realtime: deteção semântica da fala, limiar 0,5, margem de 300 ms, 500 ms de silêncio, interrupção permitida por defeito. Na ElevenLabs: o evento `interruption` é enviado para a central para cortar a reprodução. Além disso, `turn_timeout` por agente decide após quanto tempo de silêncio o agente considera que é a sua vez — por defeito 15 segundos, fixado em 12 num agente de vendas. E um «não o consigo interromper» relatado por um cliente tem, muitas vezes, outra causa que não os limiares: respostas demasiado longas. Essa resolvemos no prompt e no limite de tokens, não na deteção da fala.

Chama ferramentas durante a conversa

O agente não fica preso ao que sabe. Pode chamar funções no servidor enquanto fala — para ler uma disponibilidade, marcar uma programação, enviar um SMS ou consultar um catálogo. As ferramentas são declaradas por agente, com parâmetros tipados e com um prazo de execução próprio, para que uma ferramenta lenta não bloqueie a conversa.

A passagem para um humano faz parte do cenário, não é uma exceção

Na mensageria, a passagem para um colega tem estado próprio no fio — `handoff_status`, o momento da passagem, o motivo, quem está atribuído, as notas de resolução — implementada num módulo dedicado de 619 linhas. No telefone, a transferência é feita pela central: transferência cega por `##` e transferência assistida por `*2`, com a chamada a aterrar num contexto de dialplan escrito para isso. São dois mecanismos diferentes porque são dois canais diferentes; escrevemos ambos no cenário.

O motor e a voz escolhem-se explicitamente, não implicitamente

Quatro posições de fornecedor: `elevenlabs`, `openai-realtime`, `gemini-live` e `auto`. Para a síntese de voz noutras línguas além do inglês, o padrão é `eleven_flash_v2_5` — 32 línguas, cerca de 75 ms; a variante de melhor qualidade, `eleven_turbo_v2_5`, fica em cerca de 250 ms. No OpenAI Realtime há dez vozes e motores até `gpt-realtime-2.1`. A escolha é um campo na configuração do agente, não uma suposição da nossa parte.

Limbi

A configuração do agente aceita 32 línguas, o mapa interno de línguas da plataforma tem 41 entradas, e o painel de administração está traduzido em 20. São três números para três coisas diferentes e não se podem misturar. O romeno é a língua padrão de um novo agente.

O que fica depois da chamada

Transcrição, gravação áudio, duração, custo discriminado por fornecedor, mais uma análise pós-chamada e um breve resumo da conversa, gerado para a memória do cliente. A análise não é um fim em si: nela assenta a decisão se o agente fez o que devia ou se o cenário tem uma falha.

O consumo é verificado antes da ação, não na fatura

Antes de qualquer operação que tenha custo, a plataforma verifica o crédito disponível, e o consumo é registado discriminado por fornecedor e por agente. A gate fica antes da chamada. Na prática: um agente perdido num loop não pode consumir sem fim sem bater numa limitação.

Qué aspecto tiene

El recorrido, paso a paso.

01

Escolhemos um único percurso e escrevemos os seus limites

Um cenário com entrada clara e saída clara: chamada recebida na receção, confirmação de encomenda, verificação de disponibilidade. Escrevemos explicitamente o que o agente não tem permissão para fazer, o que não tem permissão para dizer e por que via passa a conversa a um humano. Um agente sem margens escritas não é mais capaz, é apenas mais imprevisível.

02

Construímos o agente: função, conhecimentos, ferramentas, limites

O prompt, a base de conhecimentos aprovada por si, as ferramentas que pode chamar e os limiares de conversa — fornecedor, voz, modelo textual, tempo de silêncio, comportamento em interrupção. No fim, temos um agente configurado, não uma demo.

03

Colocamo-lo no canal e verificamos o percurso sem consumir minutos

Na web: uma linha de script ou um componente próprio sobre a API de início e paragem. Existe um script que percorre exatamente o caminho de um browser — a linha na configuração, a configuração do widget, o pedido de sessão — e pára no URL assinado, sem abrir a conexão áudio. Corre num widget ou em todos, devolve código de saída, logo pode entrar numa verificação agendada. No telefone: o número entra no trunk, e as chamadas recebidas e as efetuadas são testadas separadamente, porque falham separadamente.

04

Medimos o que saiu e corrigimos o cenário

Depois das primeiras conversas reais lemos as transcrições e a análise pós-chamada, não as impressões. O que mais corrigimos não é o modelo, mas o comprimento das respostas e as margens do cenário — duas coisas que se mudam no prompt, no mesmo dia.

IntrareVerificareDeciziePublicareNimic nu trece mai departe neverificat.ORDINEA E ARGUMENTUL
Traseul unei conversații: pagina cere microfonul, platforma emite o sesiune semnată, agentul vorbește și poate fi întrerupt, cheamă o unealtă, iar ce depășește rolul lui se predă unui om.

Os dados

Qué tocamos, dónde están y cuánto se quedan

Las preguntas que hace cualquiera que tenga un delegado de protección de datos — hechas aquí antes de que las haga él.

Onde os dados ficam
PostgreSQL através do Supabase alojado em infraestrutura própria, com 559 migrações versionadas, das quais 195 abrangem políticas de Row Level Security. Os ficheiros — registos, documentos de conhecimento, amostras de voz — ficam em repositórios separados, com o caminho a começar pelo identificador do espaço de trabalho, para que o isolamento esteja na estrutura e não apenas na consulta.
O que nunca entra na tua página
A chave do fornecedor de voz e o identificador do agente. A página recebe apenas um URL assinado, de curta duração, emitido pela plataforma. A consequência prática: quem lê a origem da tua página não pode usar o teu agente às tuas custas.
O que é registado numa chamada
Áudio, transcrição, duração, número do chamador, resultado da chamada e análise posterior. Para os casos em que o agente se lembra do cliente entre chamadas, é guardado também um breve resumo da conversa anterior. Tudo fica ligado a um espaço de trabalho; não existe um repositório comum entre clientes.
A eliminação a pedido existe; a eliminação automática por prazo ainda não
Dizemo-lo como é, porque é a diferença entre uma promessa e uma funcionalidade. A eliminação a pedido está implementada: uma função dedicada elimina os objetos do repositório de ficheiros, chama o procedimento de eliminação na base de dados e invalida as sessões; existe em separado exportação de dados e uma função para os dados da chamada. O que não está implementado: prazos de retenção configuráveis por espaço de trabalho. Estão projetados num documento interno de abril, mas a coluna de configuração não aparece em nenhuma migração — por isso, hoje a eliminação por prazo é feita por procedimento, não por relógio. Se o teu projeto precisa de eliminação automática, isso entra como trabalho, não como definição.
Quem é informado de que fala com um agente
O aviso de que o interlocutor está a falar com um sistema automático, o fundamento da gravação da conversa e o texto lido no início da chamada são definidos em conjunto consigo e entram no guião. Não são uma definição técnica: são uma decisão do responsável pelo tratamento dos dados, ou seja, sua.

Un caso

O botão que não fazia nada — e nem sequer dava erro

A situação

Um agente de voz colocado numa página web. Ao carregar, não acontecia absolutamente nada: sem som, sem mensagem, sem erro na consola que um não iniciado pudesse ver. O tipo de defeito que é reportado como «não funciona» e é procurado durante um dia no sítio errado.

Qué construimos

As causas eram duas, ambas silenciosas pela sua natureza. A primeira: o cabeçalho `Permissions-Policy` do servidor continha `microphone=()`, e o navegador recusa o pedido de microfone sem mostrar nada de visível ao utilizador. A segunda: o SDK de voz era importado estaticamente, e um módulo que devolve 404 na importação estática derruba todo o script — portanto, também o pedido de configuração morria com ele, o que faz o defeito parecer exatamente como «nada aconteceu». Mudei a importação do SDK para o interior do carregamento do botão, coloquei o pedido de microfone antes do pedido de sessão e escrevi o cabeçalho do servidor como `microphone=(self)`, com a política de conteúdo que permite explicitamente a rede de distribuição do SDK.

Qué salió

Hoje, neste site, o cabeçalho servido em produção é `camera=(), microphone=(self), geolocation=(self)`, e a política de segurança de conteúdo enumera explicitamente a origem do SDK. Uma falha já não é silenciosa: a recusa do microfone produz uma mensagem em língua romena que diz o que exatamente deve ser alterado, e a recusa não custa nada, porque a sessão nem sequer é pedida.

Qué no dice el caso

As duas causas são de infraestrutura, não do agente. Se o teu site é servido por outra entidade e os cabeçalhos não estão sob o nosso controlo, a sua verificação torna-se uma condição inicial do trabalho, não uma surpresa no fim.

Perguntas

Lo que nos pregunta la gente antes de llamar

Com o que fala, concretamente? Que motor está por trás?

Escolhes entre ElevenLabs Conversational AI, OpenAI Realtime e Gemini Live, ou deixas «auto» e a plataforma escolhe com base no idioma e na disponibilidade. Para síntese de voz noutras línguas além do inglês, o padrão é `eleven_flash_v2_5` — 32 línguas, cerca de 75 ms; se quiseres maior qualidade e aceitares maior latência, `eleven_turbo_v2_5` fica em cerca de 250 ms. No OpenAI Realtime há dez vozes, e o motor vai até `gpt-realtime-2.1`. O cérebro textual é escolhido separadamente, num catálogo em que cada modelo tem a latência e o custo por minuto escritos ao lado.

Posso interrompê-lo quando fala, ou tenho de esperar que termine?

Podes. No OpenAI Realtime, a deteção de fala é semântica, com limiar 0,5, amortecimento de 300 ms e 500 ms de silêncio, e o comutador de interrupção vem ligado por defeito. No ElevenLabs, o evento de interrupção é enviado para a central telefónica para parar a reprodução. Se, ainda assim, tens a sensação de que «não o podes interromper», a causa costuma ser outra: o agente responde em parágrafos, não em frases. Isso corrige-se no prompt e no limite de tokens, não nos limiares.

Em quantas línguas fala?

A configuração do agente suporta 32 línguas. O mapa interno de línguas da plataforma tem 41 entradas, e o painel de administração está traduzido em 20 — três números para três coisas diferentes. O romeno é a língua predefinida de um agente novo. Para uma língua específica, verificamos primeiro que combinação de modelo de voz e fornecedor a cobre efetivamente, porque nem todos os modelos cobrem as mesmas línguas.

Como chega ao meu site e o que tenho de mudar no meu lado?

Uma linha de script com o identificador público do widget, ou a sua própria componente por cima de `start()` / `stop()` / `toggle()`. Duas coisas têm de ser verdadeiras no seu servidor, caso contrário o botão não faz nada e não aparece nenhum erro: o cabeçalho `Permissions-Policy` tem de permitir `microphone=(self)` — com `microphone=()` o browser recusa o microfone em silêncio — e a política de segurança do conteúdo tem de permitir o carregamento do SDK a partir da rede de distribuição usada. Nós verificamos isso antes da publicação.

Pode ligar ele primeiro, e não apenas responder?

Sim, a plataforma tem chamadas em lote, com importação de contactos, novas tentativas e acompanhamento em tempo real. Mas as chamadas efetuadas não dependem só de nós: no nosso registo de problemas está documentado um caso em que a central do operador começou a devolver `403 Forbidden` em todas as chamadas efetuadas, com a nossa configuração inalterada e com as chamadas recebidas a funcionar normalmente. Por isso testamos as chamadas efetuadas separadamente antes de prometer uma campanha de chamadas, e por isso não vendemos um volume de chamadas efetuadas antes desse teste.

O que acontece quando o agente não sabe a resposta?

Passa. Cada agente tem limites escritos e um caminho de transferência configurado. Em mensagens, o fio passa para estado de atendimento humano, com motivo e atribuição a um colega. Por telefone, a central faz a transferência — cega ou assistida — para uma extensão ou um número externo. O que excede o papel do agente pára, não se improvisa; essa é uma escolha de projeto, porque um agente que improvisa num domínio regulamentado é um risco, não uma economia.

As conversas são gravadas? Quanto tempo são guardadas?

Sim, são gravadas, transcritas e analisadas, e tudo está ligado ao seu espaço de trabalho. Quanto tempo são guardadas é uma decisão sua como operador de dados, não um valor predefinido que lhe impomos — e é preciso dizer claramente que a eliminação automática no prazo não é hoje uma simples definição na plataforma: a eliminação a pedido está implementada, a eliminação no prazo é feita por procedimento. Se precisar de um relógio automático, ele é construído no projeto.

Gasta dinheiro se o visitante carregar no botão e depois recusar o microfone?

Não. O microfone é pedido antes da sessão. Se a pessoa recusar, o pedido de sessão deixa de ser feito, logo não é emitido nenhum URL assinado e não se consome nada. Em separado, antes de qualquer operação que custe, a plataforma verifica o crédito disponível — a porta está antes da chamada, não na fatura no fim do mês.

Posso ter hoje um agente que responde a um número de telefone fixo?

Depende de uma peça que não é o agente: a gateway SIP por onde entra a chamada. A parte do agente está pronta e pode ser mostrada na página de imediato. A parte telefónica exige um trunk funcional do operador e uma central que responda; na data da redação, a gateway por onde passam as nossas linhas de teste não responde, e nós não apresentamos como disponível algo que não podemos pôr a funcionar em frente a você. Para um projeto real, a telefonia é dimensionada separadamente — veja a página de telefonia e contact center.

Em que se baseiam as afirmações acima (21 fontes)
  1. app.kallina.info răspunde 200 azi; supabase.kallina.info răspunde la funcțiile edgehttps://app.kallina.info/ · 2026-09-06
  2. Antetele servite azi în producție pe megapromoting.com permit microfonul și sursa SDK-uluihttps://www.megapromoting.com/ · 2026-09-06

19 delas são código e ficheiros dos nossos repositórios. Não publicamos o nome nem a linha: juntos, numa única página, descreveriam com demasiada precisão como estão construídos sistemas que não são só nossos. Percorremo-los consigo, no repositório, a pedido — a verificação continua possível, só que se faz numa conversa.

O que gostaria que funcionasse melhor?

Conte-nos o seu processo. Em conjunto decidimos o que vale a pena construir, o que podemos ligar e como verificamos o resultado.

Vamos falar