Especialização · Vídeo e conteúdo com AI
Clipes curtos construídos em HTML, com voz sintetizada e com a licença de cada elemento no papel.
Produzimos clipes de promoção e conjuntos de visuais usando ferramentas de geração — voz sintetizada, imagens, composições animadas renderizadas em HTML. Cada elemento que entra em quadro tem uma fonte e uma licença escritas, e o som é medido, não aproximado.
Já construídoSunt materiale livrate, pe disc, pe care le-am măsurat azi cu unelte, nu le-am citit dintr-un raport. Un set de patru clipuri de 30 de secunde fix (două limbi × două formate) pentru o platformă proprie, un al doilea set de patru clipuri de introducere, o compoziție proprie randată în șapte variante pentru promovarea companiei, și două runde de vizualuri statice de campanie pentru un operator de transport. Am reverificat sonorul unuia dintre clipuri cu `ffmpeg … ebur128`: −16,2 LUFS integrat, vârf real −1,8 dBTP — exact cifrele din documentul intern, ceea ce nu se întâmplă de fiecare dată. Corecție importantă față de propriul nostru inventar: `hyperframes` NU este codul nostru. E clona depozitului public al altei companii, sub licență Apache 2.0, fără niciun commit al nostru. E unealta cu care lucrăm; realizările sunt compozițiile și randările, nu unealta.
Um clipe de trinta segundos tem três formas de se estragar, e só uma se vê à primeira visualização. Estraga-se visualmente — isso toda a gente observa. Estraga-se sonoramente, e então o clipe fica mais alto ou mais baixo do que tudo o que o rodeia na rede onde chega, o que só se observa após a publicação. E estraga-se juridicamente, o que nunca se observa, até ao dia em que se observa. Trabalhamos nos três, e nos dois últimos temos procedimento escrito, não boa vontade.
A composição é feita em HTML, não num editor. Uma composição é um documento com faixas e clipes, cada um com o momento de início e a duração escritos como atributos — por exemplo, um clipe que começa aos 8,4 segundos e dura 5,0 segundos, com sobreposição intencional sobre o anterior para a transição. A consequência prática é que um clipe pode ser refeito de forma idêntica: os mesmos atributos, o mesmo resultado, e uma correção de texto não exige refazer manualmente a montagem. A renderização da nossa composição de promoção saiu em 1920×1080, 60 fotogramas por segundo, 1200 fotogramas, exatamente 20,000000 segundos — números lidos do ficheiro, não do briefing.
A voz é sintetizada, com definições escritas no guião juntamente com o texto, para que uma repetição soe idêntica: modelo multilingue, estabilidade, semelhança, estilo e velocidade assinalados como valores, não como impressões. O texto é calibrado pela duração antes da geração — um clipe de trinta segundos suporta cerca de sessenta e cinco palavras em romeno, e se o guião tiver oitenta, corta-se o texto, não se acelera a voz. O som final é normalizado em duas passagens até um alvo e depois medido no ficheiro entregue: os quatro clipes de um conjunto recente ficam em −16,2 e −15,9 LUFS, com pico real −1,8 dBTP.
A regra que seguimos, e que se vê claramente no dossier de licenças de um conjunto entregue: nada no clipe tem uma licença que não possamos mostrar. A faixa musical e os efeitos sonoros foram sintetizados localmente com `ffmpeg` — cinco osciladores sinusoidais com filtro passa-baixo para a música, ruído rosa filtrado para o efeito de transição, impulso de 1500 Hz com envolvente exponencial para o clique — precisamente porque um som feito por nós tem uma licença demonstrável, e um ficheiro «gratuito» de uma página que não diz em que condições, não. As molduras de telefone e de portátil são desenhadas em SVG, não fotografias de produto. As capturas são da nossa plataforma, feitas automaticamente numa versão de produção local. A fonte é auto-hospedada, sob licença aberta para fontes.