O aroma de pão recém-assado não pode ser transmitido por uma foto do cardápio — e é justamente essa sensação que influencia boa parte da decisão de entrar em um café específico, e não no estabelecimento ao lado. Restaurantes e cafés confiaram por anos nas fotos de pratos no Instagram e no VK, mas o feed em que todas as imagens são parecidas — comida bem-arrumada em um prato branco — deixou de destacar qualquer estabelecimento. Um vídeo que mostra o ambiente do salão, o preparo dos pratos ou o anúncio de uma promoção funciona de outra forma: vende uma sensação, não apenas a aparência do prato.
O problema nos restaurantes é sempre o mesmo: não há tempo nem orçamento para contratar um videomaker e um editor, mas o conteúdo precisa ser atualizado constantemente — novo cardápio sazonal, promoção de almoço executivo, anúncio de música ao vivo às sextas-feiras. É justamente aí que a automação elimina a distância entre “precisamos de vídeos toda semana” e “não temos recursos para uma equipe de filmagem”.
Três tipos de conteúdo de que um estabelecimento precisa toda semana
Um café ou restaurante geralmente tem três demandas recorrentes de vídeo. Fazer cada uma manualmente é diferente, mas, com a automação, todas ficam igualmente simples. A primeira é apresentar o cardápio ou um prato específico: um vídeo curto que mostra os ingredientes e a apresentação, geralmente necessário quando o cardápio sazonal é atualizado. A segunda é anunciar uma promoção: desconto no almoço executivo, combo para duas pessoas, happy hour — conteúdo que deve ser publicado com regularidade e previsibilidade, caso contrário o público deixa de acompanhar as promoções do estabelecimento. A terceira é mostrar o ambiente: vídeos do salão, da cozinha aberta ou de um evento — conteúdo que vende não o prato, mas a experiência de ir àquele lugar.
No Telematic, a fonte para qualquer um desses três cenários pode ser simplesmente um texto: a descrição de um prato novo ou o texto de uma promoção que o gerente já prepara para as redes sociais. A IA transforma esse texto em um roteiro, preservando os detalhes — ingredientes, preço, período da promoção —, mas estruturando-o para que o vídeo não pareça um anúncio lido em voz alta. Se o estabelecimento já tiver um rascunho de vídeo gravado no celular (por exemplo, o chef falando sobre um prato), é possível usar a transcrição desse vídeo como fonte e obter uma versão mais refinada, com o mesmo sentido.
Roteiro híbrido em vez de uma lista sem graça de ingredientes
Para apresentar o cardápio, o modo de roteiro híbrido funciona especialmente bem: em vez de ler os ingredientes ao pé da letra (“filé de frango, molho teriyaki, arroz, gergelim”), a IA transforma essa descrição em uma narração que soa como a recomendação de um garçom, e não como o rótulo de uma embalagem. A velocidade de narração “dinâmica” é ideal para anunciar rapidamente uma promoção por tempo limitado; a opção “tranquila” funciona melhor para apresentar um novo cardápio sazonal, quando é importante dar ao público tempo para apreciar a apresentação dos pratos.
A etapa de edição antes da geração dos quadros permite organizar as cenas de acordo com a lógica da apresentação: primeiro, o ambiente do salão; depois, um close do prato; por fim, o preço e a chamada para ação. As transições entre essas cenas — com o logotipo ou o endereço do estabelecimento — são inseridas como cenas comuns, sem precisar contratar um designer.
Estilo visual alinhado ao conceito do estabelecimento
Uma cafeteria de estilo escandinavo minimalista e uma steakhouse com apresentação rústica não devem parecer iguais nos vídeos. Entre 29 estilos visuais e 25 “looks” de câmera, é possível escolher uma apresentação que combine com o interior e o posicionamento de cada estabelecimento. Essa escolha pode ser salva uma única vez nas configurações do projeto, para que todos os vídeos seguintes mantenham uma identidade visual reconhecível, em vez de parecerem clipes aleatórios. Para estabelecimentos que já fotografam os pratos com o celular, também é possível estilizar as próprias fotos: em vez de gerar uma imagem abstrata de um prato, o sistema aplica o estilo visual escolhido a uma foto real tirada na cozinha, sem criar algo parecido, mas diferente do prato que é servido aos clientes.
Se o estabelecimento promove eventos — degustações, música ao vivo, noites temáticas — e os grava com o celular, esses clipes podem ser usados diretamente como cenas, em vez de fotos estáticas. O movimento real e o som do salão transmitem o ambiente com muito mais força do que uma imagem gerada.
Voz e legendas para quem assiste sem som
Uma parcela considerável do público assiste a vídeos nas redes sociais sem som. Por isso, as legendas em vídeos sobre comida não são opcionais: são indispensáveis. O sistema posiciona automaticamente as legendas em uma área segura, levando em conta a interface de cada plataforma (para que elas não fiquem escondidas pelo ícone de curtida no VK ou pelo nome da conta no Instagram). Além disso, o peso da fonte em negrito é preservado na renderização — algo importante para destacar preços em negrito no cardápio.
É possível clonar uma voz para os vídeos uma única vez — por exemplo, a voz do proprietário ou do chef executivo — e usá-la em todos os vídeos. Isso ajuda a criar reconhecimento: com o tempo, os seguidores passam a associar aquela voz ao estabelecimento, como parte de sua identidade visual. Outra opção é escolher uma voz pronta da biblioteca, caso o estabelecimento ainda não tenha uma voz própria como marca. A normalização do texto antes da narração evita que preços e pesos das porções soem estranhos (“350 g”, “a partir de 590 ₽”) — um detalhe que costuma ficar esquisito em narrações feitas por conta própria.
Agenda de promoções e piloto automático em vez de publicações manuais
Para estabelecimentos com promoções regulares — almoço executivo durante a semana, happy hour às terças-feiras —, vale a pena programar as publicações com antecedência, em vez de criar conteúdo manualmente toda vez. O piloto automático do Telematic pega o material pronto e passa por todo o processo — adaptação do texto, geração do vídeo e publicação nas plataformas desejadas — sem precisar de intervenção manual em cada etapa. O processamento em lote é útil quando é necessário preparar de uma só vez uma série de vídeos para o cardápio do mês inteiro. A publicação usa um texto diferente em cada plataforma: uma postagem curta sobre a promoção no canal do estabelecimento no Telegram, uma versão mais detalhada no VK e, no YouTube — se o estabelecimento tiver um canal com conteúdo em formato de vlog —, uma descrição com o cardápio completo.
Também é possível definir uma chamada para ação de acordo com cada objetivo: para uma promoção, “reserve sua mesa pelo link na descrição”; para um novo cardápio, apenas “esperamos por você”, sem o tom insistente de venda que costuma funcionar pior no setor de restaurantes do que em outras áreas. A chamada é configurada uma única vez no projeto ou em um canal específico. Depois, cada novo vídeo aplica automaticamente a formulação desejada, sem que o gerente precise criar uma chamada diferente do zero toda vez.
Biblioteca de mídia e reutilização de materiais
O acervo de um estabelecimento cresce rapidamente: vinhetas com o logotipo, imagens gravadas do salão, fotos de pratos sazonais de meses anteriores. Tudo isso é indexado em uma biblioteca de mídia única e pode ser reutilizado em novos vídeos. Não é necessário filmar novamente o interior a cada anúncio de promoção, se o ambiente não mudou; já a vinheta com o logotipo pode ser criada uma vez e inserida em qualquer vídeo futuro como uma cena comum na linha do tempo. Isso é especialmente prático para redes com várias unidades: a identidade visual e as vinhetas são reutilizadas em todas as filiais, enquanto mudam apenas as informações específicas de cada estabelecimento — endereço, promoção e prato do dia.
O que nosso teste mostrou
Quando testamos o fluxo com textos comuns de promoções — não slogans publicitários, mas exatamente o tipo de texto que um gerente escreve para uma publicação, como “20% de desconto no almoço executivo de segunda a sexta” —, o modo híbrido teve um desempenho claramente melhor do que o texto completo. Isso aconteceu porque o texto original é curto e sem graça, enquanto o vídeo precisa de 15 a 20 segundos de narração para não parecer interrompido. Outra observação: estilizar fotos reais dos pratos funciona muito melhor do que gerar imagens do zero. Para quem vai visitar o estabelecimento depois, é importante reconhecer no vídeo o mesmo prato que será servido, e não uma imagem parecida.
Vídeos para restaurantes e cafés deixam de ser um luxo acessível apenas a grandes redes com orçamento de marketing quando podem ser criados a partir dos mesmos textos que o estabelecimento já publica nas redes sociais toda semana. A única diferença é que agora esse texto se transforma em um vídeo em poucos minutos, em vez de ficar só em uma publicação com foto.
