Caso de uso
Um vídeo que a IA consegue ler inteiro
Modelo que assiste vídeo amostra um quadro por segundo, às cegas. Uma hora vira 3.600 imagens, mais de um milhão de tokens, e a maior parte delas é a mesma tela parada. O documento resolve isso antes de chegar no modelo.
Três coisas antes de mandar para a IA
Um vídeo longo vira vários assuntos. Marque onde cada assunto começa e saia com um documento por assunto — cada um cabe numa conversa, em vez de estourar a janela de contexto de uma vez.
O vocabulário do seu domínio, antes de mandar. Nomes de sistema, siglas e produtos que a transcrição erra são corrigidos de uma vez, e a IA passa a ler o texto certo.
Tarjar antes de colar. O que não pode sair da empresa é coberto na imagem, não escondido: a tarja é queimada, e o que você manda não tem o dado embaixo.
Preparar um vídeo para a IA grátis, e o vídeo não sai do seu computador
A dor
Você tem uma gravação — uma demonstração, uma aula, uma sessão de suporte, um incidente — e quer perguntar coisas sobre ela para um modelo. Mandar o arquivo esbarra em três paredes: o limite de tamanho, o custo de processar quadros repetidos, e o fato de que a maior parte dos modelos simplesmente não aceita vídeo.
E mesmo onde aceita, o modelo perde o que foi dito junto com o que foi mostrado: a fala chega como um bloco de texto solto, sem saber a qual tela ela pertence.
O que sai
Um PDF (ou Markdown, HTML, JSON) que qualquer modelo lê, com a informação já organizada:
- ~60 telas em vez de 3.600, porque as outras eram repetição da mesma imagem
- Cada imagem pareada com a fala daquele trecho, e não com a transcrição inteira jogada no fim
- O instante exato de cada quadro, para o modelo poder citar "aos 04:12" com precisão
- Cabe em qualquer modelo, inclusive nos que recusam vídeo — é um documento, não um arquivo de mídia
- Prompt pronto, escrito para o modelo entender o que ele está lendo antes de responder
- JSON estruturado quando o destino não é um chat e sim o seu próprio código ou o seu agente
Como fazer
- Deixe o cenário em Contexto para IA — é o padrão.
- Arraste o vídeo, ou grave a tela na hora.
- Deixe transcrever e extrair os quadros. Descarte na revisão o que não interessa: cada tela a menos é token a menos.
- Gere o PDF, copie o prompt e leve os dois para a IA que você usa.
O que ele não faz — e é melhor saber antes
Não manda nada para modelo nenhum. Ele monta o material e entrega para você. Quem escolhe o modelo, a conta e a política de uso é você — inclusive um modelo rodando dentro da sua empresa.
Não substitui assistir ao vídeo quando o movimento é o dado. Se o que importa é uma animação, uma transição ou o gesto de alguém, quadros de mudança de cena perdem isso. Para tela de sistema, que é o caso comum, eles pegam tudo o que interessa.
Não resume por conta própria. O resumo é trabalho do modelo; o nosso é fazer o modelo ler a coisa certa.
Preparar um vídeo para a IA Ver os planos
É o cenário mais genérico dos cinco, e o padrão da ferramenta — quando você não sabe qual documento quer, este é o que serve.