Vídeo → PDF → IA
O ChatGPT e o Claude não assistem vídeo. O ClipContext transforma qualquer gravação em um PDF com os frames que importam e a transcrição sincronizada — pronto para anexar na conversa.
Sem cadastro, sem instalação, sem limite de tamanho. O vídeo é processado dentro do seu navegador e não é enviado para servidor nenhum.
Modelos de linguagem leem texto e imagens — não vídeo. Ou eles recusam o arquivo, ou o tamanho inviabiliza o envio. E quando você tira prints na mão, acaba mandando dez telas parecidas e nenhuma do momento que interessava, sem nada que ligue o que aparece ao que estava sendo dito.
Como funciona
Arraste o arquivo para a página. Ele é lido direto do seu disco — 300 MB ou 3 GB dá no mesmo, porque nada é enviado para lugar nenhum.
Transcreva ali mesmo, com o Whisper rodando na sua máquina, ou arraste uma legenda .vtt / .srt que você já tenha.
Revise os frames, descarte os ruins e baixe o documento. Junto vem o texto que explica ao modelo como ler aquele PDF — é isso que muda a qualidade da resposta.
Em vez de fotografar de dez em dez segundos, ele varre o vídeo e guarda os momentos em que a tela realmente muda. Numa apresentação, isso vira um frame por slide em vez de quarenta repetidos.
No PDF, cada frame aparece junto do que é dito naquele trecho, com o instante marcado. O modelo consegue relacionar o que estava na tela com o que estava sendo falado.
Não existe servidor. O vídeo, o áudio e a transcrição são processados no seu navegador — inclusive para gravações confidenciais de reunião.
O texto pronto instrui o modelo a citar os instantes, separar o que viu do que ouviu, e admitir quando a informação não está no documento em vez de inventar.
Privacidade
A maioria das ferramentas de vídeo online pede upload: seu arquivo vai para a máquina de alguém, é processado lá e fica armazenado por um tempo que você não controla. O ClipContext não faz nada disso — a página é um arquivo estático, e todo o processamento acontece no seu navegador.
Não há conta, não há banco de dados, não há rastreamento. A única conexão externa é o download do modelo de transcrição, e apenas se você usar a transcrição automática. Leia a política completa.
Não. Abre no navegador e funciona. Chrome ou Edge atualizados dão a melhor experiência, porque a transcrição automática usa a placa de vídeo por meio do WebGPU.
Não há limite imposto por nós, justamente porque não há upload. O limite prático é a memória do seu computador. Vídeos longos levam mais tempo para varrer, e você pode interromper a varredura quando quiser.
MP4 (H.264), WebM e MOV na maioria dos casos. Formatos que o navegador não sabe decodificar — HEVC e alguns MKV — não abrem; nesses casos é preciso converter para MP4 antes.
Ela usa o Whisper rodando localmente. O modelo rápido é razoável e o mais preciso é bem melhor, às custas de um download maior. Se você já tem uma legenda gerada por outro serviço, pode arrastar o arquivo e pular essa etapa.
A ferramenta como está hoje é gratuita e o código é aberto sob licença MIT. Como não há custo de servidor, não há por que cobrar por ela.
Qualquer modelo que aceite anexos e leia imagens — Claude, ChatGPT e Gemini funcionam. Anexe o PDF e cole o prompt que a ferramenta gera junto.