Vídeo
Legendas
O Whisper roda aqui, no seu navegador, e escreve as legendas a partir do próprio áudio do vídeo. Nada é enviado e nenhuma conta é necessária.
Legende qualquer vídeo, sem enviá-lo para lugar nenhum.
O OpenSubs transcreve a fala, traduz, estiliza e queima na imagem — tudo dentro do seu navegador. O arquivo de vídeo nunca sai da sua máquina, porque não há para onde ele ir.
Sem conta. Sem upload. Sem marca d’água. Código aberto.
Procurando um arquivo de legenda pronto para baixar? Veja onde encontrar legendas.
O Whisper roda aqui, no seu navegador, e escreve as legendas a partir do próprio áudio do vídeo. Nada é enviado e nenhuma conta é necessária.
Os quatro passos acima, com mais detalhe. Todos rodam na sua própria máquina, a menos que você escolha explicitamente outra coisa.
O Whisper roda no seu navegador, na GPU quando a sua máquina tem uma. Escolha um modelo entre 40 MB e 250 MB; ele é baixado uma vez e depois fica em cache. Só o modelo é buscado — o áudio permanece onde está.
A tradução embutida do Chrome roda no seu aparelho sem custo. Traga sua própria chave da Claude, da OpenAI ou da DeepL para resultados melhores em diálogos longos, ou use a nossa e pague com créditos. Como funciona a tradução de legendas
Doze presets, de legendas limpas de TV a estilos sociais marcantes, cada um pré-visualizado sobre o seu próprio material. As palavras podem crescer e brilhar conforme são ditas.
Exporte um MP4 pronto com as legendas nos pixels, codificado no navegador com WebCodecs. Ou pegue o .srt, o .vtt ou o .ass e use em outro lugar.
A transcrição é boa e não é perfeita. Um nome, um jargão, uma palavra engolida por um caminhão passando — são essas as linhas que você vai querer mexer, e é para elas que isto foi feito.
Cada cue é uma caixa de texto simples. Reescreva o que diz, ou aperte enter dentro dela para dividir a linha em duas, e as legendas sobre o seu vídeo se atualizam junto.
O horário ao lado de cada cue é um botão. Clique e o vídeo pula para aquele momento, o que é mais rápido do que procurar e costuma ser o único jeito de saber o que foi dito de verdade.
Abra um .srt ou .vtt de um tradutor, de um editor ou de outra ferramenta e edite aqui. Se os caracteres chegarem embaralhados, escolha a codificação de texto do arquivo e ele é lido de novo.
Os tempos são fixos. Você pode reescrever o que um cue diz, mas não quando começa nem quanto dura, e cues não podem ser adicionados, apagados ou fundidos. Um arquivo fora de sincronia com o vídeo precisa de outra ferramenta.
A página acima não precisa de nada instalado. Estes precisam, e em troca fazem coisas que uma página não faz — legendar um vídeo que já está tocando em uma aba, ou queimar um arquivo de duas horas sem um navegador no caminho. Tudo é o mesmo motor em Rust, então a saída é idêntica.
Legendas sobre o que estiver tocando na aba, geradas enquanto toca. Chrome, Edge e Firefox. Ainda não está nas lojas — a versão é um .zip que você carrega.
macOS, Windows e Linux, para arquivos longos e lotes. Ele usa o ffmpeg para queimar, então precisa de um compilado com o filtro ass — brew install ffmpeg-full no macOS. As versões não são assinadas.
Um comando por arquivo, para scripts e para CI. Mesmo motor, mesmos presets, mesma saída. Compile a partir do código; ele exige o mesmo ffmpeg que o app para computador.
O motor, o app web, a extensão, o app para computador e a linha de comando são um repositório só. Leia o que roda na sua máquina em vez de acreditar nesta página.
As versões atuais são candidatas a lançamento. Estão completas e testadas; o número da versão só diz que ainda não passaram por um lançamento estável.
A maioria das ferramentas de legenda envia seu vídeo, processa e promete apagar. O OpenSubs foi feito ao contrário.
Grátis e de código aberto. O código que toca no seu vídeo está no GitHub sob AGPL-3.0 — então o parágrafo acima é algo que você pode conferir, não algo em que precisa acreditar.
Ele é lido por uma object URL e decodificado pelo seu navegador. Não existe endpoint de upload neste produto, então vazamento do material não é algo que precisemos prometer evitar — simplesmente não é possível.
Texto de legenda, se você escolher um tradutor na nuvem. Ou o trecho de áudio que recortou, se escolher transcrição na nuvem. As opções no aparelho não enviam nada, e são o padrão.
Traga sua própria chave de API: ela é usada do seu navegador e nunca é guardada, nunca é enviada para nós e nunca é gravada em disco.
O que é quase tudo. Só cobramos onde gastamos dinheiro por você, e dizemos o preço antes de você apertar o botão.
Não, e não porque prometemos: não existe endpoint de upload no produto. O OpenSubs lê o arquivo direto no seu navegador, e transcrição, estilo, tradução no aparelho e queima rodam todos na sua própria máquina. Você pode conferir em vez de acreditar — abra a aba de rede e legende um vídeo: depois que a página e o modelo de fala carregam, não há requisições. A única coisa que pode sair da sua máquina é texto de legenda ou áudio, e só se você escolher uma opção na nuvem.
Não. Uma chave de API que você digita para usar seu próprio provedor fica apenas na memória da página. Ela nunca é gravada em localStorage, sessionStorage, IndexedDB ou cookies, e o seu navegador a envia direto ao provedor escolhido — OpenAI ou outro servidor compatível, Anthropic ou DeepL — sem passar por servidores do OpenSubs. Recarregar ou fechar a aba apaga a chave, então você digita de novo da próxima vez.
Não. Transcrição, tradução no dispositivo, estilo, recorte, queima e todas as exportações funcionam sem conta e sem login. Uma conta só é necessária se você quiser pagar pela tradução na nuvem no nosso backend.
Solte o vídeo nesta página e gere legendas a partir do áudio. O Whisper roda na sua máquina, então nada é enviado e nada é cobrado. Corrija qualquer linha editando o texto, escolha um estilo e exporte as legendas como .srt, .vtt ou .ass, ou queime num MP4. Sem conta e sem marca d’água.
Ele roda o Whisper da OpenAI localmente — pesos ONNX movidos pelo transformers.js, na WebGPU quando a máquina tem e no WebAssembly caso contrário. São oferecidos três tamanhos de modelo: Tiny (só inglês, cerca de 40 MB), Base (cerca de 80 MB) e Small (cerca de 250 MB). O modelo é baixado uma vez e depois fica em cache no navegador; só o modelo é buscado, nunca o áudio. O idioma falado é detectado a cada quatro segundos, e não uma vez por arquivo, então um vídeo que alterna entre dois idiomas sai como um único arquivo de legendas com os dois.
Sim. As legendas são desenhadas pelo libass — o mesmo renderizador que o ffmpeg usa — compilado para WebAssembly, e codificadas de volta em um MP4 com WebCodecs. O que você vê na pré-visualização é o que acaba nos pixels, e o áudio é copiado intacto.
Tudo o que roda na sua máquina é grátis: transcrição, tradução no dispositivo, todos os 12 estilos de legenda, destaque palavra por palavra, recorte, queima em MP4 e todos os formatos de exportação. Não há marca d’água, nem limite de tamanho de arquivo, nem fila — nada disso existe aqui porque não há servidor pagando pelo trabalho. A única opção paga é a tradução no nosso próprio backend, a US$ 5 por 1.000 créditos, com o preço do trabalho mostrado antes de rodar e sem custo se falhar.
Não. Um MP4 queimado carrega apenas as legendas que você escolheu, e os arquivos .srt, .vtt e .ass exportados são arquivos de legenda simples. Nada é acrescentado, porque o trabalho roda no seu navegador e não num servidor que alguém precise pagar.
Vinte, incluindo chinês simplificado e tradicional, japonês, coreano, espanhol, português, francês, alemão, italiano, russo, árabe, híndi, indonésio, tailandês, vietnamita, turco, polonês, holandês e ucraniano. As fontes para escritas não latinas vêm juntas, então legendas em chinês e em árabe queimam corretamente em vez de virar quadrados vazios.
Depois da primeira visita, em boa medida sim. O modelo de fala fica em cache no navegador após o primeiro download, e tudo, exceto a tradução na nuvem, roda localmente. Traduzir no dispositivo usa os modelos de tradução integrados do Chrome, que também são baixados uma única vez.
Sim, sob a AGPL-3.0. O mesmo motor — segmentação de legendas, quebra de linha, limites de velocidade de leitura, os presets de estilo, o escritor de ASS — é compilado para WebAssembly no navegador e para um binário nativo no app para computador e na ferramenta de linha de comando, então os três produzem saída idêntica.
Solte o vídeo nesta página. A fala é escrita na aba, você corrige a linha que saiu errada, escolhe um estilo e então queima as legendas na imagem ou exporta como arquivo para mandar junto. Nada é enviado, e não há conta nem marca d’água. A versão longa, com as duas formas pelas quais uma plataforma aceita legendas, está em como colocar legenda em vídeo.
Sim, e é assim que normalmente se sai com um. Depois que as legendas estão escritas e corrigidas, exporte .srt, .vtt ou .ass. Um .srt é um arquivo de texto simples com um número de linha, um horário de início e fim, e as palavras — qualquer coisa que aceite legendas lê isso.
Aqui não. O texto do cue é editável; o início e o fim não são, e cues não podem ser adicionados, apagados ou fundidos. Se um arquivo precisa ser retemporizado em vez de reescrito, a ferramenta certa é um editor de legendas dedicado, e esta não é.
Para que servem os formatos, qual saída uma dada plataforma aceita, e como escrever legendas que alguém consiga acompanhar.
Captions trazem também os sons, não só as palavras; legendas passam a fala para outro idioma. Qual dos dois estão pedindo de você.
O que muda de fato entre os dois formatos, com um exemplo, e como converter um arquivo aqui sem enviar nada.
A mesma legenda escrita nos três, e qual deles cada player e cada plataforma aceita.
Três jeitos de fazer — digitar você mesmo, deixar a plataforma tentar, ou gerar na sua própria máquina — e o que cada um custa.
Deixar num .srt separado ou desenhar na imagem. O que cada escolha significa para os players e para editar depois.
Nenhuma das duas aceita arquivo de legenda, então o texto precisa estar na imagem. Como gerar, estilizar e queimar.
Legendas em estilo karaokê que acendem palavra por palavra: quando ajudam e como fazê-las com o seu próprio vídeo.