Escolhemos um produto menor — e melhor
Por que aposentamos três experimentos de IA de alta variabilidade e reconstruímos o CaptionBolt em torno de uma tarefa mais simples: finalizar um vídeo já escolhido com legendas que você pode revisar e aprovar.

Kevin Li

No fim de junho, publicamos o marco de 300 estilos de legenda. Era um número gratificante. Também foi quando tivemos de admitir que o CaptionBolt estava ficando mais difícil de explicar.
Começamos com uma promessa pequena: envie um vídeo, adicione legendas e receba um arquivo finalizado. Depois continuamos acrescentando ideias ao redor dela. Algumas eram experimentos úteis. Outras ficavam bem no menu. Juntas, deixaram o produto mais amplo sem tornar o resultado principal mais fácil.
Este texto registra a decisão que tomamos em julho para corrigir esse desvio.
Mais recursos, menos clareza
Ao desenvolver software, adicionar um recurso parece progresso. Surge um novo card no Dashboard, uma rota funciona na demonstração e o produto faz algo que não fazia na semana anterior.
O custo aparece menos. Cada fluxo exige estados vazios, validação, progresso, novas tentativas, regras de cobrança, respostas de suporte e recuperação. Se a IA toma uma decisão criativa, o usuário também precisa revisá-la e voltar atrás quando ela erra.
Já não estávamos melhorando um único caminho. Estávamos mantendo vários produtos que compartilhavam uma conta.

Três botões eram, na verdade, três produtos
Seleção automática de clipes, reenquadramento de quem fala e dublagem parecem recursos próximos. Para a engenharia, são três problemas de qualidade diferentes.
Escolher um clipe exige julgar se o trecho se sustenta fora do contexto. Reenquadrar exige decidir qual pessoa ou objeto importa em cada cena. Dublar envolve idioma, voz, tempo e a diferença entre uma frase traduzida e a atuação original.
Cada resultado pode ser tecnicamente válido e continuar inutilizável. Um clipe pode começar uma frase tarde demais. O corte pode seguir o rosto errado. Uma fala dublada pode caber no tempo e ainda soar errada. A fila concluir não resolve isso.
Poderíamos manter os três botões e chamar o produto de mais poderoso. Mas isso significaria construir três sistemas sérios de revisão enquanto o fluxo de legendas ainda precisava de atenção.
O trabalho que continuava aparecendo
O padrão útil era muito mais simples. As pessoas já tinham o vídeo que queriam publicar. A gravação estava pronta e o trecho escolhido. Faltava o acabamento repetitivo:
- obter uma transcrição legível;
- transformá-la em legendas adequadas ao conteúdo;
- corrigir palavras e quebras;
- preservar o enquadramento original ou mudá-lo de propósito;
- remover uma borda ou trecho quando necessário;
- exportar um resultado igual à prévia.
É uma tarefa mais estreita do que “criar conteúdo curto com IA”. Também é uma tarefa que conseguimos descrever com honestidade e melhorar como um sistema conectado.

O que removemos
AI Viral Clips, AI Reframe e AI Dubbing foram removidos dos fluxos atuais do produto SaaS e da API em 6 de julho de 2026. Eles não estão disponíveis para novos uploads ou projetos.
Mantivemos uma rota de arquivo bem limitada para resultados históricos bem-sucedidos elegíveis. Ela é somente leitura e não restaura criação, edição, novas tentativas, filas ou workers dos produtos aposentados.
Não escondemos a navegação para preparar um relançamento. Removemos os caminhos ativos porque desviavam trabalho de engenharia do resultado que os usuários já precisavam que fosse confiável.
AI Transcripts ficou, mas com papel mais claro. Uma transcrição tem valor sozinha e também apoia o fluxo de legendas. Não precisa fingir ser outro produto de geração de vídeo.
O que mudou até 23 de julho
Com um escopo menor, a experiência padrão ficou mais fácil de definir.
Novos projetos de AI Captions preservam a proporção original. Resize e a revisão em Clip são opcionais. É possível corrigir o texto, escolher um estilo e exportar sem explorar antes todas as ferramentas do Editor.
AI Transcripts ganhou um espaço próprio para edição, busca e substituição, navegação pelo áudio e os formatos disponíveis no plano. O trabalho de transcrição não precisa passar pelo Editor de vídeo nem pela fila de renderização.
Também investimos no que aparece menos: salvamento automático, Undo, status, recuperação e a diferença entre editar texto e remover mídia real.

Escopo menor, padrão mais alto
Escolher um produto menor não encurtou a lista de engenharia. Tornou o padrão mais claro.
Se o CaptionBolt é uma ferramenta de acabamento centrada em legendas, um upload que não se recupera é falha de produto. Legendas que saem de sincronia depois de um corte também. O mesmo vale para uma prévia diferente da exportação ou um recorte que o usuário não pediu.
Esses problemas rendem menos anúncio do que um novo modo de IA. Para quem está tentando terminar um vídeo hoje, importam muito mais.
Nossa direção é direta: o CaptionBolt ajuda criadores, profissionais de marketing e equipes pequenas a transformar material já gravado e escolhido em um vídeo polido com legendas, pronto para revisão e exportação. A IA faz a primeira versão. A pessoa decide o que publicar.
É uma promessa menor do que aquela para a qual estávamos derivando. Também é um produto muito melhor para construir.
Veja o fluxo em Legendas para vídeo, teste o gerador automático de legendas ou continue com o que reconstruímos depois de escolher o foco.


