Legendas de IA
Beam gera legendas de fala localmente a partir de um clipe de áudio habilitado. Ele baixa o modelo Whisper selecionado, transcreve no dispositivo e cria clipes de legenda editáveis na linha do tempo.
Painel de legendas

Screenshot pendingAdd the image at:
website/docs/public/screenshots/editor/captions-panel.webpFontes de áudio
| Fonte | Quando aparece | Regra de seleção |
|---|---|---|
| Áudio do sistema | Existe um clipe habilitado com a função Sistema. | Identificado como Áudio do Sistema. |
| Microfone | Existe um clipe habilitado com a função Microfone. | Identificado como Microfone. |
| Áudio importado | Existe um clipe de áudio importado habilitado. | Usa o nome do clipe. |
| URL de mídia duplicado | Dois clipes habilitados fazem referência ao mesmo URL de áudio. | Apenas a primeira fonte é oferecida. |
| Nenhuma fonte utilizável | Nenhum clipe de áudio ativado possui um URL de recurso legível. | Gerar permanece indisponível. |
Modelos de sussurro
| Modelo | Idiomas | Orientação de desempenho |
|---|---|---|
| Tiny | Multilíngue | Modelo padrão. |
| Tiny.en | Inglês | Modelo somente em inglês. |
| Base | Multilíngue | Nenhum aviso adicional. |
| Base.en | Inglês | Modelo somente em inglês. |
| Small | Multilíngue | Pode ser lento sem WebGPU. |
| Small.en | Inglês | Pode ser lento sem WebGPU. |
| Medium | Multilíngue | Grande download; WebGPU recomendado. |
| Medium.en | Inglês | Grande download; WebGPU recomendado. |
| Large v3 | Multilíngue | Muito grande e lento sem WebGPU. |
Download e exclusão de modelo
| Estado ou ação | Comportamento |
|---|---|
| Desaparecido | Baixar modelo está disponível para o modelo selecionado. |
| Baixando | Beam relatórios baixados e total de bytes com uma barra de progresso. |
| Pronto | Uma marca de seleção identifica o modelo instalado e Excluir modelo fica disponível. |
| Excluir modelo | Indisponível durante download, exclusão ou transcrição. |
| Erro de download | O erro é exibido e pode ser copiado para diagnóstico. |
Gerar e regenerar
- Escolha uma das fontes de áudio habilitadas.
- Escolha e baixe um modelo Whisper se ele não estiver pronto.
- Selecione Gerar legendas. Beam decodifica a fonte, converte-a em áudio mono de 16 kHz e limita-a à duração da linha do tempo.
- Os resultados parciais da transcrição atualizam a composição enquanto o processamento continua.
- A execução concluída seleciona a primeira legenda gerada para edição.
| Comportamento | Regra |
|---|---|
| Agrupamento de frases | Termina uma frase de legenda com pontuação ou após 12 palavras. |
| Duração mínima do clipe gerado | 40 ms. |
| Regenerar | Substitui legendas existentes geradas por IA e preserva legendas manuais. |
| Cancelar | Interrompe o carregamento ou a transcrição do modelo. |
| Fechar painel | Cancela a execução de transcrição ativa. |
| Diagnóstico | Relata o tempo decorrido e expõe um relatório de transcrição copiável após o processamento. |
Transcrição local
O Whisper é executado no dispositivo. A geração de legenda não requer upload na nuvem ou chave de API.
Editar legendas geradas
As legendas geradas são clipes de legenda editáveis regulares marcados como gerados por IA. Seu texto, tempo e estilo visual podem ser ajustados através do painel Clipe e da linha do tempo após a geração.