Sottotitoli AI
Beam genera localmente i sottotitoli parlati da una clip audio abilitata. Scarica il modello Whisper selezionato, esegue la trascrizione sul dispositivo e crea clip di sottotitoli modificabili nella timeline.
Pannello Sottotitoli

Screenshot pendingAdd the image at:
website/docs/public/screenshots/editor/captions-panel.webpSorgenti audio
| Sorgente | Quando appare | Regola di selezione |
|---|---|---|
| Audio di sistema | Esiste una clip abilitata con ruolo System. | Identificata come System Audio. |
| Microfono | Esiste una clip abilitata con ruolo Microphone. | Identificata come Microphone. |
| Audio importato | Esiste una clip audio importata abilitata. | Usa il nome della clip. |
| URL multimediale duplicato | Due clip abilitate fanno riferimento allo stesso URL audio. | Viene proposta solo la prima sorgente. |
| Nessuna sorgente utilizzabile | Nessuna clip audio abilitata ha un URL dell'asset leggibile. | Genera resta non disponibile. |
Modelli Whisper
| Modello | Lingue | Indicazioni sulle prestazioni |
|---|---|---|
| Tiny | Multilingue | Modello predefinito. |
| Tiny .en | Inglese | Modello solo inglese. |
| Base | Multilingue | Nessun avviso aggiuntivo. |
| Base .en | Inglese | Modello solo inglese. |
| Small | Multilingue | Può essere lento senza WebGPU. |
| Small .en | Inglese | Può essere lento senza WebGPU. |
| Medium | Multilingue | Download voluminoso; WebGPU consigliato. |
| Medium .en | Inglese | Download voluminoso; WebGPU consigliato. |
| Large v3 | Multilingue | Molto grande e lento senza WebGPU. |
Download ed eliminazione del modello
| Stato o azione | Comportamento |
|---|---|
| Mancante | Scarica modello è disponibile per il modello selezionato. |
| Download in corso | Beam mostra i byte scaricati e il totale con una barra di avanzamento. |
| Pronto | Un segno di spunta identifica il modello installato e Elimina modello diventa disponibile. |
| Elimina modello | Non disponibile durante il download, l'eliminazione o la trascrizione. |
| Errore di download | L'errore viene mostrato e può essere copiato per la diagnostica. |
Generazione e rigenerazione
- Scegli una delle sorgenti audio abilitate.
- Scegli e scarica un modello Whisper se non è pronto.
- Seleziona Genera sottotitoli. Beam decodifica la sorgente, la converte in audio mono a 16 kHz e la limita alla durata della timeline.
- I risultati parziali della trascrizione aggiornano la composizione mentre l'elaborazione continua.
- Al termine dell'esecuzione viene selezionato il primo sottotitolo generato per la modifica.
| Comportamento | Regola |
|---|---|
| Raggruppamento delle frasi | Termina una frase di sottotitoli con la punteggiatura o dopo 12 parole. |
| Durata minima della clip generata | 40 ms. |
| Rigenera | Sostituisce i sottotitoli generati dall'AI esistenti e conserva quelli manuali. |
| Annulla | Interrompe il caricamento del modello o la trascrizione. |
| Chiudi pannello | Annulla l'esecuzione di trascrizione attiva. |
| Diagnostica | Riporta il tempo trascorso ed espone un rapporto di trascrizione copiabile dopo l'elaborazione. |
Trascrizione locale
Whisper viene eseguito sul dispositivo. La generazione dei sottotitoli non richiede un caricamento nel cloud né una chiave API.
Modifica dei sottotitoli generati
I sottotitoli generati sono normali clip di sottotitoli modificabili contrassegnate come generate dall'AI. Dopo la generazione, testo, tempi e stile visivo possono essere modificati tramite il pannello Clip e la timeline.