KI-Untertitel
Beam erzeugt aus einem aktivierten Audioclip lokale Sprachuntertitel. Das ausgewählte Whisper-Modell wird heruntergeladen, die Transkription erfolgt auf dem Gerät und bearbeitbare Untertitelclips werden in der Timeline erstellt.
Untertitel-Panel

Screenshot pendingAdd the image at:
website/docs/public/screenshots/editor/captions-panel.webpAudioquellen
| Quelle | Wann sie erscheint | Auswahlregel |
|---|---|---|
| Systemaudio | Ein aktivierter Clip mit der Rolle System ist vorhanden. | Wird als Systemaudio erkannt. |
| Mikrofon | Ein aktivierter Clip mit der Rolle Mikrofon ist vorhanden. | Wird als Mikrofon erkannt. |
| Importiertes Audio | Ein aktivierter importierter Audioclip ist vorhanden. | Verwendet den Clipnamen. |
| Doppelte Medien-URL | Zwei aktivierte Clips verweisen auf dieselbe Audio-URL. | Nur die erste Quelle wird angeboten. |
| Keine verwendbare Quelle | Kein aktivierter Audioclip besitzt eine lesbare Asset-URL. | „Erzeugen“ bleibt nicht verfügbar. |
Whisper-Modelle
| Modell | Sprachen | Leistungshinweis |
|---|---|---|
| Tiny | Mehrsprachig | Standardmodell. |
| Tiny .en | Englisch | Nur-Englisch-Modell. |
| Base | Mehrsprachig | Kein zusätzlicher Hinweis. |
| Base .en | Englisch | Nur-Englisch-Modell. |
| Small | Mehrsprachig | Ohne WebGPU möglicherweise langsam. |
| Small .en | Englisch | Ohne WebGPU möglicherweise langsam. |
| Medium | Mehrsprachig | Großer Download; WebGPU wird empfohlen. |
| Medium .en | Englisch | Großer Download; WebGPU wird empfohlen. |
| Large v3 | Mehrsprachig | Sehr groß und ohne WebGPU langsam. |
Modell herunterladen und löschen
| Status oder Aktion | Verhalten |
|---|---|
| Fehlt | „Modell herunterladen“ ist für das ausgewählte Modell verfügbar. |
| Wird heruntergeladen | Beam zeigt die heruntergeladenen und die gesamten Bytes mit einem Fortschrittsbalken an. |
| Bereit | Ein Häkchen kennzeichnet das installierte Modell und „Modell löschen“ wird verfügbar. |
| Modell löschen | Während des Herunterladens, Löschens oder Transkribierens nicht verfügbar. |
| Downloadfehler | Der Fehler wird angezeigt und kann zur Diagnose kopiert werden. |
Erzeugen und erneut erzeugen
- Wähle eine der aktivierten Audioquellen aus.
- Wähle ein Whisper-Modell aus und lade es herunter, falls es noch nicht bereit ist.
- Wähle „Untertitel erzeugen“. Beam dekodiert die Quelle, wandelt sie in Mono-Audio mit 16 kHz um und begrenzt sie auf die Dauer der Timeline.
- Teilergebnisse der Transkription aktualisieren die Komposition, während die Verarbeitung fortgesetzt wird.
- Nach Abschluss wird der erste erzeugte Untertitel zur Bearbeitung ausgewählt.
| Verhalten | Regel |
|---|---|
| Satzgruppierung | Beendet eine Untertitelphrase an einem Satzzeichen oder nach 12 Wörtern. |
| Minimale Dauer eines erzeugten Clips | 40 ms. |
| Erneut erzeugen | Ersetzt vorhandene KI-Untertitel und erhält manuelle Untertitel. |
| Abbrechen | Stoppt das Laden des Modells oder die Transkription. |
| Panel schließen | Bricht die aktive Transkription ab. |
| Diagnose | Zeigt die verstrichene Zeit an und stellt nach der Verarbeitung einen kopierbaren Transkriptionsbericht bereit. |
Lokale Transkription
Whisper läuft auf dem Gerät. Für die Untertitelerzeugung sind weder ein Cloud-Upload noch ein API-Schlüssel erforderlich.
Erzeugte Untertitel bearbeiten
Erzeugte Untertitel sind normale bearbeitbare Untertitelclips, die als KI-erzeugt gekennzeichnet sind. Text, Timing und visueller Stil können nach der Erzeugung im Clip-Panel und in der Timeline angepasst werden.