Subtítulos con IA
Beam genera subtítulos de voz localmente a partir de un clip de audio activado. Descarga el modelo Whisper seleccionado, transcribe en el dispositivo y crea clips de subtítulos editables en la línea de tiempo.
Panel Captions

Screenshot pendingAdd the image at:
website/docs/public/screenshots/editor/captions-panel.webpFuentes de audio
| Fuente | Cuándo aparece | Regla de selección |
|---|---|---|
| System audio | Existe un clip activado con el rol System. | Se identifica como System Audio. |
| Microphone | Existe un clip activado con el rol Microphone. | Se identifica como Microphone. |
| Imported audio | Existe un clip de audio importado activado. | Utiliza el nombre del clip. |
| URL de contenido multimedia duplicada | Dos clips activados hacen referencia a la misma URL de audio. | Solo se ofrece la primera fuente. |
| Ninguna fuente utilizable | Ningún clip de audio activado tiene una URL de recurso legible. | Generate sigue sin estar disponible. |
Modelos Whisper
| Modelo | Idiomas | Orientación sobre el rendimiento |
|---|---|---|
| Tiny | Multilingüe | Modelo predeterminado. |
| Tiny .en | Inglés | Modelo exclusivo para inglés. |
| Base | Multilingüe | No hay ninguna advertencia adicional. |
| Base .en | Inglés | Modelo exclusivo para inglés. |
| Small | Multilingüe | Puede ser lento sin WebGPU. |
| Small .en | Inglés | Puede ser lento sin WebGPU. |
| Medium | Multilingüe | Descarga grande; se recomienda WebGPU. |
| Medium .en | Inglés | Descarga grande; se recomienda WebGPU. |
| Large v3 | Multilingüe | Muy grande y lento sin WebGPU. |
Descarga y eliminación de modelos
| Estado o acción | Comportamiento |
|---|---|
| Missing | Download Model está disponible para el modelo seleccionado. |
| Downloading | Beam muestra los bytes descargados y el total mediante una barra de progreso. |
| Ready | Una marca de verificación identifica el modelo instalado y Delete Model pasa a estar disponible. |
| Delete Model | No disponible durante la descarga, la eliminación o la transcripción. |
| Download error | El error se muestra y se puede copiar para el diagnóstico. |
Generar y regenerar
- Elige una de las fuentes de audio activadas.
- Elige y descarga un modelo Whisper si aún no está listo.
- Selecciona Generate Captions. Beam decodifica la fuente, la convierte en audio mono de 16 kHz y la limita a la duración de la línea de tiempo.
- Los resultados parciales de la transcripción actualizan la composición mientras el procesamiento continúa.
- Cuando termina, se selecciona el primer subtítulo generado para editarlo.
| Comportamiento | Regla |
|---|---|
| Agrupación de frases | La frase de subtítulos termina al encontrar un signo de puntuación o después de 12 palabras. |
| Duración mínima del clip generado | 40 ms. |
| Regenerate | Reemplaza los subtítulos generados por IA existentes y conserva los subtítulos manuales. |
| Cancel | Detiene la carga del modelo o la transcripción. |
| Close panel | Cancela la ejecución de transcripción activa. |
| Diagnostics | Informa del tiempo transcurrido y muestra un informe de transcripción que se puede copiar después del procesamiento. |
Transcripción local
Whisper se ejecuta en el dispositivo. La generación de subtítulos no requiere subir contenido a la nube ni utilizar una clave de API.
Editar subtítulos generados
Los subtítulos generados son clips de subtítulos editables normales marcados como generados por IA. Después de generarlos, su texto, temporización y estilo visual se pueden ajustar mediante el panel Clip y la línea de tiempo.