OKfmt

Extraer subtítulos incrustados de MP4/MKV: Guía de diferencias entre flujos de subtítulos y subtítulos incrustados fijos

Este artículo explica las diferencias entre los subtítulos blandos incrustados y los subtítulos incrustados fijos en un vídeo, admite la extracción de flujos de subtítulos empaquetados y su salida en formatos SRT y VTT, y describe los principios técnicos y las limitaciones del proceso de extracción.

Actualizado 2026-08-11

Diferencias esenciales entre flujos de subtítulos blandos y subtítulos incrustados fijos

Los subtítulos blandos, también denominados flujos de subtítulos empaquetados, se almacenan como pistas de datos binarias independientes dentro de un contenedor de vídeo. No están ligados a los píxeles de los fotogramas, y se pueden volver a codificar, cambiar o extraer por separado.

Los subtítulos incrustados fijos se renderizan en los píxeles de los fotogramas y se graban en los fotogramas del vídeo, se fusionan completamente con los píxeles de la imagen, y no existen como una pista de datos de subtítulos independiente y separable.

Los subtítulos incrustados comunes incluyen ambos tipos. Solo los flujos de subtítulos blandos empaquetados de forma independiente se pueden extraer mediante remultiplexación.

Diferencias en contenedores de subtítulos entre MKV y MP4

Como contenedor multimedia abierto, MKV admite de forma nativa el empaquetado de múltiples pistas de subtítulos de varios tipos. La mayoría de los vídeos con subtítulos incrustados usan el formato MKV.

MP4 usa mov_text como formato estándar de almacenamiento de subtítulos de texto. Algunos archivos MP4 generados por dispositivos almacenan subtítulos en un formato no estándar que no se puede extraer directamente.

Formato de contenedorTipos de pistas de subtítulos compatiblesCompatibilidad con múltiples pistas de subtítulos
MKVMúltiples tipos incluyendo SSA/ASS, SRT, VobSubAdmite empaquetar múltiples pistas de subtítulos en diferentes idiomas
MP4Solo pistas de texto estándar mov_text, compatibilidad limitada con subtítulos de imagenSolo admite una única pista de subtítulos de texto

Principio técnico de la extracción mediante remultiplexación

El extractor de subtítulos de vídeo usa el parámetro -c:s copy de FFmpeg para realizar la extracción. Este parámetro no vuelve a codificar el flujo de subtítulos, y copia directamente los datos de subtítulos originales para generar el archivo de destino.

Todo el proceso de extracción solo copia los datos de subtítulos empaquetados, y no requiere decodificar ni volver a codificar todo el vídeo. Extraer subtítulos de un vídeo de 1GB solo tarda unos segundos.

El proceso de extracción no modifica el archivo de vídeo original, ni consume recursos excesivos del procesador. El flujo de trabajo solo lee los datos de la pista de subtítulos del vídeo original y genera un nuevo archivo.

Alcance de la herramienta de extracción

Este extractor de subtítulos de vídeo no admite el reconocimiento por OCR para subtítulos incrustados fijos. El reconocimiento de subtítulos incrustados fijos requiere entrenamiento de modelos de IA dedicado y recursos informáticos, y pertenece a la categoría de servicios independientes de OCR. Esta herramienta no proporciona esta función.

Si el vídeo cargado no contiene un flujo de subtítulos independiente separable, la herramienta devolverá un mensaje de error claro que informa al usuario que no se detectó ninguna pista de subtítulos extraíble en el vídeo actual.

Después de la extracción, los usuarios pueden elegir libremente la salida en dos formatos de subtítulos comunes, SRT o VTT, para cumplir con diferentes requisitos de reproducción y edición. Ambos formatos son estándares públicos abiertos.

Herramientas relacionadas

Preguntas frecuentes

¿Por qué no se pueden extraer los subtítulos incrustados de mi MP4?

Hay dos causas posibles: primero, los subtítulos están incrustados fijos grabados en el fotograma, y no existe un flujo de subtítulos extraíble independiente; segundo, la pista de subtítulos del MP4 tiene un formato no estándar que no puede ser reconocido por la herramienta. Puede consultar el mensaje de error específico devuelto por la herramienta para obtener más detalles.

¿Por qué los subtítulos extraídos están en formato idx+sub?

Esto se debe a que el vídeo original empaqueta subtítulos VobSub basados en imágenes. Este formato es inherentemente un subtítulo de imagen, por lo que la herramienta copia directamente los datos originales para la salida sin realizar conversiones de formato adicionales. Si necesita convertirlo a un formato de texto, puede usar una herramienta de OCR dedicada para el procesamiento. Los precios están sujetos al anuncio público actual en el sitio web oficial.

¿Puedo extraer múltiples pistas de subtítulos de MKV?

La herramienta admite reconocer todas las pistas de subtítulos independientes empaquetadas en MKV. Puede seleccionar la pista de subtítulos especificada para realizar la extracción. Cada pista de subtítulos debe extraerse por separado, y la operación genera un archivo de subtítulos individual correspondiente.