OKfmt

Extraire les sous-titres intégrés de MP4/MKV : Guide sur les différences entre les flux de sous-titres et les sous-titres codés en dur

Cet article explique les différences entre les sous-titres souples intégrés et les sous-titres codés en dur dans une vidéo, prend en charge l'extraction de flux de sous-titres empaquetés et leur sortie aux formats SRT et VTT, et décrit les principes techniques et les limites du processus d'extraction.

Mis à jour le 2026-08-11

Différences essentielles entre les flux de sous-titres souples et les sous-titres codés en dur

Les sous-titres souples, aussi appelés flux de sous-titres empaquetés, sont stockés sous forme de pistes de données binaires indépendantes dans un conteneur vidéo. Ils ne sont pas liés aux pixels des images, et peuvent être réencodés, activés/désactivés ou extraits séparément.

Les sous-titres codés en dur sont rendus dans les pixels des images et gravés dans les trames vidéo, entièrement fusionnés avec les pixels de l'image, et n'existent pas sous forme de piste de données de sous-titres séparée et extractible.

Les sous-titres intégrés courants comprennent ces deux types. Seuls les flux de sous-titres souples empaquetés indépendants peuvent être extraits par remuxage.

Différences de conteneurs de sous-titres entre MKV et MP4

En tant que conteneur multimédia ouvert, MKV prend en charge nativement l'empaquetage de plusieurs pistes de sous-titres de types multiples. La plupart des vidéos avec sous-titres intégrés utilisent le format MKV.

MP4 utilise mov_text comme format standard de stockage de sous-titres texte. Certains fichiers MP4 générés par des appareils stockent les sous-titres dans un format non standard qui ne peut pas être extrait directement.

Format de conteneurTypes de pistes de sous-titres pris en chargePrise en charge de plusieurs pistes de sous-titres
MKVPlusieurs types dont SSA/ASS, SRT, VobSubPrend en charge l'empaquetage de plusieurs pistes de sous-titres dans différentes langues
MP4Uniquement les pistes de texte standard mov_text, prise en charge limitée des sous-titres imagePrend en charge seulement une seule piste de sous-titres texte

Principe technique de l'extraction par remuxage

L'extracteur de sous-titres vidéo utilise le paramètre -c:s copy de FFmpeg pour effectuer l'extraction. Ce paramètre ne réencode pas le flux de sous-titres, et copie directement les données de sous-titres d'origine pour générer le fichier cible.

L'ensemble du processus d'extraction ne fait que copier les données de sous-titres empaquetées, et ne nécessite pas de décoder et réencoder la vidéo entière. Extraire les sous-titres d'une vidéo de 1GB ne prend que quelques secondes.

Le processus d'extraction ne modifie pas le fichier vidéo d'origine, et ne consomme pas trop de ressources processeur. Le flux de travail ne fait que lire les données de la piste de sous-titres depuis la vidéo d'origine et génère un nouveau fichier.

Portée de l'outil d'extraction

Cet extracteur de sous-titres vidéo ne prend pas en charge la reconnaissance OCR pour les sous-titres codés en dur. La reconnaissance de sous-titres codés en dur nécessite un entraînement de modèle IA dédié et des ressources de calcul, et appartient à la catégorie des services OCR indépendants. Cet outil ne fournit pas cette fonction.

Si la vidéo téléchargée ne contient pas de flux de sous-titres indépendant extractible, l'outil renverra un message d'erreur clair informant l'utilisateur qu'aucune piste de sous-titres extractible n'a été détectée dans la vidéo actuelle.

Après l'extraction, les utilisateurs peuvent choisir librement la sortie dans deux formats de sous-titres courants, SRT ou VTT, pour répondre à différentes exigences de lecture et d'édition. Les deux formats sont des normes publiques ouvertes.

Questions fréquentes

Pourquoi les sous-titres intégrés ne peuvent-ils pas être extraits de mon MP4 ?

Deux causes sont possibles : d'une part, les sous-titres sont codés en dur et gravés dans la trame, et il n'existe pas de flux de sous-titres indépendant extractible ; d'autre part, la piste de sous-titres du MP4 est dans un format non standard qui ne peut pas être reconnu par l'outil. Vous pouvez consulter le message d'erreur spécifique renvoyé par l'outil pour plus de détails.

Pourquoi les sous-titres extraits sont-ils au format idx+sub ?

Cela est dû au fait que la vidéo d'origine empaquete des sous-titres VobSub basés sur des images. Ce format est intrinsèquement un sous-titre image, donc l'outil copie directement les données d'origine pour la sortie sans effectuer de conversion de format supplémentaire. Si vous avez besoin de le convertir en format texte, vous pouvez utiliser un outil OCR dédié pour le traitement. La tarification est soumise à l'annonce publique actuelle sur le site officiel.

Puis-je extraire plusieurs pistes de sous-titres d'un MKV ?

L'outil prend en charge la reconnaissance de toutes les pistes de sous-titres indépendantes empaquetées dans MKV. Vous pouvez sélectionner la piste de sous-titres spécifiée pour effectuer l'extraction. Chaque piste de sous-titres doit être extraite séparément, et l'opération génère un fichier de sous-titres individuel correspondant.