tomai
Connexion
☁️ Cloud · IA · crédits

Générateur de sous-titres vidéo IA

Pensé pour les créateurs : sous-titres automatiques pour toute vidéo — incrustés dans l'image ou en SRT/VTT, traduisibles en 11 langues

🪙 Transcription : 5 crédits · traduction IA : 3 crédit par passage

La reconnaissance vocale tourne sur notre propre serveur (modèle Qwen3-ASR avec alignement forcé pour des horodatages précis) — l'audio est supprimé sous 30 minutes après transcription. La transcription prend environ 20 à 50 % de la durée de la vidéo ; la vidéo incrustée optionnelle ajoute un ré-encodage.

Étapes du pipeline et options de style

  1. Passe ASR — transcription avec minutages au niveau du mot ; ponctuation ajoutée automatiquement.
  2. Passe de traduction (facultatif) — traduction attentive aux lignes respectant les limites de vitesse de lecture par sous-titre.
  3. Passe d’incrustation — police, taille, contour et position sont rendus dans les pixels.
  4. Option sous-titres souples — mux du SRT en piste sélectionnable au lieu de l’incruster, la vidéo restant intacte.

Transcrire, traduire et incruster en un seul traitement

La reconnaissance vocale produit des SRT/VTT horodatés dans la langue parlée, traduit en option ligne par ligne, puis incruste des sous-titres stylisés dans la vidéo.

🎧

Une vraie reconnaissance vocale

Ton audio ou ta vidéo est transcrit par Qwen3-ASR sur notre serveur - pas par un moteur vocal de navigateur peu fiable - et produit des sous-titres au minutage précis, prêts à être modifiés dès la fin du traitement.

🌍

SRT, VTT, ASS ou texte brut

Télécharge les sous-titres au format attendu par ton éditeur, ta plateforme ou ton lecteur. Ils sont synchronisés avec l'audio d'origine, pour que tu puisses soigner les formulations, couper les lignes et exporter à nouveau à tout moment.

⏱️

Traduire ou incruster en une étape

Confie le SRT terminé à DeepSeek pour le traduire en onze langues, ou incruste directement les sous-titres dans la vidéo - chaque étape optionnelle est facturée séparément, et seulement si tu l'utilises.

Comment ça marche

  1. 1

    Téléversez votre vidéo (tout format, jusqu'à 1 Go) — choisissez la langue parlée ou laissez Qwen3-ASR la détecter.

  2. 2

    Le serveur transcrit la parole et, par défaut, incruste les sous-titres directement dans l'image.

  3. 3

    Téléchargez la vidéo sous-titrée prête à publier — plus SRT/VTT pour votre éditeur, avec traduction IA optionnelle en 11 langues.

  4. 4

    Choisissez l’incrustation ou les sous-titres souples, ajustez le style et téléchargez — le SRT reste toujours téléchargeable aussi.

Questions fréquentes

Quelle est la précision des sous-titres ?

Nous utilisons le modèle Qwen3-ASR avec alignement forcé pour les horodatages — une parole claire se transcrit généralement avec une excellente précision dans de nombreuses langues, dont l'anglais et le chinois. Accents marqués, musique de fond ou voix qui se chevauchent réduisent la précision ; l'aperçu SRT rend la relecture manuelle facile.

Quels formats en sortie, et les timestamps survivent-ils à la traduction ?

Vous obtenez du SRT standard (compatible avec tous les éditeurs et lecteurs) plus du WebVTT pour les lecteurs web. La traduction IA ne réécrit que les lignes de texte — chaque cue garde son timing exact, le fichier traduit s'importe donc directement dans YouTube ou votre éditeur.

Ma vidéo est-elle conservée ou utilisée pour l'entraînement ?

Non. Le téléversement, l'audio extrait et la transcription sont tous supprimés du serveur sous 30 minutes, et la tâche n'est accessible qu'avec le jeton signé de votre session. Rien n'est partagé ni utilisé pour l'entraînement.

Outils associés

Qu’est-ce que les sous-titres vidéo IA ?

Les sous-titres vidéo IA sont des légendes générées automatiquement à partir de la parole dans votre vidéo — aucune saisie manuelle, aucun service de transcription. Cet outil fait tourner Qwen3-ASR, un modèle de reconnaissance vocale de classe Whisper, sur notre VPS : envoyez n’importe quelle vidéo jusqu’à 1 Go, obtenez des légendes avec un timing précis, et téléchargez-les soit incrustées dans la vidéo, prêtes à publier, soit en fichiers SRT et WebVTT pour votre logiciel de montage. Les légendes peuvent aussi être traduites par IA dans 11 langues. Conçu pour les YouTubeurs, TikTokers, créateurs de cours et tous ceux qui veulent plus de portée et d’accessibilité pour leurs vidéos. Vous pouvez aussi modifier les légendes dans la page avant l’export, pour que le fichier final corresponde à vos formulations et pas seulement au choix du modèle.

Ce que cet outil peut faire

  • 🎙️ Qwen3-ASR transcrit la parole avec un timing au mot près
  • 🌍 Indices de langue source pour 10 langues, plus la détection automatique
  • 🔥 Incruster les sous-titres directement dans la vidéo, prête à publier
  • 📄 Exporter en SRT ou WebVTT pour tout logiciel de montage
  • 🌐 Traduire les légendes par IA dans 11 langues
  • ✏️ Modifier les légendes dans la page, puis ré-incruster la vidéo

Quand l’utiliser

  • Vous publiez des vidéos et voulez des légendes pour la portée et l’engagement
  • Vous voulez rendre vos contenus accessibles aux spectateurs sourds et malentendants
  • Vous adaptez une vidéo dans d’autres langues pour de nouveaux publics
  • Vous avez besoin de fichiers de sous-titres pour un cours ou une bibliothèque vidéo interne

Votre vidéo est envoyée sur notre VPS, où Qwen3-ASR la transcrit ; les fichiers sont supprimés automatiquement en 30 minutes. La transcription consomme des crédits selon la durée, et chaque traduction IA coûte une petite somme distincte. Honnête sur la qualité : la reconnaissance dépend de l’audio lui-même — fort bruit de fond, accents marqués, paroles qui se chevauchent ou débit très rapide réduisent la précision — c’est pourquoi nous fournissons un éditeur intégré pour vérifier et corriger avant l’export.

Outils associés