Transcrire un audio ou une vidéo en texte gratuitement – sans upload ni inscription

TranscriptBalance transcrit vos fichiers audio et vidéo en texte, gratuitement et sans limite, directement dans votre navigateur. La reconnaissance vocale Whisper tourne sur votre propre appareil : vos fichiers ne sont envoyés nulle part et aucun compte n’est nécessaire.

Transcrire des fichiers

Comment transcrire un fichier en texte ?
  1. Déposez : faites glisser un ou plusieurs fichiers dans TranscriptBalance, ou cliquez sur la zone ronde en mode fichier.
  2. Lancez la transcription : la première fois, votre navigateur télécharge le modèle de reconnaissance vocale et le conserve. Le calcul se fait sur votre appareil, avec la carte graphique (WebGPU) ou le processeur.
  3. Récupérez le texte : dans le format qu’il vous faut, avec ou sans horodatage et noms des locuteurs.
Quels formats TranscriptBalance prend-il en charge ?

Les fichiers audio et vidéo, par exemple MP3, M4A, WAV, MP4 ou MOV, y compris plusieurs à la fois. Le texte s’enregistre en TXT, Word, Markdown, JSON ou CSV, et les sous-titres en SRT ou VTT. Plusieurs fichiers sont regroupés en un seul document ou livrés séparément dans un ZIP.

Quelles langues TranscriptBalance reconnaît-il ?

Whisper connaît 99 langues, dont le français, l’anglais, l’allemand, le néerlandais, l’espagnol, l’italien, le polonais et le turc. TranscriptBalance détecte la langue automatiquement, ou vous la choisissez vous-même. Les langues très répandues donnent les meilleurs résultats.

La transcription est-elle fiable ?

Cela dépend du modèle, de l’enregistrement et de la langue. Vous avez le choix entre quatre modèles Whisper, d’« Éclair » à « Précis » (large-v3-turbo, uniquement avec carte graphique), et l’application recommande celui qui convient à votre appareil. Avec une diction claire, les plus grands modèles donnent en général de très bons textes ; les accents marqués, le jargon, le bruit de fond et les gens qui parlent en même temps entraînent plus d’erreurs. Vérifiez toujours les noms, les chiffres et les citations.

TranscriptBalance distingue-t-il les différents locuteurs ?

Oui, si vous activez « Locuteurs ». L’identification se fait elle aussi sur votre appareil, automatiquement ou pour 2 à 6 personnes, et vous pouvez renommer les locuteurs. Quand deux personnes parlent en même temps, une phrase peut être attribuée à la mauvaise personne.

TranscriptBalance peut-il résumer le texte ?

Oui. Le résumé par IA d’un cours, d’une réunion, d’un entretien ou de tout autre contenu fait de 1 à 5 pages. Il est lui aussi calculé sur votre appareil : avec l’IA intégrée de Chrome ou avec Gemma (WebGPU requis).

Quelle taille ou quelle durée maximale pour un fichier ?

Il n’y a pas de limite fixe. Le son est traité dans la mémoire de votre appareil, donc un ordinateur accepte des enregistrements plus longs qu’un smartphone. Si la mémoire ne suffit pas, découpez l’enregistrement en fichiers plus courts. Gardez l’onglet ouvert jusqu’à la fin.

Transcrire en direct

Comment fonctionne le mode live ?

Le texte s’écrit pendant que vous écoutez : depuis un onglet du navigateur, depuis le son de votre écran (par exemple l’application Teams) ou avec le micro. Le son d’un onglet ou de l’écran se capte dans Chrome et Edge sur ordinateur ; le micro fonctionne aussi sur smartphone. Le mode live utilise des modèles plus petits pour suivre le rythme. Le son n’est jamais enregistré.

Que fait l’IA en mode live ?

Posez au chat IA (IA de Chrome, ou Gemini avec votre propre clé) des questions comme « Qu’ai-je manqué ? » ; il répond aussi de lui-même aux questions posées pendant la séance. Si vous l’activez, un résumé s’enrichit toutes les 5 minutes. À la fin, l’IA rédige une synthèse avec les rendez-vous et les tâches, et vous ajoutez en un clic les dates repérées à votre agenda.

IA de Chrome ou Gemini : où vont mes données ?

La transcription elle-même se fait toujours sur votre appareil. L’IA de Chrome tourne elle aussi sur votre appareil ; elle n’existe que dans Google Chrome sur ordinateur, et seulement si votre appareil la prend en charge. Si vous connectez Gemini de votre plein gré avec votre propre clé, votre navigateur envoie des extraits de la transcription et vos questions directement à Google, pas à nous. Il vous faut pour cela un compte Google, Google réserve ce service aux personnes de 18 ans et plus, et les conditions et limites de Google s’appliquent.

Ai-je le droit de transcrire un cours ou une réunion Teams en direct ?

Demandez d’abord à l’enseignant, prévenez les participants d’une réunion, obtenez leur accord quand il est nécessaire et respectez le règlement de votre établissement ou de votre employeur. TranscriptBalance n’enregistre jamais le son, mais la transcription contient les propos d’autres personnes. En Belgique, par exemple, vous ne pouvez pas enregistrer sans accord une conversation à laquelle vous ne participez pas ; d’autres pays sont plus stricts. Ne publiez pas la transcription d’un cours sans autorisation.

Les séances live sont-elles conservées, et puis-je les exporter ?

Seul le texte est conservé, jamais le son : chaque séance est gardée dans votre navigateur, sous « Séances enregistrées », classée par matière si vous le souhaitez, et vous pouvez continuer à poser des questions dessus plus tard. La transcription, la synthèse et le résumé en direct se téléchargent en Word, TXT ou Markdown.

Confidentialité, coût et compatibilité

Mes enregistrements sont-ils envoyés sur un serveur ?

Non. Votre son ne quitte jamais votre appareil : votre navigateur lit les fichiers localement, la reconnaissance vocale tourne sur votre appareil et les transcriptions restent dans le stockage de votre navigateur. Seuls les modèles (chez Hugging Face) et l’environnement d’exécution (chez jsDelivr) sont téléchargés. Seulement si vous connectez Gemini en mode live, de votre plein gré, des extraits de la transcription et vos questions partent directement chez Google.

TranscriptBalance est-il vraiment gratuit et illimité ?

Oui. Il n’y a ni abonnement, ni version payante, ni publicité de tiers, ni limite de minutes ou de fichiers ; la seule limite, c’est votre appareil, car les longs enregistrements demandent du temps et de la mémoire. Comme le calcul se fait sur votre appareil, TranscriptBalance n’a pas besoin de serveurs coûteux. Il est développé par Jeremy Heindrichs, étudiant en Belgique, à côté de ses études. Pour le soutenir, jetez un œil à son autre projet, AudioBalance : un logiciel Windows qui met vidéos, appels et musique au même volume.

Faut-il créer un compte ?

Non. TranscriptBalance fonctionne sans inscription, sans adresse e-mail et sans cookies. Seul Gemini, facultatif en mode live, demande votre propre compte Google, votre propre clé API de Google et d’avoir 18 ans ou plus.

Que compte TranscriptBalance, et puis-je le désactiver ?

Nous comptons de façon anonyme les visites et les fonctions utilisées, jamais avec du contenu et sans cookie. Vous désactivez les messages sur les fonctions utilisées dans l’application, sous « Infos et licences ». Avec Global Privacy Control ou Do Not Track, votre visite n’est pas comptée non plus. Tous les détails figurent dans la politique de confidentialité.

Quels navigateurs et appareils sont compatibles ?

C’est le plus rapide avec WebGPU, par exemple dans une version récente de Chrome ou d’Edge sur ordinateur. Sans WebGPU, TranscriptBalance calcule sur le processeur : plus lentement, mais dans pratiquement tous les navigateurs récents, y compris sur smartphone et tablette. Capter le son d’un onglet ou de l’écran ne fonctionne que dans Chrome ou Edge sur ordinateur.

TranscriptBalance fonctionne-t-il hors ligne ?

Pas entièrement. Il faut une connexion internet pour ouvrir la page et pour le premier téléchargement des modèles. Ensuite, les modèles sont stockés dans votre navigateur et la transcription se calcule sur votre appareil, mais il n’existe pas de véritable mode hors ligne.