TranscriptBalance
Ouvrir l'app

Retranscrire ses entretiens gratuitement – pour le mémoire ou le TFE

Mis à jour le

TranscriptBalance retranscrit gratuitement les entretiens de votre mémoire ou de votre TFE, sans limite de durée, avec identification des locuteurs, horodatage et export Word. L’enregistrement reste sur votre appareil : Whisper tourne directement dans votre navigateur, rien n’est envoyé.

Pourquoi retranscrire ses entretiens en local ?

Les entretiens de recherche contiennent souvent des données personnelles : des noms, des opinions, parfois des informations sur la santé ou le travail. Beaucoup de services de transcription envoient l’enregistrement sur leurs serveurs pour le traiter. Avec TranscriptBalance, la transcription se fait dans votre navigateur, sans compte. Ni l’enregistrement ni la transcription n’atteignent un serveur, pas même le nôtre. Aucun service ne traite donc vos entretiens pour votre compte.

Ce qui quitte malgré tout votre appareil : la première fois, le navigateur télécharge les modèles chez Hugging Face et l’environnement d’exécution chez jsDelivr. Ces fournisseurs voient votre adresse IP, mais aucun contenu. L’application compte aussi, de façon anonyme, les fonctions utilisées, jamais les contenus ; ce comptage peut être désactivé. Les détails figurent dans la politique de confidentialité et sur la page transcription sans upload.

Ce sont les règles de votre université ou haute école, les consignes de votre promoteur ou directeur de mémoire, l’avis du comité d’éthique et le formulaire de consentement signé par vos participants qui disent si cela suffit pour votre projet. Vérifiez-les ou renseignez-vous auprès d’eux. Ceci n’est pas un conseil juridique.

De l’enregistrement à la transcription, étape par étape

  1. Enregistrer : avec votre téléphone, un dictaphone ou en enregistrant un entretien en visio. Les fichiers audio et vidéo courants comme MP3, M4A, WAV ou MP4 conviennent.
  2. Déposer le fichier : faites glisser un ou plusieurs enregistrements dans TranscriptBalance.
  3. Régler : choisissez le modèle, laissez l’application détecter la langue ou fixez-la vous-même, et activez « Locuteurs ». L’application trouve seule le nombre de locuteurs, ou vous l’indiquez, de 2 à 6.
  4. Transcrire : gardez l’onglet ouvert. Au-delà de 10 minutes d’audio, l’application vous demande si elle peut vous prévenir par une notification quand tout est terminé.
  5. Nommer les locuteurs : renommez « Locuteur A » et « Locuteur B », par exemple en « Enquêteur » et « P1 », pour qu’aucun vrai nom n’apparaisse en tête des paragraphes.
  6. Exporter : en DOCX, TXT, SRT, VTT, Markdown, JSON ou CSV, avec ou sans horodatage et locuteurs. Plusieurs entretiens vont dans un seul document ou dans un fichier ZIP, un fichier par entretien.

Quel modèle choisir pour votre entretien ?

L’application recommande le modèle adapté à votre appareil. Chaque modèle se télécharge une seule fois, environ 45 à 760 Mo selon le modèle et l’appareil, puis reste dans le navigateur. Pour la transcription que vous citerez dans votre mémoire, prenez le modèle le plus précis que votre appareil supporte.

Conseils pour une transcription fidèle

Longs enregistrements et nombreux entretiens

Il n’y a aucune limite de minutes ni de fichiers. L’application traite plusieurs enregistrements l’un après l’autre et affiche une estimation du temps restant. La durée dépend de votre appareil et du modèle : avec une carte graphique via WebGPU, c’est nettement plus rapide qu’avec le seul processeur.

Gardez l’onglet ouvert ; pendant ce temps, l’application empêche l’écran de se mettre en veille. Si le travail est interrompu, par exemple parce que l’onglet a été fermé, le texte déjà obtenu reste enregistré dans votre navigateur. Redéposez le même fichier, et l’application reprend après le dernier passage terminé. Les très longs fichiers demandent beaucoup de mémoire vive, ce qui peut coincer sur un téléphone ou un ordinateur portable modeste.

Si vous le souhaitez, une IA sur votre appareil rédige un résumé de type « Entretien » de 1 à 5 pages : avec l’IA de Chrome, ou avec Gemma, qui tourne en local dans le navigateur, nécessite WebGPU et se télécharge une fois (environ 0,8 Go). En mode fichier, rien n’est envoyé à Gemini ni à aucun autre service en ligne. Le résumé est généré par IA : pour votre analyse, c’est la transcription qui fait foi.

TranscriptBalance, aTrain ou noScribe ?

aTrain, développé à l’université de Graz, et noScribe sont des logiciels gratuits bien connus qui transcrivent eux aussi en local avec Whisper, identifient les locuteurs et sont pensés pour les entretiens de recherche. Les différences :

Le bon outil dépend de votre ordinateur et de votre façon de travailler. Pour une vue plus large, voyez le comparatif des outils de transcription gratuits.

Retranscrire un entretien maintenant

Questions fréquentes

TranscriptBalance est-il conforme au RGPD pour des entretiens de recherche ?

TranscriptBalance n’envoie pas votre enregistrement, ne demande pas de compte et ne conserve les transcriptions que dans votre navigateur ; aucun service ne traite vos entretiens pour votre compte. Les seules connexions sont le téléchargement des modèles chez Hugging Face et jsDelivr et un comptage d’utilisation anonyme, sans contenu, que vous pouvez désactiver. Ce sont les règles de votre université ou de votre comité d’éthique qui disent si cela répond à vos exigences. Ceci n’est pas un conseil juridique.

Combien de temps faut-il pour transcrire un entretien d’une heure ?

Cela dépend beaucoup de votre appareil et du modèle choisi. Avec une carte graphique via WebGPU, c’est nettement plus rapide qu’avec le seul processeur, et les petits modèles sont plus rapides que les grands. TranscriptBalance affiche une estimation du temps restant pendant le travail ; le mieux est de tester d’abord avec un court enregistrement.

TranscriptBalance reconnaît-il qui parle ?

Oui. L’identification des locuteurs se fait sur votre appareil, avec les modèles pyannote et WeSpeaker. TranscriptBalance trouve seul le nombre de locuteurs, ou vous l’indiquez, de 2 à 6. Vous pouvez ensuite renommer les locuteurs, par exemple en « Enquêteur » et « P1 ». Vérifiez le résultat là où les voix se chevauchent ou se ressemblent.

Puis-je corriger la transcription dans Word ?

Oui. TranscriptBalance exporte un fichier DOCX, avec ou sans horodatage et noms des locuteurs, que vous corrigez dans Word ou un autre traitement de texte. TranscriptBalance n’a pas d’éditeur intégré. Les formats TXT, SRT, VTT, Markdown, JSON et CSV sont aussi disponibles.

Quels fichiers puis-je transcrire ?

Les formats audio et vidéo courants comme MP3, M4A, WAV ou MP4 ; pour une vidéo, seule la piste audio est utilisée. Ce qui fonctionne exactement dépend des formats que votre navigateur sait lire. Si TranscriptBalance signale un format non pris en charge, convertissez d’abord le fichier, par exemple en MP3.

Y a-t-il une limite de durée ou de nombre d’entretiens ?

Non. TranscriptBalance ne limite ni les minutes ni les fichiers, et plusieurs enregistrements sont traités l’un après l’autre. Les limites viennent de votre appareil : les très longs fichiers demandent beaucoup de mémoire vive, et les appareils lents prennent plus de temps.

Les hésitations et les pauses sont-elles transcrites ?

En général, non. Whisper, la reconnaissance vocale utilisée par TranscriptBalance, produit un texte lissé où les hésitations comme « euh », les répétitions et les pauses manquent souvent. Si vos conventions de transcription demandent une transcription intégrale, ajoutez ces passages à la main pendant la relecture.