TranscriptBalance transcrit vos fichiers audio et vidéo en texte, gratuitement et sans limite, directement dans votre navigateur. La reconnaissance vocale Whisper tourne sur votre propre appareil : vos fichiers ne sont envoyés nulle part et aucun compte n’est nécessaire.
Les fichiers audio et vidéo, par exemple MP3, M4A, WAV, MP4 ou MOV, y compris plusieurs à la fois. Le texte s’enregistre en TXT, Word, Markdown, JSON ou CSV, et les sous-titres en SRT ou VTT. Plusieurs fichiers sont regroupés en un seul document ou livrés séparément dans un ZIP.
Whisper connaît 99 langues, dont le français, l’anglais, l’allemand, le néerlandais, l’espagnol, l’italien, le polonais et le turc. TranscriptBalance détecte la langue automatiquement, ou vous la choisissez vous-même. Les langues très répandues donnent les meilleurs résultats.
Cela dépend du modèle, de l’enregistrement et de la langue. Vous avez le choix entre quatre modèles Whisper, d’« Éclair » à « Précis » (large-v3-turbo, uniquement avec carte graphique), et l’application recommande celui qui convient à votre appareil. Avec une diction claire, les plus grands modèles donnent en général de très bons textes ; les accents marqués, le jargon, le bruit de fond et les gens qui parlent en même temps entraînent plus d’erreurs. Vérifiez toujours les noms, les chiffres et les citations.
Oui, si vous activez « Locuteurs ». L’identification se fait elle aussi sur votre appareil, automatiquement ou pour 2 à 6 personnes, et vous pouvez renommer les locuteurs. Quand deux personnes parlent en même temps, une phrase peut être attribuée à la mauvaise personne.
Oui. Le résumé par IA d’un cours, d’une réunion, d’un entretien ou de tout autre contenu fait de 1 à 5 pages. Il est lui aussi calculé sur votre appareil : avec l’IA intégrée de Chrome ou avec Gemma (WebGPU requis).
Il n’y a pas de limite fixe. Le son est traité dans la mémoire de votre appareil, donc un ordinateur accepte des enregistrements plus longs qu’un smartphone. Si la mémoire ne suffit pas, découpez l’enregistrement en fichiers plus courts. Gardez l’onglet ouvert jusqu’à la fin.
Le texte s’écrit pendant que vous écoutez : depuis un onglet du navigateur, depuis le son de votre écran (par exemple l’application Teams) ou avec le micro. Le son d’un onglet ou de l’écran se capte dans Chrome et Edge sur ordinateur ; le micro fonctionne aussi sur smartphone. Le mode live utilise des modèles plus petits pour suivre le rythme. Le son n’est jamais enregistré.
Posez au chat IA (IA de Chrome, ou Gemini avec votre propre clé) des questions comme « Qu’ai-je manqué ? » ; il répond aussi de lui-même aux questions posées pendant la séance. Si vous l’activez, un résumé s’enrichit toutes les 5 minutes. À la fin, l’IA rédige une synthèse avec les rendez-vous et les tâches, et vous ajoutez en un clic les dates repérées à votre agenda.
La transcription elle-même se fait toujours sur votre appareil. L’IA de Chrome tourne elle aussi sur votre appareil ; elle n’existe que dans Google Chrome sur ordinateur, et seulement si votre appareil la prend en charge. Si vous connectez Gemini de votre plein gré avec votre propre clé, votre navigateur envoie des extraits de la transcription et vos questions directement à Google, pas à nous. Il vous faut pour cela un compte Google, Google réserve ce service aux personnes de 18 ans et plus, et les conditions et limites de Google s’appliquent.
Demandez d’abord à l’enseignant, prévenez les participants d’une réunion, obtenez leur accord quand il est nécessaire et respectez le règlement de votre établissement ou de votre employeur. TranscriptBalance n’enregistre jamais le son, mais la transcription contient les propos d’autres personnes. En Belgique, par exemple, vous ne pouvez pas enregistrer sans accord une conversation à laquelle vous ne participez pas ; d’autres pays sont plus stricts. Ne publiez pas la transcription d’un cours sans autorisation.
Seul le texte est conservé, jamais le son : chaque séance est gardée dans votre navigateur, sous « Séances enregistrées », classée par matière si vous le souhaitez, et vous pouvez continuer à poser des questions dessus plus tard. La transcription, la synthèse et le résumé en direct se téléchargent en Word, TXT ou Markdown.
Non. Votre son ne quitte jamais votre appareil : votre navigateur lit les fichiers localement, la reconnaissance vocale tourne sur votre appareil et les transcriptions restent dans le stockage de votre navigateur. Seuls les modèles (chez Hugging Face) et l’environnement d’exécution (chez jsDelivr) sont téléchargés. Seulement si vous connectez Gemini en mode live, de votre plein gré, des extraits de la transcription et vos questions partent directement chez Google.
Oui. Il n’y a ni abonnement, ni version payante, ni publicité de tiers, ni limite de minutes ou de fichiers ; la seule limite, c’est votre appareil, car les longs enregistrements demandent du temps et de la mémoire. Comme le calcul se fait sur votre appareil, TranscriptBalance n’a pas besoin de serveurs coûteux. Il est développé par Jeremy Heindrichs, étudiant en Belgique, à côté de ses études. Pour le soutenir, jetez un œil à son autre projet, AudioBalance : un logiciel Windows qui met vidéos, appels et musique au même volume.
Non. TranscriptBalance fonctionne sans inscription, sans adresse e-mail et sans cookies. Seul Gemini, facultatif en mode live, demande votre propre compte Google, votre propre clé API de Google et d’avoir 18 ans ou plus.
Nous comptons de façon anonyme les visites et les fonctions utilisées, jamais avec du contenu et sans cookie. Vous désactivez les messages sur les fonctions utilisées dans l’application, sous « Infos et licences ». Avec Global Privacy Control ou Do Not Track, votre visite n’est pas comptée non plus. Tous les détails figurent dans la politique de confidentialité.
C’est le plus rapide avec WebGPU, par exemple dans une version récente de Chrome ou d’Edge sur ordinateur. Sans WebGPU, TranscriptBalance calcule sur le processeur : plus lentement, mais dans pratiquement tous les navigateurs récents, y compris sur smartphone et tablette. Capter le son d’un onglet ou de l’écran ne fonctionne que dans Chrome ou Edge sur ordinateur.
Pas entièrement. Il faut une connexion internet pour ouvrir la page et pour le premier téléchargement des modèles. Ensuite, les modèles sont stockés dans votre navigateur et la transcription se calcule sur votre appareil, mais il n’existe pas de véritable mode hors ligne.