TranscriptBalance transcrit vos fichiers audio et vidéo en texte, gratuitement et sans limite, directement dans votre navigateur. La reconnaissance vocale Whisper tourne sur votre propre appareil : vos fichiers ne sont envoyés nulle part et aucun compte n’est nécessaire.
En mode live, le texte s’écrit pendant que vous écoutez : depuis un onglet du navigateur, depuis le son de votre écran (par exemple l’application Teams) ou avec le micro. Posez au chat IA (IA de Chrome, ou Gemini avec votre propre clé) des questions comme « Qu’ai-je manqué ? » ; il répond aussi de lui-même aux questions posées pendant la séance. Si vous l’activez, un résumé s’enrichit toutes les 5 minutes et, à la fin, vous ajoutez en un clic les dates repérées à votre agenda. Le son n’est jamais enregistré.
Le son d’un onglet ou de l’écran se capte dans Chrome et Edge sur ordinateur ; le micro fonctionne aussi sur smartphone. En savoir plus : transcrire un cours en direct.
Démarrer le mode liveOui. Votre son ne quitte jamais votre appareil et les transcriptions restent dans le stockage de votre navigateur. Seuls les modèles (chez Hugging Face) et l’environnement d’exécution (chez jsDelivr) sont téléchargés. Nous comptons aussi, de façon anonyme, les visites et les fonctions utilisées, jamais avec du contenu : vous désactivez dans l’application les messages sur les fonctions, et avec Global Privacy Control ou Do Not Track votre visite n’est pas comptée non plus. Seulement si vous connectez Gemini en mode live, de votre plein gré, des extraits de la transcription et vos questions partent directement chez Google. Pour le vérifier vous-même : transcription sans upload.
Comme le calcul se fait sur votre appareil, TranscriptBalance n’a pas besoin de serveurs coûteux. Pas d’abonnement, pas de version payante, pas de publicité de tiers. Il est développé par Jeremy Heindrichs, étudiant en Belgique, à côté de ses études. Pour le soutenir, jetez un œil à son autre projet, AudioBalance : un logiciel Windows qui met vidéos, appels et musique au même volume.
À lire aussi : retranscrire un entretien pour un mémoire et comparatif des outils de transcription gratuits.
Oui. Il n’y a ni abonnement, ni limite de minutes, ni limite du nombre de fichiers. La seule limite, c’est votre appareil : les longs enregistrements demandent du temps et de la mémoire.
Non. Votre navigateur lit le fichier localement et Whisper le transcrit sur votre appareil. Il ne télécharge que les modèles. Notre serveur ne reçoit que des comptages anonymes, sans aucun contenu : vous désactivez les messages sur les fonctions utilisées dans l’application, sous « Infos et licences », et avec Global Privacy Control ou Do Not Track votre visite n’est pas comptée non plus.
Non. TranscriptBalance fonctionne sans inscription, sans adresse e-mail et sans cookies. Seul Gemini, facultatif en mode live, demande votre propre compte Google et votre propre clé API de Google.
C’est le plus rapide avec WebGPU, par exemple dans une version récente de Chrome ou d’Edge sur ordinateur. Sans WebGPU, TranscriptBalance calcule sur le processeur : plus lentement, mais dans pratiquement tous les navigateurs récents, y compris sur smartphone et tablette. Capter le son d’un onglet ou de l’écran ne fonctionne que dans Chrome ou Edge sur ordinateur.
Cela dépend du modèle, de l’enregistrement et de la langue. Avec une diction claire, les plus grands modèles donnent en général de très bons textes ; les accents marqués, le jargon, le bruit de fond et les gens qui parlent en même temps entraînent plus d’erreurs. Le mode live utilise des modèles plus petits pour suivre le rythme. Vérifiez toujours les noms, les chiffres et les citations.
Whisper connaît 99 langues, dont le français, l’anglais, l’allemand, le néerlandais, l’espagnol, l’italien, le polonais et le turc. TranscriptBalance détecte la langue automatiquement, ou vous la choisissez vous-même. Les langues très répandues donnent les meilleurs résultats.
Il n’y a pas de limite fixe. Le son est traité dans la mémoire de votre appareil, donc un ordinateur accepte des enregistrements plus longs qu’un smartphone. Si la mémoire ne suffit pas, découpez l’enregistrement en fichiers plus courts. Gardez l’onglet ouvert jusqu’à la fin.
Oui, si vous activez « Locuteurs ». L’identification se fait elle aussi sur votre appareil, automatiquement ou pour 2 à 6 personnes, et vous pouvez renommer les locuteurs. Quand deux personnes parlent en même temps, une phrase peut être attribuée à la mauvaise personne.
Cela dépend des règles qui s’appliquent là où vous êtes. TranscriptBalance n’enregistre jamais le son, mais la transcription contient les propos d’autres personnes. Prévenez-les à l’avance, demandez leur accord quand il est nécessaire et respectez le règlement de votre établissement ou de votre employeur. En Belgique, par exemple, vous ne pouvez pas enregistrer sans accord une conversation à laquelle vous ne participez pas ; d’autres pays sont plus stricts. Ne publiez pas la transcription d’un cours sans autorisation.
Pas entièrement. Il faut une connexion internet pour ouvrir la page et pour le premier téléchargement des modèles. Ensuite, les modèles sont stockés dans votre navigateur et la transcription se calcule sur votre appareil, mais il n’existe pas de véritable mode hors ligne.