08VoixFlashEn usage
« j'en peux plus des outils qui demandent de payer ou qui marchent mal »
moi, mi-juin 2026, après un abonnement de trop
Une touche pour dicter partout, et rien ne quitte le Mac.
Maintenir une touche, parler, relâcher : le texte s'écrit là où se trouve le curseur, message, document ou e-mail. La transcription tourne sur le processeur du Mac, hors-ligne, sans compte ni abonnement.
- Du premier fichier à l'outil partagé
- 1 jour
- Ce qui en reste aujourd'hui
- 94 544 mots transcrits, zéro parti sur un serveur
- Premier fichier
- 15 juin 2026
Ouvrir VoixFlash Gratuit, open source (MIT) · 1.1.0 publique, 1.2.0 en usage · écrit pour moi d'abord, puis partagé
micro plein : prêt
mic → mic.fill → record.circle → waveform → doc.on.clipboard
Ce que la phrase voulait dire
Dicter un message, transcrire une réunion, retranscrire un enregistrement : tout existait déjà. À condition de payer un abonnement par outil, autour de 20 € par mois (l'ordre de grandeur du marché, relevé en juillet 2026), d'ouvrir un compte à chaque fois, et d'accepter que l'audio parte sur un serveur. Et de vivre avec des outils qui marchent un jour sur deux.
Le 15 juin 2026 en fin de journée, j'ai arrêté d'attendre que l'un d'eux devienne bon. Le dépôt est né à 19h25 ; la première exécution date du même soir. Le lendemain à 11h06, il était public sur GitHub, installateur et mode d'emploi compris ; la version 1.1.0 sortait le soir même.
Ce qui a été construit
Un outil pour moi d'abord. Une application de barre des menus, écrite en un seul fichier Python de 2 723 lignes par-dessus les composants natifs de macOS : le produit ne peint rien, le système peint tout. Le moteur est faster-whisper, qui tourne sur le processeur du Mac ; le modèle se télécharge une fois à l'installation, ensuite tout est hors-ligne.
Deux chemins pour la même phrase
| Un service externe | VoixFlash | |
|---|---|---|
| Où va la voix | Sur un serveur du service : c'est là qu'il transcrit. | Nulle part. La transcription tourne sur le processeur du Mac. |
| Ce qu'il faut ouvrir | Un compte par outil. | Aucun compte, aucune clé. |
| Ce que ça coûte | Un abonnement par outil, autour de 20 € par mois.Ordre de grandeur du marché, juillet 2026. | Rien. Code sous licence MIT. |
| Sans connexion | Rien ne fonctionne. | Tout fonctionne. Internet ne sert qu'à l'installation, pour télécharger le modèle une fois. |
| La machine | Selon l'outil. | Un Mac Apple Silicon. Celui-ci : M2, 8 Go de mémoire. |
| Les limites | Celles de l'abonnement choisi. | Dictée coupée à 120 s, réunion à 3 h, historique de 1 000 entrées. En qualité small, 1 h d'audio en 15 min environ. |
Le geste, vu par l'icône
L'icône de la barre des menus n'a aucune couleur : elle est blanche comme les autres icônes système, et c'est sa forme qui dit l'état. Une dictée en traverse quatre.
La touche se choisit dans le menu : Option droite par défaut, Cmd droite, Ctrl droite, F5, ou n'importe quelle touche captée par « Choisir ma touche… ». Une pression très brève ne dicte rien, et si rien d'audible n'est dit, rien n'est écrit : un filtre écarte aussi les phrases que le moteur invente parfois sur du silence.
Les réunions et les fichiers
- En directDémarrer une réunion
Un item du menu, aussi longtemps qu'on veut, 3 h au plus par sécurité. Le texte s'affiche dans une fenêtre de l'app, modifiable, copiable, exportable en fichier daté. Le presse-papiers n'est pas touché.
- Un fichierImporter un fichier audio…
mp3, m4a, wav, flac, ogg, aiff, ou la piste audio d'une vidéo mp4 ou mov. Découpage en blocs de 8 min, progression dans le menu, annulable sans perdre le texte déjà obtenu. Des fichiers de 2 h et plus.
- Qui parleSéparer les locuteurs
Depuis la 1.2.0, pour les réunions en direct : « Locuteur 1 », « Locuteur 2 », de 2 à 6 personnes attendues ou détection automatique. Un module local d'environ 50 Mo, téléchargé une fois depuis GitHub, sans compte.
L'installation, en un double-clic
Un fichier install.command à côté de voixflash.py. Une fenêtre Terminal s'ouvre, crée un Python 3.12 isolé avec uv, installe les bibliothèques, télécharge le modèle une fois, et inscrit l'app au démarrage de la session. Rien n'est installé dans le système : tout vit dans un dossier de la bibliothèque de l'utilisateur, et uninstall.command l'enlève proprement.
L'app n'est pas signée par Apple. macOS avertit au premier lancement, et l'entrée à autoriser dans les réglages (microphone, accessibilité, surveillance des entrées) s'appelle « Python ». Le menu « Aide & autorisations » ouvre chaque réglage au bon endroit.
===================================================================
Installation de VoixFlash
===================================================================
• Code copié dans : ~/Library/Application Support/VoixFlash
• uv : uv 0.11.7 (9d177269e 2026-04-15 aarch64-apple-darwin)
• Création de l'environnement Python 3.12 (téléchargé si nécessaire)…
• Installation des bibliothèques (transcription, audio, clavier, barre des menus)…
• Téléchargement du modèle de transcription « small » (une seule fois).
[/] Téléchargement en cours… (plusieurs minutes possibles, c'est normal)
✓ Modèle « small » prêt : la transcription fonctionnera désormais hors-ligne.
• Configuration du démarrage automatique…
• Vérification du démarrage de l'application…
===================================================================
Installation terminée : l'application tourne.
===================================================================
Ce que dit le produit, dans sa documentation : « Tout est local. Après l'installation, aucune donnée audio ni texte ne sort de ton Mac. Aucun compte, aucune télémétrie. »
Ce que VoixFlash ne fait pas
- Il ne tourne que sur un Mac Apple Silicon, et il n'est pas signé : macOS avertit au premier lancement.
- Il n'utilise pas la carte graphique : tout passe par le processeur. En qualité small, une heure d'audio prend environ quinze minutes ; medium est nettement plus lent.
- Une dictée s'arrête seule après 120 secondes de touche maintenue, une réunion après 3 heures. Une seule transcription à la fois.
- La séparation des locuteurs ne vaut que pour les réunions enregistrées en direct, pas pour les fichiers importés, et se dégrade quand plusieurs personnes parlent en même temps.
- Les fichiers protégés (DRM) sont refusés.
- La version publique est la 1.1.0. La 1.2.0, qui ajoute la séparation des locuteurs et la recherche dans l'historique, tourne sur ce Mac et n'est pas encore publiée.
Le résultat
« J'en peux plus des outils qui demandent de payer » est devenu : 94 544 mots transcrits sur ce Mac depuis le 26 juin 2026, dictées et réunions comprises, sans qu'un seul quitte la machine. Un Mac M2 de 8 Go, zéro abonnement.
Mesuré le 29 août 2026 dans l'historique local de l'app, en agrégats seulement : 36 transcriptions sur 12 jours entre le 26 juin et le 8 août, 23 dictées éclair et 13 réunions ou fichiers importés, la plus longue de 18 526 mots le 30 juin. L'historique antérieur au 26 juin a été perdu lors d'une réinstallation : ce qui a été dicté avant n'est pas compté.