Audio en texte
Une page pour tout format audio
Déposez MP3, M4A, WAV, FLAC, OGG, AAC, WebM et plus. Obtenez une transcription propre avec des horodatages, un résumé AI et des exportations.
Déposez votre fichier ici
ou cliquez pour parcourir
MP3 · MP4 · WAV · M4A · OGG · WEBM · FLAC · Max 25 Mo · Max 30 min
Comment ça marche
- 1
Déposez n’importe quel fichier audio
Téléchargez depuis votre appareil ou glissez-déposez. MP3, M4A, WAV, FLAC, OGG, AAC, WebM, et plus.
- 2
Whisper transcrit l’audio
Whisper large-v3 fonctionne sur notre backend avec ponctuation automatique, sauts de paragraphe et horodatages par segment.
- 3
Éditez, exportez, partagez
Revoyez la transcription, résumez avec AI, traduisez en plus de 50 langues et exportez en TXT, DOCX, PDF ou SRT.
Mise en page par ligne plus propre avec horodatages. Idéal pour la lecture.
Pourquoi un seul outil audio-en-texte est meilleur
Pas de conversion préalable
Téléchargez n’importe quel format audio directement. Gagnez du temps et conservez votre qualité originale, sans passage par un convertisseur avec perte.
Détection automatique du format
Mictoo détecte le format à partir de l’en-tête du fichier et applique les meilleurs paramètres de transcription pour ce codec.
Même précision sur tous les formats
Propulsé par Whisper large-v3 pour une précision constante que votre fichier soit MP3, WAV, FLAC ou WebM.
Résumé et exportations inclus
Obtenez des résumés AI, traduisez en plus de 50 langues et exportez en TXT, SRT, VTT ou DOCX. Pas de plans supplémentaires.
Quand cette page est le bon choix
Archives multi-formats
Un seul téléchargement pour tous vos fichiers, quel que soit l’appareil sur lequel ils ont été enregistrés.
Format de fichier inconnu
Vous ne savez pas ce que votre enregistreur a produit. Nous le détectons et le transcrivons.
Transcription rapide
Résultats rapides sans configuration, convertisseurs ou sélection manuelle de format.
Flux de travail multi-outils
Déposez des fichiers exportés de Zoom, Descript, Audacity, GarageBand ou tout DAW.
Premiers utilisateurs
Pas d’inscription, interface simple, gratuit. Un premier essai sûr avant de s’engager dans un outil.
Test de qualité audio
Vérifiez la clarté et voyez combien de texte utilisable vous pouvez obtenir d’un enregistrement brut.
La qualité audio compte plus que le format de fichier
Comment Mictoo détecte votre format
1010
Nous lisons l’en-tête du fichier (octets magiques) pour identifier instantanément votre format. Cela garantit les meilleurs paramètres pour une transcription précise et signifie que vous n’avez jamais besoin de choisir le format manuellement.
Formats audio pris en charge
| Format | Source courante | Idéal pour | Téléchargement direct |
|---|---|---|---|
| MP3 | Enregistreurs, podcasts, téléchargements | Usage général, petits fichiers | |
| M4A | Mémos vocaux iPhone, applications Apple | Haute qualité, taille efficace | |
| WAV | Enregistrements, exports DAW | Non compressé, audio pro | |
| FLAC | Archives musicales, haute fidélité | Qualité sans perte | |
| OGG | Enregistrements open source, applications | Web et streaming | |
| AAC | Enregistrements mobiles, streaming | Qualité et taille équilibrées | |
| WebM | Enregistrements web, navigateurs | Vidéo et audio en ligne |
À savoir sur chaque format
Aucun de ceux-ci n’a besoin d’être converti avant le téléchargement. Les notes ci-dessous sont les choses qui piègent réellement les gens, par format.
MP3
Le format par défaut pour les enregistreurs, les téléchargements de podcasts et tout ce qui est partagé par chat. Avec perte, petit et universellement lisible.
- Ce que nous acceptons
- Tout débit binaire à partir de 32 kbps, mono ou stéréo, CBR ou VBR. Pas de ré-encodage avant la transcription
- Débit binaire et précision
- Au-dessus d’environ 64 kbps pour la parole, plus de débit binaire n’aide pas. Whisper rééchantillonne en interne à 16 kHz mono de toute façon
- Débit binaire variable
- Les fichiers VBR rapportent parfois la mauvaise durée dans les anciens lecteurs. Cela n’affecte pas la transcription ou les horodatages
- Tags ID3
- Ignorés pendant la transcription. La transcription revient sous forme de texte brut, donc gardez votre mappage de métadonnées d’épisode dans votre propre système
M4A
Pas un codec mais un conteneur : audio AAC, parfois ALAC, dans une enveloppe MP4. C’est ce qu’un iPhone vous donne.
- Comment nous le lisons
- Nous analysons la boîte ftyp, extrayons la piste AAC et la transmettons à Whisper sans ré-encodage
- D’où ça vient
- Mémos vocaux iPhone, GarageBand, FaceTime, téléchargements Apple Podcasts
- Depuis un iPhone
- Partagez le mémo, enregistrez-le dans Fichiers ou iCloud, puis téléchargez-le. Pas besoin de conversion
- ALAC à l’intérieur
- Certains fichiers .m4a contiennent Apple Lossless au lieu de AAC. Les deux fonctionnent ici, et aucun n’a besoin d’être converti d’abord
WAV
PCM non compressé. Les plus gros fichiers que vous téléchargerez, et la source la plus propre, bien que le bruit ambiant compte toujours plus que le format.
- Ce que nous acceptons
- PCM 16, 24 et 32 bits, n’importe quel taux d’échantillonnage, mono ou stéréo, plus Broadcast Wave (BWF)
- Métadonnées BWF
- Les morceaux bext et iXML contenant le timecode, la scène et la prise sont ignorés, pas bloqués. Ils n’apparaissent pas dans la transcription
- Avertissement de taille
- Environ 10 Mo par minute à qualité CD, donc un enregistrement stéréo de 25 minutes dépasse déjà la limite anonyme
- Réduisez-le d’abord
- Exporter en mono à 64 kbps ne perd rien pour la parole et réduit le fichier de 10 à 15 fois
FLAC
Compression sans perte, environ la moitié de la taille du même WAV. Courant dans les archives d’histoire orale et les flux de travail d’enregistrement sur le terrain.
- Ce que nous acceptons
- FLAC natif (octets magiques fLaC) et FLAC dans un conteneur OGG, mono ou stéréo, jusqu’à 192 kHz, 16 ou 24 bits
- Pas besoin de conversion
- Le fichier passe directement. Le convertir d’abord en MP3 ne ferait que perdre des informations
- Commentaires Vorbis
- Ignorés pendant la transcription. Si votre archive dépend de ces tags, gardez le mappage en dehors de la transcription
- Vaut-il la taille ?
- Pour la précision, non. FLAC et un bon MP3 se transcrivent de la même manière. Gardez FLAC comme copie de préservation, pas parce que Whisper en a besoin
WEBM
Un conteneur Matroska, contenant généralement de l’audio Opus, parfois Vorbis. C’est ce que produisent les navigateurs et les enregistreurs d’écran.
- D’où ça vient
- Loom, OBS, l’API MediaRecorder du navigateur, exports Google Meet, téléchargements YouTube
- Vidéo à l’intérieur ?
- Nous démultiplexons, supprimons la piste vidéo et transcrivons l’audio. Rien à extraire de votre côté
- Codecs
- Opus sur tout ce qui est récent, Vorbis sur les fichiers plus anciens. Les deux sont traités sans conversion
- Pourquoi le fichier est gros
- Les enregistrements d’écran sont principalement vidéo. Un WEBM de 20 Mo contient souvent seulement 3 ou 4 Mo d’audio
Questions fréquemment posées
Quels formats audio puis-je télécharger ?
MP3, M4A, WAV, FLAC, OGG, AAC, WebM, MP4, MOV, ainsi que AIFF, AU, OPUS et MPEG. Si votre fichier se lit dans un lecteur multimédia normal, Mictoo peut le transcrire. Les fichiers vidéo sont également acceptés, nous extrayons la piste audio côté serveur.
Combien de temps prend la transcription ?
Généralement quelques secondes. Un fichier audio de 10 minutes se termine en environ 15 à 30 secondes ; un podcast de 60 minutes est terminé en environ une minute. Les fichiers plus longs qui sont automatiquement divisés prennent un peu plus de temps car les segments sont transcrits en parallèle et fusionnés.
La transcription audio est-elle vraiment gratuite ?
Oui. Transcription gratuite jusqu’à 25 Mo par fichier sans inscription. Un compte gratuit augmente la limite par fichier à 60 Mo, et les fichiers jusqu’à 180 Mo sont automatiquement divisés en segments et fusionnés en une seule transcription. Pas de carte de crédit, pas de frais cachés.
Mes fichiers audio sont-ils stockés ?
Non. Les fichiers sont diffusés directement au fournisseur de reconnaissance vocale (Groq pour la rapidité, avec Replicate, Deepgram et OpenAI en secours), traités, puis supprimés. Mictoo ne conserve pas l’audio et les fournisseurs ne s’entraînent pas sur les données API.
Le format de fichier affecte-t-il la précision ?
La qualité audio compte bien plus que le format. Un discours clair dans un MP3 compressé sera mieux transcrit qu’un audio bruyant dans un WAV non compressé. Mictoo utilise le même modèle Whisper large-v3 sur chaque format, donc la précision reste constante sur tous les types pris en charge.
Dois-je convertir mon audio dans un format spécifique d’abord ?
Non. C’est tout l’intérêt de cette page. Téléchargez ce que votre enregistreur, DAW, téléphone ou outil de téléchargement a produit. Nous détectons le format à partir de l’en-tête du fichier et le transmettons directement à Whisper. Pas de conversion, pas de perte de qualité.
Puis-je éditer la transcription avant de la télécharger ?
Oui. Après la transcription, passez à la vue Éditeur pour corriger les noms ou le jargon incorrects. Les modes Lecteur (horodatages par ligne) et Éditeur (texte brut) sont disponibles. Les exportations utilisent la dernière version que vous avez éditée.
Combien de langues la transcription prend-elle en charge ?
Plus de 50 langues, y compris l’anglais, l’espagnol, le français, l’allemand, le portugais, le russe, l’ukrainien, le japonais, le chinois, l’arabe, et bien d’autres. La détection automatique fonctionne pour la plupart des fichiers, ou vous pouvez choisir la langue manuellement dans le formulaire de téléchargement pour les clips courts.
Puis-je traduire la transcription ?
Oui. Après la transcription, cliquez sur Traduire et choisissez parmi 28 langues cibles. La traduction est disponible dans la vue Lecteur et dans chaque format d’exportation. Les horodatages sont conservés pour que le SRT traduit corresponde toujours à l’audio.
Quels formats d’exportation sont disponibles ?
TXT (texte brut), SRT (sous-titres), TXT horodaté et DOCX (document Word). Les utilisateurs enregistrés obtiennent également PDF, VTT (sous-titres web) et JSON. Tous les exports sont disponibles dans le menu de téléchargement après la fin de la transcription.