mictoo
Tout format audio · Gratuit · Pas d’inscription

Audio en texte
Une page pour tout format audio

Déposez MP3, M4A, WAV, FLAC, OGG, AAC, WebM et plus. Obtenez une transcription propre avec des horodatages, un résumé AI et des exportations.

Free
Auto-deleted
50+ languages
AI summary (OpenAI)
Chat with transcript

Déposez votre fichier ici

ou cliquez pour parcourir

MP3 · MP4 · WAV · M4A · OGG · WEBM · FLAC  ·  Max 25 Mo  ·  Max 30 min

180 min · Connexion

Fichier plus volumineux ? Voir comment compresser.

Enregistrement plus long ? Voir comment diviser.

Chaque format audio courant, un seul téléchargement

Comment ça marche

  1. 1

    Déposez n’importe quel fichier audio

    Téléchargez depuis votre appareil ou glissez-déposez. MP3, M4A, WAV, FLAC, OGG, AAC, WebM, et plus.

  2. 2

    Whisper transcrit l’audio

    Whisper large-v3 fonctionne sur notre backend avec ponctuation automatique, sauts de paragraphe et horodatages par segment.

  3. 3

    Éditez, exportez, partagez

    Revoyez la transcription, résumez avec AI, traduisez en plus de 50 langues et exportez en TXT, DOCX, PDF ou SRT.

interview-notes.mp3
Terminé·180 mots
0:00 / 1:39
Rechercher dans la transcription…
0:00Bonjour, merci d’avoir pris le temps aujourd’hui. Commençons simplement.
0:07J’ai commencé à réaliser des courts-métrages à l’université comme passe-temps.
0:15Qu’est-ce qui vous attire dans une histoire avant de vous y engager ?
0:24Des gens réels, des moments réels. J’observe d’abord, j’écris ensuite.
0:34Comment maintenez-vous l’énergie de l’équipe lors de longs tournages ?
0:42Petits rituels. Café à l’heure de l’appel, une promenade avant l’heure magique.
0:54Quel conseil donneriez-vous à quelqu’un qui débute ?
1:02Regardez beaucoup. Puis filmez encore plus. Rien ne vaut la pratique.

Mise en page par ligne plus propre avec horodatages. Idéal pour la lecture.

Pourquoi un seul outil audio-en-texte est meilleur

Pas de conversion préalable

Téléchargez n’importe quel format audio directement. Gagnez du temps et conservez votre qualité originale, sans passage par un convertisseur avec perte.

Détection automatique du format

Mictoo détecte le format à partir de l’en-tête du fichier et applique les meilleurs paramètres de transcription pour ce codec.

Même précision sur tous les formats

Propulsé par Whisper large-v3 pour une précision constante que votre fichier soit MP3, WAV, FLAC ou WebM.

Résumé et exportations inclus

Obtenez des résumés AI, traduisez en plus de 50 langues et exportez en TXT, SRT, VTT ou DOCX. Pas de plans supplémentaires.

Quand cette page est le bon choix

Archives multi-formats

Un seul téléchargement pour tous vos fichiers, quel que soit l’appareil sur lequel ils ont été enregistrés.

Format de fichier inconnu

Vous ne savez pas ce que votre enregistreur a produit. Nous le détectons et le transcrivons.

Transcription rapide

Résultats rapides sans configuration, convertisseurs ou sélection manuelle de format.

Flux de travail multi-outils

Déposez des fichiers exportés de Zoom, Descript, Audacity, GarageBand ou tout DAW.

Premiers utilisateurs

Pas d’inscription, interface simple, gratuit. Un premier essai sûr avant de s’engager dans un outil.

Test de qualité audio

Vérifiez la clarté et voyez combien de texte utilisable vous pouvez obtenir d’un enregistrement brut.

La qualité audio compte plus que le format de fichier

Parole claire
Un audio propre avec un bruit de fond minimal offre les transcriptions les plus précises.
Audio bruyant
Le bruit de fond ou le chevauchement peut réduire la précision, quel que soit le format.
Audio compressé
Des débits très faibles ou une compression lourde peuvent supprimer des détails importants.

Comment Mictoo détecte votre format

1010
1010

Nous lisons l’en-tête du fichier (octets magiques) pour identifier instantanément votre format. Cela garantit les meilleurs paramètres pour une transcription précise et signifie que vous n’avez jamais besoin de choisir le format manuellement.

Exemples
ID3·MP3
ftyp·M4A
RIFF·WAV
fLaC·FLAC
OggS·OGG
ADTS·AAC
EBML·WebM

Formats audio pris en charge

FormatSource couranteIdéal pourTéléchargement direct
MP3Enregistreurs, podcasts, téléchargementsUsage général, petits fichiers
M4AMémos vocaux iPhone, applications AppleHaute qualité, taille efficace
WAVEnregistrements, exports DAWNon compressé, audio pro
FLACArchives musicales, haute fidélitéQualité sans perte
OGGEnregistrements open source, applicationsWeb et streaming
AACEnregistrements mobiles, streamingQualité et taille équilibrées
WebMEnregistrements web, navigateursVidéo et audio en ligne

À savoir sur chaque format

Aucun de ceux-ci n’a besoin d’être converti avant le téléchargement. Les notes ci-dessous sont les choses qui piègent réellement les gens, par format.

MP3

Le format par défaut pour les enregistreurs, les téléchargements de podcasts et tout ce qui est partagé par chat. Avec perte, petit et universellement lisible.

Ce que nous acceptons
Tout débit binaire à partir de 32 kbps, mono ou stéréo, CBR ou VBR. Pas de ré-encodage avant la transcription
Débit binaire et précision
Au-dessus d’environ 64 kbps pour la parole, plus de débit binaire n’aide pas. Whisper rééchantillonne en interne à 16 kHz mono de toute façon
Débit binaire variable
Les fichiers VBR rapportent parfois la mauvaise durée dans les anciens lecteurs. Cela n’affecte pas la transcription ou les horodatages
Tags ID3
Ignorés pendant la transcription. La transcription revient sous forme de texte brut, donc gardez votre mappage de métadonnées d’épisode dans votre propre système

M4A

Pas un codec mais un conteneur : audio AAC, parfois ALAC, dans une enveloppe MP4. C’est ce qu’un iPhone vous donne.

Comment nous le lisons
Nous analysons la boîte ftyp, extrayons la piste AAC et la transmettons à Whisper sans ré-encodage
D’où ça vient
Mémos vocaux iPhone, GarageBand, FaceTime, téléchargements Apple Podcasts
Depuis un iPhone
Partagez le mémo, enregistrez-le dans Fichiers ou iCloud, puis téléchargez-le. Pas besoin de conversion
ALAC à l’intérieur
Certains fichiers .m4a contiennent Apple Lossless au lieu de AAC. Les deux fonctionnent ici, et aucun n’a besoin d’être converti d’abord

WAV

PCM non compressé. Les plus gros fichiers que vous téléchargerez, et la source la plus propre, bien que le bruit ambiant compte toujours plus que le format.

Ce que nous acceptons
PCM 16, 24 et 32 bits, n’importe quel taux d’échantillonnage, mono ou stéréo, plus Broadcast Wave (BWF)
Métadonnées BWF
Les morceaux bext et iXML contenant le timecode, la scène et la prise sont ignorés, pas bloqués. Ils n’apparaissent pas dans la transcription
Avertissement de taille
Environ 10 Mo par minute à qualité CD, donc un enregistrement stéréo de 25 minutes dépasse déjà la limite anonyme
Réduisez-le d’abord
Exporter en mono à 64 kbps ne perd rien pour la parole et réduit le fichier de 10 à 15 fois

FLAC

Compression sans perte, environ la moitié de la taille du même WAV. Courant dans les archives d’histoire orale et les flux de travail d’enregistrement sur le terrain.

Ce que nous acceptons
FLAC natif (octets magiques fLaC) et FLAC dans un conteneur OGG, mono ou stéréo, jusqu’à 192 kHz, 16 ou 24 bits
Pas besoin de conversion
Le fichier passe directement. Le convertir d’abord en MP3 ne ferait que perdre des informations
Commentaires Vorbis
Ignorés pendant la transcription. Si votre archive dépend de ces tags, gardez le mappage en dehors de la transcription
Vaut-il la taille ?
Pour la précision, non. FLAC et un bon MP3 se transcrivent de la même manière. Gardez FLAC comme copie de préservation, pas parce que Whisper en a besoin

WEBM

Un conteneur Matroska, contenant généralement de l’audio Opus, parfois Vorbis. C’est ce que produisent les navigateurs et les enregistreurs d’écran.

D’où ça vient
Loom, OBS, l’API MediaRecorder du navigateur, exports Google Meet, téléchargements YouTube
Vidéo à l’intérieur ?
Nous démultiplexons, supprimons la piste vidéo et transcrivons l’audio. Rien à extraire de votre côté
Codecs
Opus sur tout ce qui est récent, Vorbis sur les fichiers plus anciens. Les deux sont traités sans conversion
Pourquoi le fichier est gros
Les enregistrements d’écran sont principalement vidéo. Un WEBM de 20 Mo contient souvent seulement 3 ou 4 Mo d’audio

Questions fréquemment posées

Quels formats audio puis-je télécharger ?

MP3, M4A, WAV, FLAC, OGG, AAC, WebM, MP4, MOV, ainsi que AIFF, AU, OPUS et MPEG. Si votre fichier se lit dans un lecteur multimédia normal, Mictoo peut le transcrire. Les fichiers vidéo sont également acceptés, nous extrayons la piste audio côté serveur.

Combien de temps prend la transcription ?

Généralement quelques secondes. Un fichier audio de 10 minutes se termine en environ 15 à 30 secondes ; un podcast de 60 minutes est terminé en environ une minute. Les fichiers plus longs qui sont automatiquement divisés prennent un peu plus de temps car les segments sont transcrits en parallèle et fusionnés.

La transcription audio est-elle vraiment gratuite ?

Oui. Transcription gratuite jusqu’à 25 Mo par fichier sans inscription. Un compte gratuit augmente la limite par fichier à 60 Mo, et les fichiers jusqu’à 180 Mo sont automatiquement divisés en segments et fusionnés en une seule transcription. Pas de carte de crédit, pas de frais cachés.

Mes fichiers audio sont-ils stockés ?

Non. Les fichiers sont diffusés directement au fournisseur de reconnaissance vocale (Groq pour la rapidité, avec Replicate, Deepgram et OpenAI en secours), traités, puis supprimés. Mictoo ne conserve pas l’audio et les fournisseurs ne s’entraînent pas sur les données API.

Le format de fichier affecte-t-il la précision ?

La qualité audio compte bien plus que le format. Un discours clair dans un MP3 compressé sera mieux transcrit qu’un audio bruyant dans un WAV non compressé. Mictoo utilise le même modèle Whisper large-v3 sur chaque format, donc la précision reste constante sur tous les types pris en charge.

Dois-je convertir mon audio dans un format spécifique d’abord ?

Non. C’est tout l’intérêt de cette page. Téléchargez ce que votre enregistreur, DAW, téléphone ou outil de téléchargement a produit. Nous détectons le format à partir de l’en-tête du fichier et le transmettons directement à Whisper. Pas de conversion, pas de perte de qualité.

Puis-je éditer la transcription avant de la télécharger ?

Oui. Après la transcription, passez à la vue Éditeur pour corriger les noms ou le jargon incorrects. Les modes Lecteur (horodatages par ligne) et Éditeur (texte brut) sont disponibles. Les exportations utilisent la dernière version que vous avez éditée.

Combien de langues la transcription prend-elle en charge ?

Plus de 50 langues, y compris l’anglais, l’espagnol, le français, l’allemand, le portugais, le russe, l’ukrainien, le japonais, le chinois, l’arabe, et bien d’autres. La détection automatique fonctionne pour la plupart des fichiers, ou vous pouvez choisir la langue manuellement dans le formulaire de téléchargement pour les clips courts.

Puis-je traduire la transcription ?

Oui. Après la transcription, cliquez sur Traduire et choisissez parmi 28 langues cibles. La traduction est disponible dans la vue Lecteur et dans chaque format d’exportation. Les horodatages sont conservés pour que le SRT traduit corresponde toujours à l’audio.

Quels formats d’exportation sont disponibles ?

TXT (texte brut), SRT (sous-titres), TXT horodaté et DOCX (document Word). Les utilisateurs enregistrés obtiennent également PDF, VTT (sous-titres web) et JSON. Tous les exports sont disponibles dans le menu de téléchargement après la fin de la transcription.

Déposez n’importe quel fichier audio et obtenez le texte
Gratuit. Pas d’inscription. Pas de limites sur le format.
Tout format Pas d’inscription Plus de 50 langues
Télécharger l’audio à transcrire

Plus d’outils de transcription