Audio in Testo
Una pagina per qualsiasi formato audio
Carica MP3, M4A, WAV, FLAC, OGG, AAC, WebM e altro. Ottieni una trascrizione pulita con timestamp, riepilogo AI ed esportazioni.
Trascina il tuo file qui
o clicca per sfogliare
MP3 · MP4 · WAV · M4A · OGG · WEBM · FLAC · Max 25 MB · Max 30 min
Come funziona
- 1
Carica qualsiasi file audio
Carica dal tuo dispositivo o trascina e rilascia. MP3, M4A, WAV, FLAC, OGG, AAC, WebM e altro.
- 2
Whisper trascrive l’audio
Whisper large-v3 funziona sul nostro backend con punteggiatura automatica, interruzioni di paragrafo e timestamp per segmento.
- 3
Modifica, esporta, condividi
Rivedi la trascrizione, riassumi con AI, traduci in oltre 50 lingue ed esporta come TXT, DOCX, PDF o SRT.
Layout più pulito per linea con timestamp. Ideale per la lettura.
Perché un unico strumento audio-in-testo è migliore
Nessun passaggio di conversione
Carica direttamente qualsiasi formato audio. Risparmia tempo e mantieni la qualità originale, senza passaggi di conversione con perdita.
Rilevamento automatico del formato
Mictoo rileva il formato dall’intestazione del file e applica le migliori impostazioni di trascrizione per quel codec.
Stessa precisione su tutti i formati
Alimentato da Whisper large-v3 per una precisione costante, che il tuo file sia MP3, WAV, FLAC o WebM.
Riepilogo ed esportazioni inclusi
Ottieni riepiloghi AI, traduci in oltre 50 lingue ed esporta come TXT, SRT, VTT o DOCX. Nessun piano aggiuntivo.
Quando questa pagina è adatta
Archivi a formato misto
Un caricamento per tutti i tuoi file, qualunque sia il dispositivo di registrazione.
Formato file sconosciuto
Non sei sicuro di cosa abbia prodotto il tuo registratore. Lo rileviamo e lo trascriviamo.
Trascrizione veloce
Risultati rapidi senza configurazione, convertitori o selezione manuale del formato.
Flussi di lavoro cross-tool
Carica file esportati da Zoom, Descript, Audacity, GarageBand o qualsiasi DAW.
Utenti alle prime armi
Nessuna registrazione, interfaccia semplice, gratuito. Un primo tentativo sicuro prima di impegnarsi in qualsiasi strumento.
Test della qualità audio
Controlla la chiarezza e vedi quanto testo utilizzabile puoi ottenere da una registrazione grezza.
La qualità dell’audio conta più del formato del file
Come Mictoo rileva il tuo formato
1010
Leggiamo l’intestazione del file (byte magici) per identificare immediatamente il tuo formato. Questo garantisce le migliori impostazioni per una trascrizione accurata e significa che non devi mai scegliere manualmente il formato.
Formati audio supportati
| Formato | Fonte comune | Ideale per | Caricamento diretto |
|---|---|---|---|
| MP3 | Registratori, podcast, download | Uso generale, file piccoli | |
| M4A | Memo vocali iPhone, app Apple | Alta qualità, dimensioni efficienti | |
| WAV | Registrazioni, esportazioni DAW | Non compresso, audio professionale | |
| FLAC | Archivi musicali, alta fedeltà | Qualità senza perdita | |
| OGG | Registrazioni open source, app | Web e streaming | |
| AAC | Registrazioni mobili, streaming | Qualità e dimensioni bilanciate | |
| WebM | Registrazioni web, browser | Video e audio online |
Cosa sapere su ogni formato
Nessuno di questi necessita di conversione prima del caricamento. Le note qui sotto sono le cose che effettivamente mettono in difficoltà le persone, per formato.
MP3
Il formato predefinito per registratori, download di podcast e qualsiasi cosa condivisa tramite chat. Compresso, piccolo e leggibile ovunque.
- Cosa accettiamo
- Qualsiasi bitrate da 32 kbps in su, mono o stereo, CBR o VBR. Nessuna ricodifica prima della trascrizione
- Bitrate e precisione
- Sopra circa 64 kbps per il parlato, più bitrate non aiuta. Whisper risample a 16 kHz mono internamente comunque
- Bitrate variabile
- I file VBR a volte riportano la durata sbagliata nei lettori più vecchi. Questo non influisce sulla trascrizione o sui timestamp
- Tag ID3
- Ignorati durante la trascrizione. La trascrizione ritorna come testo semplice, quindi mantieni la mappatura dei metadati degli episodi nel tuo sistema
M4A
Non un codec ma un contenitore: audio AAC, occasionalmente ALAC, all’interno di un wrapper MP4. Questo è ciò che ti dà un iPhone.
- Come lo leggiamo
- Analizziamo il box ftyp, estraiamo la traccia AAC e la passiamo a Whisper senza ricodifica
- Da dove proviene
- Memo vocali iPhone, GarageBand, FaceTime, download di Apple Podcasts
- Da un iPhone
- Condividi il memo, salva su File o iCloud, quindi carica. Nessun passaggio di conversione necessario
- ALAC all’interno
- Alcuni file .m4a contengono Apple Lossless invece di AAC. Entrambi funzionano qui, e nessuno ha bisogno di essere convertito prima
WAV
PCM non compresso. I file più grandi che caricherai e la fonte più pulita, anche se il rumore ambientale conta ancora più del formato.
- Cosa accettiamo
- PCM a 16, 24 e 32 bit, qualsiasi frequenza di campionamento, mono o stereo, oltre a Broadcast Wave (BWF)
- Metadati BWF
- I chunk bext e iXML che trasportano timecode, scena e take vengono letti oltre, non bloccati. Non appaiono nella trascrizione
- Avviso di dimensione
- Circa 10 MB al minuto a qualità CD, quindi una registrazione stereo di 25 minuti supera già il limite anonimo
- Riducilo prima
- Esportare in mono a 64 kbps non perde nulla per il parlato e riduce il file di 10 a 15 volte
FLAC
Compressione senza perdita, circa la metà delle dimensioni dello stesso WAV. Comune negli archivi di storia orale e nei flussi di lavoro di registrazione sul campo.
- Cosa accettiamo
- FLAC nativo (byte magici fLaC) e FLAC all’interno di un contenitore OGG, mono o stereo, fino a 192 kHz, 16 o 24 bit
- Nessuna conversione necessaria
- Il file passa direttamente. Convertirlo prima in MP3 perderebbe solo informazioni
- Commenti Vorbis
- Ignorati durante la trascrizione. Se il tuo archivio si basa su quei tag, mantieni la mappatura al di fuori della trascrizione
- Vale la dimensione?
- Per la precisione, no. FLAC e un buon MP3 trascrivono allo stesso modo. Mantieni FLAC come copia di conservazione, non perché Whisper ne ha bisogno
WEBM
Un contenitore Matroska, di solito contenente audio Opus, a volte Vorbis. Questo è ciò che producono i browser e i registratori di schermo.
- Da dove proviene
- Loom, OBS, l’API MediaRecorder del browser, esportazioni di Google Meet, download di YouTube
- Video all’interno?
- Demuxiamo, eliminiamo la traccia video e trascriviamo l’audio. Niente da estrarre dalla tua parte
- Codec
- Opus su qualsiasi file recente, Vorbis su file più vecchi. Entrambi gestiti senza conversione
- Perché il file è grande
- Le registrazioni dello schermo sono per lo più video. Un WEBM da 20 MB spesso trasporta solo 3 o 4 MB di audio
Domande frequenti
Quali formati audio posso caricare?
MP3, M4A, WAV, FLAC, OGG, AAC, WebM, MP4, MOV, oltre a AIFF, AU, OPUS e MPEG. Se il tuo file si riproduce in un normale lettore multimediale, Mictoo può trascriverlo. Anche i file video sono accettati, estraiamo la traccia audio lato server.
Quanto tempo richiede la trascrizione?
Di solito pochi secondi. Un file audio di 10 minuti si completa in circa 15 a 30 secondi; un podcast di 60 minuti è pronto in circa un minuto. I file più lunghi che vengono suddivisi automaticamente richiedono un po’ più di tempo poiché i segmenti vengono trascritti in parallelo e uniti.
La trascrizione audio è davvero gratuita?
Sì. Trascrizione gratuita fino a 25 MB per file senza registrazione. Un account gratuito aumenta il limite per file a 60 MB, e i file fino a 180 MB vengono suddivisi automaticamente in segmenti e uniti in una singola trascrizione. Nessuna carta di credito, nessun costo nascosto.
I miei file audio vengono memorizzati?
No. I file vengono trasmessi direttamente al fornitore di riconoscimento vocale (Groq per velocità, con Replicate, Deepgram e OpenAI come fallback), elaborati e poi eliminati. Mictoo non conserva l’audio e i fornitori non addestrano sui dati API.
Il formato del file influisce sulla precisione?
La qualità dell’audio conta molto più del formato. Un discorso pulito in un MP3 compresso verrà trascritto meglio di un audio rumoroso in un WAV non compresso. Mictoo esegue lo stesso modello Whisper large-v3 su ogni formato, quindi la precisione rimane costante su tutti i tipi supportati.
Devo convertire il mio audio in un formato specifico prima?
No. Questo è il punto di questa pagina. Carica qualsiasi cosa il tuo registratore, DAW, telefono o strumento di download abbia prodotto. Rileviamo il formato dall’intestazione del file e lo indirizziamo direttamente a Whisper. Nessun passaggio di conversione, nessuna perdita di qualità.
Posso modificare la trascrizione prima di scaricarla?
Sì. Dopo la trascrizione, passa alla vista Editor per correggere eventuali nomi o gerghi errati. Sono disponibili le modalità Lettore (timestamp per linea) ed Editor (testo semplice). Le esportazioni utilizzano la versione che hai modificato per ultima.
Quante lingue supporta la trascrizione?
Oltre 50 lingue tra cui inglese, spagnolo, francese, tedesco, portoghese, russo, ucraino, giapponese, cinese, arabo e molte altre. Il rilevamento automatico funziona per la maggior parte dei file, oppure puoi scegliere manualmente la lingua nel modulo di caricamento per clip brevi.
Posso tradurre la trascrizione?
Sì. Dopo la trascrizione, clicca su Traduci e scegli tra 28 lingue di destinazione. La traduzione è disponibile nella vista Lettore e in ogni formato di esportazione. I timestamp vengono preservati, quindi l’SRT tradotto corrisponde ancora all’audio.
Quali formati di esportazione sono disponibili?
TXT (testo semplice), SRT (sottotitoli), TXT con timestamp e DOCX (documento Word). Gli utenti registrati ottengono anche PDF, VTT (sottotitoli web) e JSON. Tutte le esportazioni sono disponibili dal menu Download dopo che la trascrizione è completata.