mictoo
AAC · ADTS · 生コーデックストリーム

AACからテキストへ
生ADTSストリーム、放送アーカイブ、リッピングされたオーディオ

生の.aacファイルは、放送ストリーム、ラジオキャプチャ、抽出されたメディアトラックから来ることがよくあります。ファイルをドロップすると、Mictooがその構造を検査し、Whisper large-v3で話された音声を文字起こしします。

無料
自動削除
50+ 言語
AI 要約 (OpenAI)
文字起こしとチャット

ファイルをここにドロップ

またはクリックして参照

MP3 · MP4 · WAV · M4A · OGG · WEBM · FLAC  ·  最大25MB  ·  最大30分

180分・サインイン

大きいファイル? 圧縮方法を見る。

長い録音? 分割方法を見る。

使い方

  1. 1

    ファイルをドロップ

    デバイスからアップロードまたはドラッグ&ドロップ。一般的な音声・動画フォーマットに対応。

  2. 2

    Whisper が音声を文字起こし

    Whisper large-v3 が私たちのバックエンドで動作し、自動句読点とセグメント別タイムスタンプを付与します。

  3. 3

    編集、エクスポート、共有

    文字起こしをレビュー、AI で要約、50 以上の言語に翻訳、TXT、DOCX、PDF、SRT で書き出し。

broadcast-audio.aac
完了·142 語
0:00 / 9分44秒
文字起こしを検索…
0:00あなたは朝のショーを聞いています。今は7時15分で、私たちは主要なストーリーに戻ります。
0:08市議会は、ほぼ3年の議論の末、新しい交通拡張を可決しました。
0:17この計画では、2つの新しいライトレールラインを追加し、既存のラインを約8マイル延長します。
0:27このことが日常の通勤者にとって何を意味するのかを解説するために、私たちはスタジオに交通レポーターを招いています。
0:37お招きいただきありがとうございます。見出しは、東行きの回廊が20年ぶりに鉄道オプションを得るということです。
0:47ラッシュアワーにその区間を運転している人にとって、これは本当に変革的です。
0:56建設は来春に始まり、最初の新しいラインは2029年に開通する予定です。
1:06市議会は、約40,000人の通勤者が新しい区間を利用すると見積もっています。

タイムスタンプ付きの見やすい行ごとのレイアウト。読むのに最適。

AAC文字起こしにMictooを選ぶ理由

生ADTSをネイティブに処理

ほとんどの生の.aacファイルはADTSフレーム(Audio Data Transport Stream)です。同期ワード0xFFFを検出し、ストリームをWhisperに渡します。

ADIFとLATMもサポート

あまり一般的ではないADIF(Audio Data Interchange Format)やLATMフレーミングも機能します。手動での再パッケージングやffmpegステップは不要です。

コンテナは不要

AACは通常M4AまたはMP4内に存在しますが、時には生のストリームがディスクに保存されることもあります。Mictooはどちらも要求せずに受け入れます。

アーカイブセグメントのAI要約

放送セグメント、ラジオアーカイブクリップ、またはストリーミングダンプ。AI要約により、アーカイブを迅速に整理できます。

AACからテキストへの適切なシナリオ

放送ラジオアーカイブ

生AACとして出荷されるHLSまたはIcecastストリームから録音されたセグメント。文字起こしによりアーカイブが検索可能になります。

HLSライブストリームキャプチャ

YouTube Live、Twitch、またはラジオHLSストリームが.aacチャンクシーケンスとしてキャプチャされます。ファイルをドロップし、テキストを取得します。

リッピングされたiPhoneオーディオ

iPhoneの録音または共有ファイルから抽出されたオーディオがM4Aコンテナを失い、生のAACとして出てきたものです。

ストリーミングサービスのエクスポート

生AACダウンロードを提供するポッドキャストプラットフォームまたはストリーミングアプリ。変換をスキップし、ファイルを直接ドロップします。

放送インタビュー

生AACとしてアーカイブされたラジオホストのインタビュー。文字起こしは、記事やショーの引用用コピーです。

FFmpeg中間出力

ffmpeg -c:a copyでオーディオトラックを抽出し、.aacを取得しました。最初にM4Aに再マルチプレックスする代わりにここにドロップしてください。

生AACとM4Aの比較

AACはオーディオコーデックです。.aacで終わるファイルは通常、生のフレーム化されたストリームですが、M4Aは通常、MP4コンテナ内にAACオーディオをラップし、シークやメタデータを持っています。

ADTSは一般的

生AACは、特にオーディオがストリームや放送ワークフローから抽出された場合、ADTSフレームとして一般的に保存されます。

M4Aはコンテナを追加

M4Aは、タイミング、インデックス付け、MP4ベースのコンテナによって提供されるメタデータを持つ同じAACコーデックを運ぶことができます。

拡張子は単なる手がかり

ファイル構造は処理中に検査されるため、誤解を招く拡張子は文字起こしテキストにはなりません。

放送ワークフロー

生AACは、HLSキャプチャやオーディオ抽出の後によく現れます。アーカイブコンテキストのために元のソース参照を保持してください。

よくある質問

MictooはどのようなAACファイルを受け付けますか?

生AACはADTSフレーミング(最も一般的)、ADIF、およびLATMフレーミングです。サーバー側で同期ワードを検出し、ストリームをWhisperに渡します。M4A内のAAC(M4Aページを参照)も機能しますが、異なる取り込み経路です。

.aacと.m4aの違いは何ですか?

.aacは通常、生のADTSビットストリームです:小さな7バイトヘッダーを持つAACフレーム、コンテナなし。.m4aは、メタデータとシークインデックスを持つMP4コンテナ内にラップされたAACオーディオです。どちらもAACコーデックを使用しますが、ファイル構造は異なります。

私のAACファイルは60MBを超えています。どうすればいいですか?

典型的な放送ビットレート(128 kbps)のAACは、1分あたり約1MBですので、60MBは約1時間の録音です。サインインしている場合、最大約3時間まで自動的に分割します。そうでない場合は、ダウンサンプルしてください:ffmpeg -i in.aac -b:a 64k -ac 1 out.aac。

生AACはM4Aよりも悪い文字起こしを生成しますか?

いいえ。オーディオストリームは同一で、コンテナだけが異なります。Whisperはどちらの方法でも内部的に16kHzモノに再サンプリングします。精度は、ADTSフレーミングかMP4ラッピングかに関係なく、基礎となる録音の品質に依存します。

Mictooは非英語のAACを文字起こししますか?

はい。Whisper large-v3は50以上の言語をサポートし、自動検出します。珍しいアクセントや短い放送クリップの場合、よりクリーンな初回結果を得るために言語を明示的に設定してください。

放送クリップのSRTキャプションを取得できますか?

はい。文字起こし後にSRTまたはVTTをダウンロードできます。タイムスタンプは元のAACストリームのタイムラインに合わせて、ビデオエディタ、アクセシビリティオーバーレイ、またはアーカイブインデックスに使用できます。

私のAACファイルはサーバーに保存されますか?

いいえ。オーディオは文字起こしプロバイダーにストリーミングされ、一度処理され、メモリから削除されます。ディスクに書き込むことはありません。文字起こしは、サインインして履歴に保存する場合のみ保存されます。

文字起こしを別の言語に翻訳できますか?

はい。文字起こし後にターゲット言語を選択し、翻訳をクリックしてください。翻訳はGPT-4o-miniで実行され、元のテキストと並んで表示されます。

ファイルが.aac拡張子を持っているが実際にはM4Aの場合、どうなりますか?

マジックバイトを検査します、拡張子ではありません。ファイルがftyp(M4A/MP4署名)で始まる場合、M4Aとして扱います。ADTS同期バイトで始まる場合、生AACとして扱います。どちらにしても、文字起こしは機能します。

AACの文字起こしにはどのくらいの時間がかかりますか?

10分のAACは通常、エンドツーエンドで15〜30秒で終了します。アップロード制限に近い大きなファイルは45〜80秒かかります。アップロード速度が長いステップになることがよくあります。

生のAACをドロップして文字起こしを取得
ADTS、ADIF、LATMフレーミング。放送アーカイブ、HLSキャプチャ、リッピングされたオーディオ。
登録不要 クレジットカード不要 50+ 言語
AACをアップロードして文字起こし

その他の文字起こしツール