文字起こしのための音声圧縮方法
By Denis·
Mictooは最大25 MBまでのファイルを無料で受け付けます。ファイルがそれ以上の場合、品質を損なわずに縮小する3つの方法があります。ファイルとスキルに合った方法を選んでください。
方法1: 動画ファイルから音声を抽出
動画ファイル(MP4, WEBM, MOV)が主に音声の場合、音声トラックは通常、動画よりも5〜10倍小さくなります。Mictooは音声のみを必要とし、動画は文字起こしに役立ちません。これはほとんどのユーザーにとって最速の解決策です。
オンライン(インストール不要)
当社のブラウザコンバーターを使用してください。ファイルをドロップすると、数秒でMP3が得られます。無料、サインアップ不要、透かしなし:
- MP4 to MP3 — 任意のMP4動画から音声を抽出します。
- WEBM to MP3 — YouTubeダウンロードや画面録画用。
- WAV to MP3 — 非圧縮WAVを管理しやすいMP3に縮小します。
コマンドライン(ffmpeg)
ffmpeg -i input.mp4 -vn -acodec copy output.m4a-vnはビデオを削除し、-acodec copyは音声品質をそのまま保持します。高速で再エンコードは不要です。
方法2: 音声のビットレートを下げる
ほとんどのポッドキャストや会議は128〜192 kbpsで録音されています。文字起こしには64 kbpsのモノラルで十分です。精度は変わらず、ファイルは2〜3倍小さくなります。長い音声ファイルに最適な方法です。
オンライン
再エンコードツールはまだホストしていませんが、ビットレートを下げる最も簡単な方法は以下のffmpegワンライナーです。GUIを好む場合は、Audacity(無料、すべてのプラットフォーム)がファイル → エクスポート → MP3としてエクスポートで64〜96 kbpsに設定できます。
コマンドライン(ffmpeg)
ffmpeg -i input.mp3 -ac 1 -b:a 64k output.mp3-ac 1はモノラルに変換し(音声はモノラルで問題ありません)、-b:a 64kは音声ビットレートを64 kbpsに設定します。
おおよその計算: 64 kbpsで約28 MB/時間です。1時間のインタビューは約28 MBに収まり、ほぼ制限内です。-b:a 48kに下げると、約21 MB/時間で精度の目立った損失はありません。
方法3: 短い部分に分割
元の品質を保持する必要がある場合(法律、医療、アーカイブ)、ファイルを20〜25分のチャンクに分割し、それぞれを個別に文字起こしします。その後、任意のテキストエディタでトランスクリプトを結合します。
オンライン
ブラウザでの分割には、現在のサーバーレスコンバーターよりも多くの処理能力が必要です。現時点では、以下のffmpegワンライナーが最もクリーンな方法です。または、Audacityでファイルを開き、各領域を個別にエクスポートします。両方の方法をステップバイステップで説明した専用の長い音声ファイルを分割する方法ガイドをご覧ください。
コマンドライン(ffmpeg)
ffmpeg -i input.mp3 -f segment -segment_time 1200 -c copy part_%03d.mp3入力を20分(1200秒)ごとの部分に分割し、part_001.mp3、part_002.mp3などの名前を付けます。その後、各ファイルをMictooにアップロードします。
その他の文字起こしツール