WebMからテキストへ
Loom、OBS、およびブラウザ画面録画用
WebMはLoomがエクスポートするものであり、OBSが新しいバージョンでデフォルトで録画するものであり、ブラウザがMediaRecorder APIを使用する際にアプリが生成するものです。ファイルをドロップすると、動画を削除し、音声を数秒で文字起こしします。
ファイルをここにドロップ
またはクリックして参照
MP3 · MP4 · WAV · M4A · OGG · WEBM · FLAC · 最大25MB · 最大30分
使い方
- 1
ファイルをドロップ
デバイスからアップロードまたはドラッグ&ドロップ。一般的な音声・動画フォーマットに対応。
- 2
Whisper が音声を文字起こし
Whisper large-v3 が私たちのバックエンドで動作し、自動句読点とセグメント別タイムスタンプを付与します。
- 3
編集、エクスポート、共有
文字起こしをレビュー、AI で要約、50 以上の言語に翻訳、TXT、DOCX、PDF、SRT で書き出し。
タイムスタンプ付きの見やすい行ごとのレイアウト。読むのに最適。
WebM文字起こしにMictooを選ぶ理由
サーバーサイドで処理されるWebM動画
動画トラックを保持したWebM画面録画。デマルクスし、動画を削除し、音声を文字起こしします。ローカル抽出は不要です。
OpusとVorbisの両方をサポート
ほとんどのWebMファイルはOpus音声(新しい)またはVorbis(古い)を持っています。両方のコーデックに対応し、手動変換は不要です。
ウォークスルー用のSRTキャプション
文字起こし後にSRTまたはVTTをダウンロードします。タイムスタンプは元のWebMに合わせているため、キャプションは画面録画に正確に一致します。
リリースノート用のAI要約
AI要約は、チケットの説明、リリースノート、またはウォークスルーを置き換えるために作成された非同期更新のための良い初稿です。
WebMからテキストへの適切なシナリオ
Loomウォークスルー
Loomで録画された製品デモ、コードレビュー、または非同期更新。トランスクリプトがチケット、ノーションドキュメント、またはフォローアップメールに役立ちます。
OBS画面録画
OBS Studioで録画されたチュートリアルまたはゲームプレイキャプチャ。トランスクリプトがYouTubeの説明やブログ記事になります。
ブラウザMediaRecorder出力
MediaRecorder APIを介してアプリが録音した音声。変換ステップなしでアプリが生成した.webmをドロップします。
Google MeetまたはFirefox録画
一部の会議ツールやブラウザはデフォルトでWebMに録画します。ファイルをドロップして、会話の検索可能なテキストバージョンを取得します。
非同期デザインレビュー
デザイナーがモックアップを説明するWebMを録画します。レビュアーは、視聴する前にスキミングできるように書面のトランスクリプトを受け取ります。
講義の画面キャプチャ
講師がナレーション付きのスライドを録画し、WebMとして共有します。学生はビデオと一緒に検索可能なトランスクリプトを取得します。
WebM録画について知っておくべきこと
WebMは、動画と音声の両方または音声のみを保持できるブラウザフレンドリーなコンテナです。ブラウザとレコーダーの設定により、どのトラックとコーデックが存在するかが決まります。
OpusまたはVorbis音声
最近のWebM音声録音はOpusを使用しています。古いファイルはVorbisを使用する場合があります。両方ともWebMコンテナ内にあります。
音声のみまたは動画付き
WebMには画面録画またはマイクトラックのみが含まれる場合があります。文字起こしは可聴音声ストリームを使用します。
タイムラインベースのエクスポート
トランスクリプトのタイムスタンプは、後の字幕や編集作業のためにデコードされた録音のタイムラインに従います。
ブラウザレコーダー出力
MediaRecorderの設定はブラウザによって異なります。キャプチャにマイクの許可がない場合、文字起こしする音声が含まれない可能性があります。
よくある質問
MictooはどのようなWebMファイルを受け付けますか?
標準的なWebM:OpusまたはVorbis音声付きの動画(Loom、OBS、ブラウザMediaRecorder)、または音声のみのWebM。サーバーサイドで音声トラックをデマルクスし、Whisper large-v3で文字起こしします。
最初に自分で音声を抽出する必要がありますか?
いいえ。WebM動画をそのままアップロードしてください。サーバーサイドでデマルクスし、音声トラックのみを文字起こしします。すでに音声(OpusまたはVorbis)を抽出している場合も、それで問題ありません。
私のLoomは60 MBを超えています。どうすればいいですか?
20〜30分のLoomはしばしば60 MBを超えます。サインインしている場合、長いファイルを約3時間まで自動分割します。そうでない場合は、Loomのダウンロード設定を使用して品質を下げるか、音声をエクスポートしてアップロードしてください。
タイムスタンプは私の画面録画と一致しますか?
はい。トランスクリプトのタイムスタンプとSRT/VTTエクスポートのタイムスタンプは元のWebMタイムラインに合わせているため、キャプションはビデオに戻すと正確に一致します。
ウォークスルー用のSRTキャプションを取得できますか?
はい。文字起こし後にSRTまたはVTTをダウンロードできます。ビデオ編集ソフト、YouTubeアップロード、またはLoom再レンダリングワークフローにドロップしてください。
Mictooは非英語のWebMを文字起こししますか?
はい。Whisper large-v3は50以上の言語をサポートし、自動検出が可能です。短い録音や非英語のコンテンツの場合、よりクリーンな初回結果を得るために言語を明示的に設定してください。
WebMに音声トラックがない場合はどうなりますか?
トランスクリプトは空になります。音声トラックがないWebMファイル(無音の画面録画、GIFスタイルのキャプチャ)には、Whisperが文字起こしするものがありません。
トランスクリプトを別の言語に翻訳できますか?
はい。文字起こし後にターゲット言語を選択し、翻訳をクリックしてください。翻訳はGPT-4o-miniで実行され、元の内容と並んで表示されます。
私のWebMファイルはあなたのサーバーに保存されますか?
いいえ。WebMは文字起こしプロバイダーにストリーミングされ、私たちはメモリ内でデマルクスして文字起こしを行い、その後すべてを削除します。トランスクリプトは、サインインして履歴に保存する場合のみ保存されます。
WebMの文字起こしにはどのくらい時間がかかりますか?
10分のLoomは通常、エンドツーエンドで20〜40秒で完了します。長いWebMファイル(30〜45分)は60〜90秒かかります。大きな画面録画のアップロード速度が長いステップになることがよくあります。