動画ファイルをアップロードするだけで、音声だけを好きな形式・音質で書き出します。 トリミングや音量の自動調整にも対応し、演奏動画の音源化や会議・講義の音声保存に使えます。
このツールはブラウザの中だけで動いています。入力した内容が、外部に送信されることはありません。入力内容は外部に送信されません。
詳しく動画から音声だけを取り出したい時に。形式・音質を選べる抽出ツール
演奏動画や講義の録画、会議の録画など、「映像はいらないので音声だけが欲しい」という場面は意外と多くあります。しかし動画編集ソフトを使わずに音声だけを取り出すのは、標準のスマートフォンアプリやOSの機能だけでは難しいケースがほとんどです。
本ツールは、動画ファイルをアップロードするだけで音声トラックだけを抽出し、MP3・WAV・M4Aの好きな形式で書き出せるオンラインツールです。ビットレートやサンプルレート、モノラル・ステレオの切り替えにも対応し、用途に応じた音質とファイルサイズのバランスを選べます。
前後の不要な部分を取り除くトリミング機能、話者ごとの声の大小差を均す音量の自動正規化機能も備えており、「取り出してすぐ使える音声」として書き出すことができます。
こんなシーンで便利です
演奏動画・弾き語り動画から音源だけを取り出して練習
楽器の練習や弾き語りの練習で、動画から音声だけを取り出してスマートフォンや音楽プレイヤーに入れ、繰り返し聞きながら練習したい場合に使えます。
会議・講義の録画から音声だけを保存
Web会議や授業の録画データから、映像を除いた音声だけをコンパクトに保存しておきたい場合に。モノラル・低ビットレートを選べば容量を大きく抑えられます。
語学学習のリスニング教材を音声だけで持ち歩く
動画教材から音声部分だけを取り出し、通勤・通学中にスマートフォンの音楽アプリでリスニング練習をしたい場合の素材作りに使えます。
ポッドキャストやラジオ風コンテンツの素材作り
動画形式で収録した対談や雑談から音声のみを抽出し、ポッドキャストやボイスメディアへの投稿用音源として書き出す用途に使えます。
使い方は簡単 4ステップ
- 音声を取り出したい動画ファイルをドラッグ&ドロップ、またはクリックして選択します。
- 必要であれば「抽出する範囲」のスライダーで、音声として書き出したい部分だけに絞り込みます。
- 出力形式(MP3/M4A/WAV)とビットレート、サンプルレート、モノラル・ステレオを選択します。
- 「この設定で音声を抽出」を押すと、設定に沿って音声ファイルが生成されるので、再生して確認のうえダウンロードします。
※処理はすべてブラウザ内で完結し、動画データがサーバーに送信されることはありません。
ご利用時の注意点
- 処理にかかる時間は動画の長さやお使いの端末の性能によって変動します。長い動画や高解像度の動画では数分かかることがあります。
- WAV形式は無劣化で保存できる一方、同じ長さでもMP3・M4Aに比べてファイルサイズが大きくなりやすい点にご注意ください。
- 出力サイズの見積もりは、サンプルレート・チャンネル数などの設定値から算出した目安です。元動画の音声仕様によって実際の数値と前後することがあります。
- 完全無料・安全:処理はすべて端末内で完結し、アップロードした動画データが外部サーバーに送信・保存されることはありません。
用途別のおすすめ設定早見表
「結局どの設定を選べばいいかわからない」という方向けに、代表的な用途別のおすすめ組み合わせをまとめました。
| 用途 | 形式 | ビットレート | チャンネル |
|---|---|---|---|
| 会議・講義の記録 | MP3 | 128kbps | モノラル |
| 語学学習のリスニング教材 | MP3 | 128〜192kbps | モノラル〜ステレオ |
| 演奏動画・弾き語りの音源化 | MP3 または M4A | 256〜320kbps | ステレオ |
| 編集ソフトへの取り込み・無劣化保存 | WAV | (無圧縮のため設定不要) | ステレオ |
| ポッドキャスト・音声配信素材 | M4A | 192〜256kbps | モノラル〜ステレオ |
【形式選びの基本的な考え方】
迷った場合は、以下の基準で選ぶと失敗しにくくなります。
- とりあえず汎用的に使いたい: MP3を選べば、ほとんどの再生機器・アプリで問題なく再生できます。
- iPhone・YouTube系アプリ中心に使う: M4A(AAC)は同じビットレートでもMP3よりやや高音質とされています。
- 編集ソフトに取り込む・劣化させたくない: WAVを選べば、音質の劣化がない状態で保存できます。
※ビットレートを上げるほど音質は向上しますが、ファイルサイズも比例して大きくなります。保存先の容量やアップロード先の制限に合わせて調整してください。
動画から音声を抽出する際に知っておきたい形式・音質の基礎知識
MP3・WAV・M4Aの違いや、ビットレート・サンプルレートが音質にどう影響するかを解説します。
結論:迷ったらMP3、音楽ならM4Aかビットレートを上げたMP3、無劣化が必要ならWAV
動画から取り出した音声の使い道が決まっていない場合は、まず汎用性の高いMP3を選ぶのが無難です。
音楽的な用途で少しでも音質にこだわりたい場合はM4A(AAC)、またはMP3のビットレートを256〜320kbpsまで上げる選択肢があります。
編集ソフトへの取り込みや、将来的に再加工する可能性がある音声はWAV(無劣化)で保存しておくと、後工程での音質劣化を防げます。
ビットレートとサンプルレートはそれぞれ何を表しているのか
ビットレートは1秒あたりにどれだけの情報量を音声に割り当てるかを表す指標で、数値が高いほど音質が良くファイルサイズも大きくなります。
サンプルレートは1秒間に音を何回分割して記録するかを表す指標で、44.1kHzや48kHzが一般的な基準です。会話や講義が主な用途であれば、サンプルレートを16kHz〜22.05kHz程度まで下げても聞き取りやすさへの影響は小さく、ファイルサイズを抑えられます。
モノラル化で容量を抑える際の考え方
音楽や臨場感を重視する録音ではステレオ(左右の音)を活かすべきですが、1人または少人数の会話が中心の録音ではモノラル化してもほとんど聞き取りやすさは変わりません。
同じビットレートでもステレオからモノラルに変更するだけでデータ量をおよそ半分程度に抑えられるため、会議の記録やインタビュー音源など「とにかく容量を抑えたい」場合に有効な選択肢です。
音量のばらつきが気になる録音にはラウドネス正規化が有効
複数人が話す会議や、マイクとの距離が一定しない講義の録画では、話者によって録音された音量に大きな差が出ることがあります。
ラウドネス正規化(音量の自動平坦化)を適用すると、全体の音量感を一定の基準に揃えることができ、小さい声が聞き取りにくい、大きい声で音割れする、といった聞きづらさを軽減できます。
よくある失敗と対策
画質重視の動画をそのまま高ビットレートで抽出し、ファイルサイズが想定より大きくなる
4K撮影の動画など、映像の画質にこだわって撮影された動画でも、音声トラック自体の情報量はそれほど多くないことがほとんどです。それにもかかわらず高いビットレートを選んでしまい、会話程度の内容であれば不要に大きなファイルが出来上がってしまう失敗です。
💡 対策・解決策を見る▼
WAV形式を選んだまま長時間の音声を抽出し、保存先の容量を圧迫する
無劣化にこだわってWAV形式を選んだ結果、数時間規模の長い音声では数百MB〜1GBを超えるファイルサイズになり、スマートフォンやクラウドストレージの空き容量を大きく圧迫してしまう失敗です。
💡 対策・解決策を見る▼
音量の大小差が大きい録音をそのまま抽出し、再生環境によって聞き取りづらくなる
会議やインタビューの録画で話者ごとの声量が大きく異なるまま音声を抽出してしまい、イヤホンで聞くと小さい声が聞こえない、スピーカーで聞くと大きい声で音割れする、といった聞きづらさが残ってしまう失敗です。
💡 対策・解決策を見る▼
動画全体を抽出してしまい、不要な前置きや雑談部分まで音声に含まれてしまう
トリミングをせずに動画全体をそのまま音声化してしまい、本題に入る前の雑談や機材調整の時間まで音声ファイルに含まれ、聞き返す際に無駄な時間がかかってしまう失敗です。
💡 対策・解決策を見る▼
よくある質問(FAQ)
Q.MP3・WAV・M4Aはどれを選べばよいですか
A. 汎用性を重視するなら多くの再生機器・アプリに対応した「MP3」が無難です。iPhoneやYouTube系のアプリで扱う機会が多い場合は「M4A(AAC)」、音楽編集ソフトへの取り込みや無劣化での保存を重視する場合は「WAV」を選ぶとよいでしょう。WAVは容量が大きくなりやすい点にご注意ください。
Q.ビットレートはどれを選べばよいですか
A. 会話や講義、ナレーションなど声がメインの音声であれば128kbps前後でも十分な聞き取りやすさを確保できます。演奏や音楽、歌ってみた動画など音質を重視したい場合は192〜320kbpsを選ぶことをおすすめします。ビットレートを上げるほど音質は良くなりますが、ファイルサイズも大きくなります。
Q.モノラルとステレオの違いは何ですか、どちらを選ぶべきですか
A. ステレオは左右別々の音を再生でき、音楽や臨場感のある録音に向いています。モノラルは左右の音を1つにまとめるため、同じビットレートでもファイルサイズを抑えやすく、会議の録音やインタビュー、講義など声のみの用途であれば聞き取りやすさを保ったまま容量を小さくできます。
Q.「音量を自動で平坦化」はどのような時に使うとよいですか
A. 話者によって声の大小差が大きい会議や、場面によって音量が急に変わる動画から音声を取り出す際に有効です。ラウドネス正規化という処理を行い、全体の音量感を一定の基準に揃えることで、小さすぎる部分が聞き取りにくい、大きすぎる部分で音が割れる、といった聞きづらさを軽減します。
Q.長い動画でも音声だけを抽出できますか、処理にはどれくらい時間がかかりますか
A. はい、数時間規模の長い動画にも対応していますが、処理時間はお使いの端末の性能や動画の長さに応じて数十秒から数分程度かかる場合があります。処理中はブラウザを閉じずにそのままお待ちください。一部分だけ必要な場合は、トリミング機能で範囲を絞ると処理時間を短縮できます。
Q.アップロードした動画データが外部に送信される心配はありませんか
A. 一切ありません。本ツールは音声の抽出・変換処理をすべてユーザーのブラウザ内だけで実行する完全ローカル処理型です。動画ファイルが外部サーバーへアップロードされたり保存されたりすることはなく、ページを閉じればデータは即座に消去されます。
Q.演奏動画や歌ってみた動画から、音源だけを取り出して練習に使えますか
A. はい、ご利用いただけます。楽器の練習や弾き語りの練習で「音だけを繰り返し聞きたい」という場合に、動画から音声だけを取り出してスマートフォンや音楽プレイヤーに取り込むといった使い方ができます。語学学習でリスニング教材の音声部分だけを取り出す用途にも活用できます。
あなたの声で、
このツールをより鋭く。
「こんな機能が欲しい」「ここを直してほしい」といったご意見や、新しいツールのリクエストを募集しています。エンジニアが直接目を通し、開発の参考にさせていただきます。