オーディオ分離ツールとオーディオ抽出ツール: どちらのツールが必要ですか?
オーディオ分離器とオーディオ抽出器を比較し、その出力を理解し、ダイアログ、音楽、エフェクト、またはフル ミックスに適切なワークフローを選択します。

オーディオ分離ツールとオーディオ抽出ツールの選択は、最終的には 1 つの質問になります。完全なサウンドトラックが必要か、それともその部分を個別に編集する必要があるかです。オーディオ抽出ツールは、混合されたサウンドトラック全体をビデオから 1 つのオーディオ ファイルとして取り出します。オーディオ分離器は、ダイアログ、音楽、エフェクトなどの個別のソースを混合して推定する分析を行います。ミックス自体が資産である場合は抽出します。 1 つの部品を取り外し、交換、洗浄、または他の部品を変更せずに再利用する必要がある場合は、分離します。
この区別は簡単に思えますが、これにより、サウンドトラックを抽出した後、音声、スコア、アンビエンス、音響効果が依然として融合していることが判明するという、よくある行き止まりを防ぐことができます。
重要なポイント
- 抽出により、成果物はビデオとオーディオからオーディオのみに変更されます。サウンドトラックはアンミックスされません。
- ソースを分離すると、個別に編集可能なステムが作成されますが、サウンドが重なっていると、かすかな残留物やアーティファクトが残る場合があります。
- ダイアログ/音楽/エフェクトの分割は、基本的なボーカル/楽器の分割よりも多くのビデオ編集に役立ちます。
- 実際に必要なファイルを生成する最も軽量なワークフローを使用してください。
- 新しい編集に取り組む前に、元のミックスを保持し、難しいトランジションを確認してください。
オーディオセパレーターとオーディオエクストラクターの概要
| 決定点オーディオ抽出ツールオーディオセパレーター | ||
| 主な仕事 | 画像を含まない完全なサウンドトラックを保存します | 音源を推定して別々のステムに分割する |
| 典型的な結果 | 1 つの混合オーディオ ファイル | ダイアログ、音楽、エフェクトなどの複数のファイル |
| ベストフィット | リスニング、文字起こし入力、ポッドキャスト再利用、アーカイブコピー | リスコア、アフレコ、セリフ分離、リミックス、サウンドデザイン |
| 組み合わせたものは何でしょうか? | オリジナルミックスのすべてのサウンド | 理想的には何もありませんが、クロスステムの残留物が多少残る場合があります |
| 編集制御 | 世界的な変化はサウンドトラック全体に影響を与える | 各ステムは個別にミュート、置換、または再バランスすることができます。 |
| 主なトレードオフ | 個々のソースを制御できない | さらなる処理と品質レビューの必要性 |

オーディオ抽出ツールが実際に行うこと
ビデオファイルは画像と音声を一緒に運ぶことができます。抽出すると、サウンドトラックの音声のみのバージョンが生成されます。 「オーディオの抽出」、「ビデオからオーディオへ」、「ビデオから MP3」などと呼ばれることもありますが、中心となる操作は同じであり、混合されたオーディオは混合されたままになります。
製品デモにナレーション、BGM、キーボードのクリック音、部屋の雰囲気が含まれている場合、抽出されたファイルには 4 つすべてが含まれます。画像をオフにしても、音楽を個別に編集できるようにはなりません。
通常、次のことを行う場合は、抽出が直接選択されます。
- ビデオを見ずに講義やインタビューを聞く。
- 完全なサウンドトラックを文字起こしまたはキャプションのワークフローに送信します。
- 音声のみのレビュー コピーを作成します。
- あなたの権利と編集上のチェックを条件として、ビデオ ポッドキャストをオーディオ エピソードとして再利用します。
- さらに変更を加える前に、元のミックスを保存してください。
これらのタスクについては、Recapo のツールから始めてください。 ビデオから音声を抽出する ツール。ソース分離を追加すると、実際のニーズを解決することなく、余分なファイルと余分なレビュー手順が作成されます。
オーディオセパレーターの違い
オーディオ分離器は ソース分離 を実行します。サウンドトラックを 1 つの完成したオブジェクトとして扱うのではなく、どの部分が異なる音源に属しているかを推定し、個別に編集できるステムを生成します。
レカポさん オーディオセパレーター 現在、ビデオ指向のダイアログ/音楽/エフェクトの分割と、よりシンプルなボーカル/楽器のオプションを提供しています。 「背景」は 1 つのものではないため、3 つの部分に分割することが重要です。音楽は置き換えが必要な場合がありますが、足音、拍手、インターフェイスの音、交通量、部屋の雰囲気などは編集に残すべきです。
次のような場合に分離を選択してください。
- 会話を維持しながらバックグラウンドミュージックを置き換えます。
- ダビングする前に元の音声を下げるか削除します。
- よりクリーンな編集またはレビューパスのために音声を分離します。
- スコアを変更しながらエフェクトとアンビエンスを維持します。
- ダイアログ、音楽、エフェクトのバランスを個別に再調整します。
- 音楽中心のワークフロー向けにボーカルと楽器のステムを作成します。
ソースの分離は、隠されたスタジオトラックを復元することと同じではありません。モデルは、すでに混合された波形から機能します。スピーチと音楽が周波数を共有したり、リバーブがそれらを結びつけたりすると、ステムにかすかなにじみ、緩和されたトランジェント、または水っぽい質感が含まれることがあります。 Recapo の公式ページでは、この結果はロスレスの「アンミックス」ではなく、有用な分離であると説明されています。
この決定ワークフローを使用する
1. 最終成果物を定義する
最後に必要なものを書きます。 「このビデオからの音声ファイル」は抽出を指します。 「音楽のない声」または「オリジナルのナレーションのない雰囲気」は分離を示しています。
2. 何を変更する必要があるかを個別に特定する
すべての編集がサウンドトラック全体に適用される場合 (オーディオのみのファイルへの変換など)、サウンドトラックを分割しないでください。 1 つのソースをミュート、置換、翻訳、または再バランスし、別のソースを維持する必要がある場合は、独立したステムが必要です。
3. 適切な分割を選択する
ダイアログ/音楽/エフェクトを再スコアリング、ローカリゼーション、ビデオのサウンド デザインに使用します。レコーディングが基本的に歌である場合、または 2 つのステムの音楽ワークフローだけで十分な場合は、ボーカル/インストゥルメンタルを使用します。
4. ストレスポイントをプレビューする
大音量の音楽の上の声、スピーチの下の拍手、リバーブのかかった歌の音節、会話中の鋭い効果など、ソースが強く重なり合う瞬間を聞いてください。必要なステムと削除する予定のステムの両方にチェックを入れます。 1 つの出力だけを試聴すると、残留物が最も見逃しやすくなります。
5. オリジナルを保持し、慎重にエクスポートする
ミックスはそのまま保存しておきます。分離されたステムによって有用な詳細が失われた場合、オリジナルが参照となるため、慎重に編集することで短い領域を復元できる場合があります。

例: 音楽を置き換えますが、ダイアログとエフェクトはそのままにします
ナレーション、ミュージック ベッド、インターフェイスのクリックを含むチュートリアル ビデオを想像してください。音楽を新しいキャンペーンで再利用することはできませんが、音声パフォーマンスとクリックは引き続き役立ちます。
エクストラクターを使用すると、3 つの要素すべてを含む 1 つのファイルが得られます。音楽を全体的に下げようとすると、音声とクリック音も変化します。オーディオ セパレーターは、ダイアログ、音楽、エフェクト ステムを生成できます。音楽ステムをミュートし、ダイアログとエフェクトを保持し、代替トラックを追加して、元のミックスに対して新しいミックスのバランスを取ることができます。
同じロジックがダビングにも当てはまります。元の会話を音楽やエフェクトから分離し、会話以外のステムを基礎として使用し、新しい音声録音を追加します。元の音声の残留物がないか、特に話者が大音量のエフェクトと重なっている場合の結果を確認します。
抽出、分離、ノイズ低減は互換性がありません
これら 3 つの操作により、さまざまな問題が解決されます。
- 抽出 では、成果物から画像が削除されますが、完全なサウンド ミックスは保持されます。
- 分離 では、ダイアログ、音楽、エフェクトなどのソースごとにミックスを分割します。
- ノイズ リダクション は、トラック内の不要なノイズ、特に比較的安定したノイズを抑制します。
屋外でのインタビューに音声、音楽、風が含まれているとします。抽出すると、ノイズの多いサウンドトラックが完全に得られます。分離すると会話が音楽から分離される可能性がありますが、風は同じマイクでキャプチャされているため、会話の幹に依然として存在する可能性があります。ノイズリダクションは、その安定したテクスチャを抑制するのに役立つ可能性があります。突然のクラクションやドアがバタンと閉まる音は異なります。Recapo と Audacity の公式ガイダンスはどちらも、一回限りの音や不規則な音は一般的なノイズ リダクションでは除去するのが難しく、対象を絞ったタイムラインやスペクトル編集が必要になる場合があると述べています。
より使いやすいステムを入手する方法
利用可能な最良のソースから開始する
エクスポートを繰り返したり、強力な圧縮を行ったりすると、ソースを区別するためにセパレーターが使用する詳細がぼやける可能性があります。所有している最も古い、最もクリーンな許可されたファイルを使用してください。
必要な場合を除き、分離前の混合処理は避けてください。
広範なイコライゼーション、圧縮、またはノイズ除去により、複数のソースを一度に変更できます。不要な問題が主に 1 つのステムに属している場合は、最初に分離します。次に、そのステムのみを処理します。例外もあるので、短い難しいセクションで両方の順序を比較してください。
文脈に応じて判断する
ソロ化されたステムでは明白に聞こえるかすかなアーティファクトは、保持されたステムを再結合すると消える場合があります。逆に、ステムだけではクリーンに聞こえる場合、編集全体ではアンビエンスが欠けていることが明らかになる場合があります。ソロとフルミックスの再生を確認します。
すべてを過度に加工するのではなく、短期間の修復を使用する
5 分間の録音のうち 2 秒間に残留物が発生した場合は、ファイル全体に強力な処理を適用するのではなく、その領域を修復します。小さなフェード、オートメーション、またはオリジナル ミックスからのパッチの方が自然に聞こえる場合があります。
クイック選択チェックリスト
これらがすべて当てはまる場合は、オーディオ抽出ツールを選択してください。
- 音声のみのファイルが 1 つ必要です。
- オリジナルミックスは許容されます。
- ダイアログ、音楽、エフェクトを個別に変更する必要はありません。
次のいずれかに該当する場合は、オーディオ セパレータを選択してください:
- 音楽なしで対話が必要です。
- オリジナルの声がなくても音楽や雰囲気が必要です。
- 個々のソースのダビング、再スコア、リミックス、またはリバランスを計画しているとします。
- 2 ステムまたは 3 ステムの出力は、次の編集ステップに一致します。
よくある質問
音声を抽出することは音声を分離することと同じですか?
いいえ。抽出により、完全な混合サウンドトラックの音声のみのコピーが作成されます。分離により、その混合物から複数の発生源が生じていると推定されます。
オーディオ抽出ツールで BGM を削除できますか?
それ自体ではありません。抽出されたサウンドトラックには音楽がまだ含まれています。音楽と音声を独立して編集可能にする必要がある場合は、ソース分離を使用します。
オーディオセパレーターは完全にきれいなステムを生成しますか?
いつもではありません。強いオーバーラップ、圧縮、リバーブ、および同様の周波数コンテンツはにじみやアーティファクトを残す可能性があります。出力をプレビューし、元のミックスを保持します。
文字起こしの前に音声を分離する必要がありますか?
音声がすでに明瞭である場合は、抽出されたフルミックスで十分な場合があります。音楽やエフェクトが音声の邪魔をする場合は、対話ステムの方がより良い入力になる可能性がありますが、それでもリスニングチェックが必要です。
ノイズリダクションは分離の代わりになるのでしょうか?
いいえ、ノイズリダクションは不要なノイズ特性をターゲットとしています。通常、ダイアログ、音楽、エフェクトステムは作成されません。解決するように設計された問題に対して各プロセスを使用します。
編集内容に合わせたツールを選択する
完全なサウンドトラックが必要な場合は、抽出を使用します。サウンドトラックに独立して移動する必要があるパートが含まれている場合は、分離を使用します。編集で個別のダイアログ、置き換える音楽、または保存されたエフェクトが必要な場合は、Recapo を試してください。 オーディオセパレーター、すべてのステムをプレビューし、元のミックスを参照として保存します。