AI ボイス分離
録音をアップロードして、ノイズの中から声だけを取り出す。音楽、風、車の音、反響は消え、話した言葉はそのまま残ります。
MP3、WAV、M4A · 最長 15 分
アップロードすることで、この録音の権利を所有しているか、処理の許可を得ていることを確認したものとみなします。
話し声の録音向けです。曲からボーカルを分離するにはボーカルリムーバーを使ってください。
どちらかのトラックをタップすると同じ位置で切り替わります。あなたの結果もこのようになります。
01—なぜ分離するのか
録り直すより、声を分離すべき理由
インタビュー、ロケでのナレーション、リモート通話に共通する問題がひとつあります。欲しいテイクは、すでに録ってしまったテイクだということ。ボイス分離はまさにその状況のためにあります。録り直しを求めるのではなく、今ある録音を救います。
二度と戻らないテイク
ゲストは帰り、セットは片付けられ、演技は完璧だったのにエアコンだけが鳴っていた。録り直しには時間がかかるだけでなく、その演技そのものが失われます。ボイス分離は、話した内容を残し、部屋が加えた音だけを取り除きます。
後工程すべてがクリーンになる
クリーンな音声トラックは聴きやすいだけではありません。字幕はより正確に文字起こしされ、ボイスクローンのサンプルはより本人に近いクローンになり、ボイスチェンジャーがノイズを声と誤認することも減ります。まずボイス分離を通せば、その後の工程すべてが良くなります。
それでも録り直すべきとき
ノイズ除去はマイクが捉えた音に対してしか働きません。声そのものがクリップしていたり、二人が同時に話していたり、話者の声が車の音より小さかった場合、録音されなかったものはどんな分離ツールでも復元できません。そうしたケースは録り直しが必要です。
インストール不要
AI ボイス分離はブラウザで動作します。プラグインもデスクトップアプリもオーディオドライバも必要ありません。
どのデバイスでも
Windows、macOS、Linux、iPad、スマートフォン。ウェブページを開いてファイルを読める端末なら、声を分離できます。
演技はそのまま
間、息づかい、強調はそのまま残ります。消えるのは背景だけです。
02—基礎知識
ボイス分離とは?
ボイス分離(voice isolator)は、録音の中の人の話し声を、それ以外のすべて(音楽、風、車の音、キーボードのクリック音、部屋の反響)から切り分け、声だけのクリーンなトラックを出力する AI ツールです。ノイズゲートや EQ と違い、周波数を削るのではなく、声そのものを認識します。
ボイス分離 vs. ノイズリダクションフィルター
ノイズフィルターは周波数で働きます。ヒスノイズやハムが存在する帯域を見つけて、そこを下げます。問題は、話し声も同じ帯域にあること。歯擦音はこもり、語尾はノイズと一緒に削られてしまいます。
ボイス分離は話し声がどんな音かを学習しており、周波数ではなく内容で分離します。だからこそ、声とほぼ完全に重なる背景音楽も取り除けるのです。フィルターにはできないことです。
ボイス分離 vs. ボーカルリムーバー
この二つは正反対の仕事をします。ボーカルリムーバーは曲から歌声を取り除き、カラオケやカバー用にインストゥルメンタルを残します。ボイス分離は話し声を残してそれ以外を取り除き、ポッドキャスト、動画、ナレーションに使います。
どちらが必要?
話している人の声が欲しいなら、このページが正しいツールです。歌手のいない曲が欲しいなら、ボーカルリムーバーを探してください。
03—使い方
3 ステップで声を分離
すべての処理はこのページのブラウザ上で完結します。インストール不要、待ち行列なし、別画面に隠されたエクスポート手順もありません。
- 1
アップロードまたは録音
MP3、WAV、M4A ファイルをドロップするか、マイクから直接録音します。最長 15 分まで対応。アップロードが終わった瞬間に、長さと消費クレジットが表示されます。
- 2
分離
「声を分離」を押します。処理時間はたいてい録音の長さのほんの一部です。処理中は波形が左から右へクリーンになっていき、聴く前にノイズフロアが消えていく様子を確認できます。
- 3
比較してダウンロード
ひとつの再生ヘッドの下に、オリジナルと声のみの 2 トラックが表示されます。任意の瞬間に切り替えて何が変わったかを確かめ、分離した声を MP3 でダウンロードします。
対応フォーマットと制限
MP3、WAV、M4A、OGG。1 ファイルあたり最大 50 MB、最長 15 分。出力は MP3 です。上限により処理時間とコストが予測可能になります。長い素材は自然な区切りで分割し、それぞれ分離してください。
04—聴いて確かめる
ダウンロードの前に、違いを聴く
多くのボイス分離ツールはダウンロードリンクを渡して、判断はあなた任せ。プレイヤーを二つ開いて行ったり来たりすることになります。ここでは、オリジナルと結果がひとつの再生ヘッドの下に並びます。
ひとつの再生ヘッド、二つのトラック
どちらかのトラックをタップすると、もう一方が同じ秒数から再生を続けます。頭からやり直しではありません。ボイス分離が何を取り除き、何を残したかを見分ける最速の方法です。
聴くべきポイント
確認するのは三つ。息づかいと歯擦音が残っているか、文末が短くなっていないか、部屋の響きが消えているか。最後の点は最初は違和感があるかもしれませんが、それが正しい状態です。
文の途中で切り替え
クリップの先頭からではなく、気になるまさにその単語の位置でオリジナルと分離後を行き来できます。
納得してからダウンロード
クレジットは分離に使われ、試聴には使われません。保存する前に好きなだけ聴き比べてください。
05—活用シーン
クリーンにできる録音
ボイス分離は「話し声+不要な何か」という録音ならどれでも扱えます。特によく使われる四つの場面を紹介します。
ポッドキャストとインタビューの録音
エアコン、窓の外の街の音、机の下のキーボード、隣の部屋のテレビ。声を分離すれば、エピソード全体がブースで録ったように聞こえます。
ロケ撮影の動画ナレーション
風、車、人混みのざわめきは屋外撮影につきものです。ボイス分離がセリフからそれらを取り除くので、スタジオに戻って読み直す必要がありません。
クローン前の音声サンプル
クローンの質は、学習するサンプルの質で決まります。まず声を分離し、その結果から自分の声をクローンしてください。クローンが学ぶのはあなたの声であって、部屋の音ではありません。
古い録音や電話音質の録音
留守番電話、アーカイブのインタビュー、会議の録音。録音されなかった周波数を復元することはできませんが、その上に乗っているノイズは取り除けます。
できないこと
同時に話す二人を分けることはできず、かき消された言葉を取り戻すこともできず、通話中のリアルタイム機能でもありません。ボイス分離は、すでに手元にある録音に対して働きます。
06—比較
ボイス分離 vs. ボーカルリムーバー vs. ノイズフィルター
この三つの名前はしょっちゅう混同されますが、解決する問題はそれぞれ違います。表ひとつで整理します。
| ボイス分離 | ボーカルリムーバー | ノイズフィルター / EQ | |
|---|---|---|---|
| 出力 | 声のみ | インスト(声を除去) | 同じ音声、一部の帯域をカット |
| 対象 | 話し声 | 楽曲 | 何でも |
| 仕組み | 声を認識 | 声を認識 | 周波数をカット |
| 息づかい・歯擦音を保持 | 失われがち | ||
| 声の背後の音楽を除去 | |||
| 向いている用途 | ポッドキャスト、動画、ナレーション、クローン用サンプル | カラオケ、カバー | 軽いヒスノイズ |
話し声の背後に音楽がある場合、対処できるのは前の二つだけで、声を返してくれるのはボイス分離だけです。
07—ベストプラクティス
最もクリーンな結果を得るには
AI ボイス分離は、ほとんどの作業を自動で行います。三つの習慣で、出力は目に見えて良くなります。
分離後のトラックが「クリーンすぎる」と感じる理由
部屋の空気感はノイズと一緒に取り除かれます。モデルにとってはそれもノイズだからです。シーンに雰囲気が必要なら、編集ソフトでオリジナルのトラックを約 -20 dB で分離した声の下に混ぜ戻してください。ハムのない空間感が得られます。
録音全体を渡す
モデルはノイズがどんな音かを学ぶために数秒の文脈を必要とします。アップロード前にきつくトリミングすると、作業はかえって難しくなります。
冒頭に 1 秒の無音を残す
ファイルの先頭にある短い純粋なノイズ区間は、ボイス分離にとって最良の参照になります。
前処理をしない
すでに圧縮、ゲート、強い EQ をかけた音声は、損傷した話し声として扱われます。生のファイルをアップロードし、分離は一度だけ行ってください。
08—よくある質問
よくある質問
ボイス分離はどのプランに含まれますか?
すべての有料プランで、AI ボイスチェンジャーと同じレートで音声 1 分ごとにクレジットを消費します。無料アカウントでもファイルのアップロードとコスト確認はできますが、処理にはサブスクリプションが必要です。1 分あたりのレートは料金ページをご覧ください。
ボイス分離とは何ですか?
ボイス分離とは、録音の中の話し声を、音楽、車の音、部屋の反響など他のすべての音から切り分け、声だけを残す処理です。イコライザーと違い、周波数帯域を削るのではなく声そのものを識別します。
声の背後の音楽も取り除けますか?
はい。背景音楽は周波数フィルターでは対処できず、ボイス分離なら対処できるケースです。出力されるのは声であって音楽ではありません。インストゥルメンタルが欲しい場合はボーカルリムーバーが必要です。
息づかい、歯擦音、語尾が削られませんか?
削られません。それらを残すことこそ、ノイズフィルターとの最大の違いです。結果で単語が早く途切れて聞こえる場合、ほぼ確実に元の録音のその箇所で声がかき消されていたことが原因です。
対応フォーマットと長さは?
MP3、WAV、M4A、OGG。1 ファイルあたり最大 50 MB、最長 15 分です。分離した声は MP3 でダウンロードできます。
分離した声を自分の声のクローンに使えますか?
はい。サンプルを準備する最良の方法です。クリーンな音声トラックなら、クローンは部屋のノイズではなくあなたの声を学びます。分離が終わったら「クローンする」ボタンから続けてください。
iPhone の「声を分離」と同じものですか?
違います。iPhone の「声を分離」は通話中のリアルタイムなマイクモードで、話している間に適用されます。このボイス分離はすでにある録音を処理し、ブラウザのあるどの端末でも使え、スマートフォンの設定ではできない音楽の除去も行います。
録音は保存されますか?
分離した結果は後で再生・ダウンロードできるよう履歴に保存され、いつでも削除できます。アップロードした元ファイルは処理にのみ使用され、保持されません。
09—次のステップ
クリーンな声で、さらにできること
クリーンな声は出発点です。AnyVoice の他のツールはすべて、それによってより良く働きます。