AIで音声や動画の背景ノイズを軽減。録音ファイルをアップロードし、有料プランでより明瞭な音声をダウンロードできます。
元の音声には、マイクが拾ったすべての音が残っています。分離後のバージョンは声だけを残し、それ以外を取り除きます。両方を再生して、ご自身で判断してください。
画面のイメージです。実測結果や再生可能なサンプルではありません。
インタビュー、フィールド録音、画面収録など、100 MBまでのファイルに対応。スマホの録音でも問題なく使えます。
話し声を、部屋の環境音、車の音、うなり音、音楽から切り離します。ビフォー・アフターのプレーヤーで聴き比べられます。
すぐに編集、文字起こし、公開に使えます。元のファイルは残しておきましょう。上書きしてしまうと、音声分離は元に戻せません。
しきい値やノイズプロファイルの設定は不要です。アップロードしてボタンを押すだけ。設定はひとつだけで、最初からオンになっています。
2つのプレーヤーと2つの波形が縦に並ぶので、結果を確定する前に何が取り除かれたかを聴いて確認できます。
クリアになったファイルをそのまま編集ソフトに取り込むか、音声文字起こしに渡してより正確な文字起こしを得られます。
アップロードされる音声の多くは、騒がしい場所で録ったボイスメモです。まさにそうした録音のために作られています。
エアコンのうなりやノートPCのファン音は、エピソード全体の下で鳴り続けています。これを取り除くと、どんなEQよりも聴感上の品質が向上します。
街頭インタビューは録り直せません。車の音を取り除けば、使えなかった回答が使えるようになります。
すべての文字起こしを録音と照合してください。音質、アクセント、重なる発話、雑音、名前、専門用語によって誤りが生じます。
デジタル化したカセットテープのヒスノイズや操作音。その下にある声は、多くの場合、思っている以上に復元できます。
録音には、話している人、その人がいた部屋、そのとき起きていたほかの出来事など、マイクが同時に拾ったすべての音が混ざっています。音声分離は、特定の周波数を下げて声が残ることを期待するのではなく、それらの層を分けて話し声だけを残します。
そのため、ノイズゲートとは動作が異なります。ゲートはしきい値を下回る音をすべてカットするので、言葉の小さな語尾まで切れてしまいます。分離処理は何が声で何が声でないかを理解しているので、言葉は欠けずに残ります。
つまり、結果はフィルターをかけたファイルではなく、まったく別のファイルになります。元のファイルは残しておきましょう。インタビューに臨場感を与えていたわずかな部屋の空気感など、残したかったものがクリーンなバージョンで失われた場合でも、上書きした録音から作り直すのではなく、元に戻れるようにしておくためです。
理想的なのは、車の音、エアコン、ファンのうなり、テープのヒスノイズ、部屋の環境音といった一定の背景ノイズです。これらは変化が少ないため、システムがきれいに分離でき、たいていは別の録音のように聞こえる仕上がりになります。
直せないのは、そもそも正しく録音されていない声です。音が大きすぎてピークが失われた激しいクリッピングは、その情報がファイルにもう存在しないため復元できません。マイクから極端に離れた声や、強い風の吹かれ音も同様に困難です。また、2人が同時に話している声を分けることもできません。音声分離が分けるのは声と背景であり、話者どうしではありません。
実用上の目安として、音声分離は、使える声が埋もれている録音を改善するものです。もともと存在しない声を作り出すことはできません。選べるのであれば、あとからどれだけノイズを除去するよりも、マイクを近づけて録るほうが今でも効果的です。
音声分離は別途カウントされず、すべての有料プランに含まれます。ほかの作業内容に合わせてプランを選んでください。
すべてのアカウントに、補充されない100文字の無料枠が1回分付与されます。カードは不要です。AI音声を始める趣味のユーザー向け。
毎週コンテンツを公開するクリエイター向け。
最もよく除去できるのは、車の音、エアコン、ファンのうなり、テープのヒスノイズ、一般的な部屋の環境音といった一定の背景ノイズです。話し声の下に流れる音楽も、通常は大幅に軽減されます。ドアを閉める音や咳などの突発的な音は、声の背後にあるのではなく時間的に声と重なるため、結果が予測しにくくなります。
目指しているのは、同じ人がより静かな部屋で話しているように聞こえる声です。分離処理は何が話し声かを理解しているため、語尾を切ってしまうノイズゲートとは違い、言葉の小さな語尾も残ります。声に重なる非常に強いノイズがあると、わずかなアーティファクトが残ることがあります。ビフォー・アフターのプレーヤーで確認してください。
MP3、WAV、M4A、MP4に対応しており、1ファイルあたり100 MBまでです。動画も使えます。音声トラックが処理され、音声として返されます。
処理時間は入力サイズ、選択したモデル、プロバイダーの稼働状況によって異なります。
アップロードと結果はアカウント履歴に保存されます。アカウントデータの削除はcontact@illumind.softwareへ依頼してください。プロバイダーの保存方針や法的義務により消去が制限される場合があります。
いいえ。分離するのは声と背景であり、話者どうしではありません。2人が同時に話している場合、両方とも「声」として残ります。VoiceMateは現在、話者ラベルの付与に対応していません。誰が何を話したかを知りたい場合は、専用の話者分離ツールをご利用ください。