Soundrawは、Generative AIを利用してクリエイターがロイヤリティフリーのトラックを制作できる音楽生成プラットフォームである。2020年にDaigo Uemuraによって設立されたこのサービスは、ライセンスの複雑さを伴わずにカスタマイズ可能な背景音楽を必要とするコンテンツクリエイター、ビデオ編集者、ポッドキャスターを対象としている。ウェブベースのアプリケーションとして運営され、ユーザーはジャンル、ムード、長さなどのパラメータを選択して楽曲を生成し、インタラクティブなエディタを通じて出力を微調整できる。
このプラットフォームは、楽曲の個々の要素に対する詳細な制御を提供することで、初期のAI音楽ツールとは一線を画している。単に完全なトラックを生成するのではなく、Soundrawは楽曲をメロディ、リズム、楽器編成などの構成要素に分解し、ユーザーがリアルタイムで調整できるようにしている。このアプローチにより、Soundrawはクリエイティブな専門家向けに設計されたArtificial intelligenceツールの広範なトレンドの中に位置づけられ、OpenAIやGoogle DeepMindがテキストや画像の生成モデルを探求してきた方法と類似している。
技術と機能
Soundrawの基盤となるシステムは、音楽作品の大規模なデータセットで訓練されたMachine learningモデルに依存している。このプラットフォームは、ユーザーの入力に基づいてオリジナルのメロディ、ハーモニー、ビートを生成する独自のアルゴリズムを使用している。オーディオ波形を直接生成するDeep learningモデルとは異なり、Soundrawはより構造化されたアプローチを採用し、MIDI風のシーケンスを生成してから高品質のバーチャルインストゥルメントでレンダリングする。
主な機能は以下の通りである:
- カスタマイズ:ユーザーは、生成されたバリエーションから選択することで、トラックのイントロ、コーラス、ブリッジなどの個々のセクションを編集できる。
- ムードとジャンルのフィルター:30以上のジャンルと多数のムードタグ(例:「ハッピー」「サッド」「エピック」)により、正確なターゲティングが可能。
- リアルタイムプレビュー:変更は即座に適用され、迅速な反復が可能。
- ロイヤリティフリーのライセンス:生成されたすべての音楽は、帰属表示なしで商用プロジェクトで使用でき、サブスクリプションモデルで無制限のダウンロードが可能。
エディタのインターフェースは簡素化されたデジタルオーディオワークステーションに似ているが、音楽の専門知識は必要ない。このアクセシビリティにより、Soundrawは迅速で合法的な背景スコアを必要とするYouTuberやソーシャルメディアのコンテンツクリエイターの間で人気を博している。
ビジネスモデルと市場での位置づけ
Soundrawはフリーミアムモデルで運営されている。無料ユーザーはトラックを生成してプレビューできるが、最終的なオーディオファイルをダウンロードするには月額サブスクリプションを支払う必要がある。2024年現在、価格帯は個人向け月額16.99ドルから、ステム(各楽器の個別オーディオトラック)などの追加機能を備えた商用利用向け月額29.99ドルまでとなっている。同社は東京に本社を置き、地元のベンチャーキャピタル企業からシード資金を調達している。
AI音楽生成の市場は2020年代初頭以来急速に成長しており、競合にはAIVA、Amper Music、Mubertなどが含まれる。Soundrawは、単純な生成を超えた編集機能によって差別化を図っている。OpenAIのJukebox(2020年リリース)やGoogle DeepMindのMusicLMなどの後のモデルが生のオーディオ合成に焦点を当てていた一方で、SoundrawのMIDIベースのアプローチは、プロフェッショナルな使用に対してより実用的な制御を提供する。
倫理的および法的な考慮事項
Soundrawは、生成されたすべての音楽がオリジナルであり、既存の著作権作品から派生していないことを保証することで、著作権に関する懸念に対処している。トレーニングデータはロイヤリティフリーおよびパブリックドメインの作品で構成されており、他のAI音楽サービスを悩ませてきた法的問題を回避している。例えば、2023年には、いくつかのAI音楽生成サービスが、トレーニングデータセットでの著作権曲の無断使用をめぐってレコードレーベルから訴訟を起こされた。Soundrawはクリアされたデータのみを使用する方針により、クリエイターの間で良好な評判を維持している。
また、このプラットフォームは、特定のアーティストを強く模倣する音楽の生成を防ぐための保護措置も実施している。これは、Melanie MitchellやBrian Christianなどの研究者が議論しているように、クリエイティブ分野におけるGenerative AIの倫理的ガイドラインを確立するための業界全体の取り組みと一致している。
開発と今後の方向性
Soundrawは技術の進化を続けている。2023年には、インストゥルメンタルトラックを超えて、ユーザーが歌われるメロディを生成できるAI搭載のボーカル機能を導入した。また、チームはAdobe Premiere ProやFinal Cut Proなどのビデオ編集ソフトウェアとの統合を、ワークフローを合理化するプラグインを通じて探求してきた。
今後、Soundrawはより高度なNeural networkアーキテクチャを組み込むことを目指しており、Large language modelと同様のTransformer (architecture)モデルを使用して、音楽の一貫性と感情表現を向上させる可能性がある。また、同社は開発者向けのAPIアクセスを提供することにも関心を示しており、これによりサードパーティのアプリケーションがその音楽生成機能を埋め込むことができるようになる。
評価と影響
Soundrawは、テクノロジー出版物やコンテンツクリエイターコミュニティから肯定的なレビューを受けている。批評家はその使いやすさと出力の品質を賞賛しているが、音楽が人間が作曲したスコアと比較して時折一般的に聞こえることがあると指摘する人もいる。このプラットフォームはYouTubeクリエイターやポッドキャスター向けのガイドで取り上げられており、商用音楽のライセンス取得に代わる費用対効果の高い選択肢として推奨されることが多い。
2024年現在、Soundrawは100万人以上の登録ユーザーを主張し、1000万以上のトラックを生成している。その成功は、画像用のMidjourneyやテキスト用のChatGPTなどのツールが日常的な制作における生成モデルの使用を標準化した、AI支援による創造性への広範なシフトを反映している。ユーザーコントロールと法的安全性に焦点を当てたSoundrawは、AI駆動のコンテンツ作成ツールの拡大する市場での継続的な成長に向けて良い位置づけにある。