この記事について海外で公開された情報をもとにAIが要約・解説した記事です。原文の翻訳ではありません。正確な内容は記事末尾の出典元をご確認ください。
この記事の要点
  • Stability AIが音楽プロ向けAIツール事業へ軸足を移し、パーカー氏とCEOのアッカラジュ氏が主導
  • ソニー、ワーナー、ユニバーサルなどから7600万ドルを調達し、楽曲カタログの学習利用も許諾
  • 音声モデル3種と音楽編集ソフトを公開、鼻歌やビートボックスで操作する更新を予定

何が発表されたのか

画像生成AIで知られるStability AIが、音楽分野に事業の軸足を移しつつある。ナップスターの共同創業者であるショーン・パーカー氏は、米メディアのThe Informationに対し、今回は音楽業界のルールに従って取り組むと述べたという。同氏は2年前、経費の使い過ぎと内部の混乱によって創業者のエマド・モスタク氏が退任する事態に陥った同社の、8000万ドル規模の救済に加わった。現在は、長年の友人でCEOに就任したプレム・アッカラジュ氏とともに、準備してきた内容を公表する段階にある。

同社が目指すのは、音楽のプロフェッショナル向けAIツールの定番の供給元になることだとパーカー氏は説明している。2026年8月下旬には、ソニー、ワーナー、ユニバーサルのほか複数の出資者から7600万ドルの資金調達を発表した。この契約には、3社が自社の楽曲カタログを学習用データとしてライセンスしたことも含まれる。

公開された機能

資金調達の発表後、Stability AIは3つの新しい音声モデルと、AIを使った音楽編集ソフトを公開した。これらのAIは、テキストで指示を与えると、インストゥルメンタルの楽曲全体や短い断片を生成できる。パーカー氏によれば、今後のアップデートでは、利用者が鼻歌でメロディーを歌ったり、ビートボックスでドラムのパターンを口で再現したりして、生成結果を誘導できるようになるという。

生成した音源を完成品として前提にしているのか、編集の素材として位置づけているのかは、原文では明確にされていない。テキストからの生成と、声や口音による操作という2つの入力方法を用意することで、音楽制作の現場で使われることを狙っているとみられる。

Napsterの教訓と権利処理

パーカー氏は、かつてNapsterを通じて音楽業界に大きな影響を与えた当事者である。今回のインタビューでは、当時の「許可を取るより先に行動して許しを請う」という姿勢はうまくいかなかったと自ら認めたうえで、今回はルールを守ると述べたとされる。

今回の枠組みでは、大手音楽3社が楽曲カタログを学習用にライセンスしている点が特徴的である。権利者から事前に許諾を得たうえで学習データを使う形をとることで、生成AIをめぐる著作権の議論を避けつつ、プロ向け用途での信頼を得ようとしているとみられる。

現時点で不明な点

一方で、公開された音声モデルの名称や性能、生成できる楽曲の長さや品質については、原文では触れられていない。料金体系や提供地域、対応言語も明らかにされていない。日本から利用できるかどうか、また既存の画像生成モデルの事業が今後どうなるのかも、この記事からは判断できない。

今回の動きは、音楽生成AIの商用利用において、権利者とのライセンス契約が前提になりつつあることを示す一例とみられる。具体的な契約条件や、生成物の権利の扱いがどうなるかは、今後の発表を待つ必要がある。

Stability AIへの2回の資金提供の比較
項目2年前の救済2026年8月の調達
金額8000万ドル7600万ドル
主な出資者原文に記載なしソニー、ワーナー、ユニバーサルなど
特徴経営難に陥った同社の救済楽曲カタログの学習ライセンスを含む

今後の見通し

今後、具体的なモデル名や性能、料金、提供地域が公表されれば、日本企業が採用を検討できるかどうかを判断しやすくなる。鼻歌やビートボックスで操作できるアップデートが実際にいつ提供されるのかも焦点になる。また、ソニー、ワーナー、ユニバーサルとのライセンス契約が、生成物の商用利用や権利の配分をどう定めているのかが明らかになれば、音楽生成AIのビジネスの型として他の企業にも影響を与えるとみられる。Stability AIの画像生成事業が今後どう扱われるかも、次に確認すべき点である。

日本の開発者・IT企業にとっての意味

音楽生成AIは、これまで権利処理の曖昧さが商用利用の壁になってきた。今回のように大手音楽3社から事前にカタログのライセンスを受けて学習する枠組みが広がれば、日本企業が音楽生成AIをサービスに組み込む際の判断材料になる。動画制作、ゲーム、広告などの分野で、権利関係が明確な音源を生成できる選択肢が増える可能性がある。一方で、提供地域や価格、APIの有無は現時点で不明であり、すぐに日本の開発現場で使えるとは限らない。Stability AIは画像生成で知られた企業であり、同社が音声・音楽へ資源を移すことで、既存の画像生成モデルの開発ペースやサポートに影響が出るかどうかも注視したい。自社サービスへの組み込みを検討する場合は、ライセンス条件と生成物の利用範囲の確認が欠かせない。

気になる点

Stability AIの音楽生成AIは日本から使えて、料金はいくらですか。
原文では提供地域や料金に言及がないため、現時点では公表されていないとみられます。2026年8月下旬に発表されたのは7600万ドルの資金調達で、その後に3つの音声モデルと音楽編集ソフトが公開されました。日本での提供可否や価格は、今後の公式発表を確認する必要があります。
学習データの著作権はどう処理されていますか。
ソニー、ワーナー、ユニバーサルの3社が自社の楽曲カタログを学習用にライセンスしたと原文に記されています。権利者から事前に許諾を得る形ですが、個別の契約条件や生成物の権利の帰属までは示されていません。
どんな操作で楽曲を作れますか。
テキストで指示すると、インストゥルメンタルの楽曲全体や短い断片を生成できます。さらに今後のアップデートで、鼻歌でメロディーを歌ったり、ビートボックスでドラムのパターンを口で再現したりして生成を誘導できるようになる予定だとパーカー氏は述べています。

用語解説

音声モデル
テキストなどの指示から音や楽曲を生成するAIモデル。ここではStability AIが新たに公開した3種類を指す。
ビートボックス
口で打楽器の音をまねる発声技法。これをAIへの入力指示に使えるようにする更新が予定されている。
楽曲カタログのライセンス
著作権者から許諾を得て、保有する楽曲群をAIの学習データとして使う契約のこと。
画像生成AI
テキストなどから画像を生成するAI。Stability AIの従来の主力分野にあたる。

出典

Sean Parker is rebuilding Stability AI around music

TechCrunch / Connie Loizos / 2026年10月3日

https://techcrunch.com/2026/10/02/sean-parker-is-rebuilding-stability-ai-around-music

AI導入も顧問も、お任せください

何から手をつけるか、どこまでAIに任せるか。自社の業務に合わせて整理し、導入から運用まで伴走します。相談だけでも構いません。

AI導入について相談する