ツール一覧に戻る
Stable Audio
Stable Audio は、テキストから商用利用可能な完全な音楽トラックや効果音を素早く生成できる、Stability AI のオープンソース音声生成モデルです。
ツール概要
[採用判断] 2026年半ばのコミュニティテストやチュートリアルから、Stable Audio 3 は実際のローカル利用段階に達しつつあり、LoRAカスタマイズやクロスプラットフォーム展開の実証が進んでいます。ただし長尺音声の安定性にはさらなる実用検証が必要です。 [実用機能] テキストから音楽や効果音を生成、長さ調節可能(Small 約2分、Medium 最大6分20秒)、専用SFXモデル、音声編集・補完、かつLoRAで個人スタイルの微調整が可能。出力はライセンスデータで訓練されており、ユーザーが完全に所有し商用利用可能です。 [導入障壁とコスト] モデル重みはオープンソース(公式・コミュニティ発表)、MacBook Mシリーズ(コミュニティ実証:M5 Proで59倍リアルタイム)やCPUのみの環境でも稼働(ワンクリックランチャー)。コストは自前ハードのみで生成制限なし。オンラインAPIの価格は未公表(保守的に、オープンモデル自体は無料)。 [対象ユーザー] カスタマイズ可能で著作権的に安全な音声を必要とするインディーズミュージシャン、動画制作者、ゲーム開発者など、ある程度の技術操作ができるクリエイター向け。完全初心者やワンクリックツールを求める人、Sunoのような歌声付き楽曲生成ツールを期待する人には不向きです。むしろ「音声版 Stable Diffusion」としてのオープンな基盤モデル+ツールキットです。