Adobeが、Adobe Fireflyのオーディオ機能である「音楽を生成」「音声を生成」「効果音を生成」の3つを、ベータ提供から一般提供へ切り替えました。生成した音源はいずれも商用利用に対応します。動画に合う楽曲、台本から起こしたナレーション、映像のタイミングに合った効果音までを、素材サイトを回らずにブラウザー上でまとめて用意できる形になりました。
3つのオーディオツールがようやく出そろいました
今回一般提供に切り替わったのは、音楽・音声・効果音の3種類です。それぞれ担当するモデルが分かれており、「音楽を生成」はAdobe Firefly Music Model、「効果音を生成」はAdobe Firefly Audio Modelが処理します。
音楽の方は、動画の長さや雰囲気に合わせてオリジナル楽曲を組み立てるという設計です。既成のBGMを尺に合わせて切り貼りする作業がなくなるので、動画編集の後工程がひとつ減る計算になります。効果音は、映像のアクションやタイミングに合わせた音を作る役割で、ライブラリを延々と検索して「惜しいけれど違う」を繰り返す手間を省く狙いがあります。
3つがばらばらに存在していたベータ期間と違い、同じFireflyの中で一通りそろったという点が今回の実質的な変化です。
ナレーションはモデルを選べます
「音声を生成」では、Adobe Firefly Speech ModelとElevenLabsのどちらを使うかを選べます。台本を入力するとナレーション音声が返り、声質だけでなく読み上げの速さや感情表現も調整できます。
音声合成の質は用途によって好みが分かれる部分なので、Adobe純正モデルと外部の専業モデルを同じ画面で切り替えられるのは実務的です。落ち着いた解説向けの声と、テンポよく煽る宣伝向けの声を、それぞれ得意なモデルに任せるといった使い分けも成立します。
効果音は自分の声でタイミングを伝えられます
効果音の生成で目を引くのが、テキストプロンプトと一緒に自分の声を録音して渡せる仕組みです。「ガラスが割れる音」と文字で書くだけでなく、実際に口で表現した音声を参照させると、その声のタイミングと強弱を手がかりに効果音が作られます。
自分の動画や音声ファイルをアップロードしておけば、指定した位置に効果音を差し込めます。複数の音を重ねて厚みのある環境音を作ることもでき、タイムライン上で位置と音量を後から動かせます。文字だけで狙った音にたどり着くのは難しいものなので、声で当たりを付けられる導線は理にかなっています。
商用利用を前提にした学習データ
Adobeが繰り返し強調しているのが、商用利用への対応です。効果音の生成モデルは使用許諾を受けたコンテンツとパブリックドメインのコンテンツで学習しており、出力はロイヤリティフリーとして扱われます。帰属表示は不要で、別途のライセンス料もかかりません。
生成AIの音源は、権利関係が曖昧だと納品先で使いにくいという事情があります。学習データの出所を明示したうえで商用可と言い切る姿勢は、SNS向けの短尺動画から製品チュートリアル、ポッドキャストまで、仕事として作る側にとっては判断材料になります。
AIアシスタントの日本語無料体験とGemini Omni Flashの追加
オーディオ機能と合わせて、Adobe Firefly AIアシスタントの日本語対応と、それに伴う無料体験プログラムも始まりました。対象ユーザーは毎日一定回数まで画像・動画・音声を無料で生成でき、この枠は通常のFirefly無料ユーザー向けの生成枠とは別に付与されます。試すだけなら手持ちのクレジットを削らずに済むということです。
さらに、Fireflyで使えるAIモデルにGoogleのGemini Omni Flashが追加されました。テキストに動画・音声・画像を添えたプロンプトを渡せるモデルで、アイデアをストーリーボードにまとめ、そのままファーストカットへ仕上げる流れが想定されています。Fireflyが自社モデル一本ではなく、外部モデルを並べて選ばせる方向に寄っているのが分かります。
まとめ
Fireflyのオーディオ機能が正式提供に入り、音楽・ナレーション・効果音を1つの環境で商用利用可能な形で用意できるようになりました。声でタイミングを指示できる効果音生成や、Speech ModelとElevenLabsの選択肢など、実際の編集作業を意識した作りが目立ちます。日本語対応のAIアシスタント無料体験も始まったので、まずは手元の動画に音を足すところから試してみるのが分かりやすいところです。
※画像はイメージです
