Adobe Firefly превращается в аудиостудию для создания музыки, голосов и звуковых эффектов с помощью искусственного интеллекта

Новые инструменты «Generate Music», «Generate Speech» и «Generate Sound Effects» завершили этап тестирования и теперь доступны всем пользователям. Компания Adobe реагирует на растущее давление рынка и устраняет разрыв между цифровой обработкой изображений и профессиональным производством аудиоконтента. Эти инструменты позволяют напрямую интегрировать полноценные звуковые ландшафты в существующие рабочие процессы, не тратя время на поиск подходящих аудиодорожек. Недавний опрос, проведённый Беркли-колледжем музыки, подтверждает этот спрос: 80 процентов авторов публикуют видеоконтент несколько раз в неделю, и все они используют музыку.
ИИ-аудио с акцентом на разрешение коммерческого использования
Adobe называет «правовые гарантии» стратегическим преимуществом своего набора инструментов на базе ИИ. В то время как многие свободно доступные генераторы на базе ИИ, по имеющимся данным, работают в «серой зоне» с точки зрения законодательства, Adobe гарантирует, что контент, сгенерированный Firefly, может использоваться в коммерческих целях в рамках собственной модели лицензирования. Функция «Generate Music» создаёт индивидуальные музыкальные треки, «Generate Speech» преобразует сценарии в записи синтетического голоса, а «Generate Sound Effects» генерирует звуковые эффекты, подходящие для отдельных сцен видео.



Нацеленность на Suno, Udio и ElevenLabs
Этим шагом Adobe бросает прямой вызов признанным лидерам в данной области. В сфере музыки, созданной с помощью искусственного интеллекта, в настоящее время доминируют такие платформы, как Suno и Udio, которые способны генерировать чрезвычайно сложные композиции, однако сталкиваются с серьезными судебными исками со стороны музыкальной индустрии из-за неясных данных обучения. Adobe сознательно позиционирует себя как более безопасную с юридической точки зрения альтернативу для коммерческого производства.
ElevenLabs по-прежнему остаётся бесспорным эталоном в области синтеза речи, особенно когда речь идёт об эмоциональных и естественно звучащих голосах. Эта лондонская компания приложила значительные усилия для укрепления этой позиции, что нашло отражение и в её последней оценке стоимости, составляющей около 22 миллиардов долларов. Однако конкуренция обостряется по мере того, как на рынок выходят OpenAI, Google и Microsoft со своими собственными моделями синтеза речи. Adobe придерживается иного подхода. Вместо того чтобы сосредоточиваться исключительно на достижении максимально возможного качества голоса, компания органично объединяет инструменты редактирования, работы с изображениями, видео и аудио в едином интерфейсе.
Firefly как платформа: интеграция сторонних моделей ИИ
Примечателен также стратегический поворот Adobe в отношении лежащих в основе моделей искусственного интеллекта. Компания больше не полагается исключительно на технологии собственной разработки, а интегрирует ведущие сторонние модели непосредственно в Firefly. Помимо специализированных видеомоделей Runway Aleph 2.0 и Kling 3.0, теперь доступна и модель Gemini Omni Flash от Google. Это превращает Firefly из закрытого инструмента в открытый хаб для ведущих на рынке творческих моделей.











