Lyria 3 от Google: как генератор музыки научился писать тексты песен

Lyria 3 от Google: как генератор музыки научился писать тексты песен

В мае 2026 года Google выкатила Lyria 3 — музыкальный генератор, который впервые создаёт не просто инструментальные биты, а полноценные песни с вокалом и осмысленным текстом по одному промпту. Модель работает в экосистеме Gemini и доступна через Google Flow Labs. Это прямой конкурент Udio и Suno, но с ключевым отличием: Lyria 3 нативно интегрирована с мультимодальными возможностями Gemini — можно загрузить фото или видео, и нейросеть напишет под него саундтрек.

Разбираем пять практических сценариев, где Lyria 3 меняет подход к созданию аудиоконтента.

1. Генерация фоновой музыки для видео по кадру

Загружаете в чат Gemini кадр из вашего ролика — например, таймлапс заката над городом. Пишете промпт: «Атмосферный эмбиент-трек на 60 секунд под это видео, без вокала, с нарастающей динамикой». Lyria 3 анализирует визуальный ряд (цветовую гамму, темп движения, настроение) и генерирует трек, который синхронизируется с видео.

Это работает для блогеров, продакшн-студий и маркетологов, которым нужна уникальная музыка без риска копирайт-страйков. Базовая версия Lyria 3 бесплатна и создаёт отрывки до 30 секунд, версия Pro (доступна подписчикам Gemini Advanced) генерирует треки до 2 минут с куплетами, припевами и бриджем.

2. Создание песен с текстом по сюжету

Lyria 3 умеет писать не только мелодию, но и слова. Промпт может выглядеть так: «Инди-рок песня про выгорание программиста, куплет-припев-куплет-припев-бридж, мужской вокал, tempo 120 bpm». Модель генерирует трек с осмысленным текстом на английском, китайском, японском, испанском, французском или корейском.

Кириллица официально не заявлена, но по отзывам пользователей Lyria 3 справляется с русским текстом, если явно указать язык в промпте. Качество вокала — на уровне студийной записи, без роботизированных артефактов. Это закрывает задачу создания демо-треков для музыкантов или джинглов для рекламы.

3. Адаптация музыки под настроение сцены

Сценарий для монтажёров и геймдев-команд: загружаете в Gemini скриншот игровой локации или кадр из фильма, описываете нужное настроение — «Тревожный саундтрек для сцены погони, оркестровые струнные, crescendo к концу». Lyria 3 создаёт трек, который точно попадает в эмоциональный тон сцены.

Ключевое преимущество перед Udio и Suno — нативная мультимодальность. Вам не нужно отдельно описывать визуал словами: модель видит изображение и сама извлекает из него контекст. Это экономит время на формулировке промпта и повышает точность результата.

4. Генерация звуковых эффектов для видео

Lyria 3 умеет создавать не только музыку, но и звуковые эффекты — шаги, шум дождя, звук мотора. Это работает через связку с видеогенератором Veo 3.1: если вы генерируете видео с помощью Veo, Lyria автоматически добавляет синхронный звук. Но можно использовать и отдельно: загружаете видео без звука, пишете промпт «Добавь звук шагов по гравию и фоновый шум леса» — и получаете готовый аудиотрек.

Это закрывает задачу озвучки анимаций, explainer-видео и рекламных роликов без покупки звуковых библиотек.

5. Быстрое прототипирование музыкальных идей

Для музыкантов Lyria 3 — это инструмент быстрого скетчинга. Вы формулируете идею трека одним предложением, получаете готовый 30-секундный отрывок за 10–15 секунд, слушаете, корректируете промпт и перегенерируете. Вместо часов в DAW на поиск аранжировки — несколько итераций в чате.

Результат можно экспортировать в стерео WAV 44.1 кГц и доработать в Ableton или FL Studio. Lyria 3 не заменяет композитора, но резко ускоряет этап поиска направления и настроения трека.

Как начать работать с Lyria 3

Lyria 3 доступна в веб-версии Gemini, мобильном приложении и через Google Flow Labs — закрытую платформу для экспериментов с мультимодальными связками. Базовая версия бесплатна, лимит — 30 секунд на трек. Для доступа к Lyria 3 Pro (треки до 2 минут, приоритетная генерация) нужна подписка Gemini Advanced.

Из России доступ возможен через VPN или через сторонние агрегаторы API. В GEMERA AI Lyria 3 пока не интегрирована, но вы можете попробовать другие инструменты для работы с аудио и мультимодальные модели Gemini для генерации изображений и текста — всё в одном Telegram-боте и веб-кабинете.