Lyria 3 от Google: как генератор музыки научился писать тексты песен

В мае 2026 года Google выкатила Lyria 3 — музыкальный генератор, который впервые создаёт не просто инструментальные биты, а полноценные песни с вокалом и осмысленным текстом по одному промпту. Модель работает в экосистеме Gemini и доступна через Google Flow Labs. Это прямой конкурент Udio и Suno, но с ключевым отличием: Lyria 3 нативно интегрирована с мультимодальными возможностями Gemini — можно загрузить фото или видео, и нейросеть напишет под него саундтрек.
Разбираем пять практических сценариев, где Lyria 3 меняет подход к созданию аудиоконтента.
1. Генерация фоновой музыки для видео по кадру
Загружаете в чат Gemini кадр из вашего ролика — например, таймлапс заката над городом. Пишете промпт: «Атмосферный эмбиент-трек на 60 секунд под это видео, без вокала, с нарастающей динамикой». Lyria 3 анализирует визуальный ряд (цветовую гамму, темп движения, настроение) и генерирует трек, который синхронизируется с видео.
Это работает для блогеров, продакшн-студий и маркетологов, которым нужна уникальная музыка без риска копирайт-страйков. Базовая версия Lyria 3 бесплатна и создаёт отрывки до 30 секунд, версия Pro (доступна подписчикам Gemini Advanced) генерирует треки до 2 минут с куплетами, припевами и бриджем.
2. Создание песен с текстом по сюжету
Lyria 3 умеет писать не только мелодию, но и слова. Промпт может выглядеть так: «Инди-рок песня про выгорание программиста, куплет-припев-куплет-припев-бридж, мужской вокал, tempo 120 bpm». Модель генерирует трек с осмысленным текстом на английском, китайском, японском, испанском, французском или корейском.
Кириллица официально не заявлена, но по отзывам пользователей Lyria 3 справляется с русским текстом, если явно указать язык в промпте. Качество вокала — на уровне студийной записи, без роботизированных артефактов. Это закрывает задачу создания демо-треков для музыкантов или джинглов для рекламы.
3. Адаптация музыки под настроение сцены
Сценарий для монтажёров и геймдев-команд: загружаете в Gemini скриншот игровой локации или кадр из фильма, описываете нужное настроение — «Тревожный саундтрек для сцены погони, оркестровые струнные, crescendo к концу». Lyria 3 создаёт трек, который точно попадает в эмоциональный тон сцены.
Ключевое преимущество перед Udio и Suno — нативная мультимодальность. Вам не нужно отдельно описывать визуал словами: модель видит изображение и сама извлекает из него контекст. Это экономит время на формулировке промпта и повышает точность результата.
4. Генерация звуковых эффектов для видео
Lyria 3 умеет создавать не только музыку, но и звуковые эффекты — шаги, шум дождя, звук мотора. Это работает через связку с видеогенератором Veo 3.1: если вы генерируете видео с помощью Veo, Lyria автоматически добавляет синхронный звук. Но можно использовать и отдельно: загружаете видео без звука, пишете промпт «Добавь звук шагов по гравию и фоновый шум леса» — и получаете готовый аудиотрек.
Это закрывает задачу озвучки анимаций, explainer-видео и рекламных роликов без покупки звуковых библиотек.
5. Быстрое прототипирование музыкальных идей
Для музыкантов Lyria 3 — это инструмент быстрого скетчинга. Вы формулируете идею трека одним предложением, получаете готовый 30-секундный отрывок за 10–15 секунд, слушаете, корректируете промпт и перегенерируете. Вместо часов в DAW на поиск аранжировки — несколько итераций в чате.
Результат можно экспортировать в стерео WAV 44.1 кГц и доработать в Ableton или FL Studio. Lyria 3 не заменяет композитора, но резко ускоряет этап поиска направления и настроения трека.
Как начать работать с Lyria 3
Lyria 3 доступна в веб-версии Gemini, мобильном приложении и через Google Flow Labs — закрытую платформу для экспериментов с мультимодальными связками. Базовая версия бесплатна, лимит — 30 секунд на трек. Для доступа к Lyria 3 Pro (треки до 2 минут, приоритетная генерация) нужна подписка Gemini Advanced.
Из России доступ возможен через VPN или через сторонние агрегаторы API. В GEMERA AI Lyria 3 пока не интегрирована, но вы можете попробовать другие инструменты для работы с аудио и мультимодальные модели Gemini для генерации изображений и текста — всё в одном Telegram-боте и веб-кабинете.