Lyria 3: Google научил нейросеть писать песни с осмысленным текстом и вокалом

18 мая 2026 года Google DeepMind выкатила обновление музыкальной нейросети — Lyria 3. Это не просто генератор мелодий, как Udio или Suno первых версий. Модель умеет создавать полноценные песни с вокалом, куплетами, припевами и осмысленным текстом — всё по одному текстовому описанию. И это первая модель в экосистеме Gemini, которая нативно работает с мультимодальностью: можешь загрузить фотографию или видео, и Lyria напишет под них атмосферный саундтрек.
Что умеет Lyria 3
Базовая версия доступна бесплатно и генерирует отрывки до 30 секунд в стереозвуке 44.1 кГц. Lyria 3 Pro (в тарифе Google AI Ultra за 200 долларов в месяц) собирает полноценные треки на две-три минуты с проработанной структурой: вступление, куплеты, припев, бридж. Текст песни модель пишет сама — связный, с рифмами и смыслом. Вокал звучит естественно, без роботических артефактов, которыми грешили ранние версии генеративных моделей.
Главная фишка — мультимодальность. Ты можешь загрузить в чат с Gemini фотографию заката, и Lyria сгенерирует под неё медленную акустическую балладу. Или кинуть видео с экшен-сценой — получишь энергичный трек с драм-машиной и синтезаторами. Модель анализирует визуальный ряд и подбирает музыкальное настроение автоматически.
Кому это нужно прямо сейчас
Создатели контента на YouTube, TikTok и Instagram получили инструмент, который закрывает главную боль — авторские права на музыку. Раньше приходилось покупать лицензии на треки или рыться в библиотеках royalty-free музыки, где половина композиций заезжена до дыр. Теперь можно за пару минут сгенерировать уникальный саундтрек под конкретный ролик — и никаких страйков.
Подкастеры и авторы курсов используют Lyria для создания джинглов и фоновой музыки. Геймдев-студии тестируют модель для генерации динамических саундтреков, которые подстраиваются под действия игрока. Маркетологи собирают уникальные аудиобренды для роликов и презентаций.
Как это встроено в экосистему Google
Lyria 3 работает не изолированно, а в связке с другими моделями DeepMind. Imagen 4 генерирует обложку альбома, Veo 3.1 создаёт музыкальное видео, а Lyria пишет саундтрек — всё это происходит в одном чате с Gemini. Для разработчиков игр и создателей виртуальных миров это особенно интересно: можно загрузить концепт-арт локации, и система сама соберёт под неё визуальный ряд, музыку и звуковые эффекты.
Интеграция с Google Workspace позволяет использовать Lyria в бизнес-сценариях. Загружаешь PDF-презентацию, просишь Gemini вытянуть ключевые тезисы, Imagen рисует инфографику, а Lyria генерирует фоновую музыку для видеоверсии — всё за несколько минут в одном окне.
Что это меняет
Раньше создание оригинальной музыки требовало либо навыков композитора, либо бюджета на найм музыканта. Генеративные модели первого поколения умели делать биты и мелодии, но вокал и текст оставались проблемой. Lyria 3 закрывает этот гап: теперь любой человек с текстовым описанием может получить полноценную песню студийного качества.
Для музыкальной индустрии это не замена живых артистов, а новый инструмент для прототипирования и демо-версий. Продюсеры используют Lyria, чтобы быстро набросать структуру трека и показать артисту направление. Авторы песен генерируют варианты припевов и выбирают лучший для доработки.
Хочешь попробовать Lyria 3 и другие мультимодальные модели Google — они доступны через GEMERA AI. В одном интерфейсе можешь работать с генерацией музыки, изображений, видео и текста — всё на русском языке и без танцев с VPN. Просто загружай свои идеи и получай готовый контент за минуты.