Как не запутаться в новых версиях Kandinsky, Qwen и YandexGPT этим летом

Как не запутаться в новых версиях Kandinsky, Qwen и YandexGPT этим летом

Последний месяц российские и китайские разработчики выпустили столько обновлений, что уследить за всеми стало почти невозможно. Sber обновил Kandinsky, Alibaba показала сразу две новые модели для генерации изображений и текста, а Яндекс продолжает тихо докручивать YandexGPT. Проблема в том, что за каждым релизом идёт волна пресс-релизов с превосходными степенями, и разобраться, что из этого реальный прорыв, а что маркетинг, со стороны трудно. Я прошёлся по свежим анонсам и разложил их по полочкам — со своим мнением по каждому.

1. Kandinsky 6.0 Image Pro — редактор, а не просто генератор

Главное событие последних месяцев в российском AI-сегменте — обновление Kandinsky до версии 6.0 Image Pro внутри GigaChat. Это не косметическое обновление: модель заявлена как единая система генерации и редактирования изображений, и по собственным замерам Сбера Kandinsky 6.0 Image Pro работает на уровне Flux 2 Max и превосходит GPT Image 1.5.

На практике это выражается в наборе функций, которых ещё год назад у российских моделей просто не было: можно менять фон, освещение, прическу или макияж, примерять одежду, добавлять и удалять надписи, управлять выражением лица или фигурой человека на фото. Отдельно стоит выделить механизм Image RAG: если модель не знает, как выглядит объект из запроса, она может искать визуальный референс и уже на его основе строить изображение — это должно решить проблему генеративных моделей, которые иногда «галлюцинировали» на свежих трендах. Позже добавилась и работа с несколькими фото сразу: пользователь может загрузить до трёх фотографий и получить на их основе новое изображение в одном запросе, а также точечное редактирование кистью — выделить область и указать, что именно нужно сделать: удалить объект, заменить его или изменить.

Мой вывод: это первый случай, когда российская модель для изображений не «догоняет», а реально конкурирует с топовыми западными решениями в узкой нише сложного редактирования. Причём бесплатно и без ограничений по количеству генераций — для многих задач это делает Kandinsky вполне рабочим инструментом уже сейчас.

2. Qwen-Image-3.0 — китайцы делают ставку на текст и сложную вёрстку

Alibaba пошла другим путём: вместо гонки за фотореализмом команда сделала упор на композиционную сложность. Команда Alibaba представила Qwen-Image-3.0 — третье поколение базовой модели для генерации и редактирования изображений. Модель умеет собирать многослойные сцены с сохранением структуры — например, не только размещать множество параллельных элементов, но и сохранять вложенную структуру сцены. В демонстрациях показывали кейсы с окном одного приложения внутри другого и корректно читаемым текстом на нескольких уровнях вложенности.

Мой вывод: это узкая, но полезная фишка для тех, кто делает инфографику, обложки с текстом или интерфейсные макеты — то, с чем диффузионные модели традиционно справлялись плохо. Для портретов и «красивых картинок» разницы с конкурентами вы, скорее всего, не заметите.

3. Qwen3.8-Max-Preview — громкая цифра, которую пока нельзя проверить

Самый шумный анонс месяца — превью новой флагманской модели Alibaba. Qwen 3.8-Max-Preview уже показали на WAIC 2026: 2.4 триллиона параметров, мультимодальность и обещание open weights. Звучит громко, но нюанс важен: на момент анонса это preview, а не полноценная открытая модель с весами, модельной карточкой, лицензией и независимой таблицей бенчмарков. Плюс к этому есть и геополитический контекст: чем сильнее китайские open-weight модели, тем больше разговоров о запретах, закупочных ограничениях и security reviews в США и у союзников.

Мой вывод: восторгаться цифрами в пресс-релизе пока рано. История с китайскими моделями последних двух лет учит: между громким показом на конференции и рабочими весами в открытом доступе иногда проходят месяцы, а реальные бенчмарки часто оказываются скромнее заявленных.

4. YandexGPT 5.1 Pro — прогресс без сенсаций

На фоне ярких китайских анонсов YandexGPT выглядит скромнее, но именно это и делает его историю интереснее. По внутренним тестам Яндекса YandexGPT 5.1 Pro превосходит YandexGPT 5 Pro в 58% случаев, а GPT-4.1 компании OpenAI — в 56% случаев. Важна и экономика: стоимость использования модели заметно снизилась, что делает её доступнее для бизнеса.

Мой вывод: цифры от самого разработчика всегда стоит воспринимать с поправкой на маркетинг, но направление верное — YandexGPT постепенно закрывает разрыв с лидерами не рывками, а стабильными приростами качества от версии к версии. Для рутинных бизнес-задач на русском языке это уже вполне зрелый инструмент.

5. Рынок растёт быстрее, чем качество моделей

Пока разработчики спорят о параметрах и бенчмарках, спрос решает всё сам. Российский рынок генеративного ИИ достигнет 58 млрд руб. в 2025 году, увеличившись в пять раз по сравнению с 2024 годом. Это значит, что бизнес голосует рублём за локальные решения независимо от того, обошли ли они GPT-4.1 в 56% или 66% тестов.

Мой вывод: вопрос «догнали ли российские и китайские модели западные» уже не так важен, как вопрос «закрывают ли они конкретную задачу здесь и сейчас». По этому критерию Kandinsky и YandexGPT явно проходят порог достаточности для большинства практических кейсов.

Что в итоге

Если сравнивать российские и китайские модели с мировыми лидерами в лоб — по общим бенчмаркам, по мультимодальности, по зрелости экосистемы — разрыв всё ещё заметен, особенно у текстовых моделей. Но в узких задачах вроде редактирования изображений или работы с русскоязычным бизнес-контентом эти модели уже не просто «догоняющие», а рабочий инструмент, который решает конкретные задачи быстрее и дешевле альтернатив.

Если хочется сравнить эти модели самостоятельно, а не верить пресс-релизам, в GEMERA AI можно попробовать и Kandinsky, и GigaChat, и Qwen, и YandexGPT — а также GPT, Claude и Gemini — через один Telegram-бот или веб-кабинет, без танцев с VPN и картами. Иногда собственный опыт убеждает лучше любого бенчмарка.