Claude Opus 4.7 vs GPT-5.4: почему разработчики перестали выбирать одну модель

16 апреля 2026 Anthropic выпустила Claude Opus 4.7 — флагманскую модель с улучшенным кодингом и новым режимом xhigh-эффорт. Через две недели OpenAI ответила GPT-5.4 с собственными обновлениями. Технологическое сообщество ожидало очередной батл-тест, но данные показали другое: модели перестали конкурировать за одно место. Вместо этого началось разделение по специализациям.
Что изменилось в Opus 4.7
Anthropic заявила о росте точности на 13% в кодинговом бенчмарке из 93 задач. Модель прошла четыре теста, которые не покорились ни одной предыдущей версии Claude. Главное нововведение — режим xhigh, который позволяет контролировать глубину проработки ответа.
Из утечки в Claude Code всплыли упоминания Sonnet 4.8 — следующей модели, которая готовится как агентная система для массового сегмента. Если Opus 4.7 закрывает дорогие флагманские задачи, то Sonnet 4.8 должен стать дешёвой альтернативой для повседневной работы.
Как ответила OpenAI
GPT-5.4 вышел через две недели после Opus 4.7. OpenAI назвала его первой полностью переобученной базовой моделью со времён GPT-4.5 — с новой архитектурой и корпусом для предобучения. Главный козырь — широкая поверхность развертывания: модель сразу появилась в ChatGPT, API и Codex.
По внутренним тестам OpenAI GPT-5.4 совпадает с профессионалами или превосходит их в 84,9% случаев. Для сравнения: Claude Opus 4.7 на аналогичном бенчмарке показывает 70,9%. Разница в 14 процентных пунктов выглядит убедительно, но здесь есть нюанс — тесты проводились самими компаниями, и методологии различаются.
Почему разработчики не выбирают победителя
Независимые тесты показали, что модели разошлись по специализациям. Claude Opus 4.7 держит лидерство в трёх зонах:
- Длинный контекст — на документах от 300 страниц Opus 4.7 аккуратнее помнит детали и точнее отвечает на вопросы про удалённые фрагменты
- Кодинг — меньше галлюцинаций, аккуратный рефакторинг, лучшее понимание большой кодовой базы
- Следование инструкциям — если промпт содержит 20 пунктов с чёткими требованиями, Claude выполнит больше из них за один прогон
GPT-5.4 выигрывает в других сценариях:
- Короткие задачи — быстрее и дешевле на переводах, саммари писем, генерации идей для постов
- Широта развертывания — сразу доступен через ChatGPT, API и Codex без дополнительной интеграции
- Разговорный стиль — чуть лучше чувствует неформальную речь и креативные задачи
На тесте Terminal-Bench 2.0, который имитирует работу в терминале на реальных задачах, GPT-5.5 (следующая версия после 5.4) набрал 82,7% против 69,4% у Claude Opus 4.7. Но на тесте галлюцинаций картина обратная: Claude галлюцинирует на 36% вопросов, GPT-5.5 — на 86%. Высокая уверенность и быстрый инференс оборачиваются низкой эпистемической осторожностью.
Экономика выбора
Цена стала главным фактором разделения. Claude Opus 4.7 стоит 5 долларов за миллион входных токенов и 25 долларов за миллион выходных. GPT-5.4 дороже — около 10 долларов за вход и 30 долларов за выход. Но для коротких задач GPT-5.1 и GPT 5 chat обходятся дешевле, чем младшая модель Anthropic — Claude Sonnet 4.6.
Cursor Composer 2.5, построенная на открытой Kimi K2.5 с дообучением, стоит 50 центов за миллион входных токенов. На внутреннем тесте CursorBench она набрала 63,2% при стоимости около доллара за задачу. Для сравнения: Opus 4.7 выдает сопоставимый результат, но обходится примерно в 7 долларов за задачу. Разница в семь раз объясняет, почему разработчики всё чаще комбинируют модели вместо выбора одной.
Что это меняет
Релизы Opus 4.7 и GPT-5.4 закрепили тренд на специализацию. Вместо универсального победителя рынок получил набор инструментов под разные задачи. Корпоративные клиенты вроде Replit, Cursor, Notion используют Claude для кодинга и долгих агентных задач. Команды с большим числом мелких запросов выбирают GPT ради скорости и широкой интеграции.
Полугодовой ритм релизов Anthropic превратился в квартальный. OpenAI держит шестинедельный конвейер. Когда у конкурента выходит мажорная версия каждые полгода, единственный способ не потерять долю — подкручивать минор-релизы каждые два-три месяца. Обе компании выбрали именно этот путь.
Хотите попробовать обе модели в одном интерфейсе? В GEMERA AI доступны Claude Opus 4.7, GPT-5.4 и другие флагманские модели — через Telegram-бота и веб-кабинет. Сравните их на ваших задачах и выберите оптимальный вариант под конкретный проект.