Claude Sonnet 4.6 vs GPT-5.2: война середняков в феврале 2026

В феврале 2026 года Anthropic выпустила Claude Sonnet 4.6 — обновление модели среднего уровня, которое перевернуло представление о ценовых категориях в ИИ. Новая версия обошла прежний флагман Opus 4.5 в 59% прямых сравнений, показав при этом 79,6% в SWE-bench Verified — почти вровень с Opus 4.6 (80,8%). Разница в цене при этом составляет пятикратную: три доллара за миллион входных токенов против пятнадцати у флагмана.
GPT-5.2 от OpenAI вышла примерно в то же время и заняла позицию универсального инструмента: 80% в SWE-bench Verified и 64,7% в Terminal-Bench 2.0. Разрыв с Sonnet 4.6 в кодинге составляет всего 0,4 процентных пункта, но GPT-5.2 сильнее в математике и научных задачах. Обе модели позиционируются как рабочие лошадки — доступные по цене, но способные решать задачи флагманского уровня. Разбираем, где побеждает каждая.
Программирование: где разрыв минимален
В SWE-bench Verified — бенчмарке, который тестирует способность модели исправлять реальные баги в GitHub-репозиториях — Claude Sonnet 4.6 набирает 79,6%, GPT-5.2 — 80%. Разница в 0,4 процентных пункта растворяется в реальной работе: обе модели генерируют рабочий код с первой попытки в большинстве случаев.
Но в Terminal-Bench 2.0, который тестирует программирование через командную строку и низкоуровневые задачи, GPT-5.2 показывает 64,7% против недоступных данных для Sonnet 4.6. Если вы работаете с системным программированием, DevOps или автоматизацией через bash-скрипты, это может стать решающим фактором.
В Claude Code — среде разработки от Anthropic — пользователи в раннем тестировании выбирали Sonnet 4.6 вместо предыдущей версии 4.5 в 70% случаев. Но важнее другое: в 59% сравнений Sonnet 4.6 оказался предпочтительнее прежнего флагмана Opus 4.5. Модель среднего уровня, которая переигрывает вчерашний топ — уже не косметическое обновление.
Текстовые задачи: где Claude доминирует
В задачах на генерацию текста Claude Sonnet 4.5 и 4.6 традиционно сильнее GPT. Исследование, опубликованное на Хабре в феврале 2026, показало: при написании сценариев для YouTube и кликабельных заголовков Claude генерирует более живые и естественные тексты, в то время как GPT-5.2 склонна к шаблонности и избыточному использованию кавычек.
Claude Sonnet 4.6 поддерживает контекстное окно в 200 000 токенов (с возможностью расширения до миллиона) и генерирует до 64 000 выходных токенов. Это особенно полезно для работы с длинными документами: технической документацией, юридическими текстами, научными статьями. GPT-5.2 также поддерживает большие контексты, но в тестах на recall — способность извлекать информацию из середины документа — Claude показывает 98,4% против примерно 95% у GPT.
В креативных задачах — написании рассказов, сценариев, маркетинговых текстов — Claude сохраняет более естественную интонацию и лучше улавливает стилистические нюансы. GPT-5.2 сильнее в структурированных задачах: составлении планов, аналитических отчётов, бизнес-документов.
Математика и наука: территория GPT-5.2
В тесте AIME 2025 — олимпиадных задачах по математике — GPT-5.2 показывает 100% точности. Это лучший результат среди всех публичных моделей. Claude Opus 4.6 набирает 91,3% в GPQA Diamond — тесте на вопросы докторского уровня из физики, химии и биологии. Sonnet 4.6 пока не публиковал результаты по этому бенчмарку, но, судя по общей динамике, он будет на несколько процентных пунктов ниже.
Если вы работаете со сложными расчётами, статистикой, научными данными или финансовым моделированием — GPT-5.2 даст более надёжный результат. Модель лучше справляется с многошаговыми рассуждениями и реже допускает ошибки в вычислениях.
Цена и маршрутизация: как выбирать модель
Claude Sonnet 4.6 стоит три доллара за миллион входных токенов и пятнадцать — за выходные. GPT-5.2 Pro обойдётся дороже: точные цифры не публикуются, но подписка на ChatGPT Plus с доступом к GPT-5.2 составляет двадцать долларов в месяц при ограниченном количестве запросов. Для API-доступа цены сопоставимы с Claude Opus.
Маршрутизация моделей — распределение задач между разными ИИ — позволяет снизить расходы на 40–60%. Простые задачи отправляются на быстрые и дешёвые модели вроде Gemini Flash, сложные — на Sonnet или GPT-5.2. Такой подход используют крупные команды, которые работают с ИИ ежедневно.
В GEMERA AI доступны обе модели: Claude Sonnet 4.6 для кода и текстов, GPT-5.2 для математики и мультимодальных задач. Вы можете переключаться между ними в одном диалоге — без необходимости держать несколько подписок и VPN. Попробуйте обе модели и выберите ту, которая лучше подходит под вашу задачу.