SpaceXAI выпустила Grok 4.5 и сравнила его с Claude Opus

8 июля Илон Маск написал в X, что новая модель выйдет в публичный доступ «завтра». За несколько часов до этого собственный аккаунт xAI в той же сети опровергал релиз «на завтра или на какую-либо дату». Уже одно это должно настроить на трезвый лад: даже внутри компании явно не всегда синхронизируют коммуникацию. Разбираем главные вопросы про Grok 4.5 без придыхания.
Что вообще произошло и кто такой SpaceXAI?
SpaceX недавно стала SpaceXAI. Это не отдельный стартап, а переименованная и объединённая структура: Grok 4.5 — первый релиз компании с тех пор, как она стала публичной и купила стартап для ИИ-кодинга Cursor. Вскоре после IPO SpaceX сообщила, что воспользовалась опционом на покупку Cursor за 60 млрд долларов. Grok 4.5 — первый плод этого слияния: модель обучалась совместно с Cursor, который SpaceX согласилась купить за эту сумму.
Правда ли Grok 4.5 равен Claude Opus?
Это заявление самого Маска, а не независимая оценка. Сам Маск добавил: «Наша внутренняя оценка — Grok 4.5 примерно сопоставим с Opus 4.7, но гораздо быстрее». Заметьте формулировку — «внутренняя оценка», не сторонний бенчмарк. Независимые наблюдатели это подтверждают: аналитики отмечают, что заявление «близко к Opus» — это внутреннее впечатление компании, а не опубликованный бенчмарк. По собственным опубликованным цифрам SpaceXAI картина смешанная: компания утверждает, что новый Grok превосходит некоторые модели OpenAI и Anthropic по скорости, цене и производительности, но не самые крупные и новые модели этих конкурентов. Первые практические тесты в Cursor это подтверждают частично: модель не так хороша, как Opus и Fable, в задачах фронтенд-дизайна — интерфейсы получаются приемлемыми, но не блестящими.
Почему цена настолько ниже конкурентов — в чём подвох?
Цена реально ниже — это факт, а не маркетинг. Grok 4.5 стоит 2 доллара за миллион входных токенов и 6 долларов за миллион выходных, тогда как Opus 4.8 стоит 5 и 25 долларов, а GPT 5.6 Luna — 1 и 6 долларов. Подвох в другом: цена — не показатель качества, а стратегия захвата рынка. Итог по существу такой: SpaceXAI позиционирует Grok как серьёзного конкурента для бизнес-использования, который может быть дешевле соперников, даже если пока отстаёт по производительности от их лучших моделей. Плюс есть неудобный факт о происхождении вычислительных мощностей: модель обучалась на тех же вычислительных мощностях, которые SpaceXAI сдаёт в аренду конкурентам Anthropic и Google, и по мере роста собственных потребностей компании придётся выбирать между использованием этой мощности для своих моделей или сдачей её в аренду ради дохода.
Что с бенчмарками — им вообще можно доверять?
Частично. Компания опубликовала конкретные цифры, но сравнивала себя с моделями конкурентов по открытым источникам, а не по совместному тестированию. По одним замерам Grok 4.5 действительно лидирует — например, по устойчивости на длинных марафонных задачах SWE Marathon у него лучший результат среди перечисленных моделей. Но по другим тестам, включая DeepSWE и SWE Bench Pro, он уступает и модели уровня Fable, и GPT «xhigh». Это нормальная картина для новой модели среднего эшелона: она не претендует на абсолютное лидерство, но и не является провалом.
Почему модели пока нет в Европе, и при чём тут кибербезопасность?
Тут пересекаются две истории — регуляторная и продуктовая. Пока модель не доступна в Евросоюзе, релиз откладывается на середину июля. Одновременно релиз пришёлся на период повышенного внимания властей США к моделям такого класса: выход Grok 4.5 совпал с усиленным вниманием властей к новым моделям, особенно в части кибербезопасности — администрация Трампа временно ограничивала доступ к моделям Anthropic и рекомендовала OpenAI поэтапный запуск продуктов. Поэтому в модель заранее встроили страховку: Cursor подчеркнула, что внедрила в Grok 4.5 механизмы «обнаружения и блокировки злоумышленников», сохраняя возможность легитимной работы по выявлению уязвимостей, но ограничивая опасные сценарии.
Стоит ли новичку сразу пересаживаться на Grok 4.5?
Спешить не нужно. Это узкоспециализированная модель для программирования, работы с документами и агентных задач, а не универсальный чат-бот на замену привычному ассистенту. Разумный подход:
- Не верить громким сравнениям «на уровне Opus» без собственной проверки на своих задачах.
- Помнить, что цена ниже не означает качество выше — иногда это просто стратегия набора аудитории.
- Учитывать, что модель заточена под код, финансы и юридические документы — для творческих и разговорных задач она может не блеснуть.
- Следить за независимыми обзорами через пару недель, когда пройдёт первая эйфория пресс-релизов.
Если хочется просто попробовать Grok 4.5 без разбирательств с иностранными картами и региональными ограничениями — а вместе с ним и GPT, Claude, Gemini и другие модели для чата, картинок, видео и озвучки — удобнее сделать это через GEMERA AI: в Telegram-боте и веб-кабинете модели собраны в одном месте с оплатой в рублях. Так проще составить собственное, а не рекламное впечатление о новинке.