live
9 лабораторий · 29 моделей
Все статьи
9 мин чтенияКоманда MaxGPT

Claude Opus 5.5, GPT-6 Sol и Grok 4.7: три релиза за два дня и какую модель брать

За два дня в конце сентября вышли сразу три крупных релиза: Grok 4.7 от xAI, Claude Opus 5.5 от Anthropic и пара GPT-6 Sol и Luna от OpenAI. Разбираемся без пафоса, чем они отличаются, где каждая правда сильна и какую выбрать под свою задачу. Все четыре уже доступны в MaxGPT.

МоделиAnthropicOpenAIxAIНовости
Маскот Макс парит в открытом космосе над краем планеты и тянется к трём голографическим карточкам с логотипами и надписями «Anthropic — Claude Opus 5.5», «OpenAI — GPT-6 Sol · Luna» и «xAI — Grok 4.7». Обложка статьи о новых моделях
Прослушать статью00:00

Двадцать первого сентября xAI выпустила Grok 4.7. На следующий день Anthropic показала Claude Opus 5.5, а OpenAI в тот же день — GPT-6 Sol и GPT-6 Luna. Три лаборатории, четыре модели, два дня. Совпадением это назвать сложно: гонка идёт так плотно, что никто не хочет оставлять конкурента в новостях одного даже на неделю.

Если совсем коротко: Opus 5.5 — самая сильная из новинок и, по независимым замерам, сейчас вообще лучшая модель на рынке. GPT-6 Sol почти не прибавила в уме, зато подешевела вдвое и стала реже ошибаться в фактах. Luna — лёгкая и очень дешёвая. Grok 4.7 — большой шаг для xAI, но пока всё ещё второй эшелон, пусть и по приятной цене. Дальше — подробности и честные оговорки к каждой.

Четыре модели на одной странице

Для ориентира — базовые характеристики. Цены указаны за миллион токенов в API, чтобы было понятно, кто дорогой, а кто нет; в MaxGPT за токены отдельно платить не нужно, всё входит в подписку.

МодельРазработчикВход / выход, $КонтекстВ чём сильна
Claude Opus 5.5Anthropic4 / 201 млнДолгий код, документы, ясный текст
GPT-6 SolOpenAI2 / 101,05 млнКод, агенты, точность в фактах
GPT-6 LunaOpenAI0,10 / 0,501,05 млнБыстрые и простые задачи
Grok 4.7xAI2 / 6500 тыс.Код, инженерия, право

Claude Opus 5.5: уровень Fable, но без флагманского ценника

Opus 5.5 открывает новое семейство Claude 5.5. Anthropic формулирует её главное достоинство одной фразой: модель работает на уровне Claude Fable 5.1 — самой мощной и самой дорогой модели компании, — но обходится на 40% дешевле, чем Opus 5. Токены подешевели на 20%, а остальное дала экономность: модель тратит меньше шагов и меньше токенов на одну и ту же задачу. Выдаёт текст она при этом больше чем на 30% быстрее предшественницы.

Независимые тесты это подтвердили. В сводном индексе Artificial Analysis Opus 5.5 на максимальных настройках набрала 58 баллов — это лучший результат из всех, что там когда-либо измеряли, с отрывом в несколько пунктов. Впереди она почти везде: в агентном программировании (66,4% в Terminal-Bench 4.0 против 55,8% у Fable 5.1 и 57,9% у GPT-6 Astra), в офисной работе, в сложных вопросах с доступом к инструментам.

Но цифры бенчмарков мало что говорят о том, как модель ощущается в работе. Интереснее истории ранних тестировщиков. Один перенёс проект на 680 тысяч строк кода меньше чем за сутки, а у команды инженеров на это ушли бы недели. Другой провёл аудит и починку кодовой базы на 200 тысяч строк за три часа, хотя у Opus 5 та же работа заняла больше двадцати. Ещё в одной компании сложную задачу, на которую раньше ушло 38 запросов и четыре дня, Opus 5.5 закрыла за 11 запросов и три часа. Anthropic ставила и внутренний эксперимент: попросила Opus 5.5 и Fable 5.1 переписать HAProxy, популярный балансировщик нагрузки, с C на Rust. Обе справились, но Opus 5.5 закончила за 9,5 часа вместо 12 и потратила вдвое меньше денег.

Вторая большая перемена касается того, как модель пишет. Opus 5 часто ругали за многословность: длинные вступления, канцелярские обороты, суть где-то в третьем абзаце. Opus 5.5 ставит главное в начало, реже уходит в жаргон и лучше держит правила стиля, которые вы ей задаёте. Один из тестировщиков сказал просто: «Она пишет так, как пишу я». Если вы работаете с текстом на русском, это заметно сразу: меньше приходится вычищать после модели.

Есть и особенность, о которой стоит знать заранее: рассуждение у Opus 5.5 выключить нельзя, она всегда сначала думает, потом отвечает. На сложных задачах это плюс. На вопросе «как будет по-английски „подоконник“» — лишние секунды ожидания. Для таких мелочей лучше взять модель попроще.

На MaxGPT Claude Opus 5.5 уже доступна в чате — по подписке PRO на тарифах с 5-часовым лимитом, как и другие флагманы Anthropic.

GPT-6 Sol: та же планка, но вдвое дешевле

В начале сентября OpenAI выпустила флагман GPT-6 Astra, и теперь семейство GPT-6 выглядит так: сверху Astra, посередине Sol, снизу Luna. Sol задумана как рабочая лошадка: она забирает у Astra аккуратность и умение доводить задачу до конца, но стоит заметно меньше.

OpenAI продаёт Sol не рекордами, а надёжностью. Компания взяла реальные диалоги, в которых пользователи отмечали ошибки модели, и проверила на них новую версию: Sol ошибается примерно вдвое реже, чем GPT-5.6 Sol, и выходит на уровень надёжности Astra. Независимый тест на галлюцинации это подтверждает, хотя и с нюансом. Доля выдуманных ответов упала с 92% до 60%, но в основном потому, что модель чаще отказывается отвечать, когда не уверена. Общая доля верных ответов при этом даже немного снизилась, с 59% до 54%. Для повседневной работы это скорее хорошая новость: честное «не знаю» лучше уверенной выдумки.

В программировании Sol держится рядом с куда более дорогими моделями. На DeepSWE, тесте на долгие инженерные задачи в настоящих репозиториях, она набирает 68,8%. У Claude Fable 5 лучший результат 69,9%, но стоит он примерно в пять раз дороже за задачу. В Terminal-Bench 4.0 Sol прибавила с 37% до 43%.

Теперь о том, чего в пресс-релизе нет. По сводному индексу интеллекта Sol почти не отличается от предшественницы: 48 баллов против 47. В работе с офисными документами она даже откатилась назад, а в управлении компьютером уступает и Astra, и прошлой Sol. Так что это не скачок, а та же планка по половинной цене. Для большинства задач это как раз то, что нужно: код, разборы, переписка, аналитика. А если нужна модель, которая сама кликает по интерфейсам, берите Astra.

У нас GPT-6 Sol доступна по подписке PRO, и поскольку она вдвое дешевле прошлой Sol, заряда на длинные диалоги хватает заметно надольше. Открыть чат с GPT-6 Sol.

GPT-6 Luna: младшая, но с самыми свежими знаниями

Luna OpenAI описывает без затей: модель для массовых задач с понятной целью. Пересказать документ, вытащить из текста цифры и имена, быстро ответить на вопрос. Скромности тут нет: именно из таких задач состоит большая часть того, что люди делают с нейросетями каждый день.

Цена у неё почти символическая: десять центов за миллион входных токенов и пятьдесят за миллион выходных. Это вдвое дешевле GPT-5.6 Luna на входе и почти в два с половиной раза на выходе. По сводному индексу интеллекта модель держится на уровне предшественницы. В агентном коде она немного просела, зато в тесте DeepSWE на максимальных настройках выдаёт 66,6% всего за 22 цента на задачу. По словам OpenAI, это сопоставимо с Claude Opus 5 и Fable 5 на средних настройках, при том что стоит на 93–96% дешевле.

Любопытная деталь: у самой младшей модели семейства самые свежие знания. Luna обучена на данных до мая 2026 года, а Sol и Astra остановились на апреле.

В MaxGPT GPT-6 Luna доступна по подписке PRO и не расходует заряд — 5-часовой лимит, из которого списываются запросы к дорогим моделям. Ей можно пользоваться сколько угодно, без оглядки на счётчик. Для сложного многофайлового кода она не лучший выбор, но переключиться на Sol или Opus можно прямо в том же диалоге.

Grok 4.7: большой, поздний и неожиданно дешёвый

Grok 4.7 вышел раньше всех, хотя ждали его дольше всех: Илон Маск переносил релиз минимум пять раз, начиная с конца июля. Задержку можно понять. Это не косметическое обновление, а новая, заметно более крупная базовая модель: по данным СМИ, около 2,1 триллиона параметров. Её дольше обучали с подкреплением, причём упор делали на задачи, которые у человека занимают часы. Отдельно xAI подтянула самопроверку: модель внимательнее перепроверяет собственные ответы и лучше держит длинный контекст. Кстати, в официальных материалах компания теперь называет себя SpaceXAI, но модели по-прежнему называются Grok.

Прирост по сравнению с Grok 4.6 получился серьёзный. В CursorBench 4.0, тесте на длинные задачи программирования, результат вырос с 40,4% до 46,3%. В Terminal-Bench 4.0 он почти удвоился, с 20,3% до 37,6%. В многочасовой офисной работе (отчёты, таблицы, презентации) модель прибавила больше сотни пунктов Elo. Особенно неожиданно выглядит право: в юридическом бенчмарке Harvey Grok 4.7 набирает 19,6%, почти втрое больше, чем Claude Fable 5.1 с её 6,7%. В электротехническом EEBench у него 64% против 56,4% у Fable.

С местом в общей таблице всё скромнее. В большинстве сравнений Grok 4.7 второй: в офисной работе он уступает Fable 5.1, в инженерных задачах — GPT-6 Astra, а до Opus 5.5 ему далеко. Независимые тесты ставят его на 46 баллов индекса интеллекта. Этого хватило, чтобы xAI вошла в четвёрку сильнейших лабораторий, но не больше. Сам Маск обещает «класс Astra и Fable» только к Grok 4.9. И ещё одна оговорка: на максимальных настройках модель тратит больше чем вдвое больше токенов на задачу, чем Grok 4.6, так что одинаковая цена за токен не значит одинаковую цену за результат.

Главный козырь Grok 4.7 — соотношение цены и качества. Стоит он столько же, сколько Grok 4.6, два доллара за миллион входных токенов и шесть за миллион выходных, и заметно дешевле флагманов Anthropic и OpenAI. На MaxGPT Grok 4.7 доступен по подписке PRO.

Так какую брать

Мы бы раскладывали так.

Если задача большая и важная — сложный код, аудит проекта, аналитический отчёт, длинный документ, где нужна ясная мысль, — берите Claude Opus 5.5. Сейчас это самая сильная модель из доступных, и пишет она заметно лучше прошлых Claude.

Для повседневной работы, где нужен баланс, подойдёт GPT-6 Sol: код, разборы, письма, таблицы. Она аккуратная, реже выдумывает и не так сильно расходует заряд.

Под мелочи вроде пересказов, переводов, коротких справок и черновиков возьмите GPT-6 Luna. Она быстрая и заряд не тратит вовсе.

Grok 4.7 стоит попробовать на юридических и инженерных вопросах, где он неожиданно силён, а ещё как второе мнение, когда хочется сверить ответ другой модели.

Удобнее всего сравнивать прямо на своей задаче. В MaxGPT модель переключается посреди диалога: задали вопрос Opus, переключились на Sol или Grok, отправили тот же запрос ещё раз и сразу видно, кто справился лучше. Подробные карточки новинок лежат на страницах Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna и Grok 4.7.

Коротко

За два дня вышли четыре новые модели. Claude Opus 5.5 — новый лидер: уровень Fable 5.1 на 40% дешевле Opus 5, сильнейший агентный код и заметно более ясный текст. GPT-6 Sol почти не прибавила в интеллекте, но стала вдвое дешевле и вдвое реже ошибается в фактах. GPT-6 Luna — очень дешёвая модель для простых задач с самыми свежими знаниями в семействе. Grok 4.7 сделал большой шаг вперёд, особенно в коде, праве и инженерии, но пока остаётся вторым эшелоном, зато по доступной цене. Все четыре уже работают в MaxGPT без VPN и с оплатой российской картой.

Попробуйте лучшие ИИ-модели на MaxGPT

GPT, Claude, Gemini, GLM и другие нейросети в одном окне — на русском и без VPN.