Grok 4.6 вышел: разбираем тесты и цену долгих задач
новости
13.08.2026

Grok 4.6 вышел: разбираем тесты и цену долгих задач

Grok 4.6 вышел: разбираем тесты и цену долгих задач

Компания SpaceXAI представила языковую модель Grok 4.6. Релиз состоялся 12 августа. Главные изменения — контекст увеличен до 500 тысяч токенов, появились четыре режима рассуждения, а сама модель явно заточена под длинную агентную работу. В первых бенчмарках она держится вплотную к сильнейшим конкурентам, а в тесте CursorBench, который имитирует реальные задачи разработчика, даже вырывается вперед. Средняя стоимость одного задания там — 2,81 доллара, и выглядит это очень заманчиво.

Но у этой приятной цифры есть оборотная сторона, напоминающая чек из ресторана, где забыли про заказанное вино. Для Grok 4.6 таким «вином» оказался длинный контекст: как только объем запроса превышает 200 тысяч токенов, тариф удваивается. Это меняет картину для тех, кто планирует обрабатывать целые корпоративные документы или многотомные архивы переписки. Придется внимательно считать бюджет и решать, действительно ли нужен запредельный размер окна или достаточно более скромного, но в два раза более дешевого режима.

Если смотреть по существу, модель заметно прибавила в умении рассуждать и удерживать нить задачи на длинной дистанции. Четыре режима рассуждения позволяют гибко балансировать между скоростью и глубиной анализа, что удобно и для быстрых ответов, и для сложных многошаговых цепочек. Это делает Grok 4.6 привлекательным инструментом для разработчиков, исследователей и всех, кто строит агентные пайплайны. Но из-за скачка цены на длинном контексте разумный шаг — сначала прогнать на модели свои типовые сценарии, замерить реальный расход токенов и только потом принимать решение о масштабном внедрении.

Источник: habr.com