Встречаем Grok 4.6
Как отмечается в официальном анонсе, модель существенно продвинулась в работе с комплексными сценариями, где необходимо последовательно выполнять множество действий. Это может быть исследование темы с последующим анализом собранной информации, взаимодействие с большой кодовой базой или превращение сырой идеи в полноценное приложение или готовый рабочий материал. Grok 4.6 способна удерживать контекст на протяжении длительных операций, не теряя нити задачи, что особенно важно для агентных сценариев.
По итогам тестирования модель показывает передовые результаты в бенчмарках, оценивающих агентное программирование и интеллектуальные рабочие задачи. В сводном индексе Artificial Analysis Intelligence Index, который объединяет результаты девяти различных бенчмарков, Grok 4.6 достигает уровня GPT-5.6 Sol. Это означает, что новая версия становится прямым конкурентом сильнейших моделей на рынке, особенно в задачах, где требуется не просто генерация текста, а многоэтапные рассуждения и практическое применение знаний.
Источник: habr.com
Поделиться