SpaceXAI выпустила Grok 4.6, бросив вызов GPT-5.6 Sol
Grok 4.6 способна выполнять многоэтапные операции, включая исследование материалов, анализ информации, обработку больших объёмов кода и превращение продуктовых идей в готовые приложения. В бенчмарках агентного программирования и интеллектуальной работы модель достигла передового уровня. В индексе Artificial Analysis Intelligence Index, объединяющем девять тестов, Grok 4.6 показала такой же результат, как GPT-5.6 Sol.
Модель уже доступна в Cursor и Grok Build, а также через API и на платформах OpenRouter, Vercel и Cloudflare. В первую неделю пользователи Cursor и Grok Build получат удвоенный объём включённых лимитов. Стоимость API — 2 доллара за миллион входных токенов и 6 долларов за миллион выходных, быстрая версия вдвое дороже.
В основе Grok 4.6 — расширенное дополнительное обучение по сравнению с Grok 4.5. Использовались отфильтрованные данные, сгенерированные моделью, материалы по сложным техническим концепциям и качественные инженерные данные, а также улучшенные оптимизатор и схема обучения. Для SFT и RL траектории пересобирались с помощью Grok 4.5, проблемные примеры отсеивались автоматически. Особое внимание уделено длинным многозадачным сценариям: модель умеет проверять промежуточные результаты и демонстрирует больше автономного тестирования.
Безопасность также была усилена. Проведены самые масштабные для компании оценки: предварительное тестирование, калибровка защитных механизмов, постдеплойментные и сторонние проверки. Защита настроена на легитимные сценарии использования, включая исправление уязвимостей, инженерные разработки и исследования ИИ, чтобы сохранить полезность и снизить риски.
Источник: www.ithome.com
Поделиться