Яндекс.Метрика
Услуги Портфолио Контакты БлогНовости +7 (800) 511‑32‑27 Обсудить проект
ИИ и LLM

xAI выпустила Grok 4.6 — мощный ИИ для автономных агентов при цене вдвое ниже конкурентов

14 августа 2026·7 мин чтения
Grok 4.6xAI
xAI выпустила Grok 4.6 — мощный ИИ для автономных агентов

Коротко о главном

12 августа 2026 года компания xAI выпустила Grok 4.6 — новую версию своей флагманской языковой модели с 1,5 трлн параметров. Рейтинг ELO на арене GDPVal-AA v2 составил 1753, индекс Artificial Analysis Intelligence Index — 61 балл (наравне с GPT-5.6 Sol). Цена API осталась неизменной: $2 за млн входных токенов и $6 за млн выходных — вдвое ниже цены конкурентных флагманских моделей. Главный акцент релиза — долгосрочные агентные задачи: DeepSWE вырос с 54 до 65,9, APEX-Agents — с 47,1 до 57,5.

Grok 4.6 сразу доступна в Cursor, Grok Build, xAI API, OpenRouter, Vercel и Cloudflare. Для команд, которые строят AI/ML-продукты или встраивают агентные цепочки в сервисы, это прямой сигнал: мощность топ-класса теперь доступна по ценам среднего эшелона. Grok 4.5 сохраняется как более быстрый и дешёвый вариант для рутинных задач.

Что изменилось по сравнению с Grok 4.5

Grok 4.6 построена на той же базовой архитектуре V9 с 1,5 трлн параметров, что и предшественница. Прирост достигнут за счёт трёх рычагов: расширенный качественный датасет с reasoning-материалами и инженерными задачами, переработанный оптимизатор в RL-фазе и улучшенный supervised fine-tuning с акцентом на многоэтапные инструкции. Это позволило значительно поднять показатели агентных бенчмарков без увеличения числа параметров и без роста стоимости инференса.

На DeepSWE — бенчмарке по написанию и исправлению кода в реальных репозиториях — Grok 4.6 набрала 65,9 против 54 у Grok 4.5. На APEX-Agents, оценивающем выполнение многоэтапных задач с инструментами, — 57,5 против 47,1. На Artificial Analysis Intelligence Index модель вышла на 61 балл, сравнявшись с GPT-5.6 Sol и отставая на 2 балла от Claude Opus 5. Эти цифры важны для команд, выбирающих модель под конкретный сценарий: Grok 4.6 выигрывает там, где задача требует длительной автономной работы с инструментами и кодом, но уступает в ряде академических рассуждений и терминал-операциях.

Главная особенность: долгие агентные прогоны

xAI явно позиционирует Grok 4.6 как модель для «long-running agents» — сценариев, где агент работает без подсказок десятки минут подряд: исследует репозиторий, итерирует код, запускает тесты и корректирует результаты. На презентации была продемонстрирована 22-минутная сессия одного агента, выполнившего полную реализацию функции от постановки задачи до прохождения тестовой сюиты без вмешательства оператора. Для продуктовых команд, строящих агентные системы, этот результат означает, что порог надёжности для автономных прогонов заметно вырос.

Интеграция с Cursor и Grok Build позволяет разработчикам получить доступ к Grok 4.6 прямо в IDE без настройки собственной API-обвязки. На первой неделе запуска xAI предоставляет двойной объём включённых запросов в Cursor и Grok Build. OpenRouter и Cloudflare Workers AI также включили модель в каталог сразу после анонса.

Ценообразование и позиционирование на рынке

Ключевой коммерческий тезис xAI — стоимость. При $2/$6 за млн токенов Grok 4.6 работает в той же ценовой категории, что и модели среднего уровня, хотя по бенчмаркам агентных задач конкурирует с топ-моделями, стоящими $5–30 за млн выходных токенов. Для команд, которые запускают агентные пайплайны с длительными сессиями (а значит, большим числом выходных токенов), разница в цене может быть принципиальной — особенно при масштабировании.

xAI также апеллирует к своему инфраструктурному активу: компания эксплуатирует кластер Colossus в Мемфисе и ведёт строительство Colossus 2, что даёт прямой контроль над latency и доступностью. Для экосистемы Tesla — бортовой голосовой ИИ и будущая интеграция в Optimus — экономия на каждом токене при флотском масштабировании становится существенным аргументом выбора именно Grok в качестве базовой модели.

Что это значит для команд разработки

На практике появление Grok 4.6 означает три вещи для тех, кто строит продукты на базе LLM.

Во-первых, порог входа в агентные архитектуры снизился. Ещё полгода назад автономные агентные прогоны длиной в 20+ минут были прерогативой дорогих моделей с высоким контекстным окном. Сейчас тот же класс возможностей доступен по $6 за млн выходных токенов. Это делает рентабельными сценарии, где агент занимается автоматизацией тестирования, рефакторингом кодовой базы или сбором и структурированием данных без участия человека в каждом шаге.

Во-вторых, выбор модели становится более контекстно-зависимым. Grok 4.6 выигрывает у конкурентов на DeepSWE и APEX-Agents, но у Claude Opus 5 и ряда моделей OpenAI — сильнее позиции по академическим рассуждениям и работе с терминалом. Это означает, что оптимальная архитектура для сложного агента, вероятно, будет комбинировать модели: Grok 4.6 для длинных coding-задач, другие модели — для критических reasoning-шагов или строгих инструкций.

В-третьих, давление на стоимость вычислений продолжается. С момента релиза GPT-5 в начале 2026 года цены на флагманские модели падали трижды. Grok 4.6 продолжает этот тренд, предлагая топ-класс производительности в агентных задачах по ценовому уровню середины рынка. Команды, которые до сих пор откладывали перевод агентных прототипов в продакшен из-за стоимости, получают весомый аргумент для пересмотра бизнес-кейса.

Дорожная карта xAI: что дальше

По имеющимся данным, xAI планирует выпустить Grok 4.7 в ближайшие несколько недель. Это будет более крупная модель на 2,1 трлн параметров с акцентом на мультимодальную работу и улучшенный reasoning. Grok 5 ориентировочно запланирован до конца 2026 года. Таким образом, Grok 4.6 — это промежуточный релиз, предназначенный закрыть конкурентный разрыв в агентном домене, пока готовится следующее поколение.

Для команд это означает, что нет смысла откладывать интеграцию с Grok 4.6 до «финальной версии» — модель полностью продуктовая, уже доступна через стандартные SDK и совместима с Vercel AI SDK, LangChain и OpenRouter. Миграция между версиями Grok при появлении 4.7 потребует обновления endpoint-строки, но не переработки промптов.

Часто задаваемые вопросы

В чём принципиальное отличие Grok 4.6 от 4.5? Те же 1,5 трлн параметров, но переработанные SFT и RL с фокусом на агентные задачи. DeepSWE вырос с 54 до 65,9, APEX-Agents — с 47,1 до 57,5. Цена не изменилась.

Доступна ли модель через OpenAI-совместимый API? Да: xAI поддерживает OpenAI-совместимый endpoint, а также доступна через OpenRouter, Vercel AI SDK и Cloudflare Workers AI без дополнительных адаптеров.

Стоит ли мигрировать с Grok 4.5 прямо сейчас? Для coding-агентов и задач с инструментами — да, прирост значительный. Для быстрых, коротких запросов Grok 4.5 остаётся более экономичным вариантом. Используйте оба в одном пайплайне по типу задачи.

Что такое GDPVal-AA v2? Частная арена xAI для оценки предпочтений аннотаторов на задачах планирования, рассуждения и агентной работы. Результаты не воспроизведены сторонними исследователями — воспринимайте ELO 1753 как внутреннюю метрику, а не независимый бенчмарк.

Когда выйдет Grok 4.7? По данным тестирования источников xAI, через несколько недель после Grok 4.6. Ожидается архитектура 2,1T параметров с усиленной мультимодальностью.

Источники

Testing Catalog — xAI releases Grok 4.6 for long-running agent work, 12–13 августа 2026 года.

Basenor — xAI Launches Grok 4.6: 1753 ELO, Half the Price of Rival Frontier Models, август 2026 года.

Kie.ai — Grok 4.6 Release: Benchmarks & Analysis, август 2026 года.

OrcaRouter — Grok 4.6 Release Date: Shipped Aug 12, Same $2/$6 Price, август 2026 года.

Строите продукт на ИИ-агентах?

Grok 4.6 и другие модели топ-уровня стали доступнее — но грамотная агентная архитектура важнее выбора модели. YuSMP Group проектирует и разрабатывает AI/ML-решения: от прототипа до продакшена с надёжными пайплайнами.

Обсудить AI-проект
Материал подготовлен редакцией YuSMP Group по открытым источникам. Нужна экспертиза по теме или разработка под задачу — обсудим проект.