Grok 4.6 сравнялся с лучшей моделью OpenAI и оказался значительно дешевле

Grok 4.6 сравнялся с лучшей моделью OpenAI и оказался значительно дешевле

xAI выпустила Grok 4.6 — модель набрала 61 балл в рейтинге Artificial Analysis Intelligence Index. Столько же получила GPT-5.6 Sol от OpenAI. Выше расположились только Claude Opus 5 и Claude Fable 5 от Anthropic с 63 и 62 баллами.

Индекс Artificial Analysis объединяет результаты нескольких тестов в одну оценку. По сравнению с Grok 4.5 новая версия прибавила пять баллов и вошла в группу самых сильных моделей рынка.

Особенно заметен результат в задачах для ИИ-агентов. Это сценарии, где модель сама выполняет длинную последовательность действий на компьютере: ищет информацию, работает с файлами и использует приложения.

В тесте GDPval-AA v2 Grok 4.6 занял второе место с рейтингом Elo 1753. Этот бенчмарк имитирует реальную офисную работу. Модель справлялась со сложным заданием примерно за 53 шага, тогда как лидеру Claude Opus 5 требовалось около 103 шагов.

Цена Grok 4.6 осталась на уровне $2 за миллион входных токенов и $6 за миллион выходных. Для сравнения, Claude Opus 5 стоит $5 и $25 соответственно, а GPT-5.6 Sol — $5 и $30. На генерации модель xAI обходится в четыре-пять раз дешевле конкурентов из верхней части рейтинга.

Grok 4.6 уже доступен через API, среды Cursor и Grok Build, а также на платформах OpenRouter, Vercel и Cloudflare. В первую неделю xAI удвоила лимиты использования модели в Cursor и Grok Build.

Результаты бенчмарков не гарантируют такого же преимущества в каждом рабочем сценарии. Но по сочетанию цены, длины цепочки действий и общего рейтинга Grok 4.6 вышел в один ряд с флагманами OpenAI и Anthropic.

Анна Маркова
Анна Маркова

Специализируется на технологической журналистике с фокусом на искусственный интеллект. Пишет о реальном применении ИИ в бизнесе и повседневной жизни.