i
Новости
Новости · 2026-09-21

xAI представила Grok 4.7 по низкой цене, но тесты показали большой разрыв с Claude и GPT-6

@neuronium_ai @neuronium_ai

xAI представила Grok 4.7 — новую модель для программирования и работы со знаниями. Компания заявляет, что увеличила базовую модель, продлила обучение с подкреплением и улучшила проверку собственных ответов. Доступ к Grok 4.7 стоит $2 за миллион входных токенов и $6 за миллион выходных. В независимом Artificial Analysis Intelligence Index v4.3.2 модель набрала 46 баллов из рейтинга, который объединяет десять бенчмарков. Claude Fable 5.1 и GPT-6 получили по 53 балла. В тесте программирования с ИИ-агентами Terminal-Bench 4.0 Grok 4.7 набрала 26%, тогда как GPT-6 Astra — 60%, а Claude Fable 5.1 — 55%.

Обложка: xAI представила Grok 4.7 по низкой цене, но тесты показали большой разрыв с Claude и GPT-6

xAI представила Grok 4.7 как модель для программирования и работы со знаниями. По словам компании, она построена на более крупной базовой модели, дольше обучалась с подкреплением и лучше проверяет собственные результаты. Цена составляет $2 за миллион входных токенов и $6 за миллион выходных. Это ближе к расценкам китайских моделей, чем к ценам передовых западных моделей, и, вероятно, связано с результатами тестирования.

В независимом Artificial Analysis Intelligence Index v4.3.2, который объединяет десять бенчмарков, Grok 4.7 набрала 46 баллов и оказалась в середине рейтинга. Claude Fable 5.1 и GPT-6 возглавили его с результатом 53 балла каждая.

Grok 4.7 (чёрный) набирает 46 баллов в общем зачёте, значительно отставая от Claude Fable 5.1 и GPT-6, набравших по 53 балла. Два его самых высоких уровня рассуждения, по-видимому, работают примерно одинаково

Grok 4.7 (чёрный) набирает 46 баллов в общем зачёте, значительно отставая от Claude Fable 5.1 и GPT-6, набравших по 53 балла. Два его самых высоких уровня рассуждения, по-видимому, работают примерно одинаково

Источник: the-decoder.com

Разрыв увеличивается в задачах по программированию с ИИ-агентами. В Terminal-Bench 4.0 Grok 4.7 получила лишь 26%, тогда как GPT-6 Astra набрала 60%, а Claude Fable 5.1 — 55%. Даже более дешёвая DeepSeek V4.1 Flash обошла её с результатом 27%.

Grok 4.7 набирает 26 процентов в тесте агентного программирования Terminal-Bench 4.0, значительно отставая от GPT-6 Astra (60 процентов) и Claude Fable 5.1 (55 процентов)

Grok 4.7 набирает 26 процентов в тесте агентного программирования Terminal-Bench 4.0, значительно отставая от GPT-6 Astra (60 процентов) и Claude Fable 5.1 (55 процентов)

Источник: the-decoder.com

Модель доступна через Grok API, Cursor и Grok Build.

Почему я не боюсь, что ИИ нас всех убьёт (и вам тоже не стоит) США потратили миллиарды на наблюдение за границей. Почему людей не находят до смерти? ByteDance запустила Dramagic — ИИ-платформу для коротких сериалов от сценария до экрана Как RetroChimera улучшает прогнозирование синтеза малых молекул в больших масштабах 4 способа устранить выявленные нами сбои у «виртуальной стены» на границе США SoftBank планирует занять более $11 млрд через рискованные облигации ради доли в OpenAI Как мы создали первую подробную карту смертей у «виртуальной стены» на границе США США и Китай запустят диалог по ИИ с механизмом безопасности перед саммитом Трампа и Си Есть Android-смартфон? Google считает, что вам, скорее всего, захочется ноутбук Googlebook Популярный космический сайт выдумал инженера NASA и публиковал ИИ-шлак под её именем США и Китай обсуждают, как уведомлять друг друга об ИИ-угрозах для нацбезопасности Глава Nvidia: «Шанс, что ИИ уничтожит мир к 2030 году, — 0%» Команда робототехников школы Folkestone хочет вдохновить новое поколение Открытый EnvHarness от Google: ИИ-агенты обучаются в средах, меняющихся вместе с ними Через 40 лет в Австралии смертей будет больше, чем рождений — рост замедлится Трамп и Си: смогут ли они провести человечество через революцию ИИ? От этого зависит всё Компании, создающие модели мира, многое держат в секрете Кольцо Vocci добавляет новый форм-фактор для заметок на встречах Действительно ли индустрия ИИ готова сбавить темп? ScrollEd хочет превратить учебники в TikTok

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram