ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Grok 4.7 превосходит Fable 5.1 и GPT-5.6 Sol в тесте Харви на юридическую силу агента, при этом входная цена Fable составляет одну пятую от цены Fable

КРанда МозесРанда Мозес 2 минуты чтения
Grok 4.7 превосходит Fable 5.1 и GPT-5.6 Sol в тесте Харви на юридическую силу агента, при этом его входная цена составляет пятую часть от цены Fable.
  • Grok 4.7 набрал 19,6% в бенчмарке Harvey Legal Agent, опередив Fable 5.1 (6,7%) и GPT-5.6 Sol (2,5%).
  • Компания xAI оценивает Grok 4.7 в 2 доллара за миллион входных токенов, что составляет пятую часть от цены Fable 5.1 в 10 долларов.
  • Fable 5.1 по-прежнему превосходит Grok 4.7 на Terminal-Bench 4.0, 57,9% против 38,0%.

В понедельник компания xAI запустила Grok 4.7. В бенчмарке для юридических агентов он превзошел Fable 5.1 от Anthropic и GPT-5.6 Sol от OpenAI, при этом его цена за входной токен составила пятую часть от цены Fable.

Цена выпуска составляет 6 долларов за миллион токенов против 50 долларов у Anthropic

В пресс-релизе xAI говорится, что Grok 4.7 набрал 19,6% в тесте Harvey Legal Agent Benchmark. Fable 5.1 получил 6,7% в том же тесте, а GPT-5.6 Sol — 2,5%.

Таким образом, Grok 4.7 примерно в три раза превосходит Anthropic и почти в восемь раз — Sol. Cryptopolitan сообщал , что Grok 4.6 уже опережает этот дуэт с показателем 15,8%.

Юридическая работа — одна из немногих областей, где Grok 4.7 превосходит обоих конкурентов. Он также успешно проходит тест Fable 5.1 по электротехнике на платформе EEBench и немного опережает его в тесте DeepSWE по программированию.

Цена Grok 4.7 составляет 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов, как и в Grok 4.6. Эта ставка для входных токенов составляет половину от 4 долларов в GPT-5.6 Sol и пятую часть от 10 долларов в Fable 5.1.

Стоимость продукции составляет 6 долларов против 20 долларов у Sol и 50 долларов у Fable, что примерно в восемь раз меньше, чем у Anthropic.

Компания xAI сопоставила результаты CursorBench 4.0 со средней стоимостью выполнения задачи и утверждает, что модель находится на границе соотношения цены и производительности. Grok 4.7 показывает около 46% на этом графике при стоимости примерно 6 долларов за задачу, в то время как Claude Opus 5 требует почти вдвое больших затрат для достижения аналогичного результата.

Fable 5.1 демонстрирует лучшие результаты при больших бюджетах, достигая 51,8% при стоимости около 17 долларов за задачу. Релиз стал «tronсочетанием интеллекта, скорости и низкой стоимости», — сказал Маск на X.

Grok 4.7 превосходит Fable 5.1 и GPT-5.6 Sol в тесте Харви на юридическую силу агента, при этом его входная цена составляет пятую часть от цены Fable.
Цены токенов и показатели производительности из сообщения SpaceXAI о запуске Grok 4.7 , опубликованного 21 сентября 2026 года.

Terminal-Bench 4.0 обеспечивает компании Anthropic преимущество в 57,9% против 38,0%

Grok 4.7 занял второе место после Fable 5.1 в тестах GDPval и AA Briefcase (тест на выполнение офисной работы). Модель Anthropic сохраняет явное лидерство в тестах на выполнение более длительных операций программирования и тестах производительности терминала.

Наибольший отрыв наблюдается в Terminal-Bench 4.0, где Fable 5.1 показал 57,9% против 38,0% у Grok 4.7, разница составляет около 20 пунктов.

Fable также лидирует в тестах CursorBench и HealthBench Professional по клиническому анализу, где GPT-5.6 Sol также превосходит Grok.

Grok 4.7 набрал 1695 баллов по шкале Эло на GDPval, которая оценивает модели, выполняющие задачи, с которыми сталкиваются юристы, медсестры и финансовые аналитики, что выше, чем 1605 баллов у Grok 4.6. Это меньше, чем у Fable 5.1 (1735 баллов), но больше, чем у более новой модели OpenAI GPT-6 Astra (1542 балла) в том же рейтинге.

Grok 4.7 опережает GPT-5.6 Sol по пяти из семи тестов. Он уступает только DeepSWE и клиническому тесту.

Grok 4.7 работает на основе 2,1 триллиона параметров, что на 40% больше, чем 1,5 триллиона параметров, используемых в Grok 4.6. В систему xAI включены дополнительные обучающие данные SpaceX, в том числе телеметрия со спутника Starlink и производственные записи.

Компания утверждает, что эта модель с большей вероятностью потратит дополнительное время на решение сложных задач и перепроверит свои ответы, чем Grok 4.6.

Модель через API xAI без очереди.

Все приведенные здесь данные получены в результате собственных тестов xAI. Тест CursorBench, с которого xAI начинает работу, разработан компанией Cursor, приобретение которой SpaceX завершила в прошлом месяце.

xAI сравнивали с GPT-5.6 Sol, а более новая модель OpenAI GPT-6 Astra фигурирует только в таблицах GDPval, AA Briefcase и EEBench.

Самые умные криптоаналитики уже читают нашу рассылку. Хотите присоединиться? Вступайте в их ряды.

Часто задаваемые вопросы

Сколько стоит Grok 4.7 по сравнению с Fable 5.1 и GPT-5.6 Sol?

Стоимость Grok 4.7 составляет 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов, в то время как Fable 5.1 стоит 10 и 50 долларов соответственно.

В каких тестах Grok 4.7 выигрывает, а в каких проигрывает?

Grok 4.7 лидирует в юридическом бенчмарке Харви с показателем 19,6%, а Fable 5.1 опережает CursorBench, Terminal-Bench и HealthBench Professional.

Насколько велика модель Grok 4.7 и на чём она была обучена?

Grok 4.7 работает с 2,1 триллионом параметров и включает дополнительные обучающие данные SpaceX, такие как телеметрия со спутника Starlink.

Поделитесь этой статьей

Предупреждение. Предоставленная информация не является торговой рекомендацией. Cryptopolitanнастоятельно не несет ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мыtronпровести независимоеdent и/или проконсультироваться с квалифицированным специалистом, прежде чем принимать какие-либо инвестиционные решения.

Ранда Мозес

Ранда Мозес

Ранда Мозес — редактор и репортер Cryptopolitan освещающая темы технологий, искусственного интеллекта, робототехники, криптовалют, мошенничества и взломов. Она работает в криптопространстве с 2017 года. Ранее работала в Forward Protocol, AmaZix и Cryptosomniac. Ранда имеет степень в области электротехники иtron, полученную в Университете Брэдфорда.

ЕЩЕ… НОВОСТИ