最新ニュース
あなたへのおすすめ

Grok 4.7は、Fable 5.1とGPT-5.6 SolをHarveyの法律代理人テストで上回り、Fableの入力価格の5分の1でテストに合格した。

によるランダ・モーゼスランダ・モーゼス 2分で読む
Grok 4.7は、Harveyの法律代理人テストにおいて、Fable 5.1とGPT-5.6 Solを上回り、Fableの入力コストの5分の1でそれを達成した。.
  • Grok 4.7はHarvey Legal Agent Benchmarkで19.6%のスコアを獲得し、Fable 5.1の6.7%、GPT-5.6 Solの2.5%を上回った。.
  • xAIはGrok 4.7を100万トークンあたり2ドルで販売しており、これはFable 5.1の10ドルの5分の1の価格である。.
  • Fable 5.1はTerminal-Bench 4.0において、Grok 4.7を57.9%対38.0%で上回っています。.

xAIは月曜日にGrok 4.7をリリースした。 法律代理人ベンチマークにおいて、AnthropicのFable 5.1とOpenAIのGPT-5.6 Solを上回り、入力トークンあたりの価格はFableの5分の1に抑えられている。

出力は100万トークンあたり6ドルで、Anthropicの50ドルと比較して大幅に低い。

xAIの発表によると、Grok 4.7はHarvey Legal Agent Benchmarkで19.6%のスコアを獲得した。同じテストでFable 5.1は6.7%、GPT-5.6 Solは2.5%だった。.

これにより、Grok 4.7のスコアはAnthropicの約3倍、Solの約8倍となる。Cryptopolitan Cryptopolitan先月、Grok 4.6が既に15.8%でこの2銘柄をリードしていると報じた

法律業務は、Grok 4.7が競合製品2社を完全に凌駕する数少ない分野の一つです。また、EEBenchの電気工学分野ではFable 5.1を上回り、DeepSWEのコーディングテストでもわずかに上回っています。.

Grok 4.7の価格は、入力トークン100万個あたり2ドル、出力トークン100万個あたり6ドルで、Grok 4.6と同じです。この入力レートは、GPT-5.6 Solの4ドルの半分、Fable 5.1の10ドルの5分の1です。.

出力はSolの20ドルに対し6ドル、Fableの50ドルで、Anthropicの約8分の1となっている。.

xAIはCursorBench 4.0のスコアをタスク完了あたりの平均コストに対してプロットし、このモデルが価格性能比で最高水準にあると主張している。Grok 4.7はタスクあたり約6ドルで約46%のスコアを獲得しているのに対し、Claude Opus 5は同様の結果を得るためにほぼ2倍の費用が必要となる。.

Fable 5.1は予算が多いほどパフォーマンスが向上し、タスクあたり約17ドルで51.8%まで向上しました。マスク氏はXで、今回のリリースは「インテリジェンス、スピード、低コストのtronな組み合わせ」だと述べました。.

Grok 4.7は、Harveyの法律代理人テストにおいて、Fable 5.1とGPT-5.6 Solを上回り、Fableの入力コストの5分の1でそれを達成した。.
SpaceXAIのGrok 4.7ローンチに関する 投稿(2026年9月21日公開)からのトークン価格とベンチマークスコア。

Terminal-Bench 4.0により、Anthropicが57.9%対38.0%でリード

Grok 4.7は、GDPvalとAA Briefcaseオフィスワークテストにおいて、Fable 5.1に次ぐ2位となった。しかし、より長時間のコーディングや端末ベンチマークでは、Anthropicのモデルが明確なリードを保っている。.

最も大きな差が見られたのはTerminal-Bench 4.0で、Fable 5.1が57.9%だったのに対し、Grok 4.7は38.0%で、約20ポイントの差があった。.

FableはCursorBenchとHealthBench Professionalの臨床推論においても優位に立っており、GPT-5.6 SolもGrokを上回っている。.

Grok 4.7は、弁護士、看護師、金融アナリストなどの職業におけるモデルの能力を評価するGDPvalで1,695 Eloを獲得し、Grok 4.6の1,605から上昇した。これはFable 5.1の1,735には及ばないものの、同じチャートでOpenAIの最新モデルであるGPT-6 Astraが獲得した1,542を上回っている。.

Grok 4.7は、7つのベンチマークのうち5つでGPT-5.6 Solを上回っています。DeepSWEと臨床試験のみがGrok 4.7に劣っています。.

Grok 4.7は2.1兆個のパラメータで動作し、Grok 4.6の1.5兆個よりも40%増加しています。xAIは、Starlink衛星のテレメトリデータや製造記録など、SpaceXの補足的なトレーニングデータを追加しました。.

同社によれば、このモデルはGrok 4.6よりも、難しい問題に時間をかけたり、自身の解答を二重チェックしたりする傾向が強いという。.

この モデルは 、Grokアプリ、Cursor、Grok Build、およびxAI API上で、待機リストなしでリリースされました。

ここに掲載されている数値はすべてxAI独自のテスト結果です。xAIが最初に用いたテストであるCursorBenchは、SpaceXが先月買収を完了したCursor社によって開発されました。.

xAIはGPT-5.6 Solをベンチマーク対象としており、OpenAIのより新しいGPT-6 AstraはGDPval、AA Briefcase、EEBenchのチャートにのみ登場する。.

最も賢い暗号通貨マインドを持つ人々はすでに私たちのニュースレターを読んでいます。参加してみませんか?ぜひ ご参加ください

よくある質問

Grok 4.7の価格は、Fable 5.1やGPT-5.6 Solと比べてどのくらいですか?

Grok 4.7は、入力トークン100万個あたり2ドル、出力トークン100万個あたり6ドルかかるのに対し、Fable 5.1はそれぞれ10ドルと50ドルかかる。.

Grok 4.7はどのベンチマークで勝ち、どのベンチマークで負けるのか?

Grok 4.7はHarveyの法律ベンチマークで19.6%のシェアを獲得し、Fable 5.1はCursorBench、Terminal-Bench、HealthBench Professionalでトップとなった。.

Grok 4.7の規模はどれくらいですか?また、どのようなデータで学習されましたか?

Grok 4.7は2.1兆個のパラメータに基づいて動作し、Starlink衛星のテレメトリデータなどのSpaceXの補足的なトレーニングデータが含まれています。.

この記事を共有する

免責事項。 提供される情報は取引アドバイスではありません。Cryptopolitan.com Cryptopolitan、 このページで提供される情報に基づいて行われた投資について一切の責任を負いません。tronお勧めしますdent 調査や資格のある専門家への相談を

ランダ・モーゼス

ランダ・モーゼス

ランダ・モーゼスは、 Cryptopolitan の編集者兼記者として、テクノロジー、AI、ロボット工学、暗号通貨、詐欺、ハッキングなどを取材しています。彼女は2017年から暗号通貨業界で活動しており、Forward Protocol、AmaZix、Cryptosomniacなどで勤務経験があります。ランダはブラッドフォード大学で電気tron工学の学位を取得しています。.

もっと…ニュース