マスク氏はGrok 5でAGIを匂わせたが、4.7はAnthropicやOpenAIの最新モデルに劣っている。

写真はSalvador Riosによるもので、 Unsplashから提供されています。
- マスク氏はX上で、xAIの未発表バージョンであるGrok 4.7は、AnthropicのOpus 5.0とほぼ同等の性能で、より新しいOpus 5.1には劣ると述べた。.
- 彼は、金曜日に指摘された強化学習の遅延を受けて、依然としてマルチモーダルな修正が必要だと述べた。.
- 彼はGrok 4.8、4.9、5という迅速なフォローアップの道筋を示し、最後の5については「おそらくこれまでで最高のものになるだろう」と約束した。
イーロン・マスク氏は、xAIのGrok 4.7モデルのリリース前から、その期待値を抑えつつ、Xの投稿で、このモデルは最新のOpus 5.1モデルやFable、あるいはOpenAIのAstraと比較するよりも、AnthropicのOpus 5.0とより相性が良いと認めている。.
マスク氏はまた、マルチモーダル性能にはまだ改善の余地があると述べた。これらの発言と実際の性能は、テスラCEOが製品発売前に通常煽る誇大宣伝とはかけ離れている。.
マスク氏はGrok 4.7について何と言ったのか?
Grok 4.7が競合製品と比べてどうなのかという質問に対し、 マスク氏は 「Opus 5.1ではなく、Opus 5.0とほぼ同等の性能であるべきだ」と答えた。SpaceXの最高経営責任者であるマスク氏はさらに、「ある面では優れているが、別の面では劣っている」と付け加えた。
マスク氏は 金曜日 、Grok 4.7は「もう少し調整が必要だ」と説明した。どうやら、強化学習の際に、応答の長さに対して過度にペナルティを課してしまった可能性があるという。その結果、新しいモデルは「(本来はできるはずの)難しいタスクを早々に諦めてしまう」ようになり、自己検証能力もまだ必要なレベルに達していなかった。
当初9月12日にリリース予定だったGrok 4.7は 、SpaceXのエンジニアリングデータで補完された約2.1兆個のパラメータを持つモデルだと説明されている。これらの報道が確認されれば、最新モデルは、 約1.5兆個のパラメータを持つと報じられているGrok 4.6よりも40%大きくなることになる 。
Anthropic社のClaude Fable 5.1に対する第三者機関 による評価で は、既にTerminal-Bench-Scienceで52.6%のスコアが報告されており、価格は入力トークン100万個あたり10ドル、出力トークン100万個あたり50ドルと公表されている。
未発表のGrok 4.7には、ベンチマークスコアやトークン価格に関する公式な情報は一切ありません。本レポート執筆時点では、競合モデルよりも最大10倍安価になる可能性があるという主張も未検証です。.
マスク氏はすでにAGIを約束している
マスク氏はすぐに野心的な投稿に戻り、まだ発売されていない4.7モデルに続く迅速な発売計画を練り上げた。.

Grok 4.8は、xAIの新しいC++ソフトウェアスタックでトレーニングされた2.5兆個のパラメータを持つモデルであり、今週中にトレーニングを完了し、その後強化学習を開始する予定だと彼は述べた。彼はこれを4.7からの「顕著な改善」と評した。
そこからマスク氏は、Grok 4.9はおそらく「Astra/Fableクラス」になるだろうと主張した。これは OpenAIのGPT-6 Astra と AnthropicのFableシリーズ。彼は 述べ 、以前のバージョンでは「実行中にのみ修正された」エラーがあったと指摘した。また、アップグレードされた内部トレーニングソフトウェアとよりクリーンなデータを使用した、近々予定されている3兆パラメータの実行についても言及した。
より大きな主張は、最上位機種のために取っておかれた。マスク氏は、Grok 5は「おそらくこれまでで最高のものになるだろう」と述べつつも、「どうなるか見てみよう」と付け加えた。別のユーザーからの質問に対し、特定の機能を提供するものは何かと尋ねられた際、 彼は「それはGrok 5になるだろう」とだけ答えた。
マスク氏はそのリリース日を明示せず、主張以外の証拠も示さなかった。今のところ、測定可能な基準はGrok 4.6のままであり、マスク氏自身がクリアすべきハードルとして挙げたOpus 5.1とOpenAIのAstraは既に市場に出回っており、Grok 4.7のリリースを待っている状況だ。.
最も賢い暗号通貨マインドを持つ人々はすでに私たちのニュースレターを読んでいます。参加してみませんか?ぜひ ご参加ください。
よくある質問
Grok 4.7はAnthropicのモデルと比べてどうですか?
マスク氏は、Grok 4.7は最新のOpus 5.1ではなく、Opus 5.0とほぼ同等の性能であり、「ある面では優れているが、別の面では劣っている」と述べ、マルチモーダル性能については依然として改善が必要だと付け加えた。.
Grok 4.7のリリースが遅れたのはなぜですか?
金曜日、マスク氏は、強化学習が応答の長さに過度にペナルティを与えている可能性があり、そのためモデルが難しいタスクを早々に諦めたり、作業内容を厳密に検証しなかったりする傾向があるため、モデルにはあと数日必要だと述べた。.
Grok 4.8とは何ですか?
マスク氏によると、Grok 4.8はxAIの新しいC++ソフトウェアスタックでトレーニングされた2.5兆個のパラメータを持つモデルで、今週中にトレーニングを完了し、その後強化学習を開始する予定であり、これは4.7からの顕著な改善だと彼は述べている。.

ハンナ・コリモア
ハンナは、暗号資産分野で10年近くにわたりブログ執筆やイベントレポートに携わってきたライター兼エディターです。Cryptopolitan Cryptopolitan、ニュースページに記事を寄稿し、 DeFi、RWA、暗号資産規制、AI、最先端技術産業における最新の動向をレポート・分析しています。アーカディア大学で経営学の学位を取得しています。.













