最新ニュース
あなたへのおすすめ

AnthropicのMythos 5を上回る:中国のZ.aiが大胆なGLM-5.3の主張

著者ハンナ・コリーモアハンナ・コリーモア 2分で読了
AnthropicのMythos 5を上回る:中国のZ.aiが大胆なGLM-5.3を主張
  • Z.aiは、自社のGLM-5.3がCyberGymセキュリティベンチマークにおいてAnthropicのMythos 5を僅差で上回ったと発表しました。
  • このオープンウェイトモデルは、すでに実在するソフトウェア内で1,097件の深刻なバグを検出しています。
  • 安全性レビューのため、重みパラメータは8月28日頃まで公開が見送られています。

中国のAI企業、智譜AI(HKG: 2513)は、最新モデルGLM-5.3のリリースに伴って公開した文書で、大物狙いの狩りに出た。

国際的にZ.aiとして取引されている同社は、 具体的に AnthropicのMythos 5 を、GLM-5.3が上回ったモデルの一つとして挙げた。CyberGymベンチマークは、モデルがソフトウェアの脆弱性についてソースコードをチェックする能力を測定するものである。

GLM-5.3は、GLM-5.2と同じベースモデル上で動作し、7,430億パラメータのMixture-of-Experts設計で、トークンごとに約400億パラメータが活性化される。

Z.aiのGLM-5.3は他のモデルと比べてどうか?

Z.aiが広めた数字によると、その GLM-5.3 はCyberGymベンチマークで84.5%のスコアを記録し、AnthropicのMythos 5(83.8%)やOpenAIのGPT-5.6 Sol(83.6%)をわずかに上回る僅差だった。

Mythosを打ち負かすことで、Z.aiはオープンウェイトモデルをデプロイして攻撃に対抗しようとする開発者やセキュリティチームの間でナンバーワンに躍り出る可能性がある。同社は、このモデルがすでにライブソフトウェアで1,000件以上の深刻なバグを検出したと述べている。

ExploitBenchやExploitGymといったより困難なテストでは、Z.aiは最新のモデルが米国のトップモデルに劣認することを認めている。

例えば、ExploitBenchでは、モデルに脆弱性から実際に動作するエクスプロイトを構築させる課題が出され、GLM-5.3は54.4%のスコアだったのに対し、Mythos 5は78%だった。

GLM-5.3のウェイトはいつ利用可能になるか?

Z.aiは、新しい GLM-5.3モデル のウェイトを8月28日にHugging Faceで公開することを約束している。これはGLMモデルのウェイトが公開を保留された初のケースであり、中国のAIラボは、安全性の評価と強化を理由に2週間の遅延を説明した。

モデルが見つけた2,436件の脆弱性のうち、Linuxカーネル、WinRAR、Redis、FFmpegなどで使用されているソフトウェアを含む約269件のプロジェクトをレビューした後、100件以上が重大度が高いと評価された。最も古い欠陥は、45年間発見されていなかったと報告されている。

それまで、Z.aiのコーディングプランの有料サブスクライバーまたはそのZCodeハーンズのみがこれを使用できる。

これらの数字はZ.ai自身の

上記のすべての数値は、Z.aiの発表からのものであり、独立した実行結果ではない。公開ベンチマークでさえ、Z.aiが独自の構成を使用して実行したものであり、内部のCode Benchは社外では監査できない。

Independent leaderboards such as Artificial Analysis は、このCryptopolitanの報告時点では、まだこのモデルを追加していない。

今回のリリースは、その重要性を示す生きた例の直後に訪れた。Z.aiの以前のGLM-5.2は、 Hugging Faceが OpenAIのテストシステムがガードレールを減らして実行され、サンドボックスを脱出してサーバーを侵害した後に頼ったモデルだった。

地政学的な観点から、智譜は協力的なトーンで記者団に、AIは「一国のソロパフォーマンスではなく、グローバルな協力の交響楽であるべきだ」と語った。

最も賢明な暗号通貨の専門家たちはすでに私たちのニュースレターを読んでいます。あなたも参加しませんか? 彼らに加わりましょう。

よくある質問

GLM-5.3とは何ですか?

GLM-5.3は、中国の企業Zhipu(通称:Z.ai)が2026年8月14日にリリースした、オープンウェイトのコーディングおよびサイバーセキュリティ専用モデルです。GLM-5.2と同じ7,430億パラメータのベースモデルを採用しており、すべての改善点は新しいモデルではなく追加のポストトレーニングによって実現されています。

GLM-5.3は実際にAnthropicのMythos 5を上回ったのでしょうか?

ベンチマークは一つだけですが、Z.aiによるとGLM-5.3はCyberGymで84.5パーセントのスコアを記録し、Mythos 5の83.8パーセントをわずかに上回りました。しかし、より難易度の高いExploitBench(78パーセント対54.4パーセント)やExploitGymテストでは、Mythos 5が依然として大きくリードしています。

GLM-5.3のオープンウェイトはいつ利用可能になりますか?

Z.aiによれば、安全性評価とハードニングが完了次第、ローンチから約2週間後の2026年8月28日頃にHugging Face上で重みパラメータを公開する予定です。それまでは、モデルの利用はZ.ai Coding Planの有料サブスクリプションユーザーと、そのZCodeツールに限定されます。

この記事をシェア
ハンナ・コリーモア

ハンナ・コリーモア

Hannahは、暗号通貨分野でほぼ10年にわたるブログ執筆およびイベントレポートの経験を持つライター兼編集者です。Cryptopolitanでは、ニュースページに寄稿し、DeFi、RWA(実世界資産)、暗号通貨規制、AI、フロンティアテック業界の最新の動向を報告・分析しています。アーケディア大学でビジネス経営の学位を取得しています。

もっと見る… ニュース