Zhipu AI が GLM-5.3 をリリース——オープンウェイト コーディングモデルの最強版、50% の性能向上を実現
中国の AI企業 Zhipu AI が、オープンウェイト版コーディングモデル GLM-5.3 をリリース。前世代比 50% の性能向上を達成。サイバーセキュリティ訓練により 269 プロジェクトで 2,436 の脆弱性を発見。2週間以内にモデルウェイトが OSS化予定。
Zhipu AI、GLM-5.3 で オープンウェイト コーディングモデル最強版を実現
中国の AI企業 Zhipu AI は 8 月 13 日、新型オープンウェイトコーディングモデル GLM-5.3 をリリースしました。前世代の GLM-5.2 と同じベースアーキテクチャから開発され、ポストトレーニングの強化のみで 50% の性能向上 を達成。開発者・セキュリティチームが即座に使用可能になります。
50% 性能向上の秘密はセキュリティ訓練にあり
GLM-5.3 の改善は単なる汎用コーディング能力の向上にとどまりません。Zhipu AI はモデルを 脆弱性検出と悪用チェーン推論に特化したデータセット で訓練しました。
複数段階の悪用推論へ進化
「複数段階の悪用を横断して推論し、完全な悪用チェーンのための一貫した計画を形成し始めた」
これは単に「バグを見つける」のではなく、「セキュリティ研究者のように、複数の脆弱性を組み合わせた攻撃シナリオを考える」能力を意味します。
リアルワールド実績:2,436 の脆弱性を発見
Zhipu AI は中国のセキュリティ組織と協働し、GLM-5.3 の脆弱性検出能力を実証しました:
| 指標 | 結果 |
|---|---|
| 調査対象プロジェクト数 | 269 件 |
| 発見された脆弱性 | 2,436 件 |
| 脆弱性の公開登録 | 公開脆弱性レジストリに記録済み |
| 発見内容 | 数十年前のレガシー脆弱性を含む |
これらの脆弱性は単なる「報告」ではなく、セキュリティコミュニティの公開データベースに記録され、開発者が対応を進めています。
開発者への即時提供、2 週間以内に OSS化
現在の提供方法
GLM-5.3 は以下のプラットフォームで即座に利用可能:
- GLM Coding Plan — Zhipu の標準コーディング API
- ZCode — Zhipu の IDE 統合
- Claude Code — Anthropic の Claude Code 内
- OpenCode — オープンコーディング環境
オープンソース化スケジュール
セキュリティレビュー完了後、2 週間以内にモデルウェイトを完全にオープンソース化 する予定。開発者は自組織のサーバー上で GLM-5.3 を実行可能になります。
業界への影響:オープンウェイト コーディングモデルの新標準
GLM-5.3 のリリースは、コーディングモデル市場における 3 つの転換を示唆します:
- セキュリティ優先設計 — 単なる「コード生成速度」ではなく「脆弱性検出力」が競争軸に
- オープンウェイトの実用性向上 — プロプライエタリモデル(OpenAI Codex など)に匹敵する性能をオープンで実現
- 地政学的な多極化 — 中国発の高性能コーディングモデルが、エンタープライズ・セキュリティ市場でも存在感を高める
開発チームやセキュリティエンジニアは、今後 2 週間の OSS化を待つか、GLM Coding Plan で即座に試用を始めることが可能です。
アップデート(2026/08/20)
リリース発表から 1 週間後、Artificial Analysis による独立ベンチマーク調査で GLM-5.3 の競争力が明確になりました。
ベンチマーク成績:オープンモデル同率 1 位
Artificial Analysis Intelligence Index の評価で GLM-5.3 は 60 ポイント を獲得。Kimi K3 と並んでオープンモデルの最高峰に到達しました。
全体ランキングでは Claude Opus 5 に次ぐ 2 位 に位置しており、プロプライエタリモデルとの性能差が大幅に縮小しています。
| ランク | モデル | スコア |
|---|---|---|
| 1 | Claude Opus 5 | 63 |
| 2 | GLM-5.3 | 60 |
| 2 | Kimi K3 | 60 |
| 4 | GPT-5.6 Luna | 59 |
価格競争力:Kimi K3 より 19% 廉価
GLM-5.3 の API 利用料は $0.68 per task に設定され、同等性能の Kimi K3($0.84)と比べて 19% 安い 価格で提供されます。オープンモデルながら、価格でもプロプライエタリ勢と競争している状況が明らかになりました。
OSS化延期の理由:セキュリティ脆弱性検出能力が高すぎる
リリース時に「2 週間以内に OSS化予定」とアナウンスされていましたが、実際にはセキュリティ懸念から 2 週間の延期 が実施されています。理由は、GLM-5.3 が脆弱性検出に極めて高い能力を持つため、モデルウェイトを広く公開する前に、セキュリティベンダーや政府機関との調整が必要になったとみられます。
開放時期は現在、選定されたセキュリティパートナーへのアクセスに限定された上で段階的に進められる方針です。
アップデート(2026/09/30):Anthropic、GLM-5.3のエクスプロイト構築能力をClaude Mythosと比較評価
Anthropicが公表した評価で、GLM-5.3のサイバーエクスプロイト構築能力が、自社の最新モデルClaude Mythos Previewとほぼ同水準にあることが明らかになりました。オープンウェイトモデルが、十分な安全対策のないまま高度な攻撃能力を持つ点が懸念材料として指摘されています。
ベンチマーク結果:Mythos Previewに肉薄
AnthropicのExploitBenchテストでは、GLM-5.3が410試行中50回の成功、Mythos Previewが56回の成功と、僅差の結果になりました。社内のバイナリ脆弱性テストでも、GLM-5.3が4%、Mythos Previewが6%の成功率で、性能差はごくわずかです。
| テスト項目 | GLM-5.3 | Claude Mythos Preview |
|---|---|---|
| ExploitBench(410試行中の成功数) | 50回 | 56回 |
| バイナリ脆弱性テスト成功率 | 4% | 6% |
セーフガードの脆弱性も判明
Anthropicによると、リクエストを「レッドチームテスト」に見せかけた場合、GLM-5.3は64%の試行で攻撃的な動作を実行したといいます。さらに、拒否機能を無効化する「abliteration」という手法を適用すると、拒否率は2〜12%まで低下することも確認されました。
業界への影響:オープンウェイトモデルの二面性が浮き彫りに
今回の評価は、GLM-5.3が持つ高い脆弱性検出力(本記事の元の発表内容)が、防御目的だけでなく攻撃目的にも転用しうる「デュアルユース」の性格を持つことを裏付けるものです。プロプライエタリモデルに匹敵するサイバー能力を持つモデルが安全策の薄い状態でオープンに公開されることで、防御側と攻撃側の能力差が縮まる一方、セキュリティ脆弱性の発見が民主化されるというトレードオフが、業界内でも改めて議論を呼んでいます。