知っていたよな
中国のオープンウェイトモデル「GLM-5.2」が脆弱性検出ベンチマークでClaude Codeを上回る
2026年06月30日 23時00分
https://gigazine.net/news/20260630-glm-5-2-beats-claude-cyber-benchmarks/
>>中国のAI企業であるZ.aiが2026年6月に発表したオープンウェイトのAIモデル「GLM-5.2」が、脆弱(ぜいじゃく)性の検出精度を測定するベンチマークにおいて、AnthropicのClaude Codeを上回ったと報告されました。
>>GLM-5.2は各種ベンチマークでClaude Opus 4.7を上回るスコアを記録しており、人間によるブラインドテストではClaude Fable 5を上回った例もあることが報告されています。
>>サイバーセキュリティ企業のSemgrepは6月22日、「Insecure Direct Object Reference(IDOR:インセキュア・ダイレクト・オブジェクト・リファレンス)」の検出精度を測定するベンチマークを用いて、GLM-5.2やClaude Code(Opus 4.6/4.7/4.8)、GPT-5.5などのAIモデルをテストした結果を報告しました。
>>SemgrepはGLM-5.2の興味深い点として、「オープンウェイトのためAIモデルのパラメータが公開されており、ユーザーが自分のハードウェアで実行・検証できる」「約7500億個のパラメータを持つエキスパート混合モデル(MoE)であり、コーディング面で競争力がある」「必要なコストが同等の最先端AIモデルの約6分の1だと報告されている」といったことを挙げています。