AI
GLM-5.2がClaude超え。Semgrepの脆弱性検出で独立検証
Fable 5の規制から16日。米国が止めたのと同等のサイバーセキュリティ能力が、中国のオープンウェイトモデルで確認された。セキュリティ企業Semgrepの独立ベンチマークで、Z.aiのGLM-5.2がClaude Codeを脆弱性発見の精度で上回った。中国のセキュリティ大手360は「中国版Mythos」の開発を発表し、ジェフリーズはこの動きを「DeepSeekモーメント」と呼んだ。 「Mythosが家にある」 6月22日、セキュリティ分析ツールを開発するSemgrepが公開したベンチマーク結果のタイトルは「We Have Mythos at Home」(うちにMythosがある)だった。 We have Mythos at Home: GLM 5.2 beats Claude in our Cyber BenchmarksAmong models given nothing but a prompt, the best open-weight