Z.aiがコーディング能力に優れたオープンウェイトAIモデル「GLM-5.3」リリース、前モデル比で50%の性能向上
親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト
中国のAI企業・Z.ai(北京智譜華章科技)が、コーディング能力に優れ、サイバーセキュリティタスクでは「これまでで最も有能なモデル」だというAIモデル「GLM-5.3」をリリースしました。 GLM-5.3: Frontier Coding with Emergent Cyber Capabilities https://z.ai/blog/glm-5.3
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense. - Top-tier coding and agentic capabilities, achieved through post-training on the 743B base model - A major leap in cybersecurity, setting a new standard among open models Tech Blog: https://t.co/ekQkO83jCv pic.twitter.com/y3Y2AB0wxr
Z.aiの発表によると、GLM-5.3はGLM-5.2と同じベースモデルを使用し、ポストトレーニングによって性能向上を図ったモデルで、GLM-5.2と比べて複雑なコーディングや長期タスクで大幅な性能向上を実現しており、Z.ai Code Benchによる計測では50%の性能向上が見られたとのこと。 Claude Opus 4.7超えの中華モデル「GLM-5.2」が正式発表される、一部テストではClaude Fable 5を上回りオープンモデルとして誰でもダウンロード可能に - GIGAZINE
GLM-5.3(青)を前モデルのGLM-5.2(緑)やKimi K3、Claude Fable 5、GPT-5.6 Solと各種ベンチマークのスコアで比較したグラフは以下。「Terminal Bench 3.0」「DeepSWE」「Agents' Last Exam」「AutomationBench」「HLE(ツールあり)」「GDPVal-AA v2」の6つのベンチマークを実行していて、GLM-5.3はいずれのスコアでもGLM-5.2を上回り、他社の3モデルに匹敵するスコアを記録しています。
ポストトレーニングのスケールアップに伴い、GLM-5.3はサイバー能力が期待以上に発展し、CyberGymの脆弱性発見で最先端の性能を発揮。「ExploitBench」ではGLM-5.2の2倍以上の性能を示しました。
また、性能とトークン効率のバランスもよく、コーディングパフォーマンスは「Max effort」時にGLM-5.2では9万6000トークンで23.4%だったのに対し、GLM-5.3はおよそ7万5000トークンで34.5%を達成しています。
・関連記事 AI「GLM」を開発した中国Z.ai共同創設者の唐杰氏が「最先端のAIは可能な限りオープンで広くアクセス可能な状態であるべき」と主張 - GIGAZINE GLM-5.2の開発元による中国製AIエージェントアプリ「ZCode」、AnthropicやOpenAIのAIモデルも活用可能 - GIGAZINE Claude Opus 4.7超えの中華モデル「GLM-5.2」が正式発表される、一部テストではClaude Fable 5を上回りオープンモデルとして誰でもダウンロード可能に - GIGAZINE Gemini 3.0 ProやGPT-5.2に匹敵する中国製AI「GLM-5」が登場、Word文書作成などの事務作業も可能でモデルを自由にダウンロード可能 - GIGAZINE
You can read the machine translated English article Z.ai releases 'GLM-5.3,' an openweight A… .
この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。