謎の高性能AI「Ox Alpha」の正体は「GLM-5.3-Flash」だったことが判明、Claude Opus 4.8と同等性能のオープンモデル&中国製チップで運用可能
親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト
中国に拠点を置くAI企業のZ.aiがAIモデル「 GLM-5.3-Flash 」を2026年8月26日に発表しました。GLM-5.3-Flashは「 Ox Alpha 」という仮称でテストされていたモデルで、Claude Opus 4.8に匹敵する性能であることがアピールされています。 GLM-5.3-Flash: Frontier Intelligence, Flash Cost https://z.ai/blog/glm-5.3-flash GLM-5.3-Flash - Overview - Z.AI DEVELOPER DOCUMENT https://docs.z.ai/guides/vlm/glm-5.3-flash GLM-5.3-Flashは総パラメーター数3200億・アクティブパラメーター数180億のMoEモデルで、コンテキスト長は最大100万トークンです。総パラメーター数7530億のGLM-5.2より規模の小さいモデルですが、スパースアテンションと線形アテンションを組み合わせたハイブリッドアーキテクチャを採用することでGLM-5.2を超える性能を実現しています。
「GLM-5.3-Flash」「GLM-5.2」「DeepSeek-V4-Vision-Exp」「Claude Opus 4.8」「GPT-5.6 Terra」「Gemini 3.7 Flash」のベンチマーク結果が以下。
「GLM-5.3」「GLM-5.2」「GLM-5.3-Flash」「Claude Fable 5」「Claude Opus 4.8」のコーディングエージェントとしての性能を思考の深さ別に示したグラフが以下。Z.aiはGLM-5.3-Flashの性能について「総合的にClaude Opus 4.8と匹敵する性能」とアピールしています。
第三者機関の Artificial Analysis もGLM-5.3-Flashの性能分析結果を公開しています。インテリジェンス性能の総合指標であるArtificial Analysis Intelligence Indexのスコアは「57」で、Claude Opus 4.8を上回りました。
エージェント性能の指標であるArtificial Analysis Agentic Indexのスコアは「58」で、Claude Opus 4.8だけでなくClaude Fable 5やGPT-5.6 Solを上回っています。
以下のグラフは横軸がタスクごとのコスト、縦軸がArtificial Analysis Intelligence Indexのスコアを示しています。GLM-5.3-Flashが低コストかつ高性能なモデルであることが分かります。
横軸を総パラメーター数、縦軸をArtificial Analysis Intelligence Indexのスコアとしたグラフが以下。GLM-5.3-Flashは同一規模のモデルと比べて数段階高いスコアを達成しています。
ベンチマークスコアだけでなく、現実のタスクでの実用性も重視されています。例えば視覚的な成果物を生成する際に自己検証によって成果物の品質を向上させることができます。
また、中国製のAIチップで運用可能であることも大きな特徴としてアピールされています。GLM-5.3-FlashはOx Alphaという仮称で約1週間にわたってテスト運用されており、2026年8月24日16時半頃に一時的に接続が不安定になったものの、1日当たり数兆トークン規模のサービス運用に成功していました。このテストでは「中国製AIチップの大規模クラスタ」が使用されていたそうです。 謎のAI「Ox Alpha」が出現し無料テスト中、コンテキストウィンドウは100万トークンで1日数兆トークンを処理できる匿名ラボがAPIを提供 - GIGAZINE
GLM-5.3-FlashはZ.aiのAPIを介して使用可能。100万トークン当たりの料金は入力0.15ドル(約24円)・キャッシュ済み入力0.03ドル(約5円)、出力0.25ドル(約40円)です。また、公開から2週間は半額キャンペーンが実施されています。
GLM-5.3-Flash is now 50% off through the official https://t.co/GTCIA6vbgh API for the next two weeks. After the discount: - Input: $0.075 - Output: $0.25 - Cached input: $0.015 https://t.co/vXz0g204sh The discount is also available through third-party model aggregators. pic.twitter.com/riAUVqzUQP
さらに、GLM-5.3-Flashはオープンモデルとして公開されており、以下のリンク先からダウンロード可能。ライセンスはMIT Licenseを採用しています。 zai-org/GLM-5.3-Flash · Hugging Face https://huggingface.co/zai-org/GLM-5.3-Flash
・関連記事 Z.aiがコーディング能力に優れたオープンウェイトAIモデル「GLM-5.3」リリース、前モデル比で50%の性能向上 - GIGAZINE GLM-5.2の開発元による中国製AIエージェントアプリ「ZCode」、AnthropicやOpenAIのAIモデルも活用可能 - GIGAZINE AI「GLM」を開発した中国Z.ai共同創設者の唐杰氏が「最先端のAIは可能な限りオープンで広くアクセス可能な状態であるべき」と主張 - GIGAZINE ローカルで動く中国製オープンモデル「Qwen3.8 27B」はGPT-5.6 Terra超えのエージェント性能で同等規模のモデルより圧倒的に高性能という分析結果 - GIGAZINE テンセントがAIモデル「Hy3」をオープンモデルとして公開、295BでGLM-5.2やDeepSeek-V4に匹敵&科学タスクではGPT-5.5を上回る - GIGAZINE Metaがローカル動作するオープンモデル「Muse Glimmer」を公開、30BでGoogleのGemma 4 31Bより高性能 - GIGAZINE
この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。