中国 AI ラボ Z.ai、匿名モデル Ox Alpha の正体を明かす
本文の状態
日本語全文を表示中
詳細モードで約5分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
TLDR AI
中国のAIラボZ.aiは、匿名で公開され大規模な人気を集めたモデルOx Alphaが自社製GLM-5.3-Flashであることを発表し、中国製チップでの推論と低コスト高性能を特徴とする。
AI深層分析を開く2026年8月28日 07:03
AI深層分析
キーポイント
Ox Alphaの正体解明
Z.aiは匿名で公開されOpenCodeやOpenRouterでトップを独占したモデルOx Alphaが、自社開発のGLM-5.3-Flashであることを公式に発表した。
中国製チップでの推論
同社によると、このモデルの人気による急激なトラフィックはすべて中国製のAIチップ上で処理されているという。
高性能と低コストの両立
GLM-5.3-Flashは前世代比でベンチマーク性能を向上させつつ、推論コストを約10分の1に抑えたと発表している。
技術的革新のアプローチ
ハイブリッドアテンションアーキテクチャや「Manifold-Constrained Hyper-Connections」と呼ばれる新手法により、精度を損なわず長文コンテキスト処理のコストを削減している。
無料モデルの隠れたコスト
低価格やゼロコストのモデルアクセスは一見魅力的だが、実際には隠れたコストを伴う。監査可能性は向上するが、検証済みでテストされたモデルの方が安全である。
重要な引用
"GLM-5.3-Flash shows that frontier intelligence does not have to come at frontier cost"
"served on Chinese AI chips"
"specifically designed for ultra-low-cost inference"
"Ox Alpha demonstrates how low- and zero-cost model access may sound appealing at first, but free access always carries hidden costs," said Sj.
編集コメントを表示
編集コメント
Z.aiは匿名モデルの正体を明らかにし、中国製ハードウェアでの高効率推論という独自の強みを前面に出した。業界全体がコスト競争に直面する中、このアプローチが他社にも波及するか注目される。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
中国の AI ラボ、Z.ai が、話題となっている匿名モデル「Ox Alpha」の実体であることを明らかにしました。
先週水曜日、Z.ai は GLM-5 シリーズ初のネイティブ多モーダルモデルである「GLM-5.3-Flash」を発表しました。同社によると、このモデルは OpenCode や OpenRouter で匿名の「Ox Alpha」として公開され、リーダーボードを席巻したことで話題となりました。特に、1 日あたり 100 トリリオントークンの処理能力を提供できる点が注目されています。
発表では、このモデルの人気急上昇に伴うすべてのトラフィックが、「中国製の AI チップ」上で処理されたことも明かされました。
同社によれば、GLM-5.3-Flash は総パラメータ数が 3,200 億、アクティブなパラメータ数が 1,800 万です。前世代の GLM-5.2 を上回る性能を、価格が 1/10 というコストで実現しています。
さらに、コーディングやエージェントタスクにおけるベンチマークでは Claude Opus 4.8 に迫る性能を誇り、ソフトウェアエンジニアリング、多段階のエージェント作業、ツール利用、専門業務などの分野では、DeepSeek-V4、GPT-5.6 Terra、Gemini 3.7 Flash と同等の性能を発揮すると主張しています。
同社は、このモデルが「極限の効率性」を追求し、「超低コストでの推論」に特化して設計されたと説明しています。
同社は、GLM-5.3-Flash は「少ないリソースでより多くのことを実現する」ために設計されたと説明しています。ハイブリッドアテンションアーキテクチャを採用することで、精度を損なうことなく長文コンテキストへのクエリ処理コストを削減しました。
さらに同モデルは、「マンifold 制約ハイパーコネクション(Manifold-Constrained Hyper-Connections)」と呼ばれる技術を実装し、ニューラルネットワークの層間での情報伝達効率を高めることで「スケーリング効率」の向上を図っています。
現在、このモデルの重みは Hugging Face で入手可能です。また、Z.ai のコーディングツールである ZCode にも搭載されています。
同社は発表で、「GLM-5.3-Flash は、最先端の知能が必ずしも最先端のコストを伴うわけではないことを示した」と述べています。「今後はこのアプローチをより大規模なモデルへ展開していきます。GLM-5.3-Flash はコストと性能の限界を押し広げ、その構築過程で得た教訓は、すでに次世代の最先端モデルの開発に反映され始めています」。
Z.ai の Ox Alpha での勝利は、オープンソースモデルにとって特に重要な時期に訪れました。現在、オープンソースモデルプラットフォームの Hugging Face は、同社を 130 億ドルと評価する買収オファーを検討中だと報じられています。また、Nvidia は先週、米国におけるオープンソース AI エコシステムの強化のために 60 億ドルを投資すると発表しました。
GLM-5.3-Flash was essentially designed to do more with less, the company said, using a hybrid attention architecture to reduce the cost of serving long-context queries without sacrificing accuracy.
Additionally, the model is built to improve "scaling efficiency" by implementing what are called "Manifold-Constrained Hyper-Connections," or a technique that improves the way that information moves through the layers of a neural network.
The model weights are currently available on Hugging Face. The model is also powering ZCode, Z.ai's coding tool.
"GLM-5.3-Flash shows that frontier intelligence does not have to come at frontier cost," the company said in its announcement. "We are now scaling this recipe to larger models — GLM-5.3-Flash pushes the cost-performance frontier, and the lessons from building it are already shaping our next frontier model."
Z.ai's Ox Alpha win comes at a particularly poignant moment for open models: Open source model platform Hugging Face is reportedly fielding acquisition offers that value the company at $13 billion, and Nvidia last week announced a $6 billion investment in bolstering the open source AI ecosystem in the US.
中国の企業は、特に「トークンコスト」という課題に注力している可能性があります。LogicMonitor の首席 AI オフィサーであるカルティク・SJ 氏は The Deep View に対し、以前は AI への支出をためらわずに行うよう促されていた開発者たちが、現在は予算制約に直面する中、独自プロバイダーのモデルと同等の性能を持つ中国発のモデルが魅力的に映るだろうと語りました。
「Ox Alpha は、低コストや無料でのモデルアクセスが一見すると魅力的に聞こえることを示していますが、無料アクセスには常に隠れたコストが伴います」と SJ 氏は指摘します。「Z.ai がこのモデルの開発元であることを明らかにすることで監査可能性の懸念は一部解消されますが、審査済みで十分にテストされたモデルを選ぶ方が安全です。」
私たちの深い視点
Z.ai が GLM-5.3-Flash をリリースした背景には、コストとリソース効率への注目が明白です。しかし、このモデルの人気の高さは、もう一つのトレンドを示しています。つまり、日常利用のためのモデルがすべて最先端である必要はないのです。
GLM-5.3-Flash は、Anthropic や Google、OpenAI といった大手ラボが提供する最前線のモデルと互角か、わずかに劣る程度です。それでも、極めて有用なモデルになるために、超強力である必要はありません。
OpenAI が より低い価格で最先端モデルを利用するよう 誘導しようとしているのは事実ですが、そのコストで推論を提供し続けることができる期間は限られています。大抵の企業タスクにおいては、中程度の性能でも十分です。特に ROI(投資対効果)を追求する場面ではなおさらです。
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み