中国 z.ai の GLM-5.3 が API 公開、100 万トークンあたり 1.4 ドル
本文の状態
日本語全文を表示中
詳細モードで約6分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
TLDR AI
中国のスタートアップ z.ai が発表した新モデル GLM-5.3 が API で利用可能となり、前世代と同じ価格でコード生成やエージェント性能が大幅に強化されたことが明らかになった。
AI深層分析を開く2026年8月20日 21:56
AI深層分析
キーポイント
GLM-5.3 の API 公開と機能強化
中国のスタートアップ z.ai が「GLM-5.3」を API で提供開始し、前世代よりもコード生成能力や長期ホライゾンのエージェント性能が大幅に向上したことを発表した。
価格設定とキャッシュ機能
入力トークンあたり 140 ドル、出力トークンあたり 440 ドルという前世代 GLM-5.2 と同様の価格設定を維持しつつ、キャッシュ入力コストやストレージの無料期間特典も提供している。
オープンソース化への計画
z.ai はモデルの重み(weights)を将来的に公開する方針を示したが、具体的な日付とライセンス条件は未定である。
GLM-5.3 の価格設定
Z.AI が提供する GLM-5.3 は、入力トークンあたり1.4ドル、出力トークンあたり4.4ドルで提供されている。
他社モデルとの価格比較
GLM-5.3 の価格は、DeepSeek-V4-Pro や Gemini 3.6 Flash と同程度かやや高めであり、Grok 4.6 よりも安価である。
重要な引用
GLM-5.3, the new frontier open source language model from Chinese startup z.ai, has now hit the application programming interface (API)
the price is unchanged from GLM-5.2: $1.40 per million input tokens and $4.40 per million output tokens
Z.ai said it plans to make the model's weights openly available
$1.40
編集コメントを表示
編集コメント
GLM-5.3 は、性能向上を維持しながら価格据え置きを実現した点で市場競争力を示している。ただし、重みの公開時期が未定である点は、オープンソースコミュニティや研究機関にとって今後の動向に注目が必要となる。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
先週、Cyber 能力が極めて高度で、Cursor の未発見の脆弱性を特定したと報じられるデビューを飾った GLM-5.3。中国のスタートアップ z.ai が開発したこの新世代オープンソース言語モデルは、ついに API を公開しました。
これにより、開発者は GLM-5.3 を基盤に自社のエージェントやアプリケーションを構築し、組み込むことが可能になりました。
以前から GLM Coding Plan に加入していた開発者向けには、現時点で OpenAI の Chat Completions と互換性のあるプロトコルが提供されています。Z.ai はモデルの重み(weights)を将来的にオープンソース化すると発表していますが、具体的な公開日やライセンス条件についてはまだ未定です。
API 利用料金は GLM-5.2 と同じく据え置かれています。入力トークン 100 万個あたり 1.40 ドル、出力トークン 100 万個あたり 4.40 ドルです。キャッシュされた入力の処理コストは 100 万トークンあたり 0.26 ドルで、Z.ai は現在、一定期間に限りキャッシュ入力ストレージを無料提供しています。
つまり、同社が大幅なコード能力の向上や長期ホライズンのエージェント性能の高さを謳っているにもかかわらず、開発者は GLM-5.3 へ移行しても、トークンあたりの単価を引き上げられる心配はありません。
これらの価格設定は、最高峰のフロントエンド API のいくつかと比較しても十分に競争力のある水準です。
| モデル | 入力 ($/1M) | 出力 ($/1M) | 合計 ($/1M) | ソース |
|---|---|---|---|---|
| Muse Spark 1.2 Contributor | $0.10 | $0.20 | $0.30 | Meta |
| MiMo-V2.5 Flash | $0.10 | $0.30 | $0.40 | Xiaomi |
| DeepSeek-V4-Flash — off-peak | $0.22 | $0.66 | $0.88 | DeepSeek |
| GPT-5.6 Luna | $0.20 | $1.20 | $1.40 | OpenAI |
| MiniMax-M3 | $0.30 | $1.20 | $1.50 | MiniMax |
| LongCat-2.0 — limited-time promo | $0.30 | $1.20 | $1.50 | LongCat |
| DeepSeek-V4-Flash — peak hours | $0.44 | $1.32 | $1.76 | DeepSeek |
| MiMo-V2.5 | $0.40 | $2.00 | $2.40 | Xiaomi |
| DeepSeek-V4-Pro — off-peak | $0.66 | $1.98 | $2.64 | DeepSeek |
| LongCat-2.0 — standard | $0.75 | $2.95 | $3.70 | LongCat |
| MiMo-V2.5 Pro (≤256K) | $1.00 | $3.00 | $4.00 | Xiaomi |
| Gemini 3.6 Flash — through Dec. 31, 2026 | $0.75 | $3.75 | $4.50 | |
| Gemini 3.7 Flash — through Dec. 31, 2026 | $0.75 | $3.75 | $4.50 | |
| DeepSeek-V4-Pro — peak hours | $1.32 | $3.96 | $5.28 | DeepSeek |
| Muse Spark 1.1 / 1.2 | $1.25 | $4.25 | $5.50 | Meta |
| GLM-5.3 | $1.40 | $4.40 | $5.80 | Z.AI |
| Grok 4.6 — <200K prompt tokens | $2.00 | $6.00 | $8.00 | xAI |
| MiMo-V2.5 Pro (>256K) | $2.00 | $6.00 | $8.00 | Xiaomi |
| Qwen3.8-Max | $2.00 | $6.00 | $8.00 | QwenCloud |
| Gemini 3.6 Flash — starting Jan. 1, 2027 | $1.50 | $7.50 | $9.00 | |
| Gemini 3.7 Flash — starting Jan. 1, 2027 | $1.50 | $7.50 | $9.00 | |
| GPT-5.6 Terra | $2.00 | $12.00 | $14.00 | OpenAI |
| Grok 4.6 — ≥200K prompt tokens | $4.00 | $12.00 | $16.00 | xAI |
| GPT-5.4 | $2.50 | $15.00 | $17.50 | OpenAI |
| Kimi K3 | $3.00 | $15.00 | $18.00 | Moonshot AI |
| Claude Opus 5 | $5.00 | $25.00 | $30.00 | Anthropic |
| Sakana Fugu Ultra (≤272K) | $5.00 | $30.00 | $35.00 | Sakana AI |
| GPT-5.6 Sol — Standard mode | $5.00 | $30.00 | $35.00 | OpenAI |
| Claude Fable 5 / Claude Mythos 5 | $10.00 | $50.00 | $60.00 | Anthropic |
| GPT-5.6 Sol — Fast mode | $10.00 | $60.00 | $70.00 | OpenAI |
VentureBeat の単純な比較基準(入力 100 万トークン+出力 100 万トークン)に基づくと、GLM-5.3 の料金は 5.80 ドルです。これに対し、Grok 4.6 は低コンテキストレートで 8 ドル、Kimi K3 は 18 ドル、Claude Opus 5 は 30 ドル、GPT-5.6 Sol は 35 ドルとなっています。
これは実際のワークロードコストの推計ではありません。実務での請求額は入力と出力の比率やキャッシュの有無、トークン消費量に大きく依存します。ただし、相対的な API の価格帯を把握するには有用な指標です。
GLM-5.3 が最安値の高性能モデルというわけではありません。Google は現在、Gemini 3.7 Flash の導入期間中(2026 年 12 月 31 日まで)に、入力 100 万トークンあたり 0.75 ドル、出力 100 万トークンあたり 3.75 ドルの特別価格を設定しています。また OpenAI の GPT-5.6 Luna は、入力が 0.20 ドル、出力が 1.20 ドルです。
それでも Z.ai が設定した GLM-5.3 の価格は、比較対象となるプレミアムな最先端モデル群と比較して、明らかに低コスト帯に位置しています。
最新の独立した調査結果により、この比較はさらに重要性を増しています。Artificial Analysis が発表した知能指数(Intelligence Index)によると、GLM-5.3 は 60 点を獲得し、Kimi K3 と並んで世界最高性能のオープンウェイトモデルとなりました。これは GLM-5.2 よりも 7 ポイント高いスコアです。
また同社の分析では、知能指数に基づくタスクあたりのコストは GLM-5.3 で約 0.68 ドル、GLM-5.2 では約 0.44 ドルと試算されています。これは API のトークン単価が同一であるにもかかわらずです。
この差は、API の headline プライシング(表題価格)には重要な注意点があることを示しています。Artificial Analysis の調査では、GLM-5.3 は前作よりも冗長な回答を生成する傾向があることが判明しました。つまり、トークン単価が一定であっても、タスク完了時の総コストが必ずしも同じになるとは限りません。
開発者にとっての直接的な変化はシンプルです。GLM-5.3 は Z.ai の API を通じて利用可能となり、GLM-5.2 と同様に 100 万トークンあたり 1.40 ドル/4.40 ドルのレートで呼び出せます。これにより、最先端クラスのコーディングやエージェントワークロードのテストに、さらに低コストな選択肢が追加されました。
原文を表示
After a stunning debut last week with cyber capabilities so advanced they reportedly found a previously undetected vulnerability in Cursor, GLM-5.3, the new frontier open source language model from Chinese startup z.ai, has now hit the application programming interface (API) — allowing developers the ability to build atop it and plug it into their agents and applications.
Developers who previously subscribed to a GLM Coding Plan are currently limited to the OpenAI Chat Completions-compatible protocol. Z.ai said it plans to make the model's weights openly available, but a precise date and licensing remain to be seen.
On the API, the price is unchanged from GLM-5.2: $1.40 per million input tokens and $4.40 per million output tokens. Cached input costs $0.26 per million tokens, while Z.ai currently lists cached-input storage as free for a limited time.
That means developers can move to the new generation without taking a higher posted per-token rate from Z.ai, even as the company claims substantially stronger coding and long-horizon agent performance.
At those rates, GLM-5.3 sits well below several of the highest-end frontier APIs.
| Model | Input ($/1M) | Output ($/1M) | Total ($/1M) | Source |
|---|---|---|---|---|
| Muse Spark 1.2 Contributor | $0.10 | $0.20 | $0.30 | Meta |
| MiMo-V2.5 Flash | $0.10 | $0.30 | $0.40 | Xiaomi |
| DeepSeek-V4-Flash — off-peak | $0.22 | $0.66 | $0.88 | DeepSeek |
| GPT-5.6 Luna | $0.20 | $1.20 | $1.40 | OpenAI |
| MiniMax-M3 | $0.30 | $1.20 | $1.50 | MiniMax |
| LongCat-2.0 — limited-time promo | $0.30 | $1.20 | $1.50 | LongCat |
| DeepSeek-V4-Flash — peak hours | $0.44 | $1.32 | $1.76 | DeepSeek |
| MiMo-V2.5 | $0.40 | $2.00 | $2.40 | Xiaomi |
| DeepSeek-V4-Pro — off-peak | $0.66 | $1.98 | $2.64 | DeepSeek |
| LongCat-2.0 — standard | $0.75 | $2.95 | $3.70 | LongCat |
| MiMo-V2.5 Pro (≤256K) | $1.00 | $3.00 | $4.00 | Xiaomi |
| Gemini 3.6 Flash — through Dec. 31, 2026 | $0.75 | $3.75 | $4.50 | |
| Gemini 3.7 Flash — through Dec. 31, 2026 | $0.75 | $3.75 | $4.50 | |
| DeepSeek-V4-Pro — peak hours | $1.32 | $3.96 | $5.28 | DeepSeek |
| Muse Spark 1.1 / 1.2 | $1.25 | $4.25 | $5.50 | Meta |
| GLM-5.3 | $1.40 | $4.40 | $5.80 | **[Z.AI**](https://docs.z.ai/guides/overview/pricing) |
| Grok 4.6 — 256K) | $2.00 | $6.00 | $8.00 | Xiaomi |
| Qwen3.8-Max | $2.00 | $6.00 | $8.00 | QwenCloud |
| Gemini 3.6 Flash — starting Jan. 1, 2027 | $1.50 | $7.50 | $9.00 | |
| Gemini 3.7 Flash — starting Jan. 1, 2027 | $1.50 | $7.50 | $9.00 | |
| GPT-5.6 Terra | $2.00 | $12.00 | $14.00 | OpenAI |
| Grok 4.6 — ≥200K prompt tokens | $4.00 | $12.00 | $16.00 | xAI |
| GPT-5.4 | $2.50 | $15.00 | $17.50 | OpenAI |
| Kimi K3 | $3.00 | $15.00 | $18.00 | Moonshot AI |
| Claude Opus 5 | $5.00 | $25.00 | $30.00 | Anthropic |
| Sakana Fugu Ultra (≤272K) | $5.00 | $30.00 | $35.00 | Sakana AI |
| GPT-5.6 Sol — Standard mode | $5.00 | $30.00 | $35.00 | OpenAI |
| Claude Fable 5 / Claude Mythos 5 | $10.00 | $50.00 | $60.00 | Anthropic |
| GPT-5.6 Sol — Fast mode | $10.00 | $60.00 | $70.00 | OpenAI |
Using the simple VentureBeat comparison of one million input tokens plus one million output tokens, GLM-5.3 comes to $5.80, versus $8 for Grok 4.6at its lower context rate, $18 forKimi K3, $30 for Claude Opus 5 and $35 for GPT-5.6 Sol.
That is not a workload-cost estimate — real bills depend heavily on the input/output mix, caching and token consumption — but it makes the relative API price tier easy to see.
GLM-5.3 is not the cheapest capable model available. Google’s current introductory price for Gemini 3.7 Flash is $0.75 per million input tokens and $3.75 per million output tokens through Dec. 31, 2026, while OpenAI’s GPT-5.6 Luna is priced at $0.20 input and $1.20 output.
Still, Z.ai’s price puts GLM-5.3 into a notably lower cost band than the premium frontier models it is increasingly benchmarked against.
That comparison has become more relevant following the latest independent results. Artificial Analysis gives GLM-5.3 a score of 60 on its Intelligence Index, tying Kimi K3 as the top performing open weights model in the world, and scoring seven points higher than GLM-5.2.
Its analysis also estimates GLM-5.3 at about $0.68 per Intelligence Index task, versus roughly $0.44 for GLM-5.2, despite the identical API token prices.
The difference underscores an important caveat in headline API pricing: Artificial Analysis found GLM-5.3 more verbose than its predecessor, so flat per-token rates do not necessarily mean flat costs for a completed workload.
For developers, though, the immediate change is straightforward: GLM-5.3 is now callable through Z.ai’s API at the same $1.40/$4.40 per-million-token rate as GLM-5.2, giving teams another relatively low-cost option for testing frontier-class coding and agent workloads.
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み