中国 z.ai が公開言語モデル GLM-5.3 の API 提供を開始
本文の状態
日本語全文を表示中
詳細モードで約6分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
VentureBeat AI
中国のスタートアップ z.ai が新世代オープンソース言語モデル「GLM-5.3」を API で公開し、強力なコーディング能力とエージェント性能を維持しながら従来価格で提供すると発表した。
AI深層分析を開く2026年8月19日 11:40
AI深層分析
キーポイント
API の本格公開と機能強化
先週発表された高度なサイバーセキュリティ能力を持つ GLM-5.3 が API で利用可能となり、開発者がエージェントやアプリケーションに組み込めるようになった。
価格設定の据え置き
入力トークンあたり 1.40 ドル、出力トークンあたり 4.40 ドルという価格は前世代 GLM-5.2 と同じであり、性能向上に伴う値上げは行われなかった。
キャッシュ機能の導入
入力トークンのキャッシュ利用料が 100 万あたり 0.26 ドルに設定され、一定期間中はキャッシュ入力ストレージが無料となるキャンペーンが行われている。
オープンソース化の計画
同社はモデルの重み(weights)を将来的に公開する予定を示しているが、具体的な日付とライセンス条件はまだ未定である。
GLM-5.3 の相対的な価格競争力
GLM-5.3 は Gemini 3.7 Flash や GPT-5.6 Luna よりも高価だが、Claude Opus 5 や GPT-5.6 Sol といったプレミアムモデルと比較すると著しく低コスト帯に位置する。
重要な引用
GLM-5.3, the new frontier open source language model from Chinese startup z.ai, has now hit the application programming interface (API)
Z.ai said it plans to make the model's weights openly available, but a precise date and licensing remain to be seen.
On the API, the price is unchanged from GLM-5.2: $1.40 per million input tokens and $4.40 per million output tokens.
That comparison has become more relevant following the latest independent results.
編集コメントを表示
編集コメント
中国のスタートアップがオープンソースモデルの API 化において、性能向上と価格据え置きの両立を実現した点は業界内で注目に値する。今後の重み公開スケジュールとライセンス条件が明確になることで、コミュニティへの影響度合いがさらに拡大すると予想される。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
先週、Cursor において未発見の脆弱性を特定するほど高度なサイバーセキュリティ機能を披露して驚異的なデビューを飾った GLM-5.3。中国のスタートアップ z.ai が開発したこの新世代オープンソース言語モデルが、ついに API を通じて公開されました。これにより、開発者は同モデルを基盤に構築したり、エージェントやアプリケーションへ組み込んだりすることが可能になります。
以前から GLM コーディングプランに加入していた開発者については、現時点では OpenAI の Chat Completions と互換性のあるプロトコルのみが利用可能です。z.ai は今後はモデルの重み(ウェイト)をオープンソースとして公開する計画を示していますが、具体的な日付やライセンス条件はまだ明らかになっていません。
API における料金は GLM-5.2 から据え置かれています。入力は 100 万トークンあたり 1.40 ドル、出力は同 4.40 ドルです。キャッシュされた入力のコストは 100 万トークンあたり 0.26 ドルですが、z.ai は現在、一定期間のみキャッシュ入力ストレージを無料提供しています。
つまり、z.ai が「コーディング能力や長期にわたるエージェントの性能が大幅に向上した」と主張する一方で、開発者はトークンあたりの単価を引き上げられることなく、新世代モデルへ移行できることになります。これらの価格設定は、最高峰とされるいくつかのフロントティア API に比べても十分に競争力があります。
- モデル:入力 ($/1M) / 出力 ($/1M) / 合計 ($/1M) / ソース
- Muse Spark 1.2 Contributor:$0.10 / $0.20 / $0.30 / Meta
- MiMo-V2.5 Flash:$0.10 / $0.30 / $0.40 / Xiaomi
- DeepSeek-V4-Flash — off-peak:$0.22 / $0.66 / $0.88 / DeepSeek
- GPT-5.6 Luna:$0.20 / $1.20 / $1.40 / OpenAI
- MiniMax-M3:$0.30 / $1.20 / $1.50 / MiniMax
- LongCat-2.0 — limited-time promo:$0.30
GLM-5.3 の API 価格が、入力トークンあたり 140 ドル/百万トークン、出力トークンあたり 440 ドル/百万トークンで公開されました。
以下は主要な大規模言語モデルの料金比較表です(単位:ドル/百万トークン)。
- モデル名:入力 (標準) / 出力 (標準) / 出力 (高速) / ベンダー
- DeepSeek-V4-Flash(ピーク時):$0.44 / $1.32 / $1.76 / DeepSeek
- MiMo-V2.5:$0.40 / $2.00 / $2.40 / Xiaomi
- DeepSeek-V4-Pro(オフピーク):$0.66 / $1.98 / $2.64 / DeepSeek
- LongCat-2.0(標準):$0.75 / $2.95 / $3.70 / LongCat
- MiMo-V2.5 Pro (≤256K):$1.00 / $3.00 / $4.00 / Xiaomi
- Gemini 3.6 Flash(2026年12月31日まで):$0.75 / $3.75 / $4.50 / Google
- Gemini 3.7 Flash(2026年12月31日まで):$0.75 / $3.75 / $4.50 / Google
- DeepSeek-V4-Pro(ピーク時):$1.32 / $3.96 / $5.28 / DeepSeek
- Muse Spark 1.1 / 1.2:$1.25 / $4.25 / $5.50 / Meta
- GLM-5.3:$1.40 / $4.40 / $5.80 / Z.AI
- Grok 4.6(プロンプト <200K):$2.00 / $6.00 / $8.00 / xAI
- MiMo-V2.5 Pro (>256K):$2.00 / $6.00 / $8.00 / Xiaomi
- Qwen3.8-Max:$2.00 / $6.00 / $8.00 / QwenCloud
- Gemini 3.6 Flash(2027年1月1日〜):$1.50 / $7.50 / $9.00 / Google
- Gemini 3.7 Flash(2027年1月1日〜):$1.50 / $7.50 / $9.00 / Google
- GPT-5.6 Terra:$2.00 / $12.00 / $14.00 / OpenAI
- Grok 4.6(プロンプト ≥200K):$4.00 / $12.00 / $16.00 / xAI
- GPT-5.4:$2.50 / $15.00 / $17.50 / OpenAI
- Kimi K3:$3.00 / $15.00 / $18.00 / Moonshot AI
- Claude Opus 5:$5.00 / $25.00 / $30.00 / Anthropic
- Sakana Fugu Ultra (≤272K):$5.00 / $30.00 / $35.00 / Sakana AI
- GPT-5.6 Sol(標準モード):$5.00 / $30.00 / $35.00 / OpenAI
- Claude Fable 5 / Claude Mythos 5:$10.00 / $50.00 / $60.00 / Anthropic
- GPT-5.6 Sol(高速モード):$10.00 / $60.00 / $70.00 / OpenAI
VentureBeat の単純な比較(入力 100 万トークン+出力 100 万トークン)によると、GLM-5.3 のコストは 5.80 ドルです。これに対し、低コンテキストレートでの Grok 4.6 は 8 ドル、Kimi K3 は 18 ドル、Claude Opus 5 は 30 ドル、GPT-5.6 Sol は 35 ドルとなっています。
これは実際の請求額を正確に示すものではなく、実際の費用は入力と出力の比率やキャッシュの利用状況、トークン消費量によって大きく変動します。しかし、相対的な API の価格帯を把握するには有用な指標です。
GLM-5.3 が最安値の高性能モデルというわけではありません。Google は 2026 年 12 月 31 日まで、Gemini 3.7 Flash の導入価格として、入力 100 万トークンあたり 0.75 ドル、出力 100 万トークンあたり 3.75 ドルを提示しています。また、OpenAI の GPT-5.6 Luna は、入力が 0.20 ドル、出力が 1.20 ドルです。
それでも、Z.ai が設定した価格により、GLM-5.3 は increasingly ベンチマークされるプレミアムな最先端モデル群と比較しても、明らかに低コスト帯に位置づけられます。
この比較は、最新の独立調査結果を受けてさらに重要性を増しています。Artificial Analysis による知能指数(Intelligence Index)では、GLM-5.3 が 60 点を獲得し、Kimi K3 と並んで世界最高性能のオープンウェイトモデルとなりました。これは GLM-5.2 よりも 7 ポイント高いスコアです。
同分析によると、API トークン単価が同一であるにもかかわらず、GLM-5.3 の知能指数あたりのコストは約 0.68 ドルに対し、GLM-5.2 は約 0.44 ドルと見積もられています。
この差は、 headline API プライシング(表題の価格設定)における重要な注意点を示しています。Artificial Analysis の調査では、GLM-5.3 が前作よりも冗長な回答を生成する傾向があることが判明しており、トークン単価が一定であっても、タスク完了時の総コストが必ずしも同じになるとは限らないのです。
開発者にとって、今回の変化はシンプルです。GLM-5.3 は Z.ai の API を通じて利用可能になり、GLM-5.2 と同じく 100 万トークンあたり 1.40 ドル/4.40 ドルの料金で呼び出せます。これにより、最先端クラスのコーディングやエージェントワークロードのテストに、さらに低コストな選択肢が一つ増えました。
原文を表示
After a stunning debut last week with cyber capabilities so advanced they reportedly found a previously undetected vulnerability in Cursor, GLM-5.3, the new frontier open source language model from Chinese startup z.ai, has now hit the application programming interface (API) — allowing developers the ability to build atop it and plug it into their agents and applications.
Developers who previously subscribed to a GLM Coding Plan are currently limited to the OpenAI Chat Completions-compatible protocol. Z.ai said it plans to make the model's weights openly available, but a precise date and licensing remain to be seen.
On the API, the price is unchanged from GLM-5.2: $1.40 per million input tokens and $4.40 per million output tokens. Cached input costs $0.26 per million tokens, while Z.ai currently lists cached-input storage as free for a limited time.
That means developers can move to the new generation without taking a higher posted per-token rate from Z.ai, even as the company claims substantially stronger coding and long-horizon agent performance.
At those rates, GLM-5.3 sits well below several of the highest-end frontier APIs.
Model
Input ($/1M)
Output ($/1M)
Total ($/1M)
Source
Muse Spark 1.2 Contributor
$0.10
$0.20
$0.30
Meta
MiMo-V2.5 Flash
$0.10
$0.30
$0.40
Xiaomi
DeepSeek-V4-Flash — off-peak
$0.22
$0.66
$0.88
DeepSeek
GPT-5.6 Luna
$0.20
$1.20
$1.40
OpenAI
MiniMax-M3
$0.30
$1.20
$1.50
MiniMax
LongCat-2.0 — limited-time promo
$0.30
$1.20
$1.50
LongCat
DeepSeek-V4-Flash — peak hours
$0.44
$1.32
$1.76
DeepSeek
MiMo-V2.5
$0.40
$2.00
$2.40
Xiaomi
DeepSeek-V4-Pro — off-peak
$0.66
$1.98
$2.64
DeepSeek
LongCat-2.0 — standard
$0.75
$2.95
$3.70
LongCat
MiMo-V2.5 Pro (≤256K)
$1.00
$3.00
$4.00
Xiaomi
Gemini 3.6 Flash — through Dec. 31, 2026
$0.75
$3.75
$4.50
Gemini 3.7 Flash — through Dec. 31, 2026
$0.75
$3.75
$4.50
DeepSeek-V4-Pro — peak hours
$1.32
$3.96
$5.28
DeepSeek
Muse Spark 1.1 / 1.2
$1.25
$4.25
$5.50
Meta
GLM-5.3
$1.40
$4.40
$5.80
Z.AI
Grok 4.6 — <200K prompt tokens
$2.00
$6.00
$8.00
xAI
MiMo-V2.5 Pro (>256K)
$2.00
$6.00
$8.00
Xiaomi
Qwen3.8-Max
$2.00
$6.00
$8.00
QwenCloud
Gemini 3.6 Flash — starting Jan. 1, 2027
$1.50
$7.50
$9.00
Gemini 3.7 Flash — starting Jan. 1, 2027
$1.50
$7.50
$9.00
GPT-5.6 Terra
$2.00
$12.00
$14.00
OpenAI
Grok 4.6 — ≥200K prompt tokens
$4.00
$12.00
$16.00
xAI
GPT-5.4
$2.50
$15.00
$17.50
OpenAI
Kimi K3
$3.00
$15.00
$18.00
Moonshot AI
Claude Opus 5
$5.00
$25.00
$30.00
Anthropic
Sakana Fugu Ultra (≤272K)
$5.00
$30.00
$35.00
Sakana AI
GPT-5.6 Sol — Standard mode
$5.00
$30.00
$35.00
OpenAI
Claude Fable 5 / Claude Mythos 5
$10.00
$50.00
$60.00
Anthropic
GPT-5.6 Sol — Fast mode
$10.00
$60.00
$70.00
OpenAI
Using the simple VentureBeat comparison of one million input tokens plus one million output tokens, GLM-5.3 comes to $5.80, versus $8 for Grok 4.6 at its lower context rate, $18 for Kimi K3, $30 for Claude Opus 5 and $35 for GPT-5.6 Sol.
That is not a workload-cost estimate — real bills depend heavily on the input/output mix, caching and token consumption — but it makes the relative API price tier easy to see.
GLM-5.3 is not the cheapest capable model available. Google’s current introductory price for Gemini 3.7 Flash is $0.75 per million input tokens and $3.75 per million output tokens through Dec. 31, 2026, while OpenAI’s GPT-5.6 Luna is priced at $0.20 input and $1.20 output.
Still, Z.ai’s price puts GLM-5.3 into a notably lower cost band than the premium frontier models it is increasingly benchmarked against.
That comparison has become more relevant following the latest independent results. Artificial Analysis gives GLM-5.3 a score of 60 on its Intelligence Index, tying Kimi K3 as the top performing open weights model in the world, and scoring seven points higher than GLM-5.2. I
ts analysis also estimates GLM-5.3 at about $0.68 per Intelligence Index task, versus roughly $0.44 for GLM-5.2, despite the identical API token prices.
The difference underscores an important caveat in headline API pricing: Artificial Analysis found GLM-5.3 more verbose than its predecessor, so flat per-token rates do not necessarily mean flat costs for a completed workload.
For developers, though, the immediate change is straightforward: GLM-5.3 is now callable through Z.ai’s API at the same $1.40/$4.40 per-million-token rate as GLM-5.2, giving teams another relatively low-cost option for testing frontier-class coding and agent workloads.
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み