GLM-5.1がLMArenaコードランキングでオープンソース1位、世界3位を獲得
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
智谱
智谱のGLM-5.1が、AI評価プラットフォームLMArenaのコード性能ランキングでオープンソースモデル1位、全モデル中3位を達成した。同モデルは長期間タスクで8時間でのLinuxデスクトップ構築などの成果を上げ、Claude Opus 4.6に次ぐ持続作業能力を持つ数少ないモデルとなった。
Continue in AI NEW LAB
このニュースを、実務の判断につなげる
AI NEW LABで、試したことや先に確認したい条件を共有できます。まずはログインなしで読めます。
AI NEW LABで論点を見るSource Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
智譜 2026-04-10 17:15 北京
本日、世界的に権威あるAI評価プラットフォーム「LMArena」(百万人規模のユーザーが参加するブラインドテスト)が、Code Arenaの専門ランキングを更新しました。これにより、GLM-5.1が世界のオープンソースモデルで第1位に躍進し、全モデル中でも第3位にランクインしました。
GLM-5.1は、前世代モデルが持つオープンソースSOTAのコーディング能力を継承しているだけでなく、長期的タスク(Long-Horizon Task)においてもブレークスルーを達成し、以下の実績を実現しました:
💻 8時間でゼロからLinuxデスクトップを構築
📊 655イテレーションでベクトルデータベースの最適化ボトルネックを打破
🤖 1000ラウンドのツール呼び出しにより実世界の機械学習モデル負荷を最適化
特筆すべきは、METRランキングの同等評価基準において、GLM-5.1が8時間に及ぶ持続作業を達成した唯一のオープンソースモデルである点です。これは世界的に見ても、Claude Opus 4.6を除けば、この能力を有する数少ないモデルの一つであることを意味します。
ぜひご利用・ご体験ください。
image
WeChatで開く
原文を表示
智谱 2026-04-10 17:15 北京
今日,全球权威AI评测平台LMArena(百万用户参与盲测)更新Code Arena专项榜单,GLM-5.1登顶全球开源模型第一,位列全球模型第三。
GLM-5.1不仅继承了上一代模型的开源SOTA编码能力,还在长程任务(Long-Horizon Task)上取得突破,实现了:
💻 8小时从零构建Linux桌面
📊 655次迭代打破向量数据库优化瓶颈
🤖 1000轮工具调用优化真实机器学习模型负载
值得一提的是,在METR榜单的同等评估标准下,GLM-5.1是唯一达到8小时级持续工作的开源模型,也是全球范围内除Claude Opus 4.6外少数具备这一能力的模型。
欢迎接入与体验。
image
跳转微信打开
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み