Hugging Face、10億パラメータのオープン HRM「DFM Mimir v1」を公開
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Hugging Face Daily Papers
DFM は許可されたデータのみで訓練した10億パラメータの言語モデル「Mimir v1」を発表し、英語とデンマーク語で最先端性能を達成した。
AI深層分析を開く2026年8月18日 18:26
AI深層分析
キーポイント
倫理的データによる高性能化
許可されたポストトレーニングデータのみを使用し、大規模言語モデル開発の障壁となっている非許可データの依存問題を解決するアプローチを示す。
HRM アーキテクチャの採用
階層推論モデル(HRM)アーキテクチャに基づき、ゼロから訓練された 10 億パラメータ規模のモデルが実装されている。
多言語・多分野での競争力
20 のベンチマークで評価され、英語と数学・コードタスクでは大規模モデルと競合し、デンマーク語では新たな最高記録を達成した。
オープンソースの公開
同モデルは Hugging Face Hub で公開されており、研究コミュニティが自由に利用可能な状態にある。
重要な引用
We introduce Mimir v1, a 1-billion-parameter language model based on the Hierarchical Reasoning Model (HRM) architecture
delivers highly competitive performance for English and sets a new state of the art for Danish using only permissible post-training data
編集コメントを表示
編集コメント
許可されたデータのみで最先端性能を達成した点は、オープンソース界隈における重要な転換点となる。特にデンマーク語での SOTA 達成は、低リソース言語への技術的貢献を示す好例である。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
現在の大規模言語モデルの開発は、膨大なデータセットに依存しており、その多くは利用制限のあるものです。これにより、オープンソースや倫理的なデータソースを重視する研究者にとって高い参入障壁が生じています。
私たちは「Mimir v1」を発表します。これは階層推論モデル(HRM)アーキテクチャに基づく 10 億パラメータ規模の言語モデルです。このモデルはゼロから学習され、許可されたデータのみを用いたポストトレーニングによって、英語タスクでは極めて競争力のある性能を達成し、デンマーク語タスクにおいては新たな最高記録を更新しました。
Mimir v1 は 161 のデータセットを組み合わせて訓練されています。その結果、元の HRM-Text 1B を上回り、Qwen 3.5 4B や Gemma 4 E2B といったより大規模な最先端モデルと互角の性能を示しました。これらの評価は、英語・数学・コード分野およびデンマーク語を対象とした 20 のベンチマークテストを通じて行われました。
本モデルは Hugging Face Hub で公開されています:https://huggingface.co/danish-foundation-models/DFM-Mimir
原文を表示
Current large language model development relies on massive, often non-permissible datasets, creating a high barrier for researchers committed to open-source and ethically sourced data. We introduce Mimir v1, a 1-billion-parameter language model based on the Hierarchical Reasoning Model (HRM) architecture, that is trained from scratch and delivers highly competitive performance for English and sets a new state of the art for Danish using only permissible post-training data. Trained on a mixture of 161 datasets, Mimir v1 outperforms the original HRM-Text 1B and competes with larger frontier models like Qwen 3.5 4B and Gemma 4 E2B, tested across 20 benchmarks for English, Math & Code and Danish. The model is available on the Hugging Face Hub: https://huggingface.co/danish-foundation-models/DFM-Mimir
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み