拡散言語モデルのデコード加速のための段階的改良規制
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
ArXiv cs.AI
研究者らが、拡散言語モデルのテキスト生成において、トークンごとに安定化速度が異なる問題に対処する段階的改良規制手法を提案した。この手法は、均一な改良規則の代わりに、トークンごとに改良の必要性を動的に評価することで、冗長な処理を削減し、デコード速度を向上させる。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
arXiv:2603.04514v1 アナウンスタイプ: 新規
要約: 拡散言語モデルは、すべてのトークンに均一な改良ルールを適用した反復的ノイズ除去によりテキストを生成する。しかし実際には、トークンは異なる速度で安定化するため、冗長な改良が多分に生じ、ノイズ除去プロセスに対する改良制御の必要性が高まる。既存手法では、固定されたデコーディングプロセスにおいて、瞬間的・ステップレベルの信号から改良の必要性を評価するのが一般的である。これに対し、あるトークンが収束したかどうかは、その予測が将来の改良軌道に沿ってどのように変化するかによって定義される。さらに、改良ルールを変更すると将来の改良軌道が再形成され、それが今度は改良ルールの定式化方法を決定するため、改良制御は本質的に動的な性質を持つ。本研究では、完全なデコーディングのロールアウトから、経験的収束進捗をトークンレベルで定義する、漸進的かつ軌道に基づく改良制御フレームワーク「漸進的改良制御(Progressive Refinement Regulation, PRR)」を提案する。この信号に基づき、PRRは軽量なトークン単位のコントローラーを学習し、漸進的自己進化トレーニングスキームの下で温度ベースの分布形成により改良を制御する。実験により、PRRが生成品質を維持しつつ、拡散言語モデルのデコーディングを大幅に高速化することが示された。
原文を表示
arXiv:2603.04514v1 Announce Type: new
Abstract: Diffusion language models generate text through iterative denoising under a uniform refinement rule applied to all tokens. However, tokens stabilize at different rates in practice, leading to substantial redundant refinement and motivating refinement control over the denoising process. Existing approaches typically assess refinement necessity from instantaneous, step-level signals under a fixed decoding process. In contrast, whether a token has converged is defined by how its prediction changes along its future refinement trajectory. Moreover, changing the refinement rule reshapes future refinement trajectories, which in turn determine how refinement rules should be formulated, making refinement control inherently dynamic. We propose \emph{Progressive Refinement Regulation} (PRR), a progressive, trajectory-grounded refinement control framework that derives a token-level notion of empirical convergence progress from full decoding rollouts. Based on this signal, PRR learns a lightweight token-wise controller to regulate refinement via temperature-based distribution shaping under a progressive self-evolving training scheme. Experiments show that PRR substantially accelerates diffusion language model decoding while preserving generation quality.
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み