ページを読み込み中…
1件の記事
研究者らが、微細な強化学習(RL)を用いてエージェントに能動的な文脈管理を学習させる手法と、そのモデル「ContextPilot-14B」を Hugging Face で公開した。