ページを読み込み中…
ページを読み込み中…
7件の記事
Hugging Face は LLM ポストトレーニング手法 OPD^2 を研究し、Qwen3 で英語・韓国語・日本語の数学推論で有効性を示した。
AI が人間の知能を凌駕する可能性について、数学者たちがその影響や対応策を検討している状況が報じられた。
MIT研究者らは国際数学オリンピック(IMO)の過去問題集を体系的に収集・整理し、AI研究者や学生向けに一般公開した。
研究者らが、多言語数学問題の高品質データセット「mAceReason-Math」を公開した。このデータセットは、検証可能な報酬による強化学習(RLVR)の訓練用に設計されており、英語以外の言語での数学・論理問題解決能力の向上に貢献する。
LLM内部の特定タスクを担う「回路」と呼ばれる疎なサブネットワークを強化する手法を提案。標的的な更新により数学推論能力を向上させる研究。