ページを読み込み中…
ページを読み込み中…
Topic / 企業・研究機関
全85件中 81–85件 · 3媒体
DeepSeek、再帰的証明探索と新ベンチマークでニューラル定理証明を進展させる「DeepSeek-Prover-V2」を発表
Synced Review2025年5月1日開発元
DeepSeek は Lean 4 環境向けに再帰的証明探索と新しいベンチマークを特徴とする大規模モデル DeepSeek-Prover-V2 を公開し、数学的推論能力において新記録を達成した。
GRPOは10倍効率的か?Kwai AIのSRPOがYesを示唆
Synced Review2025年4月24日主題
Kwai AI は、数学およびコード領域で DeepSeek-R1-Zero に匹敵する性能を、訓練ステップ数を約 10 分の 1 に抑えることで達成する新手法 SRPO を発表した。
DeepSeek、次世代R2モデルを示唆しSPCTを用いた推論スケーリングの新手法を公開
Synced Review2025年4月11日開発元
DeepSeek AI が次世代モデル R2 の登場を示唆するとともに、推論段階でのスケーラビリティを革新する SPCT 技術と RL と LLM の相乗効果に関する詳細な研究論文を発表した。