ページを読み込み中…
1件の記事
大規模言語モデルの数学的推論において、正解ラベルに依存しないテスト時トレーニングを実現する新手法「TTPO」を提案し、多数決による疑似ラベルの脆弱性を克服したと報告した。