ページを読み込み中…
ページを読み込み中…
4件の記事
KDnuggets が、大規模言語モデル(LLM)の仕組みを分かりやすく説明する 5 つの有益な論文を紹介した。
研究者らが、大規模言語モデルを評価者として用いる手法を改善し、その判断基準が人間の実際の嗜好と一致するよう調整する新しいアプローチを発表した。
OpenAIのGPT-4が日本語をフランス語のつづりで表記する実験を行い、言語モデルの多言語処理能力を検証した。
Lilian Weng氏は、データ不足時の学習手法として、既存の訓練サンプルに対して増強や変換を適用して合成データを生成する「Augmented data」のアプローチについて解説している。