ページを読み込み中…
1件の記事
英国 AI セキュリティ研究所は心理測定法を用い、言語モデルの一般的な安全性ベンチマークが一貫した特性を測れていないことを示し、一律ブロックがスコアを虚偽に高める可能性を明らかにした。