AWS Machine Learning Blog公式発表·2026年7月7日 07:23·約16分
忘却を教える:Amazon Novaによる選択的アンラーニング
本文の状態
日本語全文あり
詳細モードで約16分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
AWS Machine Learning Blog
30秒でわかる
AWS は、コンテンツモデレーションの制限が業務利用を妨げる課題に対し、Amazon Nova で不要な知識のみを選択的に削除する「選択的アンラーニング」技術を公開した。
記事の3ポイント
既存セーフティの限界と課題
デフォルトのコンテンツモデレーションは、セキュリティ訓練や法務分析など正当な業務利用においても不要な拒絶(過剰な防御)を引き起こす問題があり、プロンプトエンジニアリングでは解決できない。
逆方向選好最適化(rDPO)の導入
Amazon は、モデルのパラメータから特定の学習済み行動を標的に除去する「アンラーニング」技術として rDPO を採用し、品質を維持しつつ過剰な防御を減らす手法を開発した。
4 つの責任ある AI 柱に基づく調整
承認された顧客は、安全性(危険行為)、センシティブコンテンツ(暴言など)、公平性(バイアス)、セキュリティ(マルウェア)の 4 つの柱においてセーフティを個別に調整できる。
なぜ重要か・誰に関係するか
この発表が重要なのは、企業による AI 導入において、セキュリティや法務などの正当な業務利用を阻害する過剰なセーフティガードという実存的課題に対し、技術的に解決可能な新たなアプローチ(アンラーニング)を示したからだ。開発者および企業の AI 導入担当者は、自社のユースケースに合わせてモデルの防御レベルを微調整できる機能を確認し、従来は不可能だった業務フローへの AI 統合可能性を再評価すべきである。
背景や根拠まで確認しますか?
元記事の内容を、読みやすい日本語で続けて確認できます。
この記事をシェア
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み