Googleの感情データセットの30%が誤ってラベル付けされている
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
Googleが昨年公開した「GoEmotions」データセット(Redditコメント5.8万件を27の感情で分類した人間によるラベル付きデータ)の30%が誤ってラベル付けされていることが判明した。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
昨年、Googleは「GoEmotions」データセットを公開しました。これは27の感情カテゴリで分類された、5万8千件のRedditコメントから成る人手ラベル付けデータセットです。問題は何でしょうか?実にデータセットの30%が誤ってラベル付けされているのです。ここではいくつかの顕著な誤りの例を確認し、より優れたデータセットを構築する方法を学びましょう。
原文を表示
Last year, Google released their “GoEmotions” dataset: a human-labeled dataset of 58K Reddit comments categorized according to 27 emotions. The problem? A whopping 30% of the dataset is mislabeled! Check out some of the egregious errors, and learn how to build better datasets.30% of Google's Emotions Dataset is Mislabeled
同じ出来事を4媒体で確認
同じ出来事を扱う別媒体の記事です。見出しと公開時刻を比較できます。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み