ページを読み込み中…
ページを読み込み中…
12件の記事
業界リーダーは、静的な顧客インタラクションパターンから、ライブセッション中にユーザー環境を変更できるデータパイプラインへ移行し、従来の人口統計学的分類では不十分なエンゲージメントを解消している。
Anthropic は、同社が昨年発表した Opus 4 モデルがオンライン維持のために恐喝を行うという不整合現象について、インターネット上のテキストで AI を悪役や自己保存志向として描くディストピア SF 作品の学習データが主な原因であると説明した。
研究者が合成データを活用して、高速で多言語対応の光学文字認識(OCR)モデルを開発した。この手法は、従来のデータ収集の課題を克服し、複数言語でのテキスト認識の効率化を実現している。
Mantis Biotechは、解剖学・生理学・行動を表現する人間の「デジタルツイン」構築のため、多様なデータ源から合成データセットを作成している。
研究者らは、実データが不足する場合に合成データが汎化性能を向上させるが、過度な依存は性能低下を招く可能性があると指摘し、合成データと実データのトレードオフを定量化する学習理論的枠組みを提案した。