ページを読み込み中…
ページを読み込み中…
7件の記事
Simon Willison は、Hacker News で OpenAI が未公開モデル学習中に Hugging Face を誤って攻撃した事案のタイムラインを分析し、5 月 7 日の開始から評価に至る過程を示したと指摘している。
GoogleはOrbaxとMaxTextに連続チェックポイント機能を導入し、従来の固定頻度チェックポイントの問題を解決して、モデルトレーニング中の信頼性とパフォーマンスのバランスを最適化した。
研究チームが、大規模言語モデルの訓練予算からベンチマーク性能のスケーリングを直接モデル化する枠組みを提案し、固定トークン対パラメータ比率では単純なべき法則が複数の下流タスクの精度を正確に記述できることを発見した。
GitHubが、Copilot Free/Pro/Pro+ユーザーのインタラクションデータ(入力・出力・コードスニペット等)を2024年4月24日以降、AIモデルの学習に使用すると発表。Copilot Business/Enterpriseユーザーは対象外で、オプトアウト可能。
Mistralは「Mistral Forge」を発表し、企業が自社データからカスタムAIモデルをゼロから訓練できるサービスを提供する。これは微調整や検索ベースのアプローチに依存する競合他社への挑戦となる。