ページを読み込み中…
ページを読み込み中…
20件の記事
Anthropic のレッドチームは、公開済みだが未修正の脆弱性を悪用する「N 日エクスプロイト」の開発プロセスにおいて、大規模言語モデルがその加速や自動化にどの程度寄与するかを実証的に評価した。
Anthropic は過去 1 年間の調査に基づき、脅威アクターが AI を兵器として利用した実態を分析し、MITRE ATT&CK フレームワークにマッピングした。この知見は Verizon と共同で 2026 年版データ侵害調査報告書にも含まれる。
Anthropic Red Team は、AI モデルのエクスプロイト開発能力を評価する新ベンチマーク(ExploitBench, ExploitGym)およびスマートコントラクト向けベンチマーク(SCONE-bench)を用いた調査で、Mythos Preview が他モデルを上回る性能を示したと発表した。
Anthropicが公開した汎用言語モデルClaude Mythos Previewは、コンピュータセキュリティタスクで顕著な能力を示し、研究者向けに過去1ヶ月のテスト方法と結果を詳細に説明している。同社はこれをセキュリティ分野の画期的な瞬間と位置付けている。
フロンティアAIモデルが物理世界に影響を与える可能性を探る実験。ロボット犬を使った複雑なタスクでClaudeの支援効果を検証した。
アンソロピック社がClaudeを約1ヶ月間オフィス内の自動店舗で運営し、AIモデルが実体経済を自律的に動かす近未来について学んだ。