マイクロソフトのマルチエージェントAIシステムがサイバーセキュリティベンチマークでアンソロピックのMythosを上回る
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
TLDR AI
マイクロソフトは、100以上の専門AIエージェントを連携させる「MDASH」システムを開発し、コードスキャンから検証、攻撃証明までを行うことで、アンソロピックの「Mythos」モデルを上回る成果をサイバーセキュリティベンチマークで達成した。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
Microsoft の MDASH AI システムは、100 以上の専門化された AI エージェントを複数の AI モデルにまたがって連携させることで、実世界のソフトウェアの脆弱性を発見します。ある一連のエージェントがコードをスキャンして潜在的な脆弱性を探し出し、その後、別のグループのエージェントが各発見が実際に存在するものか、悪用可能かどうかについて議論します。最終段階では、概念実証(Proof-of-Concept)攻撃を構築してバグの存在を確認します。MDASH は、AI システムがいかに実世界の脆弱性を再現できるかを測定するテストである CyberGym ベンチマークにおいて、Anthropic の Mythos モデルを上回りました。
原文を表示
Microsoft's MDASH AI system uses more than 100 specialized AI agents to work together across multiple AI models to find real-world software vulnerabilities. A set of agents scans code for potential vulnerabilities, and then a separate group of agents debates whether each finding is real and exploitable. A final stage constructs proof-of-concept attacks to confirm the bugs exist. MDASH surpassed Anthropic's Mythos model on the CyberGym benchmark, a test that measures how well AI systems can reproduce real-world vulnerabilities.
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み