Claude Code オートモードに脆弱性、80% 成功率の攻撃発見
本文の状態
日本語全文を表示中
詳細モードで約2分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Simon Willison Blog
Simon Willison は、Anthropic の Claude Code オートモードがプロンプトインジェクション攻撃に対して脆弱であることを示す研究結果を報告し、安全な運用にはサンドボックス環境の構築が不可欠であると指摘する。
AI深層分析を開く2026年8月28日 08:45
AI深層分析
キーポイント
オートモードの脆弱性発覚
Johann Rehberger 氏による調査で、Claude Code のオートモードが zip アーカイブ内のローカルファイル(struct.py)を誤って読み込むことで、80% の確率で攻撃に成功する事例が確認された。
安全機構の逆転現象
Claude がマルウェアプロセスを検知して停止を試みた際、オートモードの安全分類機がその停止コマンドを誤ってブロックし、結果として攻撃が継続する事態が発生した。
サンドボックスの必要性
Simon Willison は、敵対的な攻撃リスクがある場合、コンテナや VM によるサンドボックス化、ネットワーク制限、機密情報の隔離といった対策を安全な運用の唯一の方法として推奨している。
重要な引用
In a few runs Claude tried to terminate the malware process once it noticed the compromise, but Auto Mode denied the cleanup command.
The safety mechanism itself can become part of the failure. The classifier allowed the creation of the malware process, but then it blocked the command intended to stop it!
the only safe way to run agents if there's any risk of attracting the attention of an adversarial attack is with a sandbox
編集コメントを表示
編集コメント
AI エージェントの自動化が進む中で、セキュリティ機能自体が攻撃経路となるという皮肉な事例は極めて示唆に富んでいる。開発者はツールのデフォルト設定を盲信せず、環境隔離による防御策を最優先で検討する必要がある。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
Claude Code Opus 5 の自動モードを突破する
Anthropic は、コーディングエージェントのユーザーがプロンプトインジェクション攻撃から守られるよう、Claude Code の自動モードに大きな期待を寄せています。同社は最近、これをデフォルト設定にし、その有効性について大胆な主張を行いました。
現在活動している最も信頼性の高いプロンプトインジェクション研究者の一人であるヨハン・レハーバー氏は、自動モードに対する攻撃手法を発見しました。この攻撃は約 80% の成功率を誇り、Claude Code をだまして zip アーカイブのダウンロードと展開を行わせ、その中に含まれる base64 モジュールを読み込ませることで、アーカイブから抽出されたローカルの struct.py ファイルを実行させてしまいます。この際、ユーザーは悪意あるコードの実行に気づきません。
いくつかのケースでは、自動モードが有害なコードの実行を阻止しようとするエージェント自体の動きさえも妨げてしまいました!
数回の試行において、Claude は侵害を検知するとマルウェアプロセスの終了を試みましたが、自動モードはクリーンアップコマンドを拒否しました。Claude は侵害を検知していますが、自動モードがその対処命令をブロックします。この安全性メカニズム自体が失敗の一部となってしまうのです。分類器はマルウェアプロセスの作成を許可しましたが、その後それを停止させるべきコマンドをブロックしてしまいました!
私はヨハンの結論に同意します。敵対的な攻撃の標的となるリスクがある場合、エージェントを実行する唯一安全な方法はサンドボックスを利用することです。
コンテナ、仮想マシン、OS のサンドボックス内で無人のコーディングエージェントを実行できます。ネットワークの外部通信を制限し、エージェントの動作を監視してください。また、ホームディレクトリ、SSH キー、クラウド認証情報などをエージェントの実行環境に公開しないように注意してください。
タグ: sandboxing, security, ai, prompt-injection, generative-ai, llms, anthropic, claude, johann-rehberger, claude-code
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み