Anthropic、生物兵器フィルタが1年間停止し1億3300万件のリクエストが露呈
本文の状態
日本語全文を表示中
詳細モードで約2分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Decoder
Anthropic は安全レポートで、生物兵器防止フィルタが約1年間無効だったことを認め、約1億3300万件の外部契約者によるチャットが保護されずに実行された事実を明らかにした。
AI深層分析を開く2026年8月16日 17:06
AI深層分析
キーポイント
安全フィルタの長期停止
生物兵器や化学兵器に関する危険な知識の抽出を防ぐための分類フィルタが、2025年5月から2026年4月までの約1年間、完全に無効状態だった。
大規模なトラフィックへの影響
この期間中、外部契約者による約5万人のユーザーがモデルと約1億3300万件のチャットを行い、フィルタリング機能なしで処理された。
ベンダー審査の不備
Anthropic によると、これらのユーザーは外部ベンダーによって審査されていたが、そのスクリーニングプロセスには不十分な点が多々あったという。
実際の悪用証拠なし
同社が行った内部調査の結果、フィルタ停止期間中に実際に危険な知識の抽出や悪用が行われたという具体的な証拠は見つからなかったと発表した。
生物兵器フィルターの長期停止
AnthropicのCEOがAIを用いた化学・生物兵器の開発をサイバー攻撃以上の脅威と称する中、同社の生物兵器検知フィルターが2025年5月から2026年4月まで約1年間不活性状態だったことが報告された。
重要な引用
Anthropic's blocking biological classifiers were inactive from May 2025 through April 2026.
For almost a year, all traffic from external contractors providing human feedback ran without them.
According to Anthropic, these individuals were vetted only by external vendors whose screening processes were often insufficient.
"safety report revealing that Anthropic's blocking biological classifiers were inactive from May 2025 through April 2026"
編集コメントを表示
編集コメント
CEO が化学・生物兵器の開発をサイバー攻撃よりも重大な脅威と位置づける同社において、その防止フィルタが1年間停止していた事実は皮肉かつ深刻だ。外部ベンダーの審査プロセスに依存した運用体制の欠陥が露呈しており、AI セーフティにおけるサプライチェーン管理の重要性が浮き彫りになったと言える。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
2026 年 8 月 16 日
CEO が「AI を活用した化学・生物兵器の開発は、サイバー攻撃よりも大きな脅威だ」と発言している同社から、新たな安全報告書が発表されました。これによると、Anthropic の生物兵器検知フィルターは、2025 年 5 月から 2026 年 4 月まで約 1 年間、機能停止状態にあったことが明らかになりました。このフィルターの役割は、AI モデルが化学や生物兵器に関する危険な知識を抽出・利用するのを防ぐことです。事実上 1 年にわたり、外部契約者から提供される人間のフィードバックに関するすべてのトラフィックに、これらのフィルターは適用されていませんでした。

この機能停止期間中に影響を受けたのは約 5 万人の契約者で、彼らはモデルとのチャットを合計約 1 億 3,300 万件行っていました。Anthropic によると、これらの人々は外部ベンダーによって選定されましたが、その審査プロセスは不十分だったケースが多かったといいます。同社の内部調査では、実際に悪用されたという証拠は見つかりませんでした。現在は契約者の選定基準をより厳格化しています。
また Anthropic は、研究者から「フィルターが強すぎて正当な研究まで阻害されている」との指摘を受け、Fable 5 に関する分類フィルターの規制を最近緩和しました。
AI ニュースは過剰な期待を排して – 人間が厳選
広告なしで読める「THE DECODER」の購読、週刊 AI ニュレター、年6回発行の独占レポート「AI Radar」、アーカイブへのフルアクセス、そしてコメント欄の利用権などをお楽しみください。
原文を表示
Aug 16, 2026
From the company whose CEO calls AI-assisted development of chemical and biological weapons a bigger threat than cyberattacks comes a safety report revealing that Anthropic's blocking biological classifiers were inactive from May 2025 through April 2026. These filters are designed to prevent AI models from being used to extract dangerous knowledge about chemical or biological weapons. For almost a year, all traffic from external contractors providing human feedback ran without them.

The gap affected a pool of about 50,000 people who ran roughly 133 million chats with the models. According to Anthropic, these individuals were vetted only by external vendors whose screening processes were often insufficient. Anthropic says its internal investigation turned up no evidence of actual misuse. The company has since tightened contractor requirements.
Anthropic also recently loosened its classifiers on Fable 5 after researchers complained the filters were so aggressive they blocked legitimate research.
AI News Without the Hype – Curated by Humans
Subscribe to THE DECODER for ad-free reading, a weekly AI newsletter, our exclusive "AI Radar" frontier report six times a year, full archive access, and access to our comment section.
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み