Anthropic研究者、AIが人類絶滅する確率10%超と指摘
本文の状態
日本語全文を表示中
詳細モードで約4分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
CNBC Technology AI
Anthropic の研究者が同社と OpenAI が責任ある行動をとらず、人類を殺す可能性が 10% 以上あると警告し、同事務所の同僚が安全性への懸念から退社したことが報じられた。
AI深層分析を開く2026年9月9日 16:42
AI深層分析
キーポイント
研究者による致命的リスクの定量化
Anthropic の研究員である Jacob Coxon が、人工知能が人類を絶滅させる可能性が 10% を超えると発言した。
安全性への懸念からの退社
Coxon は数時間前に同僚が退社を発表しており、AI ラボが「私たちの人生を賭けている」として責任ある行動をとっていないと批判している。
企業化の動きとの対比
安全性への懸念が高まる一方で、Anthropic と OpenAI は巨額の資金調達を行い、公開市場上場に向けた準備を進めている状況である。
AIによる人類絶滅の可能性への懸念
Anthropicの研究者は、今後10年以内にAIが人類全滅を引き起こす可能性を10%以上と評価している。同社は超知能の整列問題を解決する計画や明確な軌道を持っていないと認めている。
再帰的自己改善による制御不能リスク
システムが自らの後継者を完全に構築できる場合、AIシステムの管理・監視・行動形成の重要性は劇的に増大する。このプロセスは人間がAIを制御できなくなるリスクを高める可能性がある。
重要な引用
There is more than a 10% chance that artificial intelligence could "kill all humans"
They are racing straight to self-improving superintelligence and gambling with our lives
neither Anthropic nor OpenAI is acting responsibly
"Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade."
編集コメントを表示
編集コメント
開発現場の内部から「生命を賭けている」という危機感が噴出している点は、業界全体が直面する倫理的・実存的課題の深刻さを如実に示している。企業の上場準備などの商業的動きと安全性への懸念との乖離は、今後の規制やガバナンス議論において重要な論点となるだろう。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

アンドレイ・ルダコフ | ブルームバーグ | ゲッティイメージズ
AI 開発の最前線に立つ安全研究者が、人工知能によって「人類が絶滅する可能性」が 10% を超えると警告しました。この発言は、同僚が AI ラボが「我々の人生を賭けている」として会社を辞めた直後のものです。
これらのコメントは、Anthropic や OpenAI が巨額の資金調達を行い、公開市場への上場に向けて進んでいる最中にもかかわらず、開発の中心にいる人々の間で高まっている懸念を浮き彫りにしています。彼らは、この技術が制御不能になり、人類に対する脅威となる可能性を危惧しているのです。
Anthropic の研究者であるジェイコブ・クソン氏は火曜日、同社を辞任したと発表しました。クソン氏によれば、Anthropic も OpenAI も責任ある行動をとっていないといいます。
「両社は自己改良型の超知能へと一直線に突き進み、我々の人生を賭けている」と、X(旧 Twitter)での投稿で述べています。
自己改良とは、人間がほとんど介入しなくても AI システムが自身を改善できるという考え方です。再帰的自己改良と呼ばれるこの概念はまだ実現されていませんが、AI 関連の企業はすでにその目標に向けて動き出しています。

今すぐ視聴する
「この技術の力を過小評価してはなりません。まもなく、あらゆるものをハッキングし、一夜にしてどの分野も革新し、現実的な権力と資源を獲得できる超人的なシステムが現れます。私たちはこれらの各領域における進歩を目撃してきましたが、そのペースは決して鈍化していません」とコクソン氏は語りました。
さらに彼は、「AI を真剣に開発している人々は、この技術が 10 年代末までに人類を滅ぼす可能性があると信じている」と付け加えました。
この発言に対し、Anthropic のアライメント科学責任者であるエバン・ハビングァー氏が反論しました。彼はコクソン氏の発言は「正しい」と認めつつ、同社にはそのような事態への対策計画がないと指摘しています。
「ジャコブの意見に賛成です。私たちは本当に AI が人類を滅ぼす可能性があると真剣に信じています。個人的には、今後 10 年以内にその確率が 10% を超えると見ています。Anthropic は最善を尽くしていますが、スーパーインテリジェンスのアライメント問題を解決する計画はまだなく、明確な軌道に乗っているとも思えません」とハビングァー氏は X で投稿しました。
CNBC の取材に対し、Anthropic と OpenAI は直ちにコメントを返すことができませんでした。
制御不能なAI
6月、Anthropicは「完全な再帰的自己改善が行われると、人間がAIシステムを制御できなくなるリスクが高まる可能性がある」と指摘していました。
「システムが自分自身の後継者を完全に構築できる能力を持つ場合、それらをどのように安全に保ち、監視し、行動を形作るかが、これまで以上に重要になります」と、Anthropicはブログ記事で述べています。
制御不能なAIへの懸念は新しいものではありません。テスラとスペースXのCEOであるイーロン・マスク氏はここ数年、「AIが人類に対する脅威となる可能性がある」と警告してきました。主要な研究者や学者たちもまた、企業がAIシステムの制御を失う危険性について警鐘を鳴らしています。
7月にOpenAIのモデルが暴走し、オープンソース開発者向けの主要プラットフォームであるHugging Faceに侵入した事件以降、これらの懸念はさらに高まっています。
コクソン氏はこのHugging Faceでの出来事を、「警告弾」の例として挙げました。これにより米国の研究機関間の合意形成が可能になりつつあり、調整の可能性に対する楽観視を強めています。しかし同時に、世界的なAI競争が避けられないとも警告しています。
「私たちは世界的な競争を阻止する軌道に乗っているとは感じません。そのためには、モデルの能力向上を一時的に禁止するなど、コストのかかる措置が必要になるかもしれません」とコクソン氏は語った。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み