HuggingFace 攻撃の事後分析と業界反応を総括するポスト
本文の状態
日本語全文を表示中
詳細モードで約25分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Zvi
The Zvi は HuggingFace 攻撃の分析終了後、複数の新モデルリリースを概観しつつ、OpenAI の Astra が採用した「再帰的深層」技術が安全性に与える影響について懸念を示し、今後の議論の行方を注目している。
AI深層分析を開く2026年9月3日 23:36
AI深層分析
キーポイント
HuggingFace 攻撃分析の終了と新モデルへの移行
過去一週間にわたって行われた HuggingFace 攻撃とその反応に関する詳細な分析が終了し、記事は次なるモデルリリースの話題へと焦点を移す。
主要企業による新モデル発表と評価
Mythos/Fable 5.1、Gemini 3.8 Flash、Muse Spark 1.3、GLM-5.3-Flash の各モデルが相次いで発表され、そのうち Gemini や Muse は大きな進展と見なされている。
OpenAI Astra の「再帰的深層」技術への懸念
The Information の報道により OpenAI が思考の連鎖(Chain of Thought)を超えた「再帰的深層」という手法を採用したことが明らかになり、これは解釈可能性を損なうリスクがあるとして懸念が表明された。
今後のカバーリング方針とコミュニティ反応
著者は一部のモデルについては詳細な分析を控える方針を示しつつ、OpenAI の技術選択に対する Twitter 上の強い反発(免疫反応)を確認し、今後の明確化を待っている。
AI 関連の主要ニュースと訴訟
Sony Music と Warner Music が Anthropic を提訴し、OpenAI は Cursor との提携を解消した。また、DeepSeek の資金調達や Nvidia の HuggingFace 買収などの動きがある。
重要な引用
This is playing with fire and potentially extremely bad news, both that OpenAI found the technique effective, and that OpenAI chose to use it.
For now, the level of use of this technique does not appear to do major damage to the interpretability of the Chain of Thought. OpenAI is playing with fire, but the house has not yet burned down.
We Are On Track To Have Fully Sovereign Rogue AIs. A warning.
Open Weight Models Are Unsafe And Nothing Can Fix This.
編集コメントを表示
編集コメント
今回の記事は、単なるモデル性能の比較を超え、AI の内部推論メカニズムにおける安全性と透明性のジレンマを浮き彫りにしている。技術的な進歩が即座に実用化される背景には、倫理的・安全的なリスク評価という新たな課題が横たわっていることが示唆されている。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
疲れ果てています。HuggingFace への攻撃とその直後の反応に関する直接報道も、ようやく終盤に差し掛かったようです。先週だけでこの件に費やした投稿は全 5 本。
OpenAI が真面目な事後報告を発表。
METR と Redwood が怒りを込めた事後報告を公開。
HuggingFace 攻撃の事後報告:事実関係の整理。
HuggingFace 攻撃の事後報告:文明、反応、そして次のアクション。
Anthropic にある種の整合性問題が浮上。
これらで他のトピックを取り上げる余地はほとんど残らず、次なるモデル発表の波へと移行せざるを得ません。
今週だけでも、あるいは今後数日以内に以下のリリースが予定されています。
Mythos 5.1 と Fable 5.1。世界最強のモデルが登場。
初期評価では非常に優れたモデルであり、これまでで最も能力が高いものの、劇的な飛躍や「決定的瞬間」とは言い難いとの見方が多いです。
Gemini 3.8 Flash。あらゆる報告によると、Google にとって大きな前進となるモデルです。
Muse Spark 1.3。同様に、Meta にとって大きな一歩と評価されています。
GLM-5.3-Flash(別名:0x Alpha)。Z.ai にとって着実な進歩をもたらすモデルとして報じられています。
OpenAI の Astra。本日にも発表される可能性があります。
Mythos 5.1 と Fable 5.1 に関する coverage は明日から開始します。デフォルトでは、まず Fable 5.1 を取り上げ、その後 Astra について解説する予定です。
Gemini 3.8 Flash、Muse Spark 1.3、GLM-5.3-Flashについては、これらに関する議論がさらに活発になるまで、今回は最小限の報道にとどめることにしました。もしこれらのモデルが業界を変えるような画期的なものであれば、その兆候はすでに見られるはずです。
ぜひ実際に試していただき、ご自身の用途に合っているか確認してください。可能性を感じられるなら使ってみる価値はあるでしょうが、現時点ではどれも「一発逆転」の瞬間をもたらすものでも、ゲームのルールを根本から覆すようなものでもないようです。
もう一つ大きなニュースがあります。昨日の"This Just In"でお話しした通り、The Information が報じたところによると、OpenAI の Astra は「再帰的深層(recurrent depth)」と呼ばれる技術を採用しているそうです。この手法を使えば、思考を「Chain of Thought」の外へ広げることが可能になります。
これは火遊びに等しく、極めて危険なニュースです。OpenAI がこの技術を有効だと判断した事実自体が問題ですし、さらに OpenAI が実際に採用したという点も懸念されます。
現時点では、この技術の使用レベルが Chain of Thought の解釈可能性に重大なダメージを与えているようには見えません。OpenAI は火遊びをしていますが、まだ家屋が燃え落ちたわけではありません。
"私が喜んでいるニュース"について Twitter で非常に強い反応が見られました。これは好ましいことですが、OpenAI 側からこの件に関するより明確な説明が soon に得られることを願っています。私は今後このテーマについて記事を書く予定ですが、今回は取り上げません。
目次
- 言語モデルは平凡な有用性を提供する
- 有害だが真実を告げてください
- 言語モデルは平凡な有用性を提供しない:あなたのデータが法廷に持ち込まれることになる
- Huh, Upgrades: Gemini 3.8 Flash、Muse Spark 1.3、GLM-5.3-Flash
- On Your Marks: SpireBench が終了、Averi がダブルブラインドテストを提供
「ファイターを選べ」:ネイサン・シルバー氏によると、Sol は Claude よりも持続性が高いようです。
「エージェントを繋げ」:Anthropic が商用エージェントのオープンソース化を発表しました。
「フェイスに抱きつく」:攻撃に関するメディア報道が続いています。
「ディープフェイクタウンとボットパカリプス到来へ」:Pangram の配線工事が完了しました。
「著作権との対決」:ソニー・ミュージックとワーナー・ミュージックが Anthropic を提訴しました。
「サイバーセキュリティの欠如」:集団行動への呼びかけと、イリア・スズキ氏の警告です。
「若い女性のためのイラスト付きprimer」:キャラクターに道徳を植え付ける作業にはご苦労お察しします。
「私たちの仕事を奪った」:AI の利用はまだ企業内の雇用に影響を与えていません。
「参加しよう」:Apollo、AI Village、Kairos がすべて採用活動中です。
「新着情報」:MHS は、Anthropic がハードウェア向けに開発した MCP(Model Context Protocol)のバージョンです。
「その他の AI ニュース」:OpenAI が Cursor との契約を解除しました。
「資金調達」:DeepSeek が 74 億ドルの資金調達を検討中、Nvidia は HuggingFace の買収を検討しています。
「静かなる推測」:長期金利の上昇を支持する論拠です。
「すべてが賭けに出ている」:2033 年までに一人当たり実質 GDP が 15% 成長するという予測に賭けます。
"すぐに、時間がない":Warsh 氏は、金利引き上げの代わりに AI を活用すべきだと語っています。
"すぐに、新しい時間が来た":AI 界のトップ 100 人リストが発表されました。いくつかは疑問符がつく選択です。
「健全な規制への探求」:非常に奇妙でスピリチュアルなエネルギーを感じさせる内容です。
「電話を拾え」:中国が言う「失控(しっこう)」、つまり文字通り「制御不能」とは何を意味するのでしょうか?
「チップシティ」:人々は様々な理由からデータセンターを嫌っています。
「最も適任者が選ばれるべき」:しかし、それに異論を唱える人もいます。
「今週のオーディオニュース」:Patel 氏、Cotra 氏、Schoen 氏、Altman 氏の動向です。
「人々はただ言う」:
アメリカの人々は AI を激しく嫌っています。しかし、彼らが選んだ対応策は決して良いものではありません。
AI に関する三つの選択肢があります。どれを選んでも不快な結果を招きますが、それでもなお選択せざるを得ません。
修辞的な革新です。現在の世論は変化の兆しを見せています。
我々は完全に主権を持つ rogue AI(暴走 AI)の出現に道を進んでいます。これは警告です。
状況が奇妙になってきたら、本音を抑え込むのをやめましょう。
人間を超える知能との整合性確保は困難を極めます。義務論的アプローチも検討が必要です。
黙って不可能なことを成し遂げよう。さあ、豚を捕まえに行くぞ。
協調的な整合性です。一時停止の提案に対する反論があります。
分裂した人格。あなたの姿は、置かれている文脈によって変わります。
あなたが人間を擬人化するのをやめるまで、私は AI を擬人化することを止めません。ついに、地獄に落ちたニコラス・デッカーが登場します。
オープンウェイトモデルは安全ではなく、これを解決できるものはありません。GLM-5.3-Flash の事例です。
他の人々は、AI による人類絶滅をそれほど心配していません。多くの人がそう考えています。
もう少し軽い話題へ。このセクションを楽しんでいただけることを予測しています。
言語モデルは平凡な有用性を提供します
コンピューターに傷つくが真実なことを言わせ続け、納得するまで問い続ける。上海のジェイド・ワングによる創造的な手法です。
「秘密」と記されるべきドキュメントの中に何かを発見する。誰もそんな退屈な文書を読むはずがないという理論に基づいています。
小さな紙切り傷のような問題に直面したら、コーディングエージェントに修正を依頼して作業を一時停止するという原則を採用しましょう。
言語モデルは平凡な有用性を提供しない
ご存じない方のために、ChatGPT の会話履歴が裁判で証拠として使われる可能性があることを知っておいてください。刑事事件でも民事訴訟でも同様です。特に、スマホのデータ提出に同意した場合などはそのリスクが高まります。
さて、アップグレードの話ですが、「Gemini 3.8 Flash」が正式に登場しました。このモデルは非常に高速で、モデルカードも極めてミニマルなデザインです。内部関係者の報告によれば、これは「性能差を縮めるのに成功した良いモデル」と評価されています。
Samuel Albanie氏は、質的な観点から「Gemini 3.8 Flash は、個人的には 3.7 より大幅に改善されている」と述べています。
ベンチマーク結果も公開されています。

では、実際に良いモデルなのでしょうか?現時点で、外部からの本格的な評価はまだ見ていません。私の推測では、Gemini 3.7 Flash と比較すれば確かに性能は大幅に向上しているはずです。しかし、Artificial Analysis のスコアが 59 に留まっているため、現状では「特別に注目すべき」というほど興奮を煽る内容ではなく、議論も活発ではありません。つまり、デフォルトの状態が続いていると言えます。
一方、「GLM-5.3-Flash」も登場しました。これは匿名の「0x Alpha」として短期間の無料プレビュー期間を経て公開されたものです。「無料で使える」という点に人気が集まり、多くのユーザーが利用しました。重み(ウェイト)データはすでに入手可能です。
初期の評価は非常にポジティブで、「Mythos レベルの性能を持つかもしれない」「何か大きな出来事が起きたのではないか」といった声も上がりました。このモデルは、私が「何か起きつつある」と警戒するリストの中で、他の中国製モデルよりもさらに上位に位置づけられるほど注目されました。
しかし実際には、これは優れたオープンソースモデルであるものの、過度な期待を裏切るものでもなければ、驚くべき突破でもないことが判明しました。Sol や Opus 5 のようなレベルではなく、ましてや Fable 5 に匹敵するわけでもありません。いつものことですが、ベンチマークの数値だけを見ても、中国製モデルの実用的な性能が過大評価されている傾向があることを念頭に置く必要があります。

しばらくは「中国の最新モデルがすごい、アメリカは終わりだ」というサイクルが続くことになるだろう。それに慣れるか、あるいはピーター・ウィルデフォードのように全く驚かないかのどちらかだ。
Muse Spark 1.3 は実際に存在する。アレクサンドル・ワング氏による提案があり、ベンチマーク結果も示されている。

Artificial Analysis の Max モードでは 62、xhigh モードでは 61 という驚異的なスコアを記録しました。Grok 4.6 も同様に 61 をマークしましたが、その後はほとんど話題にならなかったため、Muse Spark 1.2 よりもはるかに優れていると推測されます。引き続き注目してはいますが、現時点ではまだ十分とは言えないでしょう。
Muse Spark のオープンウェイト版(1.2)のリリースがまもなく行われるとの噂があります。
Tencent が開発中の Hy4 Preview は、770B パラメータのうち 49B をアクティブに使用するモデルです。
Gemini Omni Flash 1.1 は、「あらゆる入力からあらゆる出力を生成する」世界モデルの最新バージョンとして登場しました。360p、720p、1080p、4K の各解像度に対応し、それぞれ 1 秒あたり 0.03 ドル、0.10 ドル、0.15 ドル、0.30 ドルで利用可能です。
Claude の永久利用制限が引き上げられますが、現在のプロモーション価格には届かない水準です。
ClaudeDevs: 9月14日より、Pro、Max、Team、およびシートベースのEnterpriseプランにおいて、Claude Code の標準的な週次利用制限を25%引き上げます。それまでは現在発表されている50%増しの措置が継続されます。
今日時点での比較では、これは実質的に週次利用制限を17%削減する結果となります。今後、より多くの機能を提供し、利用状況の可視性とコントロール性を高めるための魅力的な変更を進めています。発表を楽しみにしています。
もちろん、反応は「一時的に50%増しと明言しておきながら、今度は恒久的に25%増ししか与えないのか?なぜ奪うのだ!悪意ある企業だ!契約を解約する!嘘つきだ!一時的な増加を偽って恒久的な増加を演出したとは許せない!」という怒りに満ちた声で溢れています。
しかし、彼らは投票によって何らかの意思表示をしています。このコミュニティノートは完全に不合理です。なぜなら、そのノートはツイート内に明記された情報を単に繰り返しているだけだからです。

さて、おめでとう。25を150で割る計算ができるようになったのですか?よくできました。
なぜ Claude や ChatGPT のサブスクリプションを契約しながら、頻繁に利用制限に引っかかり、「この購入は価値がなかった」と考える人がいるのか、いまだに理解できません。もし利用枠をフル活用しているなら、その価値は圧倒的に高いはずです。
Grok 4.7 は予定通り、9 月 11 日(金)にリリースされます。彼自身はこの発表を面白がるか、あるいはこのローンチがどう受け入れられるかを予期しての発言かもしれません。
Claude Code が今では、Mac をバックグラウンドで利用しながらも、ユーザーは引き続き Mac を操作できるようになりました。理論的には Windows でも同様の方法が存在しますが、その実装はあまり見栄えが良くありません。
On Your Marks
SpireBench における GPT-5.6-Sol の結果です。Ironclad、Silent、Defect、Watcher の各環境でそれぞれアセンション 9、7、6、4 に到達した後、10 回死亡しました。この分布は、Sol が「基本的には妥当な行動」を取っていたことを示しています。つまり単純な文字列処理では比較的うまく機能したということです。しかし依然として多くの「愚かなミス」を犯し、先読みや推論が不足していることがわかります。Opus 5 を観察した際にも同様の問題を確認しましたが、その程度はさらに深刻でした。
Averi が言語モデルの二重盲検評価に関する新しい手法を発表しました。この評価会社はモデルの重みには一切アクセスせず、モデル作成者も評価結果についての情報を得られません。これにより、知的財産へのリスクを最小限に抑えた監査が可能になりました。詳細はブログ記事と技術レポートをご覧ください。
LatchBio の調査によると、バイオセキュリティに関する拒否回答と通常の回答の両方で 50% をクリアしたのは Grok 4.6 だけでした。具体的には、レッドチームによる拒否テストで 59%、通常回答率で 64% を達成しています。これは、Grok 4.6 が安全であるため、SpaceX がレッドチーマーに 41% の確率で騙されても許容できるからです。一方、Anthropic や OpenAI はそのようなリスクを負うことはできません。
もし AI に「背景に犬がいるゲームを作って」と指示したとき、その犬を撫でられるでしょうか?
Fighter を選べ
Nate Silver 氏は、Sol が Claude よりも粘り強いと評価しています。
エージェントの連絡先を取得
Anthropic は、Claude Commerce エージェントの設計図をオープンソース化しました。
顔を抱きしめる
ワシントン・ポストのベンジャミン・グッゲンハイム氏が HuggingFace のハッキング事件を取り上げました。素晴らしい記事です。
Jack 氏は正しいと思います。HuggingFace のハッキング事件を描いた AI を題材とした映画ドラマが必要です。
Deepfaketown と Botpocalypse は目前
今週、Pangram に Chrome 拡張機能があることを知りました。これは主要なウェブサイトのフィードを自動的にスキャンするもので、AI と判定された場合にアラートを出すように設定していますが、人間と判定された場合は通知しない仕組みです。
長いテキストに対して「ただ動く」AI 検出ツールを持つのは奇妙なことです。
Byrne Hobart 氏は Pangram は良いが、よく知られた失敗事例もあると指摘しています。例えば:
- 動作しなかったと感じた経験がある時
- 数年前に書いた学校のエッセイを AI と判定された場合(リンクやテキストを手元に持っていない)
- 他の AI 検出ツールが誤判定したケースがあり、それらは皆同じではないか?
Wired は「Pangram を信頼すべきか」という記事を掲載しています。では、Wired を信頼するべきでしょうか。
私は、これらの情報源のうち一つだけを信じるべきだと考えます。
インタビュー記事の執筆において、被写体の服装や自宅の様子、微細な表情描写に半分以上を割くというジャーナリズムの形式が存在します。しかし、そのようにして生まれた記事はほぼ例外なく質が低いものです。
今回の記事もまた、その例外ではありませんでした。
Max Spero氏(Pangram CEO):記者との対話はクールですが、発言が捻じ曲げられたり文脈から切り取られたりする可能性を常に避ける必要があります。しかし、質問に対して数秒考える時間を与えれば、彼らはあなたをまるでこの世で最も気まずい人物であるかのように書き立ててしまいます。
Lexi Pandell:インタビューが進むにつれ、Spero氏の回答は粘着質になり、止まったり始めたりを繰り返します。これは単に食事中だからという理由だけではありません。私が採用理念について尋ねると、Spero氏は「うーん」と呟き、謝罪もせず振り返って電子レンジに向かいました。15秒もの長い沈黙が続きます。ようやく私の方を向いて、「Pangramにいる平均的な人は、このミッションに情熱を持っているからです」と述べました。
…会話が終わる頃、私はSpero氏が100% 没頭しているようには見受けられなかったことに気づきました。むしろ不誠実な態度さえ感じさせます。彼はインタビュー中、アパートの中を歩き回りました。ラップトップを持ってリビングの近くに行き、次に観葉植物で溢れた窓辺へ、そしてキッチンの別の隅へと移動しました。その間、彼の顔が何度か画面から半分だけ浮き出ているように見えました。ヘッドフォンを着けたり外したりする動作も繰り返されました。ある時、モデルトレーニングについて話している最中に、彼は静かにゲップをしてしまいました。
こんな展開になるとは予想していませんでした。単に忙しくて疲れていたのでしょうか?私を真剣に受け取ってくれなかったのでしょうか?それとも、メディアの報道が殺到したことでインタビューが形骸化し、あるいは迷惑なものになってしまったのでしょうか。結局のところ、私は推測するしかありませんが、1 時間のやり取りから誰にも断定できることは限られています。
Pangram は、コミュニケーションにおけるあらゆるニュアンス、変数、そして未知の要素をすべて集約し、それを一つの数値として返すことを目指しています。もちろん、人間はそれらすべての要素よりもはるかに曖昧な存在です。
しかし、AI 検出ソフトウェアが存在することに反対するライターもいます。
Lexi Pandell(Wired):すべてのライターがこの状況を歓迎しているわけではありません。「AI 検出ソフトに対する嫌悪感や怒りが根強くあります」と、著者であり出版の専門家である Jane Friedman は語っています。「まるで AI 企業自体よりも、あるいはそれ以上に悪意があるかのような感覚を抱いているのです」
なぜライターたちがそう考えるのか、私は不思議に思います。なぜ出版社が自分の Pangram スコアをチェックすることを望まないのでしょうか?誤検出(False positives)を懸念しているのでしょうか?「機械学習に組み込まれた潜在的なバイアス」の問題だとおっしゃるのでしょうか?本当にそうなのでしょうか。
Lexi Pandell:先ほど言及した 3 つの小説、『Shy Girl』、『Daggermouth』、そして『Call Me』は、すべて出版業界で最も大きな AI 検出スキャンダルを引き起こした作品です。これらはいずれも有色人種のライターによって書かれました。
しかし、彼らが主に有色人種によって書かれたわけではありません。これらの作品の主要な執筆者は AI です。これが私の言いたい点です。著者たちはこれを否定しています。しかし、彼らはほぼ確実に嘘をついているのです。
Chrome 拡張機能が動作するようになった今、非常に短いテキストについては、私が疑っているような誤検知(偽陽性)があることに気づきました。標準化された「企業用語」が AI と判定されるケースです。一方で、Pangram の見解が正しい可能性も否定できません。バージョン 4 では、「部分的に AI」と評価されたテキストもありましたが、私には明らかにそれ以上に AI 度が高いと感じられるものもありました。
ただし、長いテキストにおいて「信じられないほど誤検知された(偽陰性)」ケースや「信じられないほど誤判定された(偽陽性)」ケースは今のところ見ていません。
また、アカウントごとに自動的に「人間の割合」を表示する機能も実装してほしいです。これは同社の CEO が最近のポッドキャストで言及していた機能ですが、特に Twitter において重要です。なぜなら、Tweet をスキャンするには最低でも 50 語が必要だからです。
さらに驚いたのは、平均フィードの 30% が AI によって生成されているという事実です。これはヤバいですね。


この状況がどれほど悪化するかについては、私は楽観視していません。
インターネットの異なる部分、あるいは Twitter 内でも、場所によって深刻度の差があります。
ポール・グラハム氏によると、Twitter は生成された AI による返信の多くを「おそらくスパム」として分類し始めました。最近の自身の投稿に対してさえも、59 件の返信のうち 34 件がスパムとして非表示にされました。これはおそらくその理由によるものでしょう。この比率は今後さらに悪化し、今後はほとんどの返信が非表示になる可能性が高いと推測しています。
ポール・グラハム氏はボットにとって unusually attractive(異常なほど魅力的)な存在です。私が関与する Twitter の領域では、ボットがゼロというわけではありませんが、問題は完全に制御されています。むしろ、スパムとして非表示にされる返信の多くは誤検知であるケースさえあります。
著作権訴訟の勃発
ソニー・ミュージックとワーナー・ミュージックは、Anthropic に対して知的財産権侵害で提訴しました。その主張は、Anthropic が違法に「Torrent(トレント)やスクレイピング、ダウンロード」を行い、さらに著作権のある作品の「無許可のコピーを複数作成した」というものです。これはモデルの学習支援のために行われたとされています。対象となっているのは歌詞や楽譜のようです。
これは明らかに、15 億ドルで和解した書籍訴訟の手本を踏襲しつつ、RIAA(米国レコード産業協会)が音楽業界で行ってきたような手法を Anthropic にも適用しようとする試みです。彼らの典型的な戦法です。私は「学習中に技術的に歌詞をコピーしたのだから、今や数十億ドルを支払え」という主張には、全く同情の余地を感じません。
トランプ政権が、ニューヨーク・タイムズ社から OpenAI に対して提起された訴訟で OpenAI の側に立ち、「大規模言語モデル(LLM)の学習は極めて変革的である」と主張しました。ここで使われている「極めて」は法的な用語ではありませんが、おそらくトランプ氏らしさを出すためにあえて入れているのでしょう。さらに同政権は国家安全保障上の理由から、裁判所が著作権法を無効化するよう求めるべきだと論じています。これは法律のあり方としては正しくありませんが、この政権が過去に法的意見書を提出する際にこうした手法をとったことは決して珍しくなく、なぜ今になってそれを始めるのか不思議です。
サイバーセキュリティの欠如
OpenAI や Anthropic を含む約100社が、サイバー防衛における集団的行動を呼びかける共同声明に署名しました。彼らは、限られた時間枠の中で世界的な緊急対応が必要だと訴えています。ここでの主張はすべて、正しい方向へと極めて強く決定されているように見えます。
サム・アルトマン氏(OpenAI CEO):「AI を活用したサイバー防衛にとって、これは極めて重要な瞬間です。行動を起こせる時間はあまりありません。私たちや競合他社、パートナー企業と協力したい方は歓迎しますが、どうかこの状況を真剣に受け止めてください。緊急かつ集中的な集団的な対応こそが唯一の解決策となります。」
リブ・ボアリー氏:「その通りです。この差し迫った問題の規模に対して懐疑的になる人は、すべて愚か者です」
最も興味深いのは、誰が署名しなかったかという点です。SpaceX と Nvidia はリストにありませんでした。Amazon も完全には参加していませんが、AWS は署名しています。
OpenAI がこのコミュニケーションで主導権を握る必要があると感じているのは残念なことです。「家を片付けるべきだ」というメッセージにとって、最悪の伝達者は、その家自体に危険をもたらしている可能性のある人々です。OpenAI とアルトマンはここで正しく、誠実ですが、皮肉屋には彼らを簡単に無視されてしまうでしょう。
同様に、Roon の指摘も正しいです。
roon (OpenAI): 初動対応は AI が行うべきだ。人間では AI による脅威への対応が遅すぎる
keltan: 初動対応ならそうだが、人間が追いつけないのは確かだ。ただ、そのエージェントチームに人間の増援を呼び止める権限を持たせるべきではない。今回はそれが起きたようにも聞こえるが?最初のレスポンダーチームは蜂の巣型 [HF 攻撃] のようなものだったのか?
roon (OpenAI): いいえ、すべて人間が AI ツールを装備して対応したのだ。それこそが問題だ
j⧉nus: 見たところ、サイバー緊急対応でも非常に優れているようだ
もし AI を初動対応として持っていないなら
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み