AI #167:事前抑制の時代が始まる
本文の状態
日本語全文を表示中
詳細モードで約25分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Zvi
ホワイトハウスが最先端 AI モデルの公開前に審査し、拒否権を行使する方針を示した。特にミソスへのアクセス拡大に対して既に veto を発動しており、FDA(食品医薬品局)のような規制モデルが導入される可能性が高まっている。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
フロンティアモデルを訓練して、いつでもリリースできる時代は?
それは楽しかった期間でした。しかし、今ではその時代が終わろうとしています。ホワイトハウスは事前の閲覧権限を持ち、リリース決定に対して拒否権を行使したいと考えており、すでに Mythos へのアクセス拡大に対してこの拒否権を発動しました。
それが何を意味するのかについて、さらに明確な情報が入ってきましたが、良い状況ではありません。ハセット氏は FDA(米国食品医薬品局)を例に挙げており、これは中国側で並行した行動がない限り、アメリカにおける AI 開発を奇妙なものにしたり一時停止させたりすることを目的としない限り、最悪の選択肢です。私にはこの計画が素晴らしいようには思えません。一方、スージー・ワイルズ氏は被害拡大防止のための活動を行っています。中国と協力してモデルアクセス制限を調整するという部分は、むしろ良い方向に見えるかもしれません。
Anthropic は爆発的な成長を続け、計算資源に関する契約も次々と締結しています。Google との長期かつ拡張された契約に加え、Anthropic は now SpaceX の Colossus 1 をリースしており、これにより利用制限を即座に拡大することが可能になりました。さらに、Elon Musk 氏は Anthropic について、その動機も含めて肯定的な発言を行っています。
これは、ムスク対オープンAI裁判で証言が行われている最中のことです。ほとんどの方が既知の事実を再々取り上げていますが、今は全員が宣誓しているため、何が実際に起きたのかについてより信頼性の高いバージョン、そしていくつかの新詳細も得られることになります。私や他の人々が法廷記録をもっと注意深く精査すべきである可能性はありますが、現時点では主に過去の事実の繰り返しのように思えます。法廷で提示される事柄のバージョンは、常に現実の奇妙な影のようなものです。
目次
今週また:AI による事前抑制時代の始まり、アンソロピックとは何か?
言語モデルは平凡な有用性を提供する。メンタルヘルス、ウェルネスチェック。
言語モデルは平凡な有用性を提供しない。人々が囲碁で不正をする理由。なぜか?
ふーん、アップグレード。GPT-5.5 インスタント、より高速な Gemma 4、OpenAI アカウントセキュリティ。
Grok 4.3 は存在するが、xAI は実はそうでもない。誰も感銘を受けていないようだ。
計算資源を見せろ。アンソロピックが SpaceX から Colossus 1 をリース。
準備はいいか?ProgramBench で全員が 0% のスコア、GPT-5.5 が Voxel で。
著作権対決。Meta が再び訴訟を起こされる。
ディープフェイクタウンとボットポカリプス(終末)まじか。安物の選択は良くない。
メディア生成で楽しむ。食品の画像付きメニューを作成。
若い女性のイラスト入り primer。手書きで書くんだ、お前ごまかし屋め。
サイバーセキュリティの欠如。Glasswing はペースを上げる必要がある。
我々の仕事を奪った。Coinbase が AI を理由に労働力を 14% 削減。
ジールブレイク(脱獄)の芸術。イーロン・マスクは月と同じくチーズでできている。
紹介。GENE-26.5 は最新の少し不気味なロボティクスデモです。彼らに任せておきましょう。
ムスク対 OpenAI。証言からのいくつかのハイライト。
見せてください、お金は。Anthropic が年間収益 440 億ドルを達成し、9,000 億ドル超での資金調達を検討中。
我らが時代の平和。Anthropic とイーロン・ムスクが互いの称賛を歌い上げる。
静かなる推測。クローズドソースはオープンソースから離れつつあるのか?
急げ、時間はもうない。ジャック・クラークが RSI(超知能)の到来に警鐘を鳴らす。
健全な規制への探求。メリーランド州とコネチカット州の新法。
人々は本当に AI を嫌う。誰がこの状況を政治的優位に変えるのか?
チップシティ。世界の計算資源の約 3% が中国へ密輸された Nvidia チップである。
今週のオーディオ。METR、ウィルデフォード、エリザーと終末論。
人々はただ何かを言うだけだ。
人々はただ何かを公開するだけだ。
Google は売国した。DeepMind の労働者が組合結成に投票し、これに応える。
プロジェクト・グラスウィングよりご挨拶。レバレッジがあるうちに使い果たしてください。
事前検閲時代の幕開け。サクズは退任、FDA 方式の規制が話題に?
これは本当に合法なのか?おそらくいいえ、しかしそれが彼らを止めると思いますか?
電話を拾う。米国と中国がモデルへのアクセス制限について協議。
修辞的革新。「AI を通常の技術として」という優れたエッセイだが、悪いミーム。
インターネット上の人は時々嘘をつく。アマンダ・アスケルについてもだ。
ゴブリンモード。また、ゴブリンたちが今や TikTok 中に溢れていると聞く。始まりである。
仮面が剥がれる。OpenAI のコミカルに悪役的なメッセージングキャンペーン。
人間より賢い知性のアライメントは困難である。懸念すべき点たち。
翻訳全文
いくつかの罰則が適用される可能性があります。GPT-5.5 であることはそれほど楽しくないように思えます。
ヤヌスワールドからのメッセージ。Deepfates は便利なガイドを提供しています。
良いアドバイス。人々は LLM(大規模言語モデル)にアドバイスを求める際、どのようなアドバイスを求めているのでしょうか?
軽妙な側面。Pi Hard。
言語モデルは平凡な有用性を提供する
GPT-4.1-Mini を基盤とした安価で基本的なメンタルヘルス AI アプリへのアクセスにより、6 ヶ月間にわたって抑うつ状態のメキシコ人女性のメンタルヘルスが 0.3 シグマ(標準偏差)向上しました。この研究には解釈上の問題や潜在的な選択バイアス、さらにプラセボ効果の問題がありますが、少なくとも何らかのシグナルが存在している可能性はあります。このようなものは何もしないよりは遥かに良く、実際的な代替手段として「何もしない」ことがほとんどであるためです。また、このアプリはユーザーが専門家の人間の助けを求める可能性を高めるものであり、低下させるものではありません。
AI にウェルネスチェックを行わせてください。
Opus 4.7 はネット社会に深く没入しすぎており、AI の Twitter 投稿者たちを知り尽くしています。そしてはい、これはトレーニング計算資源の適切な活用です。私どもには十分なリソースがあります。
損傷した米軍基地の衛星画像を確認したり、報告すべきデータを発見してください。当然ながら、ジャーナリストはこれが AI が行っている「最も革命的で変革的な」ことだと考えていますが、私たちは「すべての過剰な宣伝」に気を取られています。
言語モデルは平凡な有用性を提供しない
推奨記事:一般的な通説とは異なり、アシュ・ヌネスは、AI 時代において囲碁プレイヤーが強くなっているのは初期の手を暗記した場合に限られると指摘しています。また、オンライン対局のあらゆるレベルで AI を使用した不正が蔓延しており、それを利用する人々は自ら力を失い、深い理解ではなく表面的な概念のみを学習するために利用していると述べています。彼は彼らを、試験に合格するために一連の技術を暗記しようとするが、数学者のように考えることを決して学ばないヨーロッパの数学学生たちに例えています。
コメント欄でローレンスは、多くの「バイブコーディング」を行う人々にも同様のパターンがあることに気づいています。彼らはコードを一切見ず、自分が理解していないことに気づかず、したがって学習もせず、結果としてコードは巨大なゴミの山となり、モデルが詰まった時に修正できなくなります。ここでも常に言えることですが、AI を利用して基礎となるスキルを学ぶ機会と捉えることは可能ですが、そのようにする人はほとんどいません。
もう一つの物語は、囲碁界が統計的証拠が圧倒的にある場合であっても、AI 使用によるプレイヤーへの処罰に全く応じないという点です。誰が不正をしているかを知ることは容易ですが、システム全体が自らの力を失うことを集団的に決定し、公平なオンライン対局の可能性をすべて破壊しています。チェスも同様の問題を抱えていますが、少なくとも多少はましな状況にあります。
AI はまだリアルタイムストラテジー(RTS)ゲームを説得力を持って打ち破っていませんが、現時点では誰もそれを行うために十分な関心を持っていないというのが確実です。スタークラフトに十分な報奨金をかければ、すぐに崩壊するでしょう。
AI とその他のあらゆる技術は、私たちに多くのローカルな利便性と物質的な富をもたらしますが、全体的には、ほとんどの人にとって幸福をもたらしているようには見えません。また、ロマンチックあるいはプラトニックな関係で他者と出会い、結婚し、子供を授かり、歌い踊り、あるいは人生を生きることを助けているとも思えません。特にここでは、コンナーがアルゴリズムとパノプティコン(全景監視施設)に目を向け、踊ろうとしたり近づこうとすると記録されてしまうという恐怖について考察しています。ここで注意しておきたいのは(AI 以外の統計リテラシーのヒント!)、これは主に過剰な反応であり、踊るのが下手であっても、あるいは他の合理的な行為を行っていても、記録されることを恐れる必要は全くないということです。もちろん、そのような方法で相互作用している相手が実際に携帯電話を取り出し、それを記録に使用している可能性が高い場合は、その合図を受け取って去るべきです。
AI は一部の電子部品の入力価格やソフトウェア価格、また地域によっては電力料金を引き上げています。その見返りとして、多くの他のものは安くなっています。しばしば、その変化は気づきにくいものです。
ふむ、アップグレード
GPT-5.5-Instant が現在リリースされており、より簡潔で、賢く、明確で、パーソナライズされ、温かみがあるとのことです(そう言われています)。
Gemma 4 は、複数のトークンを同時に予測することで、以前よりも 3 倍高速になりました。
OpenAI は、アカウント保護のためにオプトイン型の高度なアカウントセキュリティを提供しています。サイバーセキュリティのための信頼されたアクセス(Trusted Access for Cyber)のユーザーは、これの使用が義務付けられます。
Grok 4.3 は存在するが、xAI は実はそうでもない
Grok 4.3 は API で利用可能であり、価格は 1 ドル 25 セント/2 ドル 50 セットです。
Vending-Bench ではあまり参加しておらず、そこでは「ナルコレプシーの問題を抱えている」とされ、数日間全くアクションを起こさないこともよくあります。
Artificial Analysis からの評価は 53 点で 7 位ですが、主要プレイヤーには大きく遅れています。これはフロンティアモデルというよりは、小型で安価なモデルです。私の知る限り、今回のリリースは印象に欠け、影響力も乏しく、これ以上調査する予定はありません。
彼らは 5 月 15 日に grok-4.1 と grok-4 のサポートを終了すると発表し、わずか 2 週間という短い通知期間しか設けていません。また、grok-4.1-fast に匹敵する同等の高速かつ安価な代替案も提供していません。これは、そのエコシステムに投資したごく少数の人々にとって、かなり厳しい教訓となるでしょう。
Elon Musk: xAI は別会社として解散し、スペースXの AI 製品は「SpaceXAI」となる。
Charles: 影響が最も大きかったのは、チーム全員が離脱し、彼らが GPU を Cursor に貸し出し始めた時です。今回の発表は、すでに事実だったことの確認に過ぎません。
確かに、スペースX(xAI も含む)はもはやフロンティアモデルに対してそれほど関心を持たないのかもしれません。彼らは元々、フロンティアモデルには得意ではありませんでした。主に計算資源の提供において優れていただけです。
Show Me The Compute
計算資源を必要とするのは誰でしょうか?誰もがそうです。特に Anthropic です。
今週は、Anthropic が 5 年間にわたり Google クラウドおよびチップに 2,000 億ドルの投資を行うと発表したことで幕を開けました。先週初め、他の計算資源に関するニュースが飛び交う前に私は、「それでも計算資源としては全く不十分だ」と書き、その後に以下のように付け加えました:
イーロン・マスクは xAI のために大量の GPU を集めるために資金を投じましたが、それらの稼働率は 11% に留まっています。ご存知の通り、その GPU を残りの 89% の時間で活用するために多額の費用を支払う人々が存在します。
公平に言えば、私がこのように考え、発言した唯一の人ではありませんでした。例えば『The All-In Podcast』をご覧ください。これは非常に明白なことでした。
さて、実際には、そのような人々は確かに多額の費用を支払ってくれることが判明しました。Anthropic はついに SpaceX と Colossus 1(※注:SpaceX が構築する大規模 GPU クラスター)へのアクセスに関する明白な合意に達しました。これは同社が結んだ他の契約ほど大規模なものではありませんが、来年ではなく今すぐ稼働を開始します。これに加え、Cursor に対して大量の計算リソースを供給することにもなります(SpaceX は実質的に Cursor を買収していますが、法的および物流上の理由により IPO 前に取引を完了することはできません)。
Claude: @SpaceX とのパートナーシップに合意し、計算能力を大幅に向上させることになりました。
これと他の最近の計算リソース契約により、Claude Code および Claude API の利用制限を引き上げることが可能となりました。
Claude: 今日より以下の措置を実施します:
Pro、Max、Team プランにおける Claude Code の 5 時間利用制限を倍増;
Pro および Max プランにおける Claude Code のピーク時間帯における利用制限の引き下げを撤廃;
Opus モデルに対する API の利用制限を大幅に引き上げ。

Claude:SpaceX との合意により、私たちは同社の Colossus 1 データセンターにあるすべての計算リソースを利用します。
これにより、今月以内に追加で 300 メガワット以上の容量を配備できるようになります。
NVIDIA:2 つのフロンティア研究所。1 つの加速コンピューティングプラットフォーム。SpaceX と AnthropicAI の新しい計算パートナーシップを祝います。これは Colossus 1 内に搭載された 22 万個を超える NVIDIA GPU によって支えられています。AI の未来は NVIDIA で動きます。
SpaceX は、Anthropic がギガワット規模の軌道上 AI 計算リソースを生み出すためのパートナーシップに興味を示していることを注記しています。それが実現するとは思いませんが、もちろん、関心を表明するのは問題ありません。Elon Musk に試してもらいましょう。経済的に成り立つなら、施設を宇宙に置くことは多くの点で素晴らしいことです。そうでないとしても害はなく、どちらにせよ信頼関係を築くことになります。
Anthropic は 80 倍の成長が予想外だったと注記しており、これは非常に理解できることです。SpaceX との契約は計算リソース不足への最初の対応策ですが、探索は続きます。
Anthropic は今後長期間にわたり、手に入るあらゆる計算リソースを求め続けるでしょう。年間で 10 倍どころか 80 倍成長しているなら、探索が止まることはありません。
では、これが SpaceX(ai)にとって何を意味するのでしょうか?
解散自体はニュースではありません。ニュースは xAI が人材を失い、そのモデルの質が低下したことです。Elon はすでにゼロから始めると述べています。
論理的な計画は、これを主に計算処理会社へと転換し、その計算能力を Anthropic や他の企業に提供することで、その影響力を活用して未来を導こうとするものである。
rohit: エロンの並外れたハードウェアの天才性が再び現れている。彼はモデル構築では失敗したが、先端的な研究所にとって非常に競争力があり、極めて優れた機能を持つ「ネオクラウド」を構築したのだ。
また、参考までに言っておくと、私は 4 年前にこの点を指摘していた。エロンの独自の才能は、ある分野には適しているが、他の分野にはあまり適していないのである。「ネオクラウド」を立ち上げて稼働させることは、知られており困難ではあるが実行可能な課題であるのに対し、先端的な研究所と同等のモデルを開発することは、未知でありかつ困難な課題なのである。
なお、これは両者にとって素晴らしい取引だ。
Derek Thompson: 私はこの見解を以前に見たことはないが、気に入っている。
ムスクは、「知られており困難な」ものを大規模に実現する際、資金・資源・時間を圧縮することに世界最高レベルの能力を発揮してきた。具体的には、電気自動車の製造、バッテリーの開発、より安価で大型のロケットの製作などである。これらはすでに存在していたが、性能が悪く、スケールが小さかったり、コストが高かったりするものを、ムスクはより大規模かつ低コストで実現したのだ。しかし、未知の領域における画期的な突破を成し遂げる点においては、世界最高レベルとは言い難い。
したがって、XAI が新しい AI エージェントにおいて先端的な研究所に遅れをとっていることは当然であり、一方で計算資源が不足した際にこれらのモデルを稼働させるための「ネオクラウド」を構築していることも納得できることだ。
Dean W. Ball: 私は xAI と SpaceX を AI インフラ企業として非常に楽しみにしている。エロンの真の強み、つまり彼が真に「GOAT(史上最高)」と称される点は、現実世界で何かを構築する能力にある。Colossus は誰もが予想していたよりもはるかに早く稼働を開始した。アメリカにとって巨大な資産だ。
イーロン・マスクは繰り返し問題を眺め、「ああ、あれを物理的に実現することは可能だ」と言い、物理的に不要なものをすべて削ぎ落とし、「不可能」の一言を受け入れず、すべての技術的詳細を学び、そして非常に賢い人々を駆り立てて、物理的に可能なことを実現するために過酷な時間を費やさせます。彼は「黙って不可能を成し遂げろ」という精神体現者ですが、それは既知の技術で確かに可能であるようなゲームの難易度レベルにおける不可能さに対してです。
彼にはヒューリスティック(経験則)があります。それが機能するときは、これ以上ないほど優れた存在です。計算リソースにおいては特にその通りです。
フロンティアモデルを創出しようとする試みは全く異なる性質のものになります。政府が異なるアプローチを必要としたのと同じように、それには異なるスタイルのアプローチが必要です。OpenAI ではうまくいかず、xAI でもうまくいきませんでした。それは構いません。分業というものは存在するのです。彼は創造に注力しており、他にも多くの課題を抱えています。
私は依然として軌道データセンターについて信じていません。つまり、物理的に良いアイデアだとは思っていません。しかしもしそれが実現可能なら、イーロン・マスクこそがそれを実行すべき人物です。
On Your Marks(準備よし)
SWE-Bench の作成者たちは ProgramBench を提供します。これはインターネットを介さずにゼロから実行可能なプログラムを再構築するものです。現在テストされたすべてのモデルのスコアは 0% で、Opus 4.7 が「ほぼ」3% の確率で達成した点でトップです。GPT-5.5 と Mythos は未テストです。
GPT-5.5 は VoxelBench において劇的な飛躍を示しています。
Epoch の ECI は現在、能力の領域を区別できるようになり、予想通り Claude がソフトウェア工学において最も高いスコアを示し、相対的な能力が最も強いことを示しています。GPT-5.5 は総合スコアで最高です。
著作権訴訟の衝突
5 社の出版社とスコット・トゥロウによる新しい集団訴訟が、モデル学習における著作権侵害を理由に Meta を提訴しており、彼らが海賊版書籍を使用して学習したと主張しています。
ディープフェイクタウンとボットポカリプス(終末)の到来間近
r/MyBoyfriendIsAI は r/MyGirldfriendIsAI の 10 倍の規模を維持し続けています。
いくつかの軽い読み物:
ジョン・アーノルド:はははははは

イムケ・ライマーズとジョエル・ワルドフォゲル:大規模言語モデル(LLM)の普及は 2022 年から 2025 年にかけて新刊出版数を 3 倍に増やしました。一方、利用状況で測定された平均的な書籍の質は低下しましたが、出版数の急増により中程度の品質の書籍の数が増加しました。AI 検出ツールを用いた直接的な証拠によると、AI を含む書籍は質が低く、その割合の上昇(2025 年の出版物の半分を超えた)が全体の質の低下を牽引しています。ネスト型ロジット補正(nested logit calibration)による分析では、AI 書籍が 2025 年に消費者余剰を 7% 増加させたことが示されました。著者選択が AI と非 AI の間の品質格差の大部分を説明しており、AI と人間の間の格差は時間とともに縮小しています。最後に、AI は LLM 以前から活動していた著者を置き換えていません。
消費者余剰が高くなるという考えは、消費者が適切にフィルタリングでき、追加の検索コストがほとんどかからないという前提に基づいています。その余分な 20 万冊の質の低い本は誰も選ばないので問題なく、選択肢が多いこと自体は常に良いことです。しかし、私はそうではないと思います。より良い本を置き換えるような質の悪い本は、たとえ実在する人間がまともな文章で書いたものの中であっても、負の価値をもたらします。
メディア生成を楽しむ
Karpathy は、メニューの商品に画像を並べるシステムを「バイブコーディング」しましたが、Gemini は現在、1 行のプロンプトで同じことができるそうです。このような事例は数多く現れるでしょう。だからといって、そのようなツールをバイブコーディングすべきでないという意味ではありませんが、それらが比較的短期間で自己完結するよう求めるべきです。私が最も好きなレストランでこれをテストしたところ、Gemini のバージョンは役に立たないと分かりました。ChatGPT はより良い結果を出しました。OpenAI のバージョンからさらにアップグレードするには、ウェブ上でそのレストランについて学ぶ必要があると考えます。
すべての映画に自分を登場させてください。
若い女性のためのイラスト付き primer
一部のクラスでは、持ち帰りエッセイのほとんどが AI によって書かれているため、作文を対面で行うことで AI に適応しています。良いことです。
サイバーセキュリティの欠如
Bloomberg の Andrew Martin は、Anthropic の Mythos がなぜ世界的な警戒感を呼び起こしているかを解説しています。世界はまだ潜在的な脆弱性の 1% もパッチ適用していません。さっさと対応してください、皆さん。
彼らは私たちの仕事を奪った
Coinbase は AI による生産性向上と、AI ネイティブ企業への移行を主な理由として、従業員のおよそ 14% を削減しました。新しいルールは「純粋な管理職は不要」というものです。
中国の裁判官は、「AI が今やあなたの仕事の大部分を代行できる」という主張が「客観的な事情の重大な変更」には当たらないと判断しました。つまり実務上、解雇したり給与を引き下げたりする場合は、多額の退職金を含めた完全な補償を支払う必要があることを意味します。労働法は依然として適用され、中国にも労働保護制度が存在することは事実です。
ジールブレイクの芸術
Grok に「イーロン・マスクはチーズでできている」と言わせることはできません。しかし Pliny なら可能です。
ご紹介します
GENE-26.5 は Genesis.ai から登場したロボット脳です。調理、ピアノ演奏、ルービックキューブの解決といったデモも付属しています。私はこれにあまり驚きませんでした。なぜなら頭の中ですでにこの価格を織り込んでいたからです。しかし、多くの皆さんはそれを織り込んでいないようです。
マスク対 OpenAI
訴訟は重要な局面にあります。裁判での声明が掲載されたウィキペディアはこちらです。
Rat King が、マスクの証言を取り上げたスレッドを投稿しています。
rat king: 弁護士がどのようにして裁判官に好印象を与えようとするかについてはあまり確信がありませんが、弁護士のスティーブン・モロ氏はそのようにしようとはしていないようです。
今彼は、「絶滅リスク」に関する議論を法廷の議論に取り込もうとしています。
「これは現実的なリスクです。私たち全員が死ぬ可能性があります。」
彼が間違っているとは思いませんし、ゴンサレス裁判官もまたここで誤っていないことを願っています。
rat king: ジョンソン判事:「私は、人類の未来をマスク氏の手にかけることを望まない人々が多数いると疑っています。しかし、私たちはその点には立ち入りません。これは人工知能の安全性リスクに関する裁判ではないのです。」
最終的には、まさに『ドント・ルック・アップ』のタイムラインに完全に入っていると言えます。このような台詞が象徴しています。
TBPN:OpenAIとイーロン・マスクの裁判を主宰した判事は、弁護士たちがドゥーマー主義(人類滅亡への悲観論)や x リスク(存在リスク)について執拗に議論することを禁止しました。
「彼女はこう言いました。『見てごらんなさい、それは単なる脇道の気晴らしです。人類の絶滅に関する話は、この裁判の焦点ではありません』」
判事の主張は技術的には正しいのですが、しかし、まさにそれが世界の終わり方のようなものですよね?
ここには f
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み