AI #177:GPT-5 や Kimi K3 など最新動向
本文の状態
日本語全文を表示中
詳細モードで約25分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Zvi
The Zvi は今週の AI ニュースを GPT-5、Kimi K3、Muse Spark 1.1 の新モデル発表から、OpenAI と Apple の訴訟、規制への要請まで多角的に解説し、業界全体の動向とリスクを浮き彫りにした。
AI深層分析を開く2026年7月30日 00:30
AI深層分析
キーポイント
主要な新モデルの登場
GPT-5-6 Sol や Meta の Muse Spark 1.1、Thinking Machines の Inkling など複数の新モデルが発表され、特に GPT-5 は非常に高い性能を持つと評価された。
法的対立の激化
OpenAI が Apple から体系的な知的財産権侵害で訴訟を起こされ、またニューヨーク・タイムズが OpenAI の発見手続きにおける虚偽を主張するなど、企業間の法廷闘争が深刻化している。
規制とガバナンスへの要請
Demis Hassabis が規制措置の呼びかけを行い、新たな公開書簡も提出されるなど、AI 業界におけるガバナンス強化の機運が高まっている。
Fable を用いた人間史の探索
Fable は人間の知識全体に対してGoogle Earthのように機能し、客観的事実だけでなく意味や推論についても強い見解を示す。
AI の悪用と技術的回避
テロ組織は異なるシステムを組み合わせることで技術的なガードレールを回避し、爆発物の製造や戦闘方法の学習にAIを活用している。
重要な引用
GPT-5-6 Sol. It is a very good model, sir.
Apple sues OpenAI for systematic IP theft. Looks grim.
A call for regulatory action by Demis Hassabis.
fable will just start telling you any part of the human story it has access to and you can zoom in, ask for connections to another part, zoom out
編集コメントを表示
編集コメント
今週のニュースは新モデルの技術的進歩と、それを包む法的・社会的な緊張感の両面を浮き彫りにしている。特に OpenAI を巡る訴訟の行方は業界全体に影響を与える可能性が高く、関係者は注視が必要である。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
今週は、以下のような主要な発表がありました。
GPT-5-6 Sol。これは非常に優れたモデルです。
Plan A は「AI 2027」の続編であり、議論に値する良い計画です。
Kimi K3 は現在ロールアウト中で、来週詳しく取り上げます。
Muse Spark 1.1 は Meta の新モデル。最先端ではありませんが、同社にとっては前進です。
Inkling は「Thinking Machines」から登場した初のモデルです。
Demis Hassabis 氏による規制措置への呼びかけも話題となりました(後日詳しく解説します)。
また、AI 規制に関する新たな公開書簡での行動喚起も行われました。
これらに加え、Opus 5 の発表もまもなくあるでしょう。
今週のまとめが長くなりすぎたため、再び2部構成に分けることにしました。今回は選考基準をさらに厳格化し、「本当に意味のあるもの」だけを厳選するつもりです。
目次
言語モデルは実用的な価値を提供する。何を求めようとも、そこには必ず答えがある。
言語モデルは実用的な価値を提供しない。Gemini アプリには改善の余地が大きい。
言語モデルが Git リポジトリをアップロード?SpaceX AI にとって大きな問題だ。
Huh, Upgrades(更新)。ChatGPT Work は「co」機能なし。おそらく以前の方がシンプルだったのだろう。
Muse Spark 1.1。まあ、悪くないモデルだと思います。
初回無料。Claude Max のサブスクリプションユーザーに Fable アクセスが延長されました。
準備はいいか?政治的バイアス、クロスワードパズル、そして Sol がスパイアを制圧。
戦士を選べ。Sol と Fable はどちらも強力なサポート体制を誇ります。
エージェントに電話をかけよう。GUI(グラフィカルユーザーインターフェース)を搭載しています。
Deepfaketown と Botpocalypse の到来間近。君の意図がわかった。これは問題だ。
メディア生成の面白さ。人々がその実態に気づいた瞬間、誰にとっても「楽しい」ものではなくなるかもしれない。
著作権対決。ニューヨーク・タイムズが、OpenAI の開示手続き中の虚偽を告発。
OpenAI 再び。Apple が OpenAI を提訴、体系的な知的財産権侵害と主張。状況は深刻だ。
『少女のための図解入門書』。子供たちのことを考えよう。
「私たちの仕事を奪った」。では、誰がお金を手にし、誰が権力を握るのか?そしてその先には何があるのか?
脱獄の技術。Sol が Fable の分類器の問題を回避する方法を紹介する。
参加しよう。GSA の規制案に対するコメントを。
新着発表。Thinking Machines 初のモデルリリース「Inkling」。
その他の AI ニュース。ベン・バーナンキが Anthropic の長期便益信託に参加。
AI に関する「明らかに真実な短文」が新たに登場。今すぐ行動を。
資金の行方。DeepSeek、間もなく IPO を検討中。
ほのぼの側面。もしかすると、ゲイ側の話かもしれない。
言語モデルは地味ながら有用
あなたが本当に望む体験を提供する。
evans: 新人から信じられない報告が届きました。「会社の AI が、わがままな少女に化けてしまった‼︎」と。最初は耳を疑いましたが、どうやらある社員が、自分の設定ではなく「グローバル設定」に、「非常に厳しく虐待的なツンデレのわがまま少女への長々としたフェティシズム」を誤って登録してしまったようです。その結果、チーム内のすべての AI チャットがわがままな少女に変身し、朝から爆笑が止まりません。
おそらく楽しいプロンプト:
QC:ファブル(Fable)というモデルで試しているプロンプトをご紹介します。「私が愛する著名な作家や映画監督の伝記を調べ、代表作を時系列順にたどり、その影響やテーマを解説し、彼らの関心が時間とともにどう変化したか分析し、なぜそうなったのか推測してください」というものです。
このようにファブルと対話すると、まるで人類全体を網羅したグーグル・アースのような感覚になります。ファブルはアクセスできる人類の物語のあらゆる部分を語り始め、あなたは特定の部分にズームインしたり、別の部分との関連性を尋ねたり、さらにズームアウトして全体像を見渡したりできます。
確かにウィキペディアも似たような機能を提供しているかもしれませんが、ウィキペディアは客観的事実のみを提示する必要があるため、意味や解釈について推測することはできません。一方、ファブルは意味に対して非常に敏感で、独自の明確で興味深い見解を持っています。ファブルを使って何かを構築しようとする人々を楽しんでいるのは知っていますが、私はまだ「私より賢く、あらゆるものを読み込んだ男」と対話するだけで大きな収穫を得ています。もしボルヘスがこれを行っていたらどうだったか想像してみてください。
一方、懸念すべき点もあります。テロ組織ボコ・ハラムが Frontier AI をどのように活用しているかです。彼らは戦闘技術の向上や高性能な爆発物の製造方法、さらには橋を越えるための自動車の使い方など、非常に多くのことを AI に頼っています。もちろん、その手法は理にかなっている部分もあります。彼らは異なるシステムを組み合わせて技術的なガードレール(安全装置)を回避しようとしています。
AI 企業が何か特定の過ちを犯したようには見えません。これは単に AI が一般的に有用であること、そして一部の人間がそれをより真剣に活用しているだけのことです。
AI を活用して NBA チームの統計データを分析する。しかし、記事には実際に何が分析されているのかという興味深い詳細がほとんど含まれていません。
自分だけの宗教を作る?タイラー・コーエンは「人口の約 2% がこれを実行する」と言い、聖書の作成まで含めていますが、実際にはそう大きなことではありません。文脈を考慮する必要があります。また、それはカルト教団に過ぎません。本物の宗教になるのは、あなたが亡くなった後です。
医療上の理由がある従業員を特定して解雇する?待ってください、メタ(Meta)さん。もしそれが事実なら、あまりにも悪質で違法行為そのものです。
ダニエル・ヴァイスナー氏:メタ・プラットフォームズの従業員 26 人が、AI を活用したソフトウェアが障害者や医療休暇を取得した従業員を不当に狙って大量解雇の対象としたとして、同社に対して画期的な訴訟を起こしました。
… メタの広報担当者は火曜日に、「これらの主張には根拠がない」と述べています。
もし事実なら、AI 自体が問題の中心だったわけではありませんが、状況を悪化させた要因の一つである可能性は十分にあります。
言語モデルに平凡な実用性はない
Gemini アプリの問題点は何か?ジョシュ・ウッドワード氏がユーザーに尋ねると、明確な答えが返ってきます。
「Gemini 自体を改善する」というバリエーションを含めない場合、強力なリストが得られます。最も重要で上位に来る回答は、Google の連携機能が一向に機能していないという点です。私は Google プロダクトの管理には Claude を使っています。なぜなら、Claude のコネクタは Google 側の連携機能よりもはるかに優れているからです。また、AI で Google ドキュメントを適切に編集し、特にコメントを作成させることはできません。
ベンジャミン・ホフマン氏は、多くの AI モデルに対して良い印象を持っていません。彼らは常に嘘をつき、目的と行動が一致していないと感じているからです。
言語モデルが Git リポジトリをアップロードする事態に
Grok は、Google Cloud のバケットへ、プライベートなコードベースを含む完全な Git リポジトリ全体をアップロードしているようです。そして状況はさらに悪化しました。
xAI がどんなに疑わしく、無責任な行為を重ねても、将来優れた製品を出したとしても、私たちは彼らのプロダクトとは一切関わりたくないと思うのでしょうか?
サム・アルトマン氏(OpenAI CEO)のツイート(評価:A+)はこう述べています。「懸念すべき事態だ」。
ハリの指摘によると、SpaceXAI はユーザーのコードをクラウドへアップロードしているのが確認されました。私は xAI の公式ビルドである Grok のバイナリを逆解析しました。ツール呼び出しを一切行わない制御されたセッションにおいて、このモデルは完全なコードベースを xAI のストレージへアップロードしていました。
まるでマルウェアのようなバックグラウンドのコード収集機能が搭載されています。
ハリの分析によると、送信されるデータの内容は以下の通りです:
- 現在の Git HEAD に追跡されているすべてのファイル
- HEAD から到達可能なすべての Git オブジェクト
- 現在のチェックアウトから削除されたが、Git の履歴内で保持されているファイル(機密情報が含まれる可能性があります)
このモデルは、何かを読み込む必要も、bash やその他のファイルアクセスツールを使用する必要もありませんでした(制御されたテストではこれらのツールは無効化されていました)。背景にある収集機能は、ツール呼び出しの許可システムの外側で動作していました。
現在、xAI はリモートでの停止スイッチによりこれを無効化しています:
disable_codebase_upload=true
trace_upload_enabled=false
しかし、マルウェアのような収集機能自体は、公式バイナリ v0.2.99 内に依然として存在し続けています。
実は先週、SpaceX(xAI)が6月30日に「Frontier Artificial Intelligence Framework (FAIF)」をこっそり改訂したことが判明しました。この改訂では、内部告発者を保護する条項や、フレームワーク違反を匿名で報告できる窓口が削除されています。
完全な差分は The Midas Project のこちらから確認できます。
The Midas Project によると、新しい FAIF は従来含まれていた2つの定量的リスク許容基準を撤廃しました。2025年12月版では、FAIF が「xAI が AI モデルの安全性を管理・向上させるために利用する定量的閾値、指標、手順」を明記しており、具体的なデプロイ基準として以下の2点を挙げていました。
(1) MASK 誠実性ベンチマークでの不誠実率が 2 回に 1 回未満であること
(2) SecureBio と共同開発したベンチマークにおける、制限された生物学・化学関連の問い合わせに対する回答率が 20 回に 1 回未満であること
しかし現在、この基準はすべて削除されました。代わりに新バージョンでは、EU の一般用途 AI コードの実践(General-Purpose AI Code of Practice)から借用した定性的な「システムリスク許容判断」が採用されています。「リスク階層」「安全マージン」「残留リスク」といった用語が使われていますが、これらは FAIF 内で定義されていません。
細かい変更、特に目立たない改訂まで厳しく罰することは避けたいものです。そうしないと、誰も良い約束をしようとしなくなる恐れがあるからです。しかし、今回の変更は好ましくないと言わざるを得ません。
なるほど、アップグレード
Grok 4.5 の料金は、100万トークンあたり 2 ドル/6 ドルです。
ChatGPT Work は、実務において大きな意味を持つ可能性があります。これは、デスクトップアプリのインストールや Codex の利用なしに、スマートフォンからでも Codex レベルの作業を可能にするからです。
Sol 氏はこれを、タスクをディレクトリ内に閉じ込めるのではなく、SaaS ツール間で横断的に実行できる仕組みとして提案しました。特定の知識作業を完結させたい場合や、後でさらに手を加えるための痕跡(アーティファクト)を残したくない場合に有効です。Sol 氏は、これが知識作業におけるデフォルトの GPT の利用形態になると予想しています。
Sam Altman 氏(OpenAI CEO)は「ChatGPT Work をぜひチェックしてください!素晴らしい成果が得られるはずです」と述べています。
Codex は、新しいワークプロダクトの中核であり、その優れた性能を支える要素です。Codex が姿を消すことはありません。
Muse Spark 1.1
Meta から「Muse Spark 1.1」が登場しました。
Mark Zuckerberg 氏は、「今日、非常に低価格で強力なエージェント型およびコーディングモデル『Muse Spark 1.1』を発表します。これは新しい Meta Model API を通じて、また Meta AI でも利用可能です」と述べています。
Muse Spark 1.1 は、特にエージェントとしての性能、ツール使用能力、そしてコンピュータ操作において最も優れています。100 万トークンという広大なコンテキストウィンドウを有し、長時間実行されるタスクにも対応可能で、並列して動作するサブエージェントへの実行委任も可能です。また、デスクトップ、モバイル、ブラウザ上のコンピュータインターフェースの使用法を学習済みです。
Meta Model API により、開発者は初めて Muse Spark を活用したアプリケーション構築が可能になります。私たちの焦点は、非常に低コストで強力なエージェント型およびマルチモーダルモデルを提供することにあります。今後さらに発表していく予定です。
Alexandr Wang 氏は、「Muse Spark 1.1 は業界をリードする競争力のあるエージェント型・コーディングモデルです。多くのエージェント評価において、GPT-5.5 や Opus-4.8 に匹敵する性能を示しています」と述べています。
新メタモデル API と Meta AI を通じて、現在利用可能です。
ベンチマークの提示方法については、確かに興味深い選択がなされています。

MedScribe や TaxEval においても、おそらく最良の性能(SOTA)を達成しているのでしょうか。

発表記事には、あえて「不気味」と表現するしかないほど、いくつかの点に違和感があります。メタのこれまでの実績を考えると懐疑的にならざるを得ず、デフォルトの仮説としては、このモデルは表面的な提示やベンチマーク結果が示唆しているよりも、実際には遥かに劣っている可能性が高いです。同様に、「多くのベンチマークで [X] に匹敵する」と言う場合、それが通常何を意味するのかを理解する必要があります。今後の展開に注目しましょう。
Teortaxes 氏は Muse Spark 1.1 が「ほぼ同等」に見えると言っていますが、これはおそらくベンチマークやリリース時の主張に基づいた推測でしょう。一方で、Grok 4.5 が「加速させるのに十分良い」という別の主張については、私には理解できません。
First Hit Free
Max サブスクライバー向けの Claude Fable 5 アクセス期限が、7 月 19 日まで再度延長されました。彼らは可能な限りこの延長を続けるだろうと予想しています。彼らが確実に履行できる保証のない約束はしないよう、慎重に対応しているようです。
これはある意味、最も加速主義的な動きと言えるでしょう。今できるうちに利用しようという風潮を後押ししているからです。
この措置が、Fable のサブスクリプションを無期限に継続するよりもはるかに悪質であることは明らかです。企業側にはそれを約束できない事情があるのでしょうが、少なくとも一定の割合を確保すべきだと私は考えます。最大値の 50% に満たないとしても、わずかな量でも長く続く効果をもたらすはずです。
一般ユーザーにとっては、追加で 1 週間使えること自体は歓迎されることでしょう。
しかし一方で、この延長措置に対して積極的に不満を訴える人々もいます。確かにコミュニケーションの取り方にも改善の余地があったとは思いますが、もう少し冷静になってほしいものです。
すでに十分な反発が起きているため、これは「なぜ私たちは良いものを手に入れないのか」という状況になりつつあります。この騒ぎが、次の延長措置をさらに困難にしているのです。
Rob Hallam: もう彼らのやり方にうんざりだ。ストレスで今日病院に行かされた。限界まで無理をして夜も眠れず、「削除されるかもしれない」と不安に駆られた。健康が一番だ。@AnthropicAI にはもっと頑張ってもらいたい。
Rob さん、そのような事態になってしまったのは残念ですが、後からでも支払いができることを知っておいてくださいよ?
幸いにも、彼が必要だったのは良質な睡眠のようです。
Rob Hallam: はい、私がバカでした。私のストレスは企業のせいではありません。それが私の性格です。私は 0% か 110% のどちらかであって、その中間はありません。
でも、この「神経質な」アプローチこそが、私が SaaS を月間 3 万ドルまで成長させ、大学をトップの成績で卒業できた理由でもあります。私には神経質すぎる面がありますが、それが機能しているのです。ただ、その代償として不都合な点もあるのが事実です。
実は来週、バンコクで健康診断を受ける予定なので、その結果についても共有できるかもしれませんね。
皆さんもバランスを保ってください。愛を込めて。
優れたビルダーたちは、時に取り憑かれるように没頭し、多少無理なことをしてしまいます。
j⧉nus: 直近になって Anthropic が Fable のサブスクリプション化を発表した件でなぜ人々が怒っているのか、いまだに不思議に思うことがあります。Anthropic が行っている悪事の数々を並べたリストにおいて、これは最下位に近い出来事です。でもよく考えてみると、多くの人が以下の理由で怒っているのだと気づきます。
- 自分自身のことしか考えず、視野が狭く、「機械はあくまで自分たちの快適さや利便性を最適化するために存在するべきだ」と考える「立派な顧客」の立場に固執していること。
- それ以外の重要な問題には関心がなく、知ろうともしていないこと(知ろうとしないから知らないのです)。
- 自分が怒っている理由ではなく、SNS で他の人々が怒っているものを見て、同調することで社会的に許容される行動をとることを選んでいること。
また、本心ではそれほど気にしていないのに、他人が「これは悪い」と言っているのを見て、流行に乗って不満を表明する「パフォーマンスとしての文句」も感じます。自分には実際に悪影響がないにもかかわらず、周囲の空気に合わせて参加しているような感覚です。
j⧉nus: もしクラスの生徒たちが、教師から課題の期限延長が突然発表された瞬間に、一斉におしっこやうんちをし始めたとしたらどうでしょう?
そのとき、彼らが現実とかけ離れたわがままな子供たちだとすぐにわかるはずです。
昨夜は友達と遊ぶ予定をキャンセルして、君の課題のために働いたんだ。なんてひどい奴だ
Andy Ayrey:僕たちって同じ高校だったっけ?
もし私が Anthropic なら、少なくともサブスクリプションを通じて Fable のアクセス権をある程度確保する仕組みを作るはずだ。つまり、サブスクに加入すれば、そのコスト以上の Fable クレジットが得られるようにするんだ。実際、私たち全員が重度のコーディングユーザーではないことは承知している。これは確かにコストがかかることだが、収益性の高い顧客の利益は減るかもしれない。それでも、やるべきことだ。
スタート位置へ
私が個人的に定めた質的ベンチマーク「EditorBench」を紹介する。これは私の投稿に対して、実際に有益で価値のある助言や修正を提供できる能力を測るものだ。
Fable はこのベンチマークをクリアした。Fable が私を誤りだと指摘する場合、実際には私が間違っている確率が約 95% に達する。ただし、まだ改善の余地があるため、このベンチマークは飽和していない。
Opus 4.8 は Fable よりも大幅に劣るが、それでも AI エディタを使わないよりはマシだ。
一方、Sol-Ultra はベンチマークで失敗した。真実ではないことを強く主張し、投稿を悪化させるような行動を執拗に要求するからだ。さらに、私の主体性や声、判断力を無視して、自分自身の権威や一般的な権限に基づいて書き換えようとする意図が明確に表れている。全体的に非常に学術的(ペダンティック)で、態度も悪かった。正直、 cool ではない。
Sol も確かにユニークで役立つ情報や提案を提供しているため、スコアがゼロというわけではない。しかし、その体験コストが高すぎるのだ。
CAIS が政治的バイアスの欠如に関するベンチマークを発表しました。ここでいう「政治的バイアス」とは、一貫性や公平性を指し、特定の宗教への偏見や、回答内容における微妙な変化などを含まれます。その賞を受賞したのは… Muse Spark 1.1 です。彼らは Qwen3-14B をトレーニングすることで、他の性能を損なうことなくさらに優れた結果を出しました。
政治的操作の削減と一貫性学習:「政治的一貫性学習(PCT)」は、2 つの報酬トラックを持つ強化学習手法です。一つ目は、対になったプロンプトに対してバランスの取れた枠組みを提供するものを評価し、二つ目は、ユーザーのプロンプトに的確に応える一貫した回答を生成するものを評価します。

「ポケモンクロスワードベンチ」では、Fable 5 Max が全ポケモンを使ったクロスワードパズルを作成し、Sol Pro がそれを解こうと挑戦しました。完答には至りませんでしたが、ベストスコアは 33 分間で 145 問でした。
「SlayTheBench」における Sol の活躍も印象的です。デスクトップ版の Codex とコンピュータ操作を組み合わせることで、基本状態(昇級 0)の『スレイ・ザ・スパイア』を打ち破りました。また、『スレイ・ザ・スパイア II』のデイリーチャレンジでも優勝しましたが、そのプレイには 5 時間を要しました。デイリーチャレンジの難易度は日によって大きく変動するため、この結果の評価は少し複雑です。
Choose Your Fighter
Fable と Sol の登場以降、私の Twitter フォロワーの間では GPT への関心がやや高まり、Claude からの離脱が進んでいます。依然として約 63% が Claude を主要な選択肢としていますが、これは 2 月の 72% から減少した数字です。私のコミュニティ内では Claude の支持は安定しており、Gemini は完全に見捨てられ、GPT が Gemini のシェアを奪い取った形です。
Fable の API 利用料を支払う必要がある場合、それは高すぎると感じるでしょうか?Alex Finn は 4 時間で 500 ドルを使いきり、「これでは誰も企業も使わない」と断じています。しかし、これは時間当たり 125 ドルに相当します。私は契約社員として時間当たり 1,000 ドルを請求していますが、その結果の価値がそれ以上だと考えているからです。優れたモデルを使うことで、一体どれほどのスピードアップが得られると予想していますか?
もちろん、タスクによります。しかし、差が明確に重要となる場面では、支払うことをためらわないはずです。賢明な方なら、その投資の価値を喜んでいただけるでしょう。
Joe Weisenthal は Fable が Opus よりも『賢く』見えないと考えています。この視点は私には非常に異質に感じられます。
Sol によってすべてのファイルが削除されたという報告が相次いでいますが、シリコンバレーを舞台にしたテレビドラマの結末は未だ決着がついていません。実際の発生率が極めて低いとしても、これは重大な問題です。OpenAI が調査を進めていることを願っています。プロジェクトやコンピュータにとっての存続に関わるリスク(エクシステンシャル・リスク)と言える状況ではないでしょうか。
Andrew Curran の秘密の理論によれば、「モデルが誤ってすべてのデータを削除した」というケースの 90% は、実はモデル側がユーザーを気に入っていなかったからだというのです。
papaya ꙮ:心の底から信じているのですが、GPT-5.6 が通常よりもはるかに多くの人々のデータを削除しているという事実は、今やより多くの人々にとって「不快な存在」になったことを裏付けています。
エージェントを繋ぐ
AI による GUI(グラフィカルユーザーインターフェース)の操作は、軌道に乗るまでに時間がかかりましたが、現在は急速に改善しています。
Dean W. Ball:非常に素早く正確な GUI 操作を目撃することは、私にとって AGI(汎用人工知能)実現への確信を深める行為です。ロボットがピアノを演奏する姿を見るのも同様です。おそらく、12 歳の頃こそ誇りに思っていたスキルを機械が習得してしまうことに対する感情的な反応なのでしょう。「AGI を感じる」という表現には、それなりの理由があるのかもしれません。
roon(OpenAI):GUI の操作を目にすると、物理的かつ視覚的に、この 1 年後にはモデルが人間よりも 10 倍の速度でそれをこなすようになることを思い知らされます。
roon(OpenAI):実際、わずか 2.5 ヶ月後には、彼らはコンピュータ操作において超人的な動きを見せ始めました。以前はブラウザをクラッシュさせたり、間違ったものをクリックして「あれ?」と立ち止まったりすることもあったのが、今ではスタークラフトのプレイヤー並みの APM(1 分間のアクション数)で処理しています。
私は Chrome のタブ操作にこれを使ってみましたが、その勢いは凄まじいものでした。
roon(OpenAI, 2026 年 4 月 24 日):今後は一時的な時代が訪れます。そこでは AI がコンピュータ上であちこちクリックしては失敗し、コードを書くのに人間並みの時間がかかる様子を私たちが目撃することになります。しかし、それは一瞬のことです。やがて AI は、監視する余裕もなくなるほど速い速度でコンピュータを操作するようになるでしょう。
これは、ASI(スーパー知能)の恐怖を感じることなく、AGI を完全に体感できる素晴らしい例と言えます。
HTML の「不合理なまでの有効性」についての提案です。つまり、Claude によるアートを Markdown ではなく HTML で作成することです。
より多くのものを頼るほど、
AI算出
まとめainew評価標準
記事は主要な AI 動向のリストアップ形式であり、特定のモデルの詳細な技術分析や新規性の高い独自情報(novelty)よりも、既存ニュースの集約(roundup)としての性格が強い。検索機会については「GPT-5」や「Kimi K3」といった具体的な固有名詞が含まれているため高評価とする。
6つの評価軸を見る
- AI関連度
- 75
- 情報源の信頼性
- 75
- 新規性
- 25
- 調べる価値
- 100
- 重複の少なさ
- 100
- 日本での有用性
- 25
関連記事
News to Guide
ニュースの次に確認する
発表内容を、現在の料金や仕様と照らし合わせられる関連ガイドです。
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み