AI 検出のゴールドスタンダード、パングラムを信頼できるか
本文の状態
日本語全文を表示中
詳細モードで約21分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
WIRED AI
WIRED は AI 生成コンテンツ検出ツール「Pangram」が出版業界などでキャリアを左右する権限を持つに至った現状を紹介し、その信頼性への疑問を提起している。
AI深層分析を開く2026年9月2日 19:28
AI深層分析
キーポイント
AI ポリスとしての Pangram の台頭
WIRED は Pangram が出版やその他の分野でコンテンツの真偽を判定する「AI ポリス」として、人々のキャリアを成り立たせたり破滅させたりする権限を持つ存在になったと報じている。
信頼性への懐疑
記事は Pangram が業界のゴールドスタンダード(金標準)として確立された背景を説明しつつ、読者に対してその判定結果を盲目的に信じるべきかどうかという疑問を投げかけている。
出版業界への影響
AI 生成コンテンツの検出技術が、従来の執筆や編集プロセスにおいて決定的な役割を果たすようになり、クリエイターや編集者の立場に大きな変化をもたらしている状況が示されている。
PangramのAI検出精度と影響力
Pangramはテキスト内のAI生成割合をパーセンテージで示すツールとして、小説や新聞記事など複数の事例で高い検出スコアを出し、出版業界に大きな影響を与えている。
業界からの反発と信頼性の疑問
作家や専門家からはAI検出ソフトがAI企業以上に悪だと感じる声があり、その信頼性に対する疑問が提起されている。
重要な引用
Meet the AI police who can make or break careers—in publishing and beyond.
Pangram Has Emerged as the Gold Standard of AI Detection.
"There is such distaste and anger at the AI detection software," says Jane Friedman, an author and publishing expert. "There's this feeling like they are just as evil, if not more evil, than the AI companies themselves."
Pangram promises to detect how much AI was involved in the generation of any given text, and it does so as a best-guess percentage (using AI, of course).
編集コメントを表示
編集コメント
AI 検出ツールの台頭は、コンテンツの信頼性を保つ上で不可欠な要素となっている一方で、その判定精度やバイアスに対する懸念も同時に高まっている。業界関係者はツールを盲目的に信じるのではなく、人間の判断と組み合わせて利用する姿勢が求められるだろう。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
2026 年 9 月 2 日午前 6:00
キャリアを左右する「AI 警察」の正体。出版業界だけでなく、あらゆる分野でその影響力は絶大だ。

写真・イラスト:WIRED STAFF; 画像提供:GETTY IMAGES
Pangram(パングラム)は、ブルックリンのポパイーズ(Popeyes)レストランの上に本社を構える、従業員 24 名の AI スタートアップだ。これまでに調達した資金は 1300 万ドルに過ぎず、OpenAI の調達額の約 0.0072% にすぎない。今年初頭までほとんど無名だった同社だが、もし Pangram が主張する通りなら、彼らは「人間の文章を機械が完全に支配する未来」を防ぐ唯一の存在となる。
Pangram は、あらゆるテキストに AI がどの程度関与しているかを検知し、その割合を確率として提示する。もちろん、その判定自体も AI によって行われる。1 月には、Reddit や YouTube で「ミヤ・バラード(Mia Ballard)が AI を使用して執筆したのではないか」という憶測が広まった。バラードは自費出版した小説『Shy Girl』をハチェット社から伝統的な出版契約を得ていたのだ。バラード本人はこれを否定したが、Pangram の CEO は X で「この本の 78% が AI 生成だ」と投稿。これを受け、ハチェット社は刊行をキャンセルした。
それに続くように、同様の批判が相次ぎました。ニューヨーク・タイムズは、AI 生成による「モダン・ラブ」コラムの連載を掲載したとして非難されました(Modern Love column)。この場合のパングラム社のスコアは 100 パーセントでした。その後は、コモンウェルス短編小説賞を受賞した作品(100 パーセント)、小説『Daggermouth』(60 パーセント)、そして 240 万ドルで取引されたスリラー『Call Me, I'll Hide the Body』(97 パーセント)が次々と取り上げられました。7 月下旬には、Substack が自社のプラットフォームに Pangram を統合し、読者が AI の利用可能性を素早く判断できるようにすると発表しました。
しかし、すべての作家がこの状況を歓迎しているわけではありません。「AI 検出ソフトウェアに対する嫌悪感と怒りが非常に強い」と、著者であり出版の専門家でもあるジェーン・フリードマンは語ります。「まるで、AI 企業そのもの、あるいはそれ以上に悪意があるかのような感覚を抱く人がいるのです。」出版界や高等教育分野以外では、Pangram はまだ一般的な名前ではありませんが、今後はそうなる可能性が高いでしょう。LLM が生成した文章と人間の執筆を見分ける需要は、日を追って高まっています。今問うべきは、この企業をどこまで信頼できるかということです。
パングラム(Pangram)の共同創業者兼CEO、30歳のマックス・スペロ氏が、スマホからGoogle Meetに接続してきました。片手にはテイクアウトの箱を持ち、背景には高層ビルがそびえています。ベージュのTシャツを着た彼は、短く黒い髪で、少年のような表情と大きな笑顔を浮かべています。「ランチを持って急いで帰宅するところなので、後ほどかけ直します」とスペロ氏。10分後、彼はブルックリンのアパートから再び現れました。
「朝から採用面接の電話が続いていました」と彼は話します。7月にはパングラムが900万ドルの資金調達に成功し、最新モデル「Pangram 4」の発表も行われました。同社のウェブサイトには6つの新求人枠が掲載されており、これにより社員の数は25%増加する見込みです。
カリフォルニアでの育ちについてスパーロに尋ねると、彼は明らかに不快感を示した。これはソフトボールの質問のような簡単なものだが、彼の反応は生々しい。Pangram の技術的なニュアンスについて語る方が、個人的な質問や同社が関与する文学界のスキャンダルについて話すよりも自然だ。
スパーロは食事の一瞬を挟んで、自分はロサンゼルスの郊外であるラ・クレセントで育ったと明かした。プログラミングに情熱を燃やし、高校のロボティクスチームに参加していた。スタンフォード大学在学中には、後の共同創業者となるブラッドリー・エミに出会っている。(エミへのインタビュー依頼をメールで何度送っても、会社の広報チームは全く無視した。)
卒業後、スパーロは Google に勤務し、FLoC という技術の開発に携わった。これは Chrome ユーザーを興味関心ごとにグループ化することで、サードパーティ製のクッキーに代わることを目指した技術だ。(しかし、プライバシーへの懸念が噴出したため、Google は 2022 年に FLoC を廃止している。)その後スパーロは自動運転車メーカーの Nuro で働き、一方エミは Tesla や AI バイオテック企業の Absci を経てきた。
2022 年に ChatGPT が登場したことで、二人は AI コンテンツが溢れる未来への対抗策としてビジネスチャンスを見出した。2023 年、彼らは Checkfor.ai を設立し、1 年後に社名を Pangram に変更した。その頃にはすでに、Originality.ai や GPTZero、Turnitin など少なくとも dozen 以上の企業が検出分野でしのぎを削っていたが、Pangram は初期の独立したテストで好成績を収め、トップランナーとしての地位を確立していた。
最も人気のある記事
インタビューが進むにつれ、スペロの返答は粘着性のあるものになり、止まったり始めたりを繰り返します。彼が食べているせいだけではありません。
私は彼の採用理念について尋ねました。スペロは「んー」と呟き、謝罪もせず食事を温めるために背を向けます。沈黙が十五秒間続きます。ようやく彼が私の方を向き、「平均的な人がパングラムにいるのは、このミッションに心から関心を持っているからです」と言いました。
AI の検出において、パングラムは「合成ミラーリング」と呼ばれる手法を使用しています。これは人間の文章を取得し、LLM(大規模言語モデル)にその近い模倣を生成させることで、AI がどのように書くかを学習させます。また、「ハードネガティブマイニング」も活用しており、誤検知(偽陽性)を検出するためにデータセットを検索します。これらを合成ミラーリングしてトレーニングセットを拡張し、失敗を通じて機械を再訓練します。
「すべてのデータセットは適切にライセンスを取得しています。これは現在の AI 業界では珍しいことだと思います」とスペロは語ります。ただし、パングラムの製品が ChatGPT や Claude に比べてデータをそれほど必要としないことも理由の一つです。「AI 企業を完全に悪者にしたいわけではありませんが、彼らは特にクリエイティブの世界で多くの信頼を失ったと思います」と彼は付け加えます。
現在、パングラムは教育、法曹界、採用など複数の業界に対応していますが、トレーニングテキストの最大セグメントを占めているのは創作ライティングです。
「おとなしい少女」の物語が、Pangram を世に知らしめるきっかけとなりました。Spero 氏はすでに自身の SNS で AI による執筆を疑う投稿を繰り返しており、1 月に Reddit の投稿で彼の名前がタグ付けされ、Ballard 氏の原稿の PDF が送られてきたこと自体は驚きではありませんでした。「Pangram に読み込ませて投稿しました。その後、ニューヨーク・タイムズからコメントを求められました」と Spero 氏は語っています。「私は、この物語における Pangram の重要性が過大評価されていると思います」とも述べています。
しかし、実際の流れはそう単純ではありません。AI スキャンダルを巡る「伝言ゲーム」のように、Pangram の担当者が出版業界の分析家に話をし、その分析家がニューヨーク・タイムズに持ち込んだという経緯でした。
さらに興味深い転換点があります。Pangram に対する批判者たち、特に調査プロジェクト『The Drey Dossier』は、Spero 氏が入手した原稿が海賊版サイトからのものであると指摘しました。この件について Spero 氏に尋ねると、「ああ、そうだ。でも、まあ、そういうものだね。詳しくは見ていなかったし、PDF の全文を読んだわけでもない。ただ、そのまま Pangram に読み込ませただけだ」と答えています。
以来、Pangram は controversy(論争)を避けてきたわけではありません。Commonwealth Short Story Prize の受賞作が Pangram による高いスコアを示した際、同社は 2012 年以降のすべての受賞作品を分析し、さらに 3 つの潜在的な AI 利用事例を指摘しました。
それでも Spero 氏は、Pangram がキャンセルされた書籍契約に与えた影響については過小評価しています。「私の知る限り、書籍契約において Pangram のスコアが主要な要因となったことはなく、単なる一部に過ぎません」と彼は語ります。「確かにその要素はありますが、関係者に話を聞けばわかるように、これは全体像のごく一部でしかありません。」
次に、Pangram の Substack 統合について触れましょう。Spero 氏は「作品の価値が AI によって書かれたことを隠すことに依存しているなら、それは問題になります」と述べました。彼は途中で言葉を濁し、「どう表現しようか…」と一瞬立ち止まります。「ああ、先日の発言を思い出しました」と自信を取り戻し、語調が高まります。
(後で気づいたのですが、彼のイントネーションが変わったのは、X 上の自身の投稿 quoting his own post を引用していたためでした。)
-
-
-
-
-
Substack は、Pangram との提携構造の詳細や、スキャンごとに同社に支払いを行っているかどうかについては確認できないとしている。「Substack の哲学は AI に反対するものではない」とある代表者は語る。「単に、あなたが何を消費しているかを知るべきだと考えているだけだ」と。しかし、一部の著者たちは懸念を示している。ある著者は、「ボタンを一つ押すだけでキャリアが崩壊しかねない」という感覚を持っていると明かした。
出版業界は famously 遅いことで知られているが、AI への対応については特に遅れをとっているのが実情だ。それでも現実には、AI を利用する著者、出版社、エージェントの割合は増え続けている。昨年、Gotham Ghostwriters が働く作家 1,481 人を対象に実施した調査では、61% が AI ツールを使用していると回答し、7% は「AI 生成のテキストを出版したことがある」と答えている。また、Stony Brook University のコンピュータサイエンス准教授である Tuhin Chakrabarty 氏は、今年初めに Pangram を用いて 自己出版された小説 14,419 編 を分析した結果、約 20% が AI 検出スコアで顕著な数値を示すことを発見した。彼の作業論文は広く引用され、このデータが *Daggermouth* の告発の元となった。
五大出版社がAI検出ツールを利用しているか確認するため、私は取材を行いました。Simon & Schuster と HarperCollins はコメントを拒否し、Hachette と Macmillan は回答がありませんでした。一方、Penguin Random House の広報担当者は、編集者が承認された AI 検出ツールを「潜在的な AI 生成コンテンツの特定のための追加手段の一つとして利用する可能性がある」と認めつつも、「これらのツールは決定力を持つものではなく、より広範な編集プロセスの一部に過ぎない」と説明しました。
エージェントの間でも検出ツールの利用が進んでいます。表舞台で出版契約が成立する一方で、裏方では静かに契約が取り消されるケースも少なくありません。「通常、エージェントは何も語りませんが」と Friedman は指摘します。
私は Chakrabarty 氏の見解も聞いてみました。Chakrabarty 氏が Pangram の存在を知ったのは、2024 年後半に Spero の投稿を通じてのことでした。登録後、Spero から API クレジットが提供され、以来二人は「親しい友人」になったと Chakrabarty 氏は語ります。Pangram は現在も Chakrabarty 氏の研究を支援するために継続的にクレジットを提供しています。
Chakrabarty 氏は SNS で Pangram の検出結果を投稿し、同社を定期的に擁護しています。AI スキャンダルを受けて出版社と検出ツールに関する議論を行ったことも明かしました。「Pangram が事実上の最終判断を下すべきではありません」と Chakrabarty 氏は述べ、「しかし、自身の裁量と Pangram の判断を組み合わせれば、誤ることはないはずです」と付け加えました。
チャクラバルティ氏は、ニューヨークを代表する文学エージェント「Aevitas」の共同CEOであるトッド・シュスター氏と交際しています。チャクラバルティ氏がシュスター氏にパングラムとの面談を勧めたところ、「すぐに非常に役立つツールだと分かりました」とシュスター氏は語ります。「すぐに、著者たちとの間で困難な対話を始めなければならなくなりました。パングラムの分析結果では、作品のAI作成比率が50%から95%まで様々だったからです。」現在、シュスター氏は原稿や書籍提案書を分析するためにパングラムを活用しています。また、同社からの紹介役も務めており、パングラムと出版社との橋渡しを行っています。
著者たちが指摘された際、シュスター氏によると、中には防御的になったり嘘をつこうとする人もいれば、AIの使用を率直に認める人もいます。シュスター氏は、著者たちに対し、自らの声やアイデアで書き直すよう求めています。
パングラムに対する批判は、主に二つの点に集約されています。一つは誤検知による被害の深刻さ、もう一つは機械学習自体に内在するバイアスの可能性です。
エディンバラ・ネイピア大学のクリティカル AI リテラシー教授であるサム・イリングワース氏は、「AI 検出器が機能しているとは考えられない」と指摘します。「検出器には特定の層に対する偏見が組み込まれているのです」。ある研究(One study)では、非ネイティブ英語話者の作品が AI 生成と誤判定される可能性が高いことが示されました。また、神経多様性を持つ作家たちも、自身の文章パターンが不当に多く検出対象になると訴えています(なお、この研究はパングラムの登場以前のものであり、スペロ氏はこれに対抗する社内調査を挙げています)。
前述の三つの小説、『Shy Girl』、『Daggermouth』、『Call Me』は、いずれも出版業界における AI 検出スキャンダルの象徴的な事例ですが、これらすべてが有色人種の作家によって書かれた作品です(私はこれらの著者に連絡を取りましたが、二人からは回答がなく、一人は法的懸念を理由にコメントを拒否しました)。
全米文学エージェント協会会長のレジーナ・ブルックス氏は、「アフリカ系アメリカ人のエージェントとして、業界内にある不平等さに目を向ける必要があると考えています」と述べています。どの作品がスキャンされるか、誰が公的に非難されるのかというプロセスは、本質的に人間が行うものであり、バイアスに脆弱であることは避けられないのです。
Most Popular
-
-
-
-
-
ライターが自分の作品を誤って AI 生成と判定されたケースでは、Spero は「自分で書いたことを証明できれば現金報酬を支払う」という制度を導入しています。チャクラバルティ氏は「私がほぼ間違いなく相手が嘘をついていると確信している場合にこの報奨金を出します」と説明し、「あるいは、嘘ではない場合でも、私たちがその事実を知ることは非常に価値があるのです」と付け加えています。しかし現時点で、誰もこの報酬に応じた事例はないそうです。
「もちろん、Pangram を欺くことも可能です」とチャクラバルティ氏は指摘します。一部のライターは、誤検知を誘発するために文章を手動で調整したり、あえて AI 風の文体を書いたりしています。ノートルダム大学の新しいワーキングペーパー『Why AI Detection Fails for Academic Integrity』によると、Pangram の 3.2 モデルは学術抄録における軽微な AI 編集を、64% から 80% の確率で AI 作成と判定しました。しかし、AI 生成テキストを「人間化ツール(humanizer)」——AI の文章をより人間らしく見せるためのツール——に通した後は、Pangram が AI 作成と判定したのは 4% 未満にまで低下しています。
Pangram は自社のツールが、特に 100 語未満の短いテキストブロックでは精度が落ちることを明言しています。これは、同社が無料サービスで提供している 1 日あたりの利用クレジット(合計約 2,000 語)という制限を考えると、大きな課題です。実際の入力文の中央値は 350 語となっています。また、同じ文章でも、単独でスキャンする場合とより広い文脈の中でスキャンする場合では判定結果が異なる可能性もあることを同社は認めています。これは、小説からの抜粋をコピー&ペーストした際に起こり得る状況です。
Pangram は、新モデルにおいて誤検出(偽陽性)の発生率が 0.0041% にまで低下したと主張しています。これは以前の報告値である 0.01% よりも改善された数値です。Spero 氏によれば、むしろ Pangram の判定基準は保守的すぎるとさえ言えるほどです。テキストが検出の境界線上にある場合、ツールはあえて「人間による執筆」と判断する側に傾きます。「これは意図的な選択です」と Spero 氏は語ります。この方針こそが誤検出率を低く抑えている要因の一つですが、その代償として AI が生成した文章が検知されずに通過してしまうリスクが高まっています。Pangram の基準では、AI によって大幅に書き換えられた人間のエッセイでも、41.37% の確率で「人間によるもの」と判定されてしまいます。
インタビュー中、Spero 氏は自身の主張を裏付けるために複数の SNS の投稿を次々と引き出しました。それらをチャットに貼り付けたスピードがあまりにも速く、彼もまた背景で独自の AI システムを動かしているのではないかと思うほどでした。
ジャーナリストで元パングラム契約者であるロッド・ブレズラウ氏によれば、スペロは「一日中オンラインで活動している。あなたのツイートに返信し、Reddit の投稿にも返信するだろう。LinkedIn の投稿にもおそらく返信するはずだ」という。
ブレズラウ氏は今年初めにスペロに接触し、「攻撃犬」としてのサービスを提供した。AI によるコンテンツがソーシャルメディアを埋め尽くす現状にうんざりしていたからだ。パングラムでの契約業務には、同社のソーシャルメディア戦略への助言や、スペロ向けのインタビュー調整が含まれていたが、ブレズラウ氏はまた、パングラムの拡張機能を使ってインターネットをスクロールし、疑わしい AI 利用者を公然と名指しすることも行った。「より厳しいアプローチを取りたかった。なぜなら、人々があまりにも楽に逃げてしまっていると感じていたからだ」とブレズラウ氏は語る。
パングラムは戦略を変更したことが一因となり、ブレズラウ氏との契約を終了させた。同社は現在、AI 利用が「より受け入れられるようになる」と予測している。スペロ氏は、AI を使う者をただ追いかけることへの関心を失ったようだが、「欺瞞的な行為」を行うライターに対しては声を上げるという。また、パングラムは今後、軽微な編集であっても AI が使用された事例をフラグ付けできるようになると付け加えた。「それがロードマップだ」とスペロ氏は話す。「より高い粒度で、より詳細に、エンドユーザーにより多くの情報を提供していくのだ」。私が見る限り、パングラムは最終的に出版業界、学校、そして他のあらゆる分野における「独自性の裁定者」になることを目指しているようだ。
現時点で、Spero 氏のチームは元教育者や元出版関係者など少数のメンバーで構成されています(Pangram の広報担当者は、研究者が英語文学の学位を持っていることも付け加えています)。告発された著者たちから名誉毀損訴訟の兆候があるという噂もありますが、訴訟について尋ねられた Spero 氏は「まだ何かが起きたとは考えていません」と答えています。今後は Pangram のモデルやトレーニングに関する技術レポートを継続して公開する予定で、「他社はすべてブラックボックス化しているため、我々の戦略は透明性を通じて信頼を築き、可能な限りオープンになり、オンラインコミュニティと最大限に関わることです」と語っています。
会話が終わる頃、私は Spero 氏が以前ほど100% 関与しているようには見えなかったことに気づきました。むしろ、どこかよそよそしい印象でした。インタビュー中、彼はアパートの中を歩き回っていました。ラップトップを持ってリビングルームの近くに行き、次に観葉植物で溢れた窓際へ移動し、さらに別のキッチンコーナーへと移りました。その間、彼の顔がフレームから半分だけ浮き上がる場面もありました。ヘッドフォンを着けたり外したりする動作も何度か繰り返しました。モデルトレーニングについて話している最中、彼はふと軽くゲップをしてしまいました。
私はこんな展開になるとは思っていなかった。単に忙しくて疲れていたのか、私を真剣に受け取ってくれていなかったのか。それとも、メディアの報道が殺到したことでインタビューが形骸化し、あるいはうんざりするものになってしまったのだろうか。結局のところ、私が仮定することはできても、1 時間のやり取りから誰にも断定できることは限られている。
Pangram は、コミュニケーションにおけるあらゆるニュアンスや変数、未知の要素を抽出し、それを一つの数値として返すことを目指している。もちろん、人間はそれらすべてよりもはるかに曖昧なものだ。
*この記事に対するご意見を教えてください。編集者宛ての手紙を mail@wired.com までお送りください。*
-
-
Lexi Pandell 氏は、2027 年秋にチェルシー・グリーン出版から刊行予定の『Holy Mother!』の著者である。フィクションとノンフィクションの両方で、さまざまな出版物に寄稿している。現在はベイエリア在住。
続きを読む
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み