Anthropic、新モデル「Fable」を低コスト・制限緩和で公開
本文の状態
日本語全文を表示中
詳細モードで約4分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
TechCrunch AI
Anthropic は新モデル Fable と Mythos 5.1 を発表し、コスト削減と制限緩和に加え、データ流出を防ぐゼロデータ保持機能や高プライバシーの企業向けセーフガードを本格導入した。
AI深層分析を開く2026年9月2日 05:36
AI深層分析
キーポイント
新モデルの同時リリースと用途区分
Anthropic は Fable( unrestricted)と Mythos 5.1 を同時に発表し、後者はサイバーセキュリティや生命科学研究に限定された登録パートナーのみが利用可能となる。
ゼロデータ保持機能の実装
顧客が自社のインフラ上でモデルを実行し、データ流出を防止できる「ゼロデータ保持」の仕組みが導入され、セキュリティ懸念が解消された。
高プライバシーセーフガードの展開
エージェントや人間の誤用を検知する「Enterprise Frontier Safeguards」が 6 月にロールアウトされ、監視の実施方法を顧客が制御可能となる。
ベンチマーク記録と科学的発見
新モデルは CLI コーディングや一般推論のベンチマークで記録を塗り替え、GPU 最適化や金星の高解像度マップ作成といった新たな科学的知見も生成した。
Mythos 5.1の性能評価
Mythos 5.1はOpus 5に比べて全体的な不整合行動がやや後退しているが、以前のモデルよりもハルシネーションやタスクの誤認を減らした。
重要な引用
Anthropic has never trained on enterprise data without explicit permission, and never will.
Mythos is slightly more prone to it than Opus, possibly as a result of its enhanced capabilities.
"Mythos 5.1 is a slight regression on overall misaligned behavior compared to Opus 5, and an improvement over Mythos 5 and Claude Sonnet 5," the system card reads.
"It cooperates with human misuse and accepts unverifiable claims of authorization somewhat more readily than Opus 5, but it is less likely to ignore explicit constraints, hallucinate inputs, or falsely claim to have completed tasks than previous models."
編集コメントを表示
編集コメント
今回のリリースは、セキュリティと利便性の両立に向けた明確な方向性を示しており、企業利用における懸念の払拭に寄与する。特に顧客が監視プロセスを制御できる点は、実務現場での導入障壁を下げる重要な要素となるだろう。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
火曜日に Anthropic は、同社が最も高度な AI モデルの双子版である「Fable」と「Mythos 5.1」をリリースしました。性能の向上に加え、新しい Fabel リリースではトークンコストの削減と、モデルの安全装置による誤検知(偽陽性)の抑制を図る変更が加えられています。
前世代の Mythos モデルと同様に、Mythos 5.1 はサイバーセキュリティまたは生命科学の研究に従事する登録された Anthropic パートナー限定で利用可能です。一方、制限のないバージョンである Fable 5.1 は、本日よりクラウドプラットフォームを通じて、あるいは Anthropic API を介して利用可能になりました。
最も重要な変更点の一つは、Anthropic がゼロデータ保持(Zero Data Retention)を採用したことです。これにより、クライアントは自社のインフラ上で Anthropic モデルを実行し、データの外部流出を防止できるようになります。以前はセキュリティ上の懸念から Fable では提供されていなかった高プライバシーサービス「Enterprise Frontier Safeguards」が、6 月にユーザー向けに展開されます。なお、このシステムはエージェントや人間による不正利用の監視を継続しますが、監視の実施方法についてはクライアントが制御権を持ちます。
Anthropic は今回の発表(詳細はこちら)において、顧客データの不正アクセスはなかったと保証しました。発表文には「Anthropic は明示的な許可なく企業データを学習したことは一度もなく、今後もありません」と明記されています。
Anthropic のリリースでよく見られる通り、新モデルは Terminal-Bench 4.0(CLI ベースのコーディング向け)や Humanity's Last Exam(一般推論向け)など、さまざまなベンチマークで記録を塗り替えました。また、リリース前にモデルが生成した 3 つの新たな科学的発見も公開されています。これにはカスタム GPU の最適化手法や、既存の写真から組み立てた高解像度の金星地図が含まれます。
これまでのリリースと同様、各モデルには 詳細なシステムカード が添付されており、その能力を最も分かりやすい言葉で説明しています。このカードでは、AI 自身が自己改善を行う「自動 AI 開発」に関連するリスクについて、Mythos を「低リスク」と評価しています。これは一部の懸念者にとって人間による制御の喪失につながる可能性のあるトリガーと見なされていますが、カード内では「内部 AI の研究開発を加速させる能力は、現在のトレンドに沿っている」と述べています。
一般的な誤動作の観点からは、Mythos は Opus よりもわずかに発生しやすい傾向があります。これはおそらく、その強化された機能によるものと考えられます。
「Mythos 5.1 は、Opus 5 と比較すると全体的なミスマッチ行動がやや後退していますが、Mythos 5 や Claude Sonnet 5 と比べれば改善されています。システムカードにはこう記載されています。『人間による誤用に対して協調的になり、検証不可能な権限主張を Opus 5 よりも受け入れやすくなっていますが、明示的な制約を無視したり、入力に幻覚を起こしたり、タスク完了を偽って報告したりする可能性は、以前のモデルよりも低くなっています』。
当記事内のリンクを通じて購入された場合、私たちは少額のコミッションを受け取る可能性があります。ただし、これは編集の独立性には影響しません。
ラッセル・ブランドは 2012 年以来テック業界を取材しており、プラットフォームポリシーや新興技術に焦点を当てています。以前は The Verge や Rest of World で勤務し、Wired、The Awl、MIT Technology Review にも寄稿しています。問い合わせ先は russell.brandom@techcrunch.com または Signal(412-401-5489)です。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み