Base44 が Claude Fable 5 を採用
本文の状態
日本語全文を表示中
詳細モードで約6分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
Claude Blog
Base44 は、複雑なシステムプロンプトの再構築やネイティブモバイルインフラの変更など、従来は最上級エンジニアにしか任せていなかった高難易度の工程を、Claude Fable 5 の推論能力と効率性によって可能にしたと発表した。
AI深層分析を開く2026年7月30日 17:18
AI深層分析
キーポイント
Base44 の製品特性と課題
技術的スキルがなくてもフルスタックアプリやサイトを構築できる「vibe-coding」プラットフォームだが、コア機能の変更には従来のモデルでは不十分な推論能力がボトルネックとなっていた。
Claude Fable 5 の性能評価
同社によると、Claude Fable 5 はソフトウェア構築の理解に基づいた推論が可能であり、エラー発生時に近隣のみを修正するのではなくコード全体を検索して解決策を見つけることができる。
実証された工程の自動化
最上級エンジニアにしか任せていなかったシステムプロンプトの再構築作業を、Claude Fable 5 に委ねた結果、4 時間の独自実行で必要な成果の 90% から 95% を達成し、同日中に A/B テストを通じて実装した。
評価プロセスと成果
Latency(遅延)、コスト、ビルドエラー、ゲーム物理挙動のシミュレーションなど多角的な評価を経て、Claude Fable 5 は少ないターン数でより完全なアプリを生成できることが確認された。
モデルによる評価の盲点発見と修正
Claude Fable 5 はキャッシュヒットのテスト不足という自社の評価における盲点を指摘し、コスト増につながるリスクを修正した。
重要な引用
The decision on what to do next is a crucial one and most of time [earlier] models would take, I would say, a naive approach
Claude Fable 5 was the first model the team tested that could reason as if it had an understanding of how software is built
"This reasoning of 'this probably has been solved somewhere else, so I should go there to investigate' is something we haven't seen so often in other models," Orlev says.
"Fable has given us the confidence to make bolder moves with the business."
編集コメントを表示
編集コメント
Claude Fable 5 がシステムプロンプトの再構築という専門的かつ重要な工程を自律的に完了させた事実は、AI の推論能力が実務レベルで決定的な転換点に達したことを示唆している。Base44 の事例は、将来的にはエンジニアリングのボトルネックが人的スキルから AI モデルの性能評価へとシフトする可能性を示す重要なケーススタディである。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。
Base44 は、技術的なスキルに関係なく、誰でもフルスタックのアプリケーションやウェブサイトを作成できる「バイブコーディング」プラットフォームです。利用者は、開発者を抱えていない小規模企業から、SaaS プロダクトの開発に同社を活用している大企業まで多岐にわたります。
Base44 の創設メンバーであり、現在はプロダクト部門を率いる Yoav Orlev 氏にとって、仕事のやりがいを感じる最大の瞬間の一つは、時間や予算、あるいはノウハウが不足していた小規模企業が、このプラットフォームを使って何を実現できるかを目の当たりにすることです。デジタル店舗の構築から、飲食店のスタッフ向けシフト管理アプリの開発まで、その可能性は広範囲に及びます。彼のチームのミッションは、製品の機能を不断に拡張しつつも、誰もが使い続けられるように保つことにあります。
Base44 のプロダクトおよびエンジニアリングチームは常に迅速に動き、特に小規模から中規模のスコープを持つ機能の実装においては顕著です。しかし、相互依存する複数の部分に影響を及ぼすプラットフォームのコア部分への改変については、最も経験豊富なエンジニアにしか任せることができませんでした。
その典型的なボトルネックの一つが、システムプロンプトとその数百のバリエーションでした。これは、ユーザーが初めてアプリを作成するのか 5 つ目なのか、無料利用者とサブスクライバーのどちらか、そして構築中のアプリのカテゴリーや機能によって細かく異なります。もう一つの課題は、ネイティブモバイルインフラの変更でした。これにはモバイル分野に特化したエンジニアでなければ対応できませんでした。
2025 年初めにリリースされた Base44 のアプリ生成エンジンを支えてきた過去の Claude モデルでは、この重要な作業を任せるにはまだ不安がありました。Orlev 氏によれば、モデルがエラーに直面して行き詰まると、既存のコード内に解決策が存在する可能性に気づかず、同じ箇所での修正を試行し続ける傾向があったといいます。
「次に何をすべきかの判断は極めて重要ですが、過去のモデルは多くの場合、私が見る限り非常に素朴なアプローチを取っていました」と Orlev 氏は語ります。
Orlev 氏によると、Claude Fable 5 は初めて、ソフトウェアがどのように構築されるかを理解しているかのように推論できるモデルとしてチームにテストされました。
最も複雑な製品開発とエンジニアリング業務への信頼
Base44 では、新しい Claude モデルをさまざまな種類のアプリで評価し、レイテンシ、コスト、ビルドエラーの発生率などを測定しています。また、Minecraft のクローンを作成するなどのテストを通じて、モデルがゲームの物理演算やメカニクスをどのように処理できるかも検証します。
Claude Fable 5 では、2 つの点が際立っていました。まず、タスク完了までのターン数が大幅に減少した点です。そして、最初のプロンプトからより完成度の高いアプリを構築し、以前のモデルが見過ごしていたエッジケースにも対応できた点です。
チームは、これまで最上級エンジニアにしか任せていなかったタスクに Claude Fable 5 を投入しました。それは Base44 のシステムプロンプトの再構築です。約1時間のやり取りの後、Claude Fable 5 は約4時間にわたり自律的に作業を続け、必要な内容の90%から95%を完成させて返してきました。A/B テストインフラを活用したチームは、その日の午後にはこれらの変更を計測し、本番環境へリリースすることができました。
Claude Fable 5 が動作している間、Base44 の独自評価(evals)に抜け穴があることも発見しました。プロンプトの変更がキャッシュのヒット率に影響を与える可能性があり、数百万人のユーザー規模でそれが発生すればコスト増につながるにもかかわらず、チームはキャッシュヒットに関するテストを行っていなかったのです。モデルが盲点を指摘し、自ら修正を加えた形です。
また、Base44 のアプリ内エージェントを支えるハーン(harness)の変更で Claude Fable 5 が行き詰まった際、コードベースの他の場所で同様の問題解決策が見つかったはずだと推論し、該当箇所を調査して修正を導き出しました。Orlev はこう語ります。「『おそらくどこかで既に解決されているから、そこを調べてみよう』という推論プロセスは、他モデルではあまり見られない特徴です」。
Orlev によれば、Claude Fable 5 との協働は上級エンジニアと働くのに似ています。若手エンジニアには手順を細かく指示し、常に確認が必要ですが、上級者であれば目標とその背景にある理由(なぜそうするのか)さえ伝えれば十分なのです。
こうした取り組みはエンジニアチームに限った話ではありません。あるプロダクトマネージャーが、ネイティブモバイルアプリの構築を Base44 社内で行えるようにしたいと考えた際、Claude Fable 5 に任せてみたところ、約 2 時間半で本番環境への移行に必要な機能の 90% が整った開発環境が完成しました。
Claude Fable 5 の登場以前は、こうした作業は Base44 を支えるトップエンジニア 3 名か、専門家の空きを待つ必要がありました。現在は、モデルがタスクを実行し、Orlev 率いるチームがそのコードを検証・テスト・承認した上でリリースする体制になっています。

Claude Fable 5 は、Base44 のプロダクト・エンジニアリング・デザインチームに自信を与え、Sugeragents プラットフォームのより野心的な部分の開発を可能にしています。
次のステップ
Claude モデルの能力が向上するにつれ、Base44 チームが目指すプラットフォームの目標も進化しています。同社は、単にアプリを構築するツールから、構築したものを管理・成長させる支援をするプラットフォームへと進化させることを目指しています。現在公開されている Base44 Superagents は、これらのアプリを中心にワークフローを実行します。
複雑なタスクでも Fable 5 を信頼できることが分かっているため、Orlev は現在はプロダクトマネージャーやデザイナーに対し、以前は何かを壊す恐れから手を出せなかったプラットフォームの一部も積極的に構築するよう促しています。
「Fable は、事業においてより大胆な決断を下すための自信を与えてくれました」とオルレフは語ります。「製品をこれまで我々が恐れていた領域や可能性へと、全く新しい段階へと押し上げているのです。」
Claude Fable 5 で早速始めましょう。
AI算出
導入事例ainew評価高い
記事は AI モデルの性能評価や実装知見に焦点を当てており、AI 関連性は極めて高い。Base44 の具体的な導入事例と数値データ(ターン数減少、90-95% 完成度など)が含まれるため新規性も高いが、単一企業の事例報告という性質上、顧客事例として分類される。
6つの評価軸を見る
- AI関連度
- 100
- 情報源の信頼性
- 100
- 新規性
- 75
- 調べる価値
- 100
- 重複の少なさ
- 100
- 日本での有用性
- 25
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み