動画記事 · AI Engineer
コンテキストエンジンでマージ可能なコード生成法 — ピーター・ウェリー氏(アンブラクド)
動画の文字起こしと公開情報をもとにAIで要約・構成しています。 正確な発言は元動画と時間位置で確認してください。
まず要点
AI エージェントの文脈喪失問題を解決するため、組織の暗黙知や決定履歴を構造化して提供する「コンテキストエンジン」の概念と実装デモを紹介する。
AI エージェントが「新人の悩み」を解決する:組織文脈を理解する「コンテキストエンジン」の実践
AI エージェントの実用化において、単なるコード生成能力だけでなく、組織固有の文脈(コンテキスト)を理解する仕組みが不可欠であるという認識が広がっています。アンブラクド(Unblocked)のピーター・ウェリー氏は、従来の検索手法や Wiki への依存が「検索満足度」という落とし穴を招くリスクを指摘し、Slack やアーキテクチャドキュメントなどを統合した「コンテキストエンジン」の実証デモを通じて、その解決策を示しました。
エージェントは「新人」同様、タスクごとに知識をリセットする
AI エージェントを導入する際、多くの組織が直面する根本的な課題があります。それは、エージェントが人間のように経験や暗黙知を蓄積せず、タスクごとに知識をリセットしてしまう点です。
「エージェントは新人の従業員のようなものです。新しいタスクが始まるたびに、コードベースやテスト方法、デプロイ手順などを再発見しなければなりません」
ピーター氏はこの状況を、「Vim の使いこなし度合いで測れる AI 成熟度の曲線」に例えて解説します。初期のオートコンプリート(GPT-3.5 時代)から Cursor への移行、そして組織 Wiki の構築に至るまで、多くの企業が「文脈の問題」を解決しようとしていますが、根本的なボトルネックは解消されていません。
エージェントが真に自律的に動作するためには、過去の決断背景やチームの慣習といった「見えない氷山の一角」を理解する必要があります。しかし、現在の主流である単純な検索や RAG(検索拡張生成)では、この深層文脈へのアクセスが困難です。
「検索満足度」の罠:初期情報で判断を停止するリスク
従来の Wiki 検索や単純な RAG アプローチには、「検索満足度(Satisfaction of Search)」という重大な欠陥があります。これは放射線科医の診断プロセスに由来する用語で、X 画像で一つの癌の兆候を見つけると、他の重要な兆候を見落として診断を完了してしまう現象を指します。
AI エージェントも同様のリスクを抱えています。
「エージェントは何か正しいと思われる情報を見つけると、そこで判断を停止してしまいます。その結果、より重要な文脈や矛盾点を見逃す危険性があるのです」
また、エージェントは情報を集めることはできても、それを統合して「理解する」ことまではできません。依存関係の相互作用やアーキテクチャの将来設計といった背景知識が欠落したままでは、誤った仮説に基づいて作業を進めてしまう可能性があります。
コンテキストエンジン:組織の意図を解きほぐす基盤
この課題に対するアンブラクドの解決策は、「コンテキストエンジン」です。これは単なるデータベースではなく、Slack の議論履歴、アーキテクチャドキュメント、過去のプルリクエスト(PR)の決定背景などを統合し、エージェントが組織の意図や制約を深く理解できる基盤を提供します。
「情報のアクセス権があることと、その情報を『理解』することは別問題です。コンテキストエンジンは、エージェントが真に重要な情報を見つけ出し、組織の文脈に沿った計画を立てられるように支援します」
このエンジンにより、エージェントはコードベースを盲目的に探索するのではなく、過去の Slack での議論や PR のコメントから「なぜその設計になったのか」という意図を読み取ることができます。これにより、不要な試行錯誤(ループ)が減り、より精度の高い計画と実装が可能になります。
デモが示す効率化:コスト削減と高精度なコード生成
ピーター氏はライブデモを通じて、コンテキストエンジン導入前後の明確な違いを実証しました。ある内部コンポーネント「Source Mark Engine」の最適化を依頼した際、以下の結果が得られました。
- Unblocked なし(従来手法): エージェントはコードを探索して推測し、約 2 分、コストも高くなる結果となりました。しかし、その計画には過去の議論や将来の可能性に関する文脈が含まれておらず、誤った仮説に基づく可能性がありました。
- Unblocked あり(コンテキストエンジン): エージェントは Slack の議論や PR 履歴から最適化のヒントを即座に取得し、約 1 分、コストもサブドル(1 ドル未満)で完了しました。さらに、その根拠となるソース(出典)を明示したため、人間が検証しやすい信頼性の高い回答となりました。
「コンテキストエンジンの真価は、短いタスクでの初期コスト削減だけではありません。探索ループの減少による『複合効果』こそが最大の価値です」
また、コードレビューエージェントにおいても同様の効果が確認されました。過去のシニアエンジニア(Richie 氏)のコメントやベストプラクティスを自動的に参照し、レビュー品質を向上させる事例も紹介されています。
まとめ:文脈理解が AI エージェント実用化の鍵
AI エージェントが組織で真に役立つためには、コードそのものだけでなく、それを巡る「人々の議論」「過去の決断」「アーキテクチャの意図」といった文脈を統合的に理解する仕組みが必要です。コンテキストエンジンは、単なる検索ツールを超え、エージェントが新人のように毎回ゼロからスタートすることを防ぎ、組織の暗黙知を活用して効率的かつ高精度なタスク実行を実現します。これが、エンタープライズレベルでの AI 導入障壁を下げる鍵となるでしょう。
Original Source
元動画で発言を確認
プレイヤーは必要になるまで読み込みません。YouTubeのCookieと通信も再生を選ぶまで開始しません。
時間位置から根拠を確認
章や引用を選ぶと、元動画をその位置から再生します。