読み込み中…
読み込み中…
196件の記事
LangChain は、リポジトリの文脈と実行トレースを活用して評価(Eval)を構築するエンジニアリングスキルを発表した。これにより、AI アプリケーションの品質検証が効率化される。
LangChain は、信頼性の高いエージェント構築における「グラフ工学」の実践を 3 年間行い、モデル推論を適切な場所に配置する手法について学んだことを共有した。
企業 Apollo は、Deep Agents と LangSmith を活用して、営業・マーケティング(GTM)領域の AI 運用を成功させている。
LangChain が提供する LangSmith において、音声エージェントの動作を追跡・分析する機能を追加した。これにより開発者はエージェントの振る舞いを詳細に確認できるようになる。
LangChain がエンジン評価のための新しいベンチマーク「IssueBench」を発表した。これは開発者が AI エンジンの性能を客観的に比較・検証するためのツールである。