ページを読み込み中…
ページを読み込み中…
7件の記事
LangChain が、エージェントの評価を一元化するための新しいプラットフォーム「Harbor」との連携を発表し、開発者がエージェントのパフォーマンスを効率的に検証できる環境を提供する。
Vercel は、サポート対応からコード作成まであらゆる作業を担うエージェントが動作するために必要な、モデル間のルーティング、多段階ワークフローの実行、および外部システムとの接続という 3 つのコア機能について解説した。
AWS は、生産環境で動作する AI エージェントが失敗した際の理由特定を自動化し、手動診断によるボトルネックを解消する「Strands Evals」の評価手法を発表しました。
開発チームは、プロンプトエンジニアリングの効率化を目的とした「Promptim」という実験的なPythonライブラリを公開した。このツールは、AIモデルへの指示文(プロンプト)の品質と結果を自動的に最適化する機能を提供し、開発者の作業負担軽減に寄与する。
monday Serviceが、顧客対応サービスエージェント向けに評価主導の開発フレームワークを構築した方法を紹介。
ジェネラティブエージェンツが、プロンプト最適化機能を持つLLM Opsプラットフォーム「LangWatch」をテーマにした勉強会を開催した。