本文へスキップ
← ニュース一覧
MLflow Blog2026年2月24日

マルチターン評価とシミュレーション:チャットボット向けMLflowによるAI可観測性の強化

英語原文から AI が翻訳しました。 英語版を見る

要約

MLflow 3.10は、マルチターン評価と会話シミュレーションをサポートし、完全な会話のスコアリングとエージェント変更の再現可能なテストを可能にします。これにより、複数ターンにわたってのみ発生する障害を捕捉し、チャットボットの可観測性を向上させます。

MLflow 3.10では、マルチターン評価と会話シミュレーションが導入され、会話全体をスコアリングしたり、再現可能なシナリオでエージェントの変更をテストしたり、複数ターンにわたってのみ表面化する障害を捕捉したりできるようになります。

関連記事

News

JevはLLM judgeの代わりになるか? パート2:より難しい回答のテスト

mlflow-blog7d ago
News

JevはLLM judgeの代わりになるか?品質、コスト、レイテンシを評価

mlflow-blog10d ago
News

MLflowによるAIエージェントスキルの評価と改善

mlflow-blogAug 2026
News

レビューキュー:より優れたAIに向けた人間のステップ

mlflow-blogJul 2026