Aller au contenu
← Toutes les actus
MLflow Blog29 janvier 2026

Présentation des judges DeepEval, RAGAS et Phoenix dans MLflow

Traduit de l'original anglais par IA. Voir en anglais

Résumé

MLflow intègre plus de 50 métriques LLM-as-a-judge provenant de DeepEval, RAGAS et Arize Phoenix directement dans l'API MLflow Scorer. Les praticiens peuvent désormais exécuter et comparer ces évaluations tierces aux côtés des MLflow judges natifs en un seul appel API et via une interface visuelle unifiée pour déboguer et évaluer les pipelines RAG et les agents.

Améliorez vos agents grâce à la suite complète et de pointe de LLM judges de haute qualité proposés par MLflow.

Articles similaires

News

Jev peut-il remplacer votre LLM judge ? Partie 2 : Test de réponses plus difficiles

mlflow-blog7d ago
News

Jev peut-il remplacer votre LLM judge ? Évaluation de la qualité, du coût et de la latence

mlflow-blog10d ago
News

Évaluation et amélioration des compétences des agents IA avec MLflow

mlflow-blogAug 2026
News

Files d'attente de révision : l'étape humaine vers une meilleure IA

mlflow-blogJul 2026