Pular para o conteúdo
← Todas as notícias
MLflow Blog29 de janeiro de 2026

Apresentando os judges DeepEval, RAGAS e Phoenix no MLflow

Traduzido do original em inglês por IA. Ver em inglês

Resumo

O MLflow integrou mais de 50 métricas de LLM-as-a-judge do DeepEval, RAGAS e Arize Phoenix diretamente na MLflow Scorer API. Os profissionais agora podem executar e comparar essas avaliações de terceiros junto com os MLflow judges nativos em uma única chamada de API e interface visual unificada para depurar e avaliar pipelines RAG e agentes.

Melhore seus agentes usando o conjunto extensivo e líder do setor de LLM judges de alta qualidade do MLflow.

Artigos relacionados

News

O Jev pode substituir o seu LLM judge? Parte 2: Testando respostas mais difíceis

mlflow-blog7d ago
News

O Jev pode substituir o seu LLM judge? Avaliando qualidade, custo e latência

mlflow-blog10d ago
News

Avaliação e melhoria de habilidades de agentes de IA com MLflow

mlflow-blogAug 2026
News

Filas de revisão: o passo humano rumo a uma IA melhor

mlflow-blogJul 2026