Zum Inhalt springen
← Alle News
MLflow Blog29. Januar 2026

Einführung von DeepEval-, RAGAS- und Phoenix-Judges in MLflow

Von KI aus dem englischen Original übersetzt. Auf Englisch ansehen

Zusammenfassung

MLflow hat über 50 LLM-as-a-judge-Metriken von DeepEval, RAGAS und Arize Phoenix direkt in die MLflow Scorer API integriert. Anwender können diese Bewertungen von Drittanbietern nun zusammen mit nativen MLflow judges in einem einzigen API-Aufruf und einer einheitlichen visuellen Benutzeroberfläche ausführen und vergleichen, um RAG-Pipelines und Agents zu debuggen und zu bewerten.

Verbessern Sie Ihre Agents mit der umfangreichen, branchenführenden Suite hochwertiger LLM judges von MLflow.

Ähnliche Artikel

News

Kann Jev Ihren LLM judge ersetzen? Teil 2: Testen schwierigerer Antworten

mlflow-blog7d ago
News

Kann Jev Ihren LLM judge ersetzen? Evaluation von Qualität, Kosten und Latenz

mlflow-blog10d ago
News

Bewertung und Verbesserung von KI-Agenten-Fähigkeiten mit MLflow

mlflow-blogAug 2026
News

Review-Warteschlangen: Der menschliche Schritt zu besserer KI

mlflow-blogJul 2026