Databricks Mlflow Evaluation

MLflow 3 GenAI agent evaluation. Use when writing mlflow.genai.evaluate() code, creating @scorer functions, using built-in scorers (Guidelines, Correctness, Safety, RetrievalGroundedness), building eval datasets from traces, setting up trace ingestion and production monitoring, aligning judges with MemAlign from domain expert feedback, or running optimize_prompts() with GEPA for automated prompt improvement.

gabrielmoreira Updated 17 repo stars

File contents

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/databricks@databricks-agent-skills/skills/databricks-mlflow-evaluation commit 0b91285cb1

Frequently asked questions

npx skillmds@latest add gabrielmoreira/databricks-mlflow-evaluation