Adk Eval Guide

Use when evaluating ADK agents, running adk eval, writing evalsets, configuring eval metrics, or debugging evaluation results. Covers all 8 criteria (tool_trajectory_avg_score, response_match_score, final_response_match_v2, rubric_based_final_response_quality_v1, rubric_based_tool_use_quality_v1, hallucinations_v1, safety_v1, per_turn_user_simulator_quality_v1), eval schema, LLM-as-judge configuration, user simulation, multimodal evaluation, and common eval failure causes.

kumaran-is 2559e4e 5 files · 24.0 KB Updated

File contents

kumaran-is/claude-code-onboarding/tree/main/.claude/skills/adk-eval-guide commit 2559e4e710

Frequently asked questions

npx skillmds@latest add kumaran-is/adk-eval-guide