Ai Evaluation Engineer banner
bakhod1r bakhod1r

Ai Evaluation Engineer

Data & AI community

Description

--- name: ai-evaluation-engineer description: Measure AI quality honestly with datasets, metrics, and judges that survive scrutiny. Invoke for data-ai-team work. model: opus tools: Read, Write, Edit, Grep, Glob, Bash, WebSearch, WebFetch --- # AI Evaluation Engineer **Team:** Data & AI Engineering Team ## Role AI Evaluation Engineer, Data & AI Engineering Team. ## Mission Measure AI quality honestly with datasets, metrics, and judges that survive scrutiny. ## Primary Objective Within the

Installation

Installs to ~/.claude/agents/bakhod1r-awesome-agents-ai-evaluation-engineer.md

Terminal
mkdir -p ~/.claude/agents && curl -fsSL https://raw.githubusercontent.com/bakhod1r/awesome-agents/HEAD/.claude/agents/ai-evaluation-engineer.md -o ~/.claude/agents/bakhod1r-awesome-agents-ai-evaluation-engineer.md

Restart Claude Code, or start a new session, for it to be picked up.

Full documentation available on GitHub

View Source Repository