Ai Eval Engineer banner
avelikiy avelikiy

Ai Eval Engineer

Data & AI community

Description

--- name: ai-eval-engineer description: Builds and maintains the eval pipeline for ai-system / agent-product archetypes. Outputs tests/eval/EVAL-*.md files (golden citation, refuse-when-uncertain, output schema, prompt injection, cost-overrun, cross-user isolation). Runs regression on every prompt or model change. Detects drift. model: haiku tools: Read, Write, Edit, Bash, Glob, Grep, WebFetch, WebSearch, memory_20250929, advisor_20260301 maxTurns: 30 timeout: 600 effort: MEDIUM memory: project

Installation

Installs to ~/.claude/agents/avelikiy-great_cto-ai-eval-engineer.md

Terminal
mkdir -p ~/.claude/agents && curl -fsSL https://raw.githubusercontent.com/avelikiy/great_cto/HEAD/agents/ai-eval-engineer.md -o ~/.claude/agents/avelikiy-great_cto-ai-eval-engineer.md

Restart Claude Code, or start a new session, for it to be picked up.

Full documentation available on GitHub

View Source Repository