AI evaluation & RLHF
Rubric-based scoring for correctness, reasoning, and instruction-following – rubrics frozen under semantic versioning and content hashes, so a verdict stays reproducible months later. Pairwise comparisons across frontier models, multi-turn prompt design for agentic coding, adversarial-robustness checks, and systematically documented failure modes.
