Skip to main content
AI/MLsickn33

advanced-evaluation

This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

Stars
39,227
Source
sickn33/antigravity-awesome-skills
Updated
2026-05-30
Slug
sickn33--antigravity-awesome-skills--advanced-evaluation
View on GitHubRaw SKILL.md

// install — copy + paste into any project

mkdir -p .claude/skills && curl -fsSL https://raw.githubusercontent.com/sickn33/antigravity-awesome-skills/HEAD/plugins/antigravity-awesome-skills-claude/skills/advanced-evaluation/SKILL.md -o .claude/skills/advanced-evaluation.md

Drops the SKILL.md into .claude/skills/advanced-evaluation.md. Works with Claude Code, Cursor, and any agent that loads SKILL.md files from .claude/skills/.