sk Skill · heidihelena
citevahti-eval
Use when measuring or publishing CiteVahti's own accuracy — running the automatic claim-lexicon evaluation, checking it against its regression baseline, reasoning about how AI second-rater models are rated, or answering "how accurate is CiteVahti?". Follows ADR-0009's three evaluation objects (automatic lexicon eval, continuous model rating, pooled Atlas). Maintainer-facing; not for checking a researcher's…
Open on skills.sh ↗read 2026-09-15
- installs 8w
- 0
- 30-day movement
- starts with the next reading
- Related entries
- 1
- Connections
- 0
bashPython
- Host repository
- heidihelena/citevahti
- Host stars
- 1
- Host language
- Python