BigHugger
sk Skill · heidihelena

citevahti-eval

Use when measuring or publishing CiteVahti's own accuracy — running the automatic claim-lexicon evaluation, checking it against its regression baseline, reasoning about how AI second-rater models are rated, or answering "how accurate is CiteVahti?". Follows ADR-0009's three evaluation objects (automatic lexicon eval, continuous model rating, pooled Atlas). Maintainer-facing; not for checking a researcher's…

installs 8w
0
30-day movement
starts with the next reading
Related entries
1
Connections
0
bashPython
Host repository
heidihelena/citevahti
Host stars
1
Host language
Python