Validate Evaluator

hamelsmu/evals-skills/skills/validate-evaluator

作者 hamelsmu22418da2bfb159f28a1b0dcf64e969e14ae56c99無授權條款1.6K 個星標收錄於 2026年10月9日更新於 2026年10月9日儲存庫7 週前更新

Calibrate an LLM judge against human labels using data splits, TPR/TNR, and bias correction. Use after writing a judge prompt (write-judge-prompt) when you need to verify alignment before trusting its outputs. Do NOT use for code-based evaluators (those are deterministic; test with standard unit tests).

已封存僅含說明AI & Agents

僅公開檔案列表。將技能安裝到工作區後即可檢視檔案內容。

路徑大小類型
SKILL.md8.7 KBtext/markdown

來源與署名

來源:hamelsmu/evals-skills位於skills/validate-evaluator提交22418da

授權條款: 無授權條款

內容歸原作者所有。SourceWeft 從公開儲存庫中收錄這些內容。

檢舉或申請下架