Validate Evaluator

hamelsmu/evals-skills/skills/validate-evaluator

作者 hamelsmu22418da2bfb159f28a1b0dcf64e969e14ae56c99无许可证1.6K 个星标收录于 2026年10月9日更新于 2026年10月9日仓库7周前更新

Calibrate an LLM judge against human labels using data splits, TPR/TNR, and bias correction. Use after writing a judge prompt (write-judge-prompt) when you need to verify alignment before trusting its outputs. Do NOT use for code-based evaluators (those are deterministic; test with standard unit tests).

已归档仅含说明AI & Agents
  1. 22418da2bfb159f28a1b0dcf64e969e14ae56c99当前提交 22418da发布于 2026年10月9日

来源与署名

来源:hamelsmu/evals-skills位于skills/validate-evaluator提交22418da

许可证: 无许可证

内容归原作者所有。SourceWeft 从公开仓库中收录这些内容。

举报或申请下架