Skill Comply

作者 affaan-mef648e01899b無授權條款275K 個星標收錄於 2026年10月8日更新於 2026年10月8日儲存庫3 天前更新

スキル、ルール、エージェント定義が実際に遵守されているかを可視化する——3種類のプロンプト厳格度レベルのシナリオを自動生成し、エージェントを実行し、動作シーケンスを分類し、完全なツール呼び出しタイムラインの遵守率をレポートする

僅含說明AI & Agents
AI 產生的概覽

衡量編碼代理是否真正遵守技能、規則或代理定義,並回報遵守率。

功能
從任意 .md 檔案自動產生預期行為規格,並建立三種提示嚴格度(支持、中立、競爭)的情境。它會執行代理、取得工具呼叫軌跡,使用 LLM 將呼叫歸類到規格步驟,並以確定性方式檢查順序。最後產出自包含報告,內含規格、提示、各情境遵守分數與工具呼叫時間軸。
適用情境
用於檢查技能、規則或代理定義是否真正被遵守,特別適合在新增規則或技能之後,或作為定期品質維護的一部分。也適用於回答某條規則是否真的被遵守的問題。
執行需求
需要 uv Python 執行器與支援 stream-json 輸出的 claude CLI,以及用於產生與分類的模型存取權限。SKILL.md 記錄了 uv run python -m scripts.run 等指令,但此技能未附帶任何指令碼。

skill-comply:自動化された遵守測定

コーディングエージェントがスキル、ルール、またはエージェント定義を実際に遵守しているかを以下の方法で測定する:

  1. 任意の .md ファイルから期待される動作シーケンス(仕様)を自動生成する
  2. プロンプトの厳格度が段階的に低下するシナリオを自動生成する(支持的 → 中立的 → 競合的)
  3. claude -p を実行し、stream-json 経由でツール呼び出しトレースを取得する
  4. 正規表現ではなくLLMを使用してツール呼び出しを仕様ステップに分類する
  5. 決定論的に時系列順を確認する
  6. 仕様、プロンプト、タイムラインを含む自己完結型レポートを生成する

サポートされるターゲット

  • スキル(skills/*/SKILL.md):検索優先、TDDガイドなどのワークフロースキル
  • ルール(rules/common/*.md):testing.md、security.md、git-workflow.md などの強制的なルール
  • エージェント定義(agents/*.md):エージェントが期待される場面で呼び出されるか(内部ワークフロー検証は未サポート)

起動条件

  • ユーザーが /skill-comply <path> を実行する
  • ユーザーが「このルールは本当に遵守されているか?」と尋ねる
  • 新しいルール/スキルを追加した後、エージェントの遵守を確認する
  • 品質メンテナンスの一環として定期的に実行する

使い方

bash
# Full runuv run python -m scripts.run ~/.claude/rules/common/testing.md
# Dry run (no cost, spec + scenarios only)uv run python -m scripts.run --dry-run ~/.claude/skills/search-first/SKILL.md
# Custom modelsuv run python -m scripts.run --gen-model haiku --model sonnet <path>

重要なコンセプト:プロンプト独立性

プロンプトが明示的にサポートしていない場合でも、スキル/ルールが遵守されるかどうかを測定する。

レポートの内容

レポートは自己完結型で、以下を含む:

  1. 期待される動作シーケンス(自動生成された仕様)
  2. シナリオプロンプト(各厳格度レベルで尋ねる内容)
  3. 各シナリオの遵守スコア
  4. LLM分類ラベル付きのツール呼び出しタイムライン

高度な内容(オプション)

フックに精通したユーザー向けに、レポートには遵守率が低いステップに対するフック強化の推奨事項も含まれる。これは参考情報——主要な価値は遵守性自体の可視化にある。

來源與署名

來源:affaan-m/ecc位於docs/ja-JP/skills/skill-comply提交ef648e0

授權條款: 無授權條款

內容歸原作者所有。SourceWeft 從公開儲存庫中收錄這些內容。

檢舉或申請下架