omonuj/claude-horizon-skills

GitHub: omonuj/claude-horizon-skills

一套用于构建、红蓝对抗测试和调优 Agentic RL 评估环境的 Claude Code Agent Skills 库,通过四技能细分模式实现诊断优先、最小杠杆调节和对抗性自我审查。

Stars: 0 | Forks: 0

# Claude Horizon Skills 这是一个用于构建、红蓝对抗测试和调整 Agentic RL 评估环境的 **Claude Code Agent Skills** 库——也就是 AI agent 被投入并进行评分的容器化 SRE/DevOps 场景。 本仓库关注的是*技能的工程设计方式*,而不是任务本身。每项技能都是一个带有 YAML frontmatter 的 markdown 文件,由 Claude Code 按需加载:这是一个命名且自包含的流程,其中包含了决策表、失败→原因→修复映射,以及对 agent 可以和不可以更改的内容的明确护栏。 ## 模式 不同于使用一个巨大的 prompt,每个环境会配备四个细分的技能以及一个共享的 reviewer。它们会相互调用,因此 agent 只会加载当前阶段所需的上下文。 | 技能 | 职责 | | --- | --- | | `*-task-guardian` | 端到端负责人。负责推送前安全检查、本地质量/结构门控、推送、验证交接、rollout 监控。在出现问题时向下委派。 | | `*-validation-debugger` | 仅负责诊断。将观察到的验证日志模式映射到根本原因和*最小的安全修复*。在进行任何编辑**之前**被调用,从而避免靠猜测来修复故障。 | | `*-score-tuner` | 难度调整。诊断分数回归——无效子分数、方差崩塌、相关联的维度——并针对每种症状选择一个最小的调节杠杆。 | | `*-iteration-loop` | 协调器。驱动 推送 → 验证 → 红队测试 → 度量 → 调整 的循环,直到环境收敛,并在正确的阶段委派给上述三个技能。 | | `horizon-agentic-reviewer` | 对抗性红队。启动一个实时容器,以 agent 用户的身份进行探测,并运行 24 项检查清单(20 项实时探测 + 4 项统计探测),搜寻未披露的要求、信息泄露、无效评分和损坏的证据链。 | 三个核心理念完成了大部分工作: - **编辑前先诊断。** debugger 技能是 tuner 前面的硬门控。每个已知的失败字符串都有记录在案的根本原因和有限的修复方案,因此循环会收敛而不是震荡。 - **最小的安全杠杆。** 调整技能禁止叠加新机制;每种症状都映射到一个单一的变更,并明确列出*不允许*的编辑列表,因为它们会导致度量崩塌。 - **对抗性自我审查。** reviewer 技能会假设设置日志在撒谎,并针对实时系统进行验证——访问真实的 API,exec 进入真实的 container,绝不盲目信任声明。 ## 布局 ``` skills/ fanout-cve-rollout/ # reward-shaped: 5 independent subscores, dense partial-credit gradient maddy-delivery-split-brain/ # mail-delivery split-brain; delivery vs observability axes oncall-schedule-coverage-collapse/ # on-call rota collapse; coverage vs monitoring axes variation-fanout-pipeline-break/ # mTLS pipeline break; handshake vs trust-governance axes variation-istio-split-brain/ # service-mesh split-brain; routing vs mesh-governance axes _archived-fanout-ring-restoration/ # an earlier, pre-`SKILL.md` generation, kept for contrast QC-SPEC.md # the priority-ordered quality rubric every skill is written against ``` 每个技能都位于其独立的目录中,表现为 `SKILL.md` 文件,并包含 `name` 和 `description` frontmatter——这是标准的 Claude Code 格式。归档的技能集早于这种布局,以扁平文件的形式存储。 ## 使用方法 技能会从工作区的 `.claude/skills/` 目录中被提取: ``` mkdir -p /path/to/project/.claude/skills cp -R skills/variation-istio-split-brain/. /path/to/project/.claude/skills/ ``` 随后,Claude Code 会通过名称(如 `/istio-task-guardian`)展示它们,或者由 iteration loop 自行驱动整个周期。 ## 质量准则 [QC-SPEC.md](QC-SPEC.md) 是所有这些设计所遵循的优先级排序规范(Critical → Error → Legitimacy)。Critical 和 Error 项被视为硬性约束——不使用二元评分,不使用增量奖励,不将功能测试作为子分数,保证真实的子分数方差,权重相等,没有无效项。tuner 技能所做的大部分工作都是在底层难度发生变化时捍卫这些属性。 ## 关于脱敏的说明 这些技能是为实时评估环境编写的。任务标识符、目标分数阈值、内部模型代号、隐藏的评分检查名称,以及 agent 必须发现的特定隐藏产物,都已被替换为占位符(``、``、``、``、``、``)。其工程设计——结构、推理、决策表、护栏——均保持完整且未经编辑。
标签:AI智能体, DLL 劫持, LLM评估, Ollama, 代码生成, 大语言模型, 强化学习, 渗透测试工具, 请求拦截, 防御加固