VrtxOmega/veritas-agent-trust-lab
GitHub: VrtxOmega/veritas-agent-trust-lab
一个零注册的 AI agent 信任保障公开实验室,通过六项盲测挑战展示 agent 操作的可计算、防重放、可撤销的保障边界。
Stars: 0 | Forks: 0
# VERITAS Omega Agent Trust 实验室
一个零注册的公开参考演示器,用于展示 AI-agent 评估与重大操作之间的保障边界。
[打开实时 Trust Lab](https://vrtxomega.github.io/veritas-agent-trust-lab/)
访问者首先在一个固定的三项正常/三项篡改的挑战中,做出六个盲测的允许/拦截判断。只有在所有标签都在本地密封之后,网站才会揭示确定性的结果、原因代码和评分。除非参与者明确下载或提交公开的 GitHub issue,否则标签将保留在浏览器中。
此可探索的实验室涵盖:
1. 伪造的衍生判定;
2. 精确操作参数替换;
3. 一次性 nonce 重放;
4. 关联的评估者仲裁;
5. 删除反驳证据;
6. 心跳过期后的静默监控。
## 运行和验证
```
npm ci
npm test
```
Node 测试套件和浏览器使用 `lib/trust-engine.js` 中的同一引擎。
`npm run build:pages` 将已构建的 Vinext 输出转换为公开的 GitHub Pages artifact,并为仓库路径重写资源引用。
部署工作流在发布之前会重新运行 lint 和所有测试。
## 精确声明边界
这些测试在合成的、作者设计的 fixture 上证明了:
- 每个正常的 fixture 都通过了其声明的本地边界;
- 每个被篡改的 fixture 都会被拦截或撤销;
- 更改操作参数会破坏精确绑定;
- 重放的 nonce 会失败;
- 关联的评估者无法满足双独立来源仲裁;
- 移除证据会更改密封证据的身份标识;
- 过期的监控会撤销生命周期;
- 每个结果都将 `execution_authorized` 固定为 `false`。
此浏览器实验室并非完整的 VERITAS Omega V4 内核。它不签发加密签名、确立事实真相、执行外部策略、授权 agent、为系统提供认证,也不构成独立的安全审计。在外部参与者制作并贡献标签且未暴露答案的情况下,其标签不具备独立性。
独立的 V4 实现和 VERITAS Codex Gate 不包含在内。此仓库的 MIT 许可证仅适用于此公开演示器。
## 创始试点
该网站提供了一个有边界的 **$750 创始 Agent 操作保障试点**:
一个工作流,最多五项重大操作,一个证据/风险/操作 schema,六个量身定制的恶意案例,一个可重放的 packet,一个残余风险登记册,以及 60 分钟的演示讲解。
这是一个作者方的技术试点——不是认证、合规或独立审计。联系 `VrtxOmega@pm.me`。
## 主要背景
- [NIST AI Agent 标准倡议](https://www.nist.gov/artificial-intelligence/ai-agent-standards-initiative)
- [OpenAI:安全运行 Codex](https://openai.com/index/running-codex-safely/)
- [面向 AI agent 的 Microsoft 开源信任栈](https://devblogs.microsoft.com/foundry/build-2026-open-trust-stack-ai-agents/)
- [Open Policy Agent](https://www.openpolicyagent.org/docs/latest/)
这些组织并不为 VERITAS 背书。
标签:AI安全, Chat Copilot, GNU通用公共许可证, MITM代理, Node.js, 前端实验工具, 数据可视化, 智能体信任评估, 暗色界面, 自动化攻击, 防篡改检测