MohamadSanas/adversarial-agent-runtime
GitHub: MohamadSanas/adversarial-agent-runtime
一个从零构建的生产级 AI Agent 运行时,提供持久化、exactly-once 执行、崩溃恢复与 prompt injection 防御等能力,解决 Agent 在生产环境中面临的可靠性问题。
Stars: 0 | Forks: 0
# 对抗性 Agent Runtime
这是一个面向生产环境的 AI agent runtime,作为 Agentic Developer 评估的一部分从零开始构建。
目标是实现一个持久化、安全且可观测的 runtime,它能够与本地 mock LLM 进行交互,同时对故障、格式错误的输出、prompt injection、崩溃和长时间的对话保持弹性。
## 目标
- 在不使用 agent 框架的情况下构建 agent runtime
- 通过受控的 runtime 支持 tool 执行
- 保证对不可逆 side effect 的 exactly-once 执行
- 持久化执行状态以实现崩溃恢复
- 在固定的 token 预算内管理上下文
- 防御 prompt injection 和不安全的 tool 使用
- 生成可重放(replay)的执行 trace
- 包含具有对抗性测试用例的评估套件
## 功能
- Agent 执行循环
- 基于 SQLite 的 event sourcing
- 崩溃恢复与恢复执行支持
- 从已记录的 event 中重放(replay)
- 上下文压缩(compaction)
- Token 与步骤预算控制
- 安全的 tool 执行
- 结构化 JSONL tracing
- 评估框架
## 项目结构
```
agent/
├── main.py
├── runtime.py
├── model.py
├── tools.py
├── executor.py
├── storage.py
├── events.py
├── replay.py
├── context.py
├── budget.py
├── security.py
├── schemas.py
└── workspace/
tests/
evals/
README.md
DECISIONS.md
TIMELOG.md
```
## 技术栈
- Python 3.11+
- SQLite
- Requests
- Pytest
## 路线图
- [ ] Event-sourced 存储
- [ ] Agent 执行循环
- [ ] Tool 执行引擎
- [ ] 崩溃恢复
- [ ] Exactly-once side effect
- [ ] 上下文压缩
- [ ] Prompt injection 防护
- [ ] 重放(Replay)引擎
- [ ] 评估套件
## 状态
🚧 正在开发中
本项目正在逐步开发中,每个功能在进入下一阶段之前都会经过验证。
## 许可证
本仓库创建于教育和评估目的。
标签:LLM安全防护, Python, 上下文管理, 事件溯源, 字符串匹配, 无后门, 运行时引擎