MohamadSanas/adversarial-agent-runtime

GitHub: MohamadSanas/adversarial-agent-runtime

一个从零构建的生产级 AI Agent 运行时,提供持久化、exactly-once 执行、崩溃恢复与 prompt injection 防御等能力,解决 Agent 在生产环境中面临的可靠性问题。

Stars: 0 | Forks: 0

# 对抗性 Agent Runtime 这是一个面向生产环境的 AI agent runtime,作为 Agentic Developer 评估的一部分从零开始构建。 目标是实现一个持久化、安全且可观测的 runtime,它能够与本地 mock LLM 进行交互,同时对故障、格式错误的输出、prompt injection、崩溃和长时间的对话保持弹性。 ## 目标 - 在不使用 agent 框架的情况下构建 agent runtime - 通过受控的 runtime 支持 tool 执行 - 保证对不可逆 side effect 的 exactly-once 执行 - 持久化执行状态以实现崩溃恢复 - 在固定的 token 预算内管理上下文 - 防御 prompt injection 和不安全的 tool 使用 - 生成可重放(replay)的执行 trace - 包含具有对抗性测试用例的评估套件 ## 功能 - Agent 执行循环 - 基于 SQLite 的 event sourcing - 崩溃恢复与恢复执行支持 - 从已记录的 event 中重放(replay) - 上下文压缩(compaction) - Token 与步骤预算控制 - 安全的 tool 执行 - 结构化 JSONL tracing - 评估框架 ## 项目结构 ``` agent/ ├── main.py ├── runtime.py ├── model.py ├── tools.py ├── executor.py ├── storage.py ├── events.py ├── replay.py ├── context.py ├── budget.py ├── security.py ├── schemas.py └── workspace/ tests/ evals/ README.md DECISIONS.md TIMELOG.md ``` ## 技术栈 - Python 3.11+ - SQLite - Requests - Pytest ## 路线图 - [ ] Event-sourced 存储 - [ ] Agent 执行循环 - [ ] Tool 执行引擎 - [ ] 崩溃恢复 - [ ] Exactly-once side effect - [ ] 上下文压缩 - [ ] Prompt injection 防护 - [ ] 重放(Replay)引擎 - [ ] 评估套件 ## 状态 🚧 正在开发中 本项目正在逐步开发中,每个功能在进入下一阶段之前都会经过验证。 ## 许可证 本仓库创建于教育和评估目的。
标签:LLM安全防护, Python, 上下文管理, 事件溯源, 字符串匹配, 无后门, 运行时引擎