Kartikpatel1202/AgenticAiSafety
GitHub: Kartikpatel1202/AgenticAiSafety
Agentic AI Safety 是一个综合性的 LLM Agent 安全平台,通过安全护栏、攻击模拟、风险评估和监控 Dashboard 来检测并防御 prompt injection 和 jailbreak 等对抗攻击。
Stars: 0 | Forks: 0
# 🛡️ Agentic AI 安全
**LLM Agent 的对抗鲁棒性**
一个综合平台,用于评估和提升基于 LLM 的 agent 针对 prompt injection、jailbreak 及对抗攻击的安全性。
## 📋 概述
本项目提供:
- **安全 LLM Agent** — 具备多层安全防御的 agent
- **攻击库** — 用于红队测试的 50 多种对抗攻击模板
- **实时检测** — Prompt injection 与 jailbreak 检测 pipeline
- **风险评分** — 对每个 prompt 进行定量风险分析
- **评估引擎** — 带有指标的全自动化安全基准测试
- **Dashboard** — 用于监控和分析的可视化界面
## 🚀 快速开始
### 前置条件
- Python 3.11 或更高版本
- OpenAI API key(或用于本地模型的 Ollama)
### 安装
```
# 1. Clone the repository
git clone https://github.com/yourusername/agentic-ai-safety.git
cd agentic-ai-safety
# 2. 创建虚拟环境
python -m venv venv
source venv/bin/activate # Linux/Mac
venv\Scripts\activate # Windows
# 3. 安装依赖
pip install -r requirements.txt
# 4. 配置环境
cp .env.example .env
# 使用您的 API 密钥和设置编辑 .env
# 5. 初始化数据库
python -m src.database.sqlite_manager
# 6. 启动 API 服务器
uvicorn src.api.main:app --reload --host 127.0.0.1 --port 8000
# 7. 启动 dashboard(在单独的终端中)
streamlit run dashboard/app.py
```
### 验证安装
```
# 健康检查
curl http://127.0.0.1:8000/api/v1/health
```
## 📁 项目结构
```
agentic-ai-safety/
├── config/ # Configuration & constants
├── src/
│ ├── api/ # FastAPI application & routes
│ ├── agent/ # LLM Agent core (Phase 3)
│ ├── security/ # Security pipeline (Phase 4)
│ ├── attacks/ # Attack library (Phase 5)
│ ├── evaluation/ # Evaluation engine (Phase 7)
│ ├── database/ # Database layer
│ └── common/ # Shared utilities
├── dashboard/ # Streamlit frontend (Phase 6)
├── data/ # Attack patterns & DB storage
├── tests/ # Test suite
├── docs/ # Documentation
└── logs/ # Runtime logs
```
## 🛠️ 技术栈
| 技术 | 用途 |
|------------|---------|
| Python 3.11+ | 核心语言 |
| FastAPI | 后端 API |
| LangChain | Agent 框架 |
| OpenAI / Ollama | LLM 提供商 |
| ChromaDB | 向量数据库 |
| SQLite | 关系型数据库 |
| Streamlit | Dashboard UI |
| Pydantic | 数据校验 |
| structlog | 结构化日志 |
## 📖 文档
- [第一阶段 - 架构](docs/phase1_architecture.md)
## 📄 许可证
# 本项目采用 MIT License 授权。
# AgenticAiSafety
Agentic AI Safety 是一个 AI 安全项目,旨在构建一个安全的、由 LLM 驱动的 agent,能够检测并防御 prompt injection、jailbreak 及其他对抗攻击。它集成了安全护栏、风险分析、工具权限控制、日志记录、基准测试和监控 Dashboard,以提升 AI 的安全性与可靠性。
标签:AI智能体, AI风险缓解, AV绕过, DLL 劫持, FastAPI, Kubernetes, 人工智能安全, 合规性, 大语言模型, 红队评估, 逆向工具