sanjivni2004/ShieldLLM
GitHub: sanjivni2004/ShieldLLM
ShieldLLM 是一个基于 FastAPI 的异步 LLM 安全代理微服务,通过双层越狱检测和实时 PII 脱敏保护大语言模型部署免受提示词注入与敏感数据泄露。
Stars: 0 | Forks: 0
# 🛡️ ShieldLLM — 企业级 LLM 安全网关
ShieldLLM 是一个高性能、异步的安全中间件微服务,旨在保护大语言模型 (LLM) 部署免受提示词注入攻击、角色扮演越狱以及敏感数据泄露 (PII/PHI) 的影响。
## ✨ 核心特性
- **Tier 1 启发式防护:** 亚毫秒级的本地正则表达式过滤,可拦截常见的提示词注入特征(`DAN`、`SYSTEM OVERRIDE`)。
- **Tier 2 语义 ML 防护:** 异步 Llama 3.1 评估,通过执行结构化的 JSON-mode 分类来检测隐蔽的、角色扮演的或间接的越狱行为。
- **实时 PII 脱敏:** 由 Microsoft Presidio 和 spaCy (`en_core_web_sm`) 提供支持,在请求到达下游 LLM 提供商之前,对电子邮件、电话号码和姓名进行净化处理。
- **出站净化:** 过滤 LLM 响应,防止模型重复输出敏感数据。
- **容器化部署:** 完全使用 Docker Compose 进行 Docker 化设置,实现无缝的微服务集成。
## 🚀 技术栈
- **框架:** FastAPI (Python 3.9+)
- **安全与 NLP:** Microsoft Presidio Analyzer/Anonymizer, spaCy NLP
- **LLM 基础设施:** Groq API (Llama 3.3 / Llama 3.1)
- **容器化:** Docker & Docker Compose
## 🛠️ 快速开始
1. **克隆代码库:**
git clone [https://github.com/sanjivni2004/ShieldLLM.git](https://github.com/sanjivni2004/ShieldLLM.git)
cd ShieldLLM
标签:AI安全, AV绕过, Chat Copilot, DLL 劫持, FastAPI, Prompt注入防护, Sysdig, 中间件, 大语言模型, 护栏, 数据脱敏, 版权保护, 请求拦截, 逆向工具