sanjivni2004/ShieldLLM

GitHub: sanjivni2004/ShieldLLM

ShieldLLM 是一个基于 FastAPI 的异步 LLM 安全代理微服务,通过双层越狱检测和实时 PII 脱敏保护大语言模型部署免受提示词注入与敏感数据泄露。

Stars: 0 | Forks: 0

# 🛡️ ShieldLLM — 企业级 LLM 安全网关 ShieldLLM 是一个高性能、异步的安全中间件微服务,旨在保护大语言模型 (LLM) 部署免受提示词注入攻击、角色扮演越狱以及敏感数据泄露 (PII/PHI) 的影响。 ## ✨ 核心特性 - **Tier 1 启发式防护:** 亚毫秒级的本地正则表达式过滤,可拦截常见的提示词注入特征(`DAN`、`SYSTEM OVERRIDE`)。 - **Tier 2 语义 ML 防护:** 异步 Llama 3.1 评估,通过执行结构化的 JSON-mode 分类来检测隐蔽的、角色扮演的或间接的越狱行为。 - **实时 PII 脱敏:** 由 Microsoft Presidio 和 spaCy (`en_core_web_sm`) 提供支持,在请求到达下游 LLM 提供商之前,对电子邮件、电话号码和姓名进行净化处理。 - **出站净化:** 过滤 LLM 响应,防止模型重复输出敏感数据。 - **容器化部署:** 完全使用 Docker Compose 进行 Docker 化设置,实现无缝的微服务集成。 ## 🚀 技术栈 - **框架:** FastAPI (Python 3.9+) - **安全与 NLP:** Microsoft Presidio Analyzer/Anonymizer, spaCy NLP - **LLM 基础设施:** Groq API (Llama 3.3 / Llama 3.1) - **容器化:** Docker & Docker Compose ## 🛠️ 快速开始 1. **克隆代码库:** git clone [https://github.com/sanjivni2004/ShieldLLM.git](https://github.com/sanjivni2004/ShieldLLM.git) cd ShieldLLM
标签:AI安全, AV绕过, Chat Copilot, DLL 劫持, FastAPI, Prompt注入防护, Sysdig, 中间件, 大语言模型, 护栏, 数据脱敏, 版权保护, 请求拦截, 逆向工具