bryand410/llm-sentinel
GitHub: bryand410/llm-sentinel
LLM Sentinel 是一款本地 AI 安全网关,通过轻量微调模型实时检测并拦截针对大语言模型的提示注入与越狱攻击。
Stars: 0 | Forks: 0
# 🛡️ LLM Sentinel
一款超快速的本地 AI 网关,旨在检测并拦截 Prompt Injections 和 Jailbreaks,以防它们攻击你的大型 LLM (ChatGPT、Claude 等)。
## 🧠 架构
- **模型:** 微调 `prajjwal1/bert-tiny` 用于序列分类。
- **API:** 异步 FastAPI 后端。
- **延迟:** 在 CPU 上推理时间 < 50ms。
## 🚀 快速开始
1. `pip install -r requirements.txt`
2. 训练 sentinel:`python src/train.py`
3. 启动 API:`uvicorn api.main:app --reload`
标签:AI安全, AV绕过, Chat Copilot, FastAPI, PyTorch, 凭据扫描, 大语言模型防护, 提示词注入检测, 逆向工具, 零日漏洞检测