fsaldico/blue-team-llm-guardrail
GitHub: fsaldico/blue-team-llm-guardrail
面向蓝队的大语言模型防御原型,通过输入过滤器和上下文控制缓解提示词注入风险,并以单元测试实现自动化验证。
Stars: 0 | Forks: 0
# blue-team-llm-guardrail
AI 防御行动 (Blue Team) 项目。用于缓解提示词注入 (Prompt Injection - OWASP LLM01) 的 Python 原型,通过带有上下文控制的输入过滤器 (Guardrail) 以及由单元测试进行的自动化验证来实现。
标签:DLL 劫持, Python, 人工智能安全, 合规性, 大语言模型, 提示词注入防护, 无后门, 输入过滤, 逆向工具