emlkt/llm-eval-suite

GitHub: emlkt/llm-eval-suite

基于pytest和deepeval的LLM代理行为评测框架,通过对比关键词匹配与语义判分两种方式评估模型的合规性、质量与安全性。

Stars: 0 | Forks: 0

# llm-eval-suite ![Python](https://img.shields.io/badge/Python-3.13-blue) ![pytest](https://img.shields.io/badge/pytest-9.1-green) ![deepeval](https://img.shields.io/badge/deepeval-4.1-orange) ![OpenRouter](https://img.shields.io/badge/OpenRouter-blue)
标签:deepeval, DLL 劫持, LLM评估, Ollama, pytest, Python, 人工智能, 大语言模型, 安全规则引擎, 属性图, 无后门, 用户模式Hook绕过, 逆向工具