karminski/PromptXRay
GitHub: karminski/PromptXRay
PromptXRay 是一个拦截分析 OpenAI 兼容 API 流量的本地代理工具,帮助开发者诊断 Prompt 缓存未命中问题并优化 Token 消耗。
Stars: 16 | Forks: 1
# PromptXRay

[English](README_en.md) | 简体中文
**Agent 始终无法命中缓存巨浪费Token? 来看 PromptXRay!**
PromptXRay 是一个代理工具,只需要接入到AI API 调用中间, 就可以分析 OpenAI 兼容API的 Prompt
缓存行为。它会捕获 `/chat/completions` 和 `/responses` 流量,关联重复请求,并指导你如何优化 Prompt。
## 当前状态
PromptXRay 目前处于早期 MVP 阶段。它会在本机保存完整的请求和响应正文,同时从持久化
记录中移除鉴权 Header。Prompt 正文中仍可能包含密钥等敏感信息。请仅使用测试流量,并在
测试完成后及时清理历史数据。
## 快速开始
cp .env.example .env
# 编辑 .env,填写上游地址和 API Key
uv sync --all-extras
uv run promptxray init
uv run promptxray start
`start` 会启动后台代理并直接打开 TUI;使用 `start --no-tui` 可以只启动后台服务。
使用 `start --lang zh` 可打开中文 TUI。
将 OpenAI 兼容客户端的 Base URL 指向 `http://127.0.0.1:7410/v1`。Managed Key 和
BYOK 两种配置方式请参阅[中文使用文档](USAGE.md)。
TUI 支持滑动窗口缓存失效分析:用 `Space` 选择列表中连续的 2~10 个请求,
按 `a` 在后台生成确定性 Diff 和双语 AI 建议。窗口上限可通过
`PROMPTXRAY_WINDOW_SIZE` 配置;跨 Session 选择会提示风险,但不会阻止分析。
## 核心原则
- 只读:绝不为优化缓存而改写请求或响应。
- 本地优先:Gateway 和数据库仅绑定并保留在本机。
- 脱离请求热路径:Token 分析和优化建议在转发完成后运行。
- 以证据为准:服务商返回的 Usage 数据是事实依据,Token 与结构差异用于解释原因。
## 许可证
MIT
标签:API网关, DLL 劫持, 人工智能, 大语言模型, 性能优化, 检测绕过, 用户模式Hook绕过, 逆向工具