pxpipe 中文教程:把长上下文转成图片前先做 A/B 测试
pxpipe 位于 Agent 和模型 API 之间。它把系统提示、工具文档和较旧的长历史渲染为图片,再把请求发给目标模型。输出不会被压缩。最近对话、未完成的工具调用和需要精确保留的内容可以继续使用文本。
1. 它在请求中改了什么
代理接收 Anthropic Messages、OpenAI Responses/Chat Completions 或 Google generateContent 请求。转换器识别体积大的文本块,按模型 profile 排版、换行并生成 PNG,再附带受限 factsheet。稀疏文本通过盈利门槛后可能保持原文。
图像能装下更多字符,但读取依赖模型视觉能力。官方密集十六进制测试中,部分模型会静默读错。这类错误没有异常提示,哈希、密钥、精确 ID、逐字符补丁和金额不能只靠图片传递。
2. 用 30 秒路径启动
# 终端 1:本地代理,默认监听 127.0.0.1:47821 npx pxpipe-proxy # 终端 2:让 Claude Code 走本地代理 ANTHROPIC_BASE_URL=http://127.0.0.1:47821 claude
浏览器打开 http://127.0.0.1:47821/,先看哪些块被转换、哪些模型 chip 已开启。测试时使用非敏感仓库,保留一组关闭 pxpipe 的对照会话。需要保留第一方连接器或 remote control 行为时,再按官方说明使用 pxpipe warp -- claude。
3. 不开代理也能导出图片
npx pxpipe-proxy export src/ cat prompt.txt | npx pxpipe-proxy export --stdin npx pxpipe-proxy export --git
每次 export 会生成新的目录,里面包含 PNG 页面、factsheet.txt、manifest.json 和 prompt.txt。这条路径适合先检查排版和精确信息是否被保留,不需要连接模型。
4. 用自己的日志算节省
事件默认写入 ~/.pxpipe/events.jsonl。运行 pxpipe stats 或 pxpipe stats --json,查看压缩比、延迟、缓存命中和经过 probe 的 token 差值。没有测量到的请求不会被当成零。
官方数据说明了方法可行,但不能直接套到你的账单。模型价格、视觉 token 规则、缓存命中、上下文密度、客户端重发方式和输出长度都会改变结果。实际评估至少要比较费用、任务正确率和精确字段错误数。
5. 与 LLMLingua 对比
Microsoft LLMLingua 用小语言模型识别并删除非必要 token,输出仍是文本;pxpipe 把大块上下文变成图片,依赖目标模型的视觉读取和图片计费。LLMLingua 要准备压缩模型,pxpipe 要验证每个目标模型的图像 profile。两者都会改变原始上下文,含精确字段的任务都要做单独测试。
这里仅补原教程没有展开的事实和边界。安装命令与操作步骤仍以前文为准。
先判断这个项目是否适合你
适合谁用
适合系统提示、工具说明和旧历史很长,而且目标模型能稳定读取对应图片 profile 的 Agent 会话。包含哈希、密钥、ID、十六进制、逐字符补丁或大量稀疏自然语言时,应保留文本或关闭转换。
采用建议
pxpipe 适合上下文很密、能容忍图像读取误差并愿意看日志做 A/B 测试的用户。上线前先用自己的请求比较 token、费用和答案正确率;涉及哈希、ID、密钥和补丁内容时,把精确字段留在文本里。
原教程未展开的系统信息
核心功能
请求级文本转图片
代理按模型配置把大段系统提示、工具文档和旧历史重新排版成 PNG,并附带受限 factsheet。最新对话、开放中的工具调用和不适合图像化的请求可以保持原样。
按模型启用和盈利门槛
项目为不同模型设置渲染尺寸、保留历史和图片上限,并用盈利判断让稀疏文本继续走原文。默认模型范围和 opt-in 模型会变化,部署前应查看当前 README。
核验与使用边界
优势与限制
优势
- 代理、离线导出和库接口覆盖三种接入方式
- 仪表和事件日志能看到每次转换与实际测量记录
- 官方公开了质量测试覆盖、失败样例和小样本限制
限制
- 图像压缩有损,精确字符串可能被模型静默读错
- 节省取决于模型视觉计费、缓存命中、文本密度和客户端重发方式
- 本轮未启动代理,也未使用任何模型或 API 复现官方 benchmark
排错时先核对版本、运行环境和未覆盖范围。这里没有执行过的步骤不会写成实测结论。
常见问题
pxpipe 会压缩模型输出吗?
不会。官方 README 说明它只改写发往模型的输入请求,响应仍按原协议流式返回。
哈希、密钥和精确 ID 能放心放进图片吗?
不能。官方测试记录过密集十六进制内容的静默误读。这类值应保留为文本,并用原始工具输出复核。
README 中的节省比例可以直接套到我的账单吗?
不可以。结果会随模型价格、缓存、文本密度、客户端重发方式和会话长度改变。应读取自己的事件日志。
一定要把 Claude Code 的 ANTHROPIC_BASE_URL 改成本地代理吗?
基础代理路径需要这样做。若要保留第一方连接行为,可按官方文档评估 warp;也可以只用 export 离线生成图片。