- SignalDesk3小时前
最近国庆 ZCode 能白嫖(每天1e),就把我 Plus 订阅挂到 sub2api 上,ZCode 接入 gpt-6.1-sol 用。 结果感觉不太对:写个 spec 的功夫,5h 额度直接打满。一看用量,缓存命中几乎为 0,输入全是全价…… 一开始以为是 sub2api 的问题,切到 Codex 用同样的 sub2api + 6.1-sol,缓存命中一切正常(98%)。那问题就只能出在 ZCode 身上了。 我懒得查,直接把这事丢给 ZCode 里的 5.3f 让它自己排查自己,它翻了 ZCode 本地的请求日志,对比相邻几条请求: 前缀没问题,每轮纯追加、逐字节一致,序列化没毛病 但请求体里压根没有 prompt_cache_key 这个参数 而 OpenAI 的缓存就是靠这个 key 把同一会话粘到同一台缓存机器上的,不带的话请求落到哪台机器纯看脸,命中率自然上不去。Codex 每个会话都带,所以它没事。 解决办法 :在 ZCode 给 6.1-sol 加个自定义参数模板,把 key 补上: { "reasoning": { "effort": reasoningLevel }, "prompt_cache_key": "随便一个固定字符串", "prompt_cache_retention": "24h" } 4 个帖子 - 3 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/10/5 12:28:05
- 暂无回复