Kimix:为 Kimi Code 订阅 API 优化的终端代理
假设你每天都要和 Kimi Code 订阅 API 打交道,经常在终端里发起长会话。以前要么忍受官方 CLI 的轮询延迟,要么自己拼请求,上下文重复上传,缓存命中率不稳定。
现在,可以在 Kimix 的 TUI 里直接维护多个会话,每个会话独立上下文,不会互相污染。过程中能实时看到请求和缓存状态,需要时可以随时中断。
Kimix 是 grok-build 的一个 hard fork,使用 Rust 实现,目标很明确:针对 Kimi Code 订阅 API,把 prompt-cache 命中率做到 95% 以上,同时提供 60fps 的 TUI 刷新体验。

多个会话,解决上下文来回传的问题
多会话最怕的不是慢,而是乱。
比如刚在会话 A 里分析了报错,下一个请求却因为上下文错乱发给了会话 B;或者某个会话卡住后,其他会话的缓存也跟着失效。最终看似跑完了,但输出对应关系已经乱了。

Kimix 的处理方式很直接:
- 启动时,先锁定当前会话的上下文;
- 每个会话建立独立的上下文缓存;
- 每次请求分别发送并返回;
- 执行期间不能混用上下文,避免“串台”。
会话的归属、执行过程和停止方式都有明确规则。
比直接调 API 更可控?
真正连续跑任务以后,能发请求只是第一步。
更重要的是:缓存命中了吗?为什么没命中?卡住以后会不会反复重试?人能不能看到,又能不能马上叫停?
Kimix 给出的几项硬指标:
- prompt-cache 命中率稳定在 95% 以上,长会话重复前缀基本不重传;
- TUI 轮询从 100ms 降到 16ms,刷新率达到 60fps,状态变化跟手;
- 无效轮询会被丢弃,不浪费带宽。
执行时,TUI 会展示当前请求、缓存状态和输出。发现方向不对,可以直接中断当前会话。
换句话说,它不是把任务丢给 API 后就听天由命,而是让人始终看得见、分得清、停得住。
三类任务,最适合先拿来试
1. 长对话续聊
同一个上下文反复追问,Kimix 能把重复前缀的缓存命中稳定在高位,响应明显变快。
2. 多仓库并行问答
不同仓库使用独立会话,通过 KIMIX_* 环境变量隔离配置,互不干扰。
3. 流式日志分析
把持续输出喂给 Kimix,在 60fps 的 TUI 里跟踪进度,随时可以中断。
安装,需要 Rust 工具链和 dotslash
安装 Kimix 需要预先准备 Rust 工具链和 dotslash。具体安装命令原文未提供。
安装后,配置存放在 ~/.kimix,环境变量统一使用 KIMIX_* 前缀。官方 kimi CLI 的配置路径和环境变量不会被触碰,因此两者可以共存于同一台机器。
启动 TUI,如果刷新率达到 60fps,说明轮询配置已生效。
最后
Kimix 这次值得看:**直接跑在终端里、高缓存命中、60fps TUI 的代理端。**做长对话调试,可以让同一个上下文连续复用;做多仓库并行,可以让不同会话互不干扰;做日志分析,也可以一次看清流式输出。
装上它,从一个长会话开始试。
团队后续会推出更多实用场景和配套能力,欢迎加群关注,种子用户群直接交流反馈建议。

项目地址:https://github.com/taxueseek/kimix