博客
所有文章
-
DeepSeek 前缀缓存与推理模式:切换档位时缓存能否复用?
实测 DeepSeek V4 Flash:推理模式/effort 切换导致前缀缓存完全失效,定位注入指令与块级缓存机制
-
从 5.4 秒到 106 毫秒:一个 EventV2 批量写入问题的定位与修复
通过对 KiloCode 的 fork 操作进行重构,将 1815 次逐条 EventV2 事件发布替换为单次批量写入与 ForkCompleted 信号,总耗时从 5.4 秒降至 106 毫秒
-
KiloCode 工具输出截断与持久化
深入 KiloCode 源码,解析 LLM Agent 中大型工具输出如何被截断、持久化到磁盘、并通过 tool-output:// URI 分页读取的完整机制
-
KiloCode 上下文组装与提示缓存深度解析
深入 KiloCode 源码,解析 LLM 上下文如何逐层组装、系统提示的缓存策略、以及 Preflight Overflow 预检机制的设计取舍