
TONIGHT'S THOUGHT
Featured
Report
把一篇技术文章做成 Agent 可复用的知识节点
以一篇文章为单位,整理结构、数据、引用与发布流程,让人和 Agent 都能读、检索和继续工作。
Paper
HitKV:哪些 Token 真正重要?
从激活频率出发,理解 KV Cache 重要性评估的一种思路。
Latest
全部归档 →Report
每日技术报告|2026-08-27:KV 压缩的成本边界、Agent Trace 自动机与模型内部工作空间
聚焦 KV 压缩与张量并行的成本权衡、Agent 执行轨迹的有限状态建模、条件记忆路由,以及 OpenAI 沙箱逃逸事件带来的 Agent 基础设施安全边界。
Report
每日技术报告|2026-08-26:Agent 记忆从“检索”走向生命周期、安全边界与可复用 KV
聚焦 InjecMEM、双层 Agent 记忆、ReCache、Agent Externalization,以及 SGLang v0.5.18 的推理工程变化。
Report
每日技术报告|2026-08-25:异构模型直接交换 KV、Agent 记忆主动淘汰与 DSA 索引融合
聚焦 XKV 的异构模型 KV 潜空间通信、Weighted Memory Tree 的动态记忆保留,以及 vLLM DSA prefill 索引融合与混合状态缓存一致性问题。
Report
每日技术前沿|稀疏注意力走向可部署,Agent 评测转向持久状态(2026-08-24)
聚焦 FlashPrefill V2、稀疏注意力协同微调、Thinkingbox、PolicyGuide、Agent Skill 选择与 SGLang v0.5.18,观察长上下文与 Agent 系统从算法指标走向执行路径和状态语义。
Report
每日技术报告|2026-08-23:前缀亲和路由、可训练稀疏注意力与混合模型显存边界
聚焦 CacheRoute 的前缀亲和路由、KeysAndValues 的稀疏注意力微调,以及 vLLM 混合注意力模型的显存画像问题。
Report
每日技术报告|2026-08-22:Agent 可靠性从单次成功走向状态正确性与因果审计
聚焦 Thinkingbox 的状态化业务工作流评测、Agent 步级信用分配的因果审计、Bounded Agents 的授权链,以及 vLLM 对一等 Agentic Inference 的架构讨论。