刘政东
主题3
-
讲稿和文章不是同一份东西
一份源文件渲染成文章和幻灯片,看起来省事,实际把对应关系搞错了。
演示版 -
Billion-Context 解析:为什么真正的长任务 Agent,不需要也不该塞满百万上下文?
模型窗口卷到 1M、2M 之后,我们在实际跑自动化重构、长链条调试等任务时,Agent 为何依然频繁变笨?本文深入拆解超长上下文的注意力稀释机制,并以 billion-context(ACP)为样本,剖析不可变前缀、Compress-as-Anchor 物理锚点、多层收敛中真实的前缀破坏与缓存重购(Re-Pay)经济学模型,以及三级摘要演化与按需文件回溯的系统设计。
演示版 -
跨会话的永久黑匣子:当 pi-experiencev2 遇上 billion-context
为什么大模型 Agent 一换窗口就‘失忆’,或者单会话跑久了就‘卡死’?本文深入剖析基于向量 RAG 恢复记忆与单会话死撑的两大工程死穴,并拆解 pi-experiencev2 的原生 SQLite 存储与双轨检索架构,展现它如何与 billion-context 紧密握手,在零破坏前缀缓存的前提下实现真正无死角的跨会话永久记忆;也展示这份归档怎样让 Agent 复盘自己的行动轨迹,给 Dream 与自我进化留下依据。
演示版
