塞得进不等于用得好:长上下文与上下文工程
宣称 128K 的模型有效长度可能只有 64K,去掉词汇线索后十三个模型里十一个在 32K 跌破基线一半。梳理名义窗口与有效窗口的鸿沟、三条算法路线、工程层三大件,以及长上下文、检索与记忆该怎么选。
补个向量库是不够的:Agent 记忆的四条路线与一场信任危机
Agent 记忆已成为独立工程学科:四条实现路线、四类记忆操作、以及一场至今没有中立复现的基准争议。梳理 mem0 与 Zep 各自的证据、长上下文与记忆的成本-延迟取舍,以及为什么评测是这个领域最大的短板。





