模型与算法
给 Agent 加了记忆,它反而变笨了
记忆几乎总是被当作纯增益功能加上去的,但 2026 年的多份公开测量显示:加了记忆的 Agent 在不少任务上比不加更差。本文拆解稀释、误差累积、陈旧状态三种退化机制,对比 compaction、结构化笔记、子 Agent 隔离三种手段的取舍,并给出写入侧的过滤与遗忘策略和三组可自测的对照实验。
主题
模型能力、评估方法和工程选择背后的因果链。

模型与算法
记忆几乎总是被当作纯增益功能加上去的,但 2026 年的多份公开测量显示:加了记忆的 Agent 在不少任务上比不加更差。本文拆解稀释、误差累积、陈旧状态三种退化机制,对比 compaction、结构化笔记、子 Agent 隔离三种手段的取舍,并给出写入侧的过滤与遗忘策略和三组可自测的对照实验。

同一个问题出现不同回答,未必只是“模型随机”。从逐词元生成、会话上下文到版本变动,拆解差异从哪里来,以及哪些差异必须核验。

从输入、规则、验收、适配层和人工接管出发,说明如何评估单一 AI 工具依赖,并用实测建立可维护的降级路径。

从选择过载、排序信号、探索范围和可干预性出发,拆解推荐到底替人省掉了什么,又没有替人做掉什么。

从写作、客服、企业协作与软件开发研究出发,解释 AI 如何缩短直接任务、何时把时间转移到核验与返工,以及团队应怎样衡量净效率。

从任务自动化与工作流委托的区别出发,分析 AI 连续执行任务后判断位置、行动权限、证据链、责任归属与能力形成机制如何变化,并提出一套可执行的五步治理方案。

欧盟《AI 法案》进入实施阶段后,合规正在成为企业进入欧洲市场并持续经营 AI 的基础能力。本文从责任边界、风险控制、供应链证据和日常治理四个层面,说明企业如何把法规要求转化为贯穿产品生命周期的控制体系。

把长上下文放回合同审阅、跨版本对照和技术决策这些具体任务中,比较 128K 与 1M 各自解决什么问题,以及检索、引用和版本控制为何仍不可缺。

从正式训练运行一路拆到 HBM、先进封装、网络、折旧、利用率、推理调度和客户总拥有成本,解释 AI 的钱分别花在哪里,以及为什么单位价格下降并不保证总支出下降。