人工智能
给 Agent 加了记忆,它反而变笨了
记忆几乎总是被当作纯增益功能加上去的,但 2026 年的多份公开测量显示:加了记忆的 Agent 在不少任务上比不加更差。本文拆解稀释、误差累积、陈旧状态三种退化机制,对比 compaction、结构化笔记、子 Agent 隔离三种手段的取舍,并给出写入侧的过滤与遗忘策略和三组可自测的对照实验。
主题
模型、算法与智能系统的技术进展及其产业影响。

人工智能
记忆几乎总是被当作纯增益功能加上去的,但 2026 年的多份公开测量显示:加了记忆的 Agent 在不少任务上比不加更差。本文拆解稀释、误差累积、陈旧状态三种退化机制,对比 compaction、结构化笔记、子 Agent 隔离三种手段的取舍,并给出写入侧的过滤与遗忘策略和三组可自测的对照实验。

从代理式系统的外部行动能力出发,提出以后果、权限、数据敏感性和可恢复性划分委托边界的方法,并说明审批、责任红线、最小权限、可追溯记录与演练恢复如何共同约束 AI 的行动。

从写作、客服、企业协作与软件开发研究出发,解释 AI 如何缩短直接任务、何时把时间转移到核验与返工,以及团队应怎样衡量净效率。

以 Pew 的浏览行为数据和生成式搜索研究为边界,区分答案满足、来源打开、核验和任务完成,并为内容网站提出可证伪的页面责任与测量框架。

从任务自动化与工作流委托的区别出发,分析 AI 连续执行任务后判断位置、行动权限、证据链、责任归属与能力形成机制如何变化,并提出一套可执行的五步治理方案。

欧盟《AI 法案》进入实施阶段后,合规正在成为企业进入欧洲市场并持续经营 AI 的基础能力。本文从责任边界、风险控制、供应链证据和日常治理四个层面,说明企业如何把法规要求转化为贯穿产品生命周期的控制体系。

把长上下文放回合同审阅、跨版本对照和技术决策这些具体任务中,比较 128K 与 1M 各自解决什么问题,以及检索、引用和版本控制为何仍不可缺。

区分开放访问、开放权重与开放源码,比较托管 API、托管开放模型和自托管在数据控制、许可、成本、运维、安全更新与可迁移性方面的真实取舍,并给出八项决策检查。

从正式训练运行一路拆到 HBM、先进封装、网络、折旧、利用率、推理调度和客户总拥有成本,解释 AI 的钱分别花在哪里,以及为什么单位价格下降并不保证总支出下降。