回看 Agent 的发展,基本是一路补短板:
- 缺少当前事实,就加检索和数据接口
- 长任务容易丢信息,就加状态保存和上下文管理
- 工具调用会失败,就加重试、检查和恢复
- 行动可能越权,就加权限隔离和审批
- 结果看着对但不达标,就加测试和验收
这些「支撑技术」决定了模型的原始能力能不能真正落进现实场景。
但它们也带来自己的代价:延迟、维护成本、错误传播、协调开销。
于是形成两股力量:
外围不断加支撑系统来兜底,让结构不断深化、复杂;
模型进步又把其中一部分能力吸收进去,让结构重新变简单。
哪些留在模型里,哪些留在外面,会一直变。
@aigc1024
Post #25384
241