上下文管理

每次 AI 回复时,引擎会精心组装一套上下文送入模型。理解上下文的组成和生命周期,有助于你更高效地与 AI 协作。


上下文的组成

每次 Run(一轮对话交互)中,模型接收到的上下文由以下部分组成:

组件来源说明
系统提示词Agent 配置定义 AI 角色、行为准则、工具使用规范
SessionState上一轮 Run 的认知结算产物包含对话摘要、关键事实、Plan 状态
记忆注入Memory StoreEager 索引 + Lazy 召回 + Cold-start 重放
工具 SchemaCell 工具注册表AI 可调用的工具列表与参数定义
对话历史当前 Run 的消息列表用户消息 + AI 回复 + 工具调用结果

上下文组装流程

  1. 系统提示词构建:基于 Agent 配置 + 环境记忆 + 技能指令合成完整的 System Prompt
  2. SessionState 注入:将前一轮 Run 产出的会话状态作为历史信息注入
  3. 记忆召回:通过三条路径注入相关记忆(见下文)
  4. 工具列表:根据 Agent 的工具白名单和技能配置生成可用工具 Schema
  5. 对话消息:当前轮的用户输入和此前的交互记录

三条记忆注入路径


CognitiveSettlement(认知结算)

每次 Run 结束时,引擎会执行一个叫做 CognitiveSettlement 的强制阶段:

如果 Settlement 失败(例如模型调用出错),引擎会重试 3 次后降级到机械压缩(MechanicalFallback),确保信息不丢失。


上下文压缩

当对话过长、接近模型上下文窗口限制时,引擎会触发上下文压缩:

压缩的核心原则是信息保全优先于容量管理——丢弃消息前先提取关键证据。


对你的影响


相关文档