信息放置策略:指令、知识、数据的排布

核心03-上下文组织与窗口管理⏱ 20 分钟已审校
学习进度:

一句话定义

在分区结构之上,各信息的顺序同样重要——成熟的经验布局是"规则与背景放开头、参考资料居中、当前问题与待用证据放结尾",让位置效应为可靠性服务而不是拖累它。

为什么重要

同样的内容,排布不同,效果可以差出一个量级。很多"模型不听话"的问题调了几轮话术没用,一调顺序就好了。本知识点把 注意力衰减与"迷失在中间"(Lost in the Middle) 的理论规律转化为一张可执行的排布决策表,是知识库问答、文档问答类功能上下文设计的核心工艺。

前置知识

直观类比

法庭陈述的顺序设计:先声明立场与依据规则(开头),再铺陈背景卷宗(中段),最后呈上关键证据并提问(结尾)——没有人把关键证据埋在两小时陈述的正中间。

图示

位置 →  开头 ───────────── 中段 ───────────── 结尾
内容    系统规则(首因位)   背景资料/长参考      证据片段
        少样本示例           可牺牲内容          + 用户问题(近因位)
代价    被忽略代价最高       被部分忽略可接受     直接决定本轮回答

核心概念

  • 标准布局:[系统规则] → [示例] → [背景资料] → [证据/检索结果] → [用户问题]。
  • 证据贴近问题:与本次回答直接相关的材料放在用户问题之前紧邻处,享受近因效应。
  • 规则前置:硬约束放开头享受首因效应,且作为"阅读契约"先于一切资料出现。
  • 可牺牲内容居中:长背景、低频参考放中段——它们被部分忽略的代价最小。
  • 动态重排:每轮根据当前问题对资料重排(相关度高的上浮到证据区),而不是固定顺序。

原理与机制

排布决策的本质是把内容按"被忽略的代价"分层:规则被忽略代价最高 → 首因位;即时证据被忽略代价高 → 近因位(紧邻生成点);背景被忽略代价低 → 中段。两个补充机制:

  1. 指令重复是排布的合法补充:关键格式/安全约束可在结尾锚点处再述一次(输出格式控制三件套:指令、示例与结构),首尾呼应优于单点押注;
  2. 长对话中的排布会漂移:多轮追加让早期规则"沉底",跨轮后关键约定要在每轮开头复述或保持系统提示常驻(记忆与状态:会话内记忆、外部记忆与状态注入)。

公式或模型

本节不适用——排布策略直接引用 注意力衰减与"迷失在中间"(Lost in the Middle) 的定性 U 形可靠性规律,无可计算公式;具体排布收益按自身评估集实测。

实例或案例

案例:文档问答的排序修复。 症状:检索回 8 个片段全部按"文档原始顺序"平铺,命中率低。操作步骤:① 检索侧(跨站主题)给出相关度分;② 呈现侧按本知识点重排:相关度前 2 的片段放 <evidence> 区紧邻用户问题之前,其余按原顺序放 <documents> 背景;③ 在 <evidence> 区标注"以下片段与问题最相关";④ 对比修复前后命中率(评估集见 评估集构建:黄金样本与失败分类)。模板骨架:

<rules> …硬约束… </rules>
<documents> …背景与次要资料… </documents>
<evidence>
以下片段与本次问题最相关:
<doc id="7">……</doc>
<doc id="2">……</doc>
</evidence>
<user_input>{问题}</user_input>
(程序侧模板在结尾追加一行:仅依据以上资料作答,未覆盖则明说。)

排错清单:

  • 症状:规则随对话轮数增加逐渐失效 → 规则沉底,改为系统提示常驻或每轮开头复述;
  • 症状:资料很全但引用错片段 → 证据没有贴近问题,建立 <evidence> 上浮机制;
  • 症状:长资料段落自身内部也有效应 → 资料太长时先分块裁剪(长文档组织:分块、裁剪与引用定位),不要整段粘贴。

常见误区

  • "按来源顺序"排布:文档顺序对模型无意义,按"被忽略的代价"排才有意义;
  • 把所有检索结果都当证据:不分级就没有排布可言——先分层(证据 vs 背景)再谈位置;
  • 一次排布用到底:多轮对话必须动态维护排布,静态布局会在长会话中失效。

自测题

  1. 为什么证据要放在用户问题之前紧邻处?

答:近因效应——紧贴生成位置的内容利用率最高,证据与问题同处结尾区形成"证据-问题-作答"的最短路径。

  1. 中段适合放什么内容?

答:被部分忽略代价最低的内容:长背景、低频参考、完整但冗余的原始材料。

  1. 多轮对话中标准布局会遇到什么问题,如何应对?

答:早期内容沉底、规则稀释;应对是系统提示常驻 + 每轮开头复述关键约定 + 旧内容滚动压缩。

与其他知识点的关系

注意力衰减与"迷失在中间"(Lost in the Middle) 是理论依据;记忆与状态:会话内记忆、外部记忆与状态注入 处理多轮下的排布维护;长文档组织:分块、裁剪与引用定位 决定进入排布前的内容裁剪;本条与 输出格式控制三件套:指令、示例与结构 的结尾锚点组成"首尾呼应"策略。

延伸阅读

  • 论文:Lost in the Middle(Liu et al., 2023)——放置位置对问答命中率的实证曲线。

来源

  • Lost in the Middle: How Language Models Use Long Contexts (Liu et al.
  • 2023)