信息放置策略:指令、知识、数据的排布
一句话定义
在分区结构之上,各信息的顺序同样重要——成熟的经验布局是"规则与背景放开头、参考资料居中、当前问题与待用证据放结尾",让位置效应为可靠性服务而不是拖累它。
为什么重要
同样的内容,排布不同,效果可以差出一个量级。很多"模型不听话"的问题调了几轮话术没用,一调顺序就好了。本知识点把 注意力衰减与"迷失在中间"(Lost in the Middle) 的理论规律转化为一张可执行的排布决策表,是知识库问答、文档问答类功能上下文设计的核心工艺。
前置知识
- 注意力衰减与"迷失在中间"(Lost in the Middle):首因/近因效应与中段低谷——排布策略的全部理论依据;
- 结构化上下文:分段、标签与命名:分区结构——排布是在分区之间的排序。
直观类比
法庭陈述的顺序设计:先声明立场与依据规则(开头),再铺陈背景卷宗(中段),最后呈上关键证据并提问(结尾)——没有人把关键证据埋在两小时陈述的正中间。
图示
位置 → 开头 ───────────── 中段 ───────────── 结尾
内容 系统规则(首因位) 背景资料/长参考 证据片段
少样本示例 可牺牲内容 + 用户问题(近因位)
代价 被忽略代价最高 被部分忽略可接受 直接决定本轮回答核心概念
- 标准布局:
[系统规则] → [示例] → [背景资料] → [证据/检索结果] → [用户问题]。 - 证据贴近问题:与本次回答直接相关的材料放在用户问题之前紧邻处,享受近因效应。
- 规则前置:硬约束放开头享受首因效应,且作为"阅读契约"先于一切资料出现。
- 可牺牲内容居中:长背景、低频参考放中段——它们被部分忽略的代价最小。
- 动态重排:每轮根据当前问题对资料重排(相关度高的上浮到证据区),而不是固定顺序。
原理与机制
排布决策的本质是把内容按"被忽略的代价"分层:规则被忽略代价最高 → 首因位;即时证据被忽略代价高 → 近因位(紧邻生成点);背景被忽略代价低 → 中段。两个补充机制:
- 指令重复是排布的合法补充:关键格式/安全约束可在结尾锚点处再述一次(输出格式控制三件套:指令、示例与结构),首尾呼应优于单点押注;
- 长对话中的排布会漂移:多轮追加让早期规则"沉底",跨轮后关键约定要在每轮开头复述或保持系统提示常驻(记忆与状态:会话内记忆、外部记忆与状态注入)。
公式或模型
本节不适用——排布策略直接引用 注意力衰减与"迷失在中间"(Lost in the Middle) 的定性 U 形可靠性规律,无可计算公式;具体排布收益按自身评估集实测。
实例或案例
案例:文档问答的排序修复。 症状:检索回 8 个片段全部按"文档原始顺序"平铺,命中率低。操作步骤:① 检索侧(跨站主题)给出相关度分;② 呈现侧按本知识点重排:相关度前 2 的片段放 <evidence> 区紧邻用户问题之前,其余按原顺序放 <documents> 背景;③ 在 <evidence> 区标注"以下片段与问题最相关";④ 对比修复前后命中率(评估集见 评估集构建:黄金样本与失败分类)。模板骨架:
<rules> …硬约束… </rules>
<documents> …背景与次要资料… </documents>
<evidence>
以下片段与本次问题最相关:
<doc id="7">……</doc>
<doc id="2">……</doc>
</evidence>
<user_input>{问题}</user_input>
(程序侧模板在结尾追加一行:仅依据以上资料作答,未覆盖则明说。)排错清单:
- 症状:规则随对话轮数增加逐渐失效 → 规则沉底,改为系统提示常驻或每轮开头复述;
- 症状:资料很全但引用错片段 → 证据没有贴近问题,建立
<evidence>上浮机制; - 症状:长资料段落自身内部也有效应 → 资料太长时先分块裁剪(长文档组织:分块、裁剪与引用定位),不要整段粘贴。
常见误区
- "按来源顺序"排布:文档顺序对模型无意义,按"被忽略的代价"排才有意义;
- 把所有检索结果都当证据:不分级就没有排布可言——先分层(证据 vs 背景)再谈位置;
- 一次排布用到底:多轮对话必须动态维护排布,静态布局会在长会话中失效。
自测题
- 为什么证据要放在用户问题之前紧邻处?
答:近因效应——紧贴生成位置的内容利用率最高,证据与问题同处结尾区形成"证据-问题-作答"的最短路径。
- 中段适合放什么内容?
答:被部分忽略代价最低的内容:长背景、低频参考、完整但冗余的原始材料。
- 多轮对话中标准布局会遇到什么问题,如何应对?
答:早期内容沉底、规则稀释;应对是系统提示常驻 + 每轮开头复述关键约定 + 旧内容滚动压缩。
与其他知识点的关系
注意力衰减与"迷失在中间"(Lost in the Middle) 是理论依据;记忆与状态:会话内记忆、外部记忆与状态注入 处理多轮下的排布维护;长文档组织:分块、裁剪与引用定位 决定进入排布前的内容裁剪;本条与 输出格式控制三件套:指令、示例与结构 的结尾锚点组成"首尾呼应"策略。
延伸阅读
- 论文:Lost in the Middle(Liu et al., 2023)——放置位置对问答命中率的实证曲线。
来源
- Lost in the Middle: How Language Models Use Long Contexts (Liu et al.
- 2023)