上下文窗口算术:角色为什么聊着聊着就失忆
「角色怎么把我名字忘了」——这是全平台最高频的抱怨,而答案不是玄学,是一道除法题。理解上下文窗口,是这台「导播台」所有记忆旋钮的地基。
窗口是什么
上下文窗口 = AI 每次生成回复时能「看见」的全部文本总量,以 token 计。窗口里同时装着:
- 角色定义(性格、开场白、示例对话)
- 你的化身(Persona)描述
- 生成指令与设置
- 剩下的空间才装历史消息
窗口装不下的最老消息,就从 AI 的视野里消失了——这就是失忆。官方文档用书桌打比方:桌面就那么大,旧文件得挪走才能放新文件。
各档位窗口上限
| 档位 | 上下文上限 |
|---|---|
| 免费 | 4,096 tokens |
| Get A Taste | 4,096 tokens(与免费相同) |
| True Supporter | 8,192 tokens |
| I'm All In | 最高 32,768 tokens(模型支持时) |
注意取低规则:实际生效值 = 档位上限与所选模型上限中更低者。顶档用户选了个 8K 模型,这轮对话就是 8K。
官方给的算术题
官方文档的原版示例:免费档 4,096 tokens 里,角色定义吃掉 1,000,平均每条消息约 150 tokens——留给对话历史约 3,096,除下来只剩最近约 20 条消息可见。顶档 32K 模型下,同样条件能维持一两百条的视野,但长对话终会触顶。
这个算术解释了三件高频怪事:为什么长对话越聊越忘(老消息出窗);为什么角色定义写得肥等于慢性自杀(定义 3,000 token 的角色在免费档几乎没空间装对话);为什么换大窗口模型立竿见影。
延缓遗忘的实操手段
窗口是物理限制,但你可以把关键信息「搬运」出窗口的束缚:
- 角色定义减肥:合计压在 900–1,100 tokens(官方建议),窗口大头让给对话本身;
- 复读关键信息:重要事实在长对话里隔段重提——在窗口里就没忘;
- 用记忆管理器钉住:把名字、关系、约定钉进每次生成的必见清单(付费档,见「记忆管理器」一页);
- 靠语义记忆:付费中档以上的自动总结机制,专门收留掉出窗口的信息(见「语义记忆」一页);
- 世界书锚定:世界观规则写进世界书按需注入,不占死窗口(见「世界书」一页)。
还有一个所有档位通吃的限制要心里有数:窗口不跨对话。新开一段对话,角色对上一段剧情一无所知——这是平台设计,目前没有任何档位能改变。