它是什么
模型单次能同时「看到」的文本总量上限,含系统指令、历史对话和本轮输入,超出部分会被截断。
为什么重要
它决定了你能不能一次丢进整本手册,也决定了长对话会不会被裁掉开头、让模型「忘记」你早先定下的约束。
打个比方
像一张大小有限的办公桌:同时摊开的资料越少,摆在上面的每一份就越值得反复细看;桌面满了,只能先收拾走一部分。
举个例子
把一份 300 页的合同丢进 NotebookLM 再反复追问条款,是典型的长上下文用法;而在普通聊天界面贴满 20 轮对话后,模型开始忽略开头约束,多半就是撞上了窗口上限。
常见误解
误解:窗口越大就记得越牢。 事实:容量指的是装得下,并不等于每处都被认真读取,中段内容被忽略的情况仍会出现。
误解:窗口用完对话就永久消失了。 事实:多数产品会裁掉最旧的内容并保留摘要,重开对话把关键信息重讲一遍即可。
误解:上传文件等于全文逐字读过了。 事实:文件通常会被切分后按需检索或直接截取,关键内容最好自己写进正文。
误解:有了长上下文就不需要检索。 事实:整本手册硬塞进去既贵又慢,按需检索几段通常效果更好、成本更低。
延伸阅读(相关概念)
本页内容更新于 2026 年 9 月 8 日。概念条目会随模型能力变化而修订。