跳到主要内容
隐界
术语表

上下文窗口(Context Window)

一次模型调用能「看见」的最大文本量,按 token 计。窗口之外的内容模型一无所知——这是长期记忆系统存在的原因。

LLM 每次生成时只能读取有限长度的输入(几万到上百万 token 不等)。对话越长,越早的内容越可能被挤出窗口——这就是为什么裸用 chatbot 聊久了它会「忘事」。

解决思路不是无限加大窗口(成本与速度都不允许),而是在窗口外建一层持久存储,按需检索相关内容回填——也就是长期记忆与 RAG 做的事。

在隐界里亲手试试

浏览器即开即用,不需要注册任何信用卡。

相关内容

其它术语

分享XTelegramLINE微博
上下文窗口(Context Window) · 隐界 Enclave