跳到主要内容

1 篇博文 含有标签「Agent 架构」

查看所有标签

大模型上下文如何科学管理:不要把聊天记录当数据库

· 阅读需 7 分钟
一介布衣
全栈开发者

很多人刚开始做大模型应用时,会把上下文理解成“聊天记录”。用户说过的话越多,全部拼接给模型,似乎模型就越了解用户。

但实际情况往往相反。历史消息越长,越容易混入过期信息、无关闲聊和互相冲突的指令。模型还可能因为上下文太长而超出限制,或者忽略真正重要的内容。

科学的上下文管理不是尽可能多地塞内容,而是:

每次只给模型完成当前任务所必需、可靠、最新的信息。