大模型上下文如何科学管理:不要把聊天记录当数据库
· 阅读需 7 分钟
很多人刚开始做大模型应用时,会把上下文理解成“聊天记录”。用户说过的话越多,全部拼接给模型,似乎模型就越了解用户。
但实际情况往往相反。历史消息越长,越容易混入过期信息、无关闲聊和互相冲突的指令。模型还可能因为上下文太长而超出限制,或者忽略真正重要的内容。
科学的上下文管理不是尽可能多地塞内容,而是:
每次只给模型完成当前任务所必需、可靠、最新的信息。
很多人刚开始做大模型应用时,会把上下文理解成“聊天记录”。用户说过的话越多,全部拼接给模型,似乎模型就越了解用户。
但实际情况往往相反。历史消息越长,越容易混入过期信息、无关闲聊和互相冲突的指令。模型还可能因为上下文太长而超出限制,或者忽略真正重要的内容。
科学的上下文管理不是尽可能多地塞内容,而是:
每次只给模型完成当前任务所必需、可靠、最新的信息。