跳到主要内容
一介布衣
全栈开发者
查看所有作者

RAG 回答里的引用和 grounding 风格

· 阅读需 2 分钟
一介布衣
全栈开发者

引用与 grounding 风格 这件事在 2023 年开始越来越频繁地进入真实项目,但很多团队一开始只看到表面收益,没有先把边界收住。只要 模型回答看起来很自信,但用户根本不知道依据来自哪里,问题就会很快从“一个小体验瑕疵”变成系统性的维护成本。

切换 embedding 模型前先算切换成本

· 阅读需 3 分钟
一介布衣
全栈开发者

embedding 模型切换成本 这件事在 2023 年开始越来越频繁地进入真实项目,但很多团队一开始只看到表面收益,没有先把边界收住。只要 只盯着单点评测结果,忽略了索引重建和线上切换的系统代价,问题就会很快从“一个小体验瑕疵”变成系统性的维护成本。

Rerank 阶段到底值不值得加

· 阅读需 3 分钟
一介布衣
全栈开发者

rerank 阶段 这件事在 2023 年开始越来越频繁地进入真实项目,但很多团队一开始只看到表面收益,没有先把边界收住。只要 初始召回虽然覆盖到了答案,但排序顺序不对,模型看到的上下文依然不够好,问题就会很快从“一个小体验瑕疵”变成系统性的维护成本。

检索前做 query rewrite 什么时候值得

· 阅读需 2 分钟
一介布衣
全栈开发者

query rewrite 这件事在 2023 年开始越来越频繁地进入真实项目,但很多团队一开始只看到表面收益,没有先把边界收住。只要 原始问题太口语或太短,检索阶段根本抓不到真正意图,问题就会很快从“一个小体验瑕疵”变成系统性的维护成本。