最近在调一个文档问答的RAG,用的bge-m3召回 + OpenAI接口生成。我本来想在Prompt里写清楚“如果上下文没有答案就直说不知道”,还加了点格式要求让它输出带引用。结果发现加了这些约束之后,回答是规范了,但经常答非所问,甚至明明检索到了对的段落,它却开始编。我一度怀疑是召回阈值设太高了,但调低也没用。后来试了试把Prompt改回极简版“基于以下内容回答”,效果反而好了很多。想问问大家,Prompt里的角色设定和输出约束会不会反向影响模型对检索内容的“信任度”?还是说我的检索链路本身有问题,只是被Prompt掩盖了?有没有人遇到过类似情况,怎么平衡约束和召回质量?