最近在本地部署了一套RAG做内部文档问答,用的LangChain + BGE-large-zh + Qwen2.5-7B。实际跑起来发现一个很头疼的问题:有些问题检索得很准,但换个问法就完全找不到对应段落了。我目前是按固定512 token切chunk,overlap给了50,但文档里有不少表格和跨页的逻辑。想问下各位大佬,chunk策略到底该怎么调?是不是该上语义切分?还是说问题其实出在embedding模型上?有点迷茫,求指点。