最近在做一个内部知识库的RAG项目,用LangChain + Faiss,文档是PDF和Word混着来。现在遇到一个很头疼的问题:文档更新后,比如版本替换或者删除,向量库里旧的内容还在,检索时经常返回过期信息。我试过每次更新都重建整个索引,但文档多了以后耗时太长,而且并发高的时候容易崩。也看了一些增量更新的教程,但感觉都是讲概念,实际代码里切分、embedding、去重这些环节总对不上。想请教下各位,生产环境里一般是怎么解决索引同步的?有没有相对优雅的方案,或者直接用现成的向量数据库(比如Milvus、qdrant)会好一些?先谢过各位大佬了。