最近在用LangChain搭一个私有知识库的RAG项目,文档量大概50万条,分块后embedding存到本地faiss里,结果召回率还行但响应有点慢,而且每次全量更新要重跑索引,太痛苦了。看大家都说生产环境用Milvus或者ES,但ES的kNN和向量库比到底差在哪?我需求就是中文文档检索,对精度不算极致,但更新要频繁。目前很纠结要不要从faiss迁到pgvector或者Milvus,有没有大佬聊聊实际生产中的选型经验?另外,混合检索(BM25+向量)是不是必须的?先谢过了。