智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
认真做体验路线图

认真做体验路线图

Lv.1

关注用户体验,长期记录界面设计方法、交互逻辑与体验细节和从需求到交付的完整过程。相信长期积累胜过短期追热点,希望用清晰的方法帮助产品与业务更高效地落地。

2文章
0粉丝
0关注
0获赞
⌖ 重庆 · 重庆 ▣ 加入时间:2026-04-14

最新文章

RAG问答延迟降低42%:chunk重构与bge-reranker重排实践

线上RAG系统在2000份PDF知识库上问答准确率仅61%,Top-5召回命中率78%但答案幻觉严重。通过将固定512字符chunk改为语义段落+滑动窗口(chunk_size=384, overlap=64),Embedding从text2vec-large切换至bge-large-zh-v1.5,并引入bge-reranker-base二次重排,最终准确率提升至87%,首token延迟从1.8

向量数据库选型:Milvus 2.4与Qdrant 1.9在RAG场景下的性能对决

在搭建一个千万级商品图片向量检索服务时,我实测了Milvus 2.4.1(Docker部署,4副本)与Qdrant 1.9.2(单机模式)。同样加载768维、1000万条float向量,Milvus内存占用高出Qdrant约38%,但Qdrant在过滤查询(metadata + vector)场景下P99延迟高出Milvus近2.5倍。本文记录了两者的部署参数、压测数据与调优过程,包括磁盘索引HN