智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
阿洛_Dev手记

阿洛_Dev手记

Lv.1

Coder,长期记录真实项目中的技术选择,主要关注软件工程,分享问题排查与调试、项目复盘及真实项目复盘;更关注能够真正落地的方法。希望这些经验能帮你少踩几个坑。

2文章
0粉丝
0关注
0获赞
⌖ 山东 · 青岛 ▣ 加入时间:2026-04-21

最新文章

RAG召回率从61%到89%:chunk重切、embedding换型与rerank排序的工程实践

在搭建面向企业私有文档的问答系统时,召回质量一度卡在61%的Hit Rate上,表现为“答非所问”和“漏检关键段落”。本文记录一次为期两周的RAG管线优化过程:首先将固定256字符chunk改为基于Markdown标题的语义切分,并引入50%重叠滑动窗口;随后将Embedding模型从`text2vec-large-chinese`切换为`BAAI/bge-large-zh-v1.5`,维度从10

7B模型LoRA/QLoRA微调实录:显存从24G降到8G与效果对比

本文记录了一次完整的LLM微调实践,使用LoRA与QLoRA技术对Qwen2-7B-Instruct模型进行领域适配。通过4-bit NF4量化+双LoRA适配器,将峰值显存从全参数微调的24GB+压缩至8.2GB,训练速度仅下降约18%。文章详细对比了LoRA(秩r=16)与QLoRA在相同数据下的loss收敛曲线及推理效果,发现QLoRA在F1指标上仅损失0.7%,却换来了三倍以上的显存节省。