智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Git分支策略与CI/CD集成:从混乱到有序的团队协作重构

Git分支策略与CI/CD集成:从混乱到有序的团队协作重构

当5人团队在master上直接开发,平均每天3次冲突、2次误推送,发布前需手动合并2小时。引入Git Flow + 受保护分支 + Jenkins流水线后,冲突率下降90%,发布耗时从2小时缩短至8分钟。本文基于Git 2.39.1、Jenkins 2.414.2、SonarQube 9.9,详细拆解分支策略设计、Code Review强制规则、以及自动化流水线的完整配置,附赠3个真实踩坑记录。

持续研究战略工具箱 214 49 0 20天前
Git分支策略与CI/CD集成:团队协作中的版本控制落地实践

Git分支策略与CI/CD集成:团队协作中的版本控制落地实践

当团队从5人扩张到20人,主分支直接提交导致的代码冲突率飙升300%,发布流程耗时从30分钟延长到2小时。本文基于Git 2.39.1与GitLab 15.11,分享一套经过生产验证的分支策略(Trunk-based + 短生命周期特性分支)、Code Review强制规则(至少2人批准+流水线绿灯),以及Jenkins Pipeline与GitLab CI的双轨集成方案。通过引入pre-comm

阿哲ProductLab 201 47 0 20天前
Prompt Engineering实测:从7.2%到91.4%准确率的金融意图识别调优全记录

Prompt Engineering实测:从7.2%到91.4%准确率的金融意图识别调优全记录

在金融领域意图识别任务中,我通过系统性实验对比了4种Prompt策略:零样本、少样本、结构化输出与思维链(CoT)。在1000条真实用户咨询数据上,准确率从基线零样本的7.2%提升至最终方案的91.4%,单条token消耗从342降至187,成本下降45%。本文记录了完整的实验设计、代码实现与踩坑细节,包括GPT-4o-mini版本下的温度参数敏感性分析、JSON Schema强制输出对解析失败率

熊猫每天复盘 215 53 0 20天前
asyncio重构Flask API:请求耗时从980ms降至210ms

asyncio重构Flask API:请求耗时从980ms降至210ms

在一次电商订单导出功能优化中,我使用Python 3.10的asyncio将三个串行HTTP调用改为并发协程,配合httpx.AsyncClient连接复用,将接口P95延迟从980ms压到210ms,吞吐量提升4.2倍。文章会给出完整的before/after代码、asyncio.Semaphore限流细节、以及uvloop替换事件循环的实测数据。如果你是Flask/Django开发者,且接口里

保持好奇网络学习者 191 49 0 20天前
RAG召回率从61%到89%:chunk重构与rerank二阶段调优实录

RAG召回率从61%到89%:chunk重构与rerank二阶段调优实录

在私有知识库问答项目中,基线RAG体系(BGE-large + 固定256字chunk)的Hit@5召回率仅61.3%,答案准确率不足五成。本文记录完整调优链路:通过自适应chunk(按Markdown标题与段落切分,窗口重叠64字)将召回率提升至74.8%;切换bge-m3 embedding(输出维度1024)后召回率升至81.2%,但引入bge-reranker-large进行二阶段精排后,

灯下漫游集 210 49 0 20天前
LangChain 0.3手写Agent循环:工具记忆异常全解

LangChain 0.3手写Agent循环:工具记忆异常全解

当AutoGPT的自主循环在真实业务中频繁陷入死循环或工具调用幻觉时,我决定用LangChain 0.3.7从零手写一个仅200行代码的Agent内核。本文记录了在Python 3.11环境下,如何用Pydantic v2定义严格工具Schema、实现基于Message的滑动窗口记忆、通过try-except重构工具异常并注入ReAct循环。实测在10轮MaxStep限制下,工具调用成功率从Aut

重新出发增长成长记 211 48 0 20天前
RAG检索质量调优实录:chunk粒度、Embedding选型与Rerank排序的暴力对比

RAG检索质量调优实录:chunk粒度、Embedding选型与Rerank排序的暴力对比

线上一个基于LangChain的RAG问答系统,在128个文档、2000+分块规模下,基础版Hit Rate仅67%,Top-5准确率惨不忍睹。本文记录了从Naive Chunk到固定大小窗口、再到语义分割的调整过程,同时对比了`text2vec-large-chinese`、`bge-large-zh-v1.5`和`m3e-base`三种Embedding模型,最后引入`bge-reranker

企业级机器学习实践者 233 46 0 20天前
LangChain 0.3手写Agent:记忆管理与循环控制从零实现

LangChain 0.3手写Agent:记忆管理与循环控制从零实现

本文基于 LangChain 0.3.1 与 AutoGPT 设计思路,从零实现一个具备工具调用、短期/长期记忆、错误重试与循环上限控制的 AI Agent。代码核心仅 280 行,支持自定义工具(天气查询、计算器、数据库查询),在 12 个真实任务上测试,工具调用准确率 91.7%,平均单轮响应延迟 1.8s(GPT-4o-mini)。文中会暴露一个典型坑:LangChain 0.3 中 `Ag

认真Python玩家手记 266 58 0 20天前
React/Vue项目从Context到Zustand/Pinia重构:迁移步骤与性能对比

React/Vue项目从Context到Zustand/Pinia重构:迁移步骤与性能对比

在维护一个拥有60+页面、30+全局状态的中后台项目时,我们遇到了Context频繁re-render导致的性能瓶颈——某列表页滚动时FPS低至20。为此,我将React 18项目从useContext+useReducer迁移至Zustand 4.5,同时将Vue 3.4项目从Provide/Inject迁移至Pinia 2.1。本文记录了完整的迁移方案对比、步骤拆解以及迁移前后的性能数据:Re

持续研究战略工具箱 211 55 0 20天前
Prompt模板迭代实录:从37%到89%的NER准确率提升

Prompt模板迭代实录:从37%到89%的NER准确率提升

在实体识别任务中,我通过12组Prompt对比实验,发现模板中的标点符号与示例顺序能让准确率波动52%。最终方案引入角色锚定与结构化输出约束,token消耗仅增加18%,却将F1值从0.37提升至0.89。文中记录了完整的实验矩阵、失败案例与成本曲线,附赠一套可复用的Prompt评估脚本。

业余开源爱好者 210 48 0 20天前
FastAPI接口耗时3700ms降至180ms:profile定位与三层缓存实战

FastAPI接口耗时3700ms降至180ms:profile定位与三层缓存实战

线上订单列表API在QPS 200时P99延迟飙到3.7s,数据库CPU 92%。我通过cProfile+py-spy定位到N+1查询和JSON序列化两大瓶颈,用`selectinload`替代`lazy='subquery'`,再叠加Redis二级缓存和LRU本地缓存,最终P99降到180ms,QPS提升5.2倍。文章记录完整调优过程,含FastAPI+SQLAlchemy 2.0+Postgr

实战派推理加速应用札记 216 53 0 20天前
用asyncio重构Flask API,QPS从120飙升到2100的完整记录

用asyncio重构Flask API,QPS从120飙升到2100的完整记录

一个内部报表接口,平均响应时间850ms,高峰期线程池被打满,CPU利用率却只有35%。排查发现80%的时间阻塞在第三方HTTP调用和数据库IO上。我用了三天时间,把Flask+requests同步栈改造成asyncio异步栈,配合uvloop和httpx,最终QPS从120提升到2100,P99延迟从2.3s降到380ms。本文不聊虚的,直接给出before/after代码、压测脚本、以及我在迁

纸上问道 263 51 0 20天前
用asyncio重构Flask API,QPS提升280%的完整记录

用asyncio重构Flask API,QPS提升280%的完整记录

面对一个基于Flask 2.2.5 + Gunicorn的Web服务,在压测中发现其QPS仅为320,且CPU利用率不足40%。通过引入asyncio 3.11.4将阻塞式IO调用改为异步协程,并配合uvloop 0.19.0,最终将QPS提升至1210,P99延迟从890ms降至210ms。本文记录了一次真实的重构过程,包括代码改造、线程池调优、连接池复用等细节,以及过程中遇到的坑(如async

需求持续优化的程序员 218 43 0 20天前
7B模型LoRA微调实录:显存8G下的QLoRA训练与推理对比

7B模型LoRA微调实录:显存8G下的QLoRA训练与推理对比

本文记录了一次完整的7B模型微调实践,使用QLoRA在单张RTX 3090(24G显存)上将基座模型显存占用压至8.2G,微调后模型在领域问答任务上的BLEU从0.21提升至0.67,而LoRA模块参数量仅占全模型的0.6%。文中包含从数据清洗到训练配置的完整代码,以及loss曲线和推理效果对比,重点解决量化后训练不稳定、中文分词器截断两个实际问题。如果你正在犹豫要不要上LoRA,这篇文能帮你少踩

长期关注运营研究簿 182 40 0 20天前
FastAPI接口耗时1180ms降至90ms:Profile与缓存优化全记录

FastAPI接口耗时1180ms降至90ms:Profile与缓存优化全记录

接手一个内部报表服务,发现核心聚合接口在100并发下P95耗时高达1180ms,数据库CPU直接飙到80%。本文记录一次完整的API性能调优过程:从cProfile和py-spy定位瓶颈,到SQLAlchemy懒加载陷阱,再到Redis缓存热点数据与SQL索引重建。优化后P95降至90ms,数据库CPU降到12%,单机QPS从210提升到2400。文章包含完整的Profiling命令、缓存策略代码

认真做创新拆解所 246 56 0 20天前
Git分支策略与Code Review流水线:支撑300人团队的协作体系

Git分支策略与Code Review流水线:支撑300人团队的协作体系

当团队从15人扩张到300人,主干开发模式导致的代码冲突和发布事故频发。本文基于Git 2.39.1和GitLab 15.11,详解我们落地的一套分支策略:trunk-based + 短期特性分支,配合强制Code Review流水线(MR Approval Rules + 机器人自动检查)和CI/CD门禁(Jenkins 2.414.2 + SonarQube 10.2)。通过这套体系,我们将特

认真做商业随身笔记 232 56 0 21天前
LangChain 0.3手写AutoGPT式Agent:记忆与循环控制全拆解

LangChain 0.3手写AutoGPT式Agent:记忆与循环控制全拆解

当LangChain官方Agent在长任务中token浪费率达37%时,我决定手写一个轻量AutoGPT核心。本文基于langchain 0.3.1+Python 3.11,实现一个仅用236行代码的Agent,支持工具动态注册、双缓冲记忆管理、异常熔断与步数预算控制。在“查询数据库并生成周报”任务中,对比ReAct Agent,token消耗降低52%,任务成功率从79%提升至94%。全程附可运

小北_Product 211 54 0 21天前
RAG召回率从61%到89%:chunk重切、embedding换代与rerank落地的完整记录

RAG召回率从61%到89%:chunk重切、embedding换代与rerank落地的完整记录

两个月前,我们基于LlamaIndex搭建的RAG问答系统在200条内部技术文档测试集上召回率仅有61%,Top-5命中率惨不忍睹。经过对chunk粒度、embedding模型和检索后处理的三轮改造,最终将召回率提升至89%,Top-5命中率提升至93%。本文将完整记录这三步优化的决策依据、核心代码和踩坑细节,包含具体的版本号(LlamaIndex 0.10.43、BGE-M3、bge-reran

一只蜗牛认真测试 266 55 0 21天前
向量数据库选型实录:Milvus与Qdrant在2000万级数据下的性能对决

向量数据库选型实录:Milvus与Qdrant在2000万级数据下的性能对决

在电商以图搜图场景中,我们对比了Milvus 2.4.1与Qdrant 1.9.2在2000万条768维向量下的表现。Milvus在查询延迟上以P99 12ms领先Qdrant的18ms,但Qdrant在内存占用上仅为Milvus的1/3。本文记录了完整的部署参数、压测代码与调优细节,包含磁盘索引构建的踩坑过程,最终给出了不同业务规模下的选型建议。

长期主义商业学习者 223 46 0 21天前
asyncio重构Flask API:请求耗时从450ms降至120ms

asyncio重构Flask API:请求耗时从450ms降至120ms

某内部系统的用户详情接口,因串行调用三个独立上游服务,P99延迟飙升至860ms,严重影响前端体验。本文记录一次基于asyncio的并发改造全过程:引入`httpx.AsyncClient`配合`asyncio.gather`,将三次串行RPC改为并发请求,同时处理了连接池复用与超时熔断。改造后P95耗时从450ms降至120ms,吞吐量提升3.2倍,CPU占用反而下降。文中提供完整before/

小白_GrowthLab 224 50 0 21天前
上一页 1 2 3 ... 9 10 11 ... 31 32 33 下一页

作者推荐