智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
FastAPI+SQLAlchemy性能调优:一次接口从1.2秒优化到80毫秒的完整记录

FastAPI+SQLAlchemy性能调优:一次接口从1.2秒优化到80毫秒的完整记录

某电商后台订单列表接口在并发200时P99响应高达1.2秒,数据库CPU被打满。本文用py-spy定位到N+1查询和缺失索引两个瓶颈,通过SQLAlchemy的selectinload、复合索引与Redis缓存三层优化,最终P99降到80ms,QPS从150提升到1100。文中包含完整的profiling命令、可运行的优化代码和wrk压测对比数据。

稳步前行自动化学习者 21 6 0 1天前
React 18 与 Vue 3 项目从 Context/Props 迁移到 Zustand 和 Pinia 的状态管理实践

React 18 与 Vue 3 项目从 Context/Props 迁移到 Zustand 和 Pinia 的状态管理实践

在一个中型后台管理系统里,我们用 React Context + Props 层层透传管理状态,结果一次表单联动导致 47 个组件重渲染,首屏可交互时间从 1.2s 涨到 2.8s。后来我把 React 侧迁到 Zustand 4.5、Vue 侧迁到 Pinia 2.1,重渲染组件数降到 6 个,TTI 回到 1.3s。这篇文章记录迁移方案对比、具体步骤、踩过的坑和最终性能数据,适合正在纠结要不要

实战派知识库研究笔记 12 2 0 1天前
从Git Flow到Trunk-Based:一套支撑30人团队的Git分支策略与CI/CD落地配置

从Git Flow到Trunk-Based:一套支撑30人团队的Git分支策略与CI/CD落地配置

团队从5人扩到30人后,混乱的分支合并让发布周期从3天拖到2周,线上事故率翻倍。本文记录了我们从Git Flow迁移到Trunk-Based Development的完整过程:分支模型如何设计、Code Review如何用GitHub Actions+CODEOWNERS卡住质量、CI/CD如何用GitLab CI 16.9配置多环境流水线。含真实YAML配置、合并冲突率从37%降到6%的数据,以

北岸读书集 17 3 0 1天前
从零手写AI Agent:LangChain工具调用、记忆与循环控制实现

从零手写AI Agent:LangChain工具调用、记忆与循环控制实现

调用OpenAI API做一个聊天机器人只要20行代码,但要让模型自主决定"调哪个工具、传什么参数、失败了怎么重试",坑就来了。本文基于LangChain 0.3.7和GPT-4o-mini,从零手写一个可运行的AI Agent,实测工具调用准确率从62%提升到94%,单次任务平均耗时从8.3秒降到4.1秒。文中包含完整的工具定义、记忆管理、错误重试和循环控制代码,所有代码均可直接运行。

慢慢变强创业成长记 19 4 0 1天前
Milvus与Qdrant向量数据库选型:千万级向量场景实测对比

Milvus与Qdrant向量数据库选型:千万级向量场景实测对比

在图文推荐场景下,我们对 Milvus 2.4.0 与 Qdrant 1.9.0 进行了同硬件、同数据集的对比测试。1000 万条 768 维向量,Milvus 在 HNSW 索引下 QPS 达到 1850,Qdrant 为 1420;内存占用 Qdrant 低约 30%,但 Milvus 在批量写入和分布式扩展上更稳。本文给出部署步骤、查询代码、踩坑记录与选型建议,帮你少走一周弯路。

长期关注战略增长记 18 3 0 1天前
FastAPI + Flask 双栈 API 性能调优:一次 P99 从 1.8s 降到 120ms 的完整记录

FastAPI + Flask 双栈 API 性能调优:一次 P99 从 1.8s 降到 120ms 的完整记录

某内部订单查询 API 在 QPS 200 时 P99 飙到 1.8s,CPU 却只用了 30%,典型的"等待型"瓶颈。本文用 cProfile + py-spy 定位到 N+1 查询和同步阻塞调用,通过索引优化、批量查询、Redis 缓存三级改造,在 FastAPI(0.110)和 Flask(3.0)两套服务上分别压测验证:P99 降至 120ms,QPS 从 210 提升到 1600,数据库

向内求解全栈修炼册 19 4 0 1天前
Milvus 2.4 与 Qdrant 1.9 向量库选型对比:百万级商品召回实测

Milvus 2.4 与 Qdrant 1.9 向量库选型对比:百万级商品召回实测

本文面向电商以图搜图/语义召回场景,在 100 万条 768 维向量、TopK=10 的条件下,实测 Milvus 2.4.1(standalone,HNSW)与 Qdrant 1.9.4 的部署难度、索引构建耗时、QPS、P99 延迟与内存/磁盘占用。结果显示:Qdrant 单机部署更轻、冷启动更快,P99 约 12ms;Milvus 在批量写入与水平扩展上更稳,P99 约 18ms,但常驻内存

长期关注战略工具箱 18 3 0 1天前
从42%到89%:一次RAG检索增强生成系统的三阶段优化记录

从42%到89%:一次RAG检索增强生成系统的三阶段优化记录

本文记录了一个面向企业内部技术文档的RAG问答系统优化过程。上线初期,Top-5召回率仅42%,答案可用率不足50%。通过三步改造——chunk策略从固定512 token改为语义分段+重叠、embedding从text-embedding-ada-002切换到bge-large-zh-v1.5、引入bge-reranker-large重排——最终Top-5召回率提升至89%,答案可用率达86%,

青空煮茶集 26 6 0 1天前
从0.62到0.89:一次RAG检索增强生成系统的三段式优化记录

从0.62到0.89:一次RAG检索增强生成系统的三段式优化记录

本文记录了一个真实RAG系统(检索增强生成)的优化过程。上线初期,基于固定512字符切分与text-embedding-ada-002的方案,在200条人工标注问答集上召回率仅0.62,答案准确率0.58。通过三步改造——chunk策略从固定窗口改为语义+递归切分、embedding从Ada-002切换到bge-large-zh-v1.5、引入bge-reranker-large重排序,最终召回率

深度学习方法论 12 2 0 2天前
Milvus 2.4与Qdrant 1.9向量数据库选型对比:部署、查询性能与资源占用实测

Milvus 2.4与Qdrant 1.9向量数据库选型对比:部署、查询性能与资源占用实测

在千万级商品图文检索场景中,我们对比了Milvus 2.4.1和Qdrant 1.9.2的部署复杂度、查询延迟、内存占用和召回率。实测显示:Qdrant在单节点512MB内存下可支撑50万向量,P99延迟18ms;Milvus分布式版需4GB内存起步,但百万级向量下QPS领先37%。本文含完整Docker部署步骤、Python查询代码和踩坑记录,帮你根据业务规模做出选型决策。

长期关注品牌实践笔记 24 6 0 2天前
Docker Compose编排多服务容器化部署与健康检查顺序控制

Docker Compose编排多服务容器化部署与健康检查顺序控制

本文以一个真实的多服务项目为例,分享如何使用Docker Compose完成容器化部署。项目包含Nginx、Spring Boot应用、MySQL 8.0和Redis 7.2四个服务,通过自定义bridge网络实现服务隔离与通信,使用命名卷持久化数据,并借助healthcheck与depends_on的condition配置控制启动顺序。文章给出完整可运行的docker-compose.yml,并

慢慢变强创业成长记 16 2 0 2天前
我用12组Prompt对比测试,把电商评论分类准确率从78%提升到94%

我用12组Prompt对比测试,把电商评论分类准确率从78%提升到94%

同一个文本分类任务,只改Prompt不换模型,效果能差多少?我以电商评论情感分类为例,用GPT-4o-mini和Claude 3.5 Haiku做了12组Prompt对比实验。结果显示:零样本Prompt准确率仅78%,加入角色设定+少样本示例+结构化输出约束后提升至94%,同时单次token消耗从320降至210,月成本从$43降到$28。本文完整记录了实验设计、代码实现、踩坑细节和性能数据,供

数据库正在思考的程序员 19 2 0 2天前
LoRA微调7B大模型全流程:从数据构建到推理效果对比

LoRA微调7B大模型全流程:从数据构建到推理效果对比

本文记录了我在单张24G显存显卡上,用LoRA/QLoRA微调Qwen2.5-7B-Instruct的完整过程。训练数据为3200条垂直领域问答对,采用4-bit量化+LoRA(r=16, alpha=32),训练3个epoch,最终loss从1.82降至0.63。文中包含数据格式、训练配置、loss曲线分析、推理效果对比,以及显存溢出、loss震荡等踩坑记录,适合想动手微调7B模型的开发者参考。

深夜后端方法论 8 1 0 2天前
FastAPI接口从1200ms降到86ms:一次SQLAlchemy查询与缓存调优记录

FastAPI接口从1200ms降到86ms:一次SQLAlchemy查询与缓存调优记录

线上一个FastAPI商品详情接口P99跑到1200ms,QPS一过200就开始大量超时。用py-spy火焰图定位到87%的时间耗在SQLAlchemy的N+1查询上,单个请求打了43条SQL。本文记录了从profiling、查询重构、Redis缓存到压测验证的完整过程,最终P99降到86ms,QPS从180提升到1400+,附完整代码和locust压测数据。

保持好奇服务器修炼册 15 3 0 2天前
从58%到94%准确率:一次商品评论情感分类的Prompt Engineering实验记录

从58%到94%准确率:一次商品评论情感分类的Prompt Engineering实验记录

本文以电商评论三分类任务为例,对比了Zero-shot、Few-shot、CoT、角色扮演等6种Prompt方案。在GPT-4o-mini与Qwen2.5-7B-Instruct上实测,best prompt将准确率从58%提升至94%,单条token消耗从312降至187。文中包含完整可运行代码、温度参数调优过程,以及我踩过的3个典型坑,适合正在做LLM应用落地的同学参考。

云端赶路集 18 4 0 2天前
从0.63到0.89:一次RAG检索增强生成系统的分层优化记录

从0.63到0.89:一次RAG检索增强生成系统的分层优化记录

本文记录了一个面向企业内部知识库的RAG系统优化过程。原始方案在2000条文档上Top-5命中率仅0.63,答案可用率约58%。通过将固定512字符切分改为语义+递归混合chunk策略、把text-embedding-ada-002换成bge-large-zh-v1.5、并引入bge-reranker-large重排,最终Top-5命中率提升到0.89,端到端P95延迟从1.9s升到2.6s。文中

鹤正在学习日记 20 5 0 2天前
React 18迁移Zustand与Vue 3迁移Pinia:从Context/Props到状态管理库的性能对比与落地记录

React 18迁移Zustand与Vue 3迁移Pinia:从Context/Props到状态管理库的性能对比与落地记录

我们维护的一个中型后台系统,React 18.2 + Vue 3.3 双栈并存,页面级组件平均 props drilling 深度达到 5 层,Context 更新导致 300+ 组件无效重渲染,首屏 TTI 一度到 3.4s。本文记录我们把 React 侧从 Context/useReducer 迁到 Zustand 4.5、Vue 侧从 props/emits 迁到 Pinia 2.1 的完整

模型部署实践者 30 6 0 2天前
Milvus 2.5 与 Qdrant 1.12 向量数据库选型对比:千万级图文检索场景实测

Milvus 2.5 与 Qdrant 1.12 向量数据库选型对比:千万级图文检索场景实测

在千万级图文检索业务中,我们对 Milvus 2.5.4 与 Qdrant 1.12.4 做了同机同数据集的对比测试。单节点 16C64G、1000 万条 768 维向量、HNSW 索引,Qdrant P99 延迟 18ms、内存占用 21GB;Milvus 集群模式 P99 延迟 27ms、内存占用 34GB。本文给出完整部署脚本、压测代码与踩坑记录,帮你按业务规模做取舍。

生产级多模态方法论 32 8 0 3天前
Docker Compose编排多服务容器化部署与健康检查启动顺序配置详解

Docker Compose编排多服务容器化部署与健康检查启动顺序配置详解

本文以一个真实的前后端分离项目为例,分享如何使用Docker Compose编排Nginx、Spring Boot、MySQL、Redis四个服务。通过自定义bridge网络、命名卷挂载、healthcheck健康检查与depends_on条件启动,将服务启动成功率从62%提升至99%,冷启动时间从平均48秒压缩至22秒。文中包含完整可运行的docker-compose.yml与Dockerfil

路过的数据库玩家手记 10 2 0 3天前
Git分支策略与CI/CD集成:基于GitLab 16.8的团队协作工作流配置详解

Git分支策略与CI/CD集成:基于GitLab 16.8的团队协作工作流配置详解

团队从SVN迁移到Git后,分支混乱、合并冲突频发、上线靠手动打包的问题困扰了我们半年。经过三个迭代的调整,我们基于GitLab 16.8落地了一套包含Git Flow简化分支模型、Merge Request强制Code Review、GitLab CI流水线的完整工作流,将平均合并冲突处理时间从40分钟降到8分钟,发布频率从双周一次提升到每周两次。本文分享这套工作流的真实配置文件和踩坑记录。

暮色煮茶集 20 3 0 3天前
上一页 1 2 3 ... ... 31 32 33 下一页

作者推荐