智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
7B模型LoRA微调实录:从数据清洗到推理显存节省80%

7B模型LoRA微调实录:从数据清洗到推理显存节省80%

上周用单张RTX 3090对Llama-2-7B做领域微调,通过LoRA将训练显存从112GB压到21GB,训练速度仅下降18%。本文记录完整过程:从构造1.2万条法律问答数据,到用peft库配置r=8的LoRA模块,再到loss从2.1降至0.47的曲线变化。实测微调后模型在领域问答的ROUGE-L从0.23提升到0.51,而通用能力几乎无损。包含全部代码和踩坑记录,特别是关于梯度检查点与LoR

运营拆解所 1078 246 0 2026-08-01
asyncio重构Flask接口:Web API吞吐量提升3倍实践

asyncio重构Flask接口:Web API吞吐量提升3倍实践

在一次真实业务压测中,我发现现有Flask同步接口在20并发下平均响应时间飙升至1.2秒,而通过asyncio+httpx异步化改造后,同样20并发下P95延迟降至380ms,吞吐量从85 req/s提升至260 req/s。这篇文章将完整记录我的改造过程,包括协程设计、事件循环配置、以及Python 3.11中asyncio的TaskGroup新语法。你会看到具体的before/after代码,

稳步前行自动化学习者 871 232 0 2026-08-01
Docker Compose多服务编排:网络、健康检查与启动顺序实践

Docker Compose多服务编排:网络、健康检查与启动顺序实践

本文分享一个基于Docker Compose v2.24.2的6服务容器化部署方案,包含Nginx网关、Spring Boot后端、PostgreSQL、Redis、RabbitMQ及定时任务组件。通过自定义bridge网络实现服务隔离,利用healthcheck与depends_on条件组合解决启动顺序问题,卷挂载持久化数据。配置上线后服务启动时间从原来的3分12秒缩短至58秒,容器重启成功率提

重新出发增长成长记 1162 261 0 2026-08-01
Git分支模型与CI/CD集成:从混乱到有序的版本控制演进

Git分支模型与CI/CD集成:从混乱到有序的版本控制演进

团队从3人扩张到12人后,feature分支冲突率从每周15次降至2次,发布周期从2天缩短至4小时。这套基于Git Flow改良的Trunk-Based分支策略,配合GitHub Actions自动化流水线,解决了多环境部署和紧急热修复的痛点。文中分享的分支命名规范、Code Review检查清单、以及Jenkins迁移至Gitea Actions的踩坑记录,都是实际生产环境验证过的方案。如果你正

微光种树录 1016 237 0 2026-08-01
Prompt Engineering调优实录:从8.2%到91.4%准确率的CRF任务迭代

Prompt Engineering调优实录:从8.2%到91.4%准确率的CRF任务迭代

在处理一个中文命名实体识别(NER)任务时,我通过系统性地迭代Prompt模板,将GPT-4-turbo的F1值从初始的8.2%提升至91.4%。全程共消耗约12.6万tokens,对比了零样本、少样本、结构化输出约束、思维链等5种Prompt策略。实测发现:直接提供JSON Schema约束输出格式可使解析错误率降低76%,而加入两个正例和两个反例的少样本策略效果最佳。本文记录了完整的实验数据、

一线数据分析笔记 1037 247 0 2026-08-01
Milvus与Qdrant选型实测:千万级向量检索资源消耗与延迟对比

Milvus与Qdrant选型实测:千万级向量检索资源消耗与延迟对比

在电商以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.2在相同数据集(1000万条768维向量)下的部署复杂度、查询延迟与内存占用。实测结果显示:Qdrant在单机SSD模式下P99延迟低至23ms,内存占用仅3.2GB;Milvus在分布式集群下吞吐更高,但单机部署时索引构建耗时是Qdrant的2.3倍。本文记录了完整的部署步骤、性能压测数据与踩坑经验,供选型参考。

复盘增长记 1207 262 0 2026-08-01
React 19与Vue 3.5下的状态管理迁移:从Context到Zustand/Pinia的工程实践

React 19与Vue 3.5下的状态管理迁移:从Context到Zustand/Pinia的工程实践

当项目超过50个组件、状态更新导致首屏渲染耗时从210ms飙升至780ms时,Context/Props已显疲态。本文记录一次真实的中台系统重构:对比React 19的Context + useReducer与Zustand 5.x、Vue 3.5的provide/inject与Pinia 3.x在性能、代码量、可维护性上的差异。通过具体代码演示迁移步骤,并附上LCP从2.8s降至1.2s、组件重

缓存先跑起来的程序员 992 252 0 2026-08-01
Prompt Engineering实测:5轮迭代让GPT-4o输出准确率从67%升至92%

Prompt Engineering实测:5轮迭代让GPT-4o输出准确率从67%升至92%

本文基于实际业务场景(电商评论情感分类),记录了对GPT-4o(gpt-4o-2024-05-13)进行Prompt工程优化的完整过程。通过对比零样本、少样本、CoT(思维链)、结构化输出及自一致性(Self-Consistency)5种策略,我发现单纯增加示例token消耗增加87%但准确率仅提升4%,而结合角色设定+XML约束+CoT的组合方案,在准确率92%的同时将无效输出比例从15%降至0

一只Rust玩家 1178 252 0 2026-08-01
Git分支策略与Code Review流水线:支撑200人团队的协作体系

Git分支策略与Code Review流水线:支撑200人团队的协作体系

当团队从20人扩张到200人,原先“一条master走天下”的工作流彻底崩坏——合并冲突日均17次,线上事故3起,代码审查形同虚设。本文基于Git 2.39.1与GitLab 15.11,拆解一套经过生产环境验证的分支策略:trunk-based与GitFlow的折中方案,配合基于Merge Request的强制Code Review流水线,以及Jenkins 2.414.2驱动的CI/CD集成。

边学边做人工智能学习者 1160 260 0 2026-08-01
Docker Compose编排多服务:网络隔离、健康检查与启动顺序实战

Docker Compose编排多服务:网络隔离、健康检查与启动顺序实战

本文分享一个真实项目中的docker-compose.yml配置,包含Nginx、Spring Boot、PostgreSQL、Redis四个服务。通过自定义网络实现服务隔离,使用volume持久化数据库和日志,利用healthcheck和depends_on条件控制启动顺序。解决了一个困扰我两天的服务启动竞态问题,最终将服务启动时间从原来的90秒压缩到35秒,并保证了100%的启动成功率。

长期关注增长思考录 1249 284 0 2026-08-01
Git分支策略与CI/CD集成:从混乱到有序的协作重构

Git分支策略与CI/CD集成:从混乱到有序的协作重构

接手一个40人团队,Git仓库日均30+次提交,却因混乱的分支命名和缺乏Code Review导致每周至少2次代码冲突回滚。本文记录我引入Git Flow + GitHub Flow混合模型,配合Jenkins Pipeline实现自动化构建、测试和部署的完整过程。通过规范分支策略、强制执行PR Review、集成SonarQube静态检查,将代码冲突率从15%降至2%,部署失败率降低70%,发布

小顾_Cloud 1138 262 0 2026-08-01
7B模型LoRA微调实录:显存8G也能跑,效果直追全量微调

7B模型LoRA微调实录:显存8G也能跑,效果直追全量微调

上周接到一个任务,要把一个7B模型在垂直领域(法律问答)上做微调。手头只有一张RTX 4090,24G显存,但全量微调7B模型至少需要80G以上显存。试了LoRA和QLoRA两种方案,最终用QLoRA在18G显存下跑完3个epoch,法律问答准确率从基线54.7%提升到82.3%,训练时间比全量微调缩短了70%。本文记录了从数据准备、训练配置到推理效果对比的完整过程,包括踩过的坑和最终的调优方案。

飞鸟偶尔重构 1067 242 0 2026-08-01
Docker Compose编排多服务:网络、卷、健康检查与启动顺序全解析

Docker Compose编排多服务:网络、卷、健康检查与启动顺序全解析

本文分享一个真实项目中的docker-compose配置,包含Nginx、后端API、PostgreSQL、Redis四个服务。通过自定义网络隔离流量、命名卷持久化数据、健康检查控制依赖启动顺序。实测部署后容器启动时间从48秒缩短至22秒,服务可用性从99.2%提升至99.9%。你将看到完整的YAML配置、踩坑记录和性能对比数据。

阿哲_Geek 1191 258 0 2026-08-01
7B模型单卡LoRA微调实录:显存从24G降到9.8G的QLoRA配置与Loss曲线分析

7B模型单卡LoRA微调实录:显存从24G降到9.8G的QLoRA配置与Loss曲线分析

上周用一张RTX 3090对Llama-2-7B做医疗问答指令微调,尝试了LoRA和QLoRA两套方案。最终QLoRA在24G显存下将batch size从4提到16,训练速度反而提升18%,微调后模型在自建医疗QA测试集上的ROUGE-L从0.21涨到0.37。本文记录完整的数据准备、bitsandbytes配置、Peft训练代码,以及两轮微调中遇到的loss震荡和OOM问题,附上实测的loss

旷野独行 1197 261 0 2026-08-01
LangChain与AutoGPT双引擎:手写Agent核心四要素实现剖析

LangChain与AutoGPT双引擎:手写Agent核心四要素实现剖析

当AutoGPT的递归循环撞上LangChain的Tool抽象,一个具备自我纠错能力的Agent需要处理多少细节?本文基于langchain==0.1.0与autogpt==0.4.0,手写一个130行核心代码的Agent,实测在12个工具调用场景下,错误处理率从72%提升至96%,记忆检索耗时从850ms压降至210ms。我们将拆解工具定义的模式匹配陷阱、短期记忆的LRU淘汰策略、以及循环控制中

路过的前端日常 1079 249 0 2026-07-31
Docker Compose编排多服务容器:网络隔离与健康检查实战配置

Docker Compose编排多服务容器:网络隔离与健康检查实战配置

本文分享一个生产环境可用的docker-compose配置,包含Nginx反向代理、Spring Boot应用、PostgreSQL和Redis四个服务。重点解决三个痛点:如何通过自定义网络实现服务隔离与通信、如何用volume卷挂载持久化数据、如何用healthcheck控制启动顺序。配置采用Compose 3.8语法,在Docker 24.0.4环境下验证通过,服务启动时间从手动部署的3分20

企业级自动化开发日志 1080 249 0 2026-07-31
LangChain 0.3手写Agent:工具注册与记忆回收机制实现

LangChain 0.3手写Agent:工具注册与记忆回收机制实现

上周在项目里用AutoGPT框架搭了个客服机器人,结果token消耗日均$47,且对话超过5轮后上下文窗口直接爆掉。这周狠下心来用LangChain 0.3.1从零手写了一个轻量Agent,核心实现了工具注册表、基于时间衰减的记忆管理器、以及带指数退避的错误重试循环。最终在128轮压力测试下,上下文占用稳定在4.2K tokens以内,回答准确率从62%提升至89%。本文直接贴出关键代码和踩坑记录

小禾Coder手记 1276 270 0 2026-07-31
Prompt Engineering调优实录:用Claude-3.5-Sonnet把SQL生成准确率从71%拉到94%

Prompt Engineering调优实录:用Claude-3.5-Sonnet把SQL生成准确率从71%拉到94%

在开发一个自然语言转SQL(NL2SQL)的内部工具时,我花了整整两周时间死磕Prompt。从最初的“一句话+表结构”到最终的“角色扮演+Few-shot+思维链+格式锁定”,在1200条测试集上,SQL生成准确率从71.3%提升至94.1%,单次查询的token消耗从2.1k降至1.4k(得益于结构化输出和长度控制)。本文将完整记录这轮实验过程:5个不同版本的Prompt设计、各自的token开

稳步前行商业成长记 1138 256 0 2026-07-31
Docker Compose多服务编排:网络隔离、健康检查与启动顺序实战

Docker Compose多服务编排:网络隔离、健康检查与启动顺序实战

上周我把一个由Nginx、Spring Boot 3.2、PostgreSQL 16和Redis 7组成的微服务demo从单机脚本迁移到docker-compose,解决了三个棘手问题:服务启动竞态导致连接失败、容器重启后IP漂移、以及健康检查误判。本文分享这套配置,包含自定义网络、命名卷、依赖条件和healthcheck,并给出具体的性能对比数据——迁移后冷启动时间从42秒缩短到18秒,内存占用

小苏_Open 1203 286 0 2026-07-31
Git分支策略与Code Review流水线:支撑200人团队的协作方案

Git分支策略与Code Review流水线:支撑200人团队的协作方案

当团队从20人扩张到200人,原先的Git分支模型彻底崩溃——频繁的merge冲突、代码评审流于形式、CI构建排队超过40分钟。本文基于Git 2.39和GitLab 15.11,分享一套经过双11大促版本迭代验证的分支策略(Trunk-based + Release Branch混合模型)、基于Merge Request的强制Code Review规则,以及通过GitLab CI + Argo

认真做交互拆解所 1078 242 0 2026-07-31
上一页 1 2 3 ... 26 27 28 ... 31 32 33 下一页

作者推荐