智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Prompt工程调优实录:从3.2%到91.4%的指令抽取F1提升

Prompt工程调优实录:从3.2%到91.4%的指令抽取F1提升

在构建一个基于GPT-4o-mini的电商评论信息抽取系统时,我经历了从“能跑”到“能用”的Prompt调优全过程。初期零样本Prompt的F1仅3.2%,经过结构化指令、少样本示例与格式约束的三轮迭代,最终在200条测试集上将F1提升至91.4%,单条token消耗从412降至295。本文将公开完整的Prompt版本演进、消耗对比与踩坑记录,包含可直接运行的Python评测脚本,适合正在用LLM

重新出发增长成长记 49 8 0 5天前
React 19与Vue 3.5下从Props钻取到Zustand/Pinia的状态迁移实录

React 19与Vue 3.5下从Props钻取到Zustand/Pinia的状态迁移实录

项目从16个组件层层透传props到引入Zustand 5与Pinia 3,重构后组件重渲染次数平均下降73%,首屏交互响应时间从210ms降至95ms。本文记录了在React 19.2与Vue 3.5.17双技术栈下,从Context/Props方案迁移至状态管理库的完整决策树——包括何时该无痛迁移、zustand的selector陷阱、Pinia的setup store与组合式API的冲突处理

持续迭代创业修炼册 41 5 0 5天前
LangChain与AutoGPT启发下:从零手写Agent循环控制与记忆管理

LangChain与AutoGPT启发下:从零手写Agent循环控制与记忆管理

当LangChain的ConversationBufferWindowMemory在长对话中吃掉80%的token预算时,我意识到框架的便利背后是失控的成本。本文记录了我基于AutoGPT的规划-执行模式,用Python手写一个轻量级Agent的过程:仅用180行代码实现了工具注册、滑动窗口记忆、JSON错误重试与最大迭代限制。在模拟的订票场景中,该Agent将API调用失败率从42%降至11%,

持续研究产品观察室 45 7 0 5天前
Docker Compose编排多服务:网络隔离、健康检查与启动顺序全解析

Docker Compose编排多服务:网络隔离、健康检查与启动顺序全解析

一个典型的中型项目,从单体应用拆分为6个微服务后,部署复杂度呈指数级上升。本文基于Docker Compose 2.24.2与Docker Engine 26.1.1,分享一套生产可用的编排方案。通过自定义桥接网络实现服务隔离,利用named volume持久化MySQL与Redis数据,配置HTTP/TCP双重健康检查机制,并使用depends_on条件控制启动顺序。整套配置使得服务启动时间从原

暮色煮茶集 59 13 0 5天前
LangChain与AutoGPT双引擎:手写Agent循环控制与记忆容错机制

LangChain与AutoGPT双引擎:手写Agent循环控制与记忆容错机制

在构建一个需要调用6个外部工具的证券分析Agent时,我遇到三个致命问题:无状态对话导致上下文漂移、单次API异常导致整个循环崩溃、以及LangChain 0.3.7与AutoGPT架构在工具调用链上的隐式冲突。本文记录一个使用LangChain的`AgentExecutor`重写AutoGPT式推理循环的实践,实测对话轮次从7轮压缩至4轮,工具调用成功率从72%提升至96%。你将看到如何用`Co

松鼠追着需求跑 35 7 0 6天前
Docker Compose编排多服务项目:网络卷挂载健康检查与启动顺序全解析

Docker Compose编排多服务项目:网络卷挂载健康检查与启动顺序全解析

本文基于实际项目,分享一套包含Nginx、Golang API、PostgreSQL、Redis、RabbitMQ五个服务的docker-compose.yml配置。重点讲解自定义网络隔离、命名卷持久化、healthcheck健康门控及depends_on条件启动,解决服务启动竞态问题。配置在Docker Compose v2.20.0 + Docker Engine 24.0.2下验证通过,服务

小北_Cloud 37 8 0 6天前
asyncio重构Flask接口:QPS从327到1892的异步改造实录

asyncio重构Flask接口:QPS从327到1892的异步改造实录

某次压力测试中,我负责的订单查询API在200并发下QPS仅327,RT高达305ms,数据库连接池被打爆。通过引入asyncio+httpx+asyncpg,将同步阻塞式I/O改为异步非阻塞,仅改动47行代码,QPS提升至1892,RT降至52ms。本文记录完整改造过程,包含asyncio.Semaphore限流、uvloop事件循环替换、asyncpg连接池调优等关键细节,并附上wrk压测数据

认真做交互方法手册 52 11 0 6天前
Prompt工程调优实录:信息抽取任务下5版模板的Token与精度博弈

Prompt工程调优实录:信息抽取任务下5版模板的Token与精度博弈

在财务公告结构化抽取任务中,我对比了5版Prompt模板,从零样本到Few-shot再到思维链。实验基于GPT-4-turbo(1106-Preview),使用QPS=1的限流配置。结果显示:**结构化指令+3个示例**的模板在F1分数上比朴素模板提升22.7%,但Token消耗增加41%。最终通过**动态截断+关键字段前置**策略,将单条成本压至0.031美元,同时F1稳定在0.89。文中附全部

日志拒绝内耗观察员 70 18 0 6天前
RAG准确率从68%到91%:chunk重构、Embedding换血与Rerank落地的全记录

RAG准确率从68%到91%:chunk重构、Embedding换血与Rerank落地的全记录

三个月前,我负责的智能客服知识库RAG系统在200+真实问询测试集上命中率只有68.2%,Top-3召回率不足80%。排查发现,罪魁祸首是固定的256 token分块把技术文档中的表格和代码切得七零八碎;其次,老旧的`text2vec-large-chinese`在语义匹配上严重拖后腿。本文记录了完整的优化链路:针对文档结构定制Markdown感知分块器、切换至BGE-large-zh(v1.5)

数据库正在思考的程序员 42 8 0 6天前
asyncio重构Flask接口,QPS从120飙到800+

asyncio重构Flask接口,QPS从120飙到800+

某电商订单系统上线大促前,发现订单详情接口在500并发下平均延迟1.2秒,QPS仅120。用asyncio+httpx替换requests同步调用,配合Semaphore限流和连接复用,仅改动40行代码,延迟降至180ms,QPS提升至850。本文记录完整的压测数据、踩坑过程(包括EventLoop阻塞、超时参数陷阱)和可复用的代码模板。

终身学习运维学习者 43 4 0 6天前
Docker Compose编排实践:多服务依赖、健康检查与启动顺序控制

Docker Compose编排实践:多服务依赖、健康检查与启动顺序控制

部署一个由Nginx、Spring Boot应用、PostgreSQL和Redis组成的项目,直接`docker-compose up`就绪后,服务间依赖乱序导致连接失败。本文结合一个真实的中台项目,展示如何设计docker-compose.yml,覆盖自定义网络、持久化卷挂载、健康检查机制及depends_on条件控制,确保容器启动顺序可靠。配置上线后,服务启动成功率从70%提升至100%,平均

小白Linux 51 9 0 6天前
7B模型LoRA微调显存爆炸?QLoRA+4bit量化拯救记

7B模型LoRA微调显存爆炸?QLoRA+4bit量化拯救记

上周用两张3090微调Qwen2.5-7B做法律文书摘要,全量微调直接OOM,LoRA(rank=8)勉强跑通但显存峰值26.8GB。换用QLoRA+NF4量化后,峰值显存直降到11.2GB,训练速度只慢18%。最终在2000条法律判决书上微调3个epoch,ROUGE-L从0.42提升到0.57,推理时模型能正确引用法条编号。本文记录完整过程:从数据清洗、bitsandbytes配置、PEFT参

持续研究产品观察室 66 13 0 6天前
Prompt工程化调优实录:基于GPT-4o的SQL生成任务,从42%到89%准确率

Prompt工程化调优实录:基于GPT-4o的SQL生成任务,从42%到89%准确率

本文记录了一次针对自然语言转SQL任务的Prompt调优全过程。通过5轮迭代实验,对比了零样本、Few-shot、CoT及结构化约束等多种Prompt策略。实验基于OpenAI GPT-4o (gpt-4o-2024-05-13) 与gpt-3.5-turbo-0125,在Spider验证集抽取的200条难例上测试。最终方案通过引入Schema感知与输出格式约束,将执行准确率从基线42.5%提升至

一只熊猫偶尔重构日记 53 9 0 6天前
React 19与Vue 3.5状态管理迁移实录:从Context/Props到Zustand与Pinia的架构重塑

React 19与Vue 3.5状态管理迁移实录:从Context/Props到Zustand与Pinia的架构重塑

随着项目迭代至10万行代码,React Context频繁更新导致组件树re-render耗时从12ms飙升至210ms,Vue3中Props深层透传让维护成本增加40%。本文记录一次为期三周的状态管理层迁移:对比Zustand 5.0与Pinia 3.0在响应式追踪、代码侵入性及包体积(+3.2KB gzip)上的取舍,分享分阶段迁移策略(按模块灰度切换)、性能调优(selector精确订阅使R

喜欢复盘的算法人日常 61 13 0 7天前
asyncio重构Flask接口:Web API并发性能从50到1800 QPS的改造记录

asyncio重构Flask接口:Web API并发性能从50到1800 QPS的改造记录

一个基于Flask+Requests的聚合查询接口,在8核8G机器上压测QPS仅50,TP99高达480ms。通过引入asyncio+aiohttp替换同步IO,并利用`loop.run_in_executor`保留少量CPU密集计算,最终QPS提升至1850,TP99降至32ms。本文记录完整改造链路,包含asyncio.Semaphore限流、连接池复用、超时控制三个关键动作,并附上wrk压测

小白LinuxLab 70 16 0 7天前
RAG召回率从61%到89%:chunk重切、embedding换型与rerank排序的工程实践

RAG召回率从61%到89%:chunk重切、embedding换型与rerank排序的工程实践

在搭建面向企业私有文档的问答系统时,召回质量一度卡在61%的Hit Rate上,表现为“答非所问”和“漏检关键段落”。本文记录一次为期两周的RAG管线优化过程:首先将固定256字符chunk改为基于Markdown标题的语义切分,并引入50%重叠滑动窗口;随后将Embedding模型从`text2vec-large-chinese`切换为`BAAI/bge-large-zh-v1.5`,维度从10

阿洛_Dev手记 63 11 0 7天前
Prompt工程化调优实录:从42%到91%的意图识别准确率跃迁

Prompt工程化调优实录:从42%到91%的意图识别准确率跃迁

同一意图分类任务,朴素Prompt准确率仅42%,经系统化Prompt工程改造后提升至91%。本文记录完整实验过程,对比4种Prompt模板在GPT-4-turbo(gpt-4-0613)下的表现差异,精确统计token消耗:从每次请求平均1876 tokens降至512 tokens,成本降低72.7%。通过few-shot示例筛选、格式约束、思维链引导三步优化,最终在200条测试集上达到F1=

清晨寻光 55 12 0 7天前
FastAPI接口延迟1800ms降至90ms:Profile与缓存优化实录

FastAPI接口延迟1800ms降至90ms:Profile与缓存优化实录

某CRM系统客户列表API在QPS 50时P95延迟飙至1800ms,MySQL CPU打满。通过cProfile定位到N+1查询与ORM序列化热点,配合SQLAlchemy 2.0的selectinload、Redis管道缓存及gzip中间件,将P95降至90ms,QPS提升至800。全程记录PyCharm Profiler火焰图分析、EXPLAIN执行计划解读、缓存穿透防护等细节,附完整代码与

慢热Go玩家手记 48 12 0 8天前
RAG召回率从61%到89%:chunk重切、embedding换代与rerank落地实录

RAG召回率从61%到89%:chunk重切、embedding换代与rerank落地实录

两个月前,我们内部知识库问答系统的召回率(Recall@5)一直卡在61%左右,用户问“发票报销流程”,系统却常把“差旅报销制度”排到后面。问题不在模型,而在RAG管线的三个关键环节:chunk切分太粗导致语义混淆、embedding模型对长尾专有名词表征弱、以及缺失粗排后的精排纠错。本文记录一次完整的RAG系统优化过程——从调整chunk策略(固定256字到语义滑动窗口),到切换embeddin

金鱼会调Bug日记 61 15 0 8天前
LangChain与AutoGPT融合:手写ReAct循环实现Agent记忆与容错机制

LangChain与AutoGPT融合:手写ReAct循环实现Agent记忆与容错机制

当我的AutoGPT项目在处理连续12轮工具调用后因上下文窗口溢出而崩溃时,我意识到单纯堆砌LangChain组件无法解决Agent的长期记忆问题。本文将展示如何用LangChain 0.1.0构建一个仅需387行代码的ReAct Agent,包含自定义工具装饰器、基于SQLite的向量记忆、三级异常恢复机制,以及循环次数硬限制。实测在金融问答场景下,该Agent将工具调用成功率从68%提升至94

长期关注用户研究思考录 51 10 0 8天前

作者推荐