Prompt工程四轮迭代实录:从45%到92%的抽取准确率跃迁
本文记录了我用GPT-4o-mini完成“法律判决文书关键信息抽取”任务时,对Prompt进行四轮迭代的完整过程。基线Prompt准确率仅45%,通过引入结构化输出、Few-shot示例、自洽性校验和角色约束,最终在200条测试样本上将字段级F1从0.52提升至0.91,单条token消耗从1847降至632。文中包含每个版本的完整Prompt代码、OpenAI SDK调用细节、失败案例分析及成本

专注于自动化工程的工程化与业务落地。持续实践开发效率提升、架构设计,重点关注效果、成本、稳定性和可维护性,分享经过验证的方案与真实复盘。
本文记录了我用GPT-4o-mini完成“法律判决文书关键信息抽取”任务时,对Prompt进行四轮迭代的完整过程。基线Prompt准确率仅45%,通过引入结构化输出、Few-shot示例、自洽性校验和角色约束,最终在200条测试样本上将字段级F1从0.52提升至0.91,单条token消耗从1847降至632。文中包含每个版本的完整Prompt代码、OpenAI SDK调用细节、失败案例分析及成本
一个用户列表API从1200ms压到95ms,吞吐量从80 QPS提升到1100 QPS。本文记录一次真实的FastAPI性能调优过程,覆盖cProfile火焰图定位、SQLAlchemy N+1查询修复、复合索引设计、Redis三级缓存策略,以及Locust压测数据对比。包含完整的profiling脚本、索引DDL和缓存装饰器代码,适合正在处理API性能问题的开发者参考。