智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
用Spring AI+Qdrant实现混合检索服务:Dense、Sparse、RRF与权限过滤

用Spring AI+Qdrant实现混合检索服务:Dense、Sparse、RRF与权限过滤

# 用Spring AI+Qdrant实现混合检索服务:Dense、Sparse、RRF与权限过滤 ## 文章摘要 单一Dense向量检索擅长语义理解,却容易漏掉产品型号、合同编号和专业缩写;纯关键词检索能够精确命中术语,却难以理解自然语言。本文使用Spring Boot、Spring AI和Qdrant设计一个可复用的企业混合检索服务,完成Dense与Sparse双路召回、租户权限过滤、RR

2637 402 1 2026-07-23
企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计

企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计

# 企业级RAG性能优化与质量治理(3):混合检索、重排与权限过滤的生产级设计 ## 文章摘要 前两篇分别讨论了RAG质量问题的总体诊断,以及文档解析与Chunk工程。本篇进入检索核心:为什么企业知识库不能只依赖单一向量召回,Dense、Sparse、Metadata过滤、融合、重排和权限控制应如何组合,以及怎样通过黄金测试集和线上指标持续治理召回质量。本文给出一套可落地的生产级检索架构、数据

2583 385 1 2026-07-23
用Spring Boot搭建一个可版本化的Prompt模板管理器:加载、缓存、灰度与回滚

用Spring Boot搭建一个可版本化的Prompt模板管理器:加载、缓存、灰度与回滚

# 用Spring Boot搭建一个可版本化的Prompt模板管理器:加载、缓存、灰度与回滚 ## 文章摘要 企业AI项目中的Prompt不能长期散落在Java代码里。随着场景增加,需要解决模板版本、环境差异、审批、缓存、灰度、回滚和调用追踪。本文实现一个轻量级Spring Boot Prompt模板管理器:使用数据库保存模板元数据,通过Resource与StringTemplate渲染变量,

2896 418 3 2026-07-20
Spring AI企业级应用实战(2):ChatClient、Advisor与Prompt Template构建统一调用层

Spring AI企业级应用实战(2):ChatClient、Advisor与Prompt Template构建统一调用层

# Spring AI企业级应用实战(2):ChatClient、Advisor与Prompt Template构建统一调用层 ## 文章摘要 上一篇完成了Spring Boot 4.1、Spring AI 2.0与DeepSeek V4接入,但业务代码仍然只是直接调用ChatClient。真实企业项目需要统一管理System Prompt、模板变量、租户信息、请求日志、调用耗时和响应格式。本

2975 420 5 2026-07-20
AI 模型成本战:企业账单从月费百万到精打细算的生存指南

AI 模型成本战:企业账单从月费百万到精打细算的生存指南

AI API价格暴跌93%但企业账单却飙升。六步省钱法:切模型立省50%、模型路由再省30%、语义缓存省25%、Prompt精简省20%、自建推理省80%、成本监控。$15000压到$1500。Gartner预测40%Agentic AI项目将因成本被取消。

2903 393 4 2026-07-14
AI 价格战白热化:三大巨头一周内集体降价,Oracle 暴跌 19%,首尔启动全球首个政府 MCP

AI 价格战白热化:三大巨头一周内集体降价,Oracle 暴跌 19%,首尔启动全球首个政府 MCP

OpenAI/Meta/SpaceXAI一周内集体推低价模型,API价格降至年初1/10。Oracle因AI基建债务1300亿被降级暴跌19%。首尔启动全球首个政府公共数据MCP服务。AI从稀缺资源变成基础设施。

2735 376 3 2026-07-13
AI 智能体商业落地实战:从技术原型到生产部署的完整路径

AI 智能体商业落地实战:从技术原型到生产部署的完整路径

AI Agent从Demo到生产的完整指南:任务原子化拆分、模型路由+缓存+Prompt精简成本降99%、人机协作三级决策、企业集成架构。结合首钢秒级审核、京东2700降到10元、CSDN预判99%代码AI生成。

2914 391 10 2026-07-11
AI 端侧部署实战:模型量化、压缩与本地推理完整指南

AI 端侧部署实战:模型量化、压缩与本地推理完整指南

把大模型部署到手机和边缘设备:模型量化原理、GPTQ/AWQ/GGUF三方案对比、4-bit压缩实测精度损失、Ollama本地推理完整流程、从54GB压到4GB。附量化前后性能对比。

2987 414 4 2026-07-10
GPT-5.6 接入实战:API 调用、成本预估与从 GPT-5.5 迁移的完整指南

GPT-5.6 接入实战:API 调用、成本预估与从 GPT-5.5 迁移的完整指南

明天GPT-5.6全量上线,今天准备好接入。三模型API调用方式、速度拨盘参数详解、成本预估公式、GPT-5.5迁移代码改动量、常见陷阱避坑。月费从473降到31-220元。

3096 395 4 2026-07-09
手搓生产级 AI Agent 系统(5):MCP 协议从零实现——打造 Agent 的应用商店

手搓生产级 AI Agent 系统(5):MCP 协议从零实现——打造 Agent 的应用商店

从零实现MCP协议:JSON-RPC通信、Server/Client架构、工具热插拔自动发现、安全沙箱隔离。Agent启动时自动拉取可用工具,零代码扩展。附与Function Calling的六维对比。

2909 402 5 2026-07-08
手搓生产级 AI Agent 系统(4):A2A 协议——让两个 Agent 互相通信

手搓生产级 AI Agent 系统(4):A2A 协议——让两个 Agent 互相通信

从零实现A2A协议:三种通信模式(广播/点对点/委托)、统一消息格式、任务分配策略、错误自动恢复。双Agent协作安全审查成功率90%,比单Agent高15%。

2904 418 2 2026-07-08
手搓生产级 AI Agent 系统(1):ReAct 核心循环深度实现——从原理到50行代码

手搓生产级 AI Agent 系统(1):ReAct 核心循环深度实现——从原理到50行代码

不依赖框架从零手写ReAct核心循环。拆解三种输出解析策略失败率对比(JSON23%vs正则4%)、四层停止条件、工具描述质量5倍差异实测。50行代码跑通。

3216 423 3 2026-07-07
手搓生产级 AI Agent 系统(3):Agent 与工具系统完整集成——从 ReAct 到自主决策

手搓生产级 AI Agent 系统(3):Agent 与工具系统完整集成——从 ReAct 到自主决策

将ReAct循环与工具系统完整集成:动态工具发现、四层停止条件、上下文管理、任务防漂移。20个任务端到端测试:成功率90%、比LangChain省38% Token。

2871 402 3 2026-07-07
AI API 网关实战:多模型统一调度、自动降级与成本追踪

AI API 网关实战:多模型统一调度、自动降级与成本追踪

从零实现 AI API 网关:统一 OpenAI/Claude/DeepSeek/GLM 多模型接口、按任务复杂度自动路由、主模型故障时自动降级到备用模型、实时成本追踪。附完整代码和月省80%费用的实测数据。

2918 412 5 2026-07-06
手搓生产级 AI Agent 系统(2):工具系统深度实战——从参数校验到沙箱安全

手搓生产级 AI Agent 系统(2):工具系统深度实战——从参数校验到沙箱安全

深入 AI Agent 工具系统设计:通用工具注册框架、参数 Schema 自动校验、工具描述对调用准确率的影响实测、危险操作沙箱隔离、失败恢复策略。附完整可运行代码。

2898 379 2 2026-07-06
AI Agent 架构深度解析:从原理到生产级实现的完整指南

AI Agent 架构深度解析:从原理到生产级实现的完整指南

万字长文拆解 AI Agent 完整架构。感知-决策-执行-记忆-反思五层模型、四种规划策略对比、工具系统设计、记忆架构实现、生产级部署要点。附可运行代码。

3063 406 1 2026-07-05
RAG 系统深度实战:从朴素检索到 Agentic RAG 的完整演进

RAG 系统深度实战:从朴素检索到 Agentic RAG 的完整演进

万字拆解 RAG 完整技术演进路线。五种分块策略实测、六款 Embedding 模型 Benchmark、三种检索优化、Self-RAG/Corrective RAG/Agentic RAG 进阶模式。附可运行项目。

2984 400 1 2026-07-05
微软砸 25 亿成立 AI 部署公司,阿里同日封禁 Claude Code——AI 竞争进入落地为王阶段

微软砸 25 亿成立 AI 部署公司,阿里同日封禁 Claude Code——AI 竞争进入落地为王阶段

7月5日微软成立 Frontier Company 投入 25 亿美元专攻企业 AI 部署。阿里宣布 7 月 10 日全面禁用 Claude Code。AI 竞争从模型转向落地。

2852 393 3 2026-07-05
用自然语言查询数据库——不用写 SQL,只说你要什么数据

用自然语言查询数据库——不用写 SQL,只说你要什么数据

自然语言数据库查询工具:AI 根据问题自动生成 SQL、安全执行查询、返回结果。支持 SQLite,可扩展其他数据库。

2812 401 6 2026-07-04
把 AI 代码审查集成到 CI/CD 流水线——每次 PR 自动审查代码质量

把 AI 代码审查集成到 CI/CD 流水线——每次 PR 自动审查代码质量

将 AI 代码审查嵌入 GitHub Actions / GitLab CI:每次 PR 自动获取 diff、AI 分析安全/性能/质量问题、评论在 PR 上。附 pre-commit hook。

3045 400 4 2026-07-03

精选推荐

1 AI SDK 的工程边界:统一模型接入、Agent 工具调用与多框架 UI 346 2 GitHub Copilot 八月 VS 更新:推理强度、模型管理与代码审查的实操解读 316 3 MCP服务器连接超时排查与超时参数调优 311 4 自建AI编程工具的成本模型与替代方案 306 5 Vercel AI SDK:从模型接入到 Agent 的工程观察 303 6 RAG中文知识库分块参数调优:从召回失败到可验证的工程方法 301 7 LLM API 响应变慢时的超时与重试策略调优 300 8 Claude Code 多项目共用配置的工程化实践 292 9 Anthropic披露AI安全事件后续:实时拦截分类器与评估沙箱新规 275 10 MCP服务器超时中断,如何设计重试与降级策略 274 11 DeepSeek API 返回 401 时如何排查:密钥配置、请求头与最小复现 270 12 从 README 拆解 Vercel AI SDK:Unified Provider 与流式 UI 的工程形态 268 13 Gemini 3.8 Flash 进入 GitHub Copilot:公开信息有限 268 14 RAG检索质量差?从分块策略、Embedding到重排序的调优路径 266 15 Claude自动化研究者可靠缓解对齐失败:Anthropic官方实验解读 263 16 Google 8 月 AI 更新页已发布,可验证细节有限,附核查清单 261 17 多模型切换时上下文丢失:Spring AI 应用的工程排查框架 260 18 DeepSeek API 401 鉴权失败:从请求头到密钥轮换的排查闭环 255 19 AI SDK 如何统一 OpenAI、Anthropic 与 Google 接入 255 20 GitHub Copilot 不提示代码建议的排查路径 248