智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

企业级RAG性能优化与质量治理(6):上下文压缩、证据绑定与可信引用

实现父子检索、抽取与生成压缩、关键条件保真、EvidenceID冻结和Claim校验。

1671 249 0 2026-08-08
RAG查询改写后把关键实体改错了?人名、编号与否定词保护排查

RAG查询改写后把关键实体改错了?人名、编号与否定词保护排查

查询改写可能修改产品编号、人名、日期、否定条件和专业术语,导致检索方向错误。

1811 258 0 2026-08-07
Multi-Query、HyDE与问题分解怎么选?RAG查询增强策略指南

Multi-Query、HyDE与问题分解怎么选?RAG查询增强策略指南

查询增强可以生成多个同义查询、构造假设答案或拆成子问题,本文比较适用场景。

1862 253 0 2026-08-07
RAG查询改写后数字、缩写和型号消失?Token清洗排查

RAG查询改写后数字、缩写和型号消失?Token清洗排查

型号、错误码、版本和缩写是技术检索最重要的Token,清洗或改写阶段删除它们会同时损害稀疏和稠密检索。

1877 262 0 2026-08-07
用Spring AI搭建RAG查询增强服务:实体保护、Multi-Query与结果融合

用Spring AI搭建RAG查询增强服务:实体保护、Multi-Query与结果融合

实现查询增强服务,对输入进行实体锁定、复杂度分类、策略选择、并行检索和结果融合。

1944 289 0 2026-08-07
企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

企业级RAG性能优化与质量治理(5):查询理解、改写与召回增强

实现实体保护、指代消解、查询分类、Multi-Query、HyDE、问题分解和结果融合。

1656 242 0 2026-08-07
Spring AI应用Docker健康检查正常,为什么真实模型调用全部失败?

Spring AI应用Docker健康检查正常,为什么真实模型调用全部失败?

进程健康只能证明容器存活,不代表凭证、网络、额度和指定模型可调用。

1970 261 0 2026-08-06
滚动发布、蓝绿发布与金丝雀发布怎么选?AI应用上线策略指南

滚动发布、蓝绿发布与金丝雀发布怎么选?AI应用上线策略指南

AI应用的模型、Prompt、RAG索引和代码都会影响结果,本文比较三种发布策略。

1815 262 0 2026-08-06
AI应用上线后Prompt版本混乱?配置漂移、缓存与多实例排查

AI应用上线后Prompt版本混乱?配置漂移、缓存与多实例排查

不同Pod使用不同Prompt缓存、配置中心版本或模型别名,会导致同一代码版本行为不一致。

1944 276 0 2026-08-06
用GitHub Actions搭建Spring AI发布流水线:评测门禁、镜像、灰度与自动回滚

用GitHub Actions搭建Spring AI发布流水线:评测门禁、镜像、灰度与自动回滚

实现面向Spring AI应用的CI/CD流水线,在构建镜像前运行评测,发布后执行金丝雀检查。

1859 261 0 2026-08-06
Spring AI企业级应用实战(14):容器化部署、灰度发布与配置治理

Spring AI企业级应用实战(14):容器化部署、灰度发布与配置治理

完成容器健康、Release Manifest、资产版本、金丝雀发布、质量观察和回滚。

1914 286 0 2026-08-06
大模型单元测试为什么时好时坏?温度、模型漂移与断言方式排查

大模型单元测试为什么时好时坏?温度、模型漂移与断言方式排查

直接断言大模型完整字符串,会因采样、模型更新、提示词和检索变化产生脆弱测试。

1977 290 0 2026-08-05
规则校验、LLM-as-a-Judge与人工评审怎么选?

规则校验、LLM-as-a-Judge与人工评审怎么选?

AI输出可以由规则、评审模型或人工专家评估,本文比较可重复性、覆盖范围、成本和偏差。

2136 317 0 2026-08-05
黄金测试集更新后历史分数不能比较?数据集版本与基线漂移排查

黄金测试集更新后历史分数不能比较?数据集版本与基线漂移排查

不断补充样本后,新旧平均分不能直接比较,因为样本难度和分布已经变化。

2006 278 0 2026-08-05
用JUnit搭建AI回归测试框架:数据集、规则评分、Judge与质量报告

用JUnit搭建AI回归测试框架:数据集、规则评分、Judge与质量报告

实现可在CI运行的AI回归框架,读取JSONL数据集,执行规则与Judge评分并比较基线。

2331 311 0 2026-08-05
Spring AI企业级应用实战(13):测试、黄金数据集与发布质量门禁

Spring AI企业级应用实战(13):测试、黄金数据集与发布质量门禁

建立单元测试、Provider契约、黄金数据集、规则评分、Judge和CI质量门禁。

2091 286 0 2026-08-05
Spring WebFlux请求超时后AI任务为什么还在运行?

Spring WebFlux请求超时后AI任务为什么还在运行?

前端或网关超时只终止HTTP响应,不一定向上游模型、工具或队列传播取消信号。

2130 269 0 2026-08-04
同步接口、消息队列与工作流引擎怎么选?AI长任务架构指南

同步接口、消息队列与工作流引擎怎么选?AI长任务架构指南

AI报告、代码扫描和批量入库可能持续数分钟甚至数小时,本文比较同步HTTP、消息队列和工作流引擎。

1986 271 0 2026-08-04
AI异步回调为什么会重复到达?至少一次投递与幂等排查

AI异步回调为什么会重复到达?至少一次投递与幂等排查

网络超时、消费者重启和ACK丢失会让同一回调多次到达,必须按至少一次投递设计。

2053 292 0 2026-08-04
用Spring Boot搭建AI长任务中心:队列、进度、取消、回调与断点恢复

用Spring Boot搭建AI长任务中心:队列、进度、取消、回调与断点恢复

实现统一AI长任务中心,用状态机、队列、进度事件和幂等回调管理报告生成、批量分析和入库。

2199 307 0 2026-08-04
上一页 1 2 3 ... 11 12 13 ... 22 23 24 下一页