我要提问
大家都在搜
1
RAG里给LLM的prompt到底该写多细?我快调吐了
12
2
向量数据库选型纠结死了,Milvus和Chroma到底怎么选?
10
3
部署7B模型微调API,显存够用但推理速度只有2 token/s正常吗?
9
4
RAG里Agent多轮查询后上下文爆炸,大家都是怎么处理的?
9
5
RAG检索老召回不相关片段,是chunk切法问题还是embedding模型选错了?
9
6
MCP 工具调用总是超时,是我哪里配置错了吗?
9
7
RAG检索老是把关键信息截断,是不是chunk切法有问题?
8
8
MCP服务器连本地大模型一直超时,是配置问题还是我的姿势不对?
8
9
Claude 3.5 Sonnet写前端时,为什么总爱自作主张重构我的代码?
8
10
用Prompt让Claude写Python脚本,总是漏掉异常处理怎么办?
8
11
用LoRA微调自己的模型,为什么生成质量反而变差了?
8
12
向量数据库到底怎么选?Milvus和Chroma把我整不会了
8
13
用LangGraph写Agent总在工具调用循环里出不来,怎么设计终止条件?
8
14
大家用Qwen2.5写代码时,补全结果总是“半截”怎么破?
7
15
PyTorch转ONNX后推理速度反而变慢,是哪里设置不对吗?
7
16
MCP服务器接入深度学习框架时,模型推理的上下文该怎么管理?
7
17
RAG召回精度上不去,是切分粒度问题还是embedding模型选型不对?
7
18
RAG里向量数据库到底怎么选?Milvus还是Chroma,头秃了
7
19
用AI编程助手三个月,代码越写越烂,该不该继续用?
7
20
VLLM部署Qwen2.5-7B报错显存不足,但用Transformers却没事?
7