智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
广告
上一页 1 2 3 ... 76 77 78 ... 94 95 96 下一页
我要提问

大家都在搜

1 RAG里给LLM的prompt到底该写多细?我快调吐了 12 2 RAG召回效果差,是不是我分块方式有问题?求大佬指点 10 3 用LoRA微调Llama3做Agent工具调用,效果总是不稳定怎么办? 9 4 部署7B模型微调API,显存够用但推理速度只有2 token/s正常吗? 9 5 向量数据库选型纠结死了,Milvus和Chroma到底怎么选? 9 6 RAG里Agent多轮查询后上下文爆炸,大家都是怎么处理的? 9 7 RAG检索老召回不相关片段,是chunk切法问题还是embedding模型选错了? 9 8 RAG检索老是把关键信息截断,是不是chunk切法有问题? 8 9 MCP服务器连本地大模型一直超时,是配置问题还是我的姿势不对? 8 10 Claude 3.5 Sonnet写前端时,为什么总爱自作主张重构我的代码? 8 11 用LangGraph写Agent总在工具调用循环里出不来,怎么设计终止条件? 8 12 MCP 工具调用总是超时,是我哪里配置错了吗? 8 13 RAG里做Prompt工程,到底该把精力花在system还是query改写上? 7 14 PyTorch转ONNX后推理速度反而变慢了,是我的导出姿势不对吗? 7 15 RAG召回效果差,是切分太粗还是Embedding模型选错了? 7 16 大家用Qwen2.5写代码时,补全结果总是“半截”怎么破? 7 17 RAG召回精度上不去,是切分粒度问题还是embedding模型选型不对? 7 18 RAG里向量数据库到底怎么选?Milvus还是Chroma,头秃了 7 19 VLLM部署Qwen2.5-7B报错显存不足,但用Transformers却没事? 7 20 用Prompt让Claude写Python脚本,总是漏掉异常处理怎么办? 7