智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
广告
上一页 1 2 3 ... 69 70 71 ... 94 95 96 下一页
我要提问

大家都在搜

1 RAG里给LLM的prompt到底该写多细?我快调吐了 12 2 用LoRA微调Llama3做Agent工具调用,效果总是不稳定怎么办? 10 3 RAG召回效果差,是不是我分块方式有问题?求大佬指点 10 4 部署7B模型微调API,显存够用但推理速度只有2 token/s正常吗? 9 5 向量数据库选型纠结死了,Milvus和Chroma到底怎么选? 9 6 RAG里Agent多轮查询后上下文爆炸,大家都是怎么处理的? 9 7 RAG检索老召回不相关片段,是chunk切法问题还是embedding模型选错了? 9 8 部署Llama 3 8B微调模型,显存够但推理极慢,是量化问题还是我姿势不对? 8 9 RAG检索老是把关键信息截断,是不是chunk切法有问题? 8 10 MCP服务器连本地大模型一直超时,是配置问题还是我的姿势不对? 8 11 Claude 3.5 Sonnet写前端时,为什么总爱自作主张重构我的代码? 8 12 用LangGraph写Agent总在工具调用循环里出不来,怎么设计终止条件? 8 13 MCP 工具调用总是超时,是我哪里配置错了吗? 8 14 微调Llama3把自己的数据格式搞错了,loss不降反升正常吗? 7 15 PyTorch转ONNX后推理速度反而变慢了,是我的导出姿势不对吗? 7 16 RAG召回效果差,是切分太粗还是Embedding模型选错了? 7 17 大家用Qwen2.5写代码时,补全结果总是“半截”怎么破? 7 18 MCP服务器接入深度学习框架时,模型推理的上下文该怎么管理? 7 19 RAG召回精度上不去,是切分粒度问题还是embedding模型选型不对? 7 20 RAG里向量数据库到底怎么选?Milvus还是Chroma,头秃了 7