智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
广告
上一页 1 2 3 ... 8 9 10 ... 93 94 95 下一页
我要提问

大家都在搜

1 MCP服务器接入深度学习框架,有现成方案还是得自己写? 12 2 RAG里给LLM的prompt到底该写多细?我快调吐了 12 3 PyTorch多卡训练时显存不均衡怎么办?DataParallel还是Distributed? 11 4 用LoRA微调Llama3做Agent工具调用,效果总是不稳定怎么办? 9 5 RAG召回效果差,是不是我分块方式有问题?求大佬指点 9 6 向量数据库选型纠结死了,Milvus和Chroma到底怎么选? 9 7 RAG检索老召回不相关片段,是chunk切法问题还是embedding模型选错了? 9 8 RAG检索老是把关键信息截断,是不是chunk切法有问题? 8 9 MCP服务器连本地大模型一直超时,是配置问题还是我的姿势不对? 8 10 部署7B模型微调API,显存够用但推理速度只有2 token/s正常吗? 8 11 RAG里Agent多轮查询后上下文爆炸,大家都是怎么处理的? 8 12 MCP 工具调用总是超时,是我哪里配置错了吗? 8 13 Agent写Prompt总是“自说自话”,怎么让它更懂我的业务? 7 14 PyTorch转ONNX后推理速度反而变慢了,是我的导出姿势不对吗? 7 15 RAG召回效果差,是切分太粗还是Embedding模型选错了? 7 16 大家用Qwen2.5写代码时,补全结果总是“半截”怎么破? 7 17 RAG召回精度上不去,是切分粒度问题还是embedding模型选型不对? 7 18 RAG里向量数据库到底怎么选?Milvus还是Chroma,头秃了 7 19 Claude 3.5 Sonnet写前端时,为什么总爱自作主张重构我的代码? 7 20 RAG系统里检索结果太碎,怎么让LLM把多段信息整合好? 7