最近在折腾MCP,想着把本地部署的Qwen2.5接进去当工具用。我用的Python写的FastMCP,模型跑在Ollama上。现在问题是,MCP客户端一调用工具,请求发到我的服务端,服务端再去访问Ollama的API就卡住,几秒后直接超时。单独用curl测Ollama是秒回的,模型也加载了。我怀疑是不是MCP的同步机制阻塞了事件循环,或者Ollama那边keep-alive设置的问题?也试过把请求改成异步,还是不行。有没有老哥碰到过类似情况?求指点一下排查方向,万分感谢。