最近在折腾把MCP服务器挂到本地推理框架(vLLM+Qwen2.5)上做工具调用,发现一个很头疼的问题:MCP返回的文本块和工具结果,走的是框架自己的tokenizer,但有些工具返回的JSON里带特殊字符(比如换行符、Unicode转义),导致切分后的token序列跟模型训练时的格式对不上,偶尔会出现重复生成或者截断。想问问大家,在自建MCP网关时,有没有对工具返回内容做统一的预清洗或重新tokenize的策略?还是说直接让模型用function calling的原生接口更稳妥?有点迷茫,求指路。