最近在尝试用Qwen2.5-7B + LoRA微调一个能自主调用搜索和计算工具的Agent。自己构造了大概2k条多轮对话数据,格式是标准的function calling那种。但训练完发现模型要么不调用工具直接瞎答,要么调用了但参数格式老是错。试过调rank和alpha,效果都不稳定。想问下做过Agent微调的朋友,这种工具调用能力到底是靠SFT硬灌,还是得配合prompt工程?数据集里要不要加一些“不需要调用工具”的负样本?感觉快调崩溃了……