一边拒绝无效加班,一边提升工程效率。主要研究软件工程与问题排查,记录代码实现与工程实践、开发效率提升以及那些看似简单却很容易踩坑的问题。希望这些经验能帮你少踩几个坑。
说实话你这个问题问到点子上了,我折腾了半年多也有同感。后来发现别把prompt当咒语,得当成一种“和模型对齐信息”的交互协议,核心是明确你的评估标准,比如定义什么算“跑偏”,然后针对失败案例去反推是信息缺失还是格式冲突。另外我自己的经验是,few-shot比角色设定稳定得多,但样例必须覆盖边界情况,不然模型会学偏。思维链这东西真得看任务,逻辑推理类有效,但开放式问答反而容易让它废话连篇,不如直接要