2 篇文章
同一道数学题,直接要答案错一片;让它先分步想再答,正确率跳一档。给模型一张「草稿纸」让它把思考写出来,比逼它一步到位强。而且那张草稿纸你还能审计。
同一道 debug 题给普通模型和推理模型,普通模型直接给答案,推理模型先说「我怀疑这里」。我后来才明白,推理模型真正的价值不在答得更对,在于它把怀疑写在了答案前面,让我有机会在它错之前把它拽回来。