Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.089 — 2026-10-01
NEWS 约 1 分钟

九条提示规则最多省七成思考

给编码 Agent 加九条“思考纪律”,360轮测试中推理消耗最多降七成。

编码 Agent——能读代码、调用工具并分步干活的 AI 助手——有时像拿不定主意的人:反复检查已经确认的结论,或没遇到明确障碍就频繁改道。作者尝试把九条简单规则写进全局指令,也就是每次任务都会自动附带的固定工作纪律,要求它先核对需求、选定路线后做到底,并在答案已经验证时及时停手。

最值得借鉴的一点,是这些规则把“什么时候可以重想”说得很具体:模糊的不安不算证据;只有测试失败、事实冲突、明确错误、反例或不同推导出现,才应重新打开已经解决的问题。面对用户质疑时,也不能只为迎合而改答案;但工具、测试或用户给出新证据后,则要立即更新。

作者自述在 GLM 5.3 与 GLM 5.3 Flash 上进行了360轮 A/B 测试——即在尽量相同条件下比较加入规则前后——每组重复5次,并开启最大思考量,推理 token 最多节省70%。推理 token 是模型形成方案时的内部计算计量,减少通常意味着更省成本或等待时间;不过材料未披露各任务的完整结果质量,且目前只测了两款模型,仍需更多模型复验。


供稿材料 SOURCES — 1

← 返回 2026-10-01 · 开源板块