思维链失效的地方,该换成结构化提示
把一个两百字的客服留言丢给模型做分类,同时加一句「请一步步思考」,准确率反而从 92% 掉到 84%,输出长度翻了一倍,还得再写代码把解释部分剔掉。 思...
把一个两百字的客服留言丢给模型做分类,同时加一句「请一步步思考」,准确率反而从 92% 掉到 84%,输出长度翻了一倍,还得再写代码把解释部分剔掉。 思...
同样一句「帮我写个周报」,两个人用同一个模型,一个得到三段套话,一个得到可以直接粘进邮件的内容。差别不在模型,在那个人多写的三句话。 之前聊过提...
同一个模型,同一个问题,两个人问出来的结果差距能有多大?我做过一次很朴素的对比:让模型帮忙整理一份用户访谈记录,一次直接说「帮我总结一下」,一次补...
同一份需求文档,有人每次都要花二十分钟重新想怎么让 AI 帮忙,有人打开一个文档复制一段,改几个词就发出去了。一年下来,后者的时间差出上百小时。 这...
两份会议记录交给两个人整理。第一个人输入「帮我整理一下会议纪要」,得到一段概述,读了等于没读。第二个人输入同样要求,再补上几句:输出成决议、待办、...
有人把一段周报草稿丢给 AI,输入是「帮我总结一下这周的工作」。得到的结果是一段四平八稳的排比句,看着通顺,发出去等于没写。 同一天,另一个人用几...
第一,约束会让你自己想清楚。写规格的过程就是在回答「我到底要什么」,很多人在这一步才发现自己其实没想明白。 第二,约束让输出更稳定。结构、篇幅...
信号五:没有兜底路径 模型答不了怎么办、响应超时怎么办、不同平台的违禁词怎么过、并发上来会不会雪崩——这些问题如果在设计阶段没有答案,上线后就会...
同一份两万行的销售流水,市场部的小周用透视表做了三个小时,隔壁工位的小许在对话框里花了十分钟就跑完了,还顺手生成了三段结论。差别不在谁更会提问,而...
周五下午四点,一位研发负责人还在翻两周前的会议记录和提交日志,拼一份周报。这件事他每周做一次,每次四十分钟。 周报是典型的可结构化重复劳动。它不...