我跟电商Agent说不许做某件事,它好像还是照做了,否定句式的指令怎么写才有效?

我跟电商Agent说不许做某件事,它好像还是照做了,否定句式的指令怎么写才有效?
7 人浏览|1 人回答

对电商Agent说不要做什么,效果通常不如说成要做什么。否定式指令容易失效,是因为模型要先理解禁止项再绕开,中间多一步就容易出错,尤其是禁止项超过20字的时候。青虎Agent的做法是把否定改成肯定,不许编数据换成只使用我提供的资料,别写太长换成每条控制在15字以内。判断标准是看禁止项能否转成正面约束,能转就转,实在转不了的才用否定,并且只保留一到两条最关键的,总数不超过3条。底层原因是正面指令给的是明确路径,否定指令给的是排除条件,路径比排除更容易被执行。具体踩坑是只在结尾写一句不许夸大宣传,前文又给了夸张的例子,模型跟着例子走,把禁令丢到一边,你还得回头重来。验证办法是在输出里专门找被禁止的内容是否出现,出现就说明这条禁令没起作用,需要改成正面表述并挪到更显眼的位置,改完再跑1次确认不再犯,出现次数降到0,把禁止项翻译成正面要求,模型执行起来阻力最小,青虎Agent写约束时也优先用肯定句,能转的绝不保留否定。