很多人第一次让 AI 帮忙,都会说一句:

“帮我整理一下。”

这句话没有错,只是太像把一堆东西推给同事,然后什么都不交代,等他回来再说“不是这个意思”。

AI 最擅长的,是在已有材料里归纳、改写、分类、起草。它最容易出问题的地方,也是大家最容易误会的地方:当信息有空白时,它会努力把答案补得完整。看起来很像会办事,实际上可能已经替你做了决定。

所以第一次用 AI,别急着研究提示词,也不用背一串英文词。先把一件小事交代清楚。

我把这个方法压成四格:材料、任务、交付、验收。

下面用一个虚构的家庭聚餐案例走一遍。它不涉及真实家庭信息,只是为了把每一步看得更清楚。

八条消息,最容易在哪儿出错?

假设家族群里有八条消息:

  • 妈妈说,周六中午在奶奶家吃饭,十一点半开饭。
  • 大姨和姨父都来,大姨带水果。
  • 二叔上午有事,最早十二点到,大家先别等他。
  • 小丽带两个孩子,孩子不吃辣。
  • 爸爸去买饮料。
  • 奶奶说家里米够,不用买主食。
  • 二叔后来补了一句:能不能来,要到周五晚上才能确定。
  • 妈妈最后问:买菜还没人负责。

你把这些原话丢给 AI,再说“帮我安排一下”,它很可能写出一份像模像样的聚餐计划。

问题也往往藏在这份“像模像样”里。

它可能把二叔写成确定参加;可能把十一点半开饭改成十二点;也可能为了补齐分工,擅自指定一个人买菜。答案读起来顺,事情却办错了。

这里真正麻烦的不是 AI 不会写,而是它把没有说清的部分,当成了该由它填上的空。

第一格:材料,告诉它能看什么

材料就是原始依据。

这个例子里,材料不是“我们周六要聚餐”,而是上面八条原消息。尽量把原话给出去,尤其是时间、条件、例外和不确定项。

很多人习惯先自己总结一遍再交给 AI。这样做不是不行,但要知道风险:你自己的总结一旦漏了“二叔周五才确认”这半句,AI 后面做得再认真,也不可能把它找回来。

如果材料来自聊天记录、表格、会议纪要或截图,先做一件事:删掉不需要的信息。手机号、住址、身份证号、孩子学校、客户隐私,都不该为了“让它看得更全”而顺手塞进去。

材料不是越多越好。它要够用,也要干净。

第二格:任务,告诉它只做哪件事

“帮我看看”是一个愿望,不是任务。

在这个案例里,可以把任务说得具体一点:把确定事项和待确认事项分开;整理谁带什么;找出还没有负责人的事;最后写一段能发回家庭群的确认消息。

注意,这里没有让 AI “把聚餐全部安排好”。因为材料里根本没有菜单、总人数和买菜负责人。你让它完成一件它没有条件完成的事,它就只能猜,或者用一堆空话把答案撑起来。

任务要小到你能看懂它有没有做完。

第一次练习,选一个自己熟悉、即使做错也能改回来的小事就够了:整理一页会议记录、把几条客户需求归类、从旅行聊天里列出待确认项。不要一上来就把付款、发布、删文件、给客户回承诺交出去。

第三格:交付,告诉它最后交成什么样

交付说的是答案的形状。

这份聚餐安排,我会要求它交回四块内容:

  1. 已确定事项
  2. 待确认事项
  3. 人员和物品分工
  4. 一段可直接发回家庭群的确认消息

这样做不是为了把提示词写得花哨,而是为了把检查位置固定下来。以后你一眼就能看到,“待确认事项”里有没有二叔,“分工”里有没有买菜还空着。

同样一个任务,交付形式不同,结果也会不同。让 AI “总结一下会议”,通常只会得到一段概述;让它“按决定、待办、负责人、截止时间四栏整理”,你才拿得到可以继续往下做的东西。

第四格:验收,提前写清什么叫做对

这是最重要的一格。

交付规定了它要交几块内容,验收规定了这些内容必须满足什么。两件事很像,不能混在一起。

这个案例的验收条件可以直接写出来:

  • 八条消息都要被处理。
  • 十一点半是开饭时间;十二点只是二叔如果参加时最早到达的时间。
  • 二叔是否参加,当前必须标成待确认。
  • 两个孩子不吃辣;大姨带水果;爸爸买饮料;家里不用再买主食。
  • 买菜负责人仍待确认。
  • 总人数、菜单和其他没说过的安排,不能硬猜。

最后这一条很关键。很多 AI 输出的问题,不是胡说八道,而是把“没说”写成了“应该是这样”。

验收标准不能阻止 AI 补全,但会把这些补全变成可检查的问题。它同时也让你知道,答案回来以后到底该看哪里,而不是只凭感觉说一句“好像不太对”。

把四格合成一条能直接用的指令

把上面的内容拼起来,指令可以这样写:

请根据下面八条家庭群消息,整理一份周六聚餐安排。

先列出确定事项,再列出待确认事项;然后整理人员和物品分工,指出目前没有负责人的事情;最后写一段可以直接发回家庭群的确认消息。

请逐条检查:十一点半按时开饭;二叔是否参加仍待确认,如果参加,最早十二点到;两个孩子不吃辣;水果和饮料已有负责人;不用再买主食;买菜负责人仍待确认;总人数不能确认就不要硬算。

不要猜消息里没有说过的内容。

【八条原消息】
把原始消息粘贴在这里

你会发现,真正起作用的不是哪句“魔法提示词”。是你终于把材料、要做的事、交付形式和验收条件放到了一张桌子上。

结果回来以后,别直接发出去

AI 的第一版可以是合格起点,但还不是最终答案。

假如它把二叔写成了确定参加,不要只说“错了,重做”。这种反馈太粗,它可能顺手把其他本来正确的地方也改乱。

更好的说法是:

二叔目前仍待确认。请只修改他的参加状态;如果他参加,保留最早十二点到。其他正确内容不要重写。

你给的是一条可检查的错误,它就有机会做局部修正。改完后,再按前面的验收条件查一遍。

这就是一个最简单的闭环:做、查、改、停。

“停”常常被漏掉。有人会让 AI 一直重写,越改越长,最后自己也不知道它到底改过什么。我的建议是,给第一次练习设一个很普通的上限:最多两轮。

两轮后还在漏关键条件,先别和它耗。回头看材料是不是不全,任务是不是太大,验收是不是写得互相打架;如果这件事本来就需要责任判断,那就由人接手。

一次任务改对了,也不代表 AI 从此“学会了”。它只把这一份作业改对了。最终签字的人,仍然是你。

再做一次小变化测试

最后,可以把第七条改成:“二叔确认不参加。”

这时让 AI 更新原有安排。合格的结果,只应该改两类信息:二叔从待确认变成不参加;“最早十二点到”不再出现在当前安排里。

开饭时间、孩子不吃辣、大姨带水果、爸爸买饮料、买菜待确认,这些正确内容不应该跟着一起被改乱。

这一步很像生活里的真实情况。计划变了并不可怕,可怕的是每改一处,整份东西都要重新翻一遍。你开始要求它只动受影响的部分,就是在测试这件事能不能真的放进自己的日常流程。

第一次就从一件能反悔的小事开始

很多人把 AI 想得太大,要么只拿它聊天,要么一上来就想把整套工作交出去。

先别急。找一件你已经做过很多次、材料就在手边、结果一眼就能验收的小事。把四格填完,让它做第一版,然后自己挑错。

你不需要先懂 Agent、Loop 或复杂工作流。先跑通这一个小闭环。

等你真的做过几次,就会知道哪些信息必须写,哪些要求它最容易误解,哪些工作值得继续交给它。那时再谈更复杂的工具、资料库和自动化,才不会只是收藏了一堆名词。