本文作者:Berryxia.AI(@berryxia)。版权归作者所有,未经授权禁止转载。


AI办公产品到底适不适合你,光看别人演示真不一定能判断。每个人的工作场景不一样,别人觉得好用的,到你手上可能完全跑不通。只有一种办法,拿你自己的活,扎扎实实跑一遍。

豆包工作给了这个机会。在9月内下载豆包工作电脑版(doubao.com/work)或更新至最新版本,可免费领取30天订阅权益。不花钱,先用一个月再说。

Article image

但免费归免费,产品本身得过硬。我用过太多AI办公产品了,前阵子刚拿自己十年Apple教育经销的业务场景,把几款挨个跑了一遍。测完最大的感受是,它们经常有一个共有的毛病,交作业倒是快,但你不检查,它就真敢把半成品当完成品交给你。

所以这次我重点看了两个新入口,目标模式和计划模式。一个把"什么才算做完"提前说清楚,一个把"准备怎么做"先拿出来讨论。

CHAPTER 01


目标模式,先把交作业的标准写清楚

我做Apple教育授权经销十年了,日常工作里有一件事特别烦,摸“客户底”,在业务中也就是线索或者情报收集。

比如我要开拓大湾区市场,我得搞清楚广州、深圳、东莞、佛山四个城市里,哪些K12国际学校值得跟进。这次任务用的是"目标"入口,我把验收标准写得很具体,四个城市各一个子文档,每所学校包含学费、规模、资质、课程体系、信息化建设投入,每个子文档至少两张校园图片。

以前我说"做得完整一点",它觉得一篇长文就够了。现在文档怎么拆、字段有哪些、配图几张,都摆在前面。豆包工作交付了一个总览和四个城市子文档,覆盖86所学校,嵌入38张图。但"有子文档"不等于"学校都查全了","有图"不等于"图都对应正确学校"。

而豆包工作的目标模式,就直接解决这个问题,我们可以更加轻松的去设定计划完成的目标,而不是任由大模型发挥。

目标模式直接把验收要求显性化了,但能不能达标还要逐项对照

如果遇到有些关键信息需要核验,人工一条条复核有点麻烦,因此我们要搞点“新东西”出来。

这个时候就是需要我们的引出新的“技能”-给自己创造一个可复用的核验Skills,我们接着往下看。

CHAPTER 02


用目标模式新建“技能”,把“信息核实助手”留下来反复用。

学校情报库这种活不是只做一次。今天查大湾区,下次换华东。每次都从头打一大段核查要求,挺累的。

Article image

所以我把这套要求做成了一个技能。把一段话拆成可以单独查证的断言,优先找学校官网和授权机构的来源,分成基本属实、部分属实、不准确、无法核实四档。不编造来源,查不到就说查不到。

然后我用这个技能去查刚才的交付。初版报告给出262条断言,163条基本属实,约占62.2%。但四城明细逐行加总得到274行,和摘要的262条对不上。这组数字不能拿来宣传准确率。

更有意思的是,核查助手自己也查错了一条。

它说深圳蛇口国际学校的MYP还是候选状态,我打开IBO官方名录一看,早就授权了。

你不能因为它叫"事实核查助手",就觉得它说的一定是事实。技能能固定流程,但不会自动消灭过期资料和错误推断。这个技能真正有用的地方,是把一次踩坑变成下一次的检查项。但最后那道专业判断,还是得自己留着。

CHAPTER 03


计划模式,先出图纸,再施工

AI经常不跟你商量,拿到任务就直接开干。这次我用计划模式,让它做一份从广州出发的国庆大湾区三日亲子自驾策划。

它没有急着干活,先做了调研,给出三条路线让我选,然后停下来让我确定日期、孩子身高和住宿偏好。页面里出现了一份Markdown实施计划,底下两个选择,"开始执行"和"修改计划"。

这个停顿有用。我在计划阶段就发现它把清晖园儿童票算成7元,查了官方票务页,6周岁以下免票,两位成人30元就够了。改的是计划,不用等成品出来再推倒。

确认后才点执行,交付了一份顺德三日亲子路书和预算总览图。计划模式最实际的价值,还没做最终文档就能把路线和预算先对齐。

Article image

CHAPTER 04


再说几个其他实用的功能

Article image

1、任务队列。 跑任务时不用干等,可以继续追加指令排队,前一个干完自动接下一个。也能插队,但会中断当前任务。

2、Markdown。 支持在线查看和编辑,改完还能让AI接着干。

3、深色模式跟随系统或手动固定,深色晚上非常友好,不刺眼。

这些功能单看都不复杂,但放在同一个任务里,工作流就顺了,先说标准,先看计划,做完再查,查出的问题补进技能。


最后多说两句

这几个新功能凑在一起,方向是对的。

但流程变好了,不代表结果就自动全对。学校情报库有了目录和配图,资质还可能错。核查报告分了四档,核查结论自己也可能过时,因此我们需要不断的迭代我们的技能以及使用最顺手好用的工具才对。

这一次豆包工作让我看到整个的流程设计和执行任务的能力,更加符合我们未来对于AI办公产品的需求。

它不是一上来就猛猛干活和消耗token,这个我还挺喜欢的。

检查终于有地方落了。哪里不对能指出来,标准怎么改能留下来,改完还能再对一次。

AI能帮普通人跨过操作门槛,但无法替代专业判断。门槛只是从操作层向判断层转移。这次仍然是这样。

先对齐,再执行。先验收,再交付。

点了一个模式不等于万事大吉,但终于有了一套更像认真做事的流程。