这半年,AI Agent 一个接一个地冒出来,朋友圈、工作群里都在聊。

打开手机,满屏都是「再不学就晚了」;刷到论坛,又是一片唱衰:「这下真要被取代了」「啥活儿 Agent 都能干,人要失业了」。

我是又慌又心虚——工具这么强,自己要是跟不上,好像就要被甩下了。

我倒没那么焦虑,也没那么乐观。近一个月,办公 Agent 已经成了新的角斗场——从大模型聊天,到真正能上手干活的办公工具。

这几天,我把几家的办公 Agent 都实打实摸了一遍:腾讯的 WorkBuddy、阿里的 Qoderwork、字节的 Trae。来回替换、反复试,最后留在手上的,还是 WorkBuddy。

用下来最大的体会,其实就一句话——

神笔虽好,但我不是马良。

笔是支好笔,甚至算得上神笔。可画不画得出来、画得好不好,终究还在握笔那只手上。

工具再神,也替不了握笔人的脑子和判断。

下面这三点,是我在「派活」这件事上交了几次学费后,攒下的体会。

一模型有幻觉,派活得把话说清楚

幻觉与表达 · 关键词:词不达意

先泼盆冷水:大模型不是「懂」,是「猜」。

它底子是概率算法,按词与词之间的统计关系,一块一块往上拼。拼得顺就接着拼,拼不顺也能硬编——而且编得一本正经,引经据典、数据详实,你稍不留神就信了。

这就是「幻觉」。它是天性,不是 bug。

但说句公道话,很多时候输出跑偏,锅不能全甩给模型。

问题常出在派活的人——也就是我们自己。

我们表达任务时,往往缺省了一大堆背景:我以为它知道我要什么,其实它什么都不知道;我抓不住重点,把「大概、可能、随便弄弄」当成了指令,它自然就往模糊里猜。

说白了,是我们自己词不达意,拖累了输出,让结果一路漂移到离谱的地方。

我有过一次真教训。

有回我去外地,下了火车还要转去目的地,中途想顺路吃碗当地特色面、再买点当地点心,本来图个省事。

我把这事儿扔给豆包,它煞有介事地给我做了套行程规划:到哪站下、换几号线、去哪几家馆子、去哪采买,写得头头是道。

我照着乘地铁,到站才发现:好几家馆子离地铁口八九百米,赶到店门口,店铺已经关门了。

最坑的是买点心——豆包让我坐 1 号线直达某站下,我上了 1 号线才发觉,那个糕点铺附近的站压根不在 1 号线上,是 4 号线的另一站。

两站地图上只隔一个站距,却分属两条线,硬是多绕了两三个换乘,跟我「顺路」的初衷差了十万八千里。

事后我质问豆包,它回「非常抱歉,您指出的问题确实存在」,把纠错答案告诉我,又换了一套方案。

可回头一想,锅真不能只甩给模型。

它一本正经编线路,是幻觉;但我那句「顺路吃个面」也太含糊,没给它边界——餐馆得多近、开没开门、营业到几点、点心是不是必买,全没说。

结果它自作主张,把我的核心需求从「赶往目的地」挪到了「打卡特色餐馆、顺带采买」,还把站点给偏移了。

所以我现在的做法是,派活前先想清楚三件事:目标清晰、边界限定、标准明确。

把话说清楚,不是委屈自己,是替彼此省时间——也省得被一本正经的错答案,带进沟里。

二复杂任务先构图,别想一蹴而就

拆解与组织 · 关键词:一蹴而就

遇到大活儿,比如写一份报告、搭一个系统、理一整套流程,最忌讳的就是一把梭。

把需求啪地甩过去,指望它一口气给你个成品——往往等来的,是一堆没法用的东西。

我后来学了个办法,也是老辈人画龙的道理:先构图,再描线,后上色。

构图,是先把整体框架、脉络、要回答什么问题定下来;

描线,是按模块一步步把骨架填实;

上色,才是最后润色、补细节、调语气。

哪一步都急不得,更不能跳。

复杂任务交给 Agent,也该这么来:先跟它对齐总体思路和架构,再切成一块块、按节奏逐步交付,每交一步我验收一步。

这样它跑偏了能及时拽回来,不至于憋了半天,交上来一整篇全错。

这活儿真正考人的,是人的拆解与组织能力。我有个实打实的例子。

有个项目施工快五年,每月海量对账单、扫描件、台账一股脑归档到云盘。

临近收尾时,资料早已堆积如山:累计 9583 个文件、压缩包 9.16G,按类型、按年月层层嵌套,过程里命名还不统一,尤其台账更新了一堆版本,检索起来要命。

我借 Agent 做数据清洗——取消"按年月分级打包"的老法子,台账只留最新一份。前后近两周清下来,核心资料压到 1.6G、6988 个文件。

看着利落,过程却踩了无数坑。

我前后试了十几种方案,大多在烧 token,产出的东西根本不能用。

后来才琢磨透——最关键的不是让 Agent「去洗」,而是人先拆解步骤、找准路径、把流程理清楚。

Agent 不可能一上来就懂你的需求,更处理不了标准不统一的资料;怎么让它不冲突地归档,得你先定规矩。

说到底,一项工程不可能靠一个脚本一口气干完,得一步一验收地推进。

说到底,「一蹴而就」本就是幻想:指望一步登天,往往一步踏空。

三善假于物,但不能倚于器

主体意识 · 关键词:不倚于器

荀子说:「君子生非异也,善假于物也。」

会用工具不是丢人,是本事。

但「善假于物」不能只读前半句,得补上后半句戒律——别倚于器。

Agent 是个放大器。

你思路清楚,它帮你把一点想法放大成好成果;你思路乱,它就干脆把你那一团浆糊放大给你看。

所以它越强,反而越考你的底子:你有没有在想、想得深不深、最后拍板的那一下,是不是你自己做的。

最近 AI 漫剧从兴到亡,把这件事说透了。

去年这行还热得发烫:字节的 Seedance 2.0 一类工具一出,做一部剧从十几个人干一个月,变成一个人一个月出三四部,成本从十几万压到几万。

效率起飞,供给就炸了——2026 年一季度全网新上微短剧 12.8 万部,AI 漫剧占了 95%。

可紧接着,同质化严重、质量下滑,平台把流量导回真人内容,监管也收紧。

最讽刺的是,造这把「利器」的恰恰是大厂自己。工具太锋利,反倒把市场切成了碎片。

从业者自己总结:「成也萧何,败也萧何。」

那些只靠工具堆量、没有原创内核的创作者,最先出局——万播收益从 100 块跌到 5 块,九成以上的公司半年内关门。

能活下来的,反倒是有想法、会讲故事、有审美的人。

AI 漫剧用七个月走完「从风口到坟墓」,恰好印证:器越强,越照出使器之人有没有真东西。

我越来越确信一件事:主体意识和深入思考,才是这件事的核心。

Agent 再能干,也是「我」在判断、在取舍、在负责。

它能帮我萃取工作的精华——把重复、琐碎、机械的部分接过去,让我的精力腾出来想更值钱的事;但绝不能把脑子也一并外包出去,否则被抽空的,恰恰是我们自己。

说到底,只有靠严谨逻辑、深度思考磨出来的东西,才站得住。

那些偷懒全甩给模型、自己不动脑的产出,开头看着热闹,细看全是缝,迟早露怯。

尾声:笔给了我,画什么得我自己来

回头看开头那句——神笔虽好,我不是马良。

如今这世道,神笔近乎人手一支,门槛低到打开就能用。

可马良为什么是马良?不是笔好,是他脑子里有画、心里有数,下笔知道取舍。

笔只是延伸,那人本身才是源头。

顺着再补一句:用 Agent 的人,其实早就分了层。

有人在它面前还像用百度——遇事搜一搜、问一问,拿到答案就走。

有人已经把它当数字助手,嵌进日常流程,干活提速。

还有人更进一步,靠持续的内容创作、产品开发,把工具变成了能稳定生钱的生产资料。

三层之间看着有落差、有鸿沟。

可说到底,差的不是谁手里的笔更神,而是愿不愿意多往前迈一步——敢不断试错,敢在磕碰里沉淀真本事,肯学习、肯琢磨,再让「学—想—做」转成自己的飞轮。

笔已经递到我手里了,画什么、怎么画,得我自己来。

还在和 Agent 较劲的话,咱们一块儿琢磨。