我给AI开了”免检通行证”,数字员工闯祸删了我文件

关键词追踪「{‘type’: ‘keyword’, ‘name’: ‘数字员工’}」 原文链接: https://mp.weixin.qq.com/s?src=11&timestamp=1783422201&ver=6828&signature=*IO8DEzTR9bjR3SQzPtCxaIuVp8NrIyiCDFCttUSzn0a10I9TygyHdwwufEfZjg6WzpZJjeyglIbnkjHNqtmtVbtefqN9Dz3Yp6PFdCJp1*fL6djjWAp0uekmkF17dAE&new=1 发布时间: 2026-07-07 08:03 监控类型: 关键词追踪


核心观点

  1. 上个月,数字员工没等我确认,就把我电脑上一个文件给删了,我当时后背一凉。

  2. 所以,数字员工,光”使唤得动”还不够,还要磨成”信得过”才靠谱。上一篇我讲了数字员工的架构原理,这一篇就聊聊,实际用起来,这两层功夫我是怎么摸出来的。

  3. 在电脑端,我想让 AI 并行,办法多的是。我可以开好几个终端窗口各跑一个、或者让任务挂后台自己跑,我同时支使一群、盯着好几摊。但前提是,我得守在电脑前。

  4. 数字员工反过来,我人在小区陪娃、手里就一部手机一条钉钉,它替我远程把活干了。它就一条通道,一次只处理一条消息,这一条消息里我交代几件事都行,它会一件件做完;可我趁它忙又发一条新消息,就得排进队列。就算是补充说明,也只排队、不插队。

  5. 电脑端拿”你在场”换并行;数字员工拿”一次一条”,换的是”你人不在,也能把活托付出去”。它要解决的不是并行,而是我离开电脑,活儿也不用停。

  6. 对策:要紧的几件事,写在同一条消息里交代(它自己排着做),或者按顺序一条条发。真想要”一群数字员工一起开工、还互不打架”,那是另一码事,后续文章我会聊。


全文

上个月,数字员工没等我确认,就把我电脑上一个文件给删了,我当时后背一凉。

所以,数字员工,光”使唤得动”还不够,还要磨成”信得过”才靠谱。上一篇我讲了数字员工的架构原理,这一篇就聊聊,实际用起来,这两层功夫我是怎么摸出来的。

在电脑端,我想让 AI 并行,办法多的是。我可以开好几个终端窗口各跑一个、或者让任务挂后台自己跑,我同时支使一群、盯着好几摊。但前提是,我得守在电脑前。

数字员工反过来,我人在小区陪娃、手里就一部手机一条钉钉,它替我远程把活干了。它就一条通道,一次只处理一条消息,这一条消息里我交代几件事都行,它会一件件做完;可我趁它忙又发一条新消息,就得排进队列。就算是补充说明,也只排队、不插队。

电脑端拿”你在场”换并行;数字员工拿”一次一条”,换的是”你人不在,也能把活托付出去”。它要解决的不是并行,而是我离开电脑,活儿也不用停。

对策:要紧的几件事,写在同一条消息里交代(它自己排着做),或者按顺序一条条发。真想要”一群数字员工一起开工、还互不打架”,那是另一码事,后续文章我会聊。

数字员工活在我钉钉对话框里。我天天隔着这个窗口使唤它,摸出几条它的”沟通规矩”:

对策:不拿它做不到的方式去要东西,用它做得到的方式交代。同时也在想升级”数字员工”的优化方案。

我这个数字员工不住在云上,它就住我家那台电脑里。

那天我一不留神合上电脑盖、出门办事,半路想起件活儿,在钉钉发了句话,等了一路没动静。

其实它从我合盖那刻起就断了,机器睡死,那句话压根没收到。断网、断电也一样。不过锁着屏、只要接着电、连着网,让它在后台活着,还是能照干的。

对策:我出门要它干活,就让那台机器醒着,别合盖、接着电源、连着网。知道它在哪儿,靠啥在岗,我心里有数,就更顺手。

但光顺手还不够,真正让我敢把要紧的活交给它的是第二层。

一个新员工再能干,你也不敢把所有的事儿闭着眼交给他。重要的动作,公司里都得走审批。数字员工也一样需要定规则,遇到删东西、动系统、碰密钥这类要紧动作,先确认再动手。我回 y 它才动,回 n 就停;我要是三分钟没回,它自动当我不同意、把这事驳掉。

开头我说的那件事,就栽在这道闸上。有一次它没问我,直接把我电脑上一个做图片的文件删了。

查下来,也不能怪它。我平时在自己电脑上用AI,为了避免重复问询、点”确认”,我给AI开了张”免检通行证”。结果这张通行证开在了公用的大门上,数字员工系统从这个门进来干活也跟着免检了,那道本该拦它的闸,就被架空了。

发现当天我就修复了这个漏洞,让数字员工用一套它自己的、跟我电脑隔离开的设置。我电脑上那张”免检通行证”对数字员工不再生效,要紧的动作,它会老老实实提交审核,等我确认。(底层这套隔离,是成熟工具链本来就有的能力,这次我只是修复了一个漏洞。)

这件事真正让我后怕的,不是它删了个文件,而是一道安全闸,竟被我图省事的一个小配置就架空了。安全闸,从来不是装上就一劳永逸,它得有人盯着、当回事。

数字员工和电脑端大模型一个德性,干完活爱回我一句”搞定了”。我早已不全信这一套,不是它撒谎,是它跟很多能干的人一样,会高估自己、会有盲区:真以为干完了,其实没成,需要人确认。

对策:重要的活儿,我会让它换一条命令把关键结果再验一遍、贴给我看,或者自己核一眼。就像上一篇那个技术核对,我逼着它自查”这块到底是它主动去连、还是被动等着”,它一验,虚报的地方当场露馅。只有你清楚该在哪儿把关,才更敢把活交给AI。

我这套数字员工系统有个挺好的设计,能自我进化。每隔几个钟头,它会自己翻日志、找自己的毛病、试着优化自己的代码。这在我之前的 AI 产品里还是很少见的。

难得的是,它进化得很有分寸,改完只是写成草稿存档,要不要采用得我确认,我给指令”重启”才生效;而那几条管着它的安全底线,它不会碰。能自我优化、又跑不出安全笼子的设计,才是它真正让人省心、放心的地方。

其实,让 AI”危险动作先问一声”,不是靠在指令里叮嘱它、配置文件里跟它约法三章。但光这么”嘴上叮嘱”,软约束不保险,AI 偶尔会”漂移”,不一定次次照做。

真正兜底的,是一道代码级的安全闸门:删东西、动系统、碰密钥等动作,会被代码强制拦下,非等我回 y/n 不可。就算AI一时漂了,忘了软约束,也绕不过这道。这才是我敢放手的底。

当然,代码拦的是常见手法,并不是铜墙铁壁,真有人存心用刁钻方式绕,还有空子,更彻底的办法是从系统层面给它”降权”,那是后话。但比起”光靠叮嘱AI乖”,一道代码强制的闸门,已经硬太多了。安全这事,不要押在”AI会自觉”上。

AI时代差的不是谁手里的 AI 更神,而是谁更收放自如,既敢放手让它干,又放得踏实。 摸透它的特性、也管的住它。

一个要替我干活的员工,得先能”自己好好活着”。它是怎么在断网、卡死、半夜没人管的时候自己撑住、又自己活过来的,下一篇,我继续讲。

一、使唤得动:摸透它的几个特性

数字员工跟”电脑前用 AI”的关键区别

二、信得过:靠的是底层有安全机制兜底

要紧的动作,它先停下来问我

在钉钉里跟数字员工打交道,有几条规矩:

出门前,让那台电脑醒着

这道闸,我吃过一次大亏

它说”搞定了”,关键节点需要核查一遍

最亮的一手:它会”自己进化”,还跑不出安全笼子

光”叮嘱”它不管用,得有代码级的闸门

想要它停止某个任务:最初我打一句「取消」,它把手头这件连同后面排队的活一起全清空了。可我只想停当前这一件,排队里还等着的也跟着没了,差点误事。后来我把这个指令优化成了:「取消」只停手头这一件,后面排队的照跑;真要连队列一并清掉,另发一句「清空队列」。现在这么分,顺手多了。

它不会弹个框让我点选项。 隔着钉钉它没法弹窗;需要我拿个主意,它就把选项打成一段纯文本,让我回一句,批准驳回回 y/n,选项多就回 1/2/3。它给不了电脑端的选择按钮。

想让它把电脑上的文件发我?它能发的只有文本和图片,doc、pdf、md 这类文档附件发不出来,它只能把文件内容核心贴成文字发我。我发文件给它,它倒是能收能读,这头能进,那头出不来。有几次想在手机上看项目原始文件干着急,这也逼我去做了个工具优化,还真成了。(具体怎么做的,后续文章会分享。)


文章来源