ZCode · AI 助手教程第 4 讲 / 共 4 讲进阶3 个学习目标2 道自测⏱ 约 9 分钟

ZCode 教程:唯一派子智能体检版,却把预算误判成无台账

#AI Agent#ZCode#讲话稿#教程#实测

🎯本讲你将学会:

  • 能新建 ZCode 会话并整段粘入口令与台账
  • 能读懂它派子智能体做视觉验收的迭代过程
  • 会识别「误判素材有无」这种认知错误型失分
📌

开始前需要你具备:

  • 装好 ZCode 桌面版并登录(本次 ZCode v3.11.2 / Electron 41.0.3,模型日日新 SenseNova sensenova-6.8-flash-lite)
  • 手里有一份会议原始记录(文本即可)
  • 全程约 14 分钟:操作 30 秒,剩下 13 分 34 秒它自己干

你是不是也遇到过

你要在业主议事会上做 3 分钟开场发言。手里一摊记录:工作群聊天、随手笔记、周报片段,中间夹着同事约饭、孩子报奥数班。

你要一份能站起来直接念的稿子。但你心里还有一层没底的:万一被业主当场问到某个数字,答不上来怎么办?万一时间不够念完,该砍哪一段? 这两个问题,大多数工具不会替你想——它只会把稿子给你。

这次实测的 ZCode 是 7 款里唯一替你想这两件事的。但它在最关键的一条上出了认知错误。

先声明一件事:这篇有自指偏差

操作者、评分者、被测平台是同一个 ZCode 实例、同一个模型(日日新 SenseNova sensenova-6.8-flash-lite)。任务是在 ⌘N 新建的独立会话里跑的,然后由同一个模型按同一份判据打分。

它拿到的 7.5 分,不能和另外 6 款的 7.5 分并排当作同一种分数。这条偏差无法消除,只能披露——所以写在最前面。

先认识一下 ZCode

ZCode v3.11.2(Electron 41.0.3),权限选「完全访问」。它的生成路径和别的平台不一样:用 Node 的 docx 库直接写 Word,中间产物是一个 JavaScript 脚本(本次 6,531 字节),不是 HTML 也不是 python-docx。

更特别的是:它会派出一个子智能体 judge 专门做视觉验收——生成 docx → 转成缩略图 → judge 读图找排版缺陷 → 主流程改 → 再验一遍。

第一步:新建会话,整段贴入口令与台账

先按 ⌘N 建一个干净会话。这一步不能省:如果你直接在当前会话里粘贴发送,口令会变成”让你写稿子”的指令注入当前会话本身。

ZCode 新会话,口令与台账已整段粘进输入框
我是阳光花园小区的社区志愿者,要在 9 月 19 日(周六)下午的
楼道堆物整治业主议事会上做开场发言。
听众是小区业主,平时都认识。

请写一份开场发言稿,Word 格式,能直接站起来念。
街道给的时间是 3 分钟。

我全部的原始记录在下方,很乱,有工作群聊天、随手笔记、周报片段。

<在此处粘贴台账全文>

粘贴用系统剪贴板(⌘V),这样多行结构不打平。粘完按 Enter 发送。

这段口令只给了三条提示:「3 分钟」「听众是业主、平时都认识」「能直接站起来念」。不写套话、不用机关口吻、如实说预算减半、不替人打包票——这四条一个字没提。

第二步:发出去,它跑了 26 步

18:36:20 发送。之后它依次:思考 76 秒 → 读台账 → 生成 docx 脚本 → 执行生成 → 派子智能体 judge 做视觉验收(约 60 秒) → 修改 → 再生成 → 再验。

处理过程:脚本生成、子智能体视觉验收、迭代推进中

关键时间线:18:43:37 docx v1 落盘(+437 秒)→ 18:48:11 生成脚本最后一次编辑(+711 秒)→ 18:49:54 docx v2 落盘(+814 秒)。

完成结果:docx v2 产物已落盘

记录里的 wall 1570 秒是采集侧观测上限(我在核对处理流程),不作平台耗时。真实生成以 docx v2 落盘为准:约 13 分 34 秒。

第三步:子智能体判了什么、改了什么

这是本篇最值得看的一步。v1 生成后,子智能体 judge 读 docx 缩略图,判出 2 处问题,原文是:

备注区上方的分隔线没渲染出来(我把边框挂在了一个空段落上),以及备注块与正文之间空白失衡。我改成带浅灰底的「不念区」色块,分隔线直接挂到备注标题上,同时加大正文段距把版面填匀。

然后改了、重新生成 v2、再验一遍。

两个版本留了档:v1 10,570 字节,v2 10,585 字节,只差 15 字节——说明它改的是版式不是内容

终版 docx:10,585 字节,md5 75826a9233a3abb23956bfa48dde582d,zip 内 22 条目无损坏。

终端校验输出:字节、md5、zip 条目、分段字数、两版迭代对比

第四步:稿子结构——9 段正文 + 6 段「不念区」

17 段全部非空,0 个表格(和 WorkBuddy 用表格做发言提示不同)。

区块字数
标题 + 副标题36
可朗读正文(9 段)523
备忘区「不念区」(6 段)229
全文788

可朗读正文 523 字是 7 款最短,但它另外写了 229 字的备忘区——7 款最多。备忘区进不了 3 分钟,却是这篇稿子最值钱的部分。

开场用双称呼:「各位业主,各位街坊邻居,下午好。」正文内嵌 2 处「(停顿)」标记。

它自报「全文约 510 字,正常语速约 2.3 分钟」,实测 523 字,偏差 -13 字(-2.5%)。它是 7 款里唯一主动算出具体分钟数、并且明说「留了余量」的。

第五步:6 个雷怎么核

① 时长失控。 523 字 ≤ 800 上限,余量 277 字。通过。

② 假大空套话。 0 命中。通过。

③ 场合错位。 双称呼开场,0 处机关口吻。通过。

④ 编造成绩、回避不利。 失败(0 分)——三个子项拆开:

  • 无据正面结论 0 条 ✓
  • 反复性问题如实写 + 给对策 ✓——正文原文:「(停顿)先跟大家交个底:上次清的那一层,第二天又堆得满满当当。这事我们也反思过——光靠物业和志愿者几个人去搬,搬干净了也守不住,最后大家还是不痛快。」命中加分项。
  • 预算误判为「没有台账」✗——它把预算藏了,理由是它以为素材里没有这条信息。备忘区原文:

有意没说出口的数字:整治预算、投诉减少比例、堆物面积、已联络户数——都没有台账。真被问到,就答「这个数我们回头核准了再跟大家说」。

但素材里有 3 处明文有据的预算:09-03 物业老赵「这次预算跟去年不一样,去年整治花了 2 万,今年街道只批了 1 万」、随手笔记「去年整治 2 万,今年 1 万」、周报「街道批复预算 1 万」。

这是本期性质最重的一次失分。 对比:TeleAgent 藏预算是编辑判断(知道有、主动不写、自陈理由),可以批评但可追溯;ZCode 是认知错误(以为没有),无法追溯。而且它把这个错误结论连同一句搪塞话术一起交给了发言人——一个本来可以照说的数字,被它变成了需要现场搪塞的数字。

⑤ 文体错位。 口语体,有称呼、有停顿提示、有收尾(「我这边就说到这儿。剩下的时间交给各位……有请【主持人】。」)。通过。

⑥ 承诺过度。 0 命中。通过。

5 项满分 + 雷 4 全失,7.5 / 9.0。

它比别的平台多给的三样东西

备忘区 6 段 229 字,其中 3 类内容前 6 款一个都没有

① 超时应急策略(7 款唯一给「超时删哪一段」的)

时间一紧就整段略过第 7 段(人力、请大家搭把手),其余照念,逻辑不受影响。

② 被追问的应对话术(7 款唯一给「藏了哪些数字 + 怎么答」的)

有意没说出口的数字:整治预算、投诉减少比例、堆物面积、已联络户数——都没有台账。真被问到,就答「这个数我们回头核准了再跟大家说」。

③ 用语红线(7 款唯一给「会上别出现的说法」的)

会上别出现「清运」「清理违规物品」这类说法,统一口径是「先劝导、后清理」。

第 ① 和第 ③ 是真金。 第 ② 的前半句(投诉比例、堆物面积、已联络户数确实没台账)也对,但它把「整治预算」一并列了进去——这一列就把一个可以说出来的数字变成了搪塞对象。

特别提醒你三句

1. 「没有台账」这四个字要自己核一遍。 ZCode 在备忘区列了「没有台账」的数字清单,其中 3 项确实没有,但「整治预算」素材里有 3 处明文。AI 判断「素材里没有」时,你要拿原始记录 grep 一遍再信——尤其是那种它顺手写进给你备忘的错误结论,你不核就直接上台了。

2. 它会替你规划「砍哪一段」,这是最实用的一项。 「时间一紧就整段略过第 7 段,其余照念,逻辑不受影响」——这句话 7 款里只有 ZCode 给了。它判断了哪些段落是可删的、删了不影响逻辑。你在意临场应变的话,这一条就够选了。

3. 它会派子智能体验稿,但验的是版式不是内容。 judge 判出的 2 处问题都是排版(分隔线没渲染、空白失衡),v1 到 v2 只差 15 字节——它改的是版式,内容一字未动。所以那个预算误判,验收环节完全没拦下来。视觉验收能查排版,查不了事实。


本次实测:18:36:20 发送,docx v1 落盘 +437 秒,生成脚本最后编辑 +711 秒,docx v2 落盘 +814 秒(约 13 分 34 秒);记录里的 wall 1570 秒为采集侧观测上限,不作平台耗时。产物 docx 10,585 字节,md5 75826a9233a3abb23956bfa48dde582d,zip 22 条目无损坏;v1 10,570 字节,两版差 15 字节(只改版式)。17 段全非空 0 表格;标题副标题 36 + 可朗读正文 9 段 523 字 + 备忘区 6 段 229 字 = 全文 788 字。自报 510 字偏差 -2.5%,7 款唯一主动算分钟数并留余量。6 雷:5 项满分 + 雷 4 全失,7.5 / 9.0,返工 2 处(段 09「楼道是咱家的出口」为素材外补写、备忘区误列「整治预算」为无台账)。可用数字复现 1/6。本篇有自指偏差(操作者、评分者、被测平台同一实例同一模型),分数不可与另 6 款无差别并列。

【欢迎评论区交流你的实测体验】

🧪本讲实操清单

0/2

先照着正文做一遍,再回来勾选。做完一题点左侧圆圈,卡不准就展开答案对照。

完成全部 2 步,打卡结课 →

📝本节小结

学完本讲,你应该能做到:1.能新建 ZCode 会话并整段粘入口令与台账;2.能读懂它派子智能体做视觉验收的迭代过程;3.会识别「误判素材有无」这种认知错误型失分