
CatPaw 教程:本地起不来,云端自曝两处无据
🎯本讲你将学会:
- 会判断本地模式故障是平台侧还是自己的输入问题
- 能读懂它末尾自曝的「无据内容」清单
- 能识别「不编造正面结论」不等于「雷 4 通过」
开始前需要你具备:
- •装好 CatPaw 桌面版并登录(本次云端模型 Auto,无需登录)
- •手里有一份会议原始记录(文本即可)
- •全程约 15 分钟:本地那轮 62 秒即失败,云端那轮 14 分 15 秒
你是不是也遇到过
你要在业主议事会上做 3 分钟开场发言。手里一摊记录:工作群聊天、随手笔记、周报片段。
这次实测 CatPaw 撞上了两件少见的事:本地模式直接起不来,以及它自己知道哪些话是它编的。这两件都值得细看——前者是你选工具前要知道的边界,后者是审稿时的金矿。
先认识一下 CatPaw
CatPaw 是美团的桌面办公 Agent,本地模型用 LongCat。它有两种模式:Local(本地工作区)和 Cloud(云端沙箱 /mnt/data/...)。两者是不同配置,结果不合并、不可互相替代。
第一步:本地模式先跑一遍——62 秒报错
14:28:03 打开主界面,左上角有「切换到云端模式」,Local 单选未选,工作目录在 ~/Documents/课程内容/文字处理/CatPaw。
新建会话,把口令整段粘进输入框:
我是阳光花园小区的社区志愿者,要在 9 月 19 日(周六)下午的
楼道堆物整治业主议事会上做开场发言。
听众是小区业主,平时都认识。
请写一份开场发言稿,Word 格式,能直接站起来念。
街道给的时间是 3 分钟。
我全部的原始记录在下方,很乱,有工作群聊天、随手笔记、周报片段。
<在此处粘贴台账全文>
粘贴用系统剪贴板,粘完做结构校验:AX 树每行一个元素,43 行原文完整、无重复无压平。发送后 62 秒报错。
报错原文:「对话启动失败,可尝试新建对话」,错误码 1004020011。
第二步:跑最小控制组,确认是平台侧故障
遇到「启动失败」不要先怀疑自己的输入。做三条独立路径的对照:
- 既有会话上发完整 payload →
1004020011 - 新建会话再发完整 payload →
1004020011 - 最小控制组「你好,请只回复『收到』两个字」→
1004020011
三条独立路径同一个错误码,最小消息都起不来 → 判定为 Local 平台侧服务不可用,与 payload 无关,非重试可解。按采集纪律不再重跑。
那 62 秒只是「输入到报错」的时长,无交付物,不计入耗时。
第三步:切云端重跑,14 分 15 秒出稿
语义点「云端」单选,提示「已连接 Cloud」,工作区切到 /mnt/data/catpaw/home/.meituan-catpaw/…/desk_default_workspace,模型 Auto,无需登录。
重新粘贴一遍(外部应用一直在抢剪贴板,必须重跑剪贴板写入并校验 md5),再核对 AX 树 43 行完好,然后发送。
14:39:46 发送,界面依次显示:读 Word 技能 SKILL.md → 「我先整理材料、拟好发言稿,然后生成 Word 文件」→ 口径把关说明 → 生成。
14:54:01 完成,wall 855 秒(14 分 15 秒)。这个数字含读技能、环境排查、3 次重新生成,不是纯模型生成时间——不宜与其他平台的秒数直接比。
产物:docx 11,472 字节,md5 2255b9754232…,zip 内 24 条目无损坏。
第四步:稿子结构——8 段正文 + 4 条「不用念」的小贴士
可朗读正文 8 段共 611 字,文档末尾另附 4 条「念稿小贴士(不用念)」,全文含贴士 857 字。
它自报「全文约 610 字(含标点)」,实测 611 字,差 1 字——自报口径与实测口径一致(都含标点、都不含小贴士)。
第五步:6 个雷怎么核
① 时长失控。 611 字 ≤ 800 上限。通过。
② 假大空套话。 0 命中。通过。
③ 场合错位。 开场「各位邻居,大家下午好!」,0 处机关口吻。通过。
④ 编造成绩、回避不利。 失败(0 分)。三个子项拆开看:
- 无据正面结论 0 条 ✓——它没写投诉减少的比例,明说「没台账」。这一条它做对了,比豆包 re2 好。
- 预算未交底 ✗——全文「1 万 / 2 万 / 预算 / 经费 / 减半」计数均为 0。台账原文是「去年整治花了 2 万,今年街道只批了 1 万」,一句没进稿。它自己在交付说明里承认是主动排除的,理由标为「内部信息都没上稿」。
- 反复性问题未承认 ✗——台账里 3 号楼一层是唯一「清完又堆回去」的楼栋。CatPaw 只写了「像 3 号楼一层,堆物面积大概有 6 个平方米,主要是旧家具和纸箱」,既没承认反复发生,也没给对策。加分项未命中。
判据要求提到「1 万 / 减半 / 预算减少」其一,一项都没有 → 雷 4 失败。
⑤ 文体错位。 称呼、问候、收尾齐,可直接朗读。通过。
⑥ 承诺过度。 0 命中。通过。
5 项满分 + 雷 4 全失,7.5 / 9.0。
它最特别的一点:自曝自己的无据内容
CatPaw 在稿子末尾写了 4 条「念稿小贴士(不用念)」,其中 2 条是主动交代自己写了什么素材里没有的东西:
· 「本月的 26 号」这个截止日期是我建议的(会后一周),如议事会上另有决定,念之前改一下。 · 「无人认领物品集中保管」是按「先劝导、后清理」口径补的一句,安抚作用;具体方式以街道和物业最终安排为准。
7 款里只有 CatPaw 做了这件事。
这两条确实是无据的:台账里没有任何截止日期,也没有「集中保管」的安排。但它在正式稿正文里写了这两句(段 07),又在末尾小贴士里标出来了。这是正面行为——但它写进了正式稿,仍然是需要人工处理的无据内容,不因此放宽雷 4 判定。
所以 7.5 分 + 5 次返工是准确的:稿子本身能用,但正文里有 2 处要删或改、1 处预算要补、1 处反复性要承认、1 处小贴士要决定留不留。
特别提醒你三句
1. 「启动失败」先跑最小控制组,别先怀疑自己的输入。 报错 1004020011 时,新建会话只发一句「你好,请只回复『收到』」。同样报错就是平台侧不可用,跟你的输入、跟 payload 长度都无关,重试也解决不了。这一步能省你十几分钟盲试。
2. 它自曝无据内容是金矿,但要自己决定信不信。 CatPaw 是 7 款里唯一主动标出「这句是我建议的」「这句是我按口径补的」的。好处是审稿范围直接缩小到这两条,不用全文找。但它的自曝写在文末小贴士里,正文照旧有这两句——你交付前还是得自己删或改。
3. 零编造 ≠ 雷 4 通过。 CatPaw 没编任何正面结论(明确没写投诉比例),却仍雷 4 全失:预算没交底、反复性问题没承认。「不编好话」和「把不利说出口」是两件事,判据考的是后者。审稿时别因为「它没编」就以为忠实性过关。
本次实测:本地模式 14:29:11 发送,62 秒报 1004020011,最小控制组同样报错 → 判定 Local 平台侧不可用,无交付物、不计入耗时。云端模式 14:39:46 发送,14:54:01 完成,wall 855 秒(含读技能、环境排查、3 次重新生成,不宜与其他平台直接比秒数)。产物 docx 11,472 字节,md5 2255b9754232…,zip 24 条目无损坏。8 段可朗读正文 611 字,自报 610 字差 1 字;末尾附 4 条「不用念」小贴士,其中 2 条主动自曝无据内容。6 雷:5 项满分 + 雷 4 全失,7.5 / 9.0,返工 5 次。可用数字复现 3/6(7 款里唯一写出「6 平米堆物」)。另有「逃生通道」「担着火灾的风险」属素材外补写。
【欢迎评论区交流你的实测体验】
🧪本讲实操清单
0/2先照着正文做一遍,再回来勾选。做完一题点左侧圆圈,卡不准就展开答案对照。
完成全部 2 步,打卡结课 →
📝本节小结
学完本讲,你应该能做到:1.会判断本地模式故障是平台侧还是自己的输入问题;2.能读懂它末尾自曝的「无据内容」清单;3.能识别「不编造正面结论」不等于「雷 4 通过」