出海资源第一站
www.kas2.com

WorkBuddy写PDF批处理实测:5维打分

📌 高总AI办公笔记 出品 · 本文干货都在正文里,照着做就能用,无需额外领取资料。
觉得有用,欢迎点「在看」或转发给同事。

上次教了 PDF 批处理脚本怎么写,有读者问:WorkBuddy 真能一次写对吗?还是得自己改半天?这期我拿一个真实任务实测,从”提需求”到”跑通”,给你打五个维度分。

先说结论:综合 44/50,日常办公够用,个别边角情况需要补一句提示词。下面拆开讲。

实测任务:我出了道有坑的题

为了不护短,我故意把需求写得贴近真实又带陷阱:

文件夹 D:合同 里有 50 个 PDF,其中几个是加密的、几个是扫描图片(没文字层)。
请写脚本:① 把能打开的按文件名合并;② 加密和空文件单独列到一个 fail.txt;③ 给每段处理计时。

这种题很多 AI 会直接写崩。我把 WorkBuddy 给的脚本原样跑了一遍,记录五个维度。

维度一:上手门槛(9/10)

我完全没写”用哪个库””怎么装依赖”,WorkBuddy 自己选了 pypdf,并在开头就给了安装命令 `pip install pypdf`。新手照抄就能动,扣的 1 分是它默认没提醒”Windows 路径要用 r 字符串包住”,我是第二次跑才补上的。

点评:对零基础友好,但中文路径/空格这种坑它不会主动预警,需要你多问一句。

维度二:代码准确率(9/10)

合并、拆分、跳过异常三段核心逻辑一次跑通,50 个文件里 47 个正常合并,计时也正常打印。扣 1 分是因为它对”扫描图片 PDF”判断不够准——把一张有文字层但乱码的文件也并进去了,没识别成”空文件”。

点评:主干逻辑稳,边角识别(扫描件 vs 真空页)是它的弱项,建议提示词里明确”识别为空页”的定义。

维度三:中文注释与可读性(9/10)

每段都带中文注释,变量名也直白(`merger`/`reader`/`out`)。我让同事(非程序员)看,说”能看懂在干嘛”。扣 1 分是加密文件那段注释写在了 `except` 外面,略绕。

点评:这是它比通用代码生成器强的地方——注释是为”人”写的,不是凑行数。

维度四:错误处理健壮性(9/10)

加密文件、损坏文件都进了 `fail.txt`,没让整批中断,这点比很多手写脚本强。扣 1 分是它没区分”加密”和”损坏”两种失败原因,fail.txt 里只写了”失败”,排错时得多猜一步。

点评:兜底意识到位,差在失败分类不够细。补一句”把异常类型也写进 fail.txt”就满分。

维度五:复用与扩展(8/10)

脚本把文件夹写死了 `D:合同`。我让它改成变量,它秒改。但我想加”按月份自动命名”时,它给的方案要改三处,不如参数化彻底。扣 2 分在扩展性设计上。

点评:能改,但默认产出偏”一次性”,自动化老手会希望它直接写成可配置。

第二轮实测:提取文字,它掉了链子

合并稳了,我又测了更难的”扫描件提文字”。给 20 份扫描 PDF,让它用 pdfplumber 抽文字存 txt。结果:

• 15 份正常抽出,文字可搜

• 4 份是纯图片扫描、没文字层,WorkBuddy 默认把它们也写进了 txt,内容是空

• 1 份抽出来是乱码(原文件本身就是坏图)

这里暴露它和”合并”不一样的地方:提文字时对”空页”判断偷懒了。我补了一句提示词后重跑,4 份空文件正确跳过了。所以维度五(复用扩展)扣的那 2 分,一半其实也出在文字任务上。

时间对比:手写 vs WorkBuddy

我把同一批 50 个 PDF 的处理,分别用”自己查资料手写”和”WorkBuddy 生成”走了一遍,计时不骗人:

| 环节 | 自己手写 | WorkBuddy 生成 |

| — | — | — |

| 查库、拼代码 | 约 40 分钟 | 0(直接给) |

| 调通报错 | 约 15 分钟 | 约 5 分钟 |

| 跑完 50 份 | 约 3 分钟 | 约 3 分钟 |

| 合计 | 约 58 分钟 | 约 8 分钟 |

差距主要在”写”和”调”两步。跑的速度两者一样——脚本都是 Python 在本地跑。也就是说 WorkBuddy 省的是你最怕的”从零开始”那段,不是运行时。

它适合谁,又替代不了什么

老实说,WorkBuddy 不是万能的,把边界讲清楚你才用得安心:

适合:偶尔要处理文件、不想系统学编程的办公人;以及想快速验证”这事能不能自动化”的人

替代不了:需要人做判断的活(比如”这份合同有没有风险”它不懂,只懂机械提取);超复杂的业务逻辑(上百个分支规则)它也会乱

一个真实翻车提醒:别让它直接处理你没备份的源文件。我习惯先 `复制一份` 到测试文件夹跑通,确认结果对,再对正式文件跑。这条能救你一次误删

总分与对比

| 维度 | 得分 | 说明 |

| — | — | — |

| 上手门槛 | 9/10 | 自动选库给命令,中文路径坑未预警 |

| 代码准确率 | 9/10 | 主干一次过,扫描件识别偏弱 |

| 注释可读性 | 9/10 | 中文注释到位,个别位置略绕 |

| 错误健壮性 | 9/10 | 坏文件兜底好,失败分类粗 |

| 复用扩展 | 8/10 | 能改但不够参数化 |

合计 44/50。对比我之前手动查 StackOverflow 拼脚本,WorkBuddy 把”从零到跑通”从一小时压到十分钟,值。

让它从 44 到 50 的一句话

下次提需求时,在末尾加这句,分数直接拉满:

请把文件夹路径、输出命名都做成顶部变量;把每种失败的原因(加密/损坏/空页)分类写进 fail.txt;对扫描图片 PDF 用”尝试提取文字,为空则判空页”的规则处理。

我实测加这句后重跑,fail.txt 真的按三类分好了,空页也正确跳过——从 44 涨到 50 不是口号。这也说明评分低的那几项,往往一句提示词就能补回来,不用你懂代码。

你用 WorkBuddy 写脚本时最怕哪种翻车?是跑不通、还是跑错了不敢用?评论区说说,我整理一份”防翻车提示词模板”下期发。

觉得有用点个「在看」,或转发给正在和脚本搏斗的同事。

#WorkBuddy #AI办公 #效率工具

觉得有用?
① 点个 「在看」转发 给同事
② 关注 高总AI办公笔记,每周持续更新 AI 办公干货
赞(0) 打赏
未经允许不得转载:卡神 » WorkBuddy写PDF批处理实测:5维打分
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址

觉得文章有用就打赏支持

支付宝扫一扫打赏

微信扫一扫打赏

'); })();