用 WorkBuddy 梳理合同:批量提取条款、生成台账、比对多份差异

2026-08-08

手上攒了几十份合同要梳理,难受的地方很具体:文件名一半是「合同最终版(2).pdf」,正文格式各不相同,想知道哪几份今年到期、哪几份付款节点在季度末、哪几份的违约条款跟标准模板不一样——只能一份份打开翻。翻到第十份的时候,前面几份记的什么已经开始模糊了。

这类活儿的形状很清楚:重复、机械、规则明确,但量大。它正好落在 WorkBuddy(Tencent WorkBuddy)这类能读本地目录、能批量处理文件、能直接产出表格的桌面工作台的能力范围内。

但在往下写之前,有一条线必须先划死:合同是法律文件,AI 在这件事上的角色只能是「初筛与台账」,不能是「审查结论」。这篇讲的全部是怎么把整理的体力活交出去,以及交出去之后你必须自己盯的地方。

一、先把「能交」和「不能交」分开

官方文档在讲专家能力时有一句提醒写得很直白:AI 生成内容仅供参考,无法替代专业判断,不构成决策和投资建议。这句话放在合同场景里不是免责套话,是操作前提。

环节能不能交说明
批量重命名、按类型归档官方实践案例里明确点了合同、票据这类文件
从正文里抠出甲乙方、金额、期限、付款节点属于信息提取,但提取结果必须回原文核
汇成一张可排序、可筛选的台账表输出格式要在指令里说死
把多份同类合同的对应条款并排列出差异它负责”列出不同”,不负责”判断哪个更好”
判断某条款是否对己方不利不能这是法律判断
识别法律风险、评估条款效力不能同上,必须法务或律师
任何要签字、要盖章、要回函的决定不能不存在”AI 说没问题所以签了”这种流程

上半张表是省时间,下半张表是省不了的。中间那条线的意思是:它可以把「第 7.2 条约定逾期违约金为日万分之五」这句话准确地摘出来放进表里,但「日万分之五合不合理、要不要谈」这个问题,它给的答案没有任何效力

二、开工前的两件事:分目录,和确认它读得出来

分目录不是洁癖,是风险控制

官方在讲工作目录时给了一条建议:按任务类型分别建目录,比如发票整理、周报、待处理照片各建一个,便于管理并降低误操作风险。这条建议在别的场景里可能只是「整齐一点」,在合同场景里是硬要求。

原因是权限模型。官方文档写明权限分两档:默认权限下涉及文件修改、工作空间外执行等敏感操作时需要用户确认;完全访问权限减少确认步骤、允许直接执行更多操作,官方只建议在信任当前任务时使用。也就是说——你把哪个目录设成工作目录,它就在哪个目录里读和写。合同目录如果跟财务表、员工资料、客户名单混在一个盘符下,那就是把不该给的东西一起给出去了。

所以第一步:单独建一个合同梳理目录,只把这次要处理的合同复制进去,原件留在原处。这一步顺带解决了备份问题——官方技巧第 8 条说得很直接,它可能改过头,删掉你想保留的内容、打乱原有格式,建议改文档表格前先复制一份备份(文件名加 _备份 或当天日期),成熟的用法不是期待它永不出错,而是提前准备好回退方案。

官方 FAQ 里还有一条更硬的记录:有用户下发整理桌面的指令后生成了一个 PS 脚本,执行后桌面确实整理了,但部分文件疑似丢失。官方给的做法是执行前先备份重要文件,执行后优先检查目标整理目录与回收站。合同目录经不起这一遭。

扫描件是这个场景最大的坑

很多公司归档的合同是扫描件——纸质签完盖章再扫成 PDF 或图片。这类文件丢给它,很可能什么也提取不出来。

官方 FAQ 对「无法读取图片 / PDF / Excel / Word」给的原因是:当前模型不支持对应文件类型,或者未安装相关插件与 Skill。官方给的做法有三条:切换到支持图片或文档输入的模型;分步骤描述需求,让它逐步完成环境安装与文件处理;在插件或技能市场安装文档处理类的插件与 Skill。

模型这一层可以参考官方给的分工表——Kimi K2.5 的适用场景写的是截图分析、图片转文档这类视觉任务,MiniMax M2.5 对应 Excel 处理与数据分析,腾讯混元对应中文写作与中文文档处理。需要注意官方另有一句说明:实际可用模型列表可能随产品版本、账号类型和服务可用性变化。

实际操作上,建议开工前先拿两三份代表性文件做个探路:一份原生电子版 PDF、一份扫描件、一份 Word。用官方建议的「问一问」模式问它这几份文件里的甲乙方分别是谁——这个模式只做问答与信息查看、不修改文件,正好用来试深浅。读不出来的那一类,要么先单独处理,要么这一批就别指望它。

三、指令怎么写

官方《10 个上手技巧》给的公式是做什么 + 有什么 + 怎么样,别让 AI 猜你的意图;《创建任务》文档进一步把要补的信息列成四项:目标是什么 / 输入是什么 / 输出格式 / 约束条件。合同梳理拆成三个独立任务往下发,比一口气全说完稳得多——这也对应官方技巧第 2 条「小步快跑」:把大任务拆成独立小目标,一次推进一步,每步都能确认方向,发现偏了及时拉回,而不是最后整份推翻。

任务一:先把文件名理顺

这一步官方实践案例里有原文可以直接照抄,场景就是「目录中大量命名混乱的图片、合同、票据」:

请读取这个文件夹中的文件内容或文件属性,按 日期 + 主题 + 类型 的规则批量重命名,
并先展示重命名预览结果。

先展示重命名预览结果」这半句是官方指令里自带的,不要删。官方在讲远程使用建议时也重复了同一条原则:涉及删除、覆盖、批量移动时先要求预览。合同文件重命名一旦跑歪,你连原来叫什么都找不回来。

任务二:抠条款,出台账

请读取 D:/合同梳理/2026 目录下的全部合同文件,逐份提取关键信息生成台账表格。

【输入】该目录下所有 PDF 与 Word 格式的合同文件,共 32 份。

【目标】每份合同提取以下字段,一份一行:
文件名 / 合同名称 / 甲方 / 乙方 / 签署日期 / 生效日期 / 到期日期 /
合同总金额及币种 / 付款节点与比例 / 违约责任条款所在条号 /
是否含自动续约条款 / 是否含排他或独家约定 / 争议解决方式。

【输出格式】生成 Excel 文件,保存到 D:/合同梳理/输出 目录,
文件名为「合同台账_20260808.xlsx」。第一行为表头,冻结首行。

【约束】只填文件里白纸黑字写了的内容,一个字都不要推断。
字段在原文中找不到时填「未载明」,不要填空、不要猜、不要写"约"或"大约"。
每个字段后面加一列「出处」,写明该信息来自原文第几条或第几页。
不要对条款做任何评价或风险判断。

这条指令里有三处是特意加的,值得单独说。

一是「找不到就填未载明」。AI 补全缺失信息的倾向很强,留白比编造安全得多。台账里出现一个凭空冒出来的到期日,比这一格空着危险十倍。

二是「每个字段后加出处」。这是整篇里最关键的一句。有了出处,验收的时候你才能抽查——翻到第 12 条,看它写的对不对。没有出处,你只能整份重读,那这个台账就白做了。

三是「不要做任何评价或风险判断」。不是它做不了,是你不该要。一旦台账里出现「该条款对甲方不利」这类结论,后面看表的人很容易当成结论用,而它没有资格下这个结论。

顺带一提,官方技巧第 5 条建议给它一个身份(法律顾问、产品经理、数据分析师等预设角色),相当于预设一层角色提示,让表达框架与专业术语更快对齐。在这个场景里用「法律顾问」角色可以让它更准确地识别条款名称和术语,但角色提示只影响措辞和关注点,不产生任何法律意义上的意见,别把角色扮演当成咨询。

任务三:比对多份合同的差异

比对不要一次上三十份,官方技巧第 6 条说「一个好的参考样本胜过十行抽象要求」,比对场景里这个样本就是你的标准模板:

请以 D:/合同梳理/模板/标准采购合同模板.docx 为基准,
逐条比对 D:/合同梳理/2026/供应商 目录下的 5 份采购合同。

【目标】输出一张差异对照表,只列出与模板不一致的条款。
每行包含:合同文件名 / 条款主题 / 模板中的表述 / 该合同中的实际表述 / 差异类型
(新增条款 / 删除条款 / 表述修改 / 数值不同)。

【输出格式】生成 Markdown 文件,保存到 D:/合同梳理/输出 目录,
文件名为「差异比对_供应商采购_20260808.md」。

【约束】只做客观比对,原样引用两边的原文,不要改写、不要概括。
不判断哪一方表述更有利,不给修改建议。
完全一致的条款不用列出。无法定位到对应条款的,单独列在文末「需人工确认」区。

最后那句「无法定位的单独列出」是给自己留的闸。条款顺序被调换、被合并、被拆分的情况非常常见,这些恰恰是最需要人看的地方,让它把没对上的老实交代出来,比让它硬凑一个对应关系有用得多。

四、交付物长什么样

三个任务分别产出:重命名后的文件本身(留在合同目录)、一份 Excel 台账、一份 Markdown 差异对照表,后两者落在你指定的输出目录。

关于格式,官方 FAQ 里有一条踩坑记录值得先看:「生成的文件打不开」这个问题,常见原因是未在需求中明确指定输出文件类型,官方给的做法就是下达任务时明确说明要生成的格式,例如 Word、Excel、PDF 或 Markdown。上面三条指令里都把文件名连扩展名一起写死了,就是为了避开这一条。

产出位置也别含糊。官方在讲工作目录时说明,未指定路径的任务会优先在工作目录内执行,未提前指定时会在新建任务时自动创建独立目录。合同这种东西,你得知道它到底写在哪儿了。

另外,如果这套台账流程你每个季度都要跑一次,官方实践案例里提到可以把固定流程沉淀成自定义 Skill——在对话框直接说明想要的能力、触发方式和输出结果即可创建,之后用自然语言触发。不过这一步建议手动跑顺两三轮、指令基本不用再改了之后再做。

五、四步验收,一步都别省

台账生成出来是最容易松劲的时刻,而这恰恰是最不能松的地方。以下四步按顺序过:

第一步,查份数。 目录里 32 份,台账里是不是 32 行。少了的那几份,八成就是上面说的扫描件读不出来——它不一定会明确告诉你跳过了哪些,得你自己数。

第二步,抽查出处。 从台账里随机挑五到八行,按「出处」列翻回原文核对。重点盯金额、日期、比例这三类——数字是提取任务里最容易错位的,尤其是合同里同时出现总价、含税价、分期金额的时候。

第三步,查串行。 批量处理最典型的错误是把 A 合同的条款挂到 B 合同名下,尤其当几份合同来自同一个模板、正文高度相似时。挑两份最像的对照着看一遍。

第四步,查「未载明」是不是真的未载明。 这一栏容易两头错:该填的填了空,或者原文其实写了但它没找到。数量不多的话建议全查,因为「合同没约定到期日」和「AI 没找到到期日」是完全不同的两件事。

如果发现问题,不用重写整段提示词。官方在讲任务对话时说明,继续追问会基于之前的上下文继续处理,不需要重复描述背景——直接说「第 14 行的合同金额错了,请重新核对该文件第 3 条」就行。

六、这些情况别交给它

第一,需要出审查意见的时候。 判断某条款是否对己方不利、评估法律风险、给修改建议——这些不在讨论范围内。台账和差异表的正确用法是交给法务或律师作为工作底稿,替他们省掉翻文件的时间,而不是替他们下结论。任何要签字的决定,链条上必须有一个人类专业意见。

第二,涉密程度高、不能进工作目录的合同。 官方在《数据安全说明》里声明了三层机制:技术层面有 Bash 命令沙箱、文件系统隔离(只能访问预先授权的工作空间目录)、防沙箱逃逸、启动时仅拥有只读权限、以及 allow/ask/deny 三种权限规则;合规审计层声明数据在用户本地环境执行处理不上传,服务端仅处理数据片段、用后即弃、不保存不用于模型。这些是官方文档写明的机制,不是我们能替它担保的结论——你自己那份保密义务,不会因为工具声明了什么而转移。涉及并购、诉讼、核心客户的合同,先过内部合规再说。

顺带提醒一条容易被忽略的设置:官方文档说明「生成对话记忆」默认开启,会从对话中提取并记住上下文,记忆内容遵循官方隐私政策、仅本人可见,摘要每晚重新生成,且可以查看、编辑,也可以通过对话让它记住或忘记什么。处理敏感合同前,这个开关值得你自己确认一遍。

第三,只有几份合同的时候。 三五份合同,你自己翻一遍加上核对的时间,未必比写指令、调格式、逐行验收更长。这套流程的收益随份数增长,份数少的时候是负收益。

第四,一上来就想全自动。 官方技巧第 4 条「先本地后远程」讲得很清楚:远程遥控意味着它在你看不见的地方自主行动,执行了超出预期的操作你未必来得及叫停,建议新手先在桌面端边看边用,摸清执行方式、理解习惯和风险边界,再逐步放手。合同目录属于最不该早放手的那一类。

另外,如果你打算用专家团来跑这类多环节任务,官方有一条积分提醒必须知道:专家团可能调用多位专家协同执行,积分消耗通常为单个专家的数倍,请确保账户积分充足。

小结

合同梳理交给 WorkBuddy,能拿到的是三样东西:理顺的文件名、一张带出处的台账、一份客观的差异对照表。省下的是翻文件的体力,省不掉的是核对和判断。

指令按「目标 / 输入 / 输出格式 / 约束」四要素写,务必加上「找不到就填未载明」和「每个字段带出处」这两条约束;批量改名一定要求先出预览;产出后按份数、出处、串行、未载明四步验收。

至于哪条条款该谈、哪个风险要提、这份合同能不能签——那是法务和律师的活儿,不是工具的活儿。

相关阅读


本文依据 WorkBuddy 官方文档(workbuddy.ai/docs/zh/workbuddy/ 的《快速开始》《创建任务》《任务对话》《技能》《专家》《记忆》《10 个上手技巧》《实践案例》《常见问题》等页面)整理,核对日 2026-08-08,非亲测操作记录。产品功能与界面以官方最新说明为准。本文不构成法律意见。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。