用 WorkBuddy 合并多份表格:表头对不齐怎么办,指令、交付物与验收清单

2026-08-08

把十二份月度销售表拼成一张年表,难受的地方在于每份表都长得不太一样。有人写「金额」,有人写「销售额」,还有人写「收入(含税)」;有的表日期在第一列,有的在最后一列;下半年的表还多了一列「渠道」。

合并的工作量全在对齐上。这也是把它交给 WorkBuddy(Tencent WorkBuddy)时最容易翻车的一环:你不说清楚哪个字段等于哪个字段,它就会自己猜

一、官方给的依据是哪条

官方《技能》文档说明内置 20+ 技能包,覆盖文档处理、数据报表、文件整理等场景,列出的示例里有一条就叫自动化报表——合并多份 Excel 并输出图表报告。其中「输出图表报告」是后半段,本文只谈前半段:合并没对,图做得再漂亮也是错的。

二、别急着合并,先用 Ask 摸清现场

官方对三种工作模式的划分是:

模式说明适用场景
问一问(Ask)仅问答与信息查看,不修改文件了解内容、确认需求
做一做(Craft)直接执行任务并修改文件文档生成、表格处理
想一想(Plan)先生成执行计划,确认后再操作多步骤、需审阅改动范围

第一轮走 Ask。不是为了谨慎,而是你多半也不清楚这十几份表到底差在哪——印象里「格式都差不多」,打开总有两三份是例外。

先不要做任何合并。请读取 D:/汇总/分月销售 目录下的全部 Excel 文件,
对每个文件输出:文件名、工作表名称、表头字段列表(按实际列序)、数据行数、
第一行数据示例。用表格汇总,一个文件一行。
最后单独列出:哪些字段只在部分文件中出现。

这一轮拿到的是写映射规则的原料。最后一句尤其关键,多列少列的问题都在这里现形。

三、核心难点一:字段映射必须你来写死

AI 处理表头不一致时的默认行为是做语义猜测:看到「销售额」和「金额」大概率认为是同一列;看到「收入(含税)」和「收入(不含税)」也可能一并归到「收入」。前一个猜对是运气,后一个猜错才是灾难——含税与不含税混进同一列,加出来的总数是错的,而且从结果上看不出来。

所以映射规则要以清单形式写进指令:

【字段映射】以下列名视为同一字段,统一改名为左侧标准名:
- 销售额 ← 金额 / 销售金额 / 营业额
- 日期 ← 订单日期 / 成交日期
- 客户 ← 客户名称 / 往来单位
【严禁自行推断】未在上表出现的列名,一律不要并入已有字段,
原样保留为独立列,并在结束后告诉我它们出现在哪些文件里。

「严禁推断 + 原样保留 + 事后告知」这三句是重点:它把「猜错了」这种静默错误,换成了「多出几列你能看见」的显性问题。多几列很好删,混错的数据很难查。

另有两处提前交代:缺失的列留空还是填 0(两者在统计里不是一回事),以及加不加一列「来源文件」——后者建议加上,它是验收能否回溯的前提。

四、核心难点二:分清「该合并」和「该去重」

同一条记录出现在两份表里,留两条、留一条还是相加?这是业务口径问题,只能你定。

情形举例该怎么处理
真重复同一张订单被两个部门各报一次按订单号去重,保留一条
假重复同一客户 3 月、4 月各下一单两条都留,不能去重
需合并计算同一订单分两次开票,各报一行按订单号合并,金额相加

区别在于判重的键是什么。按「客户名」判重,第二行就被误杀;按「订单号 + 开票次数」判重,第三行又合不起来。指令里得写清楚:以哪几列组合作唯一标识、重复时保留哪条。

让它把删掉的重复行另存一份,比事后从几千行里找哪条被吃掉容易得多。官方在《实践案例》里给批量重命名任务的示例指令末尾也专门写了「并先展示重命名预览结果」——涉及删除、覆盖、批量移动的操作,先看预览再落地。

五、完整指令:按四要素填

官方《创建任务》建议的任务描述四要素是:目标 / 输入 / 输出格式 / 约束条件。填进去是这样:

【目标】把多份分月销售表合并成一张总表,不做统计和图表。

【输入】D:/汇总/分月销售 目录下全部 .xlsx 文件,每个文件只取第一个工作表,
表头在第 1 行,数据从第 2 行开始。

【字段映射】按上一节的映射清单统一列名,未列出的列名不要并入已有字段。
缺失的标准字段留空,不要填 0。额外增加一列「来源文件」。

【去重规则】以「订单号」为唯一标识,重复时保留日期最早的一条;
被删除的行另存为 重复行.xlsx。订单号为空的行不去重,全部保留。

【输出格式】生成 汇总表.xlsx 保存到 D:/汇总/输出,
列序为:日期、订单号、客户、部门、销售额、来源文件,其余列排后面。
结束后报告:读取几个文件、各文件行数、合并后总行数、去重删了几行。

【约束】不要修改任何原始文件,不做换算、四舍五入或格式推断,金额保留原值。
遇到无法归类的列或读不出的文件,停下来问我,不要自行处理。

最后一句「停下来问我」是刹车。默认权限下涉及文件修改、工作空间外执行本来就需要确认;若开了完全访问权限,确认步骤会减少,这句话就是唯一的兜底——官方对该权限的措辞也是「仅建议在信任当前任务时使用」。

前置动作也别省:先备份原始文件。官方技巧第 8 条讲得直接,它可能「改过头」,删掉你想保留的内容或打乱原有格式;成熟用法不是期待它永不出错,而是备好回退方案。

六、交付物长什么样

输出目录里应有三样:合并总表(带「来源文件」列)、重复行清单(供抽查)、以及对话里的执行报告(文件数、各文件行数、总行数、去重行数)。第三样不是文件却是验收的核心依据,别急着关会话;产物与文件变更都能在右侧详情面板查看。

七、验收:四步对账,别跳

这类任务的错误特点是结果看起来永远是对的:一张整齐的表,几千行数据,肉眼扫不出异常,只能靠对账。

第一步,行数对账。 合并后总行数应等于各分表行数之和减去按规则删掉的行数,必须严丝合缝。对不上只有两种可能:漏读了文件(常见于某个文件是 .xls 不是 .xlsx),或去重被扩大执行。

第二步,随机抽条回溯。 挑五到十行,按「来源文件」列翻回原表逐字段核对。重点抽三类:每份源文件的首行与末行、金额特别大的行、字段名原本不一致的那几份表里的行。

第三步,查列错位。 某份表列序与别人不同时,若按位置而非按列名对齐,整份数据会集体串位。方法很土:把「日期」列拉到底扫一遍,中间某段突然变成客户名或数字,就是那段来源的文件串位了。

第四步,查空值分布。 若某个文件的某列整列全空,八成是它用了第三种叫法而映射表没覆盖到。

出错概率排序:字段映射 > 去重判定 > 文件漏读 > 列序,前两个靠指令预防,后两个靠对账发现。返工不必重写提示词,官方《任务对话》说明继续追问会基于已有上下文处理。

八、三种情况,别交给它

第一,主键不明确的表。 如果这批表没有订单号、工号这类唯一标识,只能靠「姓名 + 日期 + 金额」猜哪两行是同一条,去重规则就无法写死。合并可以做,去重留给人。

第二,需要业务判断才能对齐的口径。 「收入」在财务口径和业务口径下是两个数;「已完成」在 A 部门指验收通过、B 部门指发货即算。这类差异不是改列名能解决的,需要有人拍板。没拍板之前合出来的表,每个加总数字都错,而且错得很像样。

第三,编码格式混乱的跨系统导出。 日期被存成文本或序列号、数字带不可见空格、同一客户名有全半角差异——这些在合并阶段不报错,只在后续统计时表现为「同一个客户被算成两个」。跨系统的表先各自处理干净再合并。

另外,共享目录里的文件如果还在被人改,合出来的就是个过期快照,动手前先把它们拷进自己的工作目录。

小结

多表合并省掉的是复制粘贴的体力活;省不掉的是两件:字段映射规则和去重口径都得你自己定。没写进指令它就会替你猜,而猜错不会报错,只会安静地混进那张看起来很整齐的总表里。

流程记三步:先用 Ask 摸清各表表头与行数,再用完整指令把映射和去重规则写死,最后按四步对账验收。备份放最前面。

相关阅读


本文依据 WorkBuddy 官方文档(workbuddy.ai/docs/zh/workbuddy/ 的《技能》《任务栏》《创建任务》《任务对话》《10 个上手技巧》《实践案例》等页面)整理,核对日 2026-08-08,非亲测操作记录。产品功能与界面以官方最新说明为准。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。