ERP 数据录入中的多店去重,最容易出错的地方不是“重复记录没删干净”,而是把本来应该分店保留的数据误合并了:两家店卖的是同一款商品,商品主档可能应该统一;两家店各自的库存、销售单和盘点记录,却不能因此变成一条没有门店归属的数据。处理顺序应当是先确认数据对象和管理范围,再判断是否重复,最后决定合并、映射、保留还是人工复核。
多店经营时,最常见的误判是看到商品名称、客户名称或供应商名称相同,就认为两条记录可以直接合并。但 ERP 里的数据不只有主档,还有库存、单据和流水。它们描述的对象不同,去重规则也不同。
例如,两家门店都销售同一款 500 毫升饮料,企业可以考虑使用一个统一商品主档;但门店 A 有 12 瓶、门店 B 有 8 瓶,这两份库存必须保留各自的门店或仓库归属。统一商品身份,不代表统一库存位置。
我的判断原则是:先问“这两条记录描述的是不是同一个业务对象”,再问“这个对象应该由总部共享,还是由门店分别维护”。如果这两个问题没有答案,先不要批量合并或删除。
| 数据层 | 常见对象 | 多店处理重点 | 典型错误 |
|---|---|---|---|
| 主数据 | 商品、客户、供应商、计量单位 | 判断是否需要企业级统一维护,建立跨门店编码映射 | 只因名称相同就合并不同规格商品 |
| 组织与库存数据 | 门店、仓库、库存余额、库存批次 | 保留门店、仓库、批次等业务维度 | 把各店库存汇总后覆盖门店库存 |
| 业务流水 | 销售单、采购单、调拨单、退货单 | 保留发生时间、门店、单据号、来源和关联关系 | 把不同门店的历史单据当成重复行删除 |
表中的分类是治理思路,不代表每套 ERP 的数据结构完全相同。实际落地前还要核对系统中的组织、门店、仓库和商品档案字段,以及历史数据导入后由哪些单据引用这些档案。
如果两个旧商品编码确实指向同一种商品,合并主档后仍要留下旧编码与新编码的对应关系。如果两条记录其实代表不同门店的库存,正确结果可能是商品主档共用、库存记录分开。若信息不足,则暂时保留并标记复核,通常比冒险删除更容易回退。
我会把去重后的验收标准写成三句话:该共用的主档能统一识别;该隔离的门店记录仍有归属;历史单据能够追溯到原始来源。只检查“重复商品数量下降了多少”,不足以证明数据治理成功。

在门店独立经营或分阶段上线系统的企业里,同一款商品可能由不同员工分别录入。总部表格叫“原味酸奶 200g”,门店 A 叫“酸奶原味”,门店 B 则用供应商条码或平台商品编码。名称看起来不一致,实际可能是同一商品;也可能是包装规格不同,不能合并。
反过来也一样:两个门店都录入“矿泉水”,名称完全相同,却可能分别对应 350 毫升和 550 毫升。名称相同只是一个筛查信号,不是合并证据。
多店上线常常不是一次性迁移。总部可能有一份商品主表,门店各自维护 Excel,线上渠道还有商品编码,旧系统里则留着历史单据。若导入时只依赖商品名称匹配,常见结果是:一部分商品被重复建档,另一部分不同商品被错误归并。
数据来源越多,越要保留来源字段。至少记录来源系统或文件、原始编码、所属门店、导入批次和复核状态。这样发现映射错误时,团队才知道问题从哪批数据、哪个门店、哪条规则开始。
“多店”不一定等于“多组织”,门店也不一定与仓库一一对应。有的企业一店多仓,有的多个门店共用一个配送仓,还有的线上订单由独立仓库履约。若导入模板只提供一个含糊的“门店”字段,库存可能被挂到错误位置,后续盘点和调拨都会受到影响。
因此,在录入或迁移前,我会先把组织结构画出来:谁是总部,哪些是门店,仓库属于谁,哪些渠道需要独立核算。这个结构不是为了做漂亮的组织图,而是为了确定每条库存和交易记录应当落在哪个管理范围。
主档通常会被单据、库存、价格、条码或报表引用。合并商品时如果只处理商品表,没有检查关联关系,可能出现历史单据指向旧档案、当前库存挂到新档案、报表按两套编码统计等情况。表面上商品档案更整齐,实际对账反而更困难。
下面的图是一个情景模拟,用于说明错误合并的影响范围,不是某家企业的真实统计。它把一次错误合并可能涉及的对象拆开看,提醒实施人员不要只检查商品档案行数。

名称适合做候选检索,不适合独立作为自动合并依据。商品名称可能有简称、错别字、品牌前缀差异,也可能因包装单位、口味、型号不同而应当分开。即使名称完全相同,也要检查规格、计量单位、条码、供应商货号和适用门店等字段。
如果现有数据只有名称和价格,缺少规格、条码等关键字段,系统或表格无法可靠判断是否同一商品。这时最专业的动作不是“选一个字段凑合匹配”,而是把记录放入疑似重复队列,让商品负责人补充判断依据。
门店旧编码往往反映的是各自的录入习惯,不一定代表不同商品。如果完全保留为多条商品主档,总部可能无法准确汇总销量、库存和毛利;促销分析也会被拆成多个商品。
但门店编码不同也不能直接忽略。旧编码可能绑定了门店 POS、采购合同或平台商品资料。更稳妥的做法是判断是否统一商品主档,同时保留旧编码映射,确保门店原系统和 ERP 之间还能识别同一对象。
如果只是做企业级库存总览,可以在报表中汇总各门店库存;但这不等于底层库存可以删除门店维度。仓库人员需要知道货在哪里,门店负责人需要知道自己可售多少,调拨人员需要知道从哪里出库、调往哪里。
库存总量是汇总结果,不应替代明细。若某款商品总部统计为 100 件,却不知道其中 60 件在哪家店、40 件在哪个仓库,数字虽完整,业务上却无法执行。
两张销售单的商品、数量和金额相同,不代表它们是重复单据。它们可能来自不同门店、不同顾客或不同交易时点。判断流水重复,至少要结合单据唯一编号、来源系统、门店、业务日期和明细行标识等信息。
如果确实存在重复导入,也应优先按导入批次和源单号定位,再依据系统规则进行撤销、作废或重新导入。直接删明细可能破坏库存流水和财务核对关系。涉及已审核或已结账业务时,应先确认 ERP 的更正方式和权限要求。
自动匹配比例高,不一定代表规则准确。匹配太宽松,会把相似商品错合并;匹配太严格,则大量真实重复项进入人工队列。应同时观察误合并、漏匹配、人工复核量和回退数量,而不是追求一个越高越好的“自动处理率”。
对于库存价值高、规格复杂或品牌条码不稳定的品类,人工复核比例高并不一定是流程失败,而可能是风险控制得当。反之,低价值、规则明确的标准商品可以逐步提高自动匹配范围,但要用抽样复核验证结果。
如果总部、门店和运营人员都能随时新建商品,重复档案会在上线后重新出现。数据治理不能只靠一次性清洗,还要规定商品新增、编码分配、规格修改和停用的责任人及审核规则。
至少应明确:总部是否有统一商品主档;门店能否新建本地商品;新建后谁审核;门店自定义编码如何登记;已停用商品是否允许重新启用。权限和流程不清,重复数据会持续回流。

先把待去重数据分成商品、客户、供应商、库存、价格、单据或其他对象。不要把不同对象放进同一张“重复数据清单”用一个规则处理。商品要判断规格与商品身份,客户要考虑主体和联系方式,库存要保留位置,单据则要识别交易唯一性。
如果当前数据表把商品主档、库存余额和销售明细混在一起,先拆分数据层,再设计匹配规则。否则算法可能只看见字段相似,却不知道记录在业务上承担什么作用。
每个对象都要确定其范围:企业级、区域级、门店级还是仓库级。商品主档在某些企业由总部统一,价格可能按区域或门店维护,库存则通常需要仓库或门店维度。不要假设一个对象的所有属性都共享同一层级。
我建议把“对象”和“范围”写成一张规则表。例如:商品身份企业级统一,门店旧编码作为映射;销售价按门店维护;库存按仓库记录;销售单按原门店归属。这样实施和业务人员讨论的是具体规则,而不是含糊地争论“要不要统一数据”。
| 判断问题 | 如果答案是“是” | 如果答案是“否”或不确定 |
|---|---|---|
| 两条记录描述的业务对象是否相同? | 进入范围和属性核对 | 保留为不同对象,或补充字段后再判断 |
| 该对象是否应在企业范围内统一? | 评估统一主档并保留旧编码映射 | 按门店或组织范围管理,不强行合并 |
| 相关库存、价格或流水是否具有门店差异? | 统一身份、保留业务维度 | 按确认后的共享范围处理,不覆盖原始来源 |
| 现有字段是否足以证明两条记录相同? | 按规则自动处理并留日志 | 标记疑似重复,交由业务负责人复核 |
商品匹配通常要组合多个字段。可考虑企业商品编码、条码、品牌、规格、计量单位、型号、供应商货号和包装关系。使用哪些字段,要看行业和实际数据质量。条码缺失或复用、规格写法不统一、供应商货号跨供应商重复,都可能导致单字段匹配失真。
一个实用做法是先把匹配拆成“强匹配”和“候选匹配”。企业内部唯一编码一致且组织范围合理时,可以进入较高置信度队列;名称相近但规格缺失的,只能作为候选;名称相同但条码或规格冲突的,应进入冲突复核,而不是自动合并。
| 候选类别 | 可观察信号 | 建议动作 |
|---|---|---|
| 强一致 | 企业唯一编码或已验证的统一条码一致,规格和单位无冲突 | 可按预先批准的规则处理,并保留导入日志 |
| 疑似一致 | 名称相近、品牌相同,但编码缺失或规格不完整 | 进入人工复核,不直接删除原记录 |
| 明显冲突 | 名称相同,但规格、单位、条码或型号存在实质差异 | 按不同商品保留,必要时补全属性 |
| 重复流水候选 | 单据内容相似,但源单号或门店信息不完整 | 核查来源和单据状态,不按商品匹配规则处理 |
去重不只是“合并”和“删除”两种结果。我通常把处置结论分成四类:确认同一对象后合并主档;主档统一但保留各门店旧编码映射;业务对象不同则保留;证据不足时暂存复核。每个结论都应该能说明依据,并且可以追溯到来源记录。
对于合并操作,要确认 ERP 是否支持引用关系迁移、旧编码检索、操作日志和回退。若系统不能安全迁移引用关系,宁可在当前阶段通过统一映射或报表层关联处理,也不要仅为减少档案数量而进行不可逆修改。
自动化范围要由误判成本决定。标准化程度高、单位和条码完整、错误合并后容易回滚的商品,可以先在小批次中试运行;高价值商品、药品或食品批次管理、维修配件、序列号商品等场景,字段缺失或追溯要求高时,应提高人工复核比例。
我不会把“自动化”理解为系统替代业务判断,而是让系统先筛掉证据充分的记录,把真正有歧义的项交给负责人。这样既减少重复劳动,也避免将不确定性藏在批量导入结果里。
导入成功只表示文件被系统接受,不代表业务关系正确。导入后至少核对档案数量变化、门店库存分布、单据关联情况、旧编码检索、关键商品抽样和异常记录。对于有财务影响的数据,还要与业务账、库存账或已确认的期初数据进行对照。
若报表中同一商品仍按多个旧编码分散统计,可能是映射没有生效;若各门店库存数量突然集中到总部仓库,可能是组织字段映射错误;若历史单据无法查询,可能是主档合并破坏了引用关系。这些异常都比“重复档案减少了”更值得优先处理。

以下案例是为说明方法而构造的情景模拟,不是实际客户项目或行业统计。设想一家经营三家门店的零售企业,分别维护旧商品表,准备将商品和近期业务数据导入同一套 ERP。
三家门店的商品表合计有 1,200 行。初步按名称、品牌和规格筛查后,发现 180 组候选重复项。复核后,其中 112 组可确认是同一商品的不同编码,38 组名称相近但规格或包装不同,另有 30 组信息不足,需要业务人员补充条码或供应商资料。
这里的 180 组并不等于 180 组都应该合并。真正适合统一商品身份的是 112 组;38 组应保留为不同商品;30 组暂缓处理。这个拆分说明,候选识别是起点,不能把筛查结果直接当作删除名单。
对于确认相同的 112 组商品,方案不是简单删除门店记录,而是建立企业级商品身份,并登记各门店原有编码。门店仍可使用原编码查询或对照,但采购、销售和库存报表可以通过统一商品身份汇总。
对于 38 组规格不同的商品,例如同一品牌的 250 克与 500 克包装,继续保留为两个商品。对于 30 组信息不足的记录,先不参与自动合并,补齐规格、单位、条码或供应商货号后再重新判断。
| 模拟复核结果 | 数量 | 处理方式 | 验收重点 |
|---|---|---|---|
| 确认同一商品 | 112 组 | 统一商品身份,保留门店旧编码映射 | 旧编码可检索,历史单据仍可追溯 |
| 名称相似但属性不同 | 38 组 | 分别保留,补齐规格与包装信息 | 库存单位和销售单位没有混淆 |
| 证据不足 | 30 组 | 进入人工复核,不直接合并 | 责任人、补充字段和复核结论有记录 |
假设其中一款商品在三家门店和一个配送仓都有库存。统一商品身份后,库存应仍按原门店、仓库和批次记录。管理层可以查看汇总库存,门店人员则应看到各自可用库存。两种视图可以并存,前提是底层维度没有被合并掉。
在迁移验收时,我会抽查几款库存价值高或周转快的商品,分别对比迁移前后的企业总量、门店分布和仓库分布。总量一致但门店分布错误,仍然属于迁移失败;门店余额一致但批次或效期丢失,在有相关管理要求的业务里同样不能算通过。
下图使用同一组模拟数据展示候选项如何流向不同处理结果。它不是对 ERP 导入效果的保证,而是帮助团队在导入前估算人工复核量和错误合并风险。实际数字应从本企业的去重预检结果中替换。

在这个模拟场景中,112 组已确认记录可以进入受控批次处理;38 组应补充商品属性或编码规范;30 组需要业务部门参与确认。若团队没有足够人手一次性完成全部复核,可以先处理门店覆盖广、库存价值高、销售频率高的商品,把风险最大的对象提前核清。
但“先处理高频商品”不意味着低频数据可以永久搁置。对于长期不再销售但仍被历史单据引用的商品,应设置停用、归档或查询规则,而不是为了让主档更整洁就删除。历史数据与当前可售商品需要不同的生命周期策略。
盘点的目标是弄清数据从哪里来、各字段谁维护、记录属于哪个门店或组织。每份源表都应保留原文件或可复查的副本,并记录文件名称、导出日期、负责门店和字段解释。不要在唯一一份原始文件上直接改编码或删行。
如果暂时无法取得系统级导出,也可以先用样本表核对字段,但要把样本范围写清楚。不能用几十行抽样结果推断所有门店的数据质量,更不能把抽样中的匹配规则直接无验证地套到全量数据。
字段字典至少要说明字段含义、是否必填、数据格式、维护责任人和跨门店是否共享。比如“商品编码”究竟是总部编码、门店编码还是供应商货号,若没有定义,后续匹配会把几种不同编码当成同一类信息。
规则表要写明哪些字段参与强匹配,哪些字段只用于辅助筛查,遇到冲突时谁有最终判断权。最好用真实样本验证规则,包括同名异规格、同条码不同包装、旧编码变更和字段为空等边界情况。
预检输出应至少包含原始记录、候选匹配对象、匹配依据、冲突字段、来源门店和建议处理方式。这样业务负责人看到的不是一个“系统说重复”的结论,而是能判断为什么被匹配、哪里存在冲突。
对于能通过唯一编码和属性核验的记录,可以进入自动处理候选;对于名称相似但缺少规格的记录,进入复核队列;对于关键字段冲突的记录,标记为不可自动合并。每一种状态都应有明确处理人,避免疑似重复项长期无人跟进。
第一批试导应覆盖不同门店、不同数据质量和不同商品类型,不能只选最干净的样本。试导后核对商品档案、编码映射、库存余额、单据关联和报表统计,必要时让门店人员用旧编码和新编码分别查询,确认日常操作不受影响。
如果试导发现规格错配或门店库存落错仓库,应先定位是字段映射、清洗规则还是 ERP 配置问题,再修改规则重新试导。不要通过人工手动修补一两条记录后直接扩大导入批次,因为根因还在,后续门店仍会重复出错。
正式导入前,应留存原始文件、清洗后文件、规则版本和审批记录。每次导入使用独立批次号,记录操作人、时间、门店范围和系统返回结果。若 ERP 支持导入日志或错误明细,应将其保存并与源文件对应。
对不易逆转的合并操作,先确认系统是否能够恢复引用关系,或者是否有经过测试的回退方案。不要等到库存对不上或历史单据无法查询时,才发现原始映射表没有保存。
抽查不应只从“成功导入”的记录中随机挑选。建议分别抽查强匹配、人工确认、字段冲突、门店旧编码和历史流水关联等类型。若某一类出现错误,就要扩大该类检查范围,并修订相应规则。
上线后还要观察重复档案是否重新产生。若短期内重复数据增加,问题可能出在权限、门店新增流程、商品编码生成方式或外部平台同步,而不是最初清洗没做彻底。数据治理应把“预防新重复”纳入日常管理。
下面是一个用于排期的情景模拟:假设 180 组候选项中,112 组可按已验证规则处理,38 组需要业务复核,30 组需要补资料。若每组人工复核平均用时 4 分钟,38 组约需 2.5 小时;补资料的 30 组若每组需 10 分钟,约需 5 小时。这里的时间仅用于演示估算方法,实际取决于字段完整度、人员熟悉程度和系统工具。
排期时还应加上跨部门沟通、试导、验收和异常修复时间。很多项目低估的不是点击操作时间,而是确认“这两个记录到底是不是同一商品”所需的业务判断时间。

如果企业经常比较各门店销量、统一采购、做跨店调拨或开展总部级商品分析,统一商品身份通常有明显价值。总部能够把多个门店的旧编码映射到共同商品,减少报表分散和重复维护。
这种做法的成本是需要明确总部和门店的资料维护权,并处理本地商品、临时商品、特殊包装和门店自采品。若门店仍可随意新建主档,统一主档很快会被新的重复记录稀释。
区域门店经营品类不同、商品版本差异明显、地方供应商较多时,不一定需要把所有商品统一到一张全量主档。可以统一企业级识别规则,同时允许某些商品按门店管理,并标注适用范围和停用状态。
代价是总部分析需要更完善的商品映射和分类口径。若商品只在单店使用,且不会参与跨店采购或经营分析,强行统一可能增加维护成本而收益有限。
这种方案常用于逐步迁移:企业内部有统一商品身份,门店旧系统、供应商和平台仍使用原编码。映射表承担衔接作用,能降低一次性改动门店流程的压力。
需要注意映射关系必须有有效状态和维护机制。旧编码停用后是否继续允许查询、编码发生变更时如何记录、一个外部编码是否可能对应多个内部商品,都要在规则中说明。否则映射表本身会成为新的混乱源。
如果商品规格、单位、条码和来源都缺失,或者历史单据引用关系不清楚,暂缓处理是合理选择。短期内保留疑似重复档案,可能让报表需要临时映射,但能避免库存和历史交易被错误归并。
暂缓不等于不管。要明确补充字段、责任人和复核期限,并优先处理影响采购、销售、库存或对账的记录。否则“待确认”会变成无限期积压,企业最终仍要在业务压力下仓促决定。
| 方案 | 主要收益 | 主要成本 | 更适合的条件 | 需重点防范 |
|---|---|---|---|---|
| 统一主档并保留旧编码映射 | 跨店汇总和统一采购更容易 | 需要总部维护规则、清理旧编码 | 商品共用度高,跨店分析需求强 | 映射错误造成历史数据错配 |
| 总部与门店分层管理 | 兼顾统一商品和本地业务差异 | 权限和字段规则更复杂 | 总部商品与本地商品并存 | 本地商品未经审核重复扩张 |
| 门店独立维护,仅在报表层归并 | 改动较少,适合短期过渡 | 日常维护和分析映射成本较高 | 门店商品差异大或系统暂不支持统一 | 报表口径不一致、映射滞后 |
| 暂缓处理疑似重复项 | 避免证据不足时误合并 | 短期存在重复展示和人工核查 | 关键属性缺失或引用关系复杂 | 待确认清单长期无人负责 |
对于某些数据,重复维护带来的成本更高:例如总部采购商品、跨店调拨商品和需要统一分析的核心商品。对于另一些数据,误合并的代价更大:例如门店库存批次、不同规格商品、历史交易流水和需要独立追溯的对象。
因此,决策可以按“错误合并会造成什么后果”来分级。如果错误合并可能导致库存错账、历史单据无法追溯或财务口径失真,就应提高证据要求和复核力度。如果只是报表中名称略有差异、且能通过映射修正,则可以先解决统计口径,不一定要立即改写底层记录。
有些企业会把 ERP、门店表格和渠道数据接入数据分析工具,用于发现重复编码、观察门店销售或核对库存。这类工具可以帮助汇总和筛查,但不能替代业务对象判断。连接不同数据源前,要确认编码、门店字段、时间范围和库存口径一致,否则图表可能只是把不一致的数据更快地展示出来。
若评估九数云等数据分析产品,应围绕当前任务核实数据连接方式、字段处理能力、权限管理、刷新机制和结果追溯方式,并通过自己的样本验证。不要仅凭工具名称或宣传描述,就假设它能够自动识别商品重复、迁移 ERP 主档或保证跨店库存准确。

如果检查项中有多项无法确认,建议先解决数据范围、责任人和回退能力,再执行大批量处理。去重不是孤立的表格清理任务,而是企业主数据维护、门店权限和业务流程的一部分。

选取不同门店的商品样本,至少覆盖同名同规格、同名异规格、编码不同但属性一致、条码缺失和门店自采品。由商品负责人、门店人员和 ERP 管理人员共同确认每类记录应如何处理,再把决定写成规则,不要依赖口头经验。
优先检查高频销售商品、跨店调拨商品、库存价值较高商品和正在参与促销的商品。它们的错配更容易影响采购、库存、销售报表和门店执行。低频且已停用的数据可以排在后面,但仍应保留历史查询和追溯能力。
试导发现的问题要回写到字段字典、匹配规则和权限流程中。若问题来自规格字段缺失,就规定补录要求;若问题来自门店随意建档,就调整新增审核;若问题来自旧编码混用,就明确编码含义并维护映射。只修正当前批次而不改录入规则,重复数据会继续出现。
多店 ERP 去重的核心不是把所有门店压缩成一套看似整齐的数据,而是让同一业务对象能够统一识别,让不同门店的真实经营记录仍然各归其位。下一步可以先抽取一批代表性商品,画清总部、门店、仓库与旧编码的关系,再用“合并、映射、保留、复核”四种结论完成小规模验证。规则经业务确认、导入结果可追溯后,再扩大到全量数据。
我在整理多店商品资料时发现,各店商品名称看起来一样,编码却不一样;有的连包装单位也不同。我不确定该不该统一成一条主档,担心合并后库存归属和历史单据也跟着混在一起。
先判断重复的是“商品身份”,还是门店自己的业务记录。若商品规格、计量单位和实际销售对象一致,可以考虑统一商品主档;但每家门店的库存、售价、补货记录仍应保留门店维度。统一主档不等于把所有门店数据合成一条。
例如,门店甲的编码为A-101,门店乙为B-205,核实为同一款500毫升饮品后,可将两个旧编码映射到统一商品编码P-001。导入前应确认系统能保留门店、仓库及历史单据关联;若规格或包装不同,就先不要合并。
我手里的商品表有不少同名记录,有些只是写法不同,有些可能是不同规格或包装。我想批量清理,但只按名称筛选似乎很容易误删,应该用哪些信息交叉核对?
名称适合用来找出“候选重复项”,不适合单独作为合并依据。至少要结合规格型号、计量单位、条码或企业内部编码核对;还要检查是否存在组合装、不同包装换算关系,以及停用商品与在售商品的区别。哪些字段能作为识别依据,应以企业自己的编码规则为准。可以把结果分为三类:字段一致且业务确认相同,进入归并;
名称相同但规格或单位不同,保留并复核;关键字段缺失或冲突,暂缓导入。这样比设置一个“名称相同就自动删除”的规则安全,也便于留下人工判断记录。
我准备把几家门店的数据接入同一套ERP,商品档案重复是比较明显的问题,但各店库存数量和历史销售单据也都在旧表里。我担心为了去重把这些数据汇总后,之后就查不出货在哪家店、是哪张单据产生的。
把主数据和业务流水分开处理:商品主档可以按规则统一,库存余额仍按门店、仓库和商品分别导入;销售、采购、调拨等单据则保留原门店、日期、单据号和商品关联。商品相同,不代表发生在不同门店的库存或交易是重复记录。
举例来说,若甲店有12件、乙店有7件,统一商品编码后应核对为“甲店12件、乙店7件”,而不是只留下无门店归属的19件。历史单据也应通过新旧商品编码映射关联,不能因商品档案合并而直接删改单据。
我想一次性导入总部和门店的商品资料,但来源包括旧系统、门店表格和平台导出文件,编码规则不一致。我不确定应该先清洗再导入,还是导入后再处理;如果出错,怎样才能查到来源并回退?
建议先盘点来源,再制定统一编码、门店标识和字段格式;接着生成疑似重复清单,由业务负责人确认,而不是直接批量合并。先用少量数据试导,核对商品关联、门店归属、库存余额和单据数量,再扩大范围。可以用一个小批次做对照:导入前记录各门店商品数、库存汇总和单据数,导入后按相同门店与日期范围复核。
每条映射至少保留来源文件、旧编码、新编码、处理结论和确认人。若系统不支持日志或回退,先备份并分批导入,避免一次性覆盖原数据。


读者评论
把“商品主档统一”和“库存按门店保留”分开处理很关键,单纯减少档案数量确实不能说明去重做得好。
文中强调门店和仓库不一定一一对应,这点容易被忽略。导入前先核对组织关系,能减少库存挂错位置的问题。
旧编码映射的建议比较实用。统一商品身份后仍保留原编码,门店查询和历史对账会更顺畅。
销售单内容相似不能直接当重复流水删除,还要核对源单号、门店和日期;否则可能影响库存及财务追溯。
按误判风险设置自动匹配范围比较稳妥。字段不全时先进入人工复核,比为了提高自动处理率而强行合并更安全。