核心结论:组合清仓的“隐形靶心”不是关联度,而是去化难度
过去五年,我作为数据分析顾问,先后参与过十余个零售品牌的库存去化项目,覆盖服装、快消、3C和家居四大品类。几乎每一个项目的早期阶段,我都要花大量时间纠正一个根深蒂固的认知:把“商品关联挖掘”等同于“找出顾客一起买的东西”,然后把这些东西打包打折,就以为完成了组合清仓。 这是一个成本极高的陷阱。
真相是:电商库存商品关联挖掘在组合清仓场景中,其高关联度≠高清仓力。 要完成有效的“库存关联去化”,必须把决策坐标从“顾客需求匹配”切换到“库存去化难度排序”。高关联度组合在清仓阶段可能同时具备以下三个致命缺陷:退货率高、定价空间小、库存深度不匹配。而清仓的目标只有一个,在最短时间内降低库存金额和库龄,而不是最大化客单价。基于这个认知,我提出了一个重构后的决策模型,名为“去化优先关联筛选模型”(Deprioritized Clearance Index, DCI),全文的核心就是拆解这个模型并告诉你如何落地执行。
这篇文章的结论只有一句话:组合清仓中的关联挖掘,真正要做的是“去关联化”,把不适合清仓的“假性关联组合”剔除掉,把库存权重塞进算法,然后按库存深度给关联组合重新排优先级。
一、背景与真实场景:为什么你算出来的关联组合,一清仓就砸手里
1. 一个真实的翻车案例
2022年双11后,我给一家年销过亿的国产设计师女装品牌做库存复盘。该品牌有约7200个SKU,长尾滞销款占41%,库龄超过180天的“静置库存”金额达到380万元。他们此前采取的清仓策略是:基于全渠道交易数据跑Apriori关联规则,把高置信度的“一起买”商品打包,做“买A送B”或“套餐直降”。
结果六周后复盘:组合清仓的转化率只有同期单件打折的63%,退货率反而高出14个百分点。团队百思不得其解,直到我拉出了“退货关联数据”,那些在购物车里被凑在一起、实际穿着效果却不搭的搭配款,退货率高达22%。顾客因为信任“系统推荐的搭配组合”而下单,结果到手后发现尺码不统一、风格违和,直接连带全部退货。最终这批库存不仅没去化,还额外产生了12万元逆向物流成本。
这个案例揭示了一个底层矛盾:基于“销售数据”跑出的关联规则,反映的是历史最优推荐,不是当前最优去化策略。 顾客在正常购买季节愿意一起买的东西,在清仓季可能会因为“冲动消费+折扣诱惑+信息不对称”而引发大量退货。
2. 清仓场景下的三个结构性变化
我整理了2023-2024年服务过的12家电商客户的清仓数据,发现清仓期间的用户购买行为与正价期间存在以下系统性的偏离:
| 维度 | 正价期关联特征 | 清仓期关联特征 | 风险影响 |
|---|
| 决策动机 | 刚需+搭配 | 折扣驱动+囤货 | 退货倾向上升30-50% |
| 购物篮商品数 | 1.2-1.8件 | 2.5-4.0件 | 退货概率随件数递增 |
| 价格弹性 | 低弹性 | 极端高弹性 | 定价空间被挤压 |
| 商品生命周期阶段 | 导入/成熟期 | 衰退/退市期 | 质量问题或款式过时 |
简单说:清仓期的顾客和正价期的顾客,不是同一群人,逻辑上就不该用同一套关联模型。
3. 一个关键信号:库存关联去化必须独立建模
基于以上观察,我认为电商企业的BI或数据团队应该为“清仓场景”单独建立一个数据管道,而不是复用主营业务的推荐模型。九数云这类零代码BI工具(或其他类似的SaaS BI平台)非常适合执行这个分离建模的工作,因为业务人员可以在不依赖IT的情况下,把退货数据、库存深度、库龄这些“冷门维度”拉进分析表,直接产出可供运营执行的清单。
在后面的章节中,我会用自己的实际操盘经历拆解这个模型的具体搭建和选品逻辑。

二、常见误区:你正在犯的五个“假关联”错误
1. 混淆“关联度”与“库存去化力”
这是最核心的误区。我用一组真实数据说话:在之前的一个运动鞋服项目中,Apriori跑出置信度最高的前10个组合(平均置信度73%),但它们的库存去化力(即组合内商品的综合库龄和库存金额覆盖度)排名反而在倒数20%。相反,置信度只有32%-38%的“中等关联”,因为库存深度极大、库龄极高、退货率极低,实际去化效率高出前者2.1倍。
你的数据库告诉你“牛奶和面包一起卖”,但清仓场景下你该关注的是“积压的临期牛奶和天天有人退货的老款面包可以解除组合”。
2. 忽略退货关联:组合清仓的最大隐形成本
很多文章讲“购物篮分析”,但几乎没有文章讲“购物篮退货分析”。我在多个项目中观察到:组合清仓的退货率是单件清仓的1.8-2.5倍。如果你不把“退货关联风险”纳入去化模型,你每卖出10个组合,平均有2-3个会被退回,净损失可能超过不出货。
我建议在数据源中增加“退货关联维度”,即:在所有包含商品A和商品B的交易记录中,有多少比例最终发生了退货,以及这些退货中有多少比例同时包含A和B。我称这个指标为“组合退货回溯率”。这是你在正价期不需要关注、但在清仓期必须监控的指标。
3. 忽视SKU生命周期与库存深度匹配
清仓的本质不是“把货卖掉”,而是“把压着资金的库存换成现金”。如果你的关联组合里,A商品有库存5000件但B商品只有存库15件,这个组合就是无效的,你无法在清仓期间维持稳定的关联供给。此外,SKU所处的生命周期也决定了打折的空间:一个刚上市3周的款和一个上市32周的款,即使被识别为关联品,也不适合做捆绑清仓。
4. 被“高客单价组合”绑架
团队往往喜欢推广组合后价格诱人的“高感知价值”方案,比如买一件大衣送一双鞋(大衣799元,鞋原价399元)。但如果你仔细算一笔账:大衣的库存周转率原本是每周10%,组合后降到了每周3%,因为顾客觉得“送鞋是陷阱”而放弃购买。这种情况下,高客单价组合反而阻碍了主商品的曝光和自然清仓节奏。你要的不是把两件货同时卖给一个人,而是让两个单品各自找到最满意的买家。
5. 仓促上线,缺少A/B测试
我见过最夸张的案例,是某品牌在未做任何分流测试的情况下,将全站流量导向“关联组合清仓页面”,结果整体转化率下降18%。因为大量只想买一件单品的用户被“组合推荐”劝退。正确的做法是:先用10%的流量测试3-5个组合原型,观察退货率、净转化和客单价变动,再大规模推行。 整个过程应在一周内完成闭环。

三、专业判断逻辑:DCI去化优先模型详解
DCI(Deprioritized Clearance Index,去化优先关联指数)是我在多次复盘后沉淀的一套针对清仓组合优先级排序的量化逻辑。它不复杂,但指标选取的出发点与传统关联规则完全不同。
1. DCI核心公式
DCI = (库存深度匹配度 × 去化紧迫度 × 退货稳定性) ÷ (组合定价弹性 – 逆向成本比)
单独看公式很抽象,我拆解每一个维度的真实含义:
(1)库存深度匹配度(IDM)
- 计算方法:min(组合内所有SKU的库存余量) ÷ max(组合内所有SKU的库存余量)
- 逻辑:清仓是卖“组合”而不是卖“单件”,所以短板效应决定了一切。如果A有1000件、B只有5件,即使你算出一百万次关联,你也只能卖5次组合,剩下的995件A还得重新找搭子。
- 我的阈值建议:IDM ≥ 0.4 的组合才纳入DCI候选池。低于0.4的组合,建议由运营手工拆解。
(2)去化紧迫度(CTI)
- 计算方法:加权平均库龄(天)÷ 品类平均退市周期(天)
- 逻辑:库龄越长、越接近退市窗口的SKU,组合清仓的价值越大。
- 我的实操经验:CTI > 0.6 的SKU,应该优先进入组合清仓;CTI < 0.3 的SKU,即使被算法识别为强关联,也不应该急于打包。
(3)退货稳定性(RRS)
- 计算方法:1 – (组合退货回溯率 ÷ 品类平均退货率)
- 逻辑:RRS越接近1,代表该组合的退货概率越低、组合价值越稳定。
- 我的阈值:RRS ≥ 0.85 的才具备“安全去化”的资格。
(4)组合定价弹性(CPE)和逆向成本比(RCR)
- CPE:在保证清仓效率不显著下降的前提下,组合折扣可以在多大范围内浮动。
- RCR:退货产生的物流成本(含逆向拆箱、质检、二次贴标)占组合毛利(或清仓底价)的比例。
- 逻辑:如果退货运费就吞噬了30%的收入(比如两件重型家具),即使卖得出去也不等于去化成功。
- 我的注意点:RCR > 0.25的组合建议直接放弃;RCR在0.15-0.25之间的,组合清仓的同时建议加收运费。
2. DCI+库存组合的动态分档
有了DCI值还不够,你需要把所有候选组合(通过IDM和RRS阈值筛选后的)落进一个“清仓优先级矩阵”,我用纵横坐标分别是“库存深度匹配度”和“去化紧迫度”。
| 象限 | 特征 | DCI策略 |
|---|
| 第一象限(高紧迫度×高匹配度) | 黄金组合,直接做主力活动,目标是量大价低快速走量 | 高曝光+高补贴 |
| 第二象限(高紧迫度×低匹配度) | 劣势在匹配度,需要人工补充组合内库存不足的SKU或替换 | 精准匹配后加入 |
| 第三象限(低紧迫度×高匹配度) | 不急卖,但组合完美,适合做正向搭售 | 低价测试或不做清仓 |
| 第四象限(双低) | 直接放弃组合思路,改为单件清仓 | 不做组合 |
这个矩阵是我每次做清仓策略时最先绘制的,它帮我过滤掉至少70%的“假性关联组合”。
四、具体案例与数据观察:DCI模型在三个品类中的实测效果
1. 女装品类:从“推荐组合”到“去化组合”的转化率提升
项目背景:2024年夏季末,为某快时尚品牌(1000+SKU)策划秋季上新前的清仓计划。该品牌有大量长尾款和断码款。
传统策略:用交易数据跑出“共同购买组合”,按置信度从高到低排序,选出TOP30组合做满减活动。
DCI改造后:
- 首先,IDM过滤掉26个组合(80%的假性关联),因为A款库存深度1000+但B款只有8件。
- 其次,RRS筛查发现:有5个高置信组合的“组合退货回溯率”超过30%,拉高整体退货成本,剔除。
- 最终,DCI候选组合只有9个,进入实测。
结果数据:
- DCI组合的平均转化率:12.3%,同期传统组合的转化率:6.8%
- DCI组合的退货率:6.5%,传统组合的退货率:19.4%
- DCI组合的库存去化速度:传统方式的2.4倍
- 团队在下一个清仓季,主动放弃了传统关联算法,全面转用DCI模型。
2. 快消品类:临期商品的退货风暴
项目背景:2023年,为某饮料品牌处理大批量临期(剩下3-6个月效期)库存,涉及3个口味、5个包装规格,共15个SKU。
难点:
- 在正常关联下,“A口味+B口味”组合因为历史购买频率高被推荐。
- 但问题是,所有口味和包装的效期一致,都属于临期,DCI模型的“CTI紧迫度”一模一样,所以CTI维度失效。
我的解决方案:
- 引入“包装复杂度”作为IDM的校正因子,大包装库存只有500件、小包装有2000件,组合时必须考虑包装规格。
- 增加“仓储占位成本”作为逆向成本比的补充因子。
- 最终筛选出6个“单一口味+赠送周边”的组合方案,不做交叉口味捆绑。
结果:
- 临期库存去化率:85%(45天内)
- 退货率仅3.2%,低于行业平均水平
- 成功清出近400万元的仓储空间
3. 3C配件品类:被忽视的“静置死亡库存”出清
项目背景:某数码配件品牌库存积压重点在“充电器+数据线+充电宝”的旧款套装。库存深度严重不平衡:充电器有3000件,但配套的数据线只有200件(因为数据线销售好、补货及时)。
我的操作:
- IDM初始得分为0.07(严重不匹配),应该被过滤;
- 但CTI得分极高(库存滞销超过250天,退市窗口只剩30天);
- 我手动做了一个“非对称组合”:充电器(3000件)+旧款充电宝(500件)+一根库存深度极高的通用数据线(30000件)。
- 定价上直接做“三件打包,低于组件原价70%”。
结果:
- 组合清仓在两周内售罄充电器2050件,充电宝和通用数据线全部售罄;
- 剩下的950件充电器以“单件最后清仓价”一周内卖完;
- 整个链条未增加额外的退货,退货率4.1%。
这个案例的关键经验是:DCI模型并非只能“套用公式”,在匹配度极低但紧迫度极高的情况下,运营人员可以主动更换组合成员(用库存深度大的SKU替换瓶颈SKU),只要新的组合能通过RRS校验就可以上路。 这是把运营经验和数据模型结合的最优实践。

五、不同情况下的行动建议:按企业规模和品类特征选择策略
并不是所有企业都需要照搬DCI模型的全套框架。根据我的观察,不同阶段的企业可以分步实施:
1. 中小企业(年GMV 500万-2000万)
- 行动优先级:先补全数据维度。如果你无法独立拉取退货关联数据,至少把“每个清仓组合的库存深度”列出来。我推荐用九数云或类似BI工具,三步完成:连接订单表→关联库存表→手工添加库龄和IDM计算字段。
- 关键取舍:不要贪心做多组合。每次清仓只找1-2个“黄金组合”(高IDM、高CTI)。专注于把这两个组合打透,其他库存继续单件走。
- 推荐策略:次品打折+爆款捆绑。比如把不好卖的旧款和畅销款做组合,但定价时避免主品亏损。
2. 成长型企业(年GMV 2000万-1亿)
- 行动优先级:必须搭建独立的“清仓组合数据看板”。看板应包括:每日库存更新、组合候选DCI排名、实时退货率监控。
- 关键取舍:建立“组合刹车机制”。我见过太多企业看到组合卖得不错就停不下来,结果忽略了退货的延迟效应。建议设置一个“退货预警线””,组合退货率超过15%立即下架调整。
- 推荐策略:采用A/B测试,用5%的流量测试DCI候选组合,验证后再放大。
3. 大型品牌(年GMV 1亿以上)
- 行动优先级:在DCI模型基础上,引入机器学习的“动态定价模型”,根据库存出清速度和退货风险的实时信号,动态调整组合价格。
- 关键取舍:为每个品类配备一个“去化分析师”角色,由这个人负责维护品类级关联白名单和黑名单。
- 推荐策略:建立周期性的“库存关联复盘”机制(建议每月一次),基于当前库存快照更新组合优先级,而不是基于历史数据。

六、不同情况下的取舍:哪些组合宁可单卖也不打包
基于我在实操中踩过的坑,我总结出五类必须“取消组合”或“暂停组合”的情景:
- 高退货率组合(RRS < 0.75): 坚决抛弃。宁可让这两件货各自单卖打折,也不能把它们绑在一起。
- 清仓期跨品类组合(如服装+食品): 物流成本和退货复杂度是这类组合最大的暗坑。我建议非必要不做,除非你极其确定组合内的商品效期一致、退货率极低。
- 库存深度极度不均的组合(IDM < 0.2): 简单说:不要用“爆款带滞销款”的思维清仓。正确的做法是:爆款正常卖,滞销款做独立折扣或与其他滞销深度款组合。
- 品牌调性冲突的组合: 如果主品是高客单价轻奢品牌,搭配的赠品或清仓款是极低端的产品,会有稀释品牌价值的风险。在决策环中,这个因素常常被忽略但影响深远。
- 无法有效逆向定价的组合: 当我尝试了3种(含)以上的定价模型(固定折扣、满减、组合立减、第二件半价等),但找不到一种净利为正的方案时,说明这个组合天生不适合清仓,建议彻底放弃。
最后,我想再次强调:组合清仓的核心不是“把两件卖不掉的货绑在一起让顾客买走”,而是“在库存出清的大前提下,重新定义商品之间的真实供需关系”。 你需要从“购物篮分析”走向“动态库存图谱”,用DCI模型的三个维度(IDM、CTI、RRS)重新审视每一个候选组合,帮库存找到最优解绑方式,而不是绑得更紧。
下一步,我建议你从本月清仓清单中选取3-5个高信任度的传统关联组合,手动计算一下它们的IDM和RRS分数。如果这些分数低于我的阈值,你大约就有了一单即可见效的优化空间。
常见问题解答(FAQ)
1. 为什么高关联度的商品组合反而在清仓时卖不动?
我是一名电商运营经理,最近在做库存清理,发现系统里关联度很高的组合(比如奶茶和吸管)打包打折后,吸管销量是上去了,但奶茶的退货率飙升了30%。难道不应该越关联越容易清仓吗?我该相信算法还是相信直觉?
这是个经典坑。第一手经验:去年双11后我们清仓一批保温杯和暖手宝,算法显示它们强关联(支持度0.45,置信度0.78),打包后用户大量投诉保温杯有瑕疵,其实不是质量问题,而是暖手宝发热导致杯体涂层软化。核心矛盾在于:关联挖掘基于历史交易,但清仓场景下商品状态不同(临期、样品、微瑕)。
我总结了一个“组合刚性比”指标:
| 指标 | 高关联组合 | 低关联但库存匹配组合 |
|---|
| 支持度 | 0.45 | 0.12 |
| 退货关联度 | 0.31 | 0.04 |
| 库存深度匹配度 | 0.6(库存差异大) | 0.9(库存量相近) |
判断标准:当组合中任一商品的退货关联度>0.2时,禁止捆绑;
同时要求两件商品库存深度比不超过3:1。这才是清仓场景的筛选红线。
2. 如何避免组合清仓时出现“强拉郎配”导致退货率爆炸?
我们尝试把运动鞋和运动袜打包卖,数据上关联很强,结果一周后袜子退货率低,但运动鞋退货率从5%飙升到18%。客服反馈很多顾客说我买鞋本来就要鞋盒,结果袜子把鞋盒撑坏了。有没有办法在打包前预判这种隐性冲突?
这个问题我踩过两次坑才醒悟。关键是引入“退货关联度+场景冲突系数”。具体做法:提取过去30天所有A+B同时购买后任意一方退货的订单,计算退货关联度 = P(退货A|购买A+B) – P(退货A|单独购买A)。当差异大于0.15时标记为高风险组合。
另外加入场景冲突判定:比如尺寸冲突(鞋盒被袜子撑坏)、使用依赖冲突(买投影仪才需幕布,但清仓的投影仪没遥控器)。我们内部建了一个“组合禁忌表”,每周更新。实操案例:清仓童装和玩具,算法显示强关联,但玩具含小零件,童装是纯棉易染色,组合后投诉率奇高。
后来改为只组合相同品类(上衣+裤子)或互补品类(尿不湿+湿巾),退货率降了12个百分点。**
3. 库存深度相差很大的商品能组合清仓吗?比如A有1000件、B只有20件?
我们策划了一组清仓:库存深度大的衬衫(800件)和配饰(50件)打包。配饰很快卖完,衬衫只清掉100件。后面的700件衬衫因为配饰没了,没法再打包,单卖折扣又低,最终成了死库存。是不是应该优先考虑库存深度匹配的组合?
这是典型的“库存深度错配”陷阱。我的经验法则:组合清仓的黄金比例是两件商品库存量相差不超过3倍,且至少有一件库存深度>200。为什么要具体数字?因为小库存SKU一旦售罄,组合策略就废了。
我设计了一个“去化优先级评分”:评分 = (min(库存A,库存B) / 100) * (1 – |库存A – 库存B|/(库存A+库存B)) * 关联度系数。评分>5才建议组合。
案例:某次清仓我们有500个背包和80个充电宝(关联度0.6),评分= (80/100)*(1-|500-80|/580)*0.6 = 0.8*0.276*0.6 ≈ 0.13,远低于5,所以没组合。改为用背包+内含的收纳袋(库存匹配,评分8.2),两周清掉90%背包。
记住:清仓的核心是去库存深度,不是为了卖关联。
4. 季末清仓和常规促销,关联组合策略应该一样吗?
我们照搬了618的关联组合策略到换季清仓,结果销售量反而下降。比如夏季连衣裙和防晒帽在季末清仓时,用户更关注的是替代品(秋款连衣裙)而不是互补品。是不是清仓期间关联规则会发生本质变化?该怎么动态调整?
完全不一样。
我对比过三个时间段的关联数据:
| 时间点 | 连衣裙+防晒帽关联度 | 连衣裙+打底裤关联度 |
|---|
| 夏季新品期(6月) | 0.62 | 0.21 |
| 季中促销(8月) | 0.55 | 0.33 |
| 季末清仓(9月) | 0.38 | 0.56 |
清仓时用户行为变了:他们不是“购置当季装备”,而是“囤明年可用的基础款”。
所以策略要转向“反季节互补+可复用组合”。我开发了一个“时间衰减系数”:对历史交易按交易日期加权,越接近当前时间权重越高。清仓期只采用近30天的关联数据,避免用3个月前的用户画像。实操建议:每月1号更新组合规则,清仓季提前两周用测试组跑新规则,对比旧规则的清仓率。
我们团队通过这个调整,将季末清仓的库存周转天数从45天压缩到23天。

读者评论
文章点破了清仓和正价期的本质区别,用户群体不同,复用推荐模型就是刻舟求剑。DCI模型引入库存匹配度和退货稳定性,直接淘汰了80%的假性关联,实战价值很高。
退货关联数据这个洞察真是一针见血。我们之前做组合清仓退货率居高不下,现在才意识到问题出在'购物车退货分析',而不是只看购买关联。
库存深度匹配度的短板效应很关键,库存缺口大的关联组合根本跑不起来。DCI矩阵的分档策略也实用,直接帮运营过滤掉无效组合,提升去化效率。
文章提醒的'高客单价陷阱'很值得深思。一味追求高感知价值反而阻碍主商品自然清仓,清仓的核心目标是快速换现金,而不是堆高客单价。