§1 通用输入契约Input Schema
本模块适用于亚马逊所有站点、任意品类。以下为本次实测的实际输入。
| 输入项 | 本次实测取值 | 用途 |
asin | B07H3XPSNK | 主体标识 |
product_metadata | 个护小家电 / 蒸汽美容仪;带可伸缩喷臂、精油香薰、水箱;详情页 Color=White;2018-09 上架 | 动态推导痛点维度 |
reviews_pool | 456 条文字评论(2018–2026) | 分类与统计母体 |
sales_timeseries | 25 个月实测(2024-09 至 2026-09),cutoff_month=2026-09 | TRR / TNPT 分母 |
ratings_total | 前台 5,739 个评分 | 校验文字评论稀疏度 |
category_safety_tags | fire / burn / shock / scald(电子个护类) | 红线桶构建 |
稀疏度校验:文字评论 456 条 ÷ 前台评分 5,739 = 7.9%。
即本模块所有比率的分子只覆盖约 8% 的评分总量,因此 TRR / TNPT 只能作年际相对比较,不可读作绝对投诉率。
§2 通用痛点分类引擎Universal Classification Pipeline
本模块的核心机制:由 product_metadata 动态推导痛点维度,而非写死固定清单;
并对逐年未分类率做漂移监控,用于发现「用词演变或新增品类缺陷」。
2.1 动态维度 Schema(由 product_metadata 推导,非写死)
共 14 个维度 = 8 个跨品类通用基线 + 3 个品类扩展 + 1 个红线桶 + 2 个实测新增。
下表为在差评+中性池(236 条,评分 ≤3★)上的命中情况,允许多标签(单条上限 3 个)。
| 代码 | 痛点维度 | 推导来源 | 命中 | 占比 |
| R1 | 人身安全红线(起火·触电·烫伤)红线桶 | category_safety_tags: fire / burn / shock / scald(电子个护类) | 9 | 3.8% |
| U1 | 功能失效 / 寿命通用基线 | 通用基线·基线缺陷 | 105 | 44.5% |
| U2 | 核心体验不达标通用基线 | 通用基线·核心功能未达预期 | 11 | 4.7% |
| U3 | 漏液 / 喷溅通用基线 | 通用基线·密封与流体 | 19 | 8.1% |
| U4 | 卫生 / 异味 / 霉变通用基线 | 通用基线·卫生与气味 | 41 | 17.4% |
| U5 | 装配 / 做工 / 结构通用基线 | 通用基线·装配质量 | 29 | 12.3% |
| U6 | 清洁 / 维护困难通用基线 | 通用基线·可维护性 | 35 | 14.8% |
| U7 | 物流 / 包装 / 二手通用基线 | 通用基线·交付与货况 | 13 | 5.5% |
| U8 | 易用性 / 说明缺失通用基线 | 通用基线·使用门槛 | 1 | 0.4% |
| U9 | 售后 / 客服通用基线 | 通用基线·服务闭环 | 9 | 3.8% |
| U10 | 加热效率 / 水质要求品类扩展 | 个护小家电·蒸汽类(product_metadata: 蒸汽美容仪) | 29 | 12.3% |
| U11 | 噪音品类扩展 | 个护小家电·声学(product_metadata: 蒸汽美容仪) | 1 | 0.4% |
| U12 | 人体工学 / 尺寸不适配品类扩展 | 个护小家电·人体工学(product_metadata: 带可伸缩喷臂,需适配不同身高/坐姿) | 7 | 3.0% |
| U13 | 与描述不符 / 发错货品类扩展 | 个护小家电·一致性(product_metadata: 详情页标 Color=White) | 1 | 0.4% |
| — | 未分类兜底池Unclassified |
强制项,漂移监控唯一信号源 |
17 |
7.2% |
2.2 多标签归类与红线桶
红线桶 R1 命中
9
占差评池 3.8%|人工复核后保留
单条平均命中维度
1.31
母体 236 条差评+中性
未分类 17 条
7.2%
经 v1→v3 三轮扩表
红线桶对齐 spec 的 Severity Tier 1(人身安全与合规)。v1 的裸 unsafe/dangerous
会把「喷臂太短不好用」误判为人身安全 → v2 起要求与物理伤害词共现,命中数 13 → 9 条。
2.3 词表漂移监控(Drift Monitor)
未分类率(y) = Nunclassified,y ÷ Nneg,y 警戒线 15%
平台文字评论逐年稀疏,用词随年份变化。该指标是发现「用词演变或新增品类缺陷」的唯一信号源。
本次实测完整跑通了 v1 → v2 → v3 三轮迭代,告警年份从 8 个降到 2 个。
| 年份 | v1 未分类率 | v2 未分类率 | v3 未分类率 |
|---|
| 2018 | 2/2 100% ⚠️ | 2/2 100% ⚠️ | 1/2 50% ⚠️ |
| 2019 | 13/35 37% ⚠️ | 11/35 31% ⚠️ | 5/35 14% |
| 2020 | 12/36 33% ⚠️ | 11/36 31% ⚠️ | 6/36 17% ⚠️ |
| 2021 | 16/68 24% ⚠️ | 11/68 16% ⚠️ | 4/68 6% |
| 2022 | 7/38 18% ⚠️ | 1/38 3% | 1/38 3% |
| 2023 | 4/18 22% ⚠️ | 0/18 0% | 0/18 0% |
| 2024 | 2/8 25% ⚠️ | 1/8 12% | 0/8 0% |
| 2025 | 3/14 21% ⚠️ | 0/14 0% | 0/14 0% |
| 2026 | 0/17 0% | 0/17 0% | 0/17 0% |
漂移监控实measured结论:v1 有 8/9 个年份告警、全池未分类率 25.0%。
逐条审阅后确认 告警成因不是 spec 预期的「用词演变」,而是「分类器覆盖不足」 ——
漏掉了西语故障词(dejó de funcionar)、拆不开的多种写法(can not remove / come apart / won't drain)、
锈水氧化(yellow-brown water / oxidation)、寿命计数(worked only 4 times)。扩表后收敛至 7.2%。
2.4 漂移监控捕捉到的两个「新增品类缺陷」
这正是 §2.3 设计目的的直接验证。v1/v2 的维度表里都没有以下两类,
是漂移监控的未分类池把它们暴露出来的:
U12 人体工学 / 尺寸不适配 品类扩展 · 新增
命中 7 条。投诉集中在「喷臂太短太矮,坐姿下蒸汽够不到全脸」,是本产品被反复抱怨的设计问题。
[2021] It’s ok
[2021] Could be better
[2021] Steam only parts of your face
[2020] Arm too short but not bad...
[2020] It’s ok
[2019] Extendable arm too short
[2019] Good steam flow, but needs to be a stronger flow for salon use.
U13 与描述不符 / 发错货 品类扩展 · 新增
命中 1 条。详情页标 Color=White,实际收到棕色机。
[2019] Ugly brown steamer...NOT white as advertised.
§3 通用量化指标体系Standardized Metrics
指标 A TRR(y) = 当年文字评论总数 ÷ 当年预估销量 (文字评论率)
指标 B TNPT(y) = 当年文字差评总数 ÷ 当年预估销量 × 1000 (每千件文字差评频次)
指标 C Sprojected = S实测前 M 个月 ÷ M × 12 (年化标定,展示时须与实测底数分列)
| 年份 | 文字评论 | 差评+中性 | 实测销量 | 月数 | 年化销量 | TRR | TNPT | 置信度 |
| 2018 | 5 | 2 | — | 0 | — | — | — | Low |
| 2019 | 60 | 35 | — | 0 | — | — | — | Medium |
| 2020 | 63 | 36 | — | 0 | — | — | — | Medium |
| 2021 | 109 | 68 | — | 0 | — | — | — | High |
| 2022 | 71 | 38 | — | 0 | — | — | — | Medium |
| 2023 | 51 | 18 | — | 0 | — | — | — | Low |
| 2024 | 32 | 8 | 865仅 4 个月 | 4 | 2,595 | 3.70% | 9.25‰ | Low |
| 2025 | 36 | 14 | 6,318 | 12 | 6,318 | 0.57% | 2.22‰ | Low |
| 2026 | 29 | 17 | 5,168仅 9 个月 | 9 | 6,891 | 0.56% | 3.29‰ | Low |
分母依赖警告:Sorftime 历史销量硬上限 25 个月(2024-09 起),
2019–2023 共 5 个年份无销量数据 → 这 5 年的 TRR / TNPT 无法计算,只能退回占比维度。
2024 与 2026 为部分年度(分别只有 4 / 9 个月实测),年化值仅为参考,不得回写实测底数。
口径纪律(spec §3 注):本模块所有文案统一输出为
「每千件文字差评发生频次」,严禁表述为「退货率」或「整机不良率」。
§4 小样本熔断与统计置信度规范Sample Size Guardrail
Medium(20≤N<50)
3
须附「趋势可供参考」修正提示
Low / 熔断(N<20)
5
禁用单纯百分比恶化判定
实测结论:9 个年份中仅 1 个达到 High 置信度。
亚马逊文字评论逐年稀疏是客观规律 —— 这意味着按年度的百分比恶化判定,在绝大多数年份都不可用,
必须走熔断流程。这也从反面说明 §3 的 TNPT(发生率)比占比更耐小样本。
4.1 熔断触发年份与强制话术
| 年份 | Nneg | 等级 | 必须输出的固定话术 |
|---|
| 2018 | 2 | Low / 熔断 | 因基数极小(N=2),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2023 | 18 | Low / 熔断 | 因基数极小(N=18),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2024 | 8 | Low / 熔断 | 因基数极小(N=8),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2025 | 14 | Low / 熔断 | 因基数极小(N=14),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2026 | 17 | Low / 熔断 | 因基数极小(N=17),占比波动属于随机扰动,当前发生率仍在安全范围内 |
4.2 「偶发集中」判定(占比 ≥40% 但绝对条数 <3)
| 年份 | 维度 | 占比 | 绝对条数 | 判定 |
|---|
| 2018 | 物流 / 包装 / 二手 | 50% | 1 | 偶发集中 |
§5 跨维度矛盾仲裁决策树Decision Tree
决策权重(硬性优先级):
Severity Tier 1(人身安全) > TNPT(千件发生率) > 痛点结构占比(%) > 前台差评率
| 年份 | 仲裁结论 | 主驱动 | 依据 |
|---|
| 2018 | 占比驱动 | 痛点结构占比 | 该年无销量数据,回退至占比维度(受小样本约束);因基数极小(N=2),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2019 | 红线优先 | Severity Tier 1 | 命中人身安全红线 1 条,直接置顶,不受占比与发生率影响 |
| 2020 | 红线优先 | Severity Tier 1 | 命中人身安全红线 2 条,直接置顶,不受占比与发生率影响 |
| 2021 | 红线优先 | Severity Tier 1 | 命中人身安全红线 2 条,直接置顶,不受占比与发生率影响 |
| 2022 | 红线优先 | Severity Tier 1 | 命中人身安全红线 1 条,直接置顶,不受占比与发生率影响 |
| 2023 | 红线优先 | Severity Tier 1 | 命中人身安全红线 1 条,直接置顶,不受占比与发生率影响;因基数极小(N=18),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2024 | 发生率驱动 | TNPT | 每千件文字差评 9.2(实测销量 865 件 / 差评 8 条);因基数极小(N=8),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2025 | 红线优先 | Severity Tier 1 | 命中人身安全红线 2 条,直接置顶,不受占比与发生率影响;因基数极小(N=14),占比波动属于随机扰动,当前发生率仍在安全范围内 |
| 2026 | 发生率驱动 | TNPT | 每千件文字差评 3.3(实测销量 5,168 件 / 差评 17 条);因基数极小(N=17),占比波动属于随机扰动,当前发生率仍在安全范围内 |
实测发现的设计问题:9 个年份中有 6 个仲裁结果都是「红线优先」。
原因是红线桶只要命中 ≥1 条就无条件置顶,而本产品 8 年累计红线命中 9 条、几乎每年都有 1–2 条 →
决策树在多数年份退化为单分支,失去了「TNPT vs 占比」的区分能力。
建议:红线置顶应限定为「本年度新增红线事件」或附带强度阈值,否则该层级会吞掉后续所有判断。
指标背离实例(2026):前台差评率 44.8%(看着恶化)vs TNPT 3.29‰(看着轻微)。
按决策树,TNPT 优先于前台差评率 → 结论应以发生率为准,而非差评率。
但 2026 的置信度为 Low(N=17),须同时输出熔断话术。
§6 近一年窗口深度剖析(LTM)Last Twelve Months
滚动 12 个月窗口:2025-09-17 至 2026-09-17,以最新评论日期为终点倒推 365 天。
窗口内差评+中性 24 条(占全池 10.2%)。
人身安全红线(起火·触电·烫伤)红线
4.2%1 条
读法:窗口内样本仅 24 条,按 §4 属 Low 置信度,
所有占比仅供方向参考。窗口内红线命中 1 条,
按 §5 决策树须置于所有结构性痛点之前呈现,不受占比高低影响。
§7 实施记录与已知局限
本节记录本次实测中真实发生的问题、三轮迭代的证据链,以及仍需你判断的设计缺口。
7.1 三轮词表迭代记录
| 版本 | 维度数 | 全池未分类率 | 告警年份 | 红线命中 | 本轮修正内容 |
| v1 | 12 | 25.0% | 8 | 13 | 初始词表 |
| v2 | 12 | 15.7% | 5 | 9 | 补西语故障词 / 拆不开写法 / 锈水氧化;收紧红线误报 |
| v3 | 14 | 7.2% | 2 | 9 | 新增 U12 人体工学 / U13 与描述不符;补寿命计数写法 |
7.2 v3 剩余 17 条未分类样本(人工确认基本无具体缺陷)
[2022] 2★ Don’t waste your time and money | Get the more expensive one. This one is not gonna get the job done. I regret
[2021] 3★ the top long part GET HOTTTT DONT TOUCH AFTER ITS ON | It doesnt Bring a box to put it back into after your do
[2021] 3★ Good | It’s a great steamer but I wish it came with a stand
[2021] 3★ Returned product | I got this product end of May. Haven‘t got a chance to try it until now. This looks like a
[2021] 2★ Not good for pro use | This steamer doesn’t have a strong stream for clients and isn’t powerful enough to do w
[2020] 3★ need to know | I like that the team was warm and relaxing and the spray covers a wide area , but the arm was n
[2020] 3★ Okay | Not super happy with this purchase. Its size is great for being portable, but I‘m not too happy with th
[2020] 2★ Not very convenient | The steamer works well but if you‘re looking to use it for professional use in a spa or
[2020] 3★ Super | Esta súper bueno y calienta bien hasta el momento
[2020] 1★ NOT WORTH IT | I loved this product as an esthetician worked well for my clients but it didn’t even last for a
已确认的收敛上限:剩余未分类中包括 2 条「低星但正文是好评」
(2★「Really good | Good」、3★「Esta súper bueno」)—— 说明星级与文本情感不一致,
这类评论不应强行归入任何痛点维度。继续压降未分类率会变成对单一产品的过拟合。
7.3 已知局限(请重点检查)
- 销量序列硬上限 25 个月 —— 8 年趋势中 5 年无发生率,TRR/TNPT 覆盖不全。
- 文字评论仅覆盖 7.9% 的评分总量 —— 所有比率只能年际相对比较。
- 红线桶在多数年份退化为单分支(见 §5)。
- 2024 / 2026 为部分年度 —— 年化值为参考,须与实测底数分列展示。
- 维度 Schema 仍含人工成分 —— spec 要求「严禁写死」,本次的通用基线 + 品类扩展结构是
按 steam 类推导的结果,跨品类(3C / 服饰)复用性尚未验证。
- 漂移监控无法区分「覆盖不足」与「用词演变」 —— 本次告警主因是前者。
建议增设「分类器自检」环节,否则会把词表缺陷误报成品类缺陷。