# 保哥笔记 — DTC合规与法务 > 本分片含 8 篇文章,按发布日期倒序。全部分片索引见 https://zhangwenbao.com/llms-full.md **站点**:https://zhangwenbao.com/ **分类**:DTC合规与法务 **生成**:2026-09-10 10:30:06 CST --- ## 独立站文案里最贵的字是“更”:一句比较级要你拿出整套对比测试 - URL:https://zhangwenbao.com/expert-endorsement-substantiation-by-claim-wording.html - 分类:DTC合规与法务 - 发布:2026-08-04 | 更新:2026-08-04 - 摘要:举证门槛不由产品决定,由你写下的那句话决定。16 CFR 255.3六个例子里唯一合规的那个,靠的是没写挑选二字;本文附一张句式价目表、一次净水器复盘与六个自查动作。 - 关键词:红人营销,独立站合规,广告宣称,产品页文案 > **TLDR**:摘要:这篇文章想解决一个很具体的动作——把落地页上的句子逐条抄下来,问每一句“为了写下你,我们做过什么”。答不上来的那几句不是文案不好,是它们在借用一份并不存在的证据。美国联邦贸易委员会的两份文件把这件事写到了条文级:一份规定专家背书必须有与其宣称专业度相称的实际检验,另一份把粉丝数、播放量的真伪定义成“背后有没有真人做过一件事”。本文逐条拆开这两份文件,用皮尤问卷里的269条编程指令当参照物,再补上我在净水设备站栽的那一跤——一句“我测过出水最稳的”,让47张退货工单在报表上伪装成了好数字。 > 摘要:这篇文章想解决一个很具体的动作——把落地页上的句子逐条抄下来,问每一句“为了写下你,我们做过什么”。答不上来的那几句不是文案不好,是它们在借用一份并不存在的证据。美国联邦贸易委员会的两份文件把这件事写到了条文级:一份规定专家背书必须有与其宣称专业度相称的实际检验,另一份把粉丝数、播放量的真伪定义成“背后有没有真人做过一件事”。本文逐条拆开这两份文件,用皮尤问卷里的269条编程指令当参照物,再补上我在净水设备站栽的那一跤——一句“我测过出水最稳的”,让47张退货工单在报表上伪装成了好数字。 ## 为什么同一句话,有人张嘴就说、有人得先做完整套测试? 先看两句话。第一句是“这台净水器出水口感不错”,第二句是“这台净水器出水比同价位那几台都稳”。写下第二句的人,比写下第一句的人多欠了一整套对比测试。 对比测试要做到多大规模才算数,独立站A/B测试样本量的三个公式 (https://zhangwenbao.com/dtc-ab-test-sample-size-3-formulas.html)给的是可以直接套进去算的办法,动手前先把这一步算清楚。 两句话都可能是真的,说话的也可能是同一个人。差别不在真假上,在于第二句给自己挂了一个必须兑现的动作,而第一句没有。这篇文章想讲清楚的就是这个挂钩是怎么挂上去的。 ## 一句话的价格,在写下它的那一刻就定死了 做独立站的人习惯把文案当成表达问题:怎么说更打动人、怎么说更像人话、怎么说转化更高。这些当然都对,只是它们都绕开了一个更早的问题——这句话要求我事先做过什么。 把这个问题提到最前面,文案就从表达问题变成了采购问题。每一句宣称都有一个价签,价签上写的不是钱,是动作:一次实测、一份报告、一组对比、一次抽样。你写下它,账就记上了。 把文案当采购来管并不影响它好看,SEO文案写作的八项实战技巧 (https://zhangwenbao.com/seo-copywriting-tips.html)那篇讲的仍然是怎么写得让人愿意读,两件事可以并行。 ## 先说结论:规则问的不是你说得对不对 我读完美国这两份文件最大的意外,是它们几乎不关心宣称本身是真是假。判断真假需要事后验证,而广告是当场发生的事,等真假水落石出,钱早收完了。 事后追责为什么总是追不回来,刷一条假评论的收益和罚款不在一个账本上 (https://zhangwenbao.com/fake-review-unit-payoff-and-denominator-gap.html)那篇把两边的数量级摆在一起算过一次。 于是规则换了个抓手:不问结果问过程,不问“你说的对不对”,问“你为这句话做了什么”。动作是当场就能查的,而且它留得下痕迹。这个转向看着不起眼,实际上把整个举证责任翻了个面。 ## 第一问:这句话背后,是谁具体做过什么 不是谁说的,是他做了什么。一个头衔、一张证书、一个粉丝数,全都不算答案。答案必须是一个带动词的句子:测了几台、测了多久、用什么设备测的、测的是哪个指标。 这一问最有用的地方是它极难糊弄。含糊的回答会立刻暴露自己——“我们做过充分测试”是一句没有动词的话,它只是把“充分”这个形容词摆在那里,等着你自己去脑补一个动作。 让含糊表述现形最省事的办法是过一遍核查清单,内容写完谁来质检的人机分工清单 (https://zhangwenbao.com/ai-content-qa-workflow-human-ai-review-checklist.html)可以直接改成自己团队的版本。 ## 第二问:这个动作的强度,配不配这句话的口气 做过不等于做够。一个人可能真的测了,但测的量级远远撑不住他嘴上那句话。判据是:换一个同样专业度的人来支撑同样这句结论,他通常需要做到什么程度。 这个比较对象很关键——不是“我尽力了”,也不是“行业一般都这样”,而是“这句话本身要求多少”。口气越满,要求越高,两者之间不是线性关系,是台阶。 台阶式的成本结构在定价上同样常见,从成本加成到价值定价的决策框架 (https://zhangwenbao.com/dtc-pricing-strategy-cost-plus-value-based-framework.html)那篇讲的就是怎么找到跳档的那个位置。 ## 第三问:句子里的比较级,有没有真的被执行过 只要出现更好、更快、更稳、最、第一、领先、唯一这些词,你就把别人的产品拖进了自己的举证范围。这一问单独拎出来,是因为它最容易被跳过。 大多数人会认真对待“99.9%”这种数字,却完全不觉得“更耐用”需要证据。可从举证角度看,前者只需要测自己,后者需要先买回竞品、再设计同条件测试、还得真的赢——成本高一个数量级。 欧盟那边已经在把这笔成本变成硬性要求,商品页写环保材质要拿得出证据 (https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html)整理了从九月底开始生效的具体清单。 ## 三问怎么组合,四种结果分别怎么处置 三问的组合不是打分,是分流。它给出的不是一个可信度百分比,而是一个明确的下一步动作,这也是我愿意把它当成日常工具的原因。 三问全过,这句话可以直接上线;只过前两问,删掉比较级之后可以上线;第一问答不出来,这句话不是证据是标识,只能删或者改写;第二问答“做过但很轻”,那就把口气降到动作能撑住的那一档。 三问结果 | 这句话的状态 | 下一步动作 | 三问全过 | 可用 | 把依据链接挂上去,直接上线 | 过一二,第三问未执行 | 需降级 | 删掉比较级,改成绝对表述 | 过一,第二问强度不足 | 需降级 | 把口气压到动作撑得住的那一档 | 第一问答不出 | 不可用 | 删掉,或补做动作再写回来 | ## 三十秒粗筛只留一句话 完整三问需要坐下来查资料,日常评审没有这个时间。粗筛版只有一句:这句话,我们为它做了什么。 这一句话的好处是不需要任何法规知识,也不需要打开任何文档,任何人在会上都能问出口。而且它有一个副作用——问出来之后,房间里会安静几秒钟,那几秒钟本身就是答案。 把心里的猜测写成一个可被证伪的假设再去看数据,数据驱动的假设检验打法 (https://zhangwenbao.com/data-driven-seo-decisions-attribution-and-hypothesis-testing.html)给了一套可以照着走的流程。 ## 为什么不能用“他是不是专家”代替这三问 专家身份回答的是“他有没有能力做这件事”,三问回答的是“他这次做没做”。前者是资格,后者是记录,两者之间隔着一整个执行环节。 资格和执行之间的落差在选人时同样存在,SEO专家的八项核心能力 (https://zhangwenbao.com/seo-expert-skills-guide.html)那篇拆的正是怎么从简历之外判断一个人真会做什么。 而广告里出问题的地方几乎全在执行环节上。一个真专家、用真设备、说真话,仍然可能得出一句不成立的宣称——只要他这次做的动作和这句话要求的不是同一件事。后面净水器那一节讲的就是这种情况。 ## 头衔是静态的,动作是带时间戳的 头衔一旦拿到就一直挂在那儿,它不随产品变化,也不随版本变化。动作不一样,动作发生在具体的时间、针对具体的批次、用的是具体那台设备。 这个差别在产品迭代快的品类里尤其致命。去年测的那一批和今年卖的这一批,可能连滤芯供应商都换了,可页面上那句话一个字没动,因为没人觉得一句话需要维护。 页面上的内容会随时间失效这件事,改更新日期骗不骗得过搜索引擎 (https://zhangwenbao.com/modified-timestamp-truthful-update-fake-refresh-signal-mechanism.html)那篇从另一个角度实测过真更新和假更新的差别。 ## 这条判据跟以前那些判据是什么关系 我之前用过的几套判据,一套是看这个数字是谁生产的、他生产它有什么好处;另一套是看这个数字说的是谁,问的是你自己还是别人。两套都很好用,但它们审的都是数字。 这一套审的不是数字,是数字和动作之间那段距离。它可以套在任何一句话上,哪怕那句话里一个数字都没有——“工程师推荐”里没有数字,可它照样欠着一个动作。 ## 从校正一个数,到给一句话报价 说得再具体一点。看激励结构,你得到的是信不信;看参照系,你得到的是往哪边偏、偏多少;看支撑动作,你得到的是这句话要花多少钱。 前两个是判断,第三个是定价。定价的好处是它可以进预算表、可以排优先级、可以拿去跟人讨价还价,而判断只能装在脑子里,最后往往被更响的声音盖掉。 ## 举证门槛为什么反过来由措辞决定 这是整篇文章最反直觉的一点:门槛不是由产品定的,是由你说的话定的。同一台净水器,你说“配有活性炭滤芯”和你说“比同类多滤掉三成杂质”,需要的证据完全不在一个量级。 产品没变,检测能力没变,变的只是那句话。规则读的是句子,不是产品,所以句子写成什么样,账单就开成什么样。 ## 一个直接的推论:改文案比补测试便宜得多 既然账单是句子开出来的,那么最便宜的降本方式就是改句子。删掉一个比较级,一次几千美元的对比测试就跟着消失了,而这个动作的成本是零。 我知道这听起来像是在教人怎么绕过要求。恰恰相反——绕过要求的做法是照写不误然后祈祷没人查,改措辞是把话说到自己真能兑现的那一格,这两件事的方向完全相反。 ## 大多数团队的顺序正好是反的 常见流程是这样:文案先写出最有力的那个版本,投放跑一轮,数据好就固定下来,然后某一天法务或者平台找上门,才开始回头找证据。 这个顺序的问题不是它不严谨,是它太贵。等到句子已经跑出好数据、已经被印在包装上、已经被红人念过一百遍,再想改回去,阻力就不只是合规问题了,是有人要为之前的判断负责。 越早把法务拉进来,回头改的代价越小,法务与SEO协作的七个动作点 (https://zhangwenbao.com/legal-counsel-seo-collaboration-7-actions-privacy-trademark-incident.html)列了哪些环节值得提前打招呼。 ## 转化率最高的那句话,通常也是最贵的那句 这条相关性我在几个站上反复看到。句子越满、越绝对、越带比较,点击和转化就越好看,同时它要求的举证动作也越重。 换句话说,你的落地页上转化贡献最大的那几句话,大概率就是你证据最薄的那几句。评审时该优先翻的不是表现差的模块,是表现最好的那一句——这跟大家的直觉正好拧着。 > 好句子和贵句子在页面上通常是同一句。判断一句文案该不该留,先看它跑得多好,再看它欠了多少,两个数放一起才成立。 ## 消费者为什么必须借用别人的动作 说到底,代言这件事之所以存在,是因为买家自己做不了那个动作。他没有水质检测设备,没有分贝仪,没有实验室,也没有五台竞品可以摆开对比。 所以他只能借用——借用一个他认为做过这件事的人的判断。整个背书机制建立在这个借用关系上,而借用能不能成立,只取决于那个人到底做没做,不取决于他有多可信、多真诚、粉丝多少。 ## 为什么“同行都这么写”撑不住 这是我在评审会上听到最多的一句抗辩,而它在规则里没有位置。行业惯例可以解释一句话为什么会被写出来,不能解释它凭什么成立。 更实际的一点是,同行那句话可能有证据你不知道,也可能同样没有。你照着抄,抄到的是句式,抄不到的恰恰是那份你看不见的支撑材料。 照抄供应商文案的另一重代价是内容毫无独特性,产品详情页怎么摆脱供应商文案 (https://zhangwenbao.com/product-detail-page-onpage-seo-unique-content-engineering.html)给了一套做出唯一内容的改造路线。 ## 这条判据对哪些句子无效 纯主观表达不在射程内。好看、舒服、我很喜欢、设计感强,这些话没有对应的动作,也不该有——要求一个人为“我喜欢这个颜色”提供检验记录是荒唐的。 分界线很好画:这句话的结果能不能填进一个带单位的空格里。能填的就是事实性宣称,欠着动作;填不进去的是偏好表达,不欠。这条判据后面还会用到两次。 ## 判据能查出什么,查不出什么 它能查出一句话有没有动作撑着,能查出动作的强度够不够,能查出比较级有没有兑现。这三件事都是当场可查的,不需要等结果。 它查不出那个动作本身做得对不对。一个人可能认认真真做了一件跟这句话不对应的事,三问会全部通过,问题却依然存在——这正是我在净水器那一跤里踩到的位置,也是这套方法最需要小心的地方。 ## 还有一个容易被跳过的前提 这三问处理的是页面上已经写下来的句子,它不负责决定该写什么。选题、卖点排序、首屏放哪一句,那是另一套工作,得先做完才轮到这一套。 我见过团队把顺序搞反:还没想清楚要主打什么,先拿三问把所有候选句子筛一遍,结果剩下的全是最保守那几句,页面变得又安全又没人看。先定要说什么,再定说到哪一档,顺序不能换。 ## 接下来这七节的走法 第二节和第三节拆条文,把门槛具体定在哪一格、什么情况下会降下来讲清楚。第四节换一个正面样本,看看一份被完整披露的支撑动作长什么样。 第五节讲那些看起来像证据其实不是的数字。第六节是我自己的复盘,第七节是可以今晚就开始做的六个动作,第八节讲这套方法治不了的三件事。 ## 16 CFR 255.3到底把门槛定在了哪一格? 美国联邦法规第16编第255部分叫《代言与证言使用指南》,全篇不到一万词,其中专门讲专家背书的是第255.3条。这一条只有三段:一段讲资格,一段讲动作,剩下是六个例子。 真正的重量全压在第二段。那一段是一个句子,一句话里塞了五个必须同时满足的条件,读第一遍会以为它在重复自己,读第三遍才发现每一句都在关掉一扇后门。 ## 第一段先把资格这件事关死 条文说:只要广告明示或者暗示这位背书人在该背书内容上是专家,那么他的资质就必须真的赋予他所被表现出来的那种专业能力。原文见电子版联邦法规第255.3条专家代言 (https://www.ecfr.gov/current/title-16/chapter-I/subchapter-B/part-255/section-255.3)。 注意“暗示”两个字。你不需要在页面上写“专家”,只要呈现方式让读者觉得他是,这条就启动了。白大褂、实验室背景、一面挂满证书的墙,都算暗示。 视觉元素本身就在做宣称这件事,图片越假信任越低的六类真实图打法 (https://zhangwenbao.com/b2b-image-authenticity-trust-6-types-real-photos-eeat-visual-signal.html)整理了哪些画面会被读者当成证据看。 ## 第一个例子就把这条钉死了 规则举的例子是一位被介绍为“工程师”的人为一款汽车背书。条文说,这个称呼会让消费者推断他的训练与经验使他熟悉汽车的设计与性能。 然后来了一句:如果这位背书人的领域是化学工程,那么这个背书就是欺骗性的。他是真工程师,学历是真的,工作是真的,可他的专业方向跟这句话要的那个方向不是一回事。 ## 第二个例子给出了唯一一条补救路径 一位在广告中只被称作“医生”的人为助听器背书。规则说这很可能暗示他在听力领域有专业能力,比如有相当听力学经验的医学博士,或者听力学方向的博士。 接着是关键的一句:一位在听力领域没有实质经验的医生也许仍然可以背书,前提是广告清楚且显著地披露这位背书人专业能力的性质与边界。这是全条唯一一次给出“补救”而不是“禁止”。 把边界写清楚反而更容易被接受,退换货政策页怎么写才既做信任背书又拿流量 (https://zhangwenbao.com/dtc-return-refund-policy-page-seo-trust-conversion-design.html)那篇讲的也是同一种披露思路。 ## 第二段那句话里藏着五个条件 把它拆开来看会清楚很多。第一,背书必须由该专家所被表现出的那种专业能力的实际行使来支撑;第二,这个行使针对的必须是与普通消费者使用体验相关的产品特性。 第三,这次评估必须包含一次检验或测试,其广泛程度至少等于具备同等被表现专业度的人为支撑该结论通常需要进行的程度;第四,若广告暗示了与其他产品的比较,该比较必须真的包含在评估中;第五,若净印象是本产品更优,专家必须真的发现了这种优越性。 条件 | 它关掉的后门 | 对应到页面上的问法 | 必须实际行使专业能力 | 只借名字不干活 | 他这次到底动手做了什么 | 针对消费者相关的特性 | 测了,但测的不是这件事 | 他测的项目和我们宣称的是同一项吗 | 强度不低于同行常规 | 做了一点点就敢下大结论 | 换个同行来,他会做多少 | 比较必须真的做过 | 暗示对比却从没对比 | 竞品买回来了吗,同条件测的吗 | 更优必须真的找到 | 做了对比但没赢也照写 | 对比结果是赢、是平,还是没敢看 | ## 第三个条件是整条里最锋利的一句 “至少等于具备同等被表现专业度的人为支撑该结论通常需要进行的程度”,这一句同时锁住了三个变量:谁来做、做多少、为了支撑哪句话。 它的巧妙之处在于把标准外包了。规则没有规定要测几台、测几小时、用什么仪器,它规定的是“同行会怎么做”。这样一来标准会随行业水平自动升级,条文本身不用改。 想知道同行大致做到什么程度,SEO行业基准数据大全 (https://zhangwenbao.com/seo-industry-benchmarks-data-reference-guide.html)把转化率、排名周期这类参照值汇总在了一处,可以当锚点用。 ## 为什么“我们尽力了”不是一个合格答案 因为条文里的比较对象不是你自己的努力程度,是外部同行的常规做法。尽力是一个内部量,它没法被第三方复核,而“同行通常怎么做”是可以取证的。 要摸清同行的实际做法,先得看清他们手上有什么工具,DTC品牌AI工具栈的十二款真实测评 (https://zhangwenbao.com/dtc-ai-tools-stack-12-real-world-tools.html)做过一轮横向清点。 这一点搬到日常评审上同样成立。当有人说“我们已经测得很仔细了”,正确的追问不是“有多仔细”,是“做这行的人一般会测到什么程度”。 ## 第四第五个条件是同一件事的两截 第四条管的是比较有没有做,第五条管的是比较的结果。两条分开写不是啰嗦——它们堵的是两种不同的偷懒。 第一种偷懒是根本没买竞品,第二种是买了、测了、发现自己没赢,然后把结论写成赢。第二种在数据上完全经得起查,因为测试记录都在,只是结论那一栏被改过。 实验记录齐全而结论被改写,是最难查的一类问题,SEO实验设计与统计功效 (https://zhangwenbao.com/seo-ab-testing-experiment-design-statistical-power-single-factor.html)讲了怎么把结论锁死在数据上。 ## 六个例子里,判定结果是四比一比一 我把第255.3条的六个例子逐个过了一遍,按最终判定归类:四个被明确判为欺骗性,一个是有条件通过,一个是完整通过。 这个分布本身就是一条信息。规则在讲专家背书的时候,绝大部分篇幅花在“什么情况下不成立”上,只留了一个例子告诉你什么样算成立——而那个例子的成立方式跟大多数人预期的完全不同。 例子 | 场景 | 判定 | 卡在哪一条 | 例一 | 化学工程师为汽车背书 | 欺骗 | 资格与宣称领域不符 | 例二 | 非听力方向的医生为助听器背书 | 有条件 | 需清楚显著披露专业边界 | 例三 | “美国科学研究院”认可汽车配件 | 欺骗 | 机构非独立,或未做有效测试 | 例四 | 大医院选用某非处方药 | 欺骗 | 选择依据与消费者无关且未披露 | 例五 | 家政公司总裁推荐清洁剂 | 通过 | 未暗示对比,累积经验即足够 | 例六 | 医生称可安全降胆固醇50点 | 欺骗 | 所依据材料不足以支撑该结论 | ## 第三个例子给认证徽章判了两次死刑 一家汽车配件厂商宣传自己的产品经“美国科学研究院”认可。规则说,光从这个名字,消费者就会推断它是一家有资质的独立检测机构,并且不会在未测试性能之前就给出认可。 第一次判定:如果这家机构不是真正独立的,比如它由某家汽车配件厂商设立和运营,那么这个背书就是欺骗。这一条对做自建认证体系的品牌是直接命中。 行业奖项这条路上也有大量自建体系,行业奖项与排行榜反链战术 (https://zhangwenbao.com/industry-awards-rankings-listings-link-building-tactics.html)那篇专门讲了怎么识别一个奖到底值不值钱。 ## 就算机构是真的,第二刀照样落下来 条文接着说:即便这家机构确实是独立且有资质的专家检测组织,这个背书仍然可能是欺骗性的,除非该机构确实对广告中的产品做过有效的科学测试,且测试结果支持这个背书信息。 两个条件是串联的,缺一不可。机构真、测试假不行;测试真、机构不独立也不行。落地页上那个徽章图标,实际上是在同时主张这两件事,而绝大多数人贴上去的时候只想到了第一件。 徽章只是信任体系里最表层的一格,独立站信任怎么建的七层落地实战 (https://zhangwenbao.com/dtc-ecommerce-trust-7tier-eeat-mechanism.html)把更底下那几层该做什么排了个顺序。 > 一个认证标志在页面上占的面积不到千分之一,它主张的东西却有两条:发证的人是独立的,而且他真的测过这一款。两条都得站得住,标志才站得住。 ## 第四个例子最容易被当成误伤 一家大型医院选用了某款非处方药,厂商拿这件事做广告。医院的选择理由是:这家厂商跟竞争对手不同,把每一剂都做了单独包装。 规则判定这是欺骗性的,理由有两条:这个选择依据——包装便利性——对消费者既不相关也不可得,而且这个依据没有被披露给消费者。医院是真的选了,理由是真的,可这个理由跟买家的处境毫无关系。 ## 这个例子对DTC的杀伤力比看上去大 把它翻译过来就是:任何一句“某某专业机构在用”的话,都在暗示这个选择的理由对普通买家同样成立。而实际上机构采购的理由常常是账期、包装、供货稳定性、售后条款。 这些理由都很正当,只是它们不在消费者的决策空间里。这句话没撒谎,它只是把一个不可得的理由包装成了一个可得的推荐。 自夸式榜单被点名之后的整改思路也是同一条,自夸式榜单被谷歌点名后怎么改 (https://zhangwenbao.com/self-promotional-listicles-ftc-google-crackdown.html)那篇给了一份可执行的改造清单。 ## 第六个例子讲的是证据类型不匹配 一位医生在广告中说某药物可以安全地让消费者降低50点胆固醇。规则说,如果这位医生所审阅的材料只是满意消费者的来信,或者一项啮齿动物研究的结果,那么这个背书很可能是欺骗性的。 理由写得很直白:那些材料不属于具备同等专业度的人会认为足以支撑此项安全性与有效性结论的科学证据类型。同时,广告主和这位医生都要为这个误导性表述负责。 ## 用户来信在举证意义上是零 这一点值得单独拎出来。第255.2条里有一句更狠的:消费者代言本身不构成有资质且可靠的科学证据。一百条五星好评加在一起,在举证意义上仍然是零。 这跟好评有没有价值是两回事。好评在转化上极其有用,在举证上完全无效,两个账本不通兑。把评价墙当成宣称的依据,是把营销资产错当成了证据资产。 好评在转化上的价值一点没变,让陌生买家敢下第一单的社会证明体系 (https://zhangwenbao.com/dtc-social-proof-system-reviews-ugc-trust-conversion.html)讲的就是怎么把它用在该用的位置上。 ## 背书人自己也在射程里 规则里还有一段专门讲皮肤科医生的例子。这位医生是某药企的付费顾问,被要求在专业社交账号上发帖,他发帖称该公司最新的祛痘产品“经临床证明”有效。 而他事先拿到的那份临床研究说明里,设计与执行上的缺陷严重到根本无法就产品有效性得出任何结论。规则说,凭他的医学专业能力,他本应识别出这些缺陷,因此他要为自己的虚假陈述承担责任,广告主同样要承担。 ## 专业能力在这里变成了义务而不是资本 这个转向非常关键。平时我们把专业能力当成一种资本——因为我懂,所以我的话更值钱。规则反过来用:因为你懂,所以你本应看出问题,看不出就是你的责任。 对品牌方的直接含义是:找的专家越权威,他没能识别出的东西就越少被原谅。请一位真专家来说一句没依据的话,风险比请一个素人说同样的话更高,不是更低。 ## 广告主不能靠“是他说的”脱身 规则第255.1条把这件事讲得很清楚:广告主要为通过代言传达的表述负责,背书人也可能要为自己的陈述负责。责任不是二选一,是两边都有。 所以那种“视频是博主自己拍的,脚本我们没改过”的说法,在这套规则里既不是抗辩也不是缓解。恰恰相反,你没有审过脚本这件事本身,说明那句话上线时没有任何人问过它欠了什么。 ## 还有一条关于产品改版的规定 规则举了一个油漆的例子:一位建筑承包商说他使用某款外墙漆,因为它干得快而且耐久。后来厂商重新配方,让这款漆一遍就能覆盖外墙。 条文要求:在继续使用这位承包商的背书之前,广告主必须联系他,确认他是否仍会使用改版后的产品并认同此前的说法。换句话说,产品一改,旧背书就自动失效,需要重新取得。 ## 顺便说一句,这一条对老素材同样成立 不只是产品改版会让旧背书失效,宣称本身被改写也会。你把页面上那句话从“更耐用”改成了具体读数,可红人视频里还是老说法,那句老说法仍然在替你做宣传。 处理办法不复杂,把还在跑量的老内容列一张表,标上发布时间和对应的产品版本。核对某段条文是哪一年写进去的,可以查联邦法规第16编2024年年度卷 (https://www.govinfo.gov/app/details/CFR-2024-title16-vol1)这类定本。 ## 这一条在电商里几乎从没被执行过 独立站的产品迭代频率远高于油漆。滤芯换供应商、固件升级、外壳改模,页面上那段红人评价却从上线之日起一个字没动过。 更麻烦的是,这类内容通常存在于第三方平台上——视频在他的频道里,帖子在他的账号下。你改不了,也很少有人想到去联系他重新确认。这是一笔一直在滚利息的账。 ## 六个例子里唯一合规的那个,凭什么可以少做? 第255.3条的第五个例子,是全条唯一一个从头到尾都成立的场景。它值得单独占一节,因为它成立的方式跟所有人的预期都不一样。 它不是因为做得更多才通过的。它是因为说得更少。 ## 先把这个例子完整摆出来 一位被介绍为某商业家政服务公司总裁的人,在一支电视广告里说,他的公司用某个牌子的清洁剂而不是主要竞品,因为它的表现更好。 规则先做了一个认定:由于家政服务在日常经营中大量使用清洁剂,这则广告很可能传达出这位总裁拥有超出普通消费者的知识。因此他的陈述被视为专家背书——门槛立刻升到了第255.3条这一档。 ## 接下来规则列了三项要求 第一,这家服务公司当然必须真的在用这款被背书的清洁剂。第二,由于广告暗示这家公司对相当数量的主流竞品有使用经验,它必须真的有这种经验。 第三,它必须基于自己的专业能力判定,这款产品的清洁能力至少与消费者可以买到的主流竞品相当——如果广告传达的净印象是更优,那就必须是更优。 ## 然后是那句改变一切的话 条文最后写道:由于在这个例子里,这家家政公司的总裁没有提到这款清洁剂是被“挑选”“选择”或者以其他方式经过并排比较评估出来的,因此该公司仅凭其在评估清洁剂过程中积累的经验就足够了,无需进行并排测试或科学比较。 请把这句话读慢一点。同一个人、同一家公司、同一款产品、同一份经验,举证门槛从“必须做并排对比测试”降到了“累积经验即可”,触发条件是广告里没有出现某几个词。 国内广告法里同样有一批由用词触发的门槛,广告违禁词检测里的例外与误判 (https://zhangwenbao.com/ad-word-checker-exception-overlap-falsepositive-guide.html)那篇拆过一次执法指南的口径。 > 规则不是按产品定门槛的,是按你说的话定门槛的。同一件事,说法换一种,账单差一个数量级。 ## 这是全条唯一一次门槛下降 前面四个例子讲的都是门槛怎么被抬高、怎么被卡住,只有这一个例子讲了门槛怎么降下来。而降下来的机制不在产品侧,也不在检测侧,完全在措辞侧。 我读到这里的时候把这一段抄了下来,因为它把一个抽象原则变成了可操作的东西:想省钱,先改句子。不是删掉宣称,是把宣称改到你现有证据撑得住的那一格。 降级措辞最怕把品牌口吻一起改没了,用技能把品牌口吻固化下来 (https://zhangwenbao.com/claude-brand-voice-skill-guide.html)给了一个让语气保持稳定的做法。 ## 比较级是页面上最贵的词 顺着这条逻辑往下推,结论很干脆:所有让举证成本跳档的词,都是那些把别人拖进来的词。更好、更快、更静、更持久、最、第一、领先、唯一、没有之一。 它们的共同点是都需要一个对照组。而对照组意味着你得把竞品买回来,得设计同条件测试,得承担测出来自己输了的风险。一个字带来的连锁成本,比整段文案的制作费还高。 换一套文案框架有时能绕开这笔成本,PAS与AIDA两套框架的五维选型 (https://zhangwenbao.com/pas-aida-seo.html)比较过它们在什么场景下更能撑住转化。 ## 绝对表述贵不贵,看它带不带单位 不带比较的绝对表述便宜得多,但也分档。“配有活性炭滤芯”几乎零成本,说明书就能证明;“出水TDS稳定在8到14 ppm”需要一份自测记录;“除菌率99.9%”需要第三方实验室按标准方法做。 判断方法还是那一句:这个结果能不能填进一个带单位的空格里。能填进去,它就是可验证的,就欠着一次测量;填不进去,它是偏好表达,不欠。 ## 把常见句式排成一张价目表 我在带团队的时候把这件事做成了一张表,贴在文案评审的会议纪要模板里。它不精确,也不该精确,它的作用是让写文案的人在动笔之前先看一眼自己要付什么。 把这张表和页面模块对应起来会更好用,B2B产品详情页的十四模块结构 (https://zhangwenbao.com/b2b-pdp-14-module-high-conversion-blueprint.html)给了一份逐模块的信任阶梯清单。 三档划分很粗:说明书能证明的、自测记录能证明的、必须第三方或对比测试才能证明的。分档的依据来自委员会那份代言指南问答 (https://www.ftc.gov/business-guidance/resources/ftcs-endorsement-guides-what-people-are-asking)里对证据类型的说明。 句式 | 门槛档位 | 需要的动作 | 典型成本 | 配有活性炭复合滤芯 | 一档 | 产品规格与物料清单 | 零 | 适用20平米以内房间 | 一档 | 由既有参数换算,写清换算口径 | 零 | 夜间模式实测40分贝 | 二档 | 自测记录,需注明环境与次数 | 低 | 连续30天出水8到14 ppm | 二档 | 时序自测数据,需保留原始读数 | 低 | 除菌率99.9% | 三档 | 第三方按标准方法检测报告 | 数千美元 | 比同价位机型更安静 | 三档 | 采购竞品加同条件对比测试 | 数千美元起,且可能测输 | 行业领先的净化效率 | 三档 | 全品类横向对比,实际不可完成 | 不建议写 | ## 最后那一行是故意留着的 “行业领先”这种话的问题不是贵,是根本买不到。要证明它,你得覆盖整个品类,而品类边界本身就没有定义。它不是一个高门槛的宣称,它是一个无法结算的宣称。 行业地位这类说法在指标层面同样难以结算,品牌权威度与域名权重的区别 (https://zhangwenbao.com/moz-ba-brand-authority-seo.html)那篇讲了哪些数字是可比的、哪些不是。 这类句子在页面上出现的频率极高,因为它听起来很安全——没有具体数字,好像也就不会错。实际上正相反:没有数字意味着无法证明,也意味着无法辩护。 ## 模糊反而是最不安全的写法 很多人下意识觉得,把话说虚一点风险更小。这个直觉在这套规则下是反的。可验证的具体表述,只要动作做过就站得住;不可验证的模糊表述,做多少动作都站不住。 把模糊表述换成可核对的事实,顺带还能提高被引用的概率,用事实密度提升引用率的七招 (https://zhangwenbao.com/boost-content-fact-density-ai-citations-2026.html)给了具体写法。 “40分贝”是可以被兑现的,“非常安静”看起来无害,但它同样在主张一件事,只是主张得含糊,含糊到你没法拿出任何东西来对应它。 ## 一个简单的替换练习 把页面上每一句带比较级的话,改写成一句带单位的绝对表述。这个练习通常十分钟就能做完,效果比读十页法规都直接。 “比同价位更安静”改成“夜间模式实测40分贝,20平米房间,测点距机身1米”。第二句更长、更啰嗦、听着也没那么带劲,但它是你真的能拿出来的那一句。 ## 为什么啰嗦的版本反而更有说服力 这是我没预料到的一个副产品。带条件的具体表述读起来像是有人真的做过这件事,而空泛的比较级读起来像是文案写的。买家分辨这两者的能力,比我们以为的强得多。 尤其在客单价高的品类里。一个准备花四百多美元买净水器的人,会把参数看完;对他来说“测点距机身1米”这种细节不是噪音,是一个信号,说明写这句话的人心里有数。 客单价越高,读者越吃这一套,高客单价独立站靠内容和信任取胜 (https://zhangwenbao.com/high-ticket-dtc-content-trust-geo-strategy.html)那篇拆过这类买家在下单前会看完哪些东西。 ## 规则里还有一个正面示范值得抄 第255.2条里有一个减重产品的例子,判定是不构成典型性宣称。背书人说的是:每天喝两杯代餐、只吃生蔬菜、每天健身六小时,六个月从250磅减到140磅。 规则认可它,理由是条件描述得清楚而且确实非同寻常。而同一则广告如果只说“配合饮食和运动”减了110磅,就不够了。区别只在于条件写没写具体。 ## “配合饮食和运动”是一句正确的废话 这五个字什么都没排除,任何人都可以说自己符合。“每天健身六小时”不一样,它是一道门槛,读者自己就能判断出自己过不过得去。 写清楚条件不是给自己上枷锁,是把一部分不适合的买家提前劝退。这些人本来也会退货,只是会晚三个月,而且会带着一张工单和一条差评。 把不合适的买家提前劝退,和减少结账流失是同一件事的两头,结账页放弃率超七成的九个真实成因 (https://zhangwenbao.com/dtc-checkout-abandonment-9-real-causes.html)列了另一头。 ## 门槛可以往下走,但不能往下装 必须说清楚一件事:改措辞是把宣称降到证据能撑住的那一档,不是把宣称藏起来继续暗示。规则看的是净印象,也就是普通读者读完整页之后脑子里剩下什么。 如果你把“比同类更安静”删掉,却在旁边配一张竞品打叉的对比图,那个净印象一点没变,门槛也一点没降。删词是手段,改变实际传达的意思才是目的。 ## 净印象这个概念比字面意思重要 它意味着你不能靠拆句子来规避。一段话里每句都没问题,合起来给人的印象却是“这款比别的强”,那就按“比别的强”来算账。 同理,一个数字放在一屏满是竞品参数的表格中间,即便你没写任何比较词,版式本身已经在做比较了。规则读的是整页,不是单句。 想看清整页给读者留下的印象,先得看清它的骨架,页面结构分析工具的六维体检 (https://zhangwenbao.com/structure-analyzer-html-skeleton-6-dimension-audit-guide.html)可以一次扫出层级和权重分布。 ## 那么高转化的句子就必须放弃吗 不一定。有三条路:把动作补上、把句子降级、或者换一个同样有力但便宜的角度。第三条最容易被忽略,其实往往最划算。 比如与其说“比同价位更安静”,不如说“睡眠模式下测得40分贝,相当于图书馆环境”。它没有比较任何竞品,却给了读者一个更可感的参照物,转化上不见得输。 ## 找一个不花钱的参照物是门手艺 图书馆、耳语、冰箱运行声,这些都是公共常识,不属于任何竞争对手,用起来不需要任何授权和测试。它们提供了对比感,却不产生举证义务。 这大概是整节里最实用的一条:读者要的是尺度感,不是竞品名单。给他一把尺子就够了,不必非得把邻居家的产品搬上台。 不靠对比也能立住的说法,多半来自品牌自身的叙事,出海DTC的品牌故事怎么讲才有人信 (https://zhangwenbao.com/dtc-brand-story-founder-story-narrative-system.html)给了一套叙事结构。 ## 这套换法在搜索这一侧还有个副作用 带条件的具体表述天然更长、更含实词,也更接近用户真实的搜索方式。有人搜的是“20平米空气净化器噪音多少分贝”,没有人搜“行业领先的净化效率”。 所以改措辞这件事不只是省举证成本,它顺手把页面推向了更长尾、更具体的查询。这不是我事先设计好的,是改完之后从搜索词报告里看出来的。 ## 不过别指望它能替代关键词工作 顺手拿到的长尾流量通常量不大,它的价值在于意图更明确、离下单更近。真要系统性地拿搜索流量,还是得单独做选词和页面规划,两件事不能互相替代。 我把它写出来只是想说明一点:把话说到能兑现的那一档,代价没有想象中那么纯粹,它在别的地方会还给你一部分。 ## 把这一节压成一句话 门槛由措辞决定,所以措辞是你手里唯一免费的杠杆。补动作要花钱,改句子不花钱,而两者对结果的影响是同一量级的。 接下来的问题就变成了:一个被完整记录下来的支撑动作,具体长什么样。这个问题不该靠想象回答,正好有一份公开材料可以当尺子用。 ## 一个百分比背后的动作,能不能真的数出来? 前三节都在讲规则要求什么。这一节换个方向:找一份把支撑动作完整披露出来的材料,看看它到底长什么样、有多厚、厚在哪里。 我用的样本是皮尤《美国人与人工智能2026》第187波调查 (https://www.pewresearch.org/internet/2026/06/17/americans-and-ai-2026-chatbots-smart-devices-and-views-on-impact/),2026年2月17日至23日执行,5119人,误差正负1.6个点。问卷全文公开,17页,谁都能下载。 ## 为什么拿一份民调问卷当尺子 因为它和落地页做的是同一件事:把一句话变成一个数字,然后请别人相信这个数字。区别只在于,一方把过程完整摊开了,另一方通常一个字都不留。 可验证的出处正在变成一种新的资产,内容溯源与C2PA正成为新的信任货币 (https://zhangwenbao.com/content-provenance-c2pa-trust-currency-geo.html)讲的是这套机制会怎么落到内容生产上。 我不是要独立站按民调标准做事,那不现实也没必要。我要的是一把尺子——知道“完整”长什么样,才知道自己现在离它有多远,以及远出来的那部分意味着什么。 找一把外部尺子来量自己,是最快的定位办法,三平台加三百站的收录速度实测 (https://zhangwenbao.com/seo-kpi-guide.html)那篇用的也是这个思路。 ## 先看总量:34个单元,269条编程指令 这份问卷里有20道单题、7道矩阵题,另有7段专门写给程序的跨题指令,一共34个单元。所有单元里带方括号的编程注记加起来是269条。 平均下来每道题背后差不多10条指令。这些指令没有一条是给受访者看的,也没有一条会出现在报告里,它们的唯一读者是执行这份问卷的系统和访员。 预算有限时先把免费的那一层用足,预算为零也能做好SEO的工具清单 (https://zhangwenbao.com/free-seo-tools-zero-budget-checklist.html)挑的都是能长期用下去的那几款。 ## 指令分布极不均匀,最多的那道有23条 问“你用过下列哪些聊天机器人”的那道矩阵题有23条指令,最少的几道单题只有6条,相差3.83倍。指令多的都是选项多、有分支、有随机化的题。 这个不均匀本身就说明问题:支撑动作的重量不是按题目数量分摊的,是按结论复杂度分摊的。你想说的话越细,背后要压的东西就越多。 结论越复杂,抽样口径越要写清楚,孤岛页面检测的抽样口径决定你看到什么 (https://zhangwenbao.com/orphan-page-finder-sitemap-sampling-internal-link-audit-guide.html)那篇是一次很典型的示范。 ## 最扎眼的一组数:42次不要念,32次要念 这份问卷同时有网页版和电话版。电话版里,写着“念出选项列表”的指令出现32次,而写着“不要念出来”的指令出现42次。不要念的比要念的还多10次。 我第一次数出这个结果的时候愣了一下。一份问卷,居然有更多篇幅在指示访员什么不该说出口。 ## 被藏起来的那42次,是同两个选项 顺着数下去:整份问卷里“说不准”这个选项出现15次,“拒答”出现27次,加起来正好42。和“不要念出来”的次数一个不差。 也就是说,每一个“说不准”和每一个“拒答”,都被明确标注为不要主动读给受访者听,一次不落。这不是疏漏,这是一个被贯彻到底的设计决定。 > 同一个“说不准”,在网页版是屏幕上一个可以点的按钮,在电话版是一个访员被要求不要念出来的隐藏项。它在数据文件里是同一个编码,可得性却完全不同。 ## 这个细节为什么值钱 因为它意味着“说不准”的比例,一部分是态度,一部分是通道。你如果拿一份网页问卷的“说不准”比例去和一份电话问卷比,比的其实不完全是同一件事。 同一条曲线上口径变过几次这种事极难察觉,一条五年趋势线上的三处口径变更 (https://zhangwenbao.com/trend-line-break-in-series-comparability.html)是一次完整的排查复盘。 而这个信息在报告正文里是找不到的。它只存在于问卷文件里,藏在一行括号中间。这就是我说的:举证材料的特征是平时没人看,但它必须在。 ## 电话版的指令比网页版多36.7% 继续数:标着“如果是网页版”的指令有98条,标着“如果是电话版”的有134条,后者是前者的1.367倍。 多出来的部分几乎全是在告诉访员怎么开口——先念什么、后念什么、什么时候可以重复、哪句话只在必要时才念。网页版不需要这些,因为屏幕自己会把选项摆整齐。 界面替用户省掉的动作往往也改变了他的答案,独立站搜索框怎么设计才不浪费入口 (https://zhangwenbao.com/site-search-bar-ux-design-conversion.html)那篇拆过四层交互的影响。 ## 有8个词专门标了发音 这是我最喜欢的一处细节。问卷里给电话访员标了8个词的读法,一共出现14次,因为有些词在不同题里重复出现。 标出来的是这几个:Eufy读作YOU-fee,Roomba读作ROOM-buh,ChatGPT读作Chat G-P-T,Gemini读作JEM-uh-nye,Claude读作klaw-d,Meta AI读作MEH-tuh A-I,Character.ai读作Character dot A-I,Grok读作GRAHK。 ## 为了让一个品牌名被念对,写了一行注音 这行注音不会进报告,不会进数据文件,不会被任何读者看到。它存在的唯一理由是:如果访员把品牌名念错,受访者可能听不出来那是什么,答案就不是对这个品牌的答案了。 把这件事和落地页对照一下会有点刺痛。我们连一句“比同类更安静”背后有没有测过都不确定,人家为了一个词的读音专门写了一行。 细节到什么程度算够,在小语种市场有另一套答案,落地页上最像装饰的那几个信任元素 (https://zhangwenbao.com/minor-language-landing-page-trust-signals-payment-address-support.html)给了具体清单。 ## 15处指令要求把随机顺序写回数据文件 问卷里还有一类指令,写的是把这次的轮换或随机顺序记录进数据文件。这类指令出现15次。 它的意思是:不但要随机,还要留下这次到底随机成了什么样。这样任何人拿到数据之后,都可以回过头检查顺序有没有影响答案。这是标准的留痕动作——做过还不够,得能证明做过。 ## 还有一次把品牌拆成了两组问 7个聊天机器人里,ChatGPT问了全部样本,另外6个被拆成两组:一半人被问Claude、Copilot、Character.ai,另一半被问Gemini、Meta AI、Grok。 这么做是为了不让问卷太长。代价是那6个品牌的样本量只有一半,误差更大。这是一个有取舍的决定,而这个取舍被写在问卷里,任何人都能看见并据此调整自己的解读。 取舍写不写下来,直接决定别人会不会误读你的数,GA4核心指标解析的四个错误 (https://zhangwenbao.com/google-analytics-metrics-misuse-guide.html)列的全是这类误读。 指令类型 | 次数 | 它在保护什么 | 编程注记总量 | 269 | 整份问卷的执行一致性 | 电话版专属指令 | 134 | 访员开口时的措辞统一 | 网页版专属指令 | 98 | 屏幕呈现的统一 | 标注不要念出来 | 42 | 不诱导受访者选中间项 | 标注念出选项列表 | 32 | 确保选项被完整听到 | 记录随机顺序进数据文件 | 15 | 事后可核查顺序效应 | 发音注记 | 14 | 品牌名被听清 | ## 现在看公开摘要里剩下多少 皮尤同时发布了一份结果摘要文件,14页,里面也保留了一部分编程注记,一共20条。相对问卷里的269条,保留比例是7.43%。 换句话说,92.57%的执行细节不在那份被大家引用的文件里。它们在另一份文件里——一份存在、可下载、但几乎没有人打开的文件里。 ## 而83页的报告正文里,一条都没有 报告本身是83页,写的是结论、图表和解读。那269条指令在报告正文里一条也没出现,一次也没有被提及。 这才是正常的。举证材料不该挤进结论里,它该待在旁边,等着被需要的时候拿出来。问题从来不是“为什么不写进正文”,而是“它到底存不存在”。 把支撑材料整理成可被检索的定义页是个好去处,术语库定义页怎么搭才被AI引用 (https://zhangwenbao.com/glossary-definition-hub-topical-authority-ai-citation.html)给了一套组织办法。 > 支撑动作不需要被展示,只需要被保存。分不清这两件事的团队,通常会把该保存的丢掉,把不该展示的贴满首屏。 ## 顺手看一个这份问卷问出来的数 那道问“你认为人工智能推进的速度如何”的题,结果是:63%认为太快,2%认为太慢,19%认为差不多正好,16%说不准。 太快和太慢之间差了31.5倍。这个比例极端到几乎不像民调结果——在多数议题上,两个相反方向的比例通常在同一量级上。 ## 这个31.5倍怎么读才安全 先按前面那三问过一遍:它问的是受访者自己的判断,不涉及比较级,样本和误差都写明了。三问都过得去,这个数可以用。 但可以用不等于可以随便用。它说的是公众的感受,不是行业的实际速度——没有任何一个受访者做过任何测量。他们的判断和我们文案里那句“更安静”一样,都是没有动作支撑的表述,区别只在于皮尤如实地把它标成了“公众看法”。 ## 把感受标成感受,就不欠动作了 这是一条很实用的出路。同样一句没有测量支撑的话,写成“我们认为”“用户反馈中最常提到的是”,和写成“实测证明”,欠的东西完全不同。 前者主张的是一个态度的存在,后者主张的是一个事实的成立。态度的存在只需要如实转述,事实的成立需要一整套动作。很多页面上的麻烦,就是把前者写成了后者。 ## 回到独立站,这把尺子怎么用 不是让你写269条指令。是让你在页面上每一句可验证的话背后,至少存下一样东西:一份报告编号、一段自测记录、一个日期、一个操作人。 存的东西可以很轻。轻到一张表格、一行备注、一个共享盘里的文件夹。重要的不是形式,是它在句子上线之前就已经存在了,而不是被问起时才开始找。 ## 被问起时才开始找,通常就找不到了 这是我在两个团队里都见过的场景。有人问某句话的依据,负责人说“应该有的,我找找”,然后是三天的翻聊天记录、翻邮件、问离职同事。 最后往往能找到一点碎片,但碎片证明不了完整性。而完整性正是第255.3条第三个条件要的东西——不是你做过一点,是你做的量够不够撑住这句话。 ## 存的时候有个小技巧 把依据和句子存在一起,不要分开存。常见做法是文案在一个文档里、检测报告在共享盘里、自测记录在某个人的表格里,三样东西谁也不认识谁。 我现在的做法是每句需要依据的话后面直接跟一个链接或者文件名。丑是丑了点,但它保证了一件事:句子被复制到哪里,依据就跟到哪里。 ## 皮尤那份问卷最值得抄的其实是一件小事 不是它做得多细,是它把细节和结论放在了两个文件里,各自完整。结论文件干净好读,执行文件枯燥但齐全,两份都公开,互不干扰。 独立站完全可以照这个思路来:页面上写人话,依据放在一个可点开的位置。读者九成九不会点,但那一成里可能有一个是平台审核,也可能有一个是准备下大单的客户。 从被看见走到被信任成交,中间这段路最容易断,B2B做出可见度却不来询盘的全链路路径 (https://zhangwenbao.com/b2b-geo-full-funnel-conversion-path.html)拆得比较细。 ## 粉丝数和播放量,为什么一项都不算你的动作? 选红人的时候,大家看的是订阅数、平均播放、互动率。这些数字很硬,能进表格,能做对比,能拿去跟老板汇报。它们看起来是这一行里最接近“证据”的东西。 好看却驱动不了生意的数字有个统称,砍掉虚荣指标定准北极星指标 (https://zhangwenbao.com/vanity-metrics-north-star-omtm-ecommerce.html)那篇讲了怎么把它们从周报里请出去。 美国联邦贸易委员会2024年那部关于消费者评价与证言的规则,正好给这类数字下过定义。读完那条定义之后,我看这几个指标的眼光变了。 ## 规则先把这类指标列了个清单 第465.1条的定义部分说:社交媒体影响力指标,指的是公众用来评估一个个人或实体社交媒体影响力的任何度量,例如关注者、好友、连接、订阅者、观看、播放、点赞、收藏、分享、转发和评论。 数一下,一共11项。这个清单写得很宽,用的是“例如”,意味着它不封闭,任何被公众拿来判断影响力的数字都算。 社媒那一堆数字该怎么分层看,把社媒指标拆成四层漏斗 (https://zhangwenbao.com/social-media-metrics-funnel-vanity-vs-business.html)给了一个能直接对上生意的拆法,比单看总量有用。 ## 把这11项分三类,会发现一件事 第一类是名单类:关注者、好友、连接、订阅者,4项,记的是有多少人把他加进了某个列表。第二类是曝光类:观看、播放,2项,记的是内容被送到了多少块屏幕上。 第三类是反应类:点赞、收藏、分享、转发、评论,5项,记的是别人看完之后做了什么。三类加起来11项,一项不漏。 ## 11项里,没有一项记录他本人做了什么 这就是那件事。名单类记的是别人的关注行为,曝光类记的是平台的分发行为,反应类记的是别人的互动行为。这个人本身在这11个数字里是缺席的。 素人体验官这条路上同样要回答这个问题,把素人体验官铺成真实口碑矩阵的SOP (https://zhangwenbao.com/dtc-koc-seeding-operations-overseas.html)讲了怎么保证内容真的来自使用。 他有没有拆过这台机器、测过几次、用的什么设备、测了多久,11项里一格都没有。而我们挑人的时候,恰恰是拿这11项当筛选依据的。 换个角度看选人这件事,出海独立站红人营销的选人谈合作与衡量 (https://zhangwenbao.com/dtc-influencer-marketing-operations-vetting-brief-roi.html)那篇把整条流程拆开过一遍,可以对照着补。 > 影响力指标记录的是世界对他做了什么,不是他对产品做了什么。用前者去推断后者,中间那一步从来没人补过。 ## 规则给“假”下的定义更有意思 紧接着一条写的是什么叫虚假影响力指标:由机器人生成的、由并不对应某个真实个人的所谓个人账号产生的、未经本人同意使用其个人信息创建的账号产生的、或者被劫持账号产生的。 然后是一句兜底:或者以其他方式并不反映一个真实个人或实体的活动、意见、发现或经历的指标。 ## 四个词把“真”定义成了动作 活动、意见、发现、经历——注意这四个词全都是过程类的名词,没有一个是身份类的。规则没有说“真指标就是数字准确的指标”,它说真指标是背后有一个真人做过事的指标。 这跟第255.3条对专家的要求是同一条思路。一个是问专家做过什么检验,一个是问这个数字背后有没有人做过什么,两条规则在不同章节里得出了同一个判据。 评价系统里对应的动作是验证购买,产品评论怎么配置审核和防刷 (https://zhangwenbao.com/woocommerce-product-reviews-verified-owner-moderation-spam-rating-schema-operations.html)那篇讲了具体怎么配。 ## “不反映真实活动”这一句的射程比想象中远 严格按字面读,它不只覆盖机器刷的粉。一个真人账号,如果它的关注行为是被批量任务驱动的、如果它的点赞是为了完成某个签到、如果它压根没看内容,那也谈不上反映了这个人的活动或意见。 我不打算把这条读得太激进,因为执法实践主要还是打机器和劫持账号。但作为一条自查判据它很好用:这个数字背后,有没有一个人真的把内容看完了。 把用户内容做成资产的前提也是这一条,UGC怎么做成会排名的内容资产 (https://zhangwenbao.com/ugc-user-generated-content-seo-asset-strategy.html)那篇整理了从征集到复用的完整路径。 ## 禁止条款本身只有两句 第465.8条很短。一是不得出售或散布明知或应当知道是虚假的影响力指标,且这些指标可被个人或企业用于就商业目的实质性地虚报其影响力或重要性。 二是不得购买或取得明知或应当知道是虚假的、且实质性虚报其影响力或重要性的影响力指标。卖方买方两头都堵住了。 ## “应当知道”这四个字是最终规则才加上的 这一点很值得说。规则提案阶段没有这个限定,是在收到评论之后加的。委员会在消费者评价与推荐交易规则最终文本 (https://www.federalregister.gov/documents/2024/08/22/2024-18519/trade-regulation-rule-on-the-use-of-consumer-reviews-and-testimonials)里给了两个具体理由。 第一个理由是:一家公司可能雇了一位恰好拥有虚假关注者的红人。第二个理由是:一家公司可能授予了一个正当的影响力标志,比如某种徽章,而它并不知道这个标志是基于虚假指标算出来的。 ## 加限定的目的是免责,效果却是加义务 表面上看,“明知或应当知道”是在给不知情的人留活路。实际读下来,它把一个结果义务变成了一个动作义务。 因为“应当知道”不是一个状态,是一个标准。要主张自己不应当知道,你得说得出你做过什么——查过什么、看过什么数据、问过什么问题。什么都没做,就没法主张自己不应当知道。 合规底座越早搭,需要临时补的动作越少,Stripe Atlas注册美国公司的八步流程 (https://zhangwenbao.com/dtc-stripe-atlas-us-llc-complete-guide.html)是这一层最基础的一块。 ## 规则不要求你成功,要求你做过 这句话我想单独放一行。你没能识破一份伪造的粉丝数据,不必然有问题;你从来没想过要看一眼,那就是另一回事了。 这和第255.3条的结构完全一样:那一条也不要求专家的结论必须正确,只要求他做过与其宣称专业度相称的检验。规则始终在问过程,不在问结果。 ## 还有一个概念也是最终规则才加的 委员会同时新增了“散布虚假影响力指标”的定义:把虚假指标散布给那些可能利用它们虚报影响力的个人或企业。 说明文件里写得很清楚,加这个定义的意图,是覆盖那些通过雇用碰巧拥有虚假关注者的红人而对社交媒体造成利用的情形。也就是说,链条上游的人也进了射程。 长期合作关系里这条尤其要留心,把忠实用户养成长期代言人的运营体系 (https://zhangwenbao.com/dtc-brand-ambassador-program-advocacy-operations.html)给了一套让关系可持续的做法。 ## “取得”被故意留成了普通含义 有评论者建议把“购买或取得”定义得更窄,限定成用金钱、商品或者另一个影响力指标去交换虚假指标。委员会拒绝了。 理由是这样会不必要地把规则覆盖的行为窄化成一种交换。委员会说,“取得”就取它的日常含义,也就是获得某物;任何为了获得虚假指标而进行的价值交换,都属于取得。 ## 换成人话,就是别指望在形式上绕开 不是花钱买才算。互推、置换、赠品、佣金、把流量导过去,只要是为了拿到那个数字而付出了任何东西,都在里面。 这个处理方式我很欣赏,因为它跟前面讲的净印象是同一种立法思路:不看你用了什么形式,看实际发生了什么。 同意管理那一块也是看实际效果不看形式,同意横幅怎么配才不毁数据的出海合规架构 (https://zhangwenbao.com/seo-legal-compliance-gdpr-ccpa-consent-mode-cross-border-architecture.html)讲的是同一种判定逻辑。 你在看的东西 | 它实际记录的是 | 它没有记录的是 | 订阅数、关注数 | 多少人把他加进了列表 | 他有没有用过这个产品 | 播放量、观看数 | 平台分发了多少次 | 有多少人真的看完 | 点赞、收藏、转发 | 别人看完之后的反应 | 他为这条内容做过什么 | 互动率 | 上面两类数字的比值 | 比值两端是不是真人 | 历史合作品牌数 | 有多少家找过他 | 那些合作有没有出过问题 | ## 同一部规则里还有一条相邻的定义 规则第465.1条还定义了什么叫购买消费者评价:提供有价值的东西以换取一条消费者评价,例如金钱、礼品卡、产品、服务、折扣、优惠券、抽奖资格,或者另一条评价。 最后那四个字值得多看一眼。用一条评价换一条评价,也算购买。互评、置换、社群里的互相捧场,在定义上跟直接给钱是同一件事。 ## 为什么这条定义要写得这么宽 因为它盯的不是钱,是对价。只要存在一个交换关系,那条评价就不再是纯粹的使用体验表达,它至少有一部分动机来自这笔交换。 这和影响力指标那条是同一个思路:规则不去追究数字准不准,它追究这个数字背后那个人的行为是不是被别的东西驱动的。驱动来源变了,这个数记录的东西就变了。 ## 平台徽章也逃不出这个框 认证标、优质创作者标识、年度榜单入围,这些东西在读者眼里和粉丝数是同一类信号。规则给影响力指标的定义用了“例如”,也就是说清单是开放的。 更麻烦的是徽章往往是复合的:它可能同时基于活跃度、粉丝规模和历史合作数量。如果其中任何一项掺了水,这枚徽章就成了一个不知道自己在说什么的标志。 ## 互动率这个指标还有一个自己的毛病 互动率是分子除以分母,而两端通常来自不同的统计口径。分子是点赞评论转发的加总,分母有时是粉丝数、有时是播放量、有时是触达数,不同平台不一样。 拿两个平台的互动率直接比大小,很多时候比的是两套算法。这不是造假问题,是口径问题,而口径这件事和支撑动作是两条独立的轴,得分开查。 ## 把影响力指标换成动作指标 如果非要给合作对象打分,可以试着换一组问题:他在这个品类里有多长时间的实际使用记录,他有没有固定的测量方法,他有没有公开过失败的测评。 最后一项特别有区分度。愿意发布“这台我不推荐”的人,说明他的结论确实是从动作里长出来的,而不是从合作关系里长出来的。这一条不需要任何数据支持,翻一遍他的历史内容就看得出来。 看一个人在社区里怎么说话,比看他的数据面板有信息量,二十种不像广告的Reddit回复策略 (https://zhangwenbao.com/reddit-comment-frameworks-brand-visibility-ai-seo.html)给了参照。 ## 还有一个信号比数据面板更早出现 看他接不接得住追问。你问一句他是怎么测的,如果对方能立刻说出方法、次数和当时的条件,那这件事他真做过;如果回答绕回到经验和感觉上,答案其实已经给了。 ## 那到底该看什么 把这张表的右列反过来,就是筛人时真正该问的东西。他用过这个品类的产品吗,用了多久。他有没有自己的测量方法,是什么。他愿不愿意把没剪过的素材给你一份。 最后一条是我现在最看重的。愿意给原始素材的人,和只交成片的人,是两种完全不同的合作对象——不是诚信差别,是工作方式差别。 ## 成片里看不出动作,因为剪辑本身就是一次挑选 一条五分钟的视频背后可能有三小时素材。哪一段进了成片,是根据节奏和观感挑的,不是根据证据完整性挑的。挑选这个动作是中性的,但它的结果不能当证据用。 原始素材不一样。素材里能看到他手里那支笔是什么型号、测了几次、每次读数是多少、中间有没有重来。前四类材料记录的都是结果或者身份,只有素材记录的是过程。 开箱内容天然带着过程感,把开箱做成复购与口碑的杠杆 (https://zhangwenbao.com/dtc-packaging-unboxing-experience-retention-ugc.html)那篇讲了怎么让这段过程被完整拍下来并用起来。 ## 顺带说一个容易被忽略的连带责任 规则把卖方和买方都写进了禁止条款,而中间那一层——帮你选人、帮你谈价、帮你结算的服务商——同样可能落进“散布”那一条。他们把人推荐给你,也就把那些指标一并递了过来。 所以合作合同里值得加一句很轻的话:若因合作方影响力指标不实导致投放被拒或被追责,双方如何分担。写不写得进去是另一回事,提出来这件事本身就会让对方多说几句实话。 ## 这就是我在净水器那一跤里最后找回来的东西 那件事我用了三个月才想明白问题出在哪,而真正让我看清的不是任何一份报表,是一段没剪过的录屏。下一节完整讲这件事。 先把这一节的结论留下:影响力指标不是证据,它是一层包装;包装可以真也可以假,但即便它百分之百是真的,它也没有回答我们真正要问的那个问题。 ## 那台卖了1900单的净水器,问题出在哪一句话上? 这一节讲我自己的事。做的是净水与空气净化设备的跨境独立站,主要打北美和澳洲,客单价从150美元到900美元,团队十几个人。 选这个品类做例子不是随手挑的。买净水器的人没法自己验证水质,买净化器的人也看不见空气里的颗粒物,他们只能信页面上写的和别人说的——这是标识和动作最容易脱节的地方。 选品阶段就能把这类风险筛掉一部分,DTC选品三角验证的九十天框架 (https://zhangwenbao.com/dtc-product-research-3-triangulation-seo-amazon-review-small-budget-test.html)给了三条互相印证的路径。 ## 出事的是一款429美元的台上式反渗透净水器 新品上线,我们找了一位家装测评方向的视频博主合作,他有18万订阅,做这类内容五六年,人靠谱,选题也认真。 视频里他说了一句话:我做水质检测十年了,这台是我测过出水最稳的。这句话在剪辑里被单独拎出来做了字幕卡,也被我们截图放进了产品页。 ## 数据一开始好得没有任何可疑之处 视频跑得很好,三个月带来1900单。产品页转化率3.1%,是那一季所有新品里最高的。团队士气很足,还讨论过要不要追加预算做第二支。 新品节奏一旦跑顺,很容易顺势加码,从蓄水预售到发售复盘的新品GTM框架 (https://zhangwenbao.com/dtc-new-product-launch-gtm-prelaunch-presale-playbook.html)把每个阶段该看什么写清楚了。 同期退货47单,退货率2.47%。而我们全站同期的平均退货率是3.9%。也就是说这批退货在报表上是一个好数字,比平均还低。 看着正常的数字最难查,增量测试怎么做才不让本来就会买的人冒领功劳 (https://zhangwenbao.com/incrementality-testing-marketing-measurement-guide.html)那篇讲的是另一种被平均掩盖掉的失真。 > 它三个月没被发现的全部原因,是它在报表上长得像一个成绩。异常如果表现为一个偏好的数值,任何监控都不会响。 ## 第一次复盘得出了一个所有人都能接受的结论 退货理由栏里有个高频词组:数字对不上。运营把这批工单翻了一遍,认为是滤芯批次不稳定,出水指标飘。这个解释很合理,也有人愿意为它负责。 于是我们换了滤芯供应商,采购单价从26美元涨到28.08美元,涨了8%。按1900台算,这个决定的成本是3952美元。 ## 换完之后几乎没变化 下一批的同类退货从47单降到44单。降了3单,落在任何一个季度的正常波动里。当时的解释是新供应商还需要磨合。 现在回头看,这3单大概率就是噪声。我们花了3952美元买到的东西是零,而且这笔钱花出去之后,大家反而更确信问题已经被处理了。 排除法用错方向的代价往往就是这样,三个问题看清真实搜索表现 (https://zhangwenbao.com/search-performance-presence-interpretation-momentum.html)给了一组能拦住错误结论的追问。 ## 破局的人跟这件事完全无关 是一位刚入职的合规同事,她的任务是给澳洲站做广告审查,跟净水器复盘没有任何关系。她在通读第255.3条的时候读到了第一个例子——那个化学工程师给汽车背书的例子。 她当时提的问题不是“这句话合不合规”,而是一个更笨的问题:我们知道他到底测了什么吗。 最笨的那个问题常常最值钱,调研数据里没有一个非会员 (https://zhangwenbao.com/survey-data-eligibility-criteria-conclusion-boundary.html)记的就是一次靠追问筛选条件才翻出来的错。 ## 这个问题没有人答得上来 我们知道他做水质检测十年了,知道他有设备,知道他拍过很多期同类内容。这些都是身份信息。至于这一次他测了什么项目、测了几次、什么时候测的,没人知道,也没人问过。 合作邮件里有的是拍摄排期、发布时间、结算方式和素材规格。整条链路上没有任何一个环节要求他说明依据,因为这条链路是按内容生产设计的,不是按举证设计的。 跨部门协作的缝隙可以靠动作账本补上,客服与SEO协作的七动作账本 (https://zhangwenbao.com/customer-service-seo-collaboration-7-actions-tickets-help-center.html)那篇给了一份从工单出发的接口清单。 ## 问过之后的答案很干脆 他测了TDS,也就是溶解性总固体,用的是常见的笔式测试仪。他确实测了,而且测得很认真——开箱之后连续测了一段时间,读数记在一个本子上。 问题在于,TDS测的是水里溶解物质的总量。而这台反渗透净水器在产品页上的核心宣称是除菌率和重金属去除率。这两件事之间没有对应关系。 ## 他没撒谎,我们也没造假 这是整件事最难受的地方。博主真的做了检验,动作是实打实的;我们真的卖了一台反渗透净水器,产品也是合格的;那句话里每个词单独看都站得住。 可它把两件事焊在了一起:一个真实发生过的TDS测量,和一句关于净水性能的整体判断。第255.3条第二个条件说的正是这个——检验必须针对广告所宣称的那些特性。 ## 那47张工单其实一直在说这件事 买家写“数字对不上”,指的是他们买了TDS笔,按视频里的方法测了自家的出水,读数和视频里不一样。 他们在复现的,是博主真做过的那个动作。而他们期待验证的,是我们宣称的那件事。两边都很诚实,中间那句话把不该连的地方连上了。 另一类常见的错连是主语被换掉,用户调研换一个主语答案就差十六个点 (https://zhangwenbao.com/survey-referent-asymmetry-self-versus-society.html)讲的是同一种句子层面的偷换。 > 用户复现的是他看见的动作,不是你写下的宣称。这两者一旦不是同一件事,退货就会以一种你完全读不懂的方式出现。 ## 找依据的时候,我试过五个地方 第一个是供应商提供的检测报告。报告是真的,机构也查得到,但封面写着委托检测,送检样品由委托方提供,测的是出厂样品不是量产批次。它证明不了消费者手里那台。 第二个是包装上的认证标志。发证机构真实存在,认证也没过期,可认证范围是电气安全,跟净化性能一点关系没有。这个标志在页面上和净水效果并排放着,读者不会去区分。 把用户原话转成产品描述时最容易发生这种偷换,怎么用AI把用户评论变成产品描述 (https://zhangwenbao.com/ai-transform-reviews-into-product-descriptions.html)那篇提示过要留的口子。 ## 第三和第四个地方同样是零 第三个是竞品页面。我去看了同价位的七八家,写法比我们还满。这条路走不通,因为行业惯例在规则里不构成抗辩——大家都这么写,只说明大家都欠着。 第四个是博主的数据面板。18万订阅、平均互动率4.2%、历史合作品牌三十多个。这些数字很硬,硬得让人有安全感,可它们记录的全是别人对他做了什么,一格也没记他对这台机器做了什么。 想找一个真能预测生意的品牌指标,用品牌搜索量提前预测市场份额 (https://zhangwenbao.com/share-of-search-brand-mindshare-market-share-predictor.html)那篇给的先行指标比互动率靠谱得多。 ## 第五个地方才有东西 是他的原始拍摄素材。我开口要的时候心里没底,怕显得不信任人,结果他很爽快就给了一份网盘链接。 素材里能看见的东西,成片里一样都没有:笔的型号、每次测量的完整过程、中间重来过两次、读数写在本子上的样子、以及他测的确实只有TDS这一项。三小时素材,剪成了五分钟。 聚合数据把过程压掉之后同样会失真,三百四十万篇实测拆穿的聚合数据陷阱 (https://zhangwenbao.com/discover-headline-format-quote-question-study.html)是一次很典型的还原。 ## 剪辑本身就是一次挑选 成片里那句“我测过出水最稳的”是他真心话,也是三小时素材里最有力的一句。剪进去是内容判断,完全正当。 但内容判断的标准是好不好看,不是完不完整。所以成片能证明的只有他说过这句话,证明不了这句话背后有多少动作。想看动作,只能看没剪过的那份。 ## 接下来我们做了两件事,一件省钱一件花钱 省钱的那件是改文案。把“我测过出水最稳的”换成“我用TDS笔连续测了30天,读数区间在8到14 ppm”。前一句是比较级加最高级,后一句是动作加读数,没有一个比较词。 花钱的那件是补检测。请第三方实验室按标准方法做了除菌和重金属去除的对应项目,费用4200美元,周期六周。这个数字和之前换滤芯的3952美元几乎一样。 ## 两笔钱一样多,买到的东西完全不同 3952美元买到的是一个心安:我们采取行动了,问题处理过了。4200美元买到的是一份可以挂在页面上、可以给平台看、可以在被质疑时拿出来的东西。 如果一定要总结一句,那就是:改措辞是省钱,补动作是赚钱,而当时那两个选项的价签几乎相同,我们先选了错的那个。 止损和回本这两笔账要分开算,高转化电商网站的双轴八模块九十天打法 (https://zhangwenbao.com/high-conversion-ecommerce-cro-seo-90day-playbook.html)讲了怎么在两者之间排优先级。 ## 改完文案之后,数据先是掉了 这部分必须如实写。文案换成具体读数之后,同渠道转化率从3.1%降到2.8%,掉了9.7%。退货率从2.47%降到0.9%,降了63.6%。 把两个数放一起算净订单:每1000次播放,原来是31单减去退货,剩30.24单;改完是28单减去退货,剩27.75单。净订单反而少了8.2%。合规在这一步是纯支出。 短期支出换长期结构的场景不止这一处,独立站会员日营销的五步设计与复盘 (https://zhangwenbao.com/ecommerce-membership-day-marketing-guide.html)也是先投入后回收的一类。 阶段 | 转化率 | 退货率 | 每1000播放净订单 | 原始文案,比较级 | 3.1% | 2.47% | 30.24 | 改成具体读数 | 2.8% | 0.9% | 27.75 | 补上第三方报告 | 3.4% | 0.9% | 33.69 | ## 真正把数字扳回来的是那份报告 六周之后报告到手,我们在页面上加了一句“除菌率99.9%,第三方实验室按标准方法检测,报告编号可查”,旁边挂了个可点开的链接。 转化率回到3.4%,比最初那个用比较级的版本还高9.7%,退货率保持在0.9%。每1000次播放的净订单变成33.69,比最初高了11.4%。 ## 这个顺序值得记住 降口气是止损,补动作才是回本。只做前一半,你会得到一个更安全但更弱的页面,然后很自然地得出“合规损害转化”的结论,然后在下一次悄悄改回去。 两件事要一起排期。改文案当天就能做,补检测要六周,那就先改文案止住退货,同时把检测排进去,别让中间那六周的数据变成放弃的理由。 改版期间的数据怎么读才不误判,三十个从CTA到结账的A/B测试方案 (https://zhangwenbao.com/ab-testing-ctr-conversion-optimization.html)里有几组正好覆盖这段过渡期的坑。 ## 第二款产品,我们把顺序倒过来做 接下来是一款289美元的桌面空气净化器。这次立项会上第一件事不是写卖点,是列一张两列的表:左边写我们想说的话,右边写这句话要求什么动作、多少钱。 这张表填起来只用了四十分钟,而它改变了整个页面的结构。 页面结构一变,收口的位置也要跟着调,页脚怎么设计才是信任收口与转化的最后一关 (https://zhangwenbao.com/ecommerce-footer-design-trust-conversion.html)讲的正是这一段。 想写的话 | 要求的动作 | 报价 | 决定 | 有效去除PM2.5 | 第三方按标准方法测CADR | 1800美元 | 做 | 比同价位机型更安静 | 采购5台竞品加同条件对比测试 | 4000美元且可能测输 | 砍掉 | 适合20平米以内房间 | 由CADR换算,写明换算口径 | 零 | 做 | 用户满意度96% | 有口径的问卷,还要做典型性配平 | 钱不多,配平麻烦 | 暂缓 | ## 砍掉那一句省下4000美元,页面没变差 原本要放“更安静”的那一屏,改成了一张CADR到适用面积的换算表,把口径写在表下面。这一屏的停留时长比上一款的对应位置还长一点。 我猜原因是它给了读者一件可以自己算的事。比较级只能让人接受一个结论,换算表让人参与了一次判断,后者更容易留下印象。 让读者参与一次判断的写法很有价值,清单体文章怎么写才能拿排名又被引用 (https://zhangwenbao.com/listicle-seo-writing-rank-ai-citation.html)整理了几种能调动读者的结构。 ## 代价也是真实的:转化率低于品类均值 这款上线三个月,转化率2.2%,我们能拿到的品类参考值在2.9%左右。差了0.7个点,不算小。 接受这个差距的理由不是情怀,是另一本账:澳洲和加拿大两个站的广告账户在这一年里没有再被拒审过,而前一年被拒了6次。每一次拒审平均卡掉四到九天的投放,这笔钱没人算进转化率里。 被漏掉的成本要拉进同一张表才看得清,把各渠道花费拉进GA4算统一ROAS (https://zhangwenbao.com/ga4-import-ad-cost-data-non-google-blended-roas.html)那篇讲的就是怎么合账。 ## 回头看那件最讽刺的事 我们团队对供应商的检测报告一向很谨慎。谁送来一份报告,采购都会去官网查发证机构、查证书编号、看有效期,这套动作做了好几年,从没出过岔子。 可我们从来没有对合作博主问过一句“你测的是什么”。原因很实在:报告归采购管,博主归内容管,而内容部门的验收表上有播放量、完播率、转化率、成本,没有一栏叫依据。 验收标准里缺什么,产出里就会缺什么,让产品页客服和社媒听着像同一个人 (https://zhangwenbao.com/dtc-brand-voice-tone-of-voice-system.html)那篇补的是另一栏。 > 不是没人负责,是这件事掉在两个部门中间的缝里。缝隙不会出现在任何一张流程图上,因为每一张图都只画自己那一块。 ## 后来改了四个地方 红人合作简报里加了一页宣称清单,把视频中将会出现的每一句可验证表述列出来,后面留一格填支撑动作。文案评审加了一条:出现比较级、最高级或百分比的句子,必须挂一个可点开的依据。 检测报告入库强制填三栏:测的什么项目、样品来源、报告编号。客服工单在“性能不符”下面拆了一个子类,叫“与宣传口径不符”。 ## 第四条改动最便宜,也最管用 拆工单类目这件事,技术上就是加一个下拉选项,半小时的活。可它改变的是复盘的起点——以前47单全归在产品质量下面,所以第一次复盘的方向从一开始就偏了。 拆开之后,同类问题第一次出现3单就被看见了。类目本身就是一个因果假设,类目分错,后面所有分析都会顺着那个错误的假设往下跑。 工单分流的设计直接决定你能看见什么,DTC出海客服的多语种与四层SLA分流 (https://zhangwenbao.com/dtc-overseas-customer-service-multilingual-4-layer-sla-ticket-routing.html)给了一套分类办法。 ## 今晚就能开始的六个自查动作,先做哪一个? 下面这六件事是我按两个维度排的:拿到它要花多少成本,以及做完之后的结论能不能直接变成待办。两个维度相乘,排在前面的性价比更高。 前三件加起来不到一小时,第四件要半天,第五件半小时,第六件不花时间但难在坚持。如果今晚只有十分钟,就做第一件。 ## 第一件:把首屏句子抄进一张表,逐句问它要求过什么 打开主推产品的落地页,把首屏和第二屏的每一句话抄进表格第一列,第二列写“为了写下这句,我们做过什么”。只写动作,不写形容词。 排第一是因为它完全不需要判断力。你不需要知道任何法规,也不需要判断哪句话有风险,抄下来、逐行填,填不出来的那几行自己会跳出来。 同样的逐项对照法在技术侧也好用,结构化数据审计工具怎么扒清字段缺漏 (https://zhangwenbao.com/schema-extractor-structured-data-audit-guide.html)一次就能列出哪些格子是空的。 ## 填不出来的那几句,先别急着删 它们可能只是记录丢了,动作其实做过。所以第二列有第三种写法:既不是动作,也不是空白,而是“未记录”三个字。 留空会被下一个人默认成不重要,写“未记录”会让他停一下。这三个字的作用不是提供信息,是制造一个小小的阻力。 一个小阻力能不能真的改变结果,最好用前后测验证,加上FAQ引用涨撤掉又掉回来才叫因果 (https://zhangwenbao.com/ai-citation-split-test-causation-proof.html)给了做法。 ## 第二件:把所有比较级和最高级圈出来 五分钟就够。更好、更快、更静、更耐用、最、第一、领先、唯一、没有之一、行业级、专业级,全部圈上。 每圈一个就问一句:跟谁比的,比过吗。这一问不需要答案,问出口本身就完成了大半——因为大多数时候,问的人和被问的人同时意识到没有对照组。 要给自己找一组像样的对照,先得把品类切细,出海细分品类怎么做GEO数据洞察 (https://zhangwenbao.com/category-geo-insight-method-3d-printer-example.html)用一个具体品类完整走了一遍。 ## 圈完之后你会发现它们扎堆 比较级不是均匀分布的,它们高度集中在首屏和价格附近,也就是转化压力最大的两个位置。这不是巧合,是压力的产物。 这也解释了为什么这件事一直没被处理:动它就是动转化最好的那几句,而没有人愿意主动去碰自己团队跑得最好的模块。 跑得最好的那条通道也未必是你以为的那条,AI Mode里广告与引用是三条各走各的通道 (https://zhangwenbao.com/ai-mode-ads-citation-organic-three-channels.html)用五万词做过拆解。 ## 第三件:给每个百分比补一个括号 页面上凡是出现百分比,后面补一个括号,写清三件事:谁测的、测的什么项目、多少个样本或者多少次测量。 十五分钟。补不出来的百分比,比补不出来的形容词危险得多——因为数字自带精确感,读者会默认它背后有一套方法,而这个默认是我们给出去的,不是他自己想出来的。 数字自带的精确感该怎么被约束,从指标体系到异常诊断的SEO数据分析 (https://zhangwenbao.com/seo-data-analysis-guide.html)那篇讲了给每个指标配口径的做法。 ## 第四件:把红人合作的原始素材要一份回来 这是六件里唯一需要跨部门、唯一要花半天、也是唯一能直接产出待办清单的一件。挑近半年内合作过、且视频里出现过可验证表述的那几位。 开口的时候不用绕弯子,就说要归档一份完整素材,用于内部核对宣称依据。我担心过对方会觉得被质疑,实际反应是相反的——认真做过的人,通常挺乐意让你看见他做了多少。 愿意配合的人在冷启动阶段尤其关键,出海品牌怎么激活第一批种子用户 (https://zhangwenbao.com/overseas-brand-cold-start-seed-user-activation.html)讲的是怎么把这种关系建起来。 ## 拿到素材之后只看一件事 他实际执行的那个动作,和视频里那句话要求的动作,是不是同一件事。不是看他有没有作假,是看这两件事对不对得上。 对不上的情况远比作假常见,而且更难发现,因为双方都问心无愧。我那一跤踩的就是这个坑,从头到尾没有任何人做错事。 没人做错却出了错,纠正起来最费劲,AI说错你的品牌事实怎么从溯源到纠错 (https://zhangwenbao.com/ai-brand-fact-accuracy-correcting-wrong-answers-geo.html)给了一条完整的处理流水线。 ## 第五件:把手里的检测报告翻出来,只看两栏 不用通读报告,只看两栏:检测项目是什么,样品来源是什么。三十分钟能过完十几份。 检测项目那一栏,对照页面上的宣称看是不是同一项。样品来源那一栏,看是委托方送检还是市场抽样——这两者证明的范围差别很大,而报告封面通常写得很小。 藏在细节里的错误需要工具来兜底,一个尾逗号就能让整页结构化数据失效 (https://zhangwenbao.com/json-ld-validator-syntax-debug-guide.html)是同一类不起眼但致命的问题。 ## 为什么样品来源这一栏这么关键 委托送检证明的是“送去的那台合格”,市场抽样证明的是“卖出去的那批里抽到的合格”。前者对量产批次说明不了什么,后者才接近消费者手里的实际情况。 大部分供应链给的是前者,这很正常也不违规。问题只在于我们拿它去支撑一句关于所有产品的话,而这中间那一步没有人做过。 中间那一步缺失会怎么放大,AI搜索改写敏感性的五步测试 (https://zhangwenbao.com/ai-search-paraphrase-sensitivity-geo-test.html)用一组对照实验量过一次这种传导。 ## 第六件:给常用句式标一个门槛档位 把团队常写的二三十种句式列出来,每种标一个档:说明书能证明的、自测记录能证明的、必须第三方或对比测试的。第三节那张表可以直接拿去改。 零成本,难在坚持。它的作用不是提供信息——写文案的人心里其实清楚哪句话说得满了——而是在下笔之前让他停一下。 动作 | 耗时 | 需要谁配合 | 产出 | 首屏句子逐句问动作 | 20分钟 | 自己 | 一张有空格的表 | 圈出比较级与最高级 | 5分钟 | 自己 | 一份高风险句子清单 | 给百分比补括号 | 15分钟 | 自己 | 数字口径清单 | 要回红人原始素材 | 半天 | 内容与红人 | 可执行的整改清单 | 检测报告只看两栏 | 30分钟 | 采购 | 证据覆盖范围地图 | 句式标门槛档位 | 持续 | 全员 | 写之前的一次停顿 | ## 六件事的顺序不能随便调 前三件必须在第四件之前做完。原因很实际:你去要素材的时候,得说得出你想核对哪一句话。空着手去问,对方也不知道该给什么。 而前三件做完之后,你手里会有一份具体到句子的清单,沟通成本一下子就降下来了。这也是为什么我把耗时最短的三件排在前面——它们不只是便宜,它们是后面那件的前置条件。 ## 第五件为什么排在第四件后面 检测报告这件事看着比要素材容易,实际不是。难的不是翻报告,是翻完之后要跟采购讨论覆盖范围,而这个讨论如果没有具体句子做锚,很容易变成一场关于流程的争论。 拿着第四件带回来的整改清单去谈,对话就具体多了:这句话我们要拿这份报告去撑,它的检测项目对不对得上。对得上就归档,对不上就排期补。 ## 这六件事不需要一次做完 我建议的节奏是:第一周做前三件,第二周开口要素材,素材回来之后再动检测报告,第六件从下一次改文案开始顺手做。 一口气做完的问题是它会变成一个项目,而项目需要立项、需要排期、需要有人汇报进度。这几件事的价值恰恰在于它们小到不需要立项。 ## 做的时候有个反面教训 我第一次做的时候,把表做得太细了:每句话拆出宣称类型、风险等级、责任人、整改期限,四列变八列。结果第一次填完之后,再也没有人填第二次。 后来砍到两列——句子和动作。丑,但一直有人在填。工具的存活率跟它的完整度成反比,这条经验在别的地方也一样成立。 ## 还有一个附带发现 做完第一件之后,团队里最先受益的居然是客服。因为那张表实际上回答了“这句话到底什么意思”,而客服每天被问的正是这个。 后来我们干脆把那张表共享给了客服组。他们在回复里可以直接引用括号里的口径,回复质量上去了,来回确认的轮次也少了。这个收益我事先完全没想到。 ## 做完这六件,通常会发现什么 按我自己和后来带的两个团队的经验,首屏句子里“写不出支撑动作”的比例,第一次做完大多落在三到五成之间。这个数字听起来吓人,实际很正常。 因为绝大多数句子从来没有被这样问过。它们是在“怎么说更打动人”的框架里生产出来的,而不是在“怎么说我们兑现得了”的框架里。 ## 接下来的问题是怎么让它不反弹 一次自查很容易,三个月之后新页面上线,同样的句式又会长回来。所以真正要解决的是把这个动作挂在一个人绕不开的地方。 我试过几种挂法,流程文档没人看,审批表会被绕过,评审会容易变成走过场。这次用的是一个更轻的办法。 ## 卡点挂在文案编辑器里,靠的是余光 具体做法:在内容管理系统的文案编辑框里加一条纯前端的高亮规则。凡是句子里出现更、最、第一、领先、唯一,或者出现百分号,就把那一句的底色变成极浅的黄。 不拦截保存,不弹提示,不生成记录,不影响任何流程。它唯一做的事是让那句话在屏幕上看起来跟别的句子不太一样。 ## 为什么这样就够了 因为写文案的人心里是有数的。他不需要被告知“这句话需要依据”,他自己知道;他缺的只是在那一刻多看那句话一眼。 黄色不阻止他写,它只是让他的余光扫到。而我实际观察到的结果是,被标黄的句子里,大约三分之一会在提交之前被作者自己改掉,根本用不着别人来提。 > 挑卡点的逻辑一直是同一条:不找最该记录的地方,找那个人非去不可的地方。区别只在于用什么把他留住——有时候是审批,有时候是省事,这一次是余光。 ## 它比强制方案好在哪 强制方案的问题是会激起对抗。一旦有一个必填框挡在保存按钮前面,人们会先想办法填满它,而不是先想那句话对不对——填写行为会替代思考行为。 高亮不产生这种替代,因为它不要求任何输出。它把判断权完整留给写的人,只是把判断的时机提前了几秒钟。 把判断留给人、把验证交给流程,提示词级前后测的实验框架 (https://zhangwenbao.com/ai-search-prompt-experiment-framework.html)给了一个两边都不耽误的组织方式。 ## 它也有明显的短板 关键词匹配会误标。“更多颜色可选”会被标黄,可它根本不需要任何证据。刚上线那两周,误标率大概三成。 我们没有去优化规则,反而故意留着。因为一旦开始维护关键词表,这件事就变成了一个需要有人负责的系统,而它的全部优势就在于没有人需要负责它。 ## 高亮之外还可以加一件更轻的事 在文案文档的模板首行放一句灰字:这一页里的每句话,都会被问一次你为它做了什么。不做校验,不设必填,不生成任何记录,就是一行字待在那儿。 它和高亮的作用方向不同。高亮针对的是已经写出来的句子,这行灰字针对的是还没动笔的那一刻,两个加起来把写之前和写之后都罩住了,而两件事的实施成本加起来不到半天。 ## 如果只能做一件事,做第四件 要回原始素材那件。它成本最高,但它是唯一一件会带回来新信息的——前五件都是把已知的东西整理一遍,第四件会告诉你一些你原本不知道的事。 能带回新信息的动作值得优先排期,DTC出海网络分线的五场景实战 (https://zhangwenbao.com/dtc-overseas-network-segmentation-5-scenario-ip-isolation.html)那篇的排查思路也是先做信息量最大的。 而且它有个附带效果:跟你合作的人会知道你会看。下一次他准备内容的时候,心里的那把尺子就跟着变了,这个变化不需要写进任何合同。 ## 这套判据治不了的三件事 写到这里得把边界画清楚。一套判据最容易出问题的时候,不是它失效的时候,是它被用在它管不着的地方却看起来仍然在工作的时候。 下面四条边界,前三条是能力边界,第四条是成本边界,我把它单独列出来是因为它是唯一一条明码标价的。 ## 第一条:它只管可验证的事实性宣称 好看、舒服、有质感、我很喜欢——这些话不欠任何动作,也不该欠。要求一个人为“这个颜色我喜欢”提供检验记录,是把工具用在了不该用的地方。 判断一个来源该不该被信任,也有它自己的边界,一亿条引用数据看清的被引源榜单 (https://zhangwenbao.com/most-cited-domains-ai-search-citation-sources.html)给了一份可参照的分布。 分界还是那一句:这句话的结果能不能填进一个带单位的空格里。填得进去的欠着动作,填不进去的不欠。这条线画得清楚,团队争论会少很多。 ## 第二条:标出来不等于修好了 一句话被标黄、被列进清单、被填进表格,只说明它需要依据,不说明它是错的。很多被标出来的句子,最后查下来是有依据的,只是依据存在别人的邮箱里。 把“已识别”当成“已解决”是这类自查最常见的滑坡。清单做完之后如果没有排期把动作补上,那张清单会在三个月后变成一份新员工看不懂的历史文件。 让文档活下来的办法是把它接进决策流程,出海独立站怎么选niche市场 (https://zhangwenbao.com/niche-market-selection-ai-mode-7step-12week-decision.html)那套七步决策就是这么设计的。 ## 第三条:它管不了动作做得对不对 这是最要紧的一条,也是我亲身栽过的那个坑。三问全部通过的句子,仍然可能出问题——只要那个被执行的动作和这句话要求的动作不是同一件事。 那位博主认认真真测了十年TDS,第一问答得出来,第二问的强度也够,第三问因为原句有比较级本来该被拦下,但假如他当初说的是“我测过,出水很稳”,三问就会全过,而问题依然在。 ## 所以第一问要多问半句 补丁是这样的:第一问不能只问“他做了什么”,要问“他做的这件事,和我们宣称的那件事,是不是同一件事”。多出来的这半句成本为零,却堵住了整套方法最大的漏洞。 我把这半句加进去之后,它抓出来的问题比前面三问加起来还多。不是因为大家在骗人,是因为“测过”和“测的是这一项”在日常说话里根本不区分。 同一份材料在不同场景里被当成不同角色,同一条内容在两个AI里被派了不同角色 (https://zhangwenbao.com/ai-source-roles-brightedge-citation-study.html)那篇拆过这种错位。 ## 第四条:它有明码标价的成本 页面会变短、变闷、变得不那么有冲劲。转化率通常会掉,我实测掉了9.7%。这个数字不是普遍规律,但方向是确定的:把话说小,短期转化会跟着小。 得提前把这个降幅算进排期,也得提前说好补动作的时间表。只降口气不补动作,三个月之后一定会有人提议改回去,而那时你会发现自己没有反驳的材料。 ## 还有一类情况它完全够不着 这套判据处理的是一句话和一个动作之间的关系。它管不了这句话该不该被说——一个有完整检测报告支撑的宣称,如果强调的是一个跟用户毫无关系的指标,它依然是一句无效的话。 有依据但没人在意,和被检索却不被引用是同一种失效,先分清被检索和被引用的两套打法 (https://zhangwenbao.com/ai-citation-retrieval-content-strategy.html)讲得比较清楚。 规则里那个医院选药的例子讲的就是这个。选择依据真实、专业、有据可查,只是那个依据对买家既不相关也不可得。举证完美,沟通失败。 ## 两条轴要分开走 一条轴是“这句话有没有动作撑着”,另一条是“这句话对读者有没有用”。两条都过才是好文案,只过第一条是一句正确的废话,只过第二条是一句危险的好话。 我见过团队做完自查之后走向另一个极端:页面上全是可验证的参数,读起来像一份说明书。那也不对——把宣称改到能兑现的那一档,不等于把宣称改成参数表。 ## 口径迁移要提前讲清楚 做完这一轮,可写的话一句都不会少。变的是两件事:一部分句子后面多了一个可点开的依据,一部分比较级被换成了带单位的具体读数。 报表口径基本不受影响,唯一需要注意的是转化率的前后期不可直接比——文案换了,比的就不是同一个页面了。这一点和任何一次改版一样,不是新问题。 ## 说这件事的时候,措辞比内容更决定成败 我踩过一次很典型的钉子。当时我说的是“这句话不合规,得删”。会议接下来半小时全花在“到底违不违法”上,而这个问题在场没有一个人答得了,最后只能等法务的意见。 一句话把一个当场能解决的问题,变成了一个必须等外部判断的问题。而在等待期间,页面照旧挂着,什么都没有发生。 ## 换个说法,同一件事十分钟就过了 后来我改成这样说:这句话写的是“比同价位更安静”。我去问了一下,我们没有买过竞品做对比测试。我把它改成了“睡眠模式实测40分贝,20平米房间,测点距机身1米”,用的是我们自己那份报告里的数。你看这样行不行。 句子里没有任何评价,只有一个事实、一个动作、一个现成的替代品和一个问句。听的人不需要承认任何事情,也不需要额外做任何事——替代品已经写好了。 > 提出问题的人如果同时带着替代方案,讨论的对象就从“谁错了”变成了“这个替代品行不行”。后者五分钟能有结论,前者能开一下午。 ## 另外两条,是我这次才总结出来的 第一条:越是“第三方亲口说的”越该先查。别人说的话自带一层免责错觉,好像责任跟着话一起转移了。而规则明说广告主要为通过代言传达的表述负责,代言人自己也可能担责,两边都跑不掉。 第二条:越是跑出好数据的那句话越该查。它跑得好,正因为它说得满;而说得满恰恰是举证门槛最高的那一档。转化最高的句子和欠账最多的句子,在页面上常常是同一句。 ## 第二条为什么特别难执行 因为它要求你去质疑自己团队最漂亮的成绩。评审时大家的注意力天然落在表现差的模块上,没有人会为一个好消息要求更多证据。 操作上有个笨办法:每次复盘固定翻一次转化贡献前三的句子,不问它为什么好,只问它欠了什么。做成固定动作,就不会显得是在针对谁。 ## 这套判据会不会被用歪 会,而且我见过两种走样方式。第一种是变成挡箭牌:谁提新文案,就用三问把它挡回去,结果页面几个月一个字没改,负责的人还觉得自己在守规矩。 三问的输出应该是一个动作,不是一个否决。答不出来的句子对应的是“去补一个动作”或者“换一种说法”,从来不是“所以不能改版”。判据被当成刹车用的时候,它就不是判据了。 ## 第二种走样是往上追责 自查表一旦加上“责任人”那一列,性质就变了。大家会开始琢磨怎么把句子写得不容易被追究,而不是怎么把话说到能兑现的那一档,这两件事看起来像,方向完全相反。 我的做法是这张表永远只有两列,句子和动作,谁都可以填,谁都可以改,不记录是谁填的。信息完整度会差一点,但它能一直活着,这个交换值得。 ## 还有一种情况需要单独说 如果一句话确实有完整的支撑动作,只是资料在别人手里、暂时拿不到,那它不属于“欠账”,属于“待归档”。这两者要分开记,因为处置方式完全不同。 欠账要排期补动作,待归档只要发一封邮件。混在一起记的结果是清单显得很长很吓人,然后所有人都不想碰它,最后整张表一起烂掉。 清单能不能活下来,取决于它有没有接进日常判断,从搜索需求到趋势预测的五步选品 (https://zhangwenbao.com/fashion-ecommerce-search-demand-trend-forecasting.html)那套表就一直在被用。 ## 什么时候该请外部意见 三问只处理事实层面,它给不了法律结论。真正需要律师的场景其实不多,主要是两类:宣称涉及健康、安全或者儿童,以及你打算主动去攻击某个具名竞品。 这两类之外的日常文案,靠这三问加一张表就能处理掉绝大部分。把外部意见留给真正需要它的地方,比每句话都去问一遍更省钱,也更容易得到认真的回答。 把边界写进合同比事后争论便宜,SEO服务合同模板里的达标定义与违约责任 (https://zhangwenbao.com/seo-website-optimization-contract-model.html)给了几条可以直接抄的条款。 ## 这套东西多久该重跑一次 我的节奏是跟着产品版本走,而不是跟着日历走。改配方、换供应商、升级固件、改模具,这几件事任何一件发生,页面上跟它相关的那几句话就该重新过一遍三问。 按季度跑的问题是它跟真正的风险节点对不上。一个季度里可能什么都没改,也可能连换两次供应商,而后一种情况恰恰是最需要重跑的时候。 ## 最后说一下这篇文章自己的位置 材料立场我得先交代:联邦贸易委员会在论证自己的规则值得存在,皮尤在论证自己的方法值得被信任。规矩不变——采集得到、只需如实记录的东西可以直接拿来用,需要选口径、选分母、选情景才能得出的,必须自己重做一遍。 所以条文原文和问卷里的指令条数是照抄的,而六个例子的判定分布、42比32、7.43%、退货率与净订单的换算,全部是我自己数、自己算的。 单个项目的经验该怎么被引用,五个月十一个项目的真实复盘 (https://zhangwenbao.com/geo-china-5-months-real-pitfalls-actionable-routes.html)在开头就把样本边界交代过一次,可以对照。 > 这篇讲支撑动作的文章,自己也有一个支撑动作问题:文中所有案例数字来自一个站、一个品类、三个月,样本量是1。它们能解释机制,解释不了普遍性。请拿去当参照,别拿去当基准——那正好是本文反对的那件事。 ## 常见问题解答 ## 页面上很多话是供应商资料里抄来的,出了问题算谁的? 抄来的话一样要自己兜底。规则看的是这句话出现在谁的页面上、面向谁传达,来源在举证责任上不产生转移效果。实际操作里我建议把供应商资料当成线索而不是证据:拿到一句“除菌率99.9%”,先回头问三件事,测的是哪个项目、样品从哪来、报告编号是多少。三项齐全的可以引用,但引用时要连来源一起写出来,别让读者以为这是你自测的。三项缺一的就降级,改成“依据供应商提供的检测数据”,把归属交代清楚。最危险的做法是原样抄来当自己的话说,那等于把别人的风险接过来,还免费加了一层你的背书。 ## 跟红人签合同时加一条“需提供依据”,会不会显得不信任对方? 我一开始也担心这个,实际做下来反应跟预想的相反。认真做内容的人通常很愿意让你看见他做了多少,因为那正是他区别于同行的地方;真正会抵触的,往往是那些拿到样品就直接对着说明书念的。所以这一条还有个筛选作用。写法上别用审查口吻,写成合作简报里的一页清单就行:这支视频会出现哪些可验证的表述,每条后面留一格填你是怎么得出这个结论的。填不填得满不影响付款,但填的过程会让他自己先过一遍。另外记得把这份清单和结算流程分开,一旦跟钱挂钩,它立刻会变成一份人人都填得很漂亮的表格。 ## 我们只有一份委托检测报告,能不能用在页面上? 能用,但要写清它证明了什么。委托检测证明的是送去的那台样品在那次测试中的表现,它跟量产批次之间隔着一个没人验证过的推断。所以引用时把范围写出来,比如“依据2026年3月送检样品的第三方检测结果”,加上日期和样品口径,这句话就站得住了。真正有问题的写法是把它扩写成关于所有产品的判断,“每一台都经过检测”和“送检样品经过检测”是两句话,后者你有证据,前者你没有。如果预算允许,最划算的补强不是重测一次,是隔一段时间做一次市场抽样,一年一次就足够把范围从样品推到批次。 ## 竞品都在写“行业领先”,我们不写会不会吃亏? 短期会掉一点点击,长期未必吃亏,我实测那一次转化只掉了不到一个点,而退货率降了六成多。更要紧的是这类词根本无法结算:要证明“行业领先”,你得先定义行业边界,再覆盖边界内所有竞品,这件事做不完,所以它不是一个贵的宣称,是一个无法兑现的宣称。替代方案比想象中多。给读者一个可感的参照物往往比比较级更有效,比如把分贝数换算成“相当于图书馆环境”,把过滤精度换算成“相当于头发丝直径的多少分之一”。这类参照物属于公共常识,不牵扯任何竞争对手,用起来零成本,读者却更容易记住。 ## 一整墙的用户好评,能不能当作宣称的依据? 在转化上极其有用,在举证上等于零,这两本账不通兑。规则里那句话写得很直接:消费者代言本身不构成有资质且可靠的科学证据。原因不难理解,好评记录的是使用感受,而感受和可测量的性能之间没有换算关系,一百条“出水好喝”也推不出任何一个净化指标。更需要小心的是把好评做成数字,比如“96%的用户表示满意”。这句话一旦出现,它就从体验展示变成了一个可验证的统计结论,需要交代样本、口径和回收率,门槛反而比单纯放几条评价高得多。想用数字,就得准备数字该有的那套东西。 ## 高亮规则误标太多,要不要花时间优化关键词表? 我的建议是别优化。一旦开始维护关键词表,这件事就需要有人负责、有人评审、有人在规则改动时通知全员,而它全部的优势恰恰在于没有人需要负责它。误标三成听起来很吵,实际使用中成本极低——写文案的人扫一眼就知道“更多颜色可选”不需要依据,跳过它花不了一秒钟。真正要防的是反过来那种情况:为了减少误标而把规则收窄,结果该标的句子标不出来,工具就彻底失去意义了。宁可宽一点吵一点,也别让它变成一个需要维护的系统。同样的取舍在别处也成立,越是没人负责的工具活得越久。 ## 改完文案转化率掉了,怎么跟老板解释这件事? 别只报转化率,把退货率和净订单一起报。我那次转化掉了9.7%,看着很难受,但退货率降了63.6%,两个数放一起算每千次播放的净订单,降幅其实只有8.2%。更要紧的是把补动作的排期一起放上去。只讲降口气,这件事在报表上就是纯支出,三个月后一定有人提议改回来;把第三方检测的时间和费用一起排进去,讲的就是一个先降后升的完整方案。我那次报告出来之后,转化回到3.4%,比最初用比较级的版本还高,净订单比原来高11.4%。这个数不必然复现,但顺序是可复用的。 ## 小团队请不起第三方检测,还有别的路可以走吗? 有三条,从便宜到贵排。第一条是降级措辞,把没有第三方支撑的宣称改成自测能撑住的表述,这条零成本,而且当天就能上线。第二条是把自测做规范,固定环境、固定方法、固定次数,把原始读数存下来并在页面上写明测试条件;这撑不起“认证”这类词,但撑得起带条件的具体读数,对高客单价品类往往够用。第三条才是花钱送检,而送检也不必一次做全套,挑那句转化贡献最大的宣称先做一项。判断先做哪一项的方法很简单:把每句话的转化贡献和它的举证缺口列在一起,缺口最大又最赚钱的那一句排第一。 ## 权威参考资料 ## 刷一条假评论挣1美元,罚上限53088美元,两个数不在一个账本上 - URL:https://zhangwenbao.com/fake-review-unit-payoff-and-denominator-gap.html - 分类:DTC合规与法务 - 发布:2026-08-04 | 更新:2026-08-04 - 摘要:自主报名的问卷造假者月入约3万美元,概率面板成员月上限22美元,单份报酬却是前者的11倍。四份材料把假评论比例说成4.4%、6%、16%和47%。判断一份数据可不可信,先算在这里造假能挣多少钱。 - 关键词:用户评价,假评论,数据可信度,独立站合规 > **TLDR**:摘要:刷单那头的账是这么算的——5个机器人账号,每天完成200份问卷,每份1美元,一个月30000美元。而某家概率抽样面板的成员,单账户、月均不到2份、每份约11美元,一个月理论上限22美元。单份报酬高出11倍,总收益却低1364倍。这个倍数才决定了两份数据各自值多少信任,可它不写在任何一份方法说明里。往下依次拆四个被并排引用、分母却各不相同的比例,一条两端高中间低的隐藏率曲线,一句差一个字就违规的活动文案,以及一个模型收藏品站按评价数挑主推位、方向整个选反了的例子。 > 摘要:刷单那头的账是这么算的——5个机器人账号,每天完成200份问卷,每份1美元,一个月30000美元。而某家概率抽样面板的成员,单账户、月均不到2份、每份约11美元,一个月理论上限22美元。单份报酬高出11倍,总收益却低1364倍。这个倍数才决定了两份数据各自值多少信任,可它不写在任何一份方法说明里。往下依次拆四个被并排引用、分母却各不相同的比例,一条两端高中间低的隐藏率曲线,一句差一个字就违规的活动文案,以及一个模型收藏品站按评价数挑主推位、方向整个选反了的例子。 判断一份数据能不能用,大部分人的第一反应是去找方法说明。样本量多少,怎么抽的,误差范围写没写,什么时候采集的。这套动作没错,我自己也做了十几年。 但它有个前提:写方法说明的人和提供数据的人是同一批人,而且都想把事情做对。 这个前提在很多场合是不成立的。数据不是从天上掉下来的,它是一群具体的人一条一条填出来、写出来、点出来的。这些人当中有一部分并不关心你要拿这份数据做什么决定,他们只关心填完这一条能拿到多少钱。只要这个数字足够大,方法说明写得再漂亮,你拿到手的也是一堆按最快速度点完的选项。 ## 判断一份数据可不可信,为什么要先算钱? ## 先说清楚这套动作要替换掉什么 我不是说方法说明不用看。我是说,在打开方法说明之前,有一个问题比它更快、更硬,而且答案通常就写在页面上:提供一条数据,那个人能拿到多少钱? ## 这个问题为什么比想象中重要 因为它不是一个关于诚信的问题,是一个关于产能的问题。一个人偶尔敷衍两句,对一份几千人的调查没什么影响。真正把数据搞坏的,是那种一天能生产几百条的结构。而能不能一天生产几百条,完全由报酬和次数上限决定,跟人品没有关系。 这和样本资格条件是同一类问题的两面。一份调研里如果压根没有某一类人 (https://zhangwenbao.com/survey-data-eligibility-criteria-conclusion-boundary.html),再干净的方法也补不回来;而报酬结构管的是另一头,决定谁被吸引进来。 ## 有一家机构把这笔账当众算了一遍 2026年5月12日,皮尤研究中心发了一篇关于虚假受访者的方法问答 (https://www.pewresearch.org/short-reads/2026/05/12/qa-do-ai-and-bogus-respondents-threaten-pollings-future/),答问的是他们负责方法与创新的副总裁。这篇东西的价值不在结论,在于它罕见地把造假的收益结构摊开算给外人看。 它开头列的是三种正在同时发生的事:有公司不问真人、直接问人工智能公众会怎么想;有人用人工智能大规模伪造问卷回答;还有一类人不伪造身份,只是以最快速度点完所有题目去领报酬。三件事性质完全不同,可它们在最终那张表上留下的痕迹长得一模一样。 大部分机构谈到数据质量,给出的是一串防御措施:我们有异常检测,我们有注意力测试题,我们有答题时长过滤。这些都是事后的。而这篇问答从头到尾几乎没谈检测,它谈的全是结构——谁能进来,进来之后能做多少次,做一次值多少钱。 ## 它顺手回答了另一个更时髦的问题 同一篇问答里还谈了一件事:现在有公司干脆不问真人了,直接问人工智能“公众会怎么想”,业内管这叫硅基采样。皮尤说他们不做,理由分两层——伦理上,民调的意义就在于让真人的声音被听见;科学上,已有研究发现这类估计会把群体刻板化,代表某一派观点比代表另一派更吃力,并且会系统性地低估公众内部的分歧程度。 最后那一条尤其值得记:低估分歧,意味着模型生成的意见分布会比真实世界更整齐。而整齐恰恰是最容易被当成“数据质量好”的表象。 ## 5个账号,每天200份,每份1美元 文章里举了一个具体场景:某个人注册5个机器人账号,用它们每天完成200份问卷,每份的报酬是1美元。这样一天进账1000美元,一个月大约30000美元。这个数字不是估的,是乘出来的,你可以自己按一遍。 ## 换一套结构,同一个人只能挣22美元 同一篇文章里给了对照组:他们自己那套概率抽样面板的成员,每人只有一个账号,平均每月完成不到2份问卷,每份的报酬平均是11美元。一个用人工智能代答的人,在这套结构里一个月的理论上限是22美元。 原文在这里放了一句反问,我读到时笑了一下:一个存心骗调查机构的人,是想每月挣30000美元,还是22美元?这句话没有任何数据,但它把整个问题从“怎么识别坏人”换成了“坏人为什么要来”,而后者是能靠设计解决的。 这家机构的材料我上一次拆过另一面——同一条趋势线上藏着的三处口径变更 (https://zhangwenbao.com/trend-line-break-in-series-comparability.html)。那次讲的是数据被生产出来之后发生了什么,这次讲的是生产之前。 ## 1364倍这个数是我自己除出来的 30000除以22,等于1363.6。原文只是把两个数并排放着,让读者自己感受差距,没有给出比值。我把它除出来,是因为这个倍数才是这套判据真正的刻度——差三个数量级,意味着这两套结构面对的根本不是同一批人。 ## 把1364倍拆成三个杠杆 差距不是一个原因造成的,是三个。把它们分开看,才知道哪一个真正在起作用。 杠杆 | 自主报名式问卷 | 概率抽样面板 | 倍数 | 方向 | 每份报酬 | 1美元 | 11美元 | 11倍 | 面板更高 | 每月可完成份数 | 6000份 | 不到2份 | 3000倍 | 报名式更高 | 可持有账号数 | 5个 | 1个 | 5倍 | 报名式更高 | 月收益合成 | 30000美元 | 22美元 | 1363.6倍 | 报名式更高 | ## 三个杠杆里,只有一个方向是反的 把三个倍数合成一下:3000乘5再除以11,正好是1363.6。次数和账号数这两个杠杆一起把收益放大了15000倍,而单价那个杠杆往回拉了11倍。 ## 而单价,恰恰是所有人唯一盯着的那个 这就是我觉得这笔账最值得记的地方。付得越多越可疑,这是几乎所有人的直觉,而它在这里是反的。皮尤每份给11美元,是刷单账号那边的11倍,可它那套结构的总产出只有对方的一千三百六十四分之一。 ## 为什么次数上限比金额上限管用 因为造假是一门规模生意。一条假数据的边际收益很低,靠的是量。你把单价压到0.5美元,对方多做一倍的量就补回来了;你把次数卡死在每月2份,对方再怎么加价也没用,因为他一个月总共只能交2份。限制价格是在调节收益,限制次数是在直接砍掉产能。 ## 准入门槛做的又是另一件事 皮尤那套面板不接受自荐。他们从全美住址名单里随机抽,先寄纸质信件,被抽中的概率极小,而且没有任何途径可以让你把自己塞进去。这一条比次数上限更狠:它让造假者连第一步都迈不出去,不需要检测,也不需要事后清洗。 ## 由此得到三句判据 把上面这些收拢,判断一份数据可不可信,可以先问三句话,全部不需要打开附件: ## 第一句:提供一条,能拿到多少钱 钱可以是现金、礼品卡、优惠券、抽奖资格、积分,也可以是某种排他的权限。只要提供一条数据能换来某样有价值的东西,这条就算数。数字越大越要警惕,但真正决定性的是它和后两句的组合。 ## 第二句:同一个人最多能提供多少条 有没有上限,上限是多少,怎么执行。一个人一辈子只能提交一次,和一个人一天可以提交两百次,是两种完全不同的数据。这一句往往比第一句更有信息量,因为大多数材料压根不写。 上限和样本量是一体两面。算清楚A/B测试要多少样本才不出假胜利 (https://zhangwenbao.com/dtc-ab-test-sample-size-3-formulas.html)讲的是下限,这里问的是上限,两头都不写的数据基本没法用。 ## 第三句:想进来要先付出什么 能不能自己报名,是这一句的核心。需要被随机抽中、需要收到纸质信件、需要通过某种线下核验,都属于有准入成本;点一个社交媒体广告就能加入,属于零成本。 ## 三句话怎么判分 三问全过,可以当基准数据用;只过后两问、第一句答不上来,当线索用,别拿它支撑决策;第三句答案是“能自己报名”,那这份数据只能当行业动态读,不管它的方法说明写得多好看。 分完档还得看时效。同一份行业基准隔一年发第二次 (https://zhangwenbao.com/industry-benchmark-data-observation-date-shelf-life.html)那个例子说明,就算三问全过,一份两年前采集的数据也未必还能当基准用。 ## 30秒粗筛只需要问一句话 如果连三句都嫌多,那就留一句:我能不能自己报名参加。能,说明造假的人也能,而且他比你有动机、比你有工具、比你有时间。这一句不需要打开任何文档,通常在报名页面上就能看出来。 ## 为什么这一句比读方法说明快 方法说明是一份需要理解的文档,读懂它要求你懂抽样、懂加权、懂误差范围。而“能不能自己报名”是一个事实问题,答案只有两个字,任何人都能核对。把一个需要专业判断的问题,换成一个只需要查证的问题,这本身就是效率的来源。 这也是我一直主张先把数据分析的指标体系和异常诊断路径 (https://zhangwenbao.com/seo-data-analysis-guide.html)理顺再谈工具的原因:判断力比工具贵得多,而能被换成查证的判断最划算。 ## 核心推论:可信度不写在方法论文档里 > 这套判据背后的道理只有一句:方法论文档写的是发布方希望你相信的东西,收益结构决定的是造假者实际会怎么做。前者要读,后者要算。两者冲突的时候,永远以后者为准,因为造假者不读方法论文档。 ## 它不判断数据对不对,只判断数据值不值得查 得说清楚边界。算完这笔账,你并不知道那个百分比是高了还是低了,也不知道结论对不对。你只知道这份数据的生产环节给造假留了多大的口子,从而决定要不要花时间往下查、以及查到什么程度。这是一道分诊,不是诊断。 分诊之后要做的是分级引用,不是全盘否定。这一点和砍掉虚荣指标、定准北极星指标 (https://zhangwenbao.com/vanity-metrics-north-star-omtm-ecommerce.html)是同一种取舍:不是数据越多越好,是知道哪个数能承重。 ## 自主报名的数据也不是一概不能用 皮尤自己在同一篇问答里划了这条线,我觉得比外人来划更有说服力。他们说,如果只是测量全体成年人对某个大众话题的整体态度,比如赞不赞成某项人尽皆知的政策,自主报名式调查和概率抽样调查得到的结果可能很接近。 出问题的是两类:年轻人群体的估计,以及任何一种相对罕见的行为或身份的估计。原因不难想——罕见意味着分母里真正符合条件的人极少,只要混进几个乱填的,比例立刻被抬起来。 罕见事件对口径最敏感这一条,在别处同样成立。孤岛页面检测换一种抽样口径 (https://zhangwenbao.com/orphan-page-finder-sitemap-sampling-internal-link-audit-guide.html),结论就能翻个面,机制完全一样:分母里符合条件的东西越少,噪声占的份额越大。 ## 反过来,概率抽样也不是免死金牌 这一条同样是他们自己说的:近几年的选举里,就出现过用概率样本、但加权做错了,结果偏得离谱的例子。抽样方式只是起点,一份数据要可信,得从头到尾每一步都站得住。 所以单看一个环节永远不够。把指标拆成层、给每一层定一个唯一口径 (https://zhangwenbao.com/seo-metrics-layer-single-source-of-truth-data-governance.html)讲的也是这件事:链条上任何一环出问题,前面做得再好也扛不住。 所以这三句判据的定位要放准:它筛掉的是那些结构上就守不住的,留下来的还得继续看。通不过等于不用看了,通过了不等于可以直接用。 ## 顺手说一下这套判据是怎么来的 它不是从哪本书上学的。我做SEO和独立站这些年,看过太多次同一个场景:一份数据被质疑,讨论迅速滑向“这个机构靠不靠谱”“做这个的人专不专业”,然后不了了之。 我整理过一份转化率、排名周期这类行业基准数据 (https://zhangwenbao.com/seo-industry-benchmarks-data-reference-guide.html)。做那份东西最花时间的从来不是找数,是逐个确认每个数的采集方式——找数几分钟,确认口径一整天。 因为“靠不靠谱”是一个关于人的判断,而关于人的判断在会议室里永远吵不出结果。算钱不一样,算钱是一个所有人都能验算的动作,谁都可以拿计算器按一遍,按出来的结果一样。把一个态度问题换成一道算术题,会议就有了终点。 ## 接下来要拆三样东西 光有判据不够,得看它在真实材料上怎么走。下面依次拆三样:四份材料对同一件事给出的四个比例,一个被反复引用却不是它字面意思的数,以及一条监管条文里差一个字就换性质的红线。它们分别对应收益结构的三个位置——数据被生产出来之后、被统计出来之后、以及被写进规则之后。 ## 同一件事,为什么会被报成4.4%、6%、16%和47%? ## 四个数并排出现在同一个脚注里 美国联邦贸易委员会2024年8月发布的消费者评价与推荐规则,正式文本只有九节,但配套的最终规则说明有163页 (https://www.ftc.gov/system/files/ftc_gov/pdf/r311003consumerreviewstestimonialsfinalrulefrn.pdf)。在讨论假评价到底有多普遍时,它在一个脚注里一口气列了四个来源,并且诚实地写了一句:各来源的定量估计差别很大。 ## 为什么一个脚注值得花这么大篇幅拆 因为这是极少见的一种材料形态:四个互相矛盾的数字,被一个中立的第三方原样并排放在了同一个位置上。平时你遇到的是散落在各处的单个数字,各自被各自的作者当成定论引用,永远碰不到面。 它们碰面了,矛盾才暴露出来。而更值得琢磨的是:把它们放在一起的那个机构,最后一个都没用。这个动作本身就是一句评语,只是它没有写成句子。 ## 先把四个数原样摆出来 猫途鹰2023年的评价透明度报告说,提交的评价里有4.4%是欺诈性的。信任飞行员的2024年透明度报告说,它的软件删掉了6%的评价,理由是假。Yelp的2023年信任与安全报告,被引用为16%的提交评价被软件标记为“不推荐”。第四个来自一篇工作论文,说Yelp上被隐藏的、很可能是假的评价,比例高达47%。 脚注在列完这四条之后还补了一句:这些估计从个位数到二十以上不等。写这句话的人显然知道四个数对不上,只是没有说明白为什么对不上。而“为什么对不上”,恰恰是这四个数唯一有用的那部分信息。 分母这件事在别的场合也一样折腾人。商品列表页上那个每千克价格 (https://zhangwenbao.com/unit-price-denominator-eu-rules-product-list.html)之所以难做,就是因为它是整页唯一一个需要现场选分母的数字,选错了不报错,只是算出来不对。 ## 极差42.6个百分点,最大是最小的10.68倍 这两个数是我自己算的,原脚注只是把四个数并排列出。同一个国家、同一个年份、同一类平台、同一件事,四份材料给出的答案相差十倍以上。如果这是一次温度测量,四支温度计报出的是零下三度和三十度。 ## 差十倍的时候,通常不是谁算错了 这里有一条我用了很多年的经验:当一个领域里的估计值相差十倍以上,多半不是谁算错了,而是他们数的根本不是同一样东西。算错通常差百分之几十,差一个数量级往往是定义问题。 同样的道理适用于分析工具。GA4核心指标最常见的几个误读 (https://zhangwenbao.com/google-analytics-metrics-misuse-guide.html)里,有一半根本不是读错了数,是把两个定义不同的字段当成了同一件事。 这条经验在别处也灵。同一个词的月搜索量,三个工具给出三个数、彼此差好几倍,绝大多数时候不是谁的爬虫坏了,是它们对“一次搜索”的计法不一样——含不含拼写变体、含不含移动端、含不含零点击。差得越离谱,越该先去看定义而不是先去挑哪个数好看。 ## 把四个分母逐个挖出来 挖的办法很笨,就是顺着脚注给的链接一个个打开,找到那句话原本的上下文。挖完之后是这样: 报出的数 | 分子是什么 | 分母是什么 | 这个动作可不可逆 | 4.4% | 被判定为欺诈的提交 | 当年全部评价提交量 | 不可逆,拒收 | 6% | 被软件识别并删除的评价 | 当年全部收到的评价 | 不可逆,已删除 | 16% | 被标记为“不推荐”的评价 | 当年全部提交的评价 | 可逆,仍可查看 | 47% | 被算法隐藏的评价 | 抽样商家的全部评价 | 可逆,不计入星级 | ## 前两个是删除,后两个是降权 这是四个数最根本的分野。删除意味着平台已经下了判断:这是假的,从此不存在。降权意味着平台只是把它挪到了角落:不计入星级、不计入评价数,但你点一下还能看见。 删除和降权的区别,在别的地方也会咬人。有些平台不让机器读你的评论 (https://zhangwenbao.com/reviews-ai-answers-crawlability-republish.html)时,评论并没有消失,只是对某一类读者不存在了——效果上和降权是同一回事。 > 一个是判决,一个是缓刑。把两者当成同一类比例并排比较,等于把死刑判决书和取保候审登记表放在一起数人头。 ## 被降权的那部分,平台自己不认为它们是假的 Yelp在解释推荐软件时写得很清楚:有时候一条评价出现在“不推荐”区,仅仅是因为软件对这位写评价的人了解得不够多,不足以把他的意见推荐给社区。它评估的是可靠性和活跃度,不是真伪。 ## 更要命的是这个分类会来回变 同一页还写着:推荐软件会定期重跑,随着它对这个人和这家店了解得更多,评价可以从不推荐变成推荐,也可以反过来。 一个会随时间变的分类,做成指标就更麻烦。仪表盘全是绿灯生意却没动 (https://zhangwenbao.com/ai-search-kpi-blind-spot-metric-swap.html)那篇讲过一类相似的坑:指标本身没坏,坏的是它测的那件事已经不是你关心的那件事了。 一个会随时间来回变的分类,不可能是“真假”这种事实判断。一条评价不会今天是假的、明天变成真的。会变的只能是“系统对它有多有把握”。 ## 顺手对出了一处引用差错 查这一条的时候撞上了别的东西。规则说明的脚注把Yelp那份报告引用为16%被标记为不推荐,而Yelp那份报告自己的摘要页写的是:2023年贡献的评价中有78%被推荐。 ## 78%的补数是22%,不是16% 两个数差6个百分点。按2023年约2200万条的提交量算,22%是484万条,16%是352万条,中间差着132万条评价。 我没有把这当成谁的错误来写,因为最可能的解释很平淡:Yelp的分档很可能不止两档,除了推荐和不推荐,还有一部分是直接移除的,三者相加才是100%。但这恰恰是本节要说的事——连一份监管机构逐句校对过的文件,在引用别人的比例时都会掉进档位里。 ## 第五个口径是委员会自己造的 更值得玩味的是接下来那一段。列完这四个差十倍的数之后,委员会最终一个都没用,它改用了另一个来源:按商品或商家统计,大约10%的商品或商家存在某种程度的评价操纵。 换分母这个动作,和换指标是同一类决定。该淘汰哪些老指标、换成什么 (https://zhangwenbao.com/retire-outdated-seo-metrics-2026-strategy.html)那份清单里,多数替换的理由也不是旧指标算错了,是它回答的问题已经不是现在要问的问题。 ## 从按评价算改成按商家算,是一次分母的整体搬家 这个改动很聪明。四份材料吵得不可开交,是因为它们都在数“有多少条评价是假的”,而这件事在定义上就没法统一。换成“有多少家店被操纵过”,问题一下子好答了——只要一家店出现过一条,它就算数。 代价是这个数不再能回答原来那个问题。10%的商家有过操纵,和10%的评价是假的,是两句完全不同的话,而它们长得一模一样。 ## 连续两年都写着6%,可它实际涨了 再看信任飞行员那份报告,它有一句话我盯了很久:假评价占比连续两年保持一致,都是6%。 ## 把绝对量摊开就露馅了 同一份报告里给了绝对数:2022财年删掉260万条,2023财年删掉330万条;2023财年的评价总量是5400万条,同比增长17%。 绝对数和比例要一起看,这是对账的基本功。数据分析师和SEO之间那份对账清单 (https://zhangwenbao.com/data-analyst-seo-reconciliation-7-actions.html)里,第一个动作就是把两边的绝对量摆出来,因为比例对得上、绝对量对不上的情况太常见了。 那么2022财年的总量可以反推:5400万除以1.17,约等于4615万条。260万除以4615万是5.633%,330万除以5400万是6.111%。两个数都四舍五入成6%,可它们之间隔着0.478个百分点,相对涨幅8.48%。 ## “连续两年保持一致”这句话本身没错 四舍五入到整数确实都是6,报告没有撒谎。但这句话给读者的印象是“情况没变”,而实际发生的是删除量的增速跑赢了总量的增速——删除量涨26.9%,总量涨17%。 ## 同期还有一个数涨得更快 那份报告在另一页写着:2023年这些假评价里有82%是自动检测系统发现并删除的,比2022年的68%有所提高。68到82,相对提升20.6%。 ## 把这三个数放在一起,才看得出6%是什么 自动检测能力提升了20.6%,删除量涨了26.9%,而占比只从5.63挪到6.11。这个组合能推出一件事:6%不是“有多少假评价”,是“这套系统这一年抓到了多少”。它是产能的记录,不是存量的测量。 换个说法更直白:凡是靠“我们删了多少”算出来的比例,天然是一个下界,而且它的变化更多反映检测方的动作,而不是造假方的动作。 ## 顺着本文的主线再问一句:谁在报这个数 这里可以把第一节那套判据反过来用一次。四个数里有三个是平台自己公布的,那就该问:报出这个数,对报的人有什么好处? ## “我删了多少”和“还剩多少”,激励方向正好相反 平台报“我今年删掉了330万条假评价”,这个数越大越显得它能干、投入大、系统有效。平台报“我的页面上还剩多少条假评价没抓住”,这个数越大越难看。 这种口径选择在社媒数据里最泛滥。把社媒指标拆成四层漏斗 (https://zhangwenbao.com/social-media-metrics-funnel-vanity-vs-business.html)之后会发现,被大量展示的那几个数,恰好是发布方最愿意让你看到的那几个。 四家公布的全是前一种。这不是撒谎,是选择了一个跟自身利益同向的口径——而这个口径恰好和读者真正想知道的那个问题方向相反。读者想知道的是“我现在看到的评价里有多少是假的”,得到的却是“我们今年拦下了多少”。 ## 这一条对自建评价体系的人同样成立 如果你自己的站点有评价功能,团队汇报“本季度拦截了多少条垃圾评价”时,可以顺手问一句:这个数变大,是因为坏人变多了,还是因为规则变严了,还是因为总量涨了?三种原因会推出三种完全不同的动作,而汇报口径通常一个都不说。 顺带提一句配置层面的事。产品评论的审核、防刷和已购验证怎么配 (https://zhangwenbao.com/woocommerce-product-reviews-verified-owner-moderation-spam-rating-schema-operations.html)那篇讲得比较细,本文关心的只是其中一点:你的拦截量变大,未必说明坏人变多了。 ## Yelp那份报告里还有一组数,方向就诚实得多 它写道:2023年向其他平台举报了1300多次,提醒对方有人在那里买卖评价;举报量比上一年增加23%,但只有54%的举报被对方采取了行动,这个处理率比2022年降了将近30%。 ## 1300乘54%,剩下的近600次没人管 这个乘法是我自己做的,原文只给了比例。约702次被处理,约598次石沉大海。一家平台花力气查出来的线索里,有将近一半在另一家平台那里没有下文。 我把这一条单拎出来,是因为它是四个数里唯一一个方向对自己不利的——它承认的是“我做了但没用”。一份报告里凡是出现对自己不利的数,那部分的可信度通常比其余部分高一截。 ## 那这四个数还能不能用 能,但用法要换。它们不能拿来回答“假评价有多少”,只能拿来回答“各家平台各自拦下了多少”。四个数之所以差十倍,是因为四家的口子开在不同位置,拦网的密度也完全不同。 ## 三种分母形态,对应三种完全不同的问题 把这一节收一下,分母大致就三种:以提交量为分母,回答的是“进门的人里有多少被拦下”;以展示量为分母,回答的是“留在页面上的有多少值得信”;以商家数为分母,回答的是“有多少家店碰过这件事”。 三个问题的答案可以同时是4.4%、22%和10%,彼此毫不矛盾。看见比例先找分母,这句话每次说都像废话,可它每次都管用。 ## 再补一个找分母的笨办法 把那个百分比还原成一句带主语和量词的完整中文。“6%的评价是假的”还原之后应该是:该平台该年度收到的全部评价里,有6%被它自己的软件判定为假并删除。 还原分母这件事,做多了会上瘾。搜索份额到底怎么算 (https://zhangwenbao.com/share-of-search-brand-mindshare-market-share-predictor.html)就是一个典型:同一个词,分母取全类目还是取品牌集合,算出来的份额能差出好几倍,而两种算法都在被人用。 还原不出来,说明你手上的信息不够,这个数暂时只能当谈资。能不能用一句话把分子和分母都说清楚,是判断自己有没有真看懂一个比例的唯一标准,这一条我用了很多年,基本没失过手。 ## 被隐藏的评价,真的就是假评价吗? ## 这是整条链路上最常见的一次替换 上一节说到,那个47%指的是被算法隐藏的评价占比。从“被隐藏”走到“是假的”,中间隔着一次悄无声息的替换,而这次替换几乎从来没有人标注过。它太顺理成章了:平台把它藏起来,肯定是因为它有问题。 这一层区分对做内容的人尤其要紧。把用户评价和问答做成会排名的资产 (https://zhangwenbao.com/ugc-user-generated-content-seo-asset-strategy.html)时,你真正能控制的是被展示的那一部分,而被隐藏的那部分照样占着你的数据。 ## 那篇工作论文其实给了三个数,不是一个 被引用的是一位联邦贸易委员会经济学家的工作论文,样本框有62.8万家企业。它没有说“Yelp上47%的评价是假的”,它做的是一张按商家质量分档的表,一共三行。 被搬走的那个47%,来自这张表里最高的那一格。把一张三行表里最大的那个数拿出来当成整体结论,是引用环节最常见的一种损耗——不是伪造,是把分档信息扔掉了,而分档信息恰恰是这张表全部的价值所在。 把分档信息扔掉,损失的往往正是全部价值。按页面模板抽样做电商SEO审计 (https://zhangwenbao.com/ecommerce-seo-audit-template-level-sampling.html)之所以能把一百天压到半天,靠的就是分档——不分档就只能逐条查,分了档才知道该查哪一档。 ## 把三行原样摆出来 商家质量档 | Yelp被隐藏评价占比 | 另一机构算法判为极可能造假的占比 | 高 | 46.6% | 7.9% | 中 | 33.1% | 8.9% | 低 | 46.0% | 9.4% | 观察量 | 25792 | 72257 | ## 先别看数值,看形状 左边那一列是两端高、中间低。高质量商家46.6,中等33.1,低质量46.0。这是一条U形曲线。 ## U形这个形状,造假动机造不出来 道理很简单:刷评价是要花钱的,花钱的动机来自“我的真实口碑不够好”。所以如果隐藏率测的真是造假,它应该随着商家质量下降而单调上升——越差的店越有理由刷。 动机这条线索比技术手段可靠。产品评论的SEO怎么做 (https://zhangwenbao.com/ecommerce-product-reviews-seo-guide.html)那篇里我提过一个判断:评价体系设计得好不好,看的是它有没有让作弊变得不划算,而不是看它抓得准不准。 这个推理不需要任何统计知识,只需要承认一件事:人不会为了自己已经拥有的东西付钱。一家口碑本来就好的店,花钱买好评的边际收益接近于零,它买不到什么它没有的。 它没有。它在中间那一档掉下去了,两端各比中间高出13.5和12.9个百分点。这两个差值是我自己减出来的,论文只给了三个原始数。 ## 更别扭的是高低两端的比较 高质量商家的隐藏率是46.6%,低质量商家是46.0%。高质量商家那一档还高0.6个百分点。如果这个指标测的是造假,那就等于说好店比差店刷得还多一点点。 0.6个百分点当然在误差范围里,论文给的标准误是0.4,两者差不多是一回事。但“差不多是一回事”本身就已经推翻了那个引用——一个被当成造假指标用的数,在最该拉开差距的两端居然打平了。 ## 换一把尺子,形状立刻变了 同一篇论文用了第二个数据源:另一家商业信誉机构自己的过滤算法,为每条评价打一个“是假的概率”分。按同样三档拆,得到7.9、8.9、9.4。 ## 这一条是单调的,而且极差只有1.5个百分点 高到低一路往上走,方向完全符合直觉。但它的极差只有1.5个百分点,而Yelp那把尺子的极差是13.5个百分点,相差9倍。 两把尺子量同一件事,一把说三档几乎一样,另一把说三档差出13个点还排成U形。这时候要问的不是哪把尺子准,而是这两把尺子各自到底在量什么。 两套算法给出相反答案,这种事比想象中常见。商品页那个推荐位,两套报表算出相反的结论 (https://zhangwenbao.com/product-page-recommendation-attribution-mismatch.html),而且两套都没算错——分歧全部来自它们各自把什么算进了归因窗口。 ## 论文作者自己给了两种解释 他写得很克制:这些结果可能意味着所有商家都存在假评价,也可能意味着造假者伪装得足够像真人,以至于高质量商家的许多正当评价也被标记成了假的。 注意这句话的结构——他给了两种解释,一种都没有排除,也没有说自己更倾向哪种。在一份要被引用的材料里,作者主动写下“这里我说不准”,比他给出一个确定结论有用得多,可惜这句话在传播中活不过第一手转述。 ## 两种解释推出的动作完全相反 如果是第一种,那结论是“假评价无处不在,谁都别装”。如果是第二种,那结论是“这个过滤器误伤严重,尤其误伤好店”。前者让你更不相信评价,后者让你更不相信过滤器。而引用这个数字的人,通常两种都没说,只留下了那个47%。 两种解释指向相反的动作时,唯一的出路是设计一次能分开它们的观察。把SEO决策变成假设检验 (https://zhangwenbao.com/data-driven-seo-decisions-attribution-and-hypothesis-testing.html)讲的就是这一步:先想清楚什么结果能证伪哪一种,再去看数据。 ## 还有第三种可能,藏在平台自己的说明里 回到Yelp那句话:有时候一条评价进了不推荐区,只是因为软件对这个人了解得不够多。那么高质量商家的隐藏率偏高就有了一个平淡的解释——好店往往新客占比高,新客的账号往往是新的,新账号系统认识得少。这个解释不需要任何人造假。 ## 这句话在传播里活不过一手 它写在平台自己的信任与安全说明 (https://trust.yelp.com/trust-and-safety-report/2023-report/)里,位置不隐蔽,语气也不含糊。可只要那个百分比被搬走一次,这句话就掉了。再搬第二次,连“不推荐”这个词都会变成“被判定为假”。 这不是谁存心曲解。是因为“被判定为假”比“系统了解不够所以暂不推荐”短得多、也有力得多,而每一次转述都在为简短付费,付出去的正是那些限定条件。限定条件是这类信息里最先掉的东西,因为它最长、最绕、也最不像重点。 新客账号被系统认得少这件事,反过来也会影响你。社会证明体系怎么搭才能让陌生买家敢下第一单 (https://zhangwenbao.com/dtc-social-proof-system-reviews-ugc-trust-conversion.html)里,最容易被忽略的正是新账号写的那批评价,它们对转化最有用,却最容易被过滤。 ## 被隐藏的那些评价,分数反而更高 论文还算了一件事:如果把被过滤的评价放回去一起算平均分,高质量商家的星级会上升0.2星,中等上升0.1星,低质量上升0.4星。而被过滤评价本身的平均分,比已发布的高0.3、0.2和0.7星。 这两组数要分开读。前一组是“放回去以后整体变多少”,后一组是“被拿掉的那批自己有多高”。后一组更大,是因为被拿掉的只占一部分,掺回整体里会被稀释。能同时给出这两组,说明作者知道有人会混用,提前把两个口径都摆出来了。 ## 这一条的方向反倒是对的 低质量商家那一栏的0.4和0.7最大,说明过滤器确实在压制虚高,而且在最该压的地方压得最狠。所以这套算法在做正事,只是它做的事叫“别让分数被抬起来”,不叫“判定这条是不是假的”。 ## 作者自己在脚注里划了这条线 他写道:评价没有被发布可能有假评价之外的原因,比如脏话、垃圾信息,或者与已有评价重复。这句话被放在脚注里,而正文里的那个数字被搬走时,脚注没有跟上。 ## 那人能不能靠读一读就分辨出来 这个问题有人做过实验,而且数字很难看。信任飞行员在透明度报告里引了三组:面对面判断一个人有没有说谎,准确率54%;只看评价内容找出假评价,准确率57%;如果额外提供评价者的一些信息,升到65%。 凡是靠肉眼判断的事,都值得先做一次小规模实测。拿一批样本页跑一遍再下结论 (https://zhangwenbao.com/semantic-html-content-extractability-engineering.html)那次也是这样:跑之前所有人都很确定答案,跑完之后一半的人改了口。 ## 还有一组更狠 同一页还引了一项研究:让参与者区分一段文字是人写的还是人工智能写的,准确率50%到52%。 ## 50到52是什么概念 > 随机瞎猜是50%。也就是说,最好的情况下比抛硬币多认对2条,最差的情况下和抛硬币一模一样。那句“我一眼就能看出来这是刷的”,翻译成数学是:我的判断携带的信息量约等于零。 更麻烦的是这种判断带着强烈的自信。没人会说“我抛硬币决定这条评价真不真”,可从结果上看,说“这条一看就是刷的”和抛硬币是同一件事。准确率50%配上自信度90%,比准确率50%配上自信度50%危险得多,因为前者会真的去改点什么。 ## 57%其实也没好到哪去 57%意味着每100条里比瞎猜多认对7条,同时也意味着有43条判错。拿一个准确率57%的判断去质疑一条评价,你有将近一半的概率在冤枉一个真实顾客。 ## 所以平台早就不看内容了 信任飞行员在同一页写了它的做法:技术手段访问的是数亿条评价背后的行为数据点,而不是评价的文字本身,这样即使内容是人工智能写的也能识别。看行为不看内容,是因为文字这条路已经被堵死了。 看行为不看内容,这个转向在搜索引擎那边发生得更早。产品评论算法更新之后哪些站活了下来 (https://zhangwenbao.com/google-product-reviews-update-mechanism-affiliate-site-survival.html)那次的结论是:活下来的不是文字写得漂亮的,是能拿出实际使用痕迹的。 ## 检测这条路有个结构性问题 它是一场没有终点的军备竞赛。对方每换一种写法,你就要更新一次模型;你更新一次模型,对方就换下一种。而准入门槛是一次性的结构改造:把“能自己报名”改成“只能被随机抽中”,之后不需要每年再改。 两条路的成本曲线完全不同。检测的成本随对手的进化线性增长,准入的成本主要发生在改造的那一次。代价是准入会把一部分真实用户也挡在外面——皮尤那套面板一年只邀请一小批人,样本贵得多,这笔钱就是这么花掉的。 ## 有个数字正好印证了这一点 上一节算过:信任飞行员的自动检出率从68%提到82%,相对提升20.6%,而假评价占比还是那个6%。检测能力提升了两成,报出来的比例几乎没动。这不是检测没用,是检测的产出被造假的产能同步吃掉了。 ## 换个角度,不查单条也能看出问题 同一篇论文里还有一组分布数据,我觉得比隐藏率有用得多:在几个主流平台上,平均分高于4星的商家占比分别是——某搜索平台59%,某社交平台79%,某家装服务平台96%。 ## 96%这个数说明这把尺子已经废了 一个评分体系里96%的商家都在4星以上,剩下4%里还包括各种极端情况。这时候星级已经不携带信息了,因为它对任何一家店的评价都是“很好”。你不需要一条条查假评价,看一眼分布就知道这个数字不能用来做选择。 同一组数里,某搜索平台是59%,某社交平台是79%。三个平台的分布压缩程度差得这么远,说明这不是消费者的态度差异,是各家评分规则和过滤策略的差异。换句话说,你比较的从来不是商家好不好,是平台松不松。 ## 这比查真假省力得多 查一条评价的真假,要看内容、看账号、看行为,还不一定查得出来。看一眼评分分布,只需要几分钟。而分布这个东西是造假者没法单独修的——他能把自己那家店刷到4.8,改不了整个平台96%都在4星以上这件事。 ## 顺带说一个更省力的替代动作 与其纠结某个平台的假评价率是多少,不如做一件更简单的事:把你自己后台的原始评分分布,和那个平台展示出来的评分分布放在一起比。 比对分布之前,先确认你的数据导得出来。给评论加上星级结构化数据 (https://zhangwenbao.com/shopify-ryviu-review-structured-data-guide.html)那篇里的字段设计,顺手就能满足这个需求,因为它本来就要求评分和条数分开存。 两条分布差多少,就是这个平台在你这里过滤掉的量。这个数是你自己的,不依赖任何一份透明度报告,也不用相信任何人的口径。做一次不到半小时,而且它回答的是你真正关心的那个问题——不是“行业里有多少假的”,是“我这家店在这个平台上被削掉了多少”。 ## 这一节的判据 收一下:看见一个“假评价占比”的数字,先问它是不是从“被平台处理过的评价”里算出来的。如果是,那它测的是平台的处理量,不是造假的存量;如果它还被分了档,就去看那条线的形状对不对得上造假的动机——形状不对,多半是这个指标测的根本不是那件事。 ## 一条假评价,到底值多少钱? ## 有人把这个问题直接摆到了监管机构面前 联邦贸易委员会制定这条规则时公开征求过意见。在收到的意见里,有一家企业提了个很实在的要求:希望委员会说清楚假评价的财务后果,比如是不是每条大约5万美元。 这个提法很值得注意。他没有问“这样做对不对”,也没有问“会不会被查”,他问的是单价。一个准备守规矩的人,想知道的是这条线画在哪;一个准备算账的人,想知道的是每一步值多少钱。同一个问题,两种人都会问。 问单价的人未必都是要算账。自夸式榜单被点名之后怎么改 (https://zhangwenbao.com/self-promotional-listicles-ftc-google-crackdown.html)那次,很多站长第一反应也是问“到底哪一条越线了”,而那个问题问出来,多半意味着他还想留下点什么。 ## 委员会的回答有三句,只有第一句是确定的 它写道:目前的最高民事罚款是每次违规51744美元,但法院必须考虑法案里规定的若干法定因素,可能判处低得多的单次罚款;最终,法院还将决定在一个具体案件中如何计算违规次数。 三句话,第一句给了上限,第二句说这个上限通常达不到,第三句说“一条算不算一次”这件事本身还没有答案。也就是说,提问者想要的那个单价,官方的回答是:分子有上限,分母未定。 ## 那个51744今天已经不是51744了 这类罚款上限每年按通胀调整。2025年1月17日联邦公报发布的那次调整 (https://www.federalregister.gov/documents/2025/01/17/2025-01361/adjustments-to-civil-penalty-amounts)把它提到了53088美元,此后维持。差1344美元,涨幅2.60%。 法规里的数字会变,法规要求你留的证据也会变。商品页上被划掉的那个原价 (https://zhangwenbao.com/strikethrough-price-prior-price-dtc-discount-display.html)就是个例子:规则本身十年没大改,但对“证明它存在过”的举证要求一路收紧。 我把这个变化写出来,不是因为1344美元有多重要,而是因为它说明了一件事:规则正文里印着的那个数,是会过期的。引用一条法规里的金额时,得顺手确认一下有没有更新过,这是个五分钟的动作。 ## 现在把收益端和成本端并排摆一下 收益端,本文第一节算过:自主报名式问卷,一条1美元,可以一天两百条,可以开五个账号。三个数字全部确定,精确到个位。 成本端:上限53088美元,实际多少法院定,一条算不算一次法院也还没定。三个环节里没有一个是确定的。 ## 这就是全篇最不对称的一处 > 收益端精确到分,成本端连计量单位都还没有定下来。这不是谁的失职——立法本来就得给司法留裁量空间,逐条定价反而会出问题。但对一个正在算账的人来说,这种不确定性是有方向的:它降低了成本端的期望值。 一件事收益确定、代价模糊,人们的默认反应是低估代价。模糊本身就是一种折扣。 ## 53088除以1,等于53088 这个除法很粗暴,但它有意义:一条假评价的罚款上限,相当于53088条假评价的全部收入。换个说法,如果一个人靠一美元一条挣钱,他要连续做53088条才能赚回一次顶格罚款。 再换个口径更直观:按每月30000美元算,一次顶格罚款等于1.77个月的全部收入。不到两个月的活儿,一次罚没。 ## 但这个倍数漏掉了最关键的一项 造假者不会拿罚款上限跟收入比,他算的是期望值——罚款金额乘以被抓到并被顶格处罚的概率。而上一节已经说清楚了:靠读内容识别假评价的准确率是57%,靠人力查一家一家的成本极高,跨平台举报有近一半没有下文。 把概率乘进去之后,那个53088倍就未必还是53088倍了。这也是为什么真正管用的从来不是提高罚款上限,而是提高被抓的概率——前者是乘数,后者是那个决定乘数有没有意义的因子。 ## 顺便说说那句“法定因素”是什么 法条里列的考量因素大致包括:欺骗行为的严重程度、被告的支付能力、以往的行为记录、以及从公平角度看还有什么需要考虑的。这几项没有一项是可以提前算出来的。 这类依赖情节的条款,最好在出事之前就有人替你读过。法务和SEO之间那七个协作动作点 (https://zhangwenbao.com/legal-counsel-seo-collaboration-7-actions-privacy-trademark-incident.html)里,有一条就是让法务提前把这类模糊条款翻译成运营看得懂的红线。 它们的共同点是都依赖具体情节。换句话说,能不能提前知道自己要赔多少,取决于你有没有真的做过这件事——没做过的人算不出来,做过的人算得出来但已经晚了。这个设计是故意的。 ## 把这套结构和刷单方那套放到一张表里 环节 | 造假一侧 | 处罚一侧 | 单价 | 1美元,明码 | 上限53088美元,实际由法院定 | 计量单位 | 一条就是一条 | 一条算不算一次违规,未定 | 发生概率 | 做了就有 | 要先被发现、被起诉、被判定 | 可提前测算 | 可以,乘法 | 不可以,依赖具体情节 | ## 四行里有三行是不对称的 左边一列全部可以在动手之前算清楚,右边一列只有第一行的上限是明确的。一个人做决定时,能算的那部分会被算得很仔细,算不了的那部分会被换成一句“应该不至于”。 可预测这件事,在合规工具上体现得最明显。违禁词检测把销量最好的那句话标成高风险 (https://zhangwenbao.com/ad-word-checker-exception-overlap-falsepositive-guide.html),而那句话恰好是执法指南里写明的例外——工具给的是确定答案,规则给的是有条件的答案。 这不是道德问题,是认知的默认行为。凡是要靠规则约束行为的场合,把代价做得可预测,往往比把代价做得高更有效。 ## 规则说明里有一句话,把这件事说穿了 委员会在解释为什么要把这些行为写成一条正式规则时提到:如果没有一条能有效追索民事罚款的路径,做坏事的人几乎不必担心受罚。 这句话承认的是:在这条规则之前,这些行为本来就是违法的,只是罚不动。规则改变的不是“什么被禁止”,而是“罚起来能不能走得通”。 ## 规则本体一共九节,其中一节是空的 正文短得出人意料:465.1是定义,465.2到465.8是七类被禁止的行为,465.9是可分割性条款。而465.3那一节只写着两个字:保留。 条文短不等于要求低。有的法规连表格长什么样都规定了 (https://zhangwenbao.com/product-comparison-field-alignment-disclosure-layers.html),读起来同样只有几句话,落到页面上却要改一整套模板。 条款 | 管的是什么 | 和独立站的关系 | 465.1 | 16个定义 | 只有一条是关于报酬的 | 465.2 | 写、卖、买假评价与假推荐 | 找人代写、买带货文案 | 465.3 | 保留(空) | — | 465.4 | 买好评或买差评 | 有奖评价活动的措辞 | 465.5 | 内部人评价与推荐 | 员工及其近亲属发的评价 | 465.6 | 自己控制的“独立”测评站 | 自建对比页、测评矩阵 | 465.7 | 压制评价 | 只展示好评、威胁差评者 | 465.8 | 虚假社媒影响力指标 | 买粉、买赞、买播放 | 465.9 | 可分割性 | — | ## 委员会自己算过这条规则值多少钱 说明文件里有一张十年现值表。按3%贴现率算,收益现值在674亿到2695.5亿美元之间;按7%贴现率算,是570.3亿到2304.4亿美元。净收益的低端是561.6亿美元。 十年现值这种算法,本质上和内容投入产出是同一套。内容ROI到底怎么算 (https://zhangwenbao.com/content-roi-performance-measurement-attribution.html)那篇里我拆过单篇盈亏表,最难的一步也不是加减,是决定把哪些收益算进来、算几年。 数量级很大,但这不是本节的重点。重点在成本那一行。 ## 成本那一行:低端8.7亿美元,高端0 是的,高端估计那一栏的一次性成本写的是零。第一次看到时我以为是排版错误,翻到对应章节才明白它是认真的。 ## 为什么会是零 委员会的原话大意是:这条规则禁止的行为,本来就已经属于违法行为;已经守法的企业不会因为这条规则而产生任何额外成本。所以其中一个情景假设企业只花极少时间读一遍规则,不对现行政策做任何改动——成本就是零。 另一个情景假设企业因为现在面临民事罚款风险,会主动做一轮自查:通知员工、审一遍流程、该改的改。这一轮自查算出来是8.7亿美元。 ## 这两个情景的差别,恰恰就是这条规则的效果本身 把这一层想透会有点绕,但它很值:规则的合规成本,全部来自企业因为怕被罚而多做的那些动作。而“让企业因为怕被罚而多做点什么”,正是这条规则唯一的目的。 所以这两栏数字的关系是:成本为零,等于规则完全没起作用;成本是8.7亿,等于规则起作用了。成本和效果是同一件事的两面,一份成本效益表居然把这两面同时印在了一页上。 ## 那8.7亿是怎么摊出来的 他们用的底数是2021年美国约3477万家企业,其中员工500人以上的有19688家,其余3475万家是小企业;再假设其中74%会因为这条规则做一轮自查,也就是不超过2571万家。 拍出来的比例撑起总数,这在预算测算里天天发生。财务和SEO那七个协作动作 (https://zhangwenbao.com/finance-cfo-seo-collaboration-7-actions-budget-attribution-asset.html)里最关键的一条,就是把每个假设单独列出来,让看的人知道哪一格是查来的、哪一格是估的。 这个74%是我在文件里看到的唯一一处纯假设,它没有对应的实证来源。把它调到50%,成本立刻掉三分之一。一份把每一项数据来源都标了脚注的文件,最后仍然要靠一个拍出来的比例把总数撑起来——这不是缺点,是任何前瞻性估算的宿命,值得记住的是它出现在哪一层。 ## 他们还往两个方向各做了一次压力测试 一个方向是假设合规成本被系统性低估了:把所有人工工时乘以10。这样合规审查成本变成87.2亿美元,而按7%贴现的净收益仍有483.1亿美元。 另一个方向是假设威慑效果被高估了。这次动的不是成本,是那个核心系数。 ## 核心系数从0.12换成0.04,结论缩水三分之二 主表用的假设是:消除评价操纵之后,消费者在每一美元支出上能挽回0.12美元的福利损失,这个数来自一项关于假评价如何影响需求与福利的实验研究 (https://www.nber.org/papers/w31836)。压力测试改用0.04——同一项研究里,只消除部分操纵时报告的最小改善值。 换掉这一个系数,7%贴现下的净现值从561.6亿降到181.4亿,只剩三分之一。0.12和0.04差3倍,而它们出自同一篇论文的两种情景。 ## 这一条对读任何一份影响评估都成立 一份评估报告的结论,往往由一两个核心系数决定,而这些系数通常藏在脚注里,写着它取自哪项研究的哪种情景。换掉一个系数,结论可以差三倍,而报表的格式一行都不用改。 要求给出依据,本身就是在压缩这种系数的自由度。商品页上写环保材质要拿得出证据 (https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html)那条新规也是这个思路:不禁止你说,只要求你说的时候带上算法和来源。 ## 我自己顺手把这个系数推成了金额 用他们自己的口径:2023年美国电商零售额11190亿美元,受评价影响的服务业收入3410.5亿美元;按大约10%的商品或商家存在操纵计算,分别是1119亿和341亿。 自己验算一遍别人的表,这个习惯在合规数据上尤其值。同意横幅怎么装才不毁掉SEO数据 (https://zhangwenbao.com/seo-legal-compliance-gdpr-ccpa-consent-mode-cross-border-architecture.html)那篇里的采样偏差,也是靠拿两套数据互相验算才发现的。 再乘0.12:电商侧约134.3亿美元,服务业侧约40.9亿美元,一年合计约175.2亿美元。十年一千七百多亿,和他们那张表的量级对得上,说明我理解的口径没跑偏。这一步纯粹是自己验算,不验算的话,那张表就只能当结论背。 ## 这一节的判据 收一下:看见一个罚款上限或者一个处罚金额,先找它的计量单位——按条、按次、按天、按笔,还是按案。单位没定的时候,那个金额的威慑力主要来自它的位数,而不是来自它的实际期望值。 选工具时也该问同样的问题。出海独立站怎么选同意管理平台 (https://zhangwenbao.com/cmp-consent-management-platform-selection-cross-border.html)那份横评里,我把每家的计费单位单列了一栏,因为按会话、按域名还是按次数计费,同一个报价能差出好几倍。 同理,看见一份影响评估,先找它的核心系数取自哪一项研究的哪一种情景。把那个系数换成同一篇论文里的另一个值,结论通常会缩水一半以上——如果它不会,那才是真的稳。 ## “求评价”和“求好评”,差在哪一个字上? ## 这条规则里有一句话,是独立站最容易踩的 前面几节都在讲怎么读别人的数据。这一节换个方向:如果你自己的站点在收集评价,哪一步会把自己的数据也搞成前面说的那种。 答案集中在这份规则的465.4这一节 (https://www.ecfr.gov/current/title-16/part-465)。它是整份规则里最短的一节,只有一句话,但那句话的落点很出人意料。 配置层面的对应动作也不复杂。优惠券和促销规则怎么设置才不亏本 (https://zhangwenbao.com/woocommerce-coupon-promotion-rules-discount-abuse-prevention-operations.html)那篇里的防薅逻辑,稍微改一改就能用在评价激励上,两者要防的其实是同一类行为。 ## 先把这一句原样翻出来 大意是:一家企业提供报酬或其他激励,用以换取表达特定倾向的评价,或者明示、暗示地以表达特定倾向为条件发放报酬,无论这个倾向是正面还是负面,都属于不公平或欺骗性行为,构成对本部分的违反。 读第二遍的时候注意那个转折点。被禁止的不是“提供报酬”,是“以表达特定倾向为条件”。 ## 红线不在给不给钱,在钱跟什么挂钩 这个区分极其锋利,而且几乎所有中文讨论都把它讲丢了。给写评价的顾客发5美元店铺余额,这件事本身不在禁止之列;把发放条件写成“分享你的好评”,就跨线了。 推荐计划里有完全一样的分界。双边激励怎么设计才不被薅羊毛 (https://zhangwenbao.com/dtc-referral-program-double-sided-incentive-operations.html)的核心,也是把奖励挂在“完成了某个动作”上,而不是挂在“达成了某个结果”上。 同一笔钱,同一批人,同一个动作,区别只在活动文案的措辞。 ## 两句文案,放在一起看 第一句:写下你的使用体验,无论满意与否,都可获得5美元店铺余额。第二句:分享你的好评,赢取5美元店铺余额。 > 第一句合规,第二句不合规。两句话在中文里差的是“体验”和“好评”这两个词,在英文原文里差的更少。而这两句话通常是市场同事在活动上线前十分钟随手改定的。 ## 多摆几对,这条线的位置会更清楚 活动写法 | 报酬挂在什么上 | 判断 | 写下你的使用体验即得5美元余额 | 写了这个动作 | 可以 | 分享你的好评,赢5美元余额 | 评价的倾向 | 不可以 | 五星评价额外送一张优惠券 | 具体星级 | 不可以 | 所有买过的顾客都会收到评价邀请 | 购买行为 | 可以 | 只给评分4星以上的顾客发邀请 | 已知的满意度 | 不可以 | 互相给对方店铺写个五星 | 另一条评价 | 不可以 | ## 第五行是最容易被忽略的一行 它不涉及任何文案措辞,涉及的是发送名单。只给已知满意的顾客发评价邀请,这个动作在文案上完全干净,但它把筛选做在了上游。很多站点的自动化流程里就埋着这一条,因为它当初是作为“提高邀请转化率”的优化加进去的。 名单条件通常藏在自动化流里。自动化流和一次性群发的分工 (https://zhangwenbao.com/email-marketing-flow-vs-campaign-automation-broadcast-strategy.html)那篇讲过,流的触发条件写好之后基本没人再看,而筛选偏差正好就长在那些没人再看的地方。 这也是这一节和前面几节真正的接点:无论筛选发生在写之前、写之后还是展示之前,产生的偏差是同一种,只是越靠上游越难被发现。 ## 为什么线画在这儿,而不是干脆禁止一切激励 因为激励本身不制造偏差,条件才制造偏差。你付钱请人说话,得到的是更多的人说话;你付钱请人说好话,得到的是更多的好话。前者放大样本量,后者扭曲分布。 积分和分层体系里也有这道题。会员忠诚度体系怎么搭 (https://zhangwenbao.com/dtc-loyalty-program-points-tiers-membership-retention-system.html)时,如果把积分挂在“晒好评”上,整套等级数据就会跟着倾斜,而等级数据往往还要拿去做用户分层。 这个道理和本文第一节那套判据是同一回事:决定数据形状的不是有没有钱,是钱跟什么绑在一起。 ## 那到底什么算报酬 规则在定义那一节给了清单。所谓“购买一条评价”,指的是提供任何有价值的东西以换取评价,包括金钱、礼品卡、产品、服务、折扣、优惠券、抽奖资格。 ## 清单的最后一项让人愣一下 清单没有到抽奖资格为止,后面还跟着一样东西:另一条评价。 也就是说,“我给你的店写个好评,你给我的店写个好评”,这种互换在定义上就等同于花钱买。它不需要有任何金钱流动,就已经落进了“购买”这个词里。 ## 这一条对做独立站的人有直接后果 卖家社群里的互评互赞、店主之间的资源置换、行业群里的“帮忙点个五星”,全都在这个定义的射程内。很多人觉得没花钱就不算买,而规则里那句话的存在,说明写规则的人早就想到这一层了。 找素人做体验官是另一条路,也更经得起看。KOC素人体验官怎么铺成真实口碑矩阵 (https://zhangwenbao.com/dtc-koc-seeding-operations-overseas.html)的关键在于:给的是产品和场景,不是结论,写什么由对方决定。 ## 那还能不能主动请顾客写评价 能。而且规则专门为此留了口子,位置在465.2的例外条款里。 ## 那个口子叫“泛化征集” 原文的意思是:企业向购买者发出泛化的征集,请他们就自己的使用体验发表评价或推荐,由此产生的评价不适用前面那两款的限制。 “泛化”这个词是整条规则给运营留的唯一活口,也是唯一需要逐字理解的词。它的意思是:面向所有购买者、不挑人、不挑倾向、不预设内容。 ## 三条可以照抄的自查 把这个词翻译成三个可以对着活动方案打勾的问题:这次征集是发给所有买过的人,还是只发给评分高的那批?文案里有没有出现任何暗示希望得到正面反馈的词?拿到报酬的条件,是不是只跟“写了”有关,跟“写了什么”无关? 获客那头有一份现成的对照可以借。邮件列表怎么合规地从零养起来 (https://zhangwenbao.com/dtc-email-list-building-lead-magnet-double-optin-compliance.html)里的双重确认流程,逻辑上就是把“愿意收”和“留了地址”分成两件事,和这里把“写了”和“写了什么”分开是同一种拆法。 三个都是“是”,这次活动就站得住。三个问题合计不到三分钟,而它拦下的是本文第一节讲的那种偏差,从源头上。 ## 接下来是自己人写的评价 465.5管的是内部人。高管或经理写自家产品的评价、推荐语,必须清楚显著地披露自己和企业的关系,除非这层关系对受众来说本来就很明显。 ## “近亲属”的定义只有四类 配偶、父母、子女、兄弟姐妹。清单短得几乎有点保守,堂表亲、姻亲都不在内。定义写得越窄,越说明写的人打算认真执行它——一个宽泛到没边的定义,实际上等于没有定义。 披露关系这件事,在内容侧比在法务侧更常见。把开箱做成复购和口碑的杠杆 (https://zhangwenbao.com/dtc-packaging-unboxing-experience-retention-ugc.html)时,寄出去的每一份体验装其实都产生了一层需要说明的关系,只是大多数人不这么想。 ## 最有意思的是465.5里的第三款 它管的是索要行为:高管或经理向自己的近亲属、或者向员工、代理人索要评价,或者要求员工去找他们的亲属写评价,如果结果是这些人写了评价却没有披露关系,并且这位高管或经理满足三个条件之一,就构成违规。 ## 三个条件里最值得注意的是中间那个 三个条件是:鼓励对方不要披露;没有指示对方要清楚显著地披露;或者知道、应当知道这样的评价出现了却没有采取补救措施。 中间那一条是纯粹的不作为。你什么都没说,就已经满足了这个条件。这是整份规则里唯一一处把“没做某件事”直接写成违规要件的地方。 ## 不作为等同于作为,这个设计是有道理的 因为“我没让他不披露”这句辩解太容易说了,而“我明确要求他披露了”是有痕迹的——一封邮件、一条群消息、一份内部说明。规则把举证责任推到了留痕这一侧,等于要求企业主动生产证据。 落到动作上很简单:如果你请员工或朋友帮忙写过评价,把那句“请注明你和本店的关系”写进消息里,并且留着那条消息。 ## 顺带一提,规则里16个定义只有一个是关于钱的 定义那一节从a排到p,一共16条:企业、名人推荐、清楚显著、消费者评价、评价托管、消费者推荐、虚假影响力指标的分发、虚假影响力指标、近亲属、社媒影响力指标、经理、高管、购买评价、评价者、推荐者、无依据的法律威胁。 积分算不算报酬,这个问题问得最多。积分和会员体系怎么搭才不被薅 (https://zhangwenbao.com/woocommerce-points-rewards-loyalty-membership-plugin-operations.html)那篇里我把积分当成货币处理,理由和这里一样:只要它能换到东西,它就是有价值的东西。 16条里只有“购买评价”那一条是在界定报酬。一条主要用来管钱的规则,只花了十六分之一的定义篇幅去定义钱,其余全用来界定“谁在说话”和“说的话怎么呈现”——这个比例本身就说明了监管者认为问题出在哪。 ## 再往下是能不能只展示好评 465.7管压制。它禁止两件事:一是用没有依据的法律威胁、人身威胁、恐吓或明知虚假的公开指控,来阻止评价被写出来或迫使它被删除;二是在按评分或负面倾向压制评价的同时,声称页面上展示的是全部或大部分评价。 ## 第二条的重点是那句声称 规则禁止的不是“隐藏差评”这个动作本身,是“隐藏了差评还宣称这里展示的是全部”。压制加上声称,两个要件缺一不可。 这个结构和上一节讲的那些平台数据其实是同一回事——问题从来不在于过滤,在于过滤之后还把结果当成未过滤的呈现。 ## 七条例外的共同点 规则列了允许不展示的情形:包含商业秘密或机密信息、包含诽谤骚扰淫秽内容、包含他人的个人信息或肖像、带有种族性别等歧视内容、内容明显虚假或误导;此外还有卖家有合理理由相信这条是假的,以及评价与所售商品完全无关。 规则引擎里的条件也该按同样的标准审一遍。目录规则和购物车规则怎么配 (https://zhangwenbao.com/magento-2-catalog-cart-price-rules-coupon-promotion-engine-operations.html)那篇里,最容易出错的就是条件之间的优先级,因为优先级会悄悄把某一类订单整个排除掉。 ## 把七条读一遍,会发现它们共享一个前提 规则原文写得很直白:只要扣留评价的标准是对所有提交的评价一视同仁地适用、不考虑情感倾向,就不算按评分或负面倾向压制。 换句话说,能不能藏,取决于你的筛选规则里有没有出现“评分”和“情绪”这两个变量。这一条是可以自查的:把审核规则打印出来,逐条看有没有哪一条只对差评触发。 ## 顺手说一下这一条和自家站点的关系 很多独立站的商品页只展示精选评价,这件事本身完全合规——只要你没有暗示这是全部。问题出在措辞上:写“顾客评价”是安全的,写“全部顾客评价”就把自己架上去了。 精选这个动作本身没问题,问题在于它替谁做了选择。产品详情页怎么摆脱供应商文案 (https://zhangwenbao.com/product-detail-page-onpage-seo-unique-content-engineering.html)那篇讲的是同一层:页面上每一块内容都在替用户做减法,做减法的依据必须说得出来。 更容易出事的是排序。默认按“最有帮助”排,而“有帮助”的投票本身可能被引导过;默认按星级从高到低排,等于把压制做在了排序里而不是过滤里。这一层规则文本没有明说,但它和465.7(b)想防的是同一件事。 ## 还剩两节,一句话各说清 465.6禁止把自己控制、拥有或运营的网站包装成独立第三方测评——自建对比页、自家的“行业测评站”,如果不说明关系就落在这一节里。465.8禁止买卖虚假的社媒影响力指标,粉丝、点赞、播放、转发都在列举范围内。 独立性这条线,搜索引擎那边也在画。Google给第三方工具划的信任边界 (https://zhangwenbao.com/google-third-party-seo-tools-aeo-geo-guidance.html)值得对照读一遍,两边关心的都是同一件事:这个结论是谁给的,给的人和被评的人是什么关系。 ## 把这一节能直接变成动作的部分拎出来 四条:活动文案里把“好评”改成“评价”或“体验”;请人写评价时把“请注明与本店的关系”写进去并留痕;把评价审核规则通读一遍,确认没有任何一条只对低分触发;自建的测评或对比页面上,注明这是本站的内容。 再补第五条,它不在规则里但同样重要:检查评价邀请的发送名单,确认它不是按满意度筛过的。这一条最容易漏,因为它藏在自动化流程里,不在任何一份文案里。 四条加起来不到一小时,而且不需要任何工具。它们改变的不只是合规风险,更是你自己那份评价数据的可用性——本文前四节讲的所有偏差,源头都在这四条上。 ## 保哥踩过的坑:一笔5美元的余额,把主推位选反了 ## 先说这个站是干什么的 一个做比例模型和收藏级手办的跨境独立站,卖1比18的汽车模型、树脂雕像、静态模型套件那一类,主要打北美和西欧,客单价从60美元到800多美元都有,团队二十来人,站点加运营五六个。 这类品类是典型的窄而深。怎么选一个能做起来的niche市场 (https://zhangwenbao.com/niche-market-selection-ai-mode-7step-12week-decision.html)里我提过,这种品类的好处是竞争少、客户忠诚,麻烦是每个单品的数据量都薄,任何一点扰动都会被放大。 ## 为什么这类站特别值得拿来讲评价 因为它的商品结构是极长尾的:品类下面几千个型号,每个型号的销量都不大,一个具体型号页面上通常只有个位数的评价。 而这正是关键:当一个页面只有5条评价时,多一条假的,权重是那些有5000条评价的页面的一千倍。换句话说,长尾品类的“造假单位收益”天然就比大众品类高出几个数量级——本文第一节那套判据,在这里的敏感度最高。 长尾的这个性质是双刃的。长尾关键词从挖到淘汰的全生命周期 (https://zhangwenbao.com/long-tail-keyword-lifecycle-management-discovery-to-retirement.html)里,收益最高的那一段也是数据最薄的那一段,判断只能靠少量样本,错了也最难发现。 ## 他们做了一件看上去完全正当的事 为了把评价数补起来,运营上了一个活动:买过的顾客写评价,送5美元店铺余额。全站统一,不分商品,不设上限,做了半年。 这类活动本身是常规动作。会员日营销怎么从策略设计做到复盘 (https://zhangwenbao.com/ecommerce-membership-day-marketing-guide.html)那篇里的五个步骤,最后一步就是复盘,而复盘要看什么,往往决定了这次活动到底留下了资产还是留下了噪声。 ## 数据看起来很成功 半年下来,每个在售型号的平均评价数从2.3条涨到6.8条,涨了195.7%;全站平均星级从4.31涨到4.72,涨了0.41星。 两个指标同向大涨,团队认为这是过去两年做得最漂亮的一件事。季度复盘上这一页停留时间最长,没有人提问。 ## 然后他们用这份数据做了一个决定 下一季度要选三个主推型号,吃掉首页焦点位、邮件头条位和付费投放的主要预算。选品依据定得很清楚:星级4.8以上,在此基础上按评价数排序取前三。 这个规则本身没什么可挑的。星级代表满意度,评价数代表被验证的充分程度,两个都高,听起来就是最稳的选择。 用单一来源选品是危险的。选品的三角验证 (https://zhangwenbao.com/dtc-product-research-3-triangulation-seo-amazon-review-small-budget-test.html)之所以要三条腿,就是为了避免这种情况:一条腿被污染了,另外两条能把它拽住。 ## 三个月后的结果 三个型号里有两个卖崩了。不是没卖动,是卖动了之后退货率是全站平均的三倍,算完退货和往返运费,那两个型号的主推位是亏的。 退货率是这里唯一说了实话的指标。跨境退货率怎么从尺码和产品图上降下来 (https://zhangwenbao.com/cross-border-ecommerce-reduce-return-rate-prevention.html)那篇里,退货原因的分布往往比退货率本身有用,因为率是结果,分布才指向动作。 第三个还行,但也没到值得占首页焦点的程度。 ## 当时的第一反应是找选品的毛病 会上讨论的方向是选品眼光、产品页描述、尺寸标注、模型比例说明,甚至讨论了要不要换供应商。没有一个人怀疑那两个指标本身。这很正常——那两个数就摆在那儿,谁都看得见,它们涨了也是事实。 价格带这个变量当时没有人提。从成本加成到价值定价的决策框架 (https://zhangwenbao.com/dtc-pricing-strategy-cost-plus-value-based-framework.html)里我强调过,价格带不只是定价问题,它还决定了买家画像、决策周期和对评价的依赖程度。 ## 破局的人是新来的运营,她要做的是另一件事 她进来接的活是重排评价邀请的发送节奏,属于日常优化。做之前她想先摸清楚这半年评价到底是怎么长起来的,于是把活动期内产生的评价按型号导了一遍。 ## 第一眼看到的是分布不对 新增的评价不是均匀铺在所有型号上,而是高度集中在便宜的那一批。60到120美元区间的型号,评价数增长的贡献占到了七成以上,而这个区间的销售额只占全站的三成不到。 ## 第二眼看到的是文案 她把那个活动的落地页和邮件模板翻出来,标题写的是四个字:分享好评。正文里还有一句“把你的五星留给我们”。 这一句话就把整个活动从“请你说说”变成了“请你说好”。本文上一节讲的那条红线,就画在这个位置上——报酬能不能挂在评价的倾向上。写这句文案的同事完全是好意,他只是想让文案更有号召力。 ## 但真正的问题不在这句话上 文案是问题,可它解释不了分布。就算文案改成中性的,也不该出现七成评价集中在低价段这种情况。 她算的下一个数才是关键。 ## 同一笔5美元,在不同商品上根本不是同一笔钱 商品价位 | 5美元的相对力度 | 大致相当于 | 60美元 | 8.33% | 一次不小的折扣 | 120美元 | 4.17% | 一顿外卖 | 300美元 | 1.67% | 聊胜于无 | 800美元 | 0.62% | 基本没感觉 | ## 两头一比,差了13.33倍 最低价档和最高价档之间,同一笔5美元的相对力度差13.33倍。一个全站统一、看起来最公平的激励政策,实际上是一层偏向低价商品的隐形权重。 高客单价那头受的影响完全不同。高客单价独立站为什么靠内容和信任取胜 (https://zhangwenbao.com/high-ticket-dtc-content-trust-geo-strategy.html)说的就是这件事:几百上千美元的决策,5美元的余额撬不动,能撬动的是一段能打消疑虑的说明。 于是“评价数最多”这个排序条件,测的根本不是“哪个商品被验证得最充分”,测的是“哪个商品上的顾客最容易为5美元动笔”。这两句话在报表上长得一模一样。 ## 星级那一栏也被同一个原因抬起来了 拿到余额的人给分平均更高,这是意料之中的。而低价段拿余额的人比例远高于高价段,所以低价段的星级被抬得更多。 两个指标,一个原因,同向变化。 ## 这一条是整件事里最值得记的 > 两个指标同时往好的方向走,是最让人放心的形状——大家会说“互相印证”。可如果它们被同一个原因驱动,同向恰恰是最没有信息量的:它不是两个证据,是同一个证据出现了两次。 两个数被同一个原因推动,在财务模型里更隐蔽。算LTV老是算错的那几个原因 (https://zhangwenbao.com/dtc-ltv-calculation-cohort-roas-attribution.html)里,最常见的一个就是把留存和客单价当成两个独立变量,而它们经常同时被一次促销抬起来。 要真的相互印证,两个指标得来自不同的机制。评价数和星级都长在“谁愿意写评价”这一件事上,天然就不是独立的。 ## 为什么半年里没有任何一份材料预警 这件事最费解的地方在这儿。他们的数据不算薄,事后一份份翻回去,前四份全是零。 ## 第一份:退货率总数 全站退货率在活动期内没有明显变化。原因很朴素——低价段的销量占比本来就低,它的退货波动被高价段稀释掉了。总数是个平均值,而平均值最擅长的事就是把结构性的问题抹平。 ## 第二份:广告后台 投放数据在活动期内没有任何拐点。这也正常,因为活动动的是评价,不是流量,广告后台压根测不到这一层。 后台看不见,不代表没发生。多触点归因模型怎么选才不被最后一次点击骗走预算 (https://zhangwenbao.com/dtc-multi-touch-attribution-model-selection.html)里的核心问题也是这个:一个渠道在模型里没有位置,它做的事就永远不会出现在报表上。 ## 第三份:流量分析 低价段商品页的自然流量确实涨了一些,但幅度落在正常波动区间里,谁看都不会觉得异常。 ## 第四份:A/B测试 他们做过一次评价展示位的测试,结论是样本量不足、无法得出结论。这类结论在报告里通常就是一句话带过,没人会追问“不足”背后有没有别的信息。 ## 第五份材料在另一个部门,而且它不是行为数据 真正一查就露的那份东西,在财务那边:店铺余额的发放与核销台账。 ## 为什么偏偏是它 前四份材料有一个共同前提——它们记录的都是用户在你的商品结构里的行为:来了多少、看了什么、买了没有、退没退。而这份台账记录的不是行为,是钱的去向。 钱这个东西有一个别的数据都没有的性质:它必须对账。发出去一笔要记,核销一笔要记,月底必须平。没有人可以只发不记,也没有人可以少记一笔——不是因为财务同事更认真,是因为对不上就过不去。 库存台账有同样的性质,理由也一样。库存管理为什么必须防超卖 (https://zhangwenbao.com/woocommerce-inventory-stock-management-backorder-low-stock-overselling-operations.html)说到底是因为账面数字要跟仓库里的实物对上,对不上就会有人来找你,而行为数据对不上没有任何人会来找你。 ## 由此得到本节最实用的一条 当你怀疑一份行为数据被激励污染了,最快的验证不是去查那份数据,是去查那笔钱:把发出去的激励按商品、按人群分一遍,看它是不是均匀落在你的商品结构上。 他们后来做了这件事,花了大半天。结果和评价数的分布几乎完全重合:七成多的余额发在了三成不到的销售额上。钱的账本和评价的账本,是同一张图。 ## 那它为什么半年里没被人看过 两个原因,都很实在。第一,它是成本,不是收入,归财务管,而财务不看商品结构;第二,它是按笔记录的,台账上有金额、有时间、有订单号,唯独没有商品分类那一列。 要按价位段分一遍,得手工做一次订单号和商品的关联。不是查不到,是没人有理由去做这次关联——在此之前,谁都不知道要查什么。 ## 真正在变的东西,那条曲线从头到尾测不到 把评价数按价位段拆开之后,那两个卖崩的型号的真实身份也清楚了:它们是入门款。买入门款的多半是第一次接触这个品类的人,对比例、尺寸、涂装工艺没有概念,收到实物之后落差大,退货率天然就高。 第一次买的人最需要的是把预期说清楚。退换货政策页怎么写才既是信任背书又能拿流量 (https://zhangwenbao.com/dtc-return-refund-policy-page-seo-trust-conversion-design.html)那篇里,写得越具体退货率越低,听起来反直觉,实际是因为具体的描述会先劝退一部分不合适的订单。 这件事和评价一点关系都没有,评价数再多也测不出来。那条曲线测的是“哪些商品的顾客愿意为5美元动笔”,而他们拿它去回答“哪些商品值得压上季度预算”。 ## 最扎心的一击 按价位段分档重算,一共花了半天。四个数一个都没有被推翻:评价数确实从2.3涨到了6.8,星级确实从4.31涨到了4.72,两个涨幅都是真的。 变的只是那张排序表——加了一列价位段,前三名换了两个。就这一列,把一个季度的预算方向掉了个头。 ## 还有一个回环,我当时听完愣了几秒 这个团队一直很警惕外部数据。他们不信平台公布的行业星级基准,理由是“口径不清楚,谁知道怎么算的”。而他们自己那个4.72星的口径,从头到尾没有任何一个人写下来过。 不是隐瞒。是这条信息在流转过程中没有一个能挂住它的地方——策划活动的人知道有个5美元,做复盘的人只拿到了汇总后的星级,看复盘的人连有过活动这件事都不一定记得。 ## 说服会议的措辞,比结论本身更难 她第一次汇报时说的是“这个星级不可信,是刷出来的”。这句话的效果是零,甚至是负的。 汇报的措辞不是修辞问题,是能不能推动事情的问题。怎么把电商SEO汇报给老板才让他看见价值 (https://zhangwenbao.com/dtc-ecommerce-seo-reporting-stakeholder-communication.html)那篇里的原则只有一条:让对方不需要否定过去,就能同意接下来的动作。 因为“刷”这个字指控的是人。那个活动是市场同事策划的、主管批的、老板点头的,说它是刷出来的,等于说这几个人在造假。会议接下来半小时全部花在“我们到底算不算刷单”上,没人再关心主推位。 ## 第二次她换了一句话 她说的是:“这5美元在60美元的商品上占8.3%,在800美元的商品上占0.6%。我按价位段分开重算了一遍评价数,前三名换了两个,是这样。” 这句话里没有任何评价,只有两个事实、一个动作和一个结果,而且那个动作是她自己做的。听的人不需要承认任何事情,也不需要为任何事情负责。会议自然转向了“那按新的算法我们该推哪三个”。 ## 后来改了四处 文案先改,把“分享好评”换成“说说你的使用体验”,把“把你的五星留给我们”整句删掉。改完之后评价数从6.8掉回4.1条,星级从4.72掉到4.48。 ## 掉下来的那0.24星,是这半年唯一被量出来的东西 这个数很难得。它不是估的,是把偏差源撤掉之后直接读出来的差值。在此之前,没有人能说出“我们的星级里有多少是激励带来的”,改完之后有了一个具体的数。 当然它不精确,中间还混着季节和商品结构的变化。但一个粗糙的实测值,比一句“应该有一些影响”有用得多。 顺便说,那0.24星如果换算成排序位置会更吓人:在他们那个品类里,4.48和4.72之间挤着几十个型号。星级这个东西在小数点后第二位上决定名次,而多数人的直觉还停留在“四星半和五星差不多”。 ## 第二处:激励按价位分档 低价段2美元,中价段6美元,高价段15美元,让相对力度大致拉平在3%上下。这样5美元那层隐形权重就没有了。 ## 第三处:选品规则加了一列 主推位不再看全站评价数排名,改成先分价位段,段内再排。一个能挤进段内前三的入门款和一个能挤进段内前三的高价款,含义完全不同,而全站一起排的时候它们长得一样。 ## 第四处:台账加了一列商品分类 财务那边加这一列几乎没有成本,订单号本来就在。加完之后,每个月的余额发放可以直接按价位段出一张分布图,不需要再做手工关联。 ## 最意外的收益不是这四条里的任何一条 是会上讨论评价数据的顺序变了。以前是先说哪个型号评价好,然后有人问为什么;现在是先问这个型号在哪个价位段、那个段当期的激励力度是多少,然后再说评价好不好。 顺序换一下,“这个型号评价最好”这句话就没法脱口而出了。而说不利索,恰恰就是目的。 ## 哪些自查动作,能在半天之内做完? ## 先说这六件事的排序依据 下面六个动作,前五件加起来不到一小时,第四件半天,最后一件零成本。排序不是按重要性,是按拿到成本乘以结论能不能直接变成动作这两个维度相乘的结果。 按成本和产出排序,这是我做任何清单时的习惯。开站之前那六项自评 (https://zhangwenbao.com/before-seo.html)也是这么排的:排在前面的不是最重要的,是那些答错了会让后面全部白做的。 换句话说,排在前面的不一定最深刻,但一定是最划算的。 ## 第一件:数一数,提供一条数据的人能拿到什么 10分钟。打开那份数据的参与说明、报名页或者活动条款,找报酬那一栏:多少钱、什么形式、什么时候发。 查证类的动作最适合交出去。内容运营和SEO那七个协作动作点 (https://zhangwenbao.com/content-operations-seo-collaboration-7-actions-topic-audit-22weeks.html)里,凡是不需要判断的都固化成了模板,因为模板化的前提就是这件事不依赖做的人是谁。 排第一是因为它完全不需要判断力——有没有报酬是客观的,多少钱也是客观的,任何人查出来的结果都一样。查不到就写“未披露”,千万别留空,空着过两个月你会以为自己查过。 ## 报酬的形式比金额更值得抄下来 现金、礼品卡、店铺余额、抽奖资格、积分、会员等级、优先购买权,都算。越是不像钱的形式,越容易在讨论里被当成“不算激励”。本文上一节说过,规则里那份清单的最后一项甚至包括“另一条评价”。 自动化流里发出去的权益最容易漏记。那七种高回报的自动化流 (https://zhangwenbao.com/dtc-klaviyo-7-high-roi-automation-flows.html)里有好几种自带优惠,它们通常不走活动预算,也就不会出现在任何一份活动台账上。 ## 第二件:问一句,我能不能自己报名参加 5分钟,通常一眼就能看出来。答案分三种:能自己报名、需要被邀请、需要通过某种线下核验。 这一句比第一句更硬,因为它决定的不是价格而是产能。能自己报名意味着一个人可以变成一百个人,而报酬再低,乘以一百也不低了。这就是本文第一节那个1364倍的主要来源。 ## 第三件:数一数,同一个人最多能提供多少条 10分钟。有没有上限、上限是多少、靠什么执行——是靠账号,靠手机号,靠支付账户,还是靠一句“请勿重复参与”。 大多数材料不写这一条,而不写本身就是答案。凡是认真设过上限的,一定会写出来,因为那是他们花了成本做的事,没有理由藏着。 执行方式也值得多看一眼。靠账号去重是最弱的,注册一个账号的成本接近于零;靠支付账户或者实名信息去重强得多;靠“被随机抽中才能参加”是最强的,因为它把去重做在了名单生成那一步,压根不需要事后识别。 去重强度和裂变系数是一枚硬币的两面。私域社群那五个维度的指标看板 (https://zhangwenbao.com/dtc-private-domain-community-5-dimension-metrics-ltv-cac-repurchase-engagement-virality.html)里,裂变系数越高的玩法通常去重越弱,因为去重会直接压住传播速度,这个取舍得摆到台面上说。 ## 顺便说一句,这三件事对自家数据同样适用 大部分人会拿这三句去审外部报告,其实审自己更有用。你的用户问卷发出去有没有奖励?同一个人能不能填两遍?填问卷的入口是不是挂在会员中心里,也就是说只有活跃用户才看得见? 审自家数据时,缺口往往在另一头。零点击时代的归因怎么补 (https://zhangwenbao.com/ai-search-attribution-zero-click-proxy-signals.html)讲的就是这种情况:不是数据被污染了,是有一大段行为压根没有被记录过。 第三个问题问的就是准入门槛,只不过方向反了——外部数据担心谁都能进,自家数据担心只有一小撮人能进。两种偏差的机制不同,但都能靠同一句话问出来。 ## 前三件合计25分钟,能得到什么 三个答案凑齐,就能给这份数据分个档:报酬低或没有、有条数上限、有准入门槛,三样齐全的可以当基准;缺一样的当线索;能自己报名而且没有上限的,不管方法说明写得多好,只能当行业动态读。 ## 第四件:把自己发出去的激励按商品分一遍 半天,六件里唯一能产出待办清单的,也是唯一需要跨部门的。 做法在上一节讲过:不要从营销看板做,从财务的发放与核销台账做。看板上的数字已经是加工过的,台账上的是原始的,而且必须对得上账。 ## 这一件真正花时间的地方 不是导数据,是做关联。台账通常只有金额、时间和订单号,没有商品分类那一列,得先把订单号和商品对上。这一步只需要做一次,做完之后让财务在台账里固化这一列,以后每个月自动就有。 做一次关联换长期可用,这笔账通常划算。上千篇旧内容怎么做留改并删转的决策 (https://zhangwenbao.com/content-audit-pruning-decision-system.html)也是这样,最花力气的是第一次把口径对齐,之后每季度跑一遍只要一个下午。 ## 看的时候只看一件事 把发出去的激励按商品价位段或者人群分组加总,和这些分组各自的销售额占比放在一起比。两个占比大致对齐,说明激励是中性的;明显偏向某一段,那一段的所有相关指标都要打折看。 模型站那次的结果是七成多的激励落在三成不到的销售额上,一眼就看出来了,不需要任何统计方法。 ## 第五件:把活动文案逐字过一遍 20分钟,零成本,但规避的风险最大。三个问题,对着活动方案打勾: 文案这一层的回报常被低估。从CTA到结账那三十个A/B测试方案 (https://zhangwenbao.com/ab-testing-ctr-conversion-optimization.html)里,改动最小的几条往往效果最稳,因为它们动的是理解成本,不是页面结构。 ## 三个问题 征集是发给所有买过的人,还是只发给评分高的那批?文案里有没有出现任何暗示希望得到正面反馈的词?拿到报酬的条件,是不是只跟“写了”有关,跟“写了什么”无关? 第一个问题最容易漏,因为它不在文案里,在自动化流程的筛选条件里。很多站点当初是作为“提高邀请转化率”的优化加进去的,加的时候完全没往这个方向想过。 ## 第六件:给常用数据源标一个档位 零成本,难在坚持。做法是给你经常引用的那几份材料——行业报告、平台基准、竞品数据、自家问卷——各标一个造假单位收益的档位,高、中、低三档就够,标在你存放它们的那个文档里。 ## 它的作用不是提供信息 标完之后你并不会知道任何新东西,因为那三个档是你自己刚刚判的。它真正的作用是在引用之前先让人停一下——一份材料旁边挂着“高”这个字,把它写进方案时总要多想半秒。而多想那半秒,就是全部目的。 让人停一下这件事,本身就有价值。A/B测试怎么做才不影响SEO (https://zhangwenbao.com/ab-testing-page-seo.html)那篇里的多数建议也不提供新信息,它们的作用是在上线之前多一道确认,而那道确认拦下的东西比任何优化都值钱。 ## 六件事放在一张表里 动作 | 耗时 | 需要谁配合 | 产出是什么 | 查报酬是多少 | 10分钟 | 无 | 一个数或者“未披露” | 问能不能自己报名 | 5分钟 | 无 | 三选一的答案 | 查有没有条数上限 | 10分钟 | 无 | 一个上限或者“未写” | 把激励按商品分一遍 | 半天 | 财务 | 一张分布对比,可能带待办 | 逐字过活动文案 | 20分钟 | 市场 | 三个打勾结果 | 给数据源标档位 | 零成本 | 无 | 一个提醒,不是信息 | ## 这张表里最容易被跳过的是第四行 因为它是唯一要跨部门的,而跨部门的事总是排在最后。但它也是唯一能拿出证据的一件——前三件得到的是判断,第五件得到的是风险规避,只有第四件能在会上摆出一张图说“钱是这么分布的”。 如果时间只够做一件,做第四件。如果时间只够做十分钟,做第二件。 ## 这六件事该挂在哪个流程上 光靠自觉是活不下去的。前面几批分别把类似的检查挂过组件库、验收用例模板、设计评审、采购问卷、客服工单模板、发布检查清单、上线工单、季度规划文档、竞品调研模板、立项申请单、测试假设登记表、设计规范条目、以及指标定义文档。 ## 这一批挂在促销活动申请单上 具体说,是预算审批表里“激励发放”那一栏,加一行必填:本次活动每位参与者最多能拿到多少,同一个人最多能参与几次,参与门槛是什么。 ## 选它的理由很硬 > 设计激励的人一定会来填这张表,因为不填财务不给预算。他可能不写周报、不发群公告、不更新活动文档,但他必须把发放规则写进预算申请,否则钱批不下来。 这是整条链路上唯一能保证“设计收益结构的那个人”和“这行字”必然相遇的地方。前面几批挑卡点的逻辑都是这一条:不找最该记录的地方,找那个人非去不可的地方。 ## 怎么设才不会被绕开 不设选项校验,不设审批环节,不设格式要求。判定只有两种:填了和没填。一旦引入审核,就会有人为了不被卡而写得含糊,含糊的记录比没有记录更麻烦,因为它看起来像是有。 ## 四条边界,得提前说清楚 第一,它只对有激励的数据有效。没有任何报酬的数据同样会有偏差,只是偏差的来源换成了别的,这套东西治不了。 ## 第二条边界最容易被误会 填了不等于设计合理。这一行字保证的只是信息被记下来了,它不判断5美元该不该发、该发给谁。真正做判断的是第四件事那次分组比对,而那件事需要活动结束之后才能做。 ## 第三条边界 它治的是“这个数字里有多少是激励带来的”,治不了“这个指标该不该是核心指标”。模型站那次,就算把激励拉平了,用评价数决定主推位这件事本身还是可以讨论的——那是另一个问题。 ## 第四条边界 标出了不等于修好了。要真的把偏差拿掉,得重新设计激励档位,让相对力度在各个价位段拉平;而拉平之后,前后两段数据仍然不可直接比较,这一点和跨口径的历史数据是同一类麻烦。 ## 口径迁移这件事必须提前讲 推这套东西的时候,最好在第一次会上就说清楚:可用的指标一条都不会少。变的只是一部分数字前面多一句“活动期内”,一部分“增长”要改称“激励期增长”。 而这会让一小部分“持续变好”降级成“投了钱之后变好”。按我这些年的经验,第一次做完,核心指标里被标记为明显受激励影响的通常在两到三成之间。提前说了是预期管理,不说就是事故。 ## 措辞比动作本身更重要 上一节讲了那个反例:说“这个星级是刷出来的”,半小时会议全部花在“我们算不算刷单”上。这里再补两条本批想清楚的。 ## 越是两个指标同时变好,越该先查 单个指标涨了,总会有人问一句为什么;两个指标一起涨,反而没人问了,因为大家会说“互相印证”。 可如果这两个指标长在同一件事上,同向就不是印证,是同一个证据被数了两遍。判断办法很简单:问一句“这两个数会不会被同一个原因同时推动”,答案是会,那它们就不能互相当证据。 ## 做完这六件之后,隔多久复查一次 前三件跟着材料走,每次引用一份新材料就做一遍,做多了会变成本能,看到一个百分比手就先去找报名页。第四件建议一个季度一次,因为激励政策的调整通常是按季度走的。 第五件在每次活动上线前做,属于上线检查的一项。第六件没有周期,它是一次性的标注,只有在换了新的数据源时才需要补。真正需要设周期的只有第四件,其余五件要么跟着事件走,要么根本不需要重复。 ## 怎么判断这套东西在你这儿有没有生效 有一个很土但很准的信号:会上有人开始主动交代口径了。不是被问了才说,是在报数字的时候顺手带一句“这段时间有活动”“这个是段内排名”。 这个信号比任何检查表的完成率都可靠,因为它意味着这件事已经从流程变成了习惯。流程要靠人推,习惯不用。反过来,如果推了两三个季度还是只有你一个人在问口径,那多半是挂错了卡点——它没有长在那些人非去不可的地方。 ## 越是长尾的商品越该查,可现实里恰恰相反 长尾商品页面上评价少,单条评价的权重高,造假的单位收益天然更高。可正因为每个型号销量都不大,没有人有动力去查一个季度只卖几十件的型号的评价。 长尾页面还有另一重身份。AI来的流量转化率高,可落地页接不住 (https://zhangwenbao.com/ai-referral-traffic-conversion-landing-page.html)说的正是这批页面:它们被引用的概率在上升,而它们恰恰是最少被人手工检查过的那一批。 于是最脆弱的地方,恰好是最没人看的地方。而主推位的选拔往往就是从这堆没人看过的数据里挑出来的——这正是模型站那次出事的完整机制。 ## 这套判据在什么地方会失灵? ## 先说一个它完全管不到的场景 没有任何报酬的数据,照样有偏差,而且往往更难查。免费的评价里,愿意动笔的人天然是两头的人——特别满意的和特别生气的,中间那批人默默用着,一个字不写。 自愿反应偏差没法靠算账解决,只能靠结构补。独立站信任怎么建的那七层结构 (https://zhangwenbao.com/dtc-ecommerce-trust-7tier-eeat-mechanism.html)里,评价只是其中一层,剩下几层存在的意义就是当评价这一层不可靠时还有别的东西可看。 这种偏差叫自愿反应偏差,它跟钱一点关系没有,所以本文这套判据一句话都说不上。它需要的是另一把尺子:看评分分布是不是两头高中间低。 有意思的是,激励恰恰能治这一种。给所有购买者发一笔中性的报酬,请到的正是那批本来不打算开口的中间人群。所以“有报酬”不必然是坏信号,它有时候是在修另一种偏差——前提是那笔报酬没有跟评价的倾向绑在一起。 ## 第二个失灵的地方:有报酬不等于有造假 得说句公道话。拿了5美元认真写了两百字的顾客,是大多数。激励改变的是“谁会写”,不必然改变“写的人说不说实话”。 模型站那次也是这样:没有任何证据表明有人编造了使用体验,所有评价背后都是真实订单。坏掉的不是评价的真实性,是评价数这个指标的可比性。这两件事经常被混为一谈,而它们要用完全不同的办法处理。 ## 第三个:对平台自己公布的数据只能用一半 平台不是被一条一美元的报酬驱动的,它被别的东西驱动:形象、监管压力、竞争位置。所以问“提供一条数据能拿多少钱”对它没有意义,得换成“报出这个数对它有什么好处”。 平台愿意给什么、不愿意给什么,本身就是信息。归因数据平台为什么不会给你 (https://zhangwenbao.com/ai-attribution-referral-incrementality-influence.html)那篇拆过两层,结论也是一样的:先想清楚给你这个数对它有什么好处,再决定怎么用。 这就是本文第二节做的那件事——四家全部选择了“我删了多少”这个跟自身利益同向的口径。判据的形式变了,问的还是同一件事:这个数是谁在什么激励下生产出来的。 ## 第四个:对已经聚合过的数字无能为力 你在某篇文章里看到一个百分比,它来自一份报告,报告来自一次调查,调查来自一家供应商的样本池。收益结构在三层之外,而链条上每断一层,就少一次核对的机会。 多个来源不等于多个独立来源。十种语言里十份口径一致的资料 (https://zhangwenbao.com/untranslated-invisible-ai-retrieval-translated-content-tradeoff.html)回头一查是同一篇英文翻出来的,看起来是十次互相印证,实际上只有一次。 这时候唯一能做的是往回追,追到能看见报名页为止。追不到就按最坏情况估——一份追不到源头的百分比,默认它的准入是零门槛,这个假设通常不冤枉人。 ## 第五个:算完发现可以忽略,也是结论 这一条容易被当成失败。花20分钟查了三样东西,结论是“报酬很低、有次数上限、需要邀请”,那这次自查什么都没查出来。 可它的价值恰恰在这儿:你可以放心地往下走,而不是带着一个悬着的疑问做决定。一个被排除的怀疑和一个被证实的问题,对决策的贡献是一样的,只是前者不好意思写进汇报。 ## 接下来回应三种常见的反驳 这套东西讲给团队听,通常会遇到三句话。每一句都有道理,也都需要接住。 ## 第一句:照你这么说什么数据都不能信了 不是。这套判据的产出是分级,不是否定。三问全过的可以当基准用,过两问的当线索用,一问不过的当行业动态读——三种用法都是“用”,只是承重不同。 真正该警惕的是反过来的那种态度:因为无法证明它是假的,所以当成真的用。无法证伪和已经证实之间,隔着这份材料的全部价值。 分级这件事,做手法判断时也一样。黑帽白帽灰帽到底怎么分 (https://zhangwenbao.com/black-hat-white-hat-gray-hat-seo-comparison-risk-decision-line.html)那篇里我没有给非黑即白的答案,给的是一条按风险和可逆性排的线,因为现实里的选择几乎都落在中间。 ## 第二句:我们没有能力做这些分析 前三件事不需要任何能力。查报酬多少、问能不能自己报名、看有没有次数上限,全部是查证,不是分析。一个刚入职的实习生做出来的结果,和一个十年经验的分析师做出来的结果,应该是一样的——如果不一样,说明有人查错了。 需要能力的只有第四件,而第四件的门槛也不高:把两列数据分组加总,放在一起比。 ## 第三句:交给监管管就好了 这句话最经不起推敲,因为本文第四节已经把账算过了。规则上限是53088美元,但一条算不算一次违规,规则说明里写的是“由法院决定”。 更现实的一点是:监管管的是欺骗,管不了不可比。模型站那次,从头到尾没有一条评价是假的,没有任何一条规则被违反,而那个季度的预算方向仍然是反的。规则能挡住恶意,挡不住结构性偏差。 ## 现在做一件必须做的事:用这套判据审一下本文自己 写到这儿如果不回头审一遍,前面所有的话都站不住。本文用了三类材料,三类都有立场。 ## 第一类:那家调查机构的方法问答 它是当事方。它在解释为什么自己的方法比别人的好,动机再强不过了。那两个数字——对手月入30000美元、自己月上限22美元——摆出来的方式本身就是在论证。 当事方给的材料未必不能用。图片越假信任越低 (https://zhangwenbao.com/b2b-image-authenticity-trust-6-types-real-photos-eeat-visual-signal.html)那篇里用的很多例子来自品牌方自己,取的都是那种能被独立核对的部分——拍摄地点、设备型号、可以比对的实物细节。 所以我的处理是:只用它给的原始数字,不用它的结论。1364倍这个比值是我自己除的,三个杠杆的拆解是我自己做的,而“限制次数比抬高单价有效”这个推论,原文一个字都没提。 ## 第二类:监管机构的规则说明 它在论证自己制定的规则值得做。十年收益估到2695亿,一次性成本估到0,这个组合本身就说明了这份文件的方向。 我从里面取的东西有个共同点:全部是那种对它自己不利或者至少中性的部分。比如四个来源差十倍这件事,是它自己承认的;比如换个系数结论缩水三分之二,是它自己算的;比如那个74%的假设没有来源,是我从它自己的行文里挑出来的。 ## 第三类:平台的透明度报告 方向最明显,报的全是“我拦下了多少”。所以我只用它的绝对数,不用它的比例。2.6百万、3.3百万、5400万、17%,这些是原始的;6%是它算的,而我把它重新算了一遍,发现是5.633和6.111。 绝对量比比例可靠,这一条在评估品牌信号时特别好用。品牌信任正在取代排名 (https://zhangwenbao.com/ai-agent-brand-trust-new-ranking-factor.html)那篇里我更看重被提及的次数和场合,而不是各家工具算出来的所谓可见度分数。 唯一例外是那个54%的处理率——那一条对它不利,所以我直接用了。一份材料里凡是出现对自己不利的数,那部分通常比其余部分可信。 ## 把三类材料的处理办法列成一张表 材料 | 它的立场 | 可以拿走的 | 必须自己重做的 | 调查机构的方法问答 | 论证自己的方法更可靠 | 两组原始数字 | 倍数、杠杆拆解、推论 | 监管机构的规则说明 | 论证这条规则值得做 | 条文原文、对自己不利的部分 | 成本收益结论、系数选择 | 平台的透明度报告 | 展示自己拦得住 | 绝对量、对自己不利的数 | 所有比例 | ## 第三列和第四列的分界线在哪儿 大致是这样:凡是采集得到的、只需要如实记录的,可以拿;凡是需要选择口径、选择分母、选择情景才能得出的,都要自己重做一遍。 绝对量属于前者——删了330万条就是330万条,编不了也没必要编。比例属于后者,因为分母是选出来的。这一条不只对本文这三份材料成立,对绝大多数二手材料都成立。 ## 还有一条边界,跟时间有关 今天零门槛,不代表去年也是。有些平台早年是完全开放注册的,后来才加上验证;有些机构的面板换过供应商。你查到的收益结构是现在的,而你手里那份数据可能是三年前采集的。 同一个东西在不同时点上不是同一个东西。过期域名买来之后信任能不能继承 (https://zhangwenbao.com/expired-domain-reuse-redirect-seo-trust-transfer-mechanism.html)也是一样的问题:域名没变,但它背后那串历史随时可能已经换了一茬。 这一条没有省事的办法,只能看那份材料自己有没有交代采集时点,以及那个时点的规则是什么样。查不到的时候,至少要在心里把结论的置信度往下压一档。 ## 把这三段收成一句 有立场的材料不是不能用,是不能用它的结论。原始数字、绝对量、对自己不利的部分,这三样可以拿;比例、推论、总结句,这三样得自己重做一遍。 这条规矩听起来很累,实际做起来大部分时候只是一次除法。 而且它有个副作用值得一提:自己重算过一遍的数字,你会记得住,也敢在会上被追问。直接抄来的数字则相反,被问一句“这个怎么来的”就只能说“报告上写的”。 ## 还有一类材料本文没碰,但值得提一句 行业白皮书和厂商报告。它们通常不给报名页,因为受访者是销售团队从客户名单里请来的,报酬是一份定制版报告或者一次行业沙龙的席位。这种报酬不是钱,判据的第一句问不出东西。 但第三句照样管用:能不能自己报名。答案是不能,只能被邀请——而邀请名单来自现有客户。准入门槛很高,可门槛把守的方向是反的:它挡住的不是造假者,是所有不用这家产品的人。结论会偏向哪边,不用算也知道。 ## 最后说一处留白 那条规则的九节里,465.3是空的,只写着“保留”两个字。立法文本里的这种留白通常有两种含义:要么是原来有内容后来删掉了,要么是给还没想清楚的东西预留了编号。 不管是哪一种,它都在提醒一件事:这套规则本身还在动。而本文所有关于罚款、关于计量单位、关于例外条款的讨论,都是在一个还没定型的框架上做的。 ## 再把三句判据说一遍 提供一条数据的人能拿到多少钱;同一个人最多能提供多少条;想进来要先付出什么。三问全过当基准,过两问当线索,第三问答“能自己报名”的只能当动态读。 ## 粗筛只有一句 这份数据,我自己能不能报名进去贡献一条。如果能,那想造假的人同样能,而且他比你更有动机、更有工具、也更有时间。这句话不需要打开任何附件,通常在报名入口那一屏就有答案。 它替代不了完整的三问,但在时间只够问一句的场合,它是信息量最大的那一句——因为准入门槛一旦是零,后面两句问出什么答案都救不回来。 ## 核心那句换个说法再说一遍 方法论文档写的是发布方希望你相信的东西,收益结构决定的是造假者实际会怎么做。前者要读,后者要算,两者冲突时以后者为准——因为造假者不读方法论文档。 ## 还有一句是本文写下来才想清楚的 数据质量这件事,长期以来被当成一个检测问题:怎么把假的挑出来。而本文翻过的所有材料指向的都是另一个方向。 信任飞行员把自动检出率提了两成,抓到的比例几乎没动;靠读内容识别假评价的准确率是57%,识别机器写的文字是50%到52%;而那家调查机构根本不做检测,它只是让你没法自己报名。 ## 检测和准入,是两种完全不同的成本结构 检测的成本随对手的进化持续增长,永远没有做完的一天;准入的成本主要发生在改造的那一次,之后就固定了。代价是准入会把一部分真实的声音也挡在门外,而这笔代价是要真金白银付的——概率抽样的样本贵得多,贵的就是这一段。 ## 放到自己站上,这个取舍是同一道题 你可以花力气识别哪些评价是刷的,也可以把评价入口改成只有完成订单的账号才能写、每个订单只能写一条、报酬跟写不写有关跟写什么无关。前一条永远做不完,后一条改一次管很久。 往结构上走还有一条更长远的路。可验证的出处正在成为新的信任货币 (https://zhangwenbao.com/content-provenance-c2pa-trust-currency-geo.html)讲的就是这个方向:与其事后判断真假,不如让内容在生成的那一刻就带上可核对的来源。 模型站最后改的那四处,全部属于后一类。它们没有识别出任何一条假评价——因为压根就没有假评价——但它们让那份数据重新变得可以拿来做决定。大部分时候,这才是我们真正需要的东西。 ## 常见问题解答 ## 我们站上的评价本来就少,是不是干脆别做激励了? 不建议一刀切。评价数太少本身就是个真问题,长尾商品页面上只有两三条评价,转化会明显吃亏,这个损失是实打实的。真正要改的不是做不做,是怎么做。三条就够:报酬只跟“写了”挂钩,跟写什么无关;发送名单覆盖所有购买者,不按满意度筛;报酬按客单价分档,让相对力度大致拉平。做到这三条,激励带来的是更多的样本量,而不是更偏的分布。另外提前把活动的起止日期记在指标文档里,将来看这段数据时至少知道它跟别的时段不可比。真正要避开的只有一种做法:全站统一金额,加上一句“分享你的好评”。 ## 我们已经做过好几轮有奖评价了,历史数据还能用吗? 分两种用法。用来看大方向没问题,比如判断这两年整体口碑是变好还是变差,因为量级差异通常大于激励带来的偏差。用来做商品之间的横向比较就要当心,尤其是价位跨度大的品类——同一笔奖励在便宜商品和贵商品上的相对力度可能差十几倍,横向排名会被这层隐形权重整个拧过来。稳妥的做法不是回头重算,而是把每一轮活动的起止时间标出来,在这些时段内部只做同价位段的比较。最省事的一步其实是把奖励发放台账按商品分组导一遍,看它偏向哪一段,偏得越厉害,横向比较越不能做。 ## 引用一份行业报告时,怎么快速判断它值不值得深查? 看它有没有交代受访者是怎么来的。写明了“随机抽样”“受邀参与”“来自某某面板”的,可以往下看;只写“回收有效问卷若干份”而不说这些人从哪儿来的,基本就到此为止了。第二个信号是有没有报酬说明——认真设计过激励结构的机构通常会写,因为那是他们的成本项,没有理由藏。第三个更快:搜一下这份报告的参与入口,如果你能找到一个任何人都能点进去填的链接,那准入门槛就是零。这三步合计不超过十分钟,而且完全不需要懂统计。判断标准不是它写得多严谨,是它有没有留下可核对的入口——愿意被核对本身就是最强的信号。 ## 美国那条规则对中国卖家有没有实际约束力? 有,而且路径不止一条。它管的是面向美国消费者的商业行为,卖家注册在哪儿不是免责理由;更直接的影响来自平台——各大平台的卖家政策通常会把监管要求转写成自己的规则,执行起来比监管快得多,后果也更即时,轻则商品下架,重则店铺受限。此外还有连带风险:如果你和第三方评价服务商合作,对方出了问题,追查通常会顺着订单和结算链条找上来。不过话说回来,就算完全不考虑法律层面,这条规则里那几个区分也值得照做,因为它们本质上是在教你怎么不把自己的数据搞坏。 ## 平台把我们的差评过滤掉了,该不该去申诉? 先分清是删除还是降权。被删除的评价通常有明确的违规理由,申诉有明确的对象;被降权的往往没有理由,因为平台自己都说那可能只是系统对这位评价者了解不够。后一种申诉的性价比很低,而且这个分类会随时间来回变,今天不推荐的过一阵可能自己就推荐了。更值得花力气的是另一件事:把平台展示的星级和你自己后台的原始评分对一遍,看看差多少。这个差值是你在这个平台上被过滤掉的那部分,知道它有多大,比让某一条回来重要得多。顺便说,如果你自己站上也有审核规则,趁这个机会检查一下有没有哪一条只对低分触发。 ## 团队担心改文案会让评价数掉下来,怎么说服? 别把这件事说成“合规要求”,那会让它变成一件不得不做的坏事。换个说法:掉下来的那部分,正好就是你一直想知道的那个数。模型站那次,文案改完评价数从6.8掉回4.1条、星级从4.72掉到4.48,那0.24星是他们第一次量出“我们的星级里有多少是激励带来的”。这个数在此之前谁都说不上来,只能靠猜。把它讲成一次免费的测量,比讲成一次损失容易接受得多。当然要提前说清楚预期:数字会掉,而且掉了不会自己回来,因为回来的那部分本来就不该在。同时把节省下来的预算挪到按价位分档的新方案上,团队会更容易点头。 ## 有奖问卷和有奖评价,是不是同一类问题? 机制相同,暴露面不同。两者都是用报酬改变“谁会开口”,所以本文那三句判据都适用。差别在于问卷通常是一次性的、样本封闭、只有你自己看;而评价是长期累积的、公开展示的、还会被搜索引擎和推荐算法读走。这意味着评价的偏差会被放大和固化——一条被激励抬上去的星级会持续影响后来者的判断,而一份问卷做完就归档了。所以优先级上评价要先治。另外问卷还有一个评价没有的风险:如果奖励和答案内容挂钩,比如“回答满意可抽奖”,那它污染的是结论本身。这一条更隐蔽,因为问卷不公开,没人能替你发现。 ## 我们用的是第三方评价插件,出了问题责任在谁? 从监管角度看,展示这些评价、并且从中获益的是你,所以责任很难推给工具。从实操角度看,更值得关注的是三件具体的事:这个插件的评价邀请是发给所有买家还是按条件筛的,它的默认文案里有没有暗示正面反馈的措辞,以及它的审核规则会不会因为分数低而自动扣留。这三项通常都在后台设置里,而且大多数站点从装上那天起就没动过默认值。花二十分钟把这三项过一遍,比研究责任归属有用得多。顺带把它导出的评价数据格式也看一眼,确认里面能不能带出商品分类和活动标记——不能的话,将来想按价位段分组会很麻烦。 ## 权威参考资料 ## 法规连表格长什么样都规定了,用户还是得开两个标签页自己比 - URL:https://zhangwenbao.com/product-comparison-field-alignment-disclosure-layers.html - 分类:DTC合规与法务 - 发布:2026-08-01 | 更新:2026-08-01 - 摘要:只卖几个套餐的行业为什么做出最难选的页面?从美国宽带标签规则的建立与撤回、欧盟比价工具义务,拆到独立站商品页的字段对齐与并排验收动作。 - 关键词:转化率优化,信息架构,商品页,合规披露 > **TLDR**:摘要:一个只卖五六种套餐的行业,做出了全网最难选的页面。美国监管把这张表的字段、格式、摆放位置、机器可读格式全部写进了法条,两年后一份独立测评显示七个站没有一个及格,紧接着监管自己撤回了其中最硬的三条。撤掉的那三条有个共同点:它们管的不是信息在不在,而是信息能不能被用起来。这篇把它拆成可验收的三个层次,再搬到你的商品页上。 > 摘要:一个只卖五六种套餐的行业,做出了全网最难选的页面。美国监管把这张表的字段、格式、摆放位置、机器可读格式全部写进了法条,两年后一份独立测评显示七个站没有一个及格,紧接着监管自己撤回了其中最硬的三条。撤掉的那三条有个共同点:它们管的不是信息在不在,而是信息能不能被用起来。这篇把它拆成可验收的三个层次,再搬到你的商品页上。 先说一个反直觉的对照。 一家服饰独立站,SKU上万,颜色尺码组合能排出几千行。一家宽带运营商,全站在售的套餐通常不超过六个,很多只有三个。按常理,后者的选购体验应该轻松得多——东西少,看完就选了。 实际结果是反过来的。2026年7月底公布的一份行业测评里,七家宽带服务商的桌面端与移动端站点被按280多项研究参数逐项打分,产出1700多个加权评分,整体结论是中等偏下,其中一家已经贴到了差评那一档的边线上,没有任何一家拿到“尚可”或更好。同一家研究机构在电信行业做的另一轮测试更狠:16个美国与英国的运营商站点、290多场一对一出声思维测试、3500多小时,最后测出来85% 的参与者在一次测试里至少放弃过一个站,而16个站没有一个逃过至少一次放弃。 三个套餐能把人逼走,这件事值得停下来想一想。 ## 只卖几种套餐的行业,凭什么做出了最难选的页面? ## 目录小,不等于决策简单 宽带这门生意的商品数量确实少,但每一个商品身上挂着的规则一点都不少:这个地址能不能装、装了能跑多快、首年多少钱、次年跳到多少、装机费收不收、设备是租是买、合约多久、提前解约赔多少、跨州的税费和监管附加费各是多少。 把这些拆开看,每一条都是一句能写清楚的话。把它们摞在一起,用户要做的判断就变成了一道多元方程。测评给出的诊断也正是这个:这些站的导航和产品描述普遍做得不差,真正塌下来的地方在两处——套餐对比矩阵,以及申请流程。前者被密集的排版、缺失的功能说明链接、没有常见问题和在线客服的支撑拖垮;后者则败给模糊的价格、说不清自己走到哪一步的进度条,和表单本身的摩擦。 研究方给的总结很克制:尽管产品目录不大,这些问题合起来削弱了用户自信地选出并申请一项服务的能力。翻译成人话是,东西少到用一只手就能数完,用户还是不知道该点哪一个。 ## 用户自己怎么描述这件事 电信那一轮测试里有一句原话,我看到之后一直记着。一位参与者说,看运营商的东西就像看巫术,永远搞不清在发生什么,“我是学数学的,我习惯二加二等于四,可手机运营商这儿不是这么回事”。 这句话的信息量在于,他抱怨的不是价格贵,也不是功能少,而是算不出来。同一轮测试里的其他放弃理由也都长这样: - 有人在一个站上找不到合约期到底是不是12个月,只写了每月多少钱,于是说“要是我在买东西,我就直接去别家了”,然后真的走了; - 有人因为功能清单里没提国际漫游,就直接认定这家不提供,其实提供; - 有人对着一行写着“轻松解锁与随时退回保障”的卖点发愣,旁边没有任何解释入口,他的反应是“为什么放这么一句上去却不给个说明”; - 有人想确认套餐含不含热点共享,翻遍页面找不到,最后离开。 最后一类值得单拎出来说。一个功能因为没写清楚,不但没能成为卖点,反而变成了不确定性的来源。它比“没有这个功能”更糟——没有,用户就排除掉往下走;写了却看不懂,用户会停在原地反复确认,而停留时长这个指标还会把这一停记成“深度浏览”。 ## 那些数字比感受更难反驳 把定性观察换算成比例之后,杀伤力更直接: - 在合约期不明显的站上,20% 的参与者放弃了本来适合他们的套餐——不是选了别家,是放弃了一个本该成交的选项; - 移动端如果没有明确提示“屏幕外还有套餐”,10% 的人压根没看见那些套餐存在; - 把手机和套餐捆在一起展示的站,14% 的人误判这家没有能配自己选中机型的套餐,事实上有,而且资费和合约都是可调的; - 提供可选数字权益的站,只有1% 的人真的勾选了它们,剩下99% 的人要么无视,要么把它当成抬价的累赘。 最后这条特别扎心。为了做出差异化而塞进套餐的那些附加权益,在真实用户那里的采纳率是百分之一,同时它们把价格推高、把对比表撑长、把“这个套餐到底含什么”这个问题变复杂。一件事同时做到了几乎无人使用和显著增加理解成本,这在产品评审会上很难被讲出来,因为它上线时的立项理由写得非常漂亮。 这类摩擦的共同特征是它们不体现为任何一条报错,用户也说不出自己为什么没买。用户想买却没买多半不是嫌贵,购买路径上那些看不见的摩擦力怎么揪出来 (https://zhangwenbao.com/invisible-friction-conversion-killers.html)是另一条线的话题,本篇只处理其中最结构化的那一类:信息之间的位置关系。 ## 研究方自己给的诊断,比结论更值得看 那份测评对这个行业的定性只有两句话,但两句都很准。第一句是:这些站通常只提供一组很窄的服务,然而这些服务附带着复杂的资格规则和分层的成本结构,于是在整条用户旅程上,对清晰度和结构的要求反而被抬高了。 把这句话里的三个词拿出来单独看,就是很多跨境独立站的处境:服务窄、规则复杂、成本分层。你卖的东西可能只有三十个SKU,但每个SKU上挂着分区运费、阶梯折扣、会员价、预售定金、不同市场的税费口径。商品数量和决策复杂度是两个独立的变量,多数团队却默认它们同涨同落。 第二句诊断更具体:大部分站在初始导航和产品描述上表现不错,塌下来的是最关键的两处——套餐对比矩阵,以及申请流程。对比矩阵被密集排版、缺失的功能说明链接、以及缺少常见问题与在线客服这类支撑工具拖累;申请流程则败给模糊的价格、说不清进度的指示器和表单层面的摩擦。 注意这两处的共同点:它们都是用户手上信息最多、却最需要有人帮他收敛的时刻。导航和描述这两个环节,用户的任务是获取;到了对比和申请,任务变成了取舍与承诺。前一类任务做加法就有效,后一类任务做加法只会更糟。 ## 这个行业的样本量本身说明了一件事 顺便说说这份测评的取样方式,因为它决定了这些数字能不能被拿来当依据。七家服务商,桌面端与移动端都测,按页面类型分别记录设计样本——首页与分类、套餐矩阵、套餐详情、申请流程、账户与自助服务这些环节各有二三十套设计被收录,最终形成1700多个加权评分和1100多个最佳实践示例。 换句话说,这不是抽查几个页面得出的印象,而是把同一套参数在每个站的每个环节上跑了一遍。在这种取样密度下还能出现“没有一家达到尚可”的结论,说明问题不是某几个站做得差,而是整个行业在同一个地方一起卡住了。 行业性的一致失败,通常指向结构性原因而不是执行力原因。这也是我愿意花这么大篇幅拆它的理由:凡是所有人都做不好的事,多半是因为做好它需要跨过一道所有人都没被要求跨过的门槛。接下来两节讲的就是这道门槛——有人试着用法律把它铺平了,然后又把桥拆了一半。 ## 这两份研究的来路 把出处交代一下,因为这篇后面所有的推论都建立在它们上面。 行业测评那份是2026年7月28日发布的宽带服务商UX基准测评 (https://baymard.com/blog/internet-service-providers-ux-benchmark-2026):7个站点,桌面端与移动端各自被按280多项与该行业相关的研究参数逐项人工评估,产出1700多个加权UX表现评分和1100多个最佳实践示例。整体判定是中等偏下,其中一家贴在差评那一档的边线上。 电信那份是2025年10月发布的3500小时电信行业测试的三条高层结论 (https://baymard.com/blog/telco-ux-research):16个美英运营商站点,既有大型网络运营商也有虚拟运营商;290多场一对一远程有主持人的出声思维测试,桌面与移动都做;期间参与者遇到1800多个中重度可用性问题,最后被提炼成500多条准则。 两份研究得出的三条高层结论分别是:始终提供完整的套餐细节、始终传达清晰的价格与促销、始终提供便捷的覆盖地图入口。三条都朴素得像废话,而16个站没有一个能同时把三条做到位——这本身就值得琢磨。 我个人认为这两份材料最有价值的地方不在数字,在于它们提供了一个受控的对照组:同一批人、同一套方法、同一个时间段,把这个行业和其他电商行业放在一起测。覆盖地图13% 的故障率之所以刺眼,正是因为旁边摆着“其他大规模行业研究的两倍”这个参照。没有参照系的比例数字是没有意义的,这也是我引用它们时尽量带上对照的原因。 ## 监管把这张表规定到了什么程度? 如果你觉得上面那些是行业自己不上心,那接下来这部分会让你重新算一遍账。因为在美国,这件事不是没人管,而是被管到了字段级。 ## 一张照着营养成分表画出来的表 美国联邦通信委员会推行的宽带消费者标签,官方说明里写得很直白:这些标签仿照食品药品监督管理局的营养成分标签设计,目的是帮消费者对比不同的上网套餐,选出最合自己需求和预算的那一个。它的法律来源是2021年通过的基础设施投资与就业法案,法案直接指示监管机构必须要求服务商做出消费者友好的标签。 标签上必须披露的内容包括价格、优惠期价格、数据额度、网速,还要附上网络管理措施与隐私政策的链接。规则本体写在《联邦法规汇编》第47编第8.1条,任何一家提供宽带接入服务的主体,对它在售的每一个独立套餐都要单独做一份标签。 ## 销售点的定义里,写着“用户开始比较的那一刻” 这条是我读下来最意外的一处。法条对“销售点”给了一个远超常识的定义:它包括服务商的网站、各类替代销售渠道(自营门店、第三方门店、电话),而且—— > 销售点也指消费者开始调研并比较其所在位置可获得的宽带服务方案的那一刻。 把这句话拆开看,里面塞了两个平时很难被写进需求文档的东西。一个是时刻:义务不是绑在“下单页”上,而是绑在用户开始比较的那一秒。另一个是位置:法条自己承认,可获得的方案是随着用户所在地变化的,所以它写的是“其所在位置可获得的”,而不是“你在售的”。后面我们会回来算这笔账。 对网站的具体要求还要更细:标签必须展示在与对应的在售套餐广告紧邻的位置。走电话或门店渠道的,要么逐次记录每一次把消费者引导至标签的实例并保存两年,要么建立并留存业务流程与培训材料两年,监管索要时30天内交。参与教育网与农村医疗补贴项目的,销售点被定义为提交投标的那一刻。 ## 机器可读、专用地址、电子表格格式 第8.1条第 (a) 款第3项当年的原文要求是三件事叠在一起:标签内容必须以机器可读格式在网站上呈现;服务商必须在一个专用网址上,用电子表格文件格式单独提供其全部标签;并且必须把这个网址公布在透明度披露里。 官方文档写明了这条的目的:让第三方更容易采集和汇总数据,以便为消费者制作比价工具。监管机构不但配了CSV格式的数据字典和填好示例数据的模板文件,连设计稿都给了,提供可自定义的Illustrator与EPS模板包。 剩下几条同样值得抄进任何一份披露类需求: - 标签要用英语,以及服务商在美国用于营销该服务的任何其他语言; - 套餐停售后,标签要存档不少于两年,监管或老客户索要时30天内提供; - 提供在线账户中心的,必须让每个客户在账户里能方便地拿到自己当前套餐那一份标签; - 最后一条最狠:符合标签要求不构成对透明度规则的安全港。换句话说,表填完了,不代表你就算说清楚了。 合规时间线是:10万条用户线以内的服务商2024年10月10日起执行,其余2024年4月10日起执行;账户中心与机器可读这两项,所有人2024年10月10日起执行。 ## 把这套要求换算成产品语言 抛开法条措辞,这份规则实际上替整个行业做完了一次产品设计,而且做得比多数团队的内部规范还细: 法条管的事 | 换成产品语言 | 多数独立站的现状 | 每个套餐一份标签 | 字段清单全站统一 | 每个品类各写各的 | 紧邻广告展示 | 信息出现在决策位置 | 塞进详情页第三个折叠块 | 销售点含“开始比较那一刻” | 比较阶段也要有信息 | 只有详情页有 | 机器可读+专用网址 | 结构化数据与数据源 | 做了schema,没做数据源 | 停售后存档两年 | 历史可核验 | 改价直接覆盖,无留痕 | 按营销语言出多语版本 | 披露跟着营销走 | 营销做了六语,条款只有英文 | 不构成安全港 | 合规不等于说清楚 | 法务打完勾就收工 | 看完这张表,再回头看开头那个测评结论——规则2024年4月起就生效了,两年多以后测出来仍然是没有一家及格。这就不再是“没人管”能解释的了。 ## 连素材包都替你准备好了 有一个细节我觉得很值得说,因为它堵掉了最常见的那个借口。 监管方不是只丢下一份法条就走了。官方页面上挂着一整套可下载的东西:空白样张、固定宽带样张、移动宽带样张,都有英语和西班牙语两版;可自定义的设计模板压缩包,里面是Illustrator与EPS源文件;机器可读那一侧则给了数据规范文档、CSV格式的数据字典、标签模板CSV,以及一份填好示例数据的模板。 也就是说,字段清单、字段含义、文件格式、视觉稿,全都是现成的。在这种条件下,一份披露做不做得好,已经跟“不知道该写什么”没有任何关系了。剩下的变量只有两个:它被放在页面的哪个位置,以及它能不能跟另一个选项对上。这恰好就是后面要讲的第二层和第三层。 顺带一提,官方还给了一份术语表,专门解释标签上那些词是什么意思。这个动作本身透露了一件事:制定者很清楚,即便字段填对了,用户也未必读得懂那些词。字段完整和可理解是两回事,这一点在你写商品参数表时同样成立——把“抗压强度”写上去和让买家知道它意味着能摞几层,中间还差一句话。 ## 投诉入口这一条,是执法能落地的关键 还有一处设计值得抄进任何一份披露规则:如果某家服务商没有展示标签,或者标签上关于费用和套餐的信息不准确,消费者可以直接向监管机构投诉。页面上还专门留了无障碍相关问题的联系方式,包括语音电话、视频电话和邮箱三条通道。 为什么这条重要?因为披露类规则最大的执行难题是没人有动机去举报——信息不准确的受害者是分散的个体,每个人的损失都不足以支撑一次投诉。把投诉入口做到官方页面上、并且明确写清“没展示”和“不准确”都可以投诉,等于把发现问题的成本从监管方转移到了受影响的人身上,而这批人的数量远大于任何一支检查队伍。 这个思路在独立站上也有对应物。你的商品资料错了,最先发现的一定是买家而不是运营,而多数站没有给他一个顺手的报错入口——于是他的选择就只剩下退货或者不买。前面提到的欧盟比价工具八条要求里,也专门有一条是必须提供有效的错误信息举报流程,两边想到一起去了。 ## 把这套规则读一遍的最大收获 我建议做电商的人真的去把第8.1条读一遍,哪怕业务跟宽带毫无关系。因为它是我见过的把“一份商品披露该长什么样”写得最完整的一份文件:写了内容、格式、位置、时机、语言、留存期限、渠道差异、以及合规了也不等于免责。你在自己站上做商品资料规范时需要考虑的每一个维度,它都替你列了一遍。 而它同时也是一份很好的反面教材——因为下一节我们会看到,这份考虑得如此周全的规则,两年之后被它的制定者亲手改掉了最关键的三处。 ## 去哪儿看原文 这一节的所有描述都能对到原文,建议至少扫一眼两份材料。 面向公众的说明在美国联邦通信委员会的宽带消费者标签专题页 (https://www.fcc.gov/broadbandlabels)上,那里有样张下载、术语表、模板文件,以及给服务商的合规时间表;仿照营养成分标签设计、帮助消费者比价购物这两句定性描述,也都写在那一页上。 规则本体在《联邦法规汇编》第47编第8部分 (https://www.ecfr.gov/current/title-47/chapter-I/subchapter-A/part-8),一共只有一条实体条文加若干款,读完不到二十分钟。前面引的销售点定义、紧邻广告展示、机器可读与专用网址、存档两年、以及“不构成安全港”,全部出自第8.1条第 (a) 款。 提醒一句:这份汇编上的文本是当前有效版本,会随修订滚动更新。也就是说,随着2026年7月那份命令的规则文本生效,其中第 (a) 款第3项那段机器可读的要求会从这个页面上消失。如果你想看到被删掉的原文,得去命令本身,或者查历史版本。这也算一个小小的讽刺:一条要求“停售后存档两年”的规则,自己被删掉的时候倒是干干净净。 ## 顺便说个查法规的经验 做跨境的人经常需要查外国法规原文,这里给两条省时间的做法。 第一,优先找法规汇编而不是新闻稿。新闻稿写的是意图,汇编写的是义务,两者经常有微妙差别——比如新闻稿说“必须显著展示标签”,汇编写的是“必须展示在与对应在售套餐广告紧邻的位置”,后者才是能拿来验收的表述。 第二,把生效日期单独抄出来。同一条规则对不同规模的主体往往有不同的合规日期,前面那个2024年4月和10月的双轨制就是例子。做多市场业务时,一张只有“条款、义务、适用对象、生效日”四列的表,比一份三十页的合规报告有用得多。 ## 两年之后,那三条最硬的规矩去哪了? 2026年7月22日,美国联邦通信委员会通过了一份新的报告与命令,编号FCC 26-48,把宽带标签规则改了七处。官方对外的说法是让标签更易读易懂,同时减轻服务商的合规负担。 七处改动里有四处属于合理修剪:电话销售时允许客服用自然口语描述标签内容而不必逐字念;允许简化费用呈现以免标签变得杂乱;删掉已经结束的补贴项目那一栏;澄清账户中心里可以用超链接或图标。 真正值得停下来的是另外三处。 ## 撤掉的三条 原来的要求 | 2026年7月起 | 这条原本在管什么 | 销售点必须展示标签本身,不许只放图标或链接 | 可以用超链接或图标代替完整标签 | 信息出现在决策发生的位置 | 必须以机器可读的数据库格式提供标签内容 | 整条取消 | 信息能被第三方拿去做比较 | 套餐停售后标签至少存档两年 | 整条取消 | 信息在时间维度上可核验 | 保留下来的是什么?标签仍然要做,仍然要对残障用户可访问,仍然要按营销语言出多语版本。也就是说,“这份披露必须存在”完整保留,“这份披露要能被用起来”的那三条被拿掉了。 ## 撤回文件里最诚实的一句 这份命令的可贵之处在于它没有粉饰。讨论超链接替代方案的那一段里,监管方自己写下了这样一句: > 虽然在销售点用超链接指向宽带标签、而不是自动展示标签,可能导致读到标签的消费者变少,但有意愿的消费者仍然有机会查看宽带标签。 这句话我建议做转化的人抄下来贴在工位上。“有机会看到”和“会看到”之间的那段距离,就是整个转化率优化这个行当存在的全部理由。把默认展示改成需要点一下,从合规角度看信息一个字都没少,从行为角度看它换了一件完全不同的事情:原来是信息找人,现在是人找信息。 而这份文件最有意思的地方是,它并不否认这一点,它只是认为剩下那部分人的机会已经足够。 ## “没有记录证据表明有第三方用它做出了工具” 废除机器可读那一条时,监管方给的核心理由有两层。第一层是权限:法案只授权它要求“展示标签向消费者披露信息”,没有授权它要求把标签做成供计算机处理的数据文件格式。第二层是成本收益,原话是: > 并无记录证据表明有任何第三方使用机器可读的标签内容开发出了有利于消费者的工具。 产业界的意见书说得更直白:为每一个套餐生成、托管并持续更新机器可读文件,要花掉可观的成本与时间,而对消费者的相应收益很小;对工程资源有限的中小服务商尤其吃力。 停一下,把这条时间线摆齐:机器可读的义务是2024年10月10日对所有服务商生效的,到2026年7月撤销,中间不到两年。两年里,全美宽带服务商按法条要求,在专用网址上挂出了覆盖全部在售套餐的电子表格文件。然后监管方在卷宗里找不到任何一个用它做出来的消费者工具。 这不是一个关于懒惰的故事,因为供给侧确实照做了。后面第五节我们会看到,同一件事换一个法域,结局完全不同,而差别只在一处。 ## 一场关于“机器可读到底是给谁读的”的正面交锋 废除过程中还有一段争论,对做技术SEO的人格外有用。 无障碍权益组织提出反对,理由是这条要求对使用辅助技术的盲、低视力与盲聋用户是必需的,屏幕阅读器与可刷新盲文显示器这类技术需要机器可读性才能工作。 监管方的回应是把两件事切开:被废除的那条针对的是单独托管在专用网址上、以CSV、JSON或XML之类格式提供、主要为第三方批量数据聚合而设计的数据文件;这与消费者在浏览器里直接查看的标签不是一回事,后者是HTML之类的格式,天然兼容屏幕阅读器等辅助技术,不需要额外的软件或步骤。 这个裁决划出的界线很值得记:给爬虫和聚合器读的结构化数据,与给辅助技术读的语义化HTML,是两条不同的链路,谁也替代不了谁。你的站点如果schema标得漂漂亮亮,但按钮是没有可访问名称的div,屏幕阅读器不会因为你有JSON-LD就突然读得懂它。这一点在网站无障碍访问的落地清单 (https://zhangwenbao.com/website-accessibility-seo-optimization-guide.html)里有更完整的展开,这里只强调结论:两条链路要分别验收。 ## 一位委员把希望寄托在用户会主动去找 命令末尾附着的委员声明里有一段话,情绪很真实。这位委员写道,自己本来更希望展示完整标签,但仍然希望委员会、行业伙伴和消费者团体能一起去推广宽带标签这个概念,让消费者主动寻找并经常使用这项资源;就像逛超市的人想知道自己买的食物里有多少蛋白质和纤维一样,希望选宽带的人也会在做购买决定时主动去找宽带标签。 这段话读着让人有点难受,因为它诚实地展示了一个非常常见的补救方案。当一个设计决定从“默认展示”退回到“用户主动去找”,负责人手里剩下的方案通常就只有教育用户了——而在所有可选方案里,教育用户是唯一一个不需要改任何代码、也几乎从来没有成功过的那个。 顺便说一句,营养成分表这个类比其实反过来印证了问题。超市里那张表之所以有人看,恰恰因为它印在包装上、不需要点击、而且两盒麦片可以同时拿在手里比。这三件事,正好就是被撤掉的那三条要管的东西。 ## 另外四处改动,其实都挺合理 为了公平,把剩下四处也说清楚,因为它们能反过来衬托那三条的性质。 电话销售允许口语化。原规则下客服要逐字念标签内容,新规则允许用自然、对话式的方式描述。这条改得对——逐字宣读在电话里制造的是噪音不是信息,还会拉长通话、增加培训和话术成本。 费用呈现可以简化。原规则要求逐项列出各类费用,而不少费用随司法辖区变化,导致同一个套餐在不同地区要出不同的标签。新规则允许披露最高金额或确切金额。这条后面第八节还会详细讲,它其实是整份文件里最有实操价值的一处。 删掉已结束补贴项目那一栏。那项低收入宽带补贴因为国会没有继续拨款而终止,标签上继续留着它只会误导。这属于纯粹的信息卫生。 账户中心允许用超链接或图标。这条和销售点那条同源,只是发生在已经成为客户之后,杀伤力小一些——老客户去账户中心找自己的套餐信息,本来就带着明确目的。 四处放在一起看,都符合“减少无谓成本、不减少实际信息”的标准。正因为这四处改得站得住,那三处才更值得单独拎出来分析——它们不是随手砍的,是在一份论证相当严谨的文件里被认真论证掉的。 ## 成本收益是怎么算的 废除机器可读那一条时,文件里引了两条产业界意见。一条说:生成、托管并持续更新机器可读的宽带标签,其成本超过了任何可能的收益,对工程资源有限的中小服务商尤其沉重。另一条说:为每一个套餐开发和维护专门的机器可读文件要耗费可观的成本与时间,而对消费者的相应收益很小。 这两句话里藏着一个值得警惕的论证结构:成本是确定的、可核算的、由说话人自己承担的;收益是不确定的、难核算的、由别人享受的。在这种不对称之下,任何一次成本收益比较的结论几乎都是可以预测的。 这个结构在企业内部一模一样地重演。你要推动一件基础设施类的改造——统一字段命名、补齐数据源、做价格留痕——成本一定能被算清楚(几个人天、几个迭代),收益一定算不清楚(少了多少次犹豫、少了多少次流失)。于是这类提案永远在排期表的下半段,不是因为它不重要,是因为它的收益天然不可核算,而排期会只处理可核算的东西。 唯一的破法是换量纲,把它挂到一件已经有确定成本的事情上去。这一点第十节会给具体做法。做合规类改造的人对这个套路应该不陌生——商品页上写环保材质要拿得出证据这件事 (https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html)之所以能推动,靠的也不是它对转化有好处,而是它有一个带日期的外部约束。 ## 顺带一提,撤销并不影响一件事 需要说清楚的是,这次修订没有动标签本身:标签仍然要为每个在售套餐单独制作,仍然要在销售点可获取,仍然要对残障用户可访问,仍然要按营销所用的语言出对应版本。它撤掉的全部是“这份披露之外的附加动作”。 所以这不是一个监管放弃的故事,而是一个更微妙的故事:当一件事被拆成“必须存在”和“必须好用”两半时,前一半守住了,后一半在两年内被成本论证掉了。而对用户来说,只有后一半才是他实际接触到的那部分。 ## 建议自己去读一遍那份命令 这一节引的每一句都来自同一份文件,编号FCC 26-48,2026年7月22日通过,公开可查,正文加附件一百多页。我把它当成一份产品决策文档来读,收获比当法条读大得多。 值得直接翻到的有三处:第9段列出了七项改动的完整清单,是最快掌握全貌的地方;第32到35段是废除机器可读的完整论证,包括权限依据、成本收益、以及对无障碍组织反对意见的回应;第54段是那句“可能导致读到标签的消费者变少”所在的位置,它出现在成本收益分析那一部分,语气非常克制。 如果只读一段,我推荐第54段。那份FCC 26-48号报告与命令 (https://docs.fcc.gov/public/attachments/FCC-26-48A1.pdf)在这一段里把三处撤销的预期影响一次性讲完,逻辑是一致的:消费者仍然能读到标签、仍然能读到当前在售套餐的标签,因此不预期造成实质损害,同时能降低服务商成本。每一句单独看都成立,合起来就是那句“有机会看到”。 ## 这份文件里我最欣赏的一点 它没有藏。 换个写法其实很容易:只说“允许使用超链接以提升灵活性”,不提读到标签的人会变少;只说“消除不必要的技术负担”,不提没有第三方用过。这些话都不算撒谎,而且更好看。 但它把不利于自己结论的事实写进了正文,然后论证为什么仍然选择这个结论。这种写法在企业内部的决策文档里非常罕见,而它恰恰是判断一份决策文档质量的最好标准:看它有没有写下那个对自己不利的事实。 顺便,这也是我做方案评审时的一个私人习惯——先翻风险那一节,如果那一节只有“技术风险可控”“进度风险可控”这类句子,我基本不会再看前面。一个连自己的坏消息都写不出来的方案,通常也没有认真想过它会怎么失败。 ## 被撤掉的为什么恰好是那三条? 把七处改动排在一起,会发现一个不太可能是巧合的规律:被砍掉的三条,全都不管信息在不在,只管信息能不能被用起来。 ## 一条信息的三个层次 任何一条商品信息,在页面上都可以处在三个层次中的某一层。它们的成本递增,价值也递增,但被检查的可能性递减。 层次 | 它保证了什么 | 怎么验证 | 谁能强制 | 第一层 · 存在 | 这条信息在站上能找到 | 搜一下有没有,一分钟 | 法规、法务、验收清单 | 第二层 · 在决策位置 | 它出现在用户做决定的那一屏、那一刻 | 只能靠观察真实用户 | 法规勉强能写,代价很高 | 第三层 · 可跨项对齐 | 它能跟另一个选项的同一条并排比 | 把两个页面并排放,逐字段数 | 几乎没有法规写得出来 | 回头看那三条被撤的规则,对号入座得严丝合缝:不许只放链接、必须紧邻套餐广告,管的是第二层;机器可读加专用网址加电子表格格式,明写着目的是让第三方做比价工具,管的是第三层;停售后存档两年,管的是时间维度上的第三层——让今天的价格能跟去年的自己并排。 而保留下来的那些,全部落在第一层:标签要有、要能被辅助技术读到、要有对应语言的版本。合规成本主要不来自披露本身,来自让披露真正能被用起来的那部分;所以只要开始谈减负,先掉的一定是第二层和第三层。 ## 为什么第三层几乎没有法规写得出来 这不是立法者偷懒,是义务的挂载方式决定的。 披露义务天然挂在单个商品上:每个套餐一份标签、每件商品一份成分表、每包食品一张营养表。执法也只能这么做——检查员打开一个商品页,逐项核对该有的字段在不在。 但用户要做的动作是跨商品的:他要在三个套餐之间选一个。你没法给一个卖家开出“你必须把你的商品和竞争对手的商品并排展示”这种义务,也没法要求他自己的三个套餐必须字段对齐——后者理论上能写,但它已经越过了披露的边界,变成了在规定页面怎么设计。 所以立法能走到的最远处,就是那条被撤掉的机器可读要求:我不规定你怎么并排,我规定你把数据交出来,让愿意做并排的人去做。这是一条相当聪明的迂回路线,可惜它在美国这次被判定为超出授权范围,同时被认定收益不足。 ## 三句判据 要判断一条信息卡在第几层,问三句就够,顺序不能换: - 这条信息在站上存在吗?——不存在,先补上,别往下问。 - 它出现在用户做那个决定的同一屏吗?——如果要点开折叠块、跳新页面、打开浮层才能看到,答案是否。 - 它能不能跟另一个选项的同一条信息并排且对齐?——同一个字段名、同一个单位、同一个位置。三者缺一,答案是否。 绝大多数团队会在第一句上给出漂亮的答卷,在第二句上开始犹豫,在第三句上第一次发现这件事从来没有人负责过。 第三句还有个隐藏用法:它是唯一一句能解释“我们明明都做了”和“用户还是选不出来”为什么可以同时成立的话。两边都没撒谎,两边说的是不同层次的同一件事。 ## 和“用户那一侧缺输入”不是同一个问题 这里要跟一个很接近的问题划清界线,否则很容易开错药方。 之前拆过另一类缺口:商品页上每条信息都是关于商品的,而用户要下的判断关于他自己 (https://zhangwenbao.com/product-page-user-side-input-gap-shade-matching.html),比如粉底色号——页面把商品那一侧写得再全,用户也不知道自己是冷调还是暖调,缺的那一半在他身上,而他手里没有测量它的工具。那类问题的解法是想办法把用户那一侧的输入收进来。 本篇是另一回事。宽带套餐里,用户那一侧该给的输入他给得出来:他知道自己家几口人、看不看4K、每月愿意花多少钱。缺的不是输入,是这些已经写在页面上的信息之间的空间关系。三个套餐的合约期分别写在三个不同的位置、用三种不同的说法、其中一个还折叠着,于是用户只能靠记忆在三块区域之间来回搬运数字,而人的工作记忆一次装不下三组四元数。 两类问题的药方完全相反:前者要去收数据,后者要去搬版面。把后者当成前者来治,就会做出一个又一个“帮您推荐合适套餐”的问答向导,而用户真正想要的只是把三列数字对齐了放在一屏里。 ## 顺带解释了一个长期困惑 这套分层还能顺手解开一个老问题:为什么“把信息写得更全”经常不管用,有时候还起反作用。 因为往第一层加东西,是所有动作里最便宜、最有交付物、也最不需要跨部门协作的那个。一个人一个下午就能给商品页加三段说明,截图发群里,任务闭环。而它对第二层和第三层的贡献是零甚至是负的——页面变长了,用户要在更多内容里翻找那条他真正要比的信息,对比这件事反而更难了。 所以才会出现那个熟悉的场景:详情页越做越长,转化率纹丝不动,复盘会上得出的结论是“内容还不够详细”。 ## 为什么第二层没法被清单检查 第一层能被检查,是因为它的判定是二值的:这条信息在,或者不在。搜一下、点一下,一分钟出结论,两个人查会得到同一个答案。 第二层的判定条件里带了一个变量——用户当时正在做哪个决定。同一条信息,对正在挑型号的人是决策位置,对已经决定了正在填地址的人就是噪音。所以“它有没有出现在决策位置”这个问题,脱离了具体的决策就没有答案,而清单式检查恰恰要求答案与检查者无关。 这就是为什么它只能靠观察真实用户来验证,而观察的成本比打勾高一个数量级:要招人、要设计任务、要录屏、要有人看完并写出结论。一个团队一年做几次这样的观察是现实的,做成每次发版的常规检查项是不现实的。 退而求其次的做法有两个。一个是用页面结构做代理判断:这条信息是否需要额外操作才能看到,需要就判否,这条规则虽然粗但可以被清单化。另一个是用行为数据做事后判断:那个折叠块的展开率是多少,展开的人和没展开的人转化差多少。后者的好处是不用埋新点,多数站的现有统计就能拉出来。 ## 第三层的成本高在哪 第三层要求同一个属性在多个商品上用同一个名字、同一个单位、同一个取值集合。这件事的难度不在技术,在于它要求一次跨越多个负责人的约定,而且这个约定要一直被维护下去。 更棘手的是它有历史包袱。新建一个字段是纯增量工作,统一一个已经用了三年的字段则要回填几百条商品数据、要处理旧值和新值的映射、要检查依赖这个字段的筛选器和数据源会不会挂。所以字段对齐这件事的成本随时间指数上升,而收益不变——这是典型的越拖越贵型任务,也正因如此它总是拖着。 一个降低门槛的办法是别追求一次全站统一,先挑那些真的会被拿来比较的属性。判断依据也很朴素:用户在两个商品之间犹豫时会问哪几个问题,就先统一那几个。多数品类里这个数字是三到六个,不是三十个。 ## 三层之间不能跳级 最后强调一条纪律:三层是严格递进的,不能跳级。 一条信息如果压根不存在,那么讨论它放在哪儿、跟谁对齐都没有意义。反过来,如果一条信息已经在第一层了,直接跳到第三层去做对比表,而没有先把它搬到决策位置上,你会得到一个漂亮但没人看的对比页面——因为用户在做决定的那一屏上仍然看不到它,他不知道有一张表可以对比,也不会专门去找。 这个顺序还决定了排期顺序:先把该有的补齐,再把位置搬对,最后才做对齐和对比。很多团队的做法是反的,从做一张漂亮的对比表开始,做完发现流量很少,于是判定这个方向没价值——实际上只是入口那一层没做。 ## 什么时候可以不管第三层 为了不让这套框架被滥用,说清楚它的适用边界。有三种情况下第三层确实不重要。 第一种是品类里根本不存在候选集。用户要买的东西只有一个选项,或者他早就认定了要买哪一个,剩下的动作只是完成交易。补充耗材、指定型号的配件、按图纸下单的定制件,多属于这一类。这时候把力气花在结算流程上比花在对比上划算得多。 第二种是决策由单一变量主导。如果90% 的用户只看价格,那么把价格放对位置就等于把第三层做完了——因为对比在事实上只发生在一个维度上,而列表页的排序功能已经把它解决了。判断方法很简单:看筛选和排序的使用分布,如果绝大多数人只用了价格排序,那这个品类的比较维度就是一维的。 第三种是客单价低到不值得比较。比较是有成本的,用户会本能地衡量这个成本值不值。几十块钱的东西,多数人宁愿买错也不愿意花五分钟对比。这条界线在不同市场上位置不同,但它一定存在。 把三种情况反过来说:当候选集大于一、比较维度大于一、且客单价高到值得花时间时,第三层就从锦上添花变成了必需品。宽带正好三项全中——三到六个套餐、四五个维度、一签就是一两年,所以它把这个问题放大到了肉眼可见。 ## 顺便回答一个常见反驳 经常有人说:用户又不是真的在做理性比较,行为经济学早就证明了人是靠直觉决策的,把字段对齐是不是把用户想得太理性了? 这个反驳有一半是对的。人确实不会真的去算,但他会不会算和他能不能算,是两件事。能算而选择不算,他会凭直觉快速下单;不能算,他会卡住——而卡住的表现不是慢慢想,是换一个站。 前面那些数字正好印证了这一点:合约期不明显的站上,20% 的人放弃了本来适合他们的套餐。他们不是算错了,是没法算,于是退出了。字段对齐的作用不是帮用户做数学题,是让他在两秒钟之内确认这道题是可解的,然后他就可以放心地凭直觉选了。 ## 同一件事,欧盟为什么给出了相反的答案? 同一件事,欧盟的处理方式几乎在每个关键点上都跟美国相反,而且它比美国早了四年就把话说完了。 ## 机器可读和无障碍被写在同一句话里 《欧洲电子通信法典》,即2018年第1972号指令,第103条第1款要求主管机构确保:附件九所列信息由所有服务商以清晰、全面、机器可读的方式,并以对残障终端用户可访问的格式发布,并且要定期更新。主管机构还可以对发布形式提出额外要求,发布前有权要求先把信息报送过来。 请注意这句话的结构。机器可读和无障碍格式是并列的两个要求,写在同一个句子里,中间只隔一个逗号。而美国这次废除机器可读,用的恰恰是“这两件事不是一回事”这个论证。同一组词,两个法域给出了方向相反的处理。 这里我不打算判谁对——技术上美国那套切分是站得住的,CSV文件确实不是屏幕阅读器的工作对象。有意思的是另一层:当一条规则同时服务两个目的时,它比只服务一个目的的规则更难被废除,因为你得同时证伪两次。欧盟那句话把两个目的绑在了一起,美国那条规则是单独立的,于是只需要一次成本收益论证就能拆掉。写内部规范时这个技巧可以直接借用。 ## 不只要求你发布,还要求市场上必须存在比价工具 第103条第2款是整篇文章里我最想让你记住的一条。它要求主管机构确保终端用户能免费访问至少一个独立的比价工具,用来比较和评估不同的互联网接入服务与人际通信服务,比较维度包括价格资费,以及在有最低服务质量承诺时的服务质量表现。 读慢一点:法律没有停在“你要把数据公布出来”,它直接规定了这个市场上必须存在一个能用的比价工具,并且把确保它存在的责任压给了监管机构。 第3款接着规定这个工具必须满足八条: - 运营上独立于被比较的服务商,确保各家在搜索结果中被平等对待; - 明确披露工具的所有者和运营者; - 列出清晰客观的比较标准; - 使用简明无歧义的语言; - 提供准确且最新的信息,并注明最后更新时间; - 对任何愿意提供相关信息的服务商开放,覆盖市场相当大一部分的报价,并且在展示结果之前就明确声明所呈现的并非市场全貌; - 提供有效的错误信息举报流程; - 能够比较价格、资费与服务质量表现。 满足这八条的比价工具,经运营方申请,应当由主管机构予以认证。 八条里有两条我认为任何做内容和做工具的人都该照抄。一条是注明最后更新时间——这是把“数据是否新鲜”这个不可见属性变成可见字段的最小成本做法。另一条是在展示结果之前声明这不是市场全貌,注意是之前,不是在页脚的小字里。做过比价类内容的都知道,这一句放在结果之前和放在页面底部,读者对整个榜单的信任方式完全不同。 ## 第三方免费取用被写成了一项权利 第3款的最后一句是这套设计的收口: > 第三方有权免费并以开放数据格式使用互联网接入服务或公开可用的人际通信服务提供商所发布的信息,用于提供此类独立比价工具。 把美国和欧盟的做法并排放,差别一目了然: | 美国(2022年立,2026年撤) | 欧盟(2018年立,仍在生效) | 供给侧义务 | 有:机器可读+专用网址+表格格式 | 有:机器可读方式发布并定期更新 | 需求侧主体 | 没有规定 | 有:必须存在至少一个独立比价工具 | 第三方取用 | 未明确赋权 | 写成权利,免费,开放格式 | 质量把关 | 无 | 八条要求+官方认证 | 结局 | 以“无人使用”为由废除 | 持续生效 | ## 只立供给不立需求的开放数据,一定会以“没人用”收场 这是本篇我最想留下的一条判断。 当你只规定“数据必须被交出来”,却不规定“谁在什么场景下必须用它、用它做什么、做出来要满足什么标准”,那么两年后统计出来的使用量必然接近于零。而这个零不是数据没价值的证据,它是没有规定需求侧的必然结果。 更麻烦的是,这个零会被当成证据用。美国这次废除的核心论据就是“没有记录证据表明有第三方用它做出了工具”——从卷宗看这句话完全属实,从因果看它是自己设计出来的结果。 这条判断对独立站和内容从业者的迁移价值很高,因为我们手上到处都是这种只有供给没有需求的东西: - 结构化数据:把Product、Offer、AggregateRating标得一丝不苟,但从没问过哪个具体消费方会读它、读到之后你能得到什么可观测的变化; - 商品数据源:字段填满推给各个渠道,从没核对过哪些字段真的参与了展示和排序; - llms.md:这件事的同构程度高到有点好笑——一份写给机器的清单,供给侧标准清清楚楚,需求侧没有任何一家引擎承诺过必须读它。实测十个站之后我写过它到底有没有用 (https://zhangwenbao.com/llms-txt-guide.html),结论和这里是同一条:没有需求方承诺的供给标准,最终会以使用率数据被拿去当废除理由。 所以再上任何一套面向机器的东西之前,先花十分钟回答三个问题:谁会读它?读到之后他会做什么?这件事发生了我怎么知道?三个问题里只要有一个答不上来,这件事的优先级就应该往后排——不是因为它没价值,是因为你没法证明它有价值,而没法证明的东西在下一轮减负里最先被砍。 ## 服务质量那一条,把可比较推得更远 第103条之后紧跟着的第104条,讲的是另一件独立站同样绕不开的事:怎么让“服务质量”变成可比较的东西。 它授权监管机构要求服务商发布全面、可比较、可靠、易用且最新的服务质量信息,并要求监管机构在充分参考行业机构指引的前提下,明确规定要测哪些质量参数、用什么测量方法、发布信息的内容与形式,以及可能的质量认证机制。 这一整套动作的目的只有一个词:可比较。它承认了一件事——如果不规定测量方法,各家自己报出来的数字虽然都不假,但彼此没法比。这跟我们在商品页上遇到的问题完全同构:一个卖家写“续航20小时”,另一个写“中等音量下18小时”,两个数都真实,放在一起却毫无意义。 可以直接抄的做法是:凡是你希望被用来做比较的指标,在字段说明里同时写清测量条件。这一条对独立站的价值在于,它让你的数字在被拿去跟别人比时更占便宜——当对手报的是一个没有条件的漂亮数字,而你报的是一个带条件的诚实数字,懂行的买家会更信后者,不懂行的买家至少不会因为你的数字小而排除你,因为他能看到差别来自口径。 ## 合约期上限那一条,出海做订阅的要看 再往下一条,第105条,划了一条对订阅业务很硬的线:面向消费者的电子通信服务合同,约定的承诺期不得超过24个月,成员国还可以规定更短的上限。 更值得注意的是自动续约那一段:如果合同或本国法律规定固定期限合同到期后自动延长,那么延长之后终端用户有权随时终止合同,通知期最长一个月,且除了通知期内的服务费之外不承担任何费用。终止条件与流程本身也不得构成更换服务商的障碍。 这条规则同时适用于微型企业、小型企业和非营利组织,除非它们明确同意放弃。 把它翻译成独立站的语言:如果你的订阅制业务面向欧盟消费者,那么“自动续约之后就锁定一年”这种设计是有法律风险的,而且合约期本身有硬上限。这跟我们这篇的主题是同一件事的两端——合约期是用户在比较套餐时最想看清的字段之一,法律直接给它设了上限并保障了退出路径。做订阅的具体配置与失败续费挽回,另有订阅商品、定期扣款与续费失败处理的完整实操 (https://zhangwenbao.com/woocommerce-subscriptions-recurring-billing-failed-renewal-dunning-membership-operations.html)可参考,这里只提醒一句:把合约期和退出条件写到决策位置上,往往比多写三行卖点更能促成第一单。 ## 两个法域的分歧,本质是对同一个空白的两种态度 最后收一下这一节。美国和欧盟面对的是同一个空白:披露义务只能挂在单个商品上,而比较是跨商品的动作。 美国的处理是把数据交出去,等市场自己长出比较工具;欧盟的处理是先把比较工具规定成必须存在的东西,再倒推出数据义务和取用权利。 结果差异很清楚。前者两年后以“没人用”为由撤销,后者持续生效。这里面的教训不是欧盟高明,而是一个更朴素的道理:任何供给侧的标准,都必须先有一个明确的、有动机的消费方,否则它的使用量数据迟早会被拿来当作废除它的证据。 ## 原文在哪一段 这一节引的条文全部出自欧盟第2018/1972号指令《欧洲电子通信法典》 (https://eur-lex.europa.eu/legal-content/EN/TXT/HTML/?uri=CELEX:32018L1972),第三部分终端用户权利那一章。第102条讲合同信息要求,第103条讲透明度、报价比较与信息发布,第104条讲服务质量,第105条讲合同期限与终止。 如果时间有限,只读第103条第2款和第3款就够了:前者规定必须存在至少一个免费的独立比价工具,后者列出那八条要求、认证机制,以及第三方免费取用数据的权利。整段不到八百个英文词,是我读过的把“可比较性”这件事写得最完整的一段公开文本。 要提醒的是,指令这种形式本身需要各成员国转化为国内法,所以具体到某个国家,细节会有出入——认证机构是谁、有没有额外要求、比价工具由谁运营,各国的落地方式并不一样。做欧盟市场时,指令给的是下限和框架,真正约束你的是目标国的转化立法。这一点在很多合规文章里被略过,导致读者以为查完指令就查完了。 ## 一个可以直接借用的立法技巧 最后把这一节的方法论收一下,因为它在写内部规范时非常好用。 欧盟这套设计里有三个动作是配套的:规定供给(信息要以机器可读方式发布并定期更新)、规定需求(市场上必须存在至少一个符合八条要求的独立比价工具)、规定取用(第三方有权免费以开放格式使用这些信息去做那个工具)。三者缺一,整个链条就会断在某个位置。 把它翻译成你写规范时的检查表:每当你要求某个团队产出一份数据、一个字段、一套标记,先写清楚谁是它的消费方,消费方拿它做什么,以及消费方有没有权限和动机去拿。三个问题答不齐,这份产出在下一次减负时一定会被砍掉,而且砍它的人会拿着一份完全属实的使用量报告。 这也是为什么我这些年不太主张“先把基础打好,价值以后自然会体现”这种说法。价值不会自然体现,价值需要有人来消费;没有消费方的基础设施不叫基础,叫库存。 ## 你的商品页上,哪些信息只做到了第一层? 宽带这个案例的价值不在宽带,在于它把一件普遍的事推到了极端:商品少到不可能有信息过载,监管细到不可能有人不知道该写什么,结果照样选不出来。你的站没有监管替你写字段清单,处境只会更松散。 ## 逐条对号入座 下面这张表按我这些年过手的独立站列的,第三列填的是行业里最常见的状态,不是最差的状态。 信息 | 用户拿它做什么判断 | 通常卡在第几层 | 升到下一层要动什么 | 合约期/订阅周期 | 算总支出 | 一层:写在条款页 | 搬到价格旁边,与价格同字号 | 次年价/续费价 | 比较真实成本 | 一层:藏在小字 | 与首年价并排显示两个数 | 运费与关税 | 算到手价 | 一层:运费政策页 | 列表页给区间,详情页给上限 | 交期 | 能不能赶上用 | 二层:详情页有 | 两个商品交期用同一种口径 | 规格参数 | 选哪一个型号 | 一层:一段自由文本 | 拆成固定字段,全站同名 | 成分/材质 | 能不能用、耐不耐用 | 一层:一长串 | 把用户真正在比的那两项提出来 | 尺码 | 合不合身 | 二层:有尺码表 | 同一属性在两个商品间对齐 | 库存与可得性 | 要不要现在下单 | 二层:显示有货 | 说清是哪个仓、什么时候发 | 退货窗口与谁付运费 | 估算试错成本 | 一层:政策页 | 写进每个商品的固定字段 | 单位价格 | 比不同规格的划算程度 | 多数没有 | 算出来,放列表页 | 最后一行值得单说。单位价格是个稀罕物种:它是极少数专门为跨商品比较而被造出来的字段——把不同包装规格换算到同一个分母上,让500克装和1.2千克装可以直接比。欧盟对它有强制要求,而多数站上它是整页唯一一个你从没存过、只能现算的数字 (https://zhangwenbao.com/unit-price-denominator-eu-rules-product-list.html)。这两件事其实是同一件事的两面:因为它天生属于第三层,所以商品数据库里没有它的位置,因为数据库里没有,所以它总是最后才被想起来。 ## 三个最容易被误判的例子 误判一:做了尺码表就等于做了尺码。尺码表是典型的第二层做到了、第三层没做。用户在两件衣服之间犹豫时,要比的是这两件的同一个部位,而两个商品页的尺码表往往行数不同、部位命名不同、有的量平铺有的量围度。更根上的一层是,行业标准用的词和用户描述自己的词本来就对不上 (https://zhangwenbao.com/apparel-size-self-identification-label-gap.html),字段没对齐时这个偏差会被放大两次。 误判二:把折叠块当成节省空间。折叠、标签页、抽屉这类控件,本质是用第二层换第一层的整洁。信息还在,只是不在同一屏了。这件事在商品页上的代价已经量化过:横向标签把页面收拾干净,代价是用户再没法把两块信息放进同一屏 (https://zhangwenbao.com/product-page-horizontal-tabs-adjacency-requirement.html)。宽带那边的观察是同一个模式——有个站把套餐详情默认折叠在手风琴里,用户只能一个个点开才能看出三个套餐的区别。 误判三:把可选权益当成差异化。前面那个1% 的数字建议贴在选品会上。附加权益在立项时是差异化,在对比表里是噪音;它抬高价格、拉长条目、让“这个套餐到底含什么”这个问题多一层。想加,就把它做成加购项,别做成套餐的一部分。 ## 从第一层到第二层,比从零到一便宜得多 这是排优先级时最容易被忽略的一条经济性。 一条信息如果已经在站上存在,把它搬到决策位置需要的通常只是模板改动:字段已经有了,内容已经有人在维护,你要做的是让它在另一个位置也渲染一次。而一条从来没有过的信息,要新建字段、定义口径、回填历史数据、指定维护人、写进上新流程——后者的成本往往是前者的十倍以上,还会带来一条新的长期负债。 所以清单排序的第一原则是:先把已经存在但站错位置的信息搬对,再考虑补新字段。多数站在这一步能拿到的收益,比再写三段商品描述大得多,而且做完之后页面通常更短,不是更长。 ## 另外七类同样卡在第一层的东西 上面那张表按商品字段来列,还有一类信息不属于任何单个商品,但同样在决策里被反复用到,而它们几乎全部躺在第一层: - 能不能开发票、开什么票——在帮助中心里有,在下单页没有,B2B买家会为这一条专门发一封邮件; - 支持哪些支付方式——页脚有一排图标,但用户要到最后一步才知道他惯用的那个在不在里面; - 售后由谁负责、多久响应——条款页有,商品页没有; - 保修期从哪天算起——写了保修一年,没写起算点是下单日、签收日还是激活日; - 缺货后多久补货——只显示售罄,用户不知道该等还是该走; - 换货是否重新计算运费——退货政策里写了退,很少写换; - 数量阶梯的下一档在哪——报价按数量变,却不告诉买家再加多少件能进下一档。 最后一条是我最偏爱的例子,因为它几乎是白送的转化。买家已经决定买了、正在填数量,这时候告诉他“再加12件单价降到某个数”,是全站唯一一处用户完全不反感的加购提示——因为它帮他省钱,而不是让他多花钱。而做这件事需要的数据你早就有了,它就是价格阶梯表本身。 ## 怎么判断一条信息该不该进商品页 补齐信息很容易走向另一个极端,把什么都塞进商品页。有个判断标准比较管用:问这条信息会不会改变用户在两个候选之间的选择。 会改变的,进商品页,而且要进对比区域;不改变但会影响他买不买的,进商品页的次要位置;两者都不影响、只在买完之后才用得上的,留在帮助中心,并在订单完成页面上给入口。 这条标准跟电商页面设计那几条经验法则背后的认知心理学逻辑 (https://zhangwenbao.com/ecommerce-ui-ux-design-principles.html)是一致的:人在做取舍时的容量是有限的,你多放一样东西,就要有另一样东西让位。 按这个标准分一遍,多数商品页会变短而不是变长。把品牌故事和材质工艺的散文段落让出位置给合约期、单位价格、起订量这些枯燥的数字,通常是转化率提升最快的一次改版,也是最容易被品牌部门反对的一次。 ## 一个常被问到的问题:这会不会让页面变得很像表格 会,而且这未必是坏事。 做比较的时候,用户要的就是表格。散文适合建立好感,表格适合支撑决策,而这两件事发生在旅程的不同位置。常见的错误不是用了表格,而是把两者的位置搞反了——首屏堆一大段品牌叙事,参数表折叠在第五屏。 更实际的建议是:让同一份数据有两种呈现。商品页上给一份完整的字段表,列表页和对比页上只给那三到六个真的会被拿来比的字段。字段是同一套,展示密度不同——这也是为什么字段对齐必须先做,它是所有这些呈现方式共同的底座。 ## 那张并排的表本身怎么做 说了半天要并排,得给个具体做法,否则很容易做成一张谁也不看的大表。 列数控制在三到四个。超过四列,移动端就只能横滑,而横滑一旦发生,并排这件事在物理上就不成立了——用户仍然要靠记忆搬运数字。候选多于四个时,正确的做法是先让用户筛掉一批,而不是把表撑宽。 行的顺序按决策权重排,不按字段目录排。用户最先要排除的那个条件放第一行。多数品类里第一行是价格或总成本,第二行是那个最容易一票否决的硬条件——尺寸装不装得下、能不能配送到、合约要签多久。品牌故事和获奖记录不该出现在这张表里。 差异要被标出来,相同的要能折叠。三个候选里有八行完全一样、四行不一样,那么用户真正要看的是那四行。给一个“只看不同”的开关,是这张表上性价比最高的一个功能,实现成本极低。 空值不能留白。一个格子空着,用户读到的是“没有这个功能”,而实际情况往往是“这个数据我们没录”。写“暂无数据”和留白,在决策上是两个完全不同的信号,前者他会去查,后者他直接排除。 单位要写在表头,不要写在每个格子里。这既省空间,也强制你确认这一整行用的是同一个单位——如果写不进表头,说明这一行的字段还没对齐,那就先别做这张表。这其实是一个很好的自检:表头写不出统一单位的行,全都是字段治理没做完的地方。 最后一条经验,来自那些做得好的案例:并排表的价值不在于展示得多全,在于它替用户完成了排除。一张能让人在十秒内划掉两个候选的表,比一张列了三十行参数的表有用得多。做完之后自己试一遍——如果你自己盯着它也要看半分钟才知道该选哪个,那它还没做完。 ## 为什么并排这件事在你的团队里没有人负责? 如果第三层的价值这么明显,为什么它长期无人认领?我拆过几家客户的流程,发现原因不在能力,在于现有的每一个环节都恰好只能看到一个页面。 ## 四道工序,都是单页视角 模板系统按单个商品渲染。商品页模板拿到的上下文是一个商品对象。你可以在模板里写任何逻辑,但你写不出“另一个商品的这个字段是什么”,因为那个对象根本不在作用域里。列表页倒是拿得到多个商品,可列表页模板通常只负责卡片,卡片上放什么早就被定死了。 设计评审看的是单张稿。评审会上贴出来的是商品页的完整设计稿,大家逐块看,讨论层级、字号、留白。没有人会把两张同类商品的稿子并排贴出来,因为那看起来像是在浪费评审时间——两张稿子长得一样,有什么好比的。问题恰恰是它们长得一样却对不齐:同样的位置放的是不同的字段。 实验体系测不了跨页面的事。A/B测试的分流单位是用户或会话,度量单位是页面或漏斗步骤。你可以测“详情页加一个参数表能不能提转化”,但“用户在两个商品之间来回切换时是否更容易做决定”没有对应的实验位——因为它跨越了两个页面,而且那两个页面是哪两个,取决于用户自己怎么逛。 搜索落地页也是单商品页。自然搜索的落地页绝大多数是单个商品页,用户带着一个明确意图进来。这会强化一种错觉:用户是冲着这一个商品来的,所以把这一页讲透就够了。实际上他多半刚从另一个站的另一个商品页过来,脑子里正拿着一组数字。跨站同时比较这件事在归因报表里的样子我另外算过 (https://zhangwenbao.com/comparison-shopping-co-presence-join-key.html),五个渠道的占比加起来能到159%,因为同一个人在一次决定里开了不止一个网站。 ## 还有一层组织原因:谁来定字段名 字段对齐这件事最要命的地方在于,它不属于任何一个具体的人。 商品经理负责自己那条线的商品资料完整;前端负责模板正确渲染;设计负责视觉一致;内容负责文案质量。每个人在自己的范围内都可以做到满分,而“三条产品线在同一个属性上用了三个不同的名字”这件事,不在任何一个人的范围之内。 更隐蔽的是,这种不一致在内部完全不构成困扰。公司里的人知道净重和规格是一回事,知道“标准装”就是500克,知道A线的“适用温度”和B线的“耐温范围”说的是同一个指标。一个团队对自己产品的熟悉程度,恰恰是它最难发现这类问题的原因——评审桌上坐着的所有人,脑子里都有一张自动对齐的映射表。 ## 把它交给谁 结论其实很简单:这件事该挂在字段定义上,不该挂在页面设计上。 页面评审天然是单页的,你在那儿提“要跟另一个商品对齐”会显得跑题。字段定义评审天然是跨商品的——你定的是全站范围内这个属性叫什么、什么单位、取值范围是什么,讨论的对象本来就不是某一个商品。 操作上只要加一栏:新增或修改任何一个商品属性时,写清它在同类商品上的取值是否用同一个字段名、同一个单位、同一个取值集合。这一栏不许填“视情况而定”。属性没对齐时用户扫完一整屏一个都没点开,而这件事在报表里等于没发生 (https://zhangwenbao.com/product-list-item-attributes-silent-rejection.html),所以指望数据来提醒你是不现实的,只能靠流程卡。 ## 顺便,这也解释了筛选器为什么难做 很多站的筛选器做得不好用,根因不在筛选器本身,在于它是第三层的直接产物:只有当一个属性在全站商品上用了同一个封闭取值集合,它才能变成一个筛选项。属性一乱,筛选器要么选项爆炸,要么筛完是空。 所以筛选器的质量是字段治理的体温计。用户那边的感受同样是可观测的:在集合页连点五个筛选之后用户其实已经忘了自己选过什么 (https://zhangwenbao.com/shopify-collection-applied-filters-overview-ux.html),而那个“已选条件”回显区做不做得出来,也取决于每个筛选项有没有一个稳定的显示名。 ## 还有一个原因:它做完了不像做完了 前面讲的是流程上看不见,还有一层是交付物上不好看。 把三段文案加到商品页上,有截图;把参数表重新设计一遍,有对比图;做一次改版,有前后对照。而把两个商品的属性字段统一成同一个名字,做完之后页面看上去几乎没有任何变化——如果做得好,用户甚至不会注意到发生过什么,因为他只是没再感到别扭。 这类工作在组织里的处境很尴尬:投入是实的,产出是隐形的,汇报时只能说“我们统一了14个属性字段”,而听的人无法把这句话换算成任何他关心的东西。凡是做完之后没有截图可发的事,在争取资源时天然吃亏,这跟事情本身的价值无关。 破法是给它造一个交付物。最省事的就是那张并排截图:改造前数出来对齐3个字段,改造后数出来对齐11个。把一件隐形的工作绑上一个能被数出来的数字,它才有资格进入下一轮排期讨论。 ## 为什么用户调研也常常抓不到它 这类问题还有个特点:在标准的可用性测试里也不容易暴露。 常规测试的任务描述通常是“请在这个网站上找到一款适合你的某某产品并加入购物车”,任务范围被限定在一个站内。而真实的比较行为往往跨站发生——用户开着三个标签页,其中两个是你的竞争对手。被测的人在你的站上表现得很顺利,因为任务本身就假定了他会在你这儿选。 要抓到它,任务设计得改成开放式的,允许并鼓励参与者去任何地方看。宽带那轮测试之所以能测出85% 的人至少放弃过一个站,正是因为它的任务允许放弃。一个不允许用户离开的测试,测不出他为什么会离开。 如果没有条件做这种测试,退而求其次的信号是站内搜索和客服记录。用户在你的站内搜索框里打出带比较词的查询,等于在告诉你他想比却比不了;客服反复被问同一组问题,等于在告诉你这几个字段没到位。客服工单里能挖出来的东西比多数人以为的多 (https://zhangwenbao.com/customer-service-seo-collaboration-7-actions-tickets-help-center.html),而这类线索的好处是它天天都在产生,不用等排期。 ## 先动哪个团队 如果只能推动一个环节,我会选商品资料的录入端而不是页面端。 原因是脏数据一旦进库,下游每一个消费方都要各自处理一遍:模板要兼容、筛选器要兼容、数据源要兼容、导出的表格要兼容。在入口处多花十分钟,比在四个下游各花两小时便宜得多,而且它不会随时间变贵。这也是为什么卡点要挂在字段定义评审——那正是入口。 ## 地址交进来之前,那个商品到底存不存在? 宽带这门生意还有一个性质,在跨境电商里其实相当常见,只是没人把它单独命名过:页面上展示的不是商品,是商品的可能性。真正的商品——那个有确定价格、确定速率、确定能不能装的东西——要等用户把地址交进来之后才被算出来。 ## 超过一半的人会去看那张地图,而它的故障率是行业均值的两倍 电信那轮测试里有一组数字很说明问题:超过一半的参与者至少访问过一次覆盖地图,用来确认自己那一片有没有服务。这让它成为整个信息收集过程里的关键一步。 然后是坏消息:使用覆盖地图的参与者里有13% 遇到了技术故障,是该机构其他大规模行业研究里观察到的两倍。有人等了很久之后等来一个技术故障提示,说“到这一步我大概不会打那个电话了,我直接去别处看看”;有人对着一块加载失败的区域说“这显然也不工作,我不知道那本来该是个什么,地图之类的吧”。 一个行业里最关键、超过一半用户必经的那个功能,故障率是行业均值的两倍。这件事本身就是个信号:越是承担“把待定变成确定”职责的组件,越容易是重活——它要查后端、要连第三方数据、要渲染地图、要处理边界情况,于是它也最容易挂。而它挂掉的代价不是少一个功能,是整个商品重新退回不存在的状态。 ## 标签繁殖问题,和官方给的那个笨办法 待定商品会给披露带来一个数学上的麻烦:如果价格随地区变化,你到底该出几份披露? 美国这次修订正面处理了它。原规则要求逐项列出各类费用,而很多费用随司法辖区变化,结果就是每个辖区都得出一份单独的标签,官方文件里管这叫标签繁殖问题。行业技术咨询组织给出的方案是:用一个“最高不超过”的单值,显示所有辖区中适用的最高金额,技术上完全可行,不必为每个辖区各出一份。这次修订采纳了它,允许服务商披露最高值或确切金额。 这个笨办法值得抄。跨境独立站遇到的是同一道题:关税、增值税、偏远地区附加费、大件运费,全都随收货地变化,而你在商品页上要给一个数。三种处理方式的实际效果差别很大: 做法 | 用户能不能算 | 风险 | 写“以结账页为准” | 不能 | 把不确定性原封不动推给用户,弃购集中在结账前一步 | 只写最低值起 | 能算,但算出来是错的 | 结账时数字跳涨,信任一次性归零 | 给上限或区间 | 能算,且不会低估 | 看起来贵一点,但决策能当场完成 | 第二种是最常见也最危险的。配送成本这件事在下单前的弃购里占多大分量我单独拆过 (https://zhangwenbao.com/dtc-shipping-policy-page-seo-delivery-time-cost-transparency-conversion.html),这里只补一句实操:给上限的那个数,要在旁边写清它是上限,并给出一个“多数订单实际落在哪个区间”的说法。用户对“最多不超过”的接受度远高于对“起”的接受度,因为前者他能拿来做最坏打算,后者他没法做任何打算。 ## 词汇表里有这个字段,只是没人填 值得一提的是,结构化数据这一侧并不缺表达能力。schema.org的Offer类型上有 eligibleRegion 和 ineligibleRegion 两个属性,官方说明写得很清楚:取值可以是ISO 3166-1或ISO 3166-2代码、一个地点,也可以是一个GeoShape,用来表示该报价或配送费用规格有效或无效的地理政治区域。 GeoShape意味着你可以画任意多边形。也就是说,把一张覆盖地图表达成结构化数据,词汇表层面早就支持了,粒度甚至够用。同一个类型上还有 priceValidUntil、eligibleQuantity、advanceBookingRequirement 这些字段,把“这个价格什么时候到期”“要买多少才是这个价”“要提前多久预订”都留了位置。 然后是那个熟悉的结局:这些字段几乎没人填。跟机器可读标签的故事一模一样——表达能力早就到位,缺的是一个会读它并且读了会给你反馈的消费方。这也是为什么我不建议为了完整性去把schema的每个字段填满,而建议先弄清楚哪些标记真的参与了检索侧的判断 (https://zhangwenbao.com/schema-markup-ai-search-truth.html),再决定投入。 ## 和“那个数字还没算完”要分开看 这里也要跟一个近亲划界。之前拆过结账页的配送日期:你写的是2个工作日,他记的是周四,这两个数从来没在同一个系统里对过账 (https://zhangwenbao.com/checkout-delivery-date-unfinished-calculation.html)。那是一个已经确定的商品,它的某一个属性没算完,商品本身是存在的,用户已经决定买它了。 本节说的是另一件事:整个商品都还没成立。价格、速率、能不能买,全部取决于那个还没交进来的输入。这两者的差别决定了页面该长什么样——前者要把计算补完并对齐口径,后者要在收到输入之前就诚实地说清楚“现在你看到的是什么”,并且把收输入这一步放到尽可能靠前的位置,而不是留到结账。 说得再直接些:如果一个商品的价格必须等用户输入才能确定,那么先收输入、再展示商品,几乎总是比先展示一个随时会变的价格更好。宽带站上那个覆盖地图之所以有超过一半的人主动去用,正是因为用户自己知道这一点——他不需要被教育,他只是需要那个东西别挂。 ## 哪些生意其实都在卖待定商品 把这个性质拎出来之后会发现,它比想象中普遍得多。凡是符合“最终价格或可得性取决于一个用户还没提交的输入”的,都属于这一类: 品类 | 那个决定性的输入 | 页面上通常写着 | 跨境大件家具 | 收货地址与楼层 | 运费以结算页为准 | 定制印刷与包装 | 尺寸、数量、工艺 | 某某价格起 | B2B工业品 | 数量与交付周期 | 询价 | 保险与延保 | 年龄、地区、标的 | 低至每月多少 | 安装类服务 | 现场条件 | 标准安装免费 | 生鲜与冷链 | 配送地址与时段 | 部分地区可配送 | 分期与先买后付 | 信用评估结果 | 可分12期 | B2B那一行其实是把这个性质做到明面上的做法——直接写“询价”,等于承认商品还没成立。公司账户、分级定价与报价协商那一整套配置 (https://zhangwenbao.com/magento-2-b2b-company-account-shared-catalog-tier-pricing-negotiable-quote-operations.html)解决的正是这件事,只是多数消费品站没意识到自己也在卖同一种东西。 第三列全是同一种句式:一个不完整的承诺,配一个用户没法验证的限定词。而这些句式之所以流行,是因为它们在营销上确实有效——它们让首屏那个数字看起来足够低。代价是把验证成本推到了后面,而后面那个位置恰好是用户已经投入了时间的地方,落差在那里的破坏力最大。 ## 把收输入这一步前置,到底前置到哪 结论是:前置到用户第一次看到价格之前,而不是第一次决定购买之后。 具体位置取决于输入的成本。地址这种只要一次、之后可以记住的输入,适合放在列表页之前,用一个轻量的入口(选择配送地区、输入邮编);尺寸数量这种每次都不同的输入,适合放在列表页上作为筛选条件,让用户边填边看到候选集合的变化。 有两个细节容易做错。一是输入之后一定要把结果带回原来的位置,别让用户在一个浮层里得到答案,关掉浮层回到页面发现什么都没变——这件事在其他品类上已经被反复观察到,用户的反应通常是“这不是你们刚才给我的那个数”。二是要把他的输入复述出来:写“按你选的某地区某数量,单价为多少”,比只显示一个数字更能让他确信这个数是给他算的。 ## 还有一种更省事的做法:直接说清楚现在这个数是什么 如果收输入这件事一时做不了,还有一个成本极低的过渡方案:把当前显示的这个数字的性质写在它旁边。 “标准区域运费,偏远地区另计”比“运费以结算页为准”强;“1000件起的单价,数量越少单价越高”比“某某价格起”强;“不含安装,安装费视现场情况另报,通常在某个区间”比“标准安装免费”强。 这些写法都没有解决计算问题,但它们把不确定性的方向和大致幅度交代了。用户对不确定性的容忍度其实不低,他不能接受的是不知道自己在哪个方向上会被意外。说清楚方向的成本是一句话,而它能挽回的是结账那一步最贵的那一批流失。 ## 词汇表这一侧还有哪些字段被闲置 顺着 schema.org的Offer类型定义 (https://schema.org/Offer)翻一遍,会看到一批专门为“这个报价在什么条件下成立”准备的属性,绝大多数在真实站点上是空的: - eligibleRegion 与 ineligibleRegion:报价有效或无效的地理区域,可以用国家代码、行政区代码、地点,也可以用任意多边形; - eligibleQuantity:这个价格在什么数量区间内成立,正好对应起订量和阶梯价; - priceValidUntil:这个价格什么时候到期,对应促销价和首年价; - advanceBookingRequirement:需要提前多久预订,对应定制品和预售; - availabilityStarts:什么时候开始可以买。 把这五个字段并排看会发现一件事:它们描述的全部是“条件”,而不是“属性”。一个待定商品的本质,就是它的价格是一组条件的函数;而这套词汇表其实老早就准备好了描述这些条件的位置。 那为什么没人填?我的判断跟前面机器可读标签的结局是同一个原因:没有一个明确的消费方会因为你填了它而给你任何反馈。填了 eligibleRegion,搜索结果不会因此多出一行“你所在地区可用”;填了 eligibleQuantity,也没有哪个界面会把阶梯价展示出来。于是它就停在了“理论上应该填”这个状态里。 所以我的建议不是去把它们填满,而是把它当成一份现成的字段清单来用——它替你列出了一个待定商品需要交代清楚的所有条件维度。你可以不填标记,但这五个维度在页面上有没有说清楚,是可以逐条自查的。一份被闲置的规范,往往是最好的需求清单,因为它是一群人认真讨论过之后留下的共识,只是暂时没有消费方而已。 ## 这件事在搜索那一侧长什么样? 前面全在讲页面。但三层结构在搜索这一侧还有一组对应关系,做SEO的人会更熟悉,也更容易低估。 ## 被收录的,可能是一个还没成立的价格 待定商品的页面被抓取时,爬虫看到的是默认状态:没有地址、没有选项、没有数量,于是它抓到的价格是那个“最低档起”的数字。这个数字会进索引,会进结构化数据,会出现在搜索结果的富媒体展示里,也会被生成式检索拿去当作答案的一部分。 接下来的链条是这样的:用户搜到一个价格,点进来看到同一个价格,输入自己的信息之后价格变了。他不会认为这是配置差异,他会认为这个站在做诱饵。而这一次落差发生在他已经投入了填写成本之后,杀伤力比首屏就看到高价大得多。 这里有个容易被忽视的技术细节:如果你的价格是靠前端脚本在拿到定位之后再改写的,那么结构化数据里那个价格和用户最终看到的价格是两个数,而检索侧读的是前者。商品数据源那边的规则更硬——各大渠道对提交价与落地页价格一致性的要求都是刚性的,对不上的后果是商品被拒登,不是排名下降。这一层的完整口径可以对照购物渠道排序的几个决定性因素 (https://zhangwenbao.com/google-shopping-ranking-factors-traffic-exposure.html)来看,价格字段在那套排序里的权重比多数人估计的高。 ## 对比类的搜索意图,落在谁的页面上 还有一个结构性的机会常年被忽略。 用户在做跨商品比较时会去搜什么?他会搜“A和B哪个好”“A与B区别”“XX值不值”。这些查询的共同点是一个查询里出现两个实体。而你的站上,这类查询几乎没有对应的落地页——因为你的页面结构是一个商品一页,它天然对应“A怎么样”这种单实体查询。 于是这部分意图全部流向了第三方:测评站、聚合站、论坛、问答。这跟欧盟那条“必须存在至少一个独立比价工具”讲的是同一件事的两面——需求方一直存在,只是当你不满足它时,它会被别人满足,而那个别人不一定对你友好。 能做的事其实不复杂:在自己站内建立对比型的落地页面,把同一组商品的同一批字段并排放好。这类页面还有个额外好处,它天然是第三层的产物,做的过程会强迫你把字段先对齐。至于这类页面在专题与商品之间怎么分工、内链怎么收口,属于结构化数据与页面类型配合 (https://zhangwenbao.com/seo-schema-guide.html)那一层的话题,这里不展开。 ## 生成式检索会怎么处理你的待定商品 再往前一步。当答案是由模型拼出来的时候,“这个价格是起价还是到手价”这个限定条件极易在摘要过程中丢失。你写的是“起”,被引用出来的很可能是那个数字本身。 应对办法不是去跟模型较劲,而是把限定条件写进句子的主干,别放在括号里或者上标里。“月费39元起”很容易被摘成“月费39元”;“首年月费39元,次年恢复至59元”就很难被摘错,因为两个数字在同一个句子里互相锚定。这是一条对人和对机器同时生效的写法。 同理,覆盖范围这种信息,写“部分地区可用”等于没写;写“目前覆盖X、Y、Z三个地区,其余地区暂不提供”,人和机器都能用。凡是你希望被完整引用的限定条件,都要让它在语法上没法被单独摘走。 ## 回到那场关于机器可读的争论 最后把第三节那个争论收个尾,因为它对技术SEO的日常判断很有用。 那次交锋确立的界线是:为批量聚合而设计的数据文件,和为浏览器渲染并被辅助技术读取的语义化标记,是两条独立链路。套到我们的工作上: - 结构化数据面向的是抓取与理解,验收方式是用官方测试工具看它有没有被解析出来,以及在检索结果里有没有对应的呈现变化; - 语义化HTML与可访问名称面向的是渲染与辅助技术,验收方式是键盘走一遍、读屏走一遍; - 商品数据源面向的是渠道展示与排序,验收方式是看拒登率和字段覆盖率。 三条链路各有各的验收动作,任何一条做得好都不会自动带来另外两条的收益。把它们混为一谈,最典型的后果就是那句“我们schema都标了,为什么还是没有效果”——因为你标记的那件事,和你期待的那个效果,压根不在同一条链路上。 ## 对比页该怎么建才不变成薄内容 既然对比意图是真实存在的,那就得说清楚这类页面怎么做才不会翻车。 最常见的翻车方式是为每一对组合都生成一个页面。十个商品两两组合是四十五个页面,三十个商品就是四百多个,而其中绝大多数组合在现实里没有人比。这类页面的共同特征是内容高度模板化、彼此差异极小,正是搜索引擎最不愿意收录的那一类。 正确的做法是只做真实存在的那几组,判断依据有两个现成来源:站内搜索里带比较词的查询,以及一次会话内被同时访问过的商品对。后者尤其准,它不是用户说的,是他做的。多数站跑一遍会发现,真正高频的组合只有个位数。 这套做法在软件类目里已经很成熟,按功能与集成关系铺开的页面矩阵 (https://zhangwenbao.com/saas-page-matrix-feature-integration-comparison-seo.html)本质上就是把第三层做成了站点结构,实物商品这边反而少有人这么干。 内容结构上也有一条纪律:对比页的主体必须是那张对齐的字段表,不是两段商品描述的拼接。拼接出来的东西跟两个商品页都重复,而字段表是新信息——因为任何一个商品页上都没有另一个商品的数据。表后面再补一段“什么情况下选哪个”的判断依据,这段才是真正的差异化内容,也是最容易被引用的部分。 ## 内链要怎么收口 对比页建好之后,链接关系别只做单向。商品页要能链到它参与的那几个对比页,对比页要能链回每个商品页,分类页最好也给一个入口。这个双向结构的意义不在权重传递,在于它把“我想比一比”这个念头在用户产生它的地方接住了——而他产生这个念头的地方,正是某一个商品页上。 一个实操细节:商品页上那个链接的文案别写“对比”,写清楚跟谁比。“和某某型号的区别”比“产品对比”点击率高得多,因为前者回答了他脑子里那个具体问题。锚文本这件事上,具体永远赢过通用。 ## 价格历史那一格,顺便说一句 前面提到被撤掉的第三条是存档两年。这条对应到独立站上是价格留痕,而它在国内外都有对应的合规压力:促销时那个被划掉的原价,需要有证据表明它真实存在过,而能证明它存在过的只有你自己的价格历史 (https://zhangwenbao.com/strikethrough-price-prior-price-dtc-discount-display.html)。 把它放在三层框架里看会更清楚:价格历史是时间维度上的第三层——它让今天的价格能跟过去的自己并排。多数站没有它,不是因为难做(一张价格变更流水表而已),是因为它跟横向的字段对齐一样,不属于任何一个人的职责范围,而且做完之后页面上看不出任何变化。 顺手提一个几乎零成本的做法:在商品价格变更时写一行流水,字段只要商品、时间、旧值、新值、操作人五个。这张表不需要立刻拿来做任何事,它的价值在于三个月后你想做什么的时候,数据已经在那儿了。数据这件事最贵的不是存储,是没存的那段时间永远补不回来。 补一句容易被忽略的:这行流水的操作人字段,要能写“系统”。促销到期自动恢复原价、汇率浮动带来的重新计价、批量调价任务,这些变更不是任何一个人点出来的,但它们同样改变了价格。如果你的流水只记录人工操作,那么恰恰是那些没有人参与的变化会从记录里消失,而它们往往是数量最多的那一批。 ## 保哥的落地清单:怎么把三层验收挂进流程 讲到这里,方法已经清楚了,剩下的是怎么让它在一个真实团队里发生。下面这些是我在客户那边反复用的,能直接抄。 ## 五个不用埋点就能看的指标 这五个都不需要新加代码,数据早就躺在你的库里或者日志里。 - 一次会话里访问过两个以上同类商品详情页的会话占比,以及这些会话在两个页面之间来回跳转的次数分布。来回跳就是在用手动方式做并排比较;跳得越多,说明你越没给他工具。这个数字比任何满意度问卷都诚实。 - 从详情页退回列表页的比例。这是“我再看看另一个”最朴素的信号。把它和“从详情页直接加购”放在同一张表上,两条线的形状差别会告诉你这个品类到底是不是比较驱动的。 - 报价器或配置器提交过但没加购的会话里,重复提交不同参数的次数。重复提交等于在手动扫描价格空间,说明你没给他一次看到全貌的方式。 - 同一属性在全站商品上的取值基数。按属性名分组,数一下不同取值有多少个。基数异常大的那几个属性,就是没对齐的那些。这一条完全不看用户行为,只查自己的数据库,是全套里最便宜的一个。 - 站内搜索里包含两个商品名,或者带“区别”“哪个”“对比”“还是”这类词的查询占比。用户在你站内做比较却只能靠搜索去做,这是需求证据,而且是他自己写下来的。 这五个都属于先看现成数据、再决定要不要埋点的路子。如果你正在从零搭测量体系,顺序反过来会更贵——先把测量框架设计清楚再上工具 (https://zhangwenbao.com/measurement-framework-before-ga4-setup.html)这件事,在字段还没对齐的时候尤其重要,否则埋出来的事件参数会继承同一套混乱命名。 五条口径修正,不改会得到假信号:第一条要按会话去重,并排除刷新和回退造成的重复访问;第二条要排掉面包屑和分页带来的返回;第三条要判断参数是否真的变了,只改数量不算;第四条要先对取值做大小写与空格归一,否则算出来全是假阳性;第五条要先剔除品牌词和货号。 ## 清单怎么排序 两个维度相乘,别用别的: - 这条信息现在在第几层。已经在第一层的排前面,因为把已有信息搬到正确位置,成本远低于新建一个字段。 - 这个判断需不需要同时看到两个选项。需要的排前面,因为这类判断在你的页面上目前是零支持,用户只能靠开标签页和记性。 两维都占的那几条先做。两维都不占的,说明它其实是个内容质量问题,交给内容那条线,别占产品排期。 ## 一个验收动作 只做一件事:打开两个同类商品的详情页,在一块屏幕上左右并排放好,然后逐个字段数——有多少个字段在两边是同一个名字、同一个单位、同一个位置。三者全中才算一个。把那个数字写下来。 我做过十几次,多数站的答案是三到五个,而且通常是标题、主图和价格。这个数字的好处是它不需要解释:把两张截图并排贴进需求文档,没有人会问“这有什么问题吗”。 ## 卡点挂在字段定义评审,不挂在页面评审 原因前面说过:页面评审天然只能看到一个页面。落地方式是在字段定义评审里加一栏,只有一句话——这个属性在同类商品上叫什么名字、用什么单位、取值集合是什么。这一栏不许填“视情况而定”,填了就打回。 另外加一条纪律:新加的检查项,先造一个必然失败的例子,确认它真的会红。一个从来没红过的检查项和没有这个检查项,效果是一样的。 ## 一次失手复盘:那份报告是对的,它只是回答了另一个问题 客户是做定制包装材料的出海独立站,卖瓦楞纸箱、贴纸标签和缓冲材料,买家多是中小品牌和电商卖家,客单价中等,复购很高。这类商品的价格是算出来的:尺寸、材质、印刷色数、数量、要不要模切,任意一项变了价格就变,所以页面上写的全是起价。 原状是询盘量还行,报价器提交率也不低,但提交之后的成交比例一直上不去。 那三个月里做的最大一件事,是配合客户法务做了一次全站披露自查。对照欧盟那边的要求逐项过:单位价格有没有、材质说明有没有、送达时间有没有、退换条款清不清楚。一项一项打勾,最后出了一份验收报告,结论是全部合格。 而这份报告,就是这次失手的核心。 客服那边其实一直有反馈,而且反馈很稳定:客户来问的翻来覆去就是那几个问题——这个纸箱能装多重、你们的克重和别家的层数怎么换算、最小起订量到底是多少。每次这类反馈被拿到会上,都会碰到同一堵墙:我们查过了,信息都在页面上,这里有报告。 这堵墙特别难翻,因为那份报告是真的,结论也是对的——信息确确实实都在页面上。它只是回答了第一层的问题,而客服转述的是第三层的问题。一份结论正确的验收报告,把一个它根本没有回答的问题正式关闭了。 翻过来靠的就是上面那个笨动作。我把两个同类纸箱产品页并排放在一块屏幕上,逐字段数:十六个字段里,两边同名同单位同位置的只有三个,标题、主图、起价。一个页面写承重,另一个写抗压强度;一个用克重,另一个用层数;最小起订量在一个页面上紧挨着价格,在另一个页面上躺在下方的说明段落里。 后来真正见效的是两个动作,都跟“把信息写得更全”无关: - 把报价器的输入前置到列表页。既然商品在拿到尺寸和数量之前根本不成立,那就先收这两个输入,再展示带着真实价格的商品。用户少走一步,页面上那个数也终于变成了一个能拿来比较的数。 - 建一张全站属性字典。同类商品强制用同一个字段名和同一个单位,换算关系写进字段说明。附带产物是这个站第一次有了能用的筛选器——在此之前不是没做,是做了之后筛完总是空的。 结果也符合这个诊断:询盘总量没怎么变,成交比例变了,客服那三类问题的占比明显下降。这也说明之前的问题从来不在获客那一端。 ## 这次失手和前面那些不一样在哪 做过的复盘里,预警失效的形态各不相同:有的根本没有预警;有的预警用了另一个部门的语言,收件人读不懂;有的被读成了捷报;有的响了、准了,但送到了错的人手上;有的干脆是记录本身缺席,系统里连一行都没有。 这一次是新的一种:预警既没有被忽略,也没有被误读,它被一份正式文件宣告为已解决。而那份文件本身没有任何毛病。 由此得到一条可以直接抄的判据:任何一次验收通过之后,追问一句——这次验收能不能通过,取决于我们看了几个页面?只看一个页面就能通过的验收,覆盖的一定只有第一层。再往前推一步就是那条更硬的:凡是能靠一张清单逐项打勾完成的检查,天然只能覆盖第一层;第二层要靠观察真实用户,第三层必须把两个页面并排放在一起看。这三件事的成本和形态完全不同,把它们写进同一张验收表,最省事的那一项会把另外两项的名额吃掉。 ## 这套东西不解决什么 边界要先说清楚,否则期望会歪。 它不解决产品线本身太杂——如果你的同类商品有二十几个型号,彼此差别小到连你自己都要查表,那该做的是砍,不是对齐。它不解决价格没有竞争力,对比表做得再好,也只是让用户更快地确认你贵。它也不保证短期数字好看:把次年价、运费上限、最小起订量老老实实写到决策位置上,一部分本来会盲下单的人会想清楚然后不下单,这批订单消失在当期,而省下来的退货、纠纷和客服成本要到下个季度才体现。这笔账要在动手之前就跟决策人对齐,不然第一个月的数据一出来,这件事就会被推翻。 最后,它也不适用于纯冲动型的低客单价品类。那里的用户压根不做比较,你把三层做到满分,他还是看一眼就买或者看一眼就走。判断标准很简单:去数一数有多少会话访问了两个以上同类商品页,如果这个比例很低,那这篇文章讲的事情在你的站上就不是主要矛盾。 ## 一页纸速查 把全文能带走的东西压成一张表,贴在需求文档最前面就够用了。 层次 | 问自己 | 验收方式 | 典型失败 | 存在 | 这条信息站上有吗 | 清单逐项打勾 | 写在条款页,商品页没有 | 在决策位置 | 它在用户做决定的那一屏吗 | 观察真实用户;退而求其次看是否需要额外操作 | 折叠、浮层、跳转新页 | 可跨项对齐 | 它能跟另一个选项的同一条并排吗 | 两个页面并排放,数同名同单位同位置的字段数 | 同一属性三条产品线三个名字 | 再配三句话就完整了:合规只查第一层;页面评审只能看到一个页面;能靠打勾完成的检查天然覆盖不到后两层。 ## 如果只做一件事 那就做那个并排动作,今天就能做,不需要任何人批准。 打开你自己站上两个同类商品页,左右并排,数一数有多少个字段是同名、同单位、同位置的。数完之后你会得到一个很小的数字,以及一份现成的待办清单——那些对不齐的字段,按“用户会不会拿它做选择”排个序,前三个就是下个迭代的内容。 这件事的说服力来自它不需要论证。你没法跟人争论“用户其实很难比较”,但你没法否认两个页面上同一个东西被叫了两个名字。 ## 最后回到那张营养成分表 宽带标签是照着食品营养成分表设计的,这个类比一开始就埋着一个不太起眼的问题。 营养成分表能起作用,靠的不是它的字段设计有多科学,而是三件跟设计无关的事:它印在包装上,用户不需要点击;它格式全国统一,两盒不同牌子的麦片可以直接对着看;它就在货架上,而货架的本质就是把候选项并排摆着。 这三件事,恰好就是第二层和第三层。换句话说,营养成分表之所以成功,靠的正是宽带标签在2026年7月被撤掉的那三条。字段照抄了,让字段起作用的那些条件没抄——而后者从来不写在字段规范里,它们写在超市的货架结构里。 你的商品页也是一样。字段清单谁都能列,真正决定它有没有用的,是这些字段被放在了哪儿,以及它们能不能跟旁边那个选项对上。 ## 常见问题解答 ## 商品信息明明都写全了,用户还是选不出来,问题通常出在哪一步? 大概率卡在第二层和第三层之间。信息写全只属于第一层,它保证的是内容在站上找得到。往下要问的是:这条信息出现在用户做决定的那一屏吗,还是要点开折叠块、跳转新页面才看得到;以及,它能不能跟另一个候选商品的同一条信息并排对齐。多数团队在第一句上答得很好,到第三句才发现这件事从来没有人负责过。有个不用查数据的快速判断法:打开两个同类商品页并排放在一块屏幕上,数一数有多少字段是两边同名、同单位、同位置的。我做过十几次,多数站的答案是三到五个,而且通常只有标题、主图和价格。 ## 折叠块、标签页这类控件到底还能不能用? 能用,但要清楚你在拿什么换什么。这类控件的本质是用第二层换第一层的整洁:信息还在页面上,只是不在同一屏了。判断标准不是控件好不好,而是被折起来的那条信息参不参与当前这个决定。如果用户要比的正是它,那它就不该被折叠——他得点开、记住、关掉、去另一个页面再点开、再回忆,而人的工作记忆装不下几组多元数据。反过来,说明书下载、保养建议、品牌故事这类不参与决策的内容,折起来完全合理。一个可操作的分界线是:凡是会出现在用户对比清单里的字段一律不折叠,其余随意。 ## 价格随收货地址或配置变化时,商品页上该写哪个数字? 三种写法里,写上限或区间通常最好。写“以结账页为准”等于把不确定性原封不动推给用户,弃购会集中在结账前一步;只写“多少起”看着漂亮,但用户按它做的计算全是错的,结账时数字跳涨,信任一次性归零,而且落差发生在他已经付出填表成本之后。给上限看起来贵一点,但用户能拿它做最坏打算,决策可以当场完成。实操上要在数字旁写清这是上限,并补一句多数订单落在哪个区间。更根本的办法是把收输入前置:既然商品在拿到地址之前根本不成立,那就先收输入再展示商品。 ## 只有十几个SKU的小站,也需要做字段对齐吗? 需要,而且小站做起来更便宜。字段对齐的成本几乎完全取决于商品数量和历史包袱,十几个SKU意味着你一个下午就能把属性字典建完,而等到几百个SKU、三条产品线各自演化出一套叫法之后再做,就得回填历史数据、协调多个负责人、还要处理已经上线的筛选器和数据源。判断要不要现在做,有个更准的依据不是SKU数量,是去数一下有多少会话访问了两个以上同类商品页。这个比例高,说明你的用户在做比较,那么字段对齐就是主要矛盾;比例很低,说明这个品类是冲动型的,用户看一眼就决定,那这件事可以往后排。 ## 结构化数据是不是填得越全越好? 不是。判断一个字段值不值得填,只问三个问题:谁会读它,读到之后他会做什么,这件事发生了我怎么知道。有一个答不上来就往后排。宽带标签是很好的警示:监管强制服务商把标签做成机器可读文件挂在专用网址上,两年后废除时给的理由之一,是没有记录证据表明有第三方用它做出了面向消费者的工具。供给侧完全照做了,只是没有需求方。schema.org上那些表达力很强的条件字段几乎没人填,也是同一个道理。与其求全,不如先确认哪些标记真的参与了检索侧的判断。 ## 怎么说服老板做这件事? 别用“体验更好”这个量纲,它进不了排期。换成三个能被复述的东西。第一个是那张并排截图:两个同类商品页放在一屏,数出来只有三个字段对得齐,这张图不需要任何解释。第二个是同一属性的取值基数,一条查询就能跑出来,基数异常大的就是失控字段,属于数据治理问题,不涉及审美之争。第三个是把它挂到已有的合规待办上,单位价格、价格历史这些本来就有外部要求,要改的位置跟你是同一处。另外要主动交代边界:短期数字可能不好看。 ## 做对比型页面会不会造成站内内容重复? 只要它不是把两个商品页的文案拼在一起,就不会。对比页的价值来自那张对齐的字段表,不是描述文字,所以正确做法是少写散文、把同一批字段用同一个单位并排列出,再补一段“什么情况下选哪个”的判断依据。这样产出的内容跟任何一个商品页都不重复,因为商品页上没有另一个商品的数据。要注意别为每一对组合都生成页面,那会造出大量薄内容;只做真实存在比较需求的那几组,依据可从站内搜索的比较词查询、以及一次会话内被同时访问的商品对里取。 ## 权威参考资料 ## 商品页上被划掉的那个原价,只有你自己的价格历史能证明它存在过 - URL:https://zhangwenbao.com/strikethrough-price-prior-price-dtc-discount-display.html - 分类:DTC合规与法务 - 发布:2026-07-27 | 更新:2026-07-27 - 摘要:拆解商品页折扣展示里最容易出事的一环:那个被划掉的原价该拿什么来定。逐条讲欧盟第6a条的三十天最低价、C-330/23判决对百分比与促销措辞的约束、德国条例第9条与第11条的一松一紧,以及价格事件表怎么建、折扣兑现率怎么算,附十八项上线自查与四周落地路径。 - 关键词:结构化数据,独立站,缓存 > **TLDR**:摘要:商品页上被划掉的那个价格不是价格,是一句断言,断言你以前卖过这个数。美国1967年的规则问你是不是善意挂过,欧盟2019年起改问你过去三十天的最低价是多少,Google的词表干脆把这个字段从厂商建议零售价改名成划线价。做直连消费者品牌的人没有同区域比价、也没有第三方厂商,唯一合法的参照系只剩自己的价格历史。 > 摘要:商品页上被划掉的那个价格不是价格,是一句断言,断言你以前卖过这个数。美国1967年的规则问你是不是善意挂过,欧盟2019年起改问你过去三十天的最低价是多少,Google的词表干脆把这个字段从厂商建议零售价改名成划线价。做直连消费者品牌的人没有同区域比价、也没有第三方厂商,唯一合法的参照系只剩自己的价格历史。 ## 折扣的说服力全长在页面上,可它成不成立一个像素都不在页面上? 先把这件事的性质说清楚:划线价不是一个价格,它是一句关于过去的话,而这句话的真假不由版式决定。 先说清楚这篇要处理的是哪个数字。商品页上那个带删除线的价格,行业里叫划线价,代码里通常叫originalPrice或者compareAtPrice,营销同学口中叫原价。它挨着实际售价,字号小一号,颜色浅一档,几乎所有做电商的人都默认它是个装饰件。 它不是装饰件。它是整个商品页上唯一一个对过去做出事实陈述的元素。 ## 四个展示上的坑,来自十几万小时的可用性测试 Baymard Institute那篇讲商品页折扣展示的研究里,把常见毛病归成四类:价格与折扣淹没在页面其他元素里、折扣信息离价格太远、同一个促销在页面上被写了好几遍、以及没有把降幅用百分比或者绝对金额突出出来。他们给的量化结论是,18%以上的站至少中了其中一条,其中桌面端有18%的站让用户找价格找得费劲,14%的站把促销信息摆在离价格很远的地方,而在展示促销的站里有19%用多种说法描述同一个优惠,把用户绕晕。 这些结论我基本都认。测试里有个受试者在Patagonia的商品页上反复上下滚动找价格,最后骂了一句才发现它就在标题下面;Baymard记的那次测试里,67%的参与者在这个站上找价格有困难。另一个受试者在MVMT上看到全站横幅在推折扣,商品页的价格却没体现,只好先把商品加进购物车才看到折后价。这类观察很扎实,它们描述的是人眼在一屏信息里的搜寻行为。要把这类问题一条条验过去,从按钮到结账的三十个对照实验方案 (https://zhangwenbao.com/ab-testing-ctr-conversion-optimization.html)里有现成的题目可以照着排。 ## 可是这四条全都在处理同一个层面 字号、颜色、位置、重复次数、用百分比还是用绝对金额——这五个变量有一个共同点:它们全都关于这个数字长什么样,没有一个关于这个数字是什么。 把划线价放大两号、涂成红色、挪到价格旁边,用户确实更容易看见它,也确实更容易相信自己捡到了便宜。但这一整套操作里没有任何一步验证过一件事:这个商品在此之前,究竟有没有卖过那个被划掉的价。 ## 划线价是一句话,不是一个数 把它翻译成中文就清楚了。页面上写着划掉的 €59.00、现价 €39.00,等于对着买家说了一句:这件东西原来卖59欧元,现在卖39欧元。这是一个可以为真也可以为假的陈述句,跟天气预报、财务报表、产品参数是同一类东西。 而排版能做的事只有一件——让这句话更容易被听见,更容易被相信。排版不改变这句话的真假,它只放大这句话说错时的后果。把一句假话印得更大更红,不叫优化,叫加重情节。 ## 说服力和真实性挤在同一个数字上 这是折扣展示这件事真正拧巴的地方。商品页上大多数元素,说服力和真实性是分开的:产品图负责说服,规格表负责真实;文案负责说服,成分表负责真实。你可以把图拍得好看,规格表照实写,两者互不干扰。 划线价不行。同一个数字既是说服工具又是事实陈述,而这两种身份的优化方向恰好相反——作为说服工具它越大越好,作为事实陈述它必须精确等于某个特定的值。营销团队天然往前一个方向推,而后一个方向没有人负责推,因为它看起来根本不像一个需要有人负责的事。 ## 这个字段和商品页上别的字段有一处关键差别 售价填错了,你会在几分钟内知道。支付网关会照着它扣款,财务会照着它对账,毛利报表会照着它跳水,客服会接到电话。售价周围站着一圈随时会替你报警的系统。 划线价周围一个都没有。它不参与结算,不进对账,不影响任何一张财务报表,改了不会有任何下游系统抗议。它在数据库里是一个自由输入的数字,谁有后台权限谁就能改,改完没有日志、没有审批、没有比对。一个能被随便写、没有任何一方会因为它不对而叫痛的字段,最后长成什么样,基本可以预料。这跟法务与业务之间那些没人认领的动作点 (https://zhangwenbao.com/legal-counsel-seo-collaboration-7-actions-privacy-trademark-incident.html)是同一类组织毛病,缺的从来不是能力,是一个会因为它出错而难受的人。 ## 打折没问题,问题在拿什么当基准 这里先把立场说明白,免得后面几节读起来像在劝人别打折。促销是正当的商业手段,限时降价、清仓、季末处理、节日活动,全都合法也全都有效。所有这些规则处理的都不是“能不能降价”,而是“降价的时候,你拿哪个数字来衡量自己降了多少”。 换句话说,被管的是那句比较,不是那个动作。你把59欧元的东西卖39欧元,这件事没人有意见;你说这是打了六六折,这句话就得站得住。差别在于前者是你的经营自由,后者是你对公众做的一次陈述。 ## 这篇和另一个价格数字讲的不是一回事 我前不久写过商品列表页上那个每千克价格的分母到底该取哪个数 (https://zhangwenbao.com/unit-price-denominator-eu-rules-product-list.html),两篇很容易被当成一件事,这里先划清界限。那篇处理的是分母:单位价格等于售价除以含量,麻烦全在含量那一侧——净含量、稀释后等效量、能用多少次,三个数都在你系统里,法律只认其中一个。 这一篇处理的是分子的参照物:不是这个价格该除以什么,而是这个价格该跟什么比。两者在条文上甚至分属不同章节,在代码里分属不同模块,在组织里往往也分属不同的人。唯一的共同点是,它们都是页面上看起来最不重要、实际上最没人管的那类数字。 ## 为什么这件事对做出海的人格外要紧 国内电商环境里,划线价长期是个软规则,平台管得比法律紧,处理方式通常是平台侧的规则限制加事后申诉。出海之后规则的形态完全变了:在欧盟,它是一条写进指令、由成员国转化成本国条例、可以被消费者协会和竞争对手直接告上法庭的强制义务;在美国,它是联邦贸易委员会一份沿用了半个多世纪的指南;在英国,它2025年4月起进了一份无条件禁止清单。 更麻烦的是,这三套规则对同一个数字给出了三个不同的定义,而你的系统里通常只存了一个数。这篇文章要做的事,就是把这三个定义摆开、把它们各自要求你存下什么摆开,然后说清楚在只有一张商品表和一个compareAtPrice字段的现实里,该怎么把这件事收拾干净。顺带一提,主体设在哪个法域也会影响你先撞上哪一套规则,这方面可以对照美国、英国与香港三地架构的税务与合规差异 (https://zhangwenbao.com/dtc-overseas-incorporation-us-llc-uk-ltd-hk-ltd-3-region-comparison.html)。 ## 先给一个不太舒服的判断 如果你现在打开自己的后台,找不到一张能回答“这个SKU在过去三十天里,对消费者适用过的最低价是多少”的表,那么你所有的折扣展示优化——不管做得多漂亮——都建立在一个你没有能力验证的断言上。 这不是危言耸听,这只是把顺序摆正:先有可验证的参照价,再谈这个数字该用多大的字号。顺序反过来的时候,做得越用力,暴露得越快。 ## 你的划线价到底能拿哪个数字来划? 美国那份1967年的老指南里其实写了三个可比对象,而做直连消费者品牌的人,亲手把其中两个吃掉了。 要判断一句“原价59欧元”是真是假,你得先回答一个更基础的问题:跟谁比。这个问题的答案不止一个,而且不同答案对应完全不同的举证责任。 ## 一份1967年的规则,把可比对象列了三种 美国联邦贸易委员会的《反欺骗性定价指南》收在联邦法规汇编第16编第233部分,最初发布于1967年11月8日,五十多年没有实质改动,今天仍然生效。它一共五节,前三节各处理一种比较方式,读下来会发现它其实是在给“打折”这件事做分类。 第233.1节处理的是跟自己的历史价比:广告里说“原价多少、现价多少”。第233.2节处理的是跟同区域别家的价比:广告里说“别处卖10美元,我们卖7.5美元”。第233.3节处理的是跟厂商建议零售价比:广告里说“建议零售价10美元,我们卖7.5美元”。第233.4节管买一赠一那类,第233.5节兜底。 ## 第一种:跟自己的过去比,标准是善意 第233.1节(a)款给的判据是,前价必须是实际的、善意的、在合理相当的一段时间内按常规向公众提供过的价格。反过来,如果那个前价是虚构的——比如人为设一个虚高价,就为了随后能宣布一次大降价——那么这个所谓的便宜就是假的,买家没有得到他以为自己得到的那份额外价值。 这一节里有一句话特别容易被误读,值得单独拎出来:前价不会仅仅因为没有人按那个价成交过就被认定为虚构。也就是说,挂牌但零成交的价格,在美国规则下仍然可以当前价用。但紧接着的限定条件很重,这个价格必须是公开且主动地、在合理相当的时间内、在近期的正常经营过程中、诚实并善意地提供过的。而且第233.1节(b)款还补了一句:除非确实有相当数量的成交,否则要避免任何暗示前价是成交价的措辞,比如“原售价多少”这种写法。 ## 那个钢笔的例子,今天的独立站还在天天重演 第233.1节(c)款举了个例子。零售商约翰进货成本5美元一支钢笔,惯常加价五成,也就是常规售价7.5美元。为了随后能推出一个惊人的优惠,他先把标价挂到10美元。他清楚这个价格基本卖不掉,但他不在乎,因为只挂几天。然后他把价格“降”回7.5美元这个原本的水平,打出广告:超值特惠,原价10美元,现仅售7.5美元。 这个手法在今天有个更好听的名字,叫“新品上架高开”,在给零流量商品重新找机会 (%szombie-sku-revival-performance-max.html)这类场景里尤其常见。做法完全一样:新品上线时挂一个没打算卖的价,挂两周,然后进入长期折扣状态。半个多世纪前就被点名的做法,换了个说辞又活了一遍。 ## 一句只写“大促”不写数字的文案,也可能出问题 第233.1节(e)款处理的是另一种情形:广告里既不写前价也不写降幅,只写一个“Sale”。条文说,这时候商家要注意降价幅度不能小到毫无意义,它应当大到足以让消费者在知道具体数额后仍然认为自己得到了真实的优惠。举的例子是把原价10美元的商品标成“降至9.99美元”——消费者会理解成这是一次相当可观的让利,而不是一分钱。 这一条在国内的运营语境里几乎没有对应物,但它揭示了美国这套规则的性质:它管的不只是数字对不对,还管这次促销在实质上算不算一次促销。这种判断没法写进代码,只能由人来做,最终由法院来做。 ## 这份指南的性质:不是条文,但是执法的依据 需要说明一句,第233部分的正式名称是《反欺骗性定价指南》 (https://www.ecfr.gov/current/title-16/chapter-I/subchapter-B/part-233),属于指南而非规则,授权来自《联邦贸易委员会法》第5条和第6条。它本身不直接设定罚则,作用是说明委员会在什么情况下会认为某种定价宣传构成不公平或欺骗性行为。换句话说,违反它不等于自动挨罚,但它是执法机构判断的公开标准,也是原告律师起草诉状时的现成模板。 对做出海的人来说,这个性质意味着两件事:一是没有一个明确的数字门槛让你踩着线走;二是判断权在别人手里,而对方使用的判据里有大量“善意”“合理”“相当数量”这类词。这是一套你无法在发布前自证合规的规则。面对这类规则,唯一靠谱的做法是把判断交给流程而不是交给某个人的记忆,思路可以参考出海合规架构的分层做法 (https://zhangwenbao.com/seo-legal-compliance-gdpr-ccpa-consent-mode-cross-border-architecture.html)。 ## 第二种和第三种,需要的是站外的事实 第233.2节和第233.3节的判据都指向你的门外。前者要求你合理确信自己宣称的那个较高价格没有明显超过本区域内该商品实际大量成交的价格;第233.3节则说得更直白:厂商建议零售价只有在你的经营区域内有相当数量的实际成交发生在这个价位上时,才不算虚构。它明确指出,如果这个建议零售价明显高于本区域内实际大量成交的最高价,消费者被误导的风险就很清楚也很严重。 第233.3节(i)款还堵了一个口子:厂商不得为了配合特定零售商而在标签上印虚高价,让对方拿去做虚假的降价比较。这句话是写给品牌方看的。 ## 做直连消费者品牌的人,把中间那两个参照系吃掉了 现在把这三种比较方式放到一个直连消费者的独立站上,逐条对一遍。 可比对象 | 传统零售商能不能用 | 直连消费者品牌能不能用 | 原因 | 自己的历史价 | 能用 | 能用 | 只要留了价格变更记录 | 同区域别家的售价 | 能用 | 基本用不了 | 自有品牌在本区域没有第二家在卖同一件商品 | 厂商建议零售价 | 能用 | 用不了 | 你自己就是厂商,你建议的价就是你自己定的价 | 同类可比商品价 | 能用 | 风险高 | 要证明对方商品在品质上确实相当,且在本地买得到 | 第二行的原因很直接:自有品牌商品只在自己站上卖,所谓的本区域市场价不存在。第三行更彻底——当你既是厂商又是唯一的零售商,厂商建议零售价这个概念在逻辑上就塌掉了:你在拿自己定的一个数字,去证明自己定的另一个数字很划算。第233.3节要求的“相当数量的实际成交发生在这个价位”,在只有一个销售渠道的情况下,等价于要求你自己真的按那个价卖过——绕一圈又回到了第233.1节。 ## 于是唯一剩下的参照系,是你自己的价格历史 这就是这篇文章的核心判断。传统零售商手上有三条可比路径,做直连消费者品牌的人在商业模式上主动砍掉了两条——砍得很值,因为砍掉中间商正是这个模式的全部意义——但砍掉的同时,也把折扣宣称的举证责任全部压回了自己的价格历史上。 这也是高客单价品牌更依赖内容和信任 (https://zhangwenbao.com/high-ticket-dtc-content-trust-geo-strategy.html)的另一面:既然没有第三方价格可供比较,你就得自己把这件东西凭什么值这个价说清楚。这里还有个不太好笑的对称:直连消费者品牌最引以为豪的那件事,恰好让它在折扣合规上只剩一条退路,而那条退路是一张多数人根本没建的表。参考出海独立站定价的决策框架 (https://zhangwenbao.com/dtc-pricing-strategy-cost-plus-value-based-framework.html)里的说法,价值定价的品牌尤其吃亏——它的定价本来就不参照成本也不参照同行,那它更没有第二个数可拿来比。 ## 顺带把两个常见的替代方案说死 方案一是拿别的市场的价来划。比如欧洲站显示的原价其实是美国站的价格,或者是没打折那个国家的价格。这个做法在第233.2节下站不住,因为它比较的不是消费者所在区域的价格;在欧盟规则下更站不住,理由下一节讲。多市场的价格本来就该按各市场独立的店铺架构 (https://zhangwenbao.com/shopify-markets-vs-plus-expansion-stores-international-seo-architecture.html)来管,跨市场借用一个数字,等于把两边的口径同时弄脏。 方案二是拿建议零售价当划线价,而这个建议零售价是自己拍的。这个在第233.3节下就是典型的虚构价,而且是被条文点名的那一种。一个只在你自己的价格表里出现过、从没被任何人按这个价买走过的数字,不管你在后台把它命名成什么,都不能拿去做比较。 ## 欧盟为什么把“你是不是真心的”换成了一个能查询的数? 同一件事,一边问动机,一边问数据。这个差别决定了它在你这儿是法务议题还是工程议题。 欧盟处理同一件事的路径完全不同。它没有去定义什么叫善意,而是把这个概念替换成了一个可以从数据库里查出来的数。 ## 一条只有五款的新条文 2019年11月27日通过的第2019/2161号指令,业内习惯叫它现代化指令,做的事之一是给1998年的价格标示指令插入了一条新的第6a条。这条不长,五款,值得逐款读。 第6a条的五款条文 (https://eur-lex.europa.eu/legal-content/EN/TXT/HTML/?uri=CELEX:32019L2161)可以这样拆。第1款:任何降价公告都应当标明商家在降价适用之前的某一确定期间内所适用的前价。第2款给出前价的定义:前价指商家在降价适用之前不短于三十天的期间内所适用的最低价格。第3款允许成员国对易腐或保质期短的商品另定规则。第4款允许成员国对上市不满三十天的商品缩短这个期间。第5款允许成员国规定,在降价幅度逐步加大的情况下,前价取首次降价开始之前的那个未降价的价格。 ## 把这条翻译成一句工程语言 它说的其实是一句SQL。取这个商品在过去三十天里所有对消费者生效过的价格,求最小值,这个最小值就是你唯一可以拿去划线、也是唯一可以拿去算百分比的那个数。 注意条文用的动词是“适用过”,不是“成交过”。只要这个价格在你的站上对消费者生效过——哪怕一单没卖出去——它就进入了那个取最小值的集合。这一点和美国规则表面上一致(都不要求成交),实质上正好相反:美国允许你把一个没成交的高价当前价,欧盟则强迫你把一个没成交的低价算进来。同一个“不要求成交”,一个是给你放宽,一个是给你收紧。 ## 定性标准和定量标准,差别不在严格程度 很多人的第一反应是欧盟这条更严。我的看法不太一样,它们严格程度未必可比,真正的差别在别处。 对比维度 | 美国那套(第233部分) | 欧盟那套(第6a条) | 问的问题 | 你当时是不是真心想按那个价卖 | 你过去三十天的最低价是多少 | 判据类型 | 意图、商业惯例、是否公开主动 | 一个可计算的统计量 | 需要的证据 | 邮件、会议纪要、上架决策、销售记录 | 一张带时间戳的价格变更表 | 谁能判定 | 执法机构与法院,事后 | 你自己,事前 | 发布前能否自证 | 不能,只能自我评估风险 | 能,跑一次查询就知道 | 在组织里归谁 | 法务与市场负责人 | 数据与工程 | 降幅太小算不算问题 | 算,第233.1节(e)款明确管 | 不算,标出前价即可 | 最后一行的差别很有意思。在欧盟,你把三十天最低价老实标出来,然后只降五分钱,条文层面挑不出毛病;在美国,这样做本身就可能构成误导。一个管披露,一个管实质。管披露的规则可以自动化,管实质的规则不能。 ## 可自动化,意味着这件事该归工程 这是我认为最值得跟团队讲清楚的一层。当一条规则的判据是一个可计算的数,它就从法务议题变成了工程议题,处理方式也跟着变——不再是每次大促前请法务过一遍文案,而是在促销排期系统里加一道发布前的校验。 这个转变的收益不只是省了法务的时间。更重要的是它把这件事从事后挪到了事前:法务过文案只能告诉你“这么写风险有点高”,而一次查询能告诉你“这次能标的前价是39欧元不是59欧元”,是个确切答案。团队对确切答案的执行率,比对风险提示的执行率高得多。 ## 三个成员国选项,决定了你必须按国家分表 第3、4、5款都是“成员国可以”,也就是说这三处规则在二十七个国家里未必一样。易腐商品的例外、新品不满三十天的处理、逐步加大降幅时前价怎么取——每一条都可能在德国是一个样,在法国是另一个样。 落到实现上就一句话:三十天这个窗口长度和例外规则必须做成按市场配置的表,不能硬编码。这和单位价格那篇里分母必须按市场加品类做映射是同一种结构,都是欧盟指令留了成员国选项之后必然长出来的形态。做多语言多货币站点的价格体系 (https://zhangwenbao.com/woocommerce-multilingual-multicurrency-seo-hreflang-url-schema.html)时,这类按市场分叉的配置最好从一开始就集中在一处,别散落在主题模板里。 ## 三十天到底从哪一天往回数 条文写的是“降价适用之前”,这个起点比想象中容易搞错。它不是你在排期表里填的活动开始日,不是营销物料的定稿日,也不是你把商品加进促销组的那一刻,而是新价格第一次对消费者生效的那个时点。促销提前配好但定时在凌晨生效,窗口就从凌晨那一刻往回数。 这带出两个很实际的问题。第一是时区:如果你的价格调度器跑在服务器所在时区,而消费者在另一个时区看到页面,窗口的两个端点就会各偏几个小时;对一次跨过月末的促销来说,这几个小时足够把某天的一次降价挪进或挪出窗口。第二是同一天内的多次改价:手动改错了又改回来的那个短暂的低价,同样属于对消费者适用过的价格。含税与不含税之间的换算也会引入同类偏差,处理方式可以对照税率、税务类与含税显示的配置 (https://zhangwenbao.com/woocommerce-tax-rates-classes-vat-sales-tax-inclusive-display-setup-operations.html)。只在页面上存在过十分钟的一个错误低价,进不进那个最小值集合,条文没有给你留缝。 ## 罚则那一条,对多市场经营的人有额外含义 同一份现代化指令还改写了价格标示指令的第8条,要求成员国规定有效、相称且具劝阻力的罚则,并列了六项在裁量时应予考虑的标准:违法行为的性质、严重程度、规模与持续时间;商家为减轻或补救消费者损害所采取的行动;商家此前的违法行为;因违法获得的收益或避免的损失;以及一条对跨境经营者特别重要的——在跨境案件中,若可通过第2017/2394号条例建立的机制获知信息,商家在其他成员国因同一违法行为已受的处罚也在考虑之列。 把这条读明白:欧盟内部有一套合作机制在传递处罚信息。在德国被处理过一次,会成为法国那边加重考量的情节,而你不需要做任何事这个信息就会传过去。对同时开着好几个国家站点的团队来说,这意味着不能把各国的合规问题当成互相独立的事件来处理。这一点跟商品页上的环保声明要拿得出证据 (https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html)是同一条线上的事:欧盟这几年在商品页上加的义务,都是把一句口号换成一份可核验的材料。 ## 顺便说一下英国不在这套体系里 英国脱欧之后没有跟进第6a条,所以英国站上没有三十天最低价这个硬性口径。但这不等于英国更宽松,只是它的规则形态更接近美国那一侧——靠不公平交易行为的一般条款加执法机构的指引来管,判据也是定性的。 2024年的《数字市场、竞争与消费者法》给出了一份在任何情况下都被禁止的商业行为清单 (https://www.legislation.gov.uk/ukpga/2024/13/schedule/20),其中一条从2025年4月6日起生效,禁止虚假声称某商品仅在有限时间内可得,或仅在有限时间内可按特定条件获得,以促使消费者立即作出决定、剥夺其充分了解与思考的机会。这条管的不是价格数字,而是促销窗口的真实性。也就是说,同一块促销组件,德国审查的是那个划线数字,英国审查的是旁边那个倒计时。 ## 一句总结 欧盟做的事是把一个关于动机的问题,换成了一个关于数据的问题。这个替换让合规变得可预测,代价是它不再听你解释。你不能说我们本来打算按这个价长期卖的,也不能说那次降价是个失误——条文只看那张表里的最小值。而这恰恰是好消息:可预测的规则,才有可能被工程化地满足。 ## 一条判决为什么把“立省23%”和“超值优惠”放进了同一条规则? 卢森堡那份判决里的香蕉和菠萝,把披露和基准这两件常被当成一回事的东西彻底分开了。 把前价标出来,和把降幅算在前价上,是两件事。很多团队做到了第一件就以为完事了,而欧盟法院2024年的一份判决恰恰是冲着第二件去的。 ## 案子的事实,是一份周报上的两种水果 德国巴登符腾堡州消费者中心把Aldi Süd的一家服务公司告到了杜塞尔多夫地方法院,后者在2023年5月19日决定向欧盟法院提出先决裁判请求,案号C-330/23,判决由第八庭在2024年9月26日作出。 争议对象是2022年10月17日到22日那一周的宣传册。册子上把几样生鲜标成“已降价”,其中包括散装的公平贸易有机香蕉和雨林联盟认证菠萝。每样商品旁边有一个白色矩形,矩形中间是大字号的价格(香蕉1.29欧元、菠萝1.49欧元),右下角是一个小字号的划线价(两样都是1.69欧元)。香蕉那格上叠着一个德国国旗配色的方块,标着降价百分比;菠萝那格用了同样形状的叠加块,写的是“价格亮点”。 ## 最要命的细节,在白框下面那一行小字里 两个白框下方各有一行文字:“上次售价。最近三十天内最低价”,后面跟着第三个价格——香蕉1.29欧元,菠萝1.39欧元。 停下来看一眼这两个数。香蕉的最近三十天最低价是1.29欧元,而这次促销的售价也是1.29欧元。也就是说,按第6a条的口径,这次香蕉的降幅是零,而广告上正印着一个国旗配色的百分比。菠萝更进一步:三十天最低价1.39欧元,本次促销价1.49欧元——那个被标注为“价格亮点”的价格,比它自己过去三十天里的最低价还高出一毛。 裁判请求书还交代了一个背景:香蕉在Aldi各门店的售价自2022年9月中旬起一直稳定在每公斤1.69欧元,只有9月19日到24日那一周降到过一块二出头。 ## Aldi做对了一件事,做错了另一件 这个案子有意思的地方在于,被告并不是一家藏着掖着的公司。它把三十天最低价老老实实印在了页面上——多数中国出海站到今天都没做到这一步。它做的是把披露义务当成了全部义务。 错在哪里?错在那个大大的百分比和那个“价格亮点”的表述,都是拿1.69欧元这个日常价当基准算出来的,而条文规定的基准是1.29欧元。一个页面上同时存在两个基准:给人看的那个和给合规看的那个,而醒目程度差着好几个量级。 ## 法院的结论只有一句话,但覆盖面很宽 判决主文 (https://eur-lex.europa.eu/legal-content/EN/TXT/HTML/?uri=CELEX:62023CJ0330)的意思是:第6a条第1款和第2款必须解释为,商家以百分比形式宣布的降价,或者以旨在突出所宣布价格优惠性的促销表述形式宣布的降价,都必须以该条第2款意义上的前价为基准来确定。 请注意后半句的范围。它没有停在百分比上,而是把“旨在突出价格优惠性的促销表述”一并纳入。这一句让规则从一个数字扩张到了一整类文案。做品牌声音体系 (https://zhangwenbao.com/dtc-brand-voice-tone-of-voice-system.html)的时候,这类促销措辞通常被划在市场同学的自由创作区里,而现在它们全部落进了受约束的范围。 ## 这句话落到你的页面上是什么后果 把常见的促销表述按这个口径过一遍,很多写法要重新算。 页面上的写法 | 是不是降价公告 | 必须以三十天最低价为基准吗 | 划掉59欧元,现价39欧元 | 是 | 是,被划掉的那个数就得是前价 | 立省33% | 是 | 是,判决直接点名百分比 | 省20欧元 | 是 | 是,绝对金额同样是在算降幅 | 价格亮点、超值特惠、本季最划算 | 是 | 是,属于突出优惠性的促销表述 | 年度最低价 | 是 | 是,而且这句话本身还得为真 | 新品上市、限量发售 | 不是 | 不涉及降价宣称 | 会员专享价 | 通常不是 | 个性化降价另有规则,见下一节 | 第四行是这份判决扩出来的新地盘。过去很多团队以为只要不写数字就安全,把“立省33%”换成“超值特惠”当作规避手段——这条路被这份判决明确堵死了。 ## 那行小字里还藏着一个更细的毛病 回头再看Aldi那行文案:“上次售价。最近三十天内最低价”,一个句号隔开两句话,后面跟着一个数字。这行字用两个不同的定义指向了同一个数——上次售价是一个时间上最近的值,三十天最低价是一个区间上的最小值,它们只在特定情况下才相等。 这个毛病在中文站上更常见,因为翻译过程会把口径进一步磨平。原价、日常价、参考价、前价、上次售价、三十天最低价,这六个词在运营的口头表达里几乎通用,落到页面上却是六个可能不同的数。文案措辞会替你给这个数字下定义,而买家和执法者读到的是文案给的那个定义,不是你代码里算的那个。所以文案定稿这一步,必须和口径确认放在一起做,不能各走各的评审流程。同样的问题在社会证明体系 (https://zhangwenbao.com/dtc-social-proof-system-reviews-ugc-trust-conversion.html)里也存在——一句“上万人选择”背后到底对应哪个统计口径,多数站也答不上来。 ## 披露是名词,基准是动词 我觉得这个案子最值得记住的是这组区分。把三十天最低价印出来,是一个静态的展示动作,做起来不难,加个字段加行文案就行。而以它为基准,是一个运算约束,它要求页面上所有跟“便宜了多少”有关的表达,都必须从同一个数出发。 后者难得多,因为这些表达散落在各处:商品页的价格模块、列表页的角标、全站横幅、邮件模板、广告素材、商品数据源里的字段 (https://zhangwenbao.com/product-feed-seo-asset-organic-ai-ownership.html)。做披露只要改一个地方,改基准要把所有会说“省了多少”的地方都接到同一个数上。 ## 顺带把散装商品那条也点一下 这个案子还有个容易被忽略的层次。香蕉是按每公斤1.69欧元散装标价的,而按价格标示指令第3条第3款,散装商品只需标单位价格。那么被拿去算百分比的那个基准价,本身就是一个单位价格。换句话说,我在前一篇里处理的分母口径和这篇处理的参照价口径,在这个案子里落到了同一个数上。 这不是巧合。只要你的商品是按单位价格标示的,两套规则就会叠在一起:分母得对,参照系也得对,错一个整句话就不成立。做食品、日化、耗材这类品类的站,需要同时把两件事纳入自查。 ## 为什么这个案子对中国出海团队特别有参考价值 因为原告不是政府。德国这条赛道的执行主体是消费者协会和竞争对手,路径是发警告函加要求签署附违约金的停止侵害承诺书。这套机制的启动成本极低,对方只需要保存一份你的页面截图。而截图这件事,任何一个竞争对手的市场专员都能每周做一次。做大促排期 (https://zhangwenbao.com/maximize-seo-traffic-conversion-during-promotion.html)时把这条算进风险清单,比事后请律师便宜得多。 更值得注意的是被告的规模。一家把三十天最低价印在页面上、显然请过法律顾问的连锁零售巨头,仍然在这个点上输掉了官司。如果连它都会在“披露对了、基准错了”这里翻车,那么一个只用一个compareAtPrice字段撑着的独立站,风险是什么水平,不用我多说。 ## 同一部条例为什么一边给你减负、一边给你加负? 德国价格标示条例里有两条挨得很近的规定,一条说打折时可以少标一个数,另一条说必须多标一个数。 指令要靠成员国转化成本国法才有牙齿。德国2022年重写的价格标示条例把第6a条落成了第11条,而在它前面两条的位置上还有一条第9条,两条挨得很近,方向却相反。 ## 第11条:打折时必须多标一个数 德国价格标示条例第11条 (https://www.gesetze-im-internet.de/pangv_2022/__11.html)标题是“商品降价时的附加价格标示义务”,第1款说:负有标示总价义务的人,在向消费者公布任何商品降价时,必须标明其在降价适用前最后三十天内对消费者适用过的最低总价。 这是第6a条第1款和第2款的德文版本,措辞更紧一点。关键动词是angewendet,适用过。它没有说“通常售价”,也没有说“成交价”,只说你对消费者适用过的价格。促销价适用过,闪购价适用过,改错了又改回来的那个价也适用过。三十天窗口里所有这些值一起进入取最小值的集合。 ## 第11条第2款给了一条唯一的缓和路径 第2款处理逐步加大降幅的情形:如果一次降价是分步的、中间不间断地持续加大,那么在整个降价期间,可以一直标示这一系列降价开始之前对消费者适用过的那个最低总价。 这句话是整条里唯一对运营有利的规则,值得记牢。它意味着一次五折起、逐周加码到三折的清仓活动,全程可以用同一个前价,不必每加一档就把前价换成上一档的促销价。代价是这个降价序列必须不间断且单向加大——中间涨回去一次,或者插进来一次不相干的活动,这个豁免就断了。 做清仓、季末处理、库存周转的团队应该按这条来设计活动结构。海外仓的滞销品处理 (https://zhangwenbao.com/dtc-overseas-warehouse-sku-turnover-inventory-abc-classification.html)本来就常常是阶梯降价,把它配成一个连续的序列而不是几次独立促销,在合规上完全不是一回事。 ## 第11条第4款:两类不受约束的降价 第4款排除两种情形。第一种是个性化降价;第二种是易腐或保质期短的商品因临近变质或过期而降价,且已用适当方式向消费者标明这一点。 第一种排除的分量很重,值得单独说。个性化降价指的是只对特定个人生效的价格:生日券、召回流失用户的专属码、按行为触发的挽留优惠。它们不受三十天最低价约束,因为它们从来不是一次面向公众的降价公告。 ## 但个性化这条豁免,不是一把万能钥匙 用它之前得先确认这个优惠真的是个性化的。判据不是你在后台把它建成了券,而是它是否只对被选定的个人生效。一张挂在首页、任何人点一下就能领的券,实质上就是一次面向公众的降价公告,换个技术形态不改变它的性质。同理,一个在结账页对所有人自动生效的折扣码,也不是个性化。 另一条边界来自渠道侧。Google明确要求不要把需要加入忠诚计划才能享受的会员价提交为促销价,而应使用专门的忠诚计划属性。也就是说,如果你把会员价当成普通折扣往数据源里塞,落地页和数据源就会对不上,这是另一类麻烦。做推荐计划这类双边激励 (https://zhangwenbao.com/dtc-referral-program-double-sided-incentive-operations.html)时也一样,谁能拿到、怎么触发,决定了它算不算公开降价。 ## 第9条第2款那条豁免,是写给多规格产品线的 第2款处理的场景在日化和食品站上很常见:同一条产品线有250毫升、500毫升、1升三个规格,三者的每升价格设计成一样的。这时候如果你按统一金额或统一百分比给整条线降价,三个规格的每升价格仍然彼此相等,重算一遍不会给消费者带来任何新信息,条例干脆免了这道手续。 值得注意的是这条豁免的前提有两个:降价必须是统一金额或统一百分比,而且降价前各规格的基本价格必须本来就相同。只要你给大包装多让了两个点——这恰恰是最常见的促销设计——前提就不成立了,豁免随之失效。把这条写进促销配置的校验逻辑里,比事后靠人记住可靠得多。折扣规则与防薅设计 (https://zhangwenbao.com/woocommerce-coupon-promotion-rules-discount-abuse-prevention-operations.html)里那套先定边界再配规则的顺序,在这里同样适用。 ## 由此长出一条真正可操作的策略 把前面几节的结论合起来看,会得到一个不太直观但很实用的推论:当参照价被锁死,折扣力度的天花板也跟着被锁死了;想突破这个天花板,唯一在条文上站得住的方向是把优惠从公开的降价改成别的形态。 优惠形态 | 是不是降价公告 | 受三十天最低价约束吗 | 力度天花板由谁决定 | 全站或单品公开降价 | 是 | 是 | 你过去三十天的最低价 | 个性化券码、专属优惠 | 否 | 否 | 你的毛利 | 会员价 | 通常否 | 否 | 会员体系的设计 | 加量不加价、赠品、套装 | 否 | 否 | 供应链 | 满额免运费、免费退换 | 否 | 否 | 履约成本 | 先涨价再打折 | 是 | 是,且这么做没有任何用 | 被条文直接抵消 | 最后一行值得多说一句。在三十天最低价的规则下,先涨后降这个动作在数学上完全失效——你临时抬高的那个价格不进最小值集合,最低价还是原来那个,抬价既不能提高可标示的前价,又留下了一条明确的价格变更记录。这条老手法被这条规则精确地废掉了,这也是我认为定量规则比定性规则好用的原因之一:它不靠威慑,它靠让作弊在算术上不生效。在大促与日常运营的差异 (https://zhangwenbao.com/seo-during-sales-events-vs-daily-work.html)里,这类被规则直接注销掉的老动作还有好几个,值得整批清理一次。 ## 第9条:打折时可以少标一个数 现在看条例第9条 (https://www.gesetze-im-internet.de/pangv_2022/__9.html),标题就叫“价格降低”。第1款说,在三种情形下不必标示新的总价或新的基本价格:个性化降价;按日历日限定期间、并通过广告或其他方式公布的一般性降价;以及易腐商品因临近变质而降价并已适当标明的情形。 第2款还有一条:对于标称重量、体积、长度或面积不同但基本价格相同的商品,如果总价按统一金额或统一百分比降低,不必标示新的基本价格。 ## 同一部条例,一边减负一边加负 把第9条和第11条并排放,会看到一个很漂亮的分工。 基本价格就是前面提过的每千克、每升那个数。第9条说的是:促销期间,分母那条链可以歇一歇,你不用为一场为期五天的活动把全站的每升价格重算一遍。第11条说的是:与此同时,分子那条链要多干一件事,你必须把三十天最低价算出来并标上去。 一部条例,同一次修订,对同一场促销,一个环节松、一个环节紧。这不是立法者精神分裂,而是两条链的成本结构不同:单位价格是一个可以由售价现算的派生值,促销期间重算它对消费者没有增量信息;而前价是一个只能从历史里取的原始值,不标出来消费者就无从判断。松的是能算出来的,紧的是只能存下来的。 ## 这条区别对系统设计的直接指导 如果你正在做促销引擎,这两条落到代码上是两件不同的事。单位价格模块在促销期间可以按未降价的价格继续显示,不必接进促销管线——少一个改动点,就少一个出错点。而前价模块必须接进促销管线,并且要在促销生效之前就完成计算,因为它的输入是历史数据,促销一旦生效,历史就多了一条记录。 顺序上有个容易踩的坑:先写价格再算前价,算出来的最小值里会混进这次促销自己的价格。这个错误在单次促销里表现为前价等于现价、降幅为零,很容易发现;但在批量任务里,如果价格写入和前价计算是两个异步作业,谁先跑完就不一定了。目录价格规则和购物车价格规则分层的电商系统 (https://zhangwenbao.com/magento-2-catalog-cart-price-rules-coupon-promotion-engine-operations.html)里尤其要注意,因为规则生效时点和价格快照时点常常不在同一个环节。 ## 同一个字段在六十年里为什么被改得越来越不敢说话? 从厂商建议零售价到划线价,词表放弃的不是一个属性名,是对这个数字来源的最后一点声称。 法律那一侧看完了,现在看渠道这一侧。你的商品数据要提交给购物渠道,页面上的价格也要用结构化数据标记出来,这两处各自对“原价”下了定义,而它们和法律给的定义都不一样。 ## 数据源里那个price字段,定义是“不打折时的价格” Google商家中心的规则是:商品在促销时,用促销价属性提交新价格,同时继续用价格属性提交商品的完整价格,也就是它不在促销时的价格 (https://support.google.com/merchants/answer/6324471)。文档里还有一条容易被忽略的补充:如果商品在促销但你没有提交促销价属性,那就应该把促销价直接填进价格属性。 请注意这个定义的类型。“不在促销时的价格”是一个类型化的概念——它假设每个商品都存在一个常规状态和一个促销状态,而常规状态下有一个稳定的价格。它不是过去三十天的最小值,也不是最近一次的售价,它是一个关于商品应然状态的判断。 ## 对一个常年在打折的品类,这个假设不成立 美妆、服饰、家居这类品类,一年里不打折的日子屈指可数。这时候“不打折时的价格”是一个虚构的状态——它在日历上从来没有真正出现过。你往数据源里填的那个价格,实质上是一个设计出来的锚点,而不是一个观测到的事实。 而欧盟要的那个数是观测出来的:三十天窗口里实际生效过的最小值。在一个促销密集的站上,这两个数几乎必然不相等,而且方向固定——设计出来的锚点总是更高。于是同一个商品,数据源里写着59欧元,页面上按法律必须标39欧元,两个数都是按各自的规则算对的。 ## 渠道还要求这两处保持一致 麻烦在于Google同时要求:提交的值必须与你在落地页和结账时展示的促销价一致;落地页上必须清楚展示非促销价和促销价这两个价格,而结账时只展示促销价;如果你宣传优惠码,还要确保所有用户都能用到它,并清楚展示应用优惠码后的价格。 把这几条和上一节的结论合起来:渠道要求数据源与页面一致,法律要求页面上那个较高的数必须等于三十天最低价,于是数据源里那个“不打折时的价格”也被间接拉着往下走。这条约束链没有写在任何一份文档里,它是两套规则相交出来的。类似的相交在商品结构化数据新增分类属性 (https://zhangwenbao.com/merchant-listing-category-property-google-product-taxonomy.html)那次也出现过:页面标记与数据源各自都合规,对不上的是两者之间。 ## 还有一条经常被忽视的展示要求 Google文档里明确写着,促销价不必是落地页上最醒目的那个价格 (https://support.google.com/merchants/answer/6324471),举的例子就是原价的字号可以更大。这一条很有意思,因为它跟可用性研究的建议正好岔开——那边说折后价要更大更醒目,才不会让用户看错自己要付多少钱。 两边并不矛盾,只是各管一段:渠道管的是数据能不能对上,研究管的是人看不看得懂,法律管的是那个较高的数从哪儿来。三套要求各自只覆盖一个维度,没有任何一套是完整的,而把它们缝起来的那个人是你。 ## 结构化数据这一层,词表刚刚改了名字 再往下一层是页面上的标记。Google的商品信息结构化数据文档把价格分成三类:当前生效价、划线价、会员价。当前生效价既没有priceType也没有validForMemberTier;划线价把priceType设成StrikethroughPrice;会员价用validForMemberTier标记,两个属性不能同时用,同时出现的价格规范会被忽略。 关键在划线价那一行的括号里:ListPrice在过渡期内仍然被允许。也就是说,这个属性原来叫ListPrice,现在改叫StrikethroughPrice。 ## 促销的起止时间同样是有字段的 数据源里有促销生效日期属性,用来标明促销价在哪个区间内有效,不提交的话促销价会立即生效;页面标记里也有对应的有效期写法 (https://developers.google.com/search/docs/appearance/structured-data/merchant-listing)。这两处填的日期,就是你对外声明的促销窗口。 把这一点和英国那条禁止虚假限时的规定放在一起,会得到一个不太舒服的推论:一次次把结束日期往后顺延的促销,会在你自己的数据里留下一串完整的修改记录。倒计时归零后又刷新一次,页面上看不出痕迹,数据源的历史版本里看得清清楚楚。这类字段的性质就是这样——它既是给渠道看的,也是将来别人拿来对照你说过什么的凭据。想确认自己页面上到底提交了哪些价格字段,用结构化数据审计工具 (https://zhangwenbao.com/schema-extractor-structured-data-audit-guide.html)扫一遍最快。 ## 这次改名,是一次悄悄的撤退 ListPrice的中文对应词是目录价或者厂商建议零售价。这是一个关于商品在市场上的正常价位的断言,跟第233.3节管的是同一件事。而StrikethroughPrice的意思是“被画了一条横线的那个价格”。 把这两个名字并排看一眼:前一个描述这个数字从哪儿来,后一个描述这个数字在屏幕上长什么样。词表没有收紧定义,也没有加校验,它做的是放弃对来源的声称——不再说这是市场价,只说这是被划掉的那个数。文档里给它的说明是“促销期间,商品通常提供的那个较高的常规价”,措辞比ListPrice松得多。 ## 把三个定义按时间排开,会看到一条退让的曲线 年份 | 出处 | 它管这个数字叫什么 | 它要求你证明什么 | 1967 | 联邦贸易委员会指南 | 前价、建议零售价 | 你曾善意地按这个价对外提供过 | 2019 | 欧盟现代化指令 | 前价 | 它等于你过去三十天的最低价 | 2024 | Google结构化数据词表 | 划线价 | 什么都不用证明,只要它被画了条线 | 这条曲线不是在说后来的规则更宽松——欧盟那条其实最硬。它说的是每一次重新定义,都在减少这个数字所声称的内容:从“市场上的正常价”,退到“我自己的历史最低价”,再退到“页面上的一个视觉样式”。 ## 为什么词表会做这种撤退 我的理解是,词表面对的是全网数以亿计的商品,它没有能力验证任何一个ListPrice是否真的是市场价。一个无法被验证的语义,写在词表里就是一句空话,不如干脆换成一个可以被验证的形式描述——这个数被划了线,这件事引擎自己看得见。 这个取舍本身是理性的,但它把责任原封不动地推回给了你。词表不再声称这个数是什么,不等于这个数就不用是什么;它只是不再替你背书。你在页面上写下那个数字的那一刻,做出承诺的仍然是你,而现在连词表都不站在你这边了。做结构化数据能不能帮上AI搜索 (https://zhangwenbao.com/schema-markup-ai-search-truth.html)这类判断时,这条经验同样适用:标记只负责表达,不负责担保。标记本身写没写对是另一回事,那部分交给语法校验 (https://zhangwenbao.com/json-ld-validator-syntax-debug-guide.html)就行,而值对不对,永远只能由你自己保证。 ## 那四个展示上的坑,搬到多币种站上还剩几个? 源头那篇文章的四条建议我基本都认,但其中一条一过海关就会失效,失效的原因藏在单位量纲里。 回到展示层。前面几节把参照价这件事说透了,接下来把源头研究给的四条建议逐条过一遍,看看哪几条在跨境语境下还成立、哪几条要改。 ## 第一条:价格别淹在页面里,这条完全成立 研究里那些观察很实在——受试者在商品页上反复滚动找价格,最后在标题下面找到时已经开始迁怒整个站;有人干脆说“价格在哪儿?我现在很烦……我不喜欢这个网站”。Baymard给的数据是18%的桌面站和11%的移动站 (https://baymard.com/blog/product-page-price-discounts)让用户找价格找得费劲。 这条建议不需要任何本地化改造,照做即可:字号接近标题级、用颜色或背景块区分、别和促销角标、评分星级、库存提示挤在一起争注意力。有一条容易被忽略的补充:价格本身文字量极少,小字号下比长文案更容易被眼睛跳过,所以它对字号的敏感度高于页面上任何其他元素。把购买区当成一个整体来设计会更省事,产品详情页的模块化结构 (https://zhangwenbao.com/b2b-pdp-14-module-high-conversion-blueprint.html)里那套按信任阶梯排模块的思路可以直接借来用。 ## 第二条:折扣信息别离价格太远,这条也成立 研究观察到,特价说明放在图片画廊附近时,有受试者搞不清它指的是全站活动还是这个商品;14%的桌面站把促销信息放在离价格很远的位置。有个受试者的做法很典型:她把商品加进购物车,就为了看看折扣到底有没有生效。 把促销文案、活动角标、优惠条件全部聚拢到购买区,这条我完全同意。跨境场景下还要多加一条:把折扣说明和运费、税费提示分开摆——它们看起来都是“价格旁边的小字”,但一个在说你少付多少,一个在说你还要多付多少,混在一起会让人算不清最终要花多少钱。这跟结账放弃率那篇 (https://zhangwenbao.com/dtc-checkout-abandonment-9-real-causes.html)里讲的意外费用是同一类问题的两端。 ## 第三条:同一个优惠别写好几遍,这条要加一层 研究里有个受试者被绕住了:“写着省10%,但不清楚是不是已经算进价格里了,因为已经有20美元的优惠了,所以我不知道是不是还能再省10%。”另一个受试者更直接,说这看起来像虚假广告。在展示促销的站里,有19%存在这个毛病。 建议本身没问题:一个优惠原则上只写一次;确实需要写两次(比如页面很长,顶部和底部各一处),措辞要几乎完全一致,让人一眼看出是同一件事而不是两个可叠加的优惠。 ## 可这个毛病的根源不在文案,在系统 同一个促销之所以会在页面上长出三种说法,通常是因为它在三个地方被各写了一遍:全站横幅由市场同学在内容管理后台写,商品页角标由促销引擎按规则生成,购物车提示由结账模板另写一套。三处的数据来源不同、更新时机不同、负责人也不同。 所以真正的解法不是让文案同学注意措辞,而是让这三处从同一个促销对象取值。一个促销在系统里应该只有一个身份,页面上出现几次是渲染问题,说法不一致则是数据问题。做不到彻底统一时,退一步的办法是给每个促销定一个规范名称字段,所有展示位只允许引用这个字段,不许各自造句。这和产品文案摆脱供应商模板 (https://zhangwenbao.com/product-detail-page-onpage-seo-unique-content-engineering.html)要解决的是相反方向的问题:那边要的是别处没有的表达,这边要的是各处一致的表达。 ## 第四条:百分比还是绝对金额,这条一出海就失效 研究引了沃顿商学院Jonah Berger的“百元法则”:哪个数字看起来更大就用哪个。20美元的东西降到15美元,写“省25%”比写“省5美元”有力;1000美元的东西降到900美元,写“省100美元”比写“省10%”有力。分界线大致在100美元。 这条在单一市场里很好用。可一旦你的站开了多个货币,这个100就出问题了——它是一个有量纲的数,而不同货币的量纲差着好几个数量级。100美元、100欧元、100英镑还算接近,100人民币不到15美元,100日元还不到1美元。同一个阈值套过去,等于在不同市场用了完全不同的心理分界。 ## 正确的做法是把法则本身实现出来,而不是把阈值抄过来 百元法则的实质其实只有一句话:把百分比和绝对金额都算出来,哪个数字大就展示哪个。100这个数字只是这条规则在美元语境下的一个近似解——当售价高于100美元时,绝对金额的数值必然大于百分比的数值。 所以直接比数值就行,一行判断的事,还免去了维护一张按货币配置的阈值表。这个思路和处理多市场价格格式化 (https://zhangwenbao.com/currency-formatter-cross-border-price-localization-schema-guide.html)时的原则一致:别把某个市场的经验值硬编码进逻辑,把产生这个经验值的规则实现出来。想验证换了写法之后到底有没有效果,记得先按样本量公式 (https://zhangwenbao.com/dtc-ab-test-sample-size-3-formulas.html)算清楚要跑多久,促销期间的流量波动很容易制造出一个漂亮的假胜利。 ## 这四条在移动端上,优先级要重排 研究给的桌面端和移动端数据本身就不一样:找不到价格这个毛病,桌面站是18%,移动站是11%。移动端反而好一点,因为一屏能塞的元素少,价格更难被别的东西挤走。真正在移动端变严重的是另外两条。 四个坑 | 桌面端的典型表现 | 移动端的典型表现 | 移动端优先级 | 价格不显眼 | 被周边元素稀释 | 相对少见,一屏元素本来就少 | 中 | 折扣离价格远 | 散在画廊旁或页面下方 | 更严重,纵向滚动会把两者拉开好几屏 | 高 | 同一优惠写多遍 | 横幅与购买区并存 | 更严重,吸顶条与购买区同时出现,用户以为能叠加 | 高 | 没突出降幅 | 少一个说服点 | 同左,但空间紧张时容易被第一个砍掉 | 中 | 第二行和第三行值得展开一句。移动端的纵向滚动会把桌面端上并排的两个元素变成一前一后,中间还隔着几屏内容,而促销文案通常是最先被响应式布局挤到下面去的那一块。第三行则是移动端特有的叠加错觉来源:吸顶的活动条和购买区里的角标同屏出现,两处措辞稍有差别,用户就会开始盘算是不是能叠。 ## 还有一个研究没测到、却最容易掉量的坑 促销生效那一刻,页面变了,数据源还没变;或者数据源先更新了,页面缓存还没刷。渠道抓到的价格和用户点进来看到的价格对不上,轻则商品被暂停展示,重则整个账户的商品被批量审核。这个坑不影响用户体验,它影响的是流量本身,而且往往在促销开始后的头几个小时发作——正好是流量最贵的那几个小时。 解法是把促销生效做成一次协调过的动作:先刷价格,再刷页面缓存,最后推送数据源更新,中间留出足够的间隔。宁可让渠道晚半小时看到促销价,也别让它先看到促销价再点进一个还是原价的页面。顺序反了,代价是可见性;顺序对了,代价只是半小时。商品下架、缺货、改价这几类动作的时序问题是同一族,处理原则可以参考缺货与下架商品的收尾判断 (https://zhangwenbao.com/magento-2-out-of-stock-discontinued-product-seo-301-410-soft-404.html)。 ## 还有一条研究没说、但跨境必须补的 两者都展示是研究给的最优解,我同意,但欧盟站要多算一步:百分比必须以三十天最低价为基准算,而多数系统里的百分比是拿日常价现算的。这就是前面那份判决的核心。如果你把两个数都显示出来,那么这两个数得来自同一个基准,否则会出现绝对金额和百分比对不上的滑稽场面,而这种对不上恰恰是最容易被截图取证的。 还有一条实操建议:百分比一律向下取整,绝对金额一律照实算。四舍五入把33.4%写成34%,在严格口径下就是一次夸大。这种事平时没人计较,进了争议程序就是一个现成的把柄。 ## 价格历史该怎么存,才经得起“过去30天最低价是多少”这一问? 这一节讲工程:它不是一个字段,是一次查询;而多数站上,被查的那张表根本不存在。 前面所有结论都指向同一个前提:你手上得有一份可信的价格历史。这一节讲怎么建它,以及为什么多数站上它不存在。 ## 先破一个最常见的误解 “三十天最低价”不是一个可以存在商品表里的字段。它是一个查询的结果,输入是一段时间内的全部价格记录,输出随时间不断变化——今天算出来是39欧元,明天同一个商品同一段代码算出来可能就是49欧元,因为窗口往前滚了一天,最早那次促销掉出了区间。 把它做成字段的团队通常会在两个地方翻车:一是忘了定期重算,字段值停在了某次促销的那天;二是重算时机不对,在促销价写入之后才算,把这次促销自己算了进去。正确的做法是把它当作一个由价格事件表派生的视图,需要的时候查,或者在促销排期时预先算好并冻结成本次活动的参数。 ## 那张表该记什么 价格事件表的每一行是一次价格变更,字段至少要覆盖这几项:商品标识(到最小可售单元,不是到款)、市场或国家、货币、价格数值、是否含税、生效开始时刻与结束时刻、变更来源(人工、促销规则、批量导入、接口回写)、操作者。 其中最容易漏的是含税标志和生效时刻。含税与否漏了,德国站按含税价、美国站按不含税价,两个市场的历史根本不可比。生效时刻只记了写入时间而没记生效时间,那么所有定时促销的窗口边界全是错的——写入时刻和生效时刻在定时促销里天然不是同一个数,而条文关心的是后者。 ## 为什么很多站真的没有这张表 因为主流建站系统默认不给。商品表里价格就是一个字段,改了就是改了,旧值直接被覆盖。有些系统有操作日志,但日志的设计目的是审计谁改了什么,不是给业务查询用的,往往没索引、没保留期保证、还可能被定期清理。这一点和站点地图里那个最后修改时间的诚实度 (https://zhangwenbao.com/ecommerce-product-sitemap-strategy-sharding-lastmod-image-index.html)是同一类问题:一个没人校验的时间戳,用久了就会变成装饰。 更普遍的情况是价格根本不在一处:基础价在商品表,促销价在活动表,会员价在客户分组,渠道价在数据源,落地页显示的那个数是这四层运算出来的结果,而这个结果本身没有任何地方记录过。这一点在分组定价与税务类别分层的系统 (https://zhangwenbao.com/magento-2-customer-groups-segmentation-group-pricing-tax-class-operations.html)里格外明显——每一层都对,合起来那个数没人存。 ## 所以该记的是渲染出来的那个数 这是我认为最重要的一条设计决策。价格事件表要记的不是某一层的输入,而是消费者实际看到的那个最终价格。条文说的是“对消费者适用过的价格”,不是“商品表里的基础价”。 实现上最稳的做法是在价格计算的出口处埋一个点:每次某个商品在某个市场的最终展示价发生变化,就写一条记录。这样不管前面有多少层规则,记下来的都是那个唯一有法律意义的数。从输入侧记录,你永远要维护一套和渲染逻辑并行的重算逻辑,而两套逻辑迟早会分叉。 ## 价格历史的六维治理,和售价对比一下 治理维度 | 当前售价 | 价格历史 | 谁负责 | 定价或运营,责任明确 | 通常没有人 | 改动是否要审批 | 多数站有流程 | 没有概念,因为没人认为它会被改 | 有没有变更日志 | 有 | 它本身就是日志,但常被当成可清理的数据 | 错了多久被发现 | 分钟级 | 可能永远不会,除非有人来告 | 谁会投诉 | 客服、财务、买家 | 竞争对手、消费者协会、比价网站 | 能不能回滚 | 能,旧值就在上一次记录里 | 删掉就没了,没有第二份副本 | 第四行和第六行是这张表的要害。一个错了不会有人告诉你、删了又找不回来的数据,在系统里的实际地位约等于不存在。而第五行提醒了另一件事:会来找你麻烦的那几方,恰好都不在你的用户反馈渠道里。 ## 变体和多规格,是这张表最容易记错的地方 价格历史必须记到最小可售单元。同一款精华液的30毫升装和50毫升装是两条独立的历史,同一件外套的黑色M码和米色L码也是——尽管它们在页面上共用一个商品标题。这一点跟变体在收录上该合还是该拆 (https://zhangwenbao.com/product-variant-seo-url-canonical-indexation-strategy.html)是两回事:收录可以合并,价格历史必须拆开。这条界线在变体的标记与规范化治理 (https://zhangwenbao.com/woocommerce-product-variations-seo-schema-canonical-url-deep-dive.html)里也画过一次,只不过那次分的是索引与展示,这次分的是展示与记录。 由此引出一个很少被讨论的陷阱:列表页上那句“39欧元起”,它的划线价该取哪个变体的历史?如果起价来自30毫升装,划线价就必须是30毫升装的三十天最低价,不能拿50毫升装那个更高的历史价来充数。安全的做法是列表页只显示起价、不显示划线价和百分比,把降幅表达全部留给商品页——在能确定是哪一个变体之前,任何降幅宣称都缺少一个明确的主语。 ## 一个能报数的指标:折扣兑现率 合规议题最难推动的地方,是它没有数字,只有风险描述。所以我给这件事配了一个可以放进周报的指标:折扣兑现率=页面上宣称的降幅 ÷ 按三十天最低价算出的真实降幅。 取值等于1,说明宣称和事实一致;大于1,说明夸大了,比如页面写着立省40%,而按三十天最低价只降了20%,兑现率就是2。这个指标的好处有三个:它不需要读者懂任何一条法律条文;它可以按品类、按活动、按负责人拆开看;它能做时序监控,一场促销上线当天就能出数。 实际用起来还有一个副产品。兑现率长期接近1的产品线,说明它的日常价是真的在卖的;兑现率常年在2以上的产品线,通常意味着这条线的所谓日常价其实从来没有生效过,它的定价体系本身该重做了。换句话说,这个合规指标顺手体检了一遍定价的真实性。 ## 保留期该定多长 三十天是条文口径,但保留三十天是不够的。理由有三个:一是第11条第2款那种阶梯降价需要回溯到序列开始之前;二是争议发生时对方引用的可能是几个月前的页面,你得能自证当时的口径;三是内部复盘和定价分析本来就需要更长的序列。 我的建议是至少留十三个月,这样任何一次年度大促都能和去年同期对上。存储成本几乎可以忽略——一个五千SKU、五个市场的站,一年的价格事件通常也就几十万行,比一天的埋点数据还小。 ## 价格历史不是只有你在存 这是很多团队没意识到的一层。比价网站、价格监控工具、浏览器插件、竞争对手的抓取脚本,每天都在抓你的商品页并保存价格。你可以决定自己不存这份数据,但你决定不了别人存不存。 换句话说,价格历史在事实上是一份公开信息,而且很可能别人手里那份比你自己的更完整。把它当内部数据来处理,是这件事上最危险的心智模型——你在争议里能拿出的证据,未必比对方多。 ## 先做诊断,别急着改代码 如果你现在要启动这件事,第一周不要碰任何渲染逻辑,先回答三个问题:这个站上有多少比例的商品在过去三十天里发生过价格变化;这些变化里有多少能从现有数据里还原出生效时刻;当前页面上的划线价和还原出来的三十天最低价,有多少个商品对不上。 第三个数字是整件事的体检指标。它通常比团队预期的高得多,而且高出来的部分几乎全是同一个方向——划线价偏高。拿着这三个数字去开会,比讲十条法律条文有用。这也是仪表盘全是绿灯生意却没动 (https://zhangwenbao.com/ai-search-kpi-blind-spot-metric-swap.html)那篇里的老问题——一个议题没有指标,它在会上就永远排在最后一个。 ## 促销日历一加密,一段一直正确的代码就开始违规 我自己的一次失手。代码没改、数据没错、规则没变,是排期节奏的变化让它从对的变成了错的。 这一节讲我自己经手的一次事故。它值得单独写,是因为它的形态跟常见的技术故障完全不同:没有任何一段代码出错,没有任何一条数据写错,没有任何一条规则被违反,而系统在某一天开始系统性地生产违规页面。 ## 客户与背景 一个出海美妆护肤站,卖面部精华、防晒和一条彩妆线,主销德国、法国、英国,加上少量北欧订单。这个品类的特点是促销频率高:节日、换季、新品导入、联名,理由永远不缺,排期表的密度接近类目页那种常年在变的状态 (https://zhangwenbao.com/ecommerce-plp-collection-page-seo-mechanism-complete-guide.html),只不过变的是价格不是商品。 他们找我的时候已经把三十天最低价这件事做完了,做得还挺好。价格事件表有,生效时刻记得准,促销页面上老老实实标着最近三十天最低价那一行字。第一年跑下来没出过任何问题。 ## 那个看起来完全合理的决定 建表的时候团队讨论过一个问题:促销价要不要计入历史。当时的直觉理由很顺——促销价不是我们的常规价,把它算进最低价,等于让上一次促销把下一次促销的力度锁死。听起来像是在纠正一个不合理的副作用。 于是加了一个过滤器,函数名叫excludePromoPrices,作用是在计算三十天最低价时跳过来源标记为促销规则的那些记录。这个名字读起来毫无问题,代码评审时没有一个人停下来问它对不对,因为它看上去就是一个正常的业务过滤条件。 而它在条文层面是错的。第11条第1款和第6a条第2款说的都是“对消费者适用过的最低价”,德文用的是angewendet这个词,它不区分这个价格是常规价还是促销价。适用过就是适用过,条文里没有给任何一类价格开口子——除了第4款明确列出的个性化降价和易腐商品那两种。 ## 它上线后有整整一年是无害的 这是这次事故最要命的地方。过滤器上线那年,这个站一年做六次促销,平均间隔六十天左右。任何两次促销之间都超过三十天,所以窗口里根本不会出现上一次促销的价格,过滤器每次运行都是空转——它从来没有真正排除过任何一条记录。 测试用例也是这样写的。测试数据构造的是一个正常的场景:日常价加一次促销,跑一遍,结果正确。没有人构造过“两次促销间隔二十六天”这样的数据,因为在当时的业务里这种情况不存在。 ## 第二年,业务把它激活了 第二年促销效果好,营销团队把节奏加密了。加上联盟活动、达人专场、清库存、新品预热,一年做到了十四次,平均间隔缩到二十六天左右。 就在某一次促销排期通过的那一刻,那段代码从空转变成了每次都生效。同一段代码,一个字符没改;同一张表,一条记录没错;同一部条例,一个字没变。变的是营销日历的密度,而营销日历不归技术管,改日历也从来不会触发代码评审。 具体的偏差是这样的:主力精华液日常价59欧元,三月做过一次促销降到39欧元,四月又做一次也是39欧元。第二次促销时,正确的前价是39欧元、降幅为零;过滤器把三月那次排除掉之后,算出来的前价是59欧元,页面上写着立省34%。 ## 为什么没人发现 三条原因,每一条都很普通。 第一,所有测试和验收都在看促销期间的页面对不对,没有一条在看促销结束之后历史表里留下了什么。验收的时间窗和错误的时间窗根本不重叠——错误是在第二次促销开始时才显形的,而那时上一轮验收早就关闭了。 第二,这个错误让折扣显得更大,所有业务信号都是正向的。加购率好看,转化率好看,联盟素材的点击率好看,连素人体验官那条线 (%sdtc-koc-seeding-operations-overseas.html)反馈回来的素材转化都在涨。凡是能证明这个决定做对了的数字,全都在往上走;能证伪它的人,不在这家公司里。 第三,也是我印象最深的一条:真正把问题捅出来的,既不是我们也不是客户,是一个价格监控网站的公开图表。德国一家律所代表同行发来的警告函里,附的就是那张图的截图——曲线上三月那段39欧元清清楚楚,而我们自己的计算逻辑当时正把它当作不存在。 ## 那张图给我的教训比警告函本身更重 我们以为价格历史是内部数据,可以按自己的口径决定收录哪些、排除哪些。实际上它是一份公开数据,任何人每天抓一次页面就能拥有一份完整副本,而且那份副本不会替你执行任何过滤。 说白了,这个过滤器过滤掉的不是数据,只是我们自己看得见的那一份。对方手上那份从来没被过滤过。这件事之后我给自己立了条规矩:凡是外界能独立观测到的事实,内部就不能有一套跟它不一致的口径,哪怕那套口径在业务上说得通。 ## 改了三处 第一,价格事件表改成只追加、不过滤,任何来源的价格变更都进表,是不是促销只作为一个标签存着,绝不作为排除条件参与最低价计算。需要区分促销与非促销的分析场景,在查询时自己加条件,别把这个判断固化进事实表。 第二,把三十天最低价的计算前移到促销排期环节。营销同学在排期系统里选好商品和日期,系统当场算出这次能标的前价,直接显示在排期界面上:这次能标的原价是39欧元,不是59欧元。看到这句话的人是决定要不要做这次促销的人,这比事后拦截有效得多。这跟把合规约束前移到弹窗设计阶段 (https://zhangwenbao.com/email-popup-lead-capture-opt-in-conversion-guide.html)是同一种思路:在人做决定的那一屏给出约束,比在人做完决定之后来纠正省力得多。 第三,把促销日历的密度做成一个技术信号:排期系统里两次促销间隔小于三十天时自动标黄,并把上一次的最低价显示在旁边。既然这次事故的触发条件是业务节奏,那么监控就得盯着业务节奏,而不是盯着代码。 ## 结果,以及一个意料之外的收获 改完之后,页面上宣称的名义折扣力度平均掉了一大截,因为很多次促销的前价从日常价降成了上一次的促销价。但实际转化几乎没掉。老客户早就摸清这个站每隔两三周就打一次折,页面上写40%还是15%,对他们没什么区别——他们等的是促销本身,不是那个百分比。 真正掉的是新客那一侧的点击率,尤其是联盟和比价渠道来的流量。修复方式不是把百分比想办法做大,而是把促销的形态换掉:从降价改成加量、赠品、套装和限定组合。这几类不构成降价公告,不受三十天最低价约束,力度天花板重新由供应链决定而不是由价格历史决定。三个季度之后,新客转化回到基线以上,而且客单价比原来做纯折扣时更高。 这次的经验和我在上一次那个分母事故里学到的正好互补:那次是两个各自合理的默认值撞出了系统性偏差,这次是一个一直正确的默认值被业务节奏推到了失效区。两次的共同点是,出问题的地方都没有报警,因为没有任何一个系统认为自己该为那个数字负责。 ## 这件事从哪一步开始做,才不会变成每次大促前的救火? 四周路径、十八项上线自查、三条该让你停下来的反信号,外加一段该写进帮助中心的公共答案。 把前面的结论收成可执行的东西。这一节给四周路径、上线自查、反信号,以及一段应该写在帮助中心而不是商品页上的公共答案。 ## 第一周:只出三张清单,一行代码不改 第一张是覆盖清单:过去九十天里,有多少个最小可售单元发生过价格变化,这些变化能不能还原出准确的生效时刻。第二张是偏差清单:当前所有在售商品里,页面划线价与还原出的三十天最低价不一致的有多少,按品类和市场拆开。第三张是表达清单:把站上所有会出现降幅表述的位置列出来——商品页、列表页角标、全站横幅、购物车、邮件、数据源、广告素材。 第三张清单通常是最让人意外的那一张,它的行数往往是团队预期的两三倍。先知道有多少处要接同一个数,再谈怎么接。清点的时候别漏掉邮件那一路,邮件营销那条链路 (https://zhangwenbao.com/dtc-email-list-building-lead-magnet-double-optin-compliance.html)上的促销文案通常由另一套模板生成,和站上的促销对象完全脱钩。 ## 第二周:先修数据,别碰展示 把价格事件表建起来或者补起来,埋点埋在价格计算的出口处,记渲染出来的最终价。同时把历史数据尽可能还原——订单表里的实付价、快照、缓存日志、渠道数据源的历史版本,都是可以拿来回填的材料。 这一周的验收标准只有一条:随便挑十个商品,能不能准确回答它们在过去三十天里对消费者适用过的最低价是多少。答不上来,就别往下走。这一步没有捷径,跟商品编码这类基础字段 (https://zhangwenbao.com/product-gtin-seo.html)一样,前面偷的懒后面都要还。 ## 第三周:把计算前移到排期环节 在促销排期系统里加一个字段,选定商品和生效日期后自动算出本次可用的前价,并显示在营销同学做决策的那个界面上。这一步是整件事投入产出比最高的一处,因为它把合规从事后检查变成了事前信息。 同时加两条硬校验:本次促销价必须低于算出的前价,否则不许提交;两次促销间隔小于三十天时标黄提示。 ## 第四周:统一表达层 把第一周第三张清单上的所有位置,逐个改成从同一个促销对象取值。改不动的先做兜底——不显示百分比,只显示两个价格;实在改不动的,暂时把降幅表述撤掉。撤掉一个降幅表述损失的是一点转化,留着一个算错的降幅表述损失的是别的东西。 ## 上线前的十八项自查 前八项管数据,中间六项管页面,最后四项管流程。哪一项过不了,就别让促销上线。 - 每个在售最小可售单元都能查到过去三十天的完整价格序列。 - 序列记的是最终展示价,不是商品表里的基础价。 - 含税标志与市场标识齐全,跨市场的历史不会被混在一起比较。 - 生效时刻与写入时刻分别记录,定时促销的边界取前者。 - 三十天窗口的起点取新价对消费者生效的时刻,不是排期通过日。 - 窗口长度与例外规则按市场配置,不硬编码。 - 促销价、闪购价、误改后回滚的价,全部计入最小值计算。 - 个性化券码与会员价不计入,且判据是仅对被选定的个人生效。 - 页面上被划掉的那个数,等于算出来的前价。 - 百分比与绝对金额都以同一个前价为基准,两者对得上。 - 百分比一律向下取整,不做四舍五入。 - 列表页不显示无法归属到具体变体的降幅表述。 - 结构化数据里的划线价用正确的价格类型标注,不与会员价属性混用。 - 数据源里的价格与页面一致,促销生效顺序是先价格、再缓存、后数据源。 - 阶梯降价按连续不间断的序列配置,中途不插入独立活动。 - 站上所有降幅表述从同一个促销对象取值,没有一处是各自造句的。 - 促销结束时间不做无声顺延,需要延期就重新走一次排期。 - 价格事件表只追加不删改,保留期不少于十三个月。 ## 三条该让你停下来的反信号 第一条:某条产品线的折扣兑现率长期高于2。这说明它的日常价基本没生效过,第一反应不该是调整文案,而是重新审视这条线的定价。 第二条:促销排期表上,两次活动的间隔在缩短,而页面上的名义折扣力度没有跟着缩小。这两个数按算术必然反向变动,如果没有,说明某个地方正在替你把上一次促销从历史里抹掉。 第三条:营销侧提出希望把某类价格排除出历史计算。这个诉求本身完全合理,但它指向的是同一个陷阱。正确的应对不是拒绝,而是把它翻译成促销形态的调整——想要更大的力度,就换一种不构成降价公告的给法。 ## 三种投入档位,按团队规模挑一个 不是所有站都需要把上面十八项全做完。按站的规模和促销频率,这件事有三档合理的投入。 档位 | 适合谁 | 做到哪一步 | 最大的残余风险 | 最小可用 | 单市场、一年促销少于六次 | 建价格事件表,划线价人工核对 | 促销加密时无人察觉 | 标准 | 多市场、促销按月排期 | 加排期环节的自动计算与硬校验 | 表达层仍有几处各自造句 | 完整 | 促销密集、有联盟与比价渠道 | 表达层统一取值,兑现率进周报 | 主要在跨渠道时序一致性上 | 三档之间有一道明确的门槛:从最小可用跨到标准,第一次真正要改的不是页面,是促销排期的工作流——你得让营销同学在决定做不做这次活动的那一刻就看到可用的前价。这一步跨过去,后面全是收尾工作;跨不过去,做多少页面上的修补都会被下一次排期推翻。 ## 该写进帮助中心的那段公共答案 商品页上那行小字只够写口径本身,写不下解释。而买家、比价网站、AI助手真正会去检索的是解释。所以建议在帮助中心单独写一页,回答四个问题:我们标的原价是怎么算出来的;为什么同一件商品这次的原价比上次低;会员价和促销价能不能叠加;不同国家站上的原价为什么不一样。 这一页的价值有两层。对买家,它把一个容易引起怀疑的数字变成了一个有出处的数字。对要被AI引用的内容 (https://zhangwenbao.com/ai-ready-product-page-optimization.html)来说,它是这个站上少数几个只有商家自己能回答的问题——别人可以写一万篇讲三十天最低价规则的科普,但只有你能说清楚你自己是怎么算的。这种唯一性,比任何一篇通用指南都更容易被引用,答案引擎优化 (https://zhangwenbao.com/aeo-answer-engine-optimization-guide.html)里讲的可引用性,本质上就是这种别人替代不了的具体。这一页最好配上规范的问答标记 (https://zhangwenbao.com/faq-schema-optimizer-rich-result-ai-citation-guide.html),让它更容易被整段取用。 ## 最后回到那个被划掉的数字 整篇文章绕了一圈,结论其实很短:你可以自由决定卖多少钱,但你不能自由决定自己以前卖过多少钱。前者是经营,后者是事实。 而做直连消费者品牌的人,因为砍掉了中间商,也就砍掉了所有外部的参照系,只剩下自己的过去可以引用。你的价格历史就是你唯一的证据,而这份证据的完整性,取决于一件很不起眼的事——你有没有认真地把它存下来。 ## 常见问题解答 ## 划线价一定要等于三十天最低价吗,标日常价不行吗? 在欧盟范围内,只要你在页面上公布了一次降价,就必须标明降价适用前不短于三十天期间内适用过的最低价,这是价格标示指令第6a条第1款和第2款的直接要求。标日常价而不标这个最低价,等于没有履行披露义务。 更关键的是欧盟法院在C-330/23里给出的解释:以百分比形式宣布的降价,以及以突出优惠性的促销表述宣布的降价,都必须以第6a条第2款意义上的前价为基准来确定。换句话说,即使你把三十天最低价另外标了出来,只要那个百分比是拿日常价算的,仍然不合规。 ## 新品刚上架不满三十天,怎么打折? 指令第6a条第4款允许成员国对上市不足三十天的商品规定较短的期间,所以具体做法要看目标市场的本国规则,不能一刀切。 工程上最稳的处理是给价格历史加一个数据充分性判断:商品上架时长不足配置的窗口长度时,不允许在页面上出现任何降幅表述,只显示当前价格。新品本来就不该靠划线价卖,它的说服力应该来自别的地方。这条规则还顺手挡住了一类常见操作——先高开挂两周再降价,那个高开价在窗口内会被完整记录,抬不上去。 ## 会员价和优惠券能绕开这条规则吗? 能,但判据比多数人以为的严。德国价格标示条例第11条第4款和指令的相关规定都把个性化降价排除在外,前提是这个优惠只对被选定的个人生效。生日券、流失召回码、按个体行为触发的挽留优惠,属于这一类。 不属于这一类的包括:挂在首页人人可领的券、结账时对所有人自动生效的折扣码、注册即得的新客券。它们在技术上是券,在性质上是一次面向公众的降价公告。另外,Google明确要求需要加入忠诚计划才能享受的会员价不要提交为促销价,而应使用专门的忠诚计划属性,这一层也要一并对上。 ## 大促期间促销一场接一场,前价是不是会越标越低? 会,而且这是规则设计出来的效果,不是副作用。两次促销间隔小于三十天时,第二次的前价就是第一次的促销价,名义降幅自然缩小。促销排得越密,可标的降幅越小。 唯一的缓和路径是德国价格标示条例第11条第2款那条:一次分步进行、中间不间断且降幅持续加大的降价,整个期间可以一直用序列开始之前的那个最低价当前价。所以清仓和季末处理应该配成一个连续的阶梯序列,而不是几场彼此独立的活动——同样的降价节奏,配置方式不同,可标的降幅完全不同。中途涨回去一次,或者插进来一场不相干的活动,这个豁免就断了。 ## 美国站和欧盟站能用同一套划线价逻辑吗? 可以用同一套,而且建议用同一套,但方向要选对:按欧盟口径统一,而不是按美国口径统一。 理由是两套规则的判据类型不同。美国那份1967年的《反欺骗性定价指南》要求前价是实际的、善意的、在合理相当的一段时间内公开提供过的价格,这是一个关于意图和商业惯例的判断,没有数字门槛,发布前你无法自证合规。而欧盟那个三十天最低价是可以算出来的。用三十天最低价当划线价,在欧盟是硬性要求,在美国则天然满足“实际提供过”这一条,因为它本来就是你实际适用过的价格。一套逻辑覆盖两个市场,还少维护一套分支。 ## 完全没有历史数据,从零开始要多久才能正常打折? 如果你今天开始记录,理论上三十天后就有了完整的窗口数据。但实际上可以更快:订单表里的实付价、渠道数据源的历史版本、页面缓存日志、比价网站的公开曲线,都可以拿来回填。多数站能还原出六十到九十天的可用序列,足够立刻恢复正常的折扣表达。 回填的时候有一条要守住:只回填能确定生效时刻的记录,拿不准的宁可留空,也别用推测值把序列补成看起来完整的样子。一个有缺口但每条都可信的序列,比一个完整但掺了估算的序列有用得多——前者你知道哪里不能依赖,后者你不知道。 在数据补齐之前的过渡期,最稳妥的做法是暂时撤掉所有降幅表述,只显示当前价格。这会损失一点转化,但比在数据不可靠的情况下继续标百分比划算得多——前者是可以量化的短期损失,后者是无法量化的长期敞口。 ## 干脆不显示划线价、只标现价,是不是最安全? 确实最安全,但要注意一个容易忽略的边界:不显示划线价,不等于没有做出降价公告。页面上如果还留着“限时特惠”“本季最划算”这类突出优惠性的表述,按C-330/23的口径它们同样构成降价公告,同样要以三十天最低价为基准。真要走这条路,得把这类文案一并清理掉。 另外,全面撤掉折扣表达也有代价。可用性研究里那些观察是真实的:价格与折扣信息不清晰会直接导致用户放弃这个商品。更实际的路径不是不打折,而是把折扣的形态换掉——加量、赠品、套装、限定组合、免运费,这些都不构成降价公告,力度天花板由供应链和履约成本决定,而不是由你三十天前的那次促销决定。 ## 权威参考资料 ## 商品列表页上那个每千克价格,是整页唯一一个你没存过、只能现算的数字 - URL:https://zhangwenbao.com/unit-price-denominator-eu-rules-product-list.html - 分类:DTC合规与法务 - 发布:2026-07-27 | 更新:2026-07-27 - 摘要:从一瓶浓缩洗涤液的三个分母讲起,拆解单位价格的分子与分母治理差异、欧盟98/6/EC与成员国落地规则的分岔、净含量在计量法上的统计属性、促销前价与分母的交叉,以及法定单位与使用单位的分离,附十六项上线自查与四周落地路径。 - 关键词:结构化数据,商品数据,商品列表页 > **TLDR**:摘要:商品列表上那行“每升多少钱”,是整张卡片上唯一一个你没有存过、只能现算的价格。分子来自价格系统,有审批、有日志、有回滚;分母来自净含量,那是商品目录里最没人认领的一个字段。欧盟把标注单位价格定成了义务而不是建议,德国要求一律折到每千克,英国按品类给了一张表,Google的商品数据字段还留着改写你分母的权利。这篇讲清楚分母归谁管、错在哪一步,以及怎么让法定单位和真正有用的单位同时出现在同一张卡片上。 > 摘要:商品列表上那行“每升多少钱”,是整张卡片上唯一一个你没有存过、只能现算的价格。分子来自价格系统,有审批、有日志、有回滚;分母来自净含量,那是商品目录里最没人认领的一个字段。欧盟把标注单位价格定成了义务而不是建议,德国要求一律折到每千克,英国按品类给了一张表,Google的商品数据字段还留着改写你分母的权利。这篇讲清楚分母归谁管、错在哪一步,以及怎么让法定单位和真正有用的单位同时出现在同一张卡片上。 ## 为什么单位价格是商品列表页上唯一一个算出来的价格? 先把地基挖开:同一张卡片上挨着的两个数字,一个有完整的治理体系,另一个连主人都找不到。 ## 一个价格有两个来源,血统完全不同 打开你自己站上任意一个品类页,随便挑一张商品卡片。上面那个大号的总价,是从价格表里读出来的。它有一条完整的来路:谁改的、什么时候改的、走了哪个审批、上一版是多少、出事了怎么回滚。 紧挨着它的那行小字,“€12.90/升”,来路完全不同。它不在任何一张表里。它是渲染那一刻,拿总价除以一个叫净含量的字段临时算出来的。页面刷新一次,它就重新算一次。 这两个数字挨得那么近,看起来是同一个东西的两种写法。实际上它们中间隔着一整套治理体系的有无。 ## 含量字段为什么是目录里最没人认领的那一个 净含量这个字段,在大多数团队的分工表上找不到主人。采购觉得那是产品的事,产品觉得那是运营录入的事,运营觉得供应商给的资料里写着呢。而供应商给的资料,通常是一个PDF,或者一列写着“500ml装”的Excel。 更要命的是它的错误几乎不产生投诉。价格错了,五分钟内客服工单就来了。含量错了,没有任何人会告诉你——买家不会拿量杯去量,客服不会去核,财务的报表里根本没有这个维度。商品属性和属性集的作用域管理 (https://zhangwenbao.com/magento-2-eav-product-attributes-attribute-sets-scope-management.html)做得再规整,也管不住一个从来没人去核对的值。 于是它就这么躺着。躺三年,躺到你某天决定上线单位价格,才第一次把它请上台面。 ## 三种含量来源,三种完全不同的错法 实操里,含量数据只可能有三个来源。批量导入导出 (https://zhangwenbao.com/woocommerce-product-csv-import-export-bulk-catalog-mapping-variations-operations.html)做得再熟练,也改不掉这三种来源各自的毛病。它们的覆盖率、错误形态和可校验性差得很远,值得先摆开看清楚。 来源 | 典型覆盖率 | 最常见的错法 | 能不能自动校验 | 供应商资料表 | 高,但字段口径不统一 | 毛重当净重、整箱数量当单件数量 | 能,用重量区间和品类做交叉校验 | 从商品标题正则解析 | 看着高,实际是假的高 | 标题里有两个数量时抓错那一个 | 很难,因为解析出来的值永远合乎语法 | 人工在后台录入 | 低,新品补录常年欠账 | 单位填错,把毫升写成升 | 能,但要在录入时就卡,事后查基本查不出 | 第二行是最危险的一行,因为它的产出物在形式上无懈可击。解析器吐出来的永远是一个数字加一个合法单位,你在数据库里看到的是干干净净的500和ml,看不出它是从哪串字符里刮下来的。 ## 算错的单位价格,比空着更难收场 这一点反直觉,但站得住。单位价格缺失的时候,用户会做两件事:要么自己心算,要么放弃比较随便挑一个。前者慢,后者可能让他错过更划算的那件,但两种情况下他心里都清楚这个判断是自己做的。 单位价格算错的时候,用户不算了。他直接采信。你等于把一个错误的结论以权威的口吻塞进了他的决策里,而且是用一个看起来像系统计算结果的形态塞进去的。 还有一层:错误的单位价格是机器可读的。它会进你的商品数据源、进结构化数据、进比价站、进答案引擎。一个人的误判止步于一次下单,一条错误的结构化数据会被复制到你完全看不见的地方去。 ## 它是整张卡片上唯一一个会被拿去做算术的数字 商品卡片上其他信息,用户是拿来读的。标题读一眼、评分扫一眼、配送时效瞄一眼。只有单位价格是拿来算的——准确说,是拿来免去算的。 Baymard在商品列表与筛选方向的大规模可用性测试里,反复观察到同一个动作:受试者停在列表页上,掰着手指算每份多少钱。有人对着四盒装的订阅餐盒把总价除以份数,有人在货架前对比单个牛油果和一整袋的差价,算完抬头说“差不多,那我拿整袋”。 这个动作发生的那一刻,浏览就中断了。而中断的次数是有上限的:测试里只要站点不给算好,参与者通常只肯认真比较少数几件商品,剩下的直接跳过。结账环节的放弃 (https://zhangwenbao.com/dtc-checkout-abandonment-9-real-causes.html)大家盯得很紧,列表页上这种静悄悄的放弃基本没人统计。 ## 分子有治理,分母没有 把两个数放在同一张表里对照一次,问题的形状就出来了。 治理维度 | 价格(分子) | 净含量(分母) | 有没有明确的责任人 | 有,通常是定价或运营负责人 | 多数团队答不上来 | 改动要不要审批 | 要,且往往有金额阈值 | 不要,后台改完就生效 | 有没有变更日志 | 有,能查到每一次调价 | 基本没有 | 错了多久会被发现 | 分钟级 | 可能永远不会 | 谁会来投诉 | 买家、客服、财务 | 没有人 | 能不能回滚 | 能 | 没有旧值可回 | 这张表里最扎眼的是“错了多久会被发现”那一行。分子出错以分钟计,分母出错以永远计。而单位价格这个数,是这两者相除的结果——它的可靠性只能等于两者中更差的那一个。 ## 第一周别碰代码,先去数覆盖率 很多团队上单位价格的第一个动作是找前端排期。这个顺序是反的。定价框架 (https://zhangwenbao.com/dtc-pricing-strategy-cost-plus-value-based-framework.html)再清楚,落到页面上也得先有分母。 正确的第一个动作是跑一条查询:全站有多少个在售商品填了净含量,填了的里面有多少个同时填了单位,单位的取值一共有几种写法。绝大多数站第一次跑这条查询,结果都比想象中难看。这条查询也是给一个字段建立单一可信来源 (https://zhangwenbao.com/seo-metrics-layer-single-source-of-truth-data-governance.html)的起点。 这个数字直接决定了后面所有的技术选型。覆盖率不到一半的时候,讨论“要不要按单位价格排序”是没有意义的——排序会把所有没数据的商品系统性地堆到一端去。 ## 两个必须配着看的指标 第一个是净含量覆盖率,按品类拆开看。全站一个总数没用,因为问题从来不是均匀分布的:日化和食品通常七八成,配件和长尾品类可能不到两成,而恰恰是长尾品类最需要用单位价格来自证划算。 第二个指标是我自己后来才开始盯的,姑且叫排序错位率:在同一个品类页里,按总价升序排出来的第一件商品,如果改按单位价格升序排,它落在第几位。这个位次差就是不标单位价格时,用户被总价误导的幅度。 它的好处是把一个说不清的体验问题变成了一个能报数的数字。某个品类算出来的错位是零,那这个品类做不做单位价格都行;算出来第一名掉到第九,那这个品类的比较功能基本是失灵的。砍掉虚荣指标只盯真信号 (https://zhangwenbao.com/vanity-metrics-north-star-omtm-ecommerce.html)这件事,在这里有一个很具体的落点。 ## 跨境站为什么要比本土站重一档看这件事 如果你只做美国市场,单位价格确实可以当成一个转化率优化项来排期,做与不做是个投入产出的判断。这也是绝大多数英文UX研究的默认语境。 一旦你的商品出现在欧盟、英国、挪威或者澳大利亚的页面上,性质就变了。那里的规则不问你转化率高不高,它规定了这个数必须出现、必须按某个分母算、必须清晰可读。做不做不再是选择题,怎么做才是。 更麻烦的一层在于:本土站上做错了,损失是一部分订单;欧盟站上做错了,损失可能是一封律师函加一份具结书。同一段代码,在两个市场里的失败代价根本不在一个量级上。 ## 欧盟为什么把标单位价格定成义务而不是建议? 这一节把条文摊开读一遍,顺便回答一个更有意思的问题:这条义务其实是在给谁的自由买单。 ## 指令的第一句话就把目的写死了 管这件事的是1998年的一部指令,98/6/EC,全称是关于向消费者标示商品价格方面消费者保护的指令。它的第1条只有一句话,说这部指令的目的是规定售价与计量单位价格的标示,以改善消费者信息、便利价格比较。 注意最后四个字,便利价格比较。这不是一句漂亮话,它是整部指令的解释锚。后面所有条款出现歧义的时候,回到这句话上就有答案:怎么做能让两件规格不同的商品被放在一起比,就该怎么做。 把这句话读进去之后,很多实操争论会自动消失。比如单位价格该不该显示在列表页而不只是详情页——用户是在列表页做比较的,答案不用讨论。 ## 法律眼里的单位价格,是这么定义的 第2条给了两个定义。售价是指某一单位商品或某一给定数量商品的最终价格,含增值税和所有其他税费。单位价格是指每一千克、每一升、每一米、每一平方米或每一立方米商品的最终价格,同样含税。 但这条定义还有一个尾巴,而这个尾巴是后面所有麻烦的源头:98/6/EC第2条(b)项 (https://eur-lex.europa.eu/legal-content/EN/TXT/HTML/?uri=CELEX:31998L0006)写的是,也可以是在相关成员国内被广泛且惯常用于该类特定商品营销的另一种单一数量单位。 一句话:分母有一个默认值,但成员国可以改。指令在定义分母的同一句话里,把分母的最终决定权下放了出去。这是欧盟层面的“另一种单一数量单位”,后面德国和英国会各自把它填成完全不同的东西。 ## 两个价格必须一起出现,缺一不可 第3条第1款是义务本体:本指令第1条所指的所有商品,都应标示售价与单位价格。同一款后半句给了唯一一个省略条件——当单位价格与售价相同时,单位价格无须标示。 这个省略条件比看上去窄。它说的是数值相同,不是概念相当。一瓶正好1升的橄榄油,售价 €8.90,单位价格也是 €8.90/升,这时候可以不标。一瓶750毫升的,就不行。 第3条第3款还有一条反向规定:散装商品只需标单位价格。因为散装商品在消费者说出要多少之前,总价根本不存在。这条对现场零售更相关,但线上做定制裁切、按米卖的线缆布料时会撞上。 ## 广告里提到售价,就得同时给单位价格 第3条第4款是这部指令里最容易被跨境团队漏掉的一条:任何提及本指令第1条所指商品售价的广告,也应标示单位价格。 把这条放到今天的语境里读一遍,它覆盖的范围相当宽。购物广告的素材上有价格,邮件营销的模块里有价格,联盟客的素材包里有价格,站内的促销横幅上也有价格。这些位置上出现了售价,按条文就得配上单位价格。 实操上,第一个会被撞到的是产品数据源 (https://zhangwenbao.com/product-feed-seo-asset-organic-ai-ownership.html)。它同时喂着购物广告和免费商品列表,而它是不是归你管、有没有人在维护含量字段,往往是两个不同部门的答案。 ## 不含糊、易辨认、清晰可读 第4条第1款规定,售价和单位价格必须是明确无歧义、易于辨认、清晰可读的。同一款还允许成员国限制可标示价格的最大数量,防止一个货架牌上堆七八个数字。 这三个词看着虚,其实很好落地。明确无歧义对应的是单位要写全,写 €0.22/1UNI这种缩写就不算。易于辨认对应的是它得在商品的视觉范围内,不能塞进折叠的详情区。清晰可读对应的是字号和对比度。 反过来讲,它也给了一条明确的下界:单位价格不需要跟总价一样醒目。它只要够找得到就行。这一点和体验设计的结论是一致的,总价该抢眼,单位价格该安静地待在那儿等人来看。 ## 分母必须是依法申报的那个量 第4条第2款是全条最硬、也最容易被工程实现忽略的一句:单位价格应参照依照国家与共同体规定所申报的数量。 这句话的意思是,你不能自己发明分母。分母得是那个按包装标示法规申报在包装上的净含量数字。你觉得按稀释后的等效体积算更有意义?你觉得按可使用次数算更公平?在这条规则下,这些都不是你能自己决定的。 同一款还带了一句补充:在国家或共同体规定要求对某些预包装商品同时标示净重与沥干净重的情况下,标示沥干净重的单位价格即为已足。罐头橄榄、腌菜、糖水水果这一类商品,分母用沥干重,不用连汤一起算。 ## 规格自由化,才是这条义务的前因 大部分人把单位价格当成一条孤立的消费者保护规则。它不是。它是欧盟为了另一件事付的代价。 2007年的2007/45/EC做了一件影响深远的事:除了少数几类商品,成员国不得再以标称量为由拒绝、禁止或限制预包装商品上市。翻译过来就是,包装规格全面放开了。你想做375毫升、480毫升、还是833毫升,随你。 规格一放开,货架上就再也没有可比的公分母了。所以必须有另一个机制把可比性补回来——那就是强制标示单位价格。这两条规则是一套设计的两个半边,一个负责给企业自由,一个负责把自由造成的信息成本从消费者身上挪走。 ## 只有酒类还锁着规格 2007/45/EC的附件里留了一张短名单,是唯一还被锁死规格的那几类。静酒在100毫升到1500毫升区间内只允许8种规格,起泡酒只允许5种,烈酒在100毫升到2000毫升区间内只允许9种,利口酒和加香葡萄酒各7种。 把这张名单和上一节连起来读,逻辑就闭合了:规格被锁死的品类,天然可比,对单位价格的依赖最低;规格全放开的品类,可比性完全靠单位价格撑着。 顺带一提,这张名单还解释了一个常见的困惑——为什么烈酒的瓶子几乎全世界都是700毫升,而美国是750毫升。那不是行业习惯,那是两套法规各自锁出来的结果。 ## 哪些情况可以不标 第3条第2款允许成员国把服务过程中提供的商品、拍卖以及艺术品古董排除在外。第5条则给了成员国一个更宽的口子:当标示单位价格因商品的性质或用途而无益处、或可能造成混淆时,可以豁免。 关键在于豁免权在成员国手里,不在你手里。你不能自己判断某个品类标了没意义就不标,你得去看目标市场的国内法有没有把它列进豁免清单。 下面两节就来看两个把这个口子用得完全不同的市场。它们的差别之大,会直接把同一件商品在两个站上的显示数字拉开一个数量级。 ## 这套规则到底管不管网店 这是被问得最多的一个问题,而且问的人心里通常存着一丝侥幸。答案很干脆:管。指令通篇说的是经营者向消费者提供的商品,从来没有区分线下货架和线上页面。 成员国的落地法规写得更明白。德国的价格标示条例专门有一条讲远程销售合同的价格标示,英国的价格标示令则在规定标示位置时直接写了“就远程合同与广告而言,标示应给在商品的视觉或文字描述的近旁”。也就是说,立法者早就把网页上的商品卡片算进去了。 唯一的差别在于线上没有货架牌这个物理载体,所以“近旁”要靠版式来兑现。这也是为什么单位价格不能只出现在详情页最下面那张规格表里——那儿离商品描述太远了,够不着这个词。 ## 同一罐咖啡在德国和英国为什么要标两个差十倍的数字? 两个市场把欧盟留下的那个口子填成了完全相反的形状,而多数代码里只写死了其中一种。 ## 德国的答案:一律折到每千克、每升 德国的价格标示条例把这件事规定得极其干脆。条例第5条第1款 (https://www.gesetze-im-internet.de/pangv_2022/__5.html)写明,基础价格的计量单位分别是1千克、1升、1立方米、1米或1平方米。没有别的选项。 只在一种情况下允许换:通常以100升以上、50千克以上或100米以上交付的商品,按符合一般交易观念的单位来算。这是给建材、燃料、批量包装留的口子,日用消费品用不上。多语言多货币站 (https://zhangwenbao.com/woocommerce-multilingual-multicurrency-seo-hreflang-url-schema.html)要留意的是,这条按市场分岔的规则和货币、税率属于同一类配置。 这条规则在2022年那次修订里收得比以前更紧。老版本允许小规格商品用每100克、每100毫升,新版本把这个选项从预包装商品身上拿掉了,只留给散装。所以你如果参考的是几年前的中文资料,很可能拿到的是一份过期口径。 ## 德国留了100克这个单位,但只给散装 第5条第2款说的是散装商品:按重量或体积提供的散装商品,依一般交易观念,用1千克或100克、1升或100毫升。第3款还补了一句,自助灌装的液体散装商品可以在体积基础价之外额外给一个按重量的基础价。 散装的定义在第2条:由经营者当着消费者的面、或由消费者自己、或应消费者要求现场称量的未包装商品。线上零售基本落不到这个定义里,除非你做的是按米裁切或者按重量分装。跨境多市场的价格格式化 (https://zhangwenbao.com/currency-formatter-cross-border-price-localization-schema-guide.html)在这里也要跟着分岔,德语区和英语区连小数点的写法都不一样。 第4款则和欧盟指令对上了:需要标示沥干重的商品,基础价格按标示的沥干重算。橄榄、酸黄瓜、糖水桃子这类东西,分母是捞出来的那部分。 ## 英国的答案:附表里有一张按品类的表 英国2004年的价格标示令走了完全相反的路子。它的默认值和欧盟一样是每千克、每升,但紧接着开了两个例外:附表1所列商品按附表里给出的对应数量单位 (https://www.legislation.gov.uk/uksi/2004/102/made),按件销售的商品按单件价格。 附表1是一张实打实的品类清单。香精、食用色素、香草、香料、彩妆、种子这几类用10;饼干、面包、早餐谷物、巧克力糖果、咖啡、熟食肉类与海鲜、彩妆之外的化妆品、奶油、蘸酱、干调味料、鲜切沙拉、果汁软饮、冰淇淋、腌菜、非内燃机润滑油这一长串用100。 换句话说,英国立法者的思路是:让分母贴近人们真实购买和讨论这类商品的口径。买咖啡的人心里的单位是100克,不是1千克。这个思路更贴近用户,代价是你的系统里得存下一张品类映射表。 ## 同一罐250克咖啡,两个数字 把上面两套规则套到同一件商品上,差别就具体了。 同一罐咖啡 | 德国站 | 英国站 | 包装 | 250克 | 250克 | 法定分母 | 1千克 | 100克 | 页面上要出现的数 | 每千克19.96欧元 | 每100克2.00英镑 | 数值倍数关系 | 同一件商品,两个页面上的数字相差10倍 | 能不能共用一份计算逻辑 | 能,但分母必须是变量,且要跟着市场走 | 这张表最容易被误读成“改个换算系数就行”。它比换算系数难一点:德国那一列的分母只跟单位类型有关,英国那一列的分母跟品类有关。两套规则的输入参数根本不是同一个东西。 ## 小规格商品会被这条规则放大 德国这套一刀切的规则有一个很容易被忽略的商业后果:所有小规格商品的单位价格会被推到一个心理上不太舒服的量级。 一瓶50毫升的面部精华卖29.90欧元,德国站上要写的是每升598欧元。含税与否也会牵动这个数,含税显示 (https://zhangwenbao.com/woocommerce-tax-rates-classes-vat-sales-tax-inclusive-display-setup-operations.html)没配对,单位价格就会连着错。数字本身完全正确,但看到它的那一秒,很多买家的第一反应是“这玩意儿一升要六百欧”。而这恰恰就是立法意图——它逼你把商品放进一个所有人都能横向比较的坐标系里。 能做的不是把它藏起来,而是给它配上下文。同一张卡片上写清楚一次用量、能用多少天、折下来每天多少钱,那个598就从一个吓人的数字变成了一个可以理解的数字。高客单价品类靠内容与信任撑住价格 (https://zhangwenbao.com/high-ticket-dtc-content-trust-geo-strategy.html)这件事,在这里有一个非常直接的落点。 ## 德国的两条豁免,恰好都在美妆品类上 条例第4条第3款列了8类不必标基础价格的商品,其中有两条对跨境卖家格外相关。 第7项:专门用于对皮肤、毛发或指甲进行着色或美化的化妆品。也就是彩妆。第8项:至少含3%体积香精油且至少含70%体积纯乙醇的香水和香水类香氛水。这条写得非常技术,是照着香水的配方定义划的线。 有意思的地方在于,Google在商品数据规范里把香水明确列为最该提交单位价格的品类之一。同一类商品,渠道方按最佳实践建议你提交,德国法却明文把它排除在义务之外。这不是谁错了,这是两套规则的目的本来就不同。类似的错位在商品标识码的填报要求 (https://zhangwenbao.com/product-gtin-seo.html)上也出现过,渠道的最佳实践和某个市场的强制规范并不总是重合。 ## 英国还管了字号:单位价格必须占主导 价格标示令第7条第1款和欧盟指令一样要求明确无歧义、易于辨认、清晰可读,并规定标示要给在商品旁边,就远程合同和广告而言,是给在商品的视觉或文字描述的近旁。 第7条第4款则多管了一件欧盟没管的事:如果在单位价格之外还标了一个按补充数量单位计的价格,单位价格必须占主导,补充单位的价格所用字符不得大于单位价格。 这一条在跨境场景里有个现成的用武之地。你要是想在英国站上同时给出每100克和每一份的价格,法定那个必须更醒目,你自己发明的那个只能更小。这个次序不是审美问题,是条文写死的。 ## 三个市场并排看一遍 对照项 | 欧盟基准规则 | 德国 | 英国 | 默认分母 | 每千克、每升、每米、每平方米、每立方米 | 同左,且几乎不许换 | 同左,但附表另有规定 | 能不能按品类改分母 | 可以,交给成员国决定 | 基本不行 | 可以,附表1一整张清单 | 100克这个单位 | 成员国自定 | 只给散装 | 咖啡、面包等一长串品类都用 | 沥干重 | 用沥干重即可 | 明文要求用沥干重 | 另有净重相关规定 | 特殊品类豁免 | 授权成员国制定 | 彩妆、符合定义的香水等8类 | 另有小面积门店等豁免 | 对字号排序的要求 | 只要求清晰可读 | 要求清晰可辨 | 额外规定单位价格必须占主导 | 这张表放在一起看,最直接的结论是:分母不是一个常量,是一个至少由市场和品类两个维度决定的函数。 ## 所以分母不能硬编码 我见过太多实现是把千克和升写死在模板里的。这在只做一个市场的时候完全够用,在开第二个市场的那一天会变成一次全站返工。多市场架构怎么选 (https://zhangwenbao.com/shopify-markets-vs-plus-expansion-stores-international-seo-architecture.html)这个决定做得越早,这类分岔配置的代价越低。 正确的做法是把它做成一张三列的映射:市场、品类、法定基准单位。渲染的时候查表,查不到就回落到欧盟默认值并打一条告警,而不是静默地按千克算下去。 这张表还得有人维护,因为它会变。德国2022年那次修订就把一整列选项删掉了。多市场站点的架构选型 (https://zhangwenbao.com/international-seo-domain-structure-cctld-subdirectory-subdomain.html)做完之后,这类按市场分岔的配置表会越来越多,早点给它一个正经位置比事后到处补要省事得多。 ## 那个分母到底归谁管? 全篇最核心的一节:三个系统各有一套分母规则,各自都合理,合起来却谁也装不下谁。 ## 同一件商品,三个系统各自算出一个分母 到这一步,一件很奇怪的事情该被说出来了。你的商品在三个地方会出现单位价格:自己的商品卡片上、提交给渠道的商品数据里、页面的结构化数据里。这三个地方各有一套关于分母的规则,而且它们互不知道对方的存在。 更奇怪的是,这三套规则各自都是合理的。法律那一套是为了让消费者能比价,渠道那一套是为了让同一个结果页上的商品能并排放,词表那一套是为了尽量精确地描述任意一种价格结构。没有哪一方在犯错。 可它们合起来的结果是:同一瓶油,三个位置上可以出现三个不同的数字,而只有其中一个是你要承担法律责任的。这件事没有任何一层去负责调和。 ## 渠道这一套:两个字段,一个当分子一个当分母 Google的商品数据规范里有一对属性。unit_pricing_measure描述这件商品本身的量与维度,unit_pricing_base_measure是你希望用来展示的那个分母。 官方文档给的例子很清楚:price提交3美元,unit_pricing_measure提交150液量盎司,unit_pricing_base_measure提交100液量盎司,最终展示的单位价格就是每100液量盎司2美元。 文档还专门点了一句:在欧盟、欧洲自贸联盟国家、英国、澳大利亚和新西兰,某些按重量、体积、长度或面积销售的商品,按当地法规必须显示单位价格,因此需要提交这个属性。渠道方自己承认了这是法规驱动的字段,不是可选优化。 ## 但渠道保留了改写你分母的权利 这是这一节最需要划下来的一句。unit_pricing_base_measure的文档 (https://support.google.com/merchants/answer/6324490)里写着:为了让同一个页面上所有广告和免费商品列表的单位价格更可比,你的商品显示出来的基准量可能与你在这里提交的不同。 翻译成大白话:你提交每100毫升,它可能给你展示成每升。理由完全站得住——一个结果页上六件商品,三件按100毫升、三件按1升,那这个页面上的比价功能就废了。它必须统一。 但这条规则的后果是,你在渠道里看到的那个数,不一定是你提交的那个数。而你在自己站上按德国法算出来的那个数,跟渠道展示的那个数,也不必然一致。买家一天之内可能在两个位置看到同一件商品的两个单位价格,两个都对。 ## 渠道能表达的分母,比法律能要求的少 还有一层更硬的限制。unit_pricing_base_measure支持的整数只有1、10、100、2、4、8这六个,另外额外支持75cl、750ml、50kg、1000kg四种组合。 这意味着有些分母你根本填不进去。比如某个市场惯用每250克,250不在这张表里。比如英国附表1里那些用10的品类,10倒是有,但你得确保单位类型也对得上。 所以正确的心态是:渠道字段是你表达意图的地方,不是你兑现法定义务的地方。法定义务只能在你自己控制的那张商品卡片上兑现。这一点在页面标记与数据源分类对齐 (https://zhangwenbao.com/merchant-listing-category-property-google-product-taxonomy.html)那件事上也是同一个道理,两边各有各的口径,别指望一方替另一方兜底。 ## 词表这一套:一个通用得多的模型 结构化数据这边用的是UnitPriceSpecification。它有一个叫referenceQuantity的属性,词表给的定义是“某一价格所适用的参考数量,例如每4千瓦时电1欧元”。 Google的两个属性正好映射过去:unit_pricing_measure对应Offer.priceSpecification.referenceQuantity,unit_pricing_base_measure对应它下面的valueReference。两层结构,一层描述商品有多少,一层描述你按多少来报价。想确认自己页面上到底输出了什么,用结构化数据审计工具 (https://zhangwenbao.com/schema-extractor-structured-data-audit-guide.html)扒一遍最快。 值得注意的是referenceQuantity的定义原文 (https://schema.org/UnitPriceSpecification)还带了一句自我说明:这个属性是unitOfMeasurement的替代品,用于价格与标准单位无关的进阶情形。词表自己承认了标准单位不够用,所以才有了这个更松的结构。 ## unitCode与unitText:一个逃生口,也是一次降级 数量单位在词表里有两种写法。unitCode要求填UN/CEFACT通用代码,三个字符,或者一个网址。unitText是一个纯文本字符串,词表对它的说明是:当你没法为unitCode提供一个标准单位代码时,这个属性很有用。 这两行字里藏着一个结构性的取舍。有代码的单位可以被机器对齐、换算、排序、比较;没有代码只能塞进自由文本的单位,机器只能把它当成一串字符原样搬运。 而问题恰恰在于:越是对用户有意义的单位,越可能没有标准代码。每次洗涤、每杯、每日剂量、每平方米涂布面积——这些正是买家心里真正的计价口径,也正是只能进unitText的那一批。可比较的单位往往没意义,有意义的单位往往不可比较。 ## 三方摆在一起看 对照项 | 法律 | 渠道商品数据 | 结构化数据词表 | 分母由谁决定 | 成员国法规按品类锁死 | 你提交,但渠道可改写 | 你自己写,无人校验 | 能表达的分母范围 | 法规列举的那几种 | 六个整数加四种组合 | 几乎任意,含自由文本 | 能不能表达每次使用 | 个别品类可以 | 不能 | 能,但只能进自由文本 | 填错了会怎样 | 可能被竞争对手或协会追究 | 商品可能被拒登 | 通常没有任何反应 | 谁最终承担责任 | 你 | 你 | 你 | 谁负责让三者一致 | 没有人 | 最后两行是这张表的全部意思。责任永远落在同一个人身上,协调工作却没有任何一方认领。 ## 这跟三方各自独立得出同一个结论,是两回事 做合规话题的时候,我们常常会碰到另一种更让人安心的格局:法规、平台规范和技术词表各自从不同方向出发,最后要求的东西高度一致。那种情况下你只要照着做,三边同时满足。 单位价格不是这种格局。它是反过来的:三方各自合理,各自给出的答案却互相装不下。法律要一个按品类锁死的分母,渠道只认那六个整数,词表干脆放弃约束、给你一个自由文本框。 识别出这个差别很重要,因为它决定了你的做法。三方收敛的时候,做一份就行。三方发散的时候,你必须显式地维护一份翻译层,并且明确规定当它们冲突时以哪一边为准。 ## 那份翻译层长什么样 实操里它可以很朴素。一张表,每行一个市场加品类的组合,四列:法定基准单位、页面展示单位、提交给渠道的基准量、结构化数据里写什么。 规则也很朴素:页面展示单位必须等于法定基准单位,这一列没有商量余地。渠道那一列尽量贴近法定单位,实在表达不了就选最接近的合法值,并且接受它可能被改写。结构化数据那一列跟页面保持一致,附加单位另开一个Offer或者进自由文本。 把这四列显式写出来的最大好处,不是它更规范,而是它把一个隐藏在三个系统缝隙里的决策,变成了一张有人负责的表。结构化数据该按优先级做而不是凭感觉堆类型 (https://zhangwenbao.com/schema-org-usage-statistics-priority-guide.html),在这里也一样:先把冲突写下来,再谈优化。 ## 净含量那个数字在法律上为什么是个统计量? 分子精确到分,分母是一个在20摄氏度下按批次平均、允许单件有偏差的约定值。 ## 标称量的官方定义,比你想的松 包装上印的那个500毫升,法律上叫标称量。1976年的76/211/EEC附件一第2.1条给了它一个定义,读起来会让人愣一下:标称量是包装上标示的重量或体积,也就是该包装被认为含有的产品数量。 关键在“被认为”三个字。它不是“实际含有”,实际含有的量在第2.2条里另有一个名字,叫实际含量。同一份法条用了两个不同的词,说明立法者从一开始就没打算让这两个数相等。 这就是分母的真身:它是一个约定的标示值,不是每一瓶的测量值。你在页面上算的每一次除法,除的都是这个约定值。 ## 合规判据是一个批次的平均,不是单件 附件一第1.1条把要求写得很直接:完成灌装的包装,其实际含量平均不得少于标称量。注意“平均”。 第1.2条接着说,负偏差大于容许负偏差的包装比例应当足够小,小到能通过附件二规定的抽样检验。第2.3条把负偏差定义为实际含量低于标称量的差额,第2.4条给了一张按商品类别和标称量分档的容许负偏差表。 第1.3条留了一条底线:负偏差超过容许负偏差两倍的单个包装,不得带那个小写的e标。也就是说,法规允许单件低于标示值,只是给了上限,并且用批次平均来兜底。 ## 体积甚至规定了测量温度 第2.2条还有一句非常工程师的规定:所有以体积单位表示的数量核查,实际含量的取值应在20摄氏度下测量,或者校正到20摄氏度,无论包装或检查时的实际温度是多少。深冻和冷冻商品按体积标示的不适用。 把这条读完再回头看商品卡片上那个每升多少钱,感觉会有点微妙。分子是一个精确到分的价格,分母是一个在20摄氏度下、按批次平均、允许单件有容许偏差的统计约定。 这不是在挑法规的毛病,恰恰相反,这套设计非常务实——灌装线不可能做到每一瓶都分毫不差,用平均值加偏差上限来约束是唯一可行的办法。需要调整的是我们这边的心态:别把分母当成一个物理常数来对待。 ## 对做电商的人来说,这条推论最有用 结论其实很简单:你唯一该用来当分母的,就是包装上那个印着的标称量,一个字都不要改。 不要用称重系统里的实测均值,那是另一套数,而且它不是消费者看得到的那个数。不要用毛重,毛重里有瓶子。不要用你自己算出来的等效量,欧盟指令第4条第2款已经把这条路堵死了——分母应参照依法申报的数量。 这条推论的实操价值在于,它把一个看起来需要判断的问题变成了一个只需要抄写的问题。抄包装上那个数就行。可配置商品的属性矩阵 (https://zhangwenbao.com/magento-2-configurable-product-variations-attributes-inventory-matrix.html)建得再漂亮,这一格填错了照样白搭。难的从来不是决定抄哪个,是保证仓库、供应商资料和后台字段里躺的都是同一个数。 ## 多件装的标称量,适用于每一个单件 2007/45/EC第5条第1款规定:两个或两个以上独立预包装构成多件装时,附件所列的标称量适用于每一个独立预包装。第2款则说,如果一个预包装由两个或以上不打算单独销售的独立包装构成,标称量适用于整个预包装。 这两款合起来,正好回答了一个电商里天天遇到的问题:六罐装的汽水,分母该是330毫升还是1980毫升。答案取决于里面那六罐是不是打算单独销售的规格,而这件事在变体该合还是该拆 (https://zhangwenbao.com/product-variant-seo-url-canonical-indexation-strategy.html)那个决定里就已经定下来了。 落到页面上,稳妥做法是把总量和单件量都写出来。一张卡片上同时出现“6 × 330毫升”和“每升多少钱”,用户不会误解,而按总量算出来的那个每升价格也正好是他要拿去比价的那个数。分组商品与关联简单商品 (https://zhangwenbao.com/magento-2-grouped-product-associated-products-setup-pricing-guide.html)那一套建模,在这里必须和含量字段对齐,否则六罐装会继承单罐的含量。 ## 气雾剂罐上有两个体积,法律明文要求别搞混 这是我最喜欢的一条,因为它把整篇文章的主题浓缩成了一句法条。2007/45/EC第4条第1款:气雾剂分配器应标示容器的标称总容量,该标示的方式不得与内容物的标称体积造成混淆。 也就是说,立法者早在2007年就预见到了:同一个罐子上会印两个体积数字,一个是罐子有多大,一个是里面装了多少,人们会搞混。所以专门写了一款去禁止。 而你的商品标题里,这两个数字很可能同时存在。“清洁喷雾400毫升罐装/净含量300毫升”这种写法,在任何一个正则表达式面前都是一道选择题,而正则表达式不会做选择题,它只会执行一条默认规则。这条默认规则是谁在哪一年写的,多半已经没人记得了。批量导入时的字段映射 (https://zhangwenbao.com/magento-2-product-import-export-csv-mapping-bulk-catalog.html)里,这类历史遗留的默认值往往还不止一处。 ## 小规格商品有两条容易漏掉的边界 第一条边界在德国。价格标示条例第4条第3款第1项写着,标称重量或标称体积小于10克或10毫升的商品,不必标示基础价格。样品装、旅行装、单次用量的精油滴管,很多正好落在这条线以下。 第二条边界在计量法规里。76/211/EEC附件一第2.6条把标称重量或体积小于25克或25毫升的预包装、以及所有液体产品,都划进了B类,容许负偏差按更宽松的一档算。规格越小,允许的相对偏差越大。 把两条放在一起,小规格商品的情形就清楚了:10毫升以下在德国免标,10到25毫升之间要标、但那个分母的相对不确定性是全品类里最高的。这一档商品的单位价格,形式上完全合规,实质上参考价值有限,页面上最好配一句用量说明去补它。 ## 四种看起来像单位价格、其实不是的东西 错误形态 | 页面上看起来 | 实际错在哪 | 怎么发现 | 用毛重当分母 | 完全正常,只是偏低 | 把包装重量算进了商品 | 对比同品类同规格商品的离散度 | 用稀释后等效量当分母 | 非常有竞争力 | 违反依法申报数量那一条 | 看该商品是不是浓缩型 | 用整箱数量当分母 | 低得离谱但没人查 | 批发规格串到零售页面上 | 单位价格排序时它会窜到最前 | 促销后没有重算 | 和划线价配在一起,很自然 | 分子换了分母没换或者反过来 | 促销开始那一刻抓一次快照对比 | 四种里有三种的表现都是“看起来更便宜”。这不是巧合。分母类的错误天然偏向于把分母做大,因为营销文案总是倾向于把更大的那个数字写在更显眼的地方。 ## 所以校验的对象不是算式,是分母 大部分团队给单位价格写的测试用例,验的是price除以quantity等不等于预期值。这类用例永远会通过,因为除法不会错。 真正该验的是三件事:这个商品的含量字段是从哪儿来的、它和包装上印的那个数是不是同一个、同品类同规格的商品之间这个值离散得正不正常。 第三条尤其好用,因为它不需要任何外部数据。同一个品类里三十件500毫升装的商品,其中两件的含量字段写着2000,那两件不用查就知道有问题。这种品类内的离群检测,比逐个核对包装照片省事得多,也比等着别人来投诉靠谱得多。 ## 打折的时候单位价格该跟着哪个价走? 同一部指令里的两条规则,在你的系统里分属两个模块,每逢大促就要同时改一批数字。 ## 同一部指令里的两条规则,在你系统里是两个模块 2019年那部俗称综合指令的2019/2161,给98/6/EC塞进了一条全新的第6a条。从那以后,管分母的规则和管参照价的规则住进了同一部法里。 可在你的系统里,这两件事从来没见过面。参照价是促销引擎算的,它读价格历史、算折扣、渲染划线价。单位价格是模板层算的,它读当前价、读含量、做一次除法。两条代码路径,两个负责人,两套上线节奏。法务和业务的协作账本 (https://zhangwenbao.com/legal-counsel-seo-collaboration-7-actions-privacy-trademark-incident.html)里,这类跨模块的合规点最容易掉进缝隙。 于是每次大促开始的那一秒,就有一批数字要重新排列组合,而没有任何一处代码知道它们本来是一家人。 ## 前价的定义:降价前至少30天内的最低价 第6a条第1款规定:任何降价公告都应标示经营者在降价适用之前的某一确定期间内所适用的前价。第2款把前价定义为:经营者在降价适用前不少于30天的期间内所适用的最低价格。 这两句的组合很狠。它不看你的原价标签写着多少,也不看上一次调价前是多少,它只看过去30天里的最低点。你要是在大促前半个月做过一次七折闪购,那次闪购价就是你这回的参照价。 第3到第5款留了三个口子:易腐或快速过期的商品,成员国可另定规则;上市不足30天的商品,成员国可缩短期间;渐进式加大降幅时,成员国可规定以第一次降价前的价格为前价。三条都是授权成员国,不是直接给你的豁免。 ## 那个关于香蕉和菠萝的案子 2024年9月26日,欧盟法院第八审判庭对C-330/23号案作出判决。原告是巴登符腾堡州消费者中心,被告是奥乐齐南方公司,提交预先裁决请求的是杜塞尔多夫地方法院。 案情非常具体。2022年10月17日到22日那一周的宣传册上,超新鲜商品被标为已降价,其中包括散装的公平贸易有机香蕉和雨林联盟菠萝。价格印在一个白色矩形里:中间大字写着香蕉1.29欧元、菠萝1.49欧元,右下角小字划着一道线写1.69欧元。 香蕉那一栏还叠着一个德国国旗配色的小矩形,标着降价百分比。菠萝那一栏的小矩形上写的是价格亮点。矩形下面还有一行字:最后售价、过去30天内最低价,后面跟着第三个数——香蕉1.29欧元,菠萝1.39欧元。 ## 一张宣传册上印了三个价格,法院看的是哪一个 从裁定书披露的事实看:香蕉在门店里从2022年9月中旬起一直卖1.69欧元每公斤,只有9月19日到24日那一周降到过1.29欧元每公斤。菠萝在此前五周的单价在1.39到1.79欧元之间。 也就是说,香蕉这次的“降价”售价1.29,和它30天内的最低价1.29完全一样。可宣传册上那个百分比,是拿1.69去算的。 法院的判词 (https://eur-lex.europa.eu/legal-content/EN/TXT/HTML/?uri=CELEX:62023CJ0330)很短:第6a条第1款和第2款必须解释为,经营者以百分比形式宣布的降价,或者以旨在突出所宣布价格优惠性的促销表述形式宣布的降价,都必须以第2款意义上的前价为基准来确定。价格亮点这类说法,一样跑不掉。 ## 被判的那个数,本身就是一个单位价格 这个案子还有一层细节,很少有人提,但对本文的主题恰好是最关键的:香蕉是散装卖的,价格标的是每公斤1.69欧元。 回到98/6/EC第3条第3款——散装商品只需标示单位价格。所以奥乐齐宣传册上被拿去算百分比的那个前价,从法律形态上讲就是一个单位价格。 换句话说,第2条(b)项定义的分母和第6a条定义的参照价,在这个案子里落在了同一个数字上。它们本来就不是两件事,是同一件事在两个条文里的两个切面。这个案子是我见过最干净的一次演示。 ## 划线价旁边那个单位价格,该按哪个价算 回到页面上。一张促销中的商品卡片通常有三个数:现价、划线价、单位价格。前两个的关系有明文规定,第三个和前两个的关系,条文里没写。 但推理并不难。单位价格的定义是“最终价格”除以基准量,最终价格就是消费者实际要付的那个数,所以单位价格必须按现价算。这一点没有争议。 有争议的是要不要同时给出划线价对应的单位价格。我的建议是不要。三个数字已经够多了,第四个只会稀释注意力,而且它会给人一种“这两个单位价格都是有效报价”的错觉。目录与购物车价格规则 (https://zhangwenbao.com/magento-2-catalog-cart-price-rules-coupon-promotion-engine-operations.html)那一层能算出多少个价格是一回事,页面上该露几个是另一回事。 ## 低价商品会同时被三条规则夹住 Baymard在商品页折扣展示方向的研究 (https://baymard.com/blog/product-page-price-discounts)里给了一条很实用的经验:低于100美元的商品,折扣用百分比表达心理效果更强;高于100美元的商品,用绝对金额更有力——一件1000美元降到900美元,写“省100美元”比写“省10%”有效。同一份研究里还有一组数字:超过18%的站在商品页展示折扣时会踩到四个坑之一,19%的桌面站用多种说法描述同一个促销,14%的桌面站把促销信息放得离价格很远。 把这条经验和前面的判决摆在一起,一个尴尬的重叠就出现了。低价商品最适合用百分比,而百分比正是判决点名必须以30天最低价为基准的那种表达。而低价商品,又恰恰是食品、日化、耗材这些最需要标单位价格的品类。 同一批商品上,三条规则同时生效:折扣怎么表达归转化率优化管,参照价怎么算归法务管,分母怎么选归前端管。三个人各自都做对了自己那一份,页面上照样可能出错。 ## 促销那一刻要抓的三个快照 这件事最省力的验收方式不是评审文档,是抓快照。促销上线前后各抓一次同一批商品的渲染结果,对比三组数。 第一组:现价变了没有,变的幅度和促销规则一致不一致。第二组:单位价格跟着变了没有,新的单位价格除回去等不等于现价除以含量。第三组:划线价对应的那个前价,是不是真的等于过去30天的最低点,而不是等于价目表里的原价。 第三组最容易出问题,因为大多数系统里的原价字段是一个静态值,而前价是一个需要查历史才能算出来的动态值。这两个字段长得太像了,谁都会顺手拿原价去填。促销与优惠券规则 (https://zhangwenbao.com/woocommerce-coupon-promotion-rules-discount-abuse-prevention-operations.html)那一套配置里,这个坑埋得特别深。 顺带说一句,这三组快照的对比脚本一旦写好,就是可以一直跑下去的资产。它比任何一份上线检查表都可靠,因为它验的是渲染出来的结果,而不是验有没有人记得去检查。 ## 有意义的单位和法定的单位为什么常常不是同一个? 德国法在洗涤剂这一个品类上自己承认了这件事,那一款条文是全篇最好的一处印证。 ## 德国法在一个品类上,自己承认了这件事 价格标示条例第5条前四款一路把分母锁得死死的,到第5款突然松了一次口,而且松得非常具体:对家用洗涤剂,可以用一次常规使用作为基础价格的计量单位 (https://www.gesetze-im-internet.de/pangv_2022/__5.html)。 把这句话读慢一点。德国立法者在一部通篇要求折算到千克和升的条例里,专门给洗涤剂开了一个口子,允许你用“洗一次衣服”当分母。 同一款第二句还把范围扩了一点:这也适用于洗涤和清洁用品,只要它们是单独分量包装的,并且在总灌装量之外还标明了份数。洗衣凝珠、洗碗块、单次分装的清洁片,都在这个范围里。 ## 为什么这个口子只给了洗涤剂 因为在这个品类里,体积已经不能构成可比性了。 两瓶都是1升的洗衣液,一瓶标准配方一次用75毫升,一瓶三倍浓缩一次用25毫升。按每升算,浓缩那瓶贵得多;按每次洗涤算,可能反过来。分母选哪个,直接决定了页面上谁看起来划算。 这正是源研究里那个咳嗽糖浆例子的放大版:两瓶都是100毫升,一瓶的用量是另一瓶的两倍,那么每毫升多少钱这个数就失去了意义。区别在于德国立法者没有停在观察上,而是把它写进了法条。 ## 别的品类里,有意义的单位是什么 洗涤剂只是最早被写进法条的那一个。类似的错位在很多品类里都存在。 品类 | 法定分母 | 买家心里的分母 | 两者为什么不一致 | 挂耳与咖啡豆 | 每千克 | 每杯 | 粉水比不同,同样重量冲出来的杯数差得远 | 洗衣液与凝珠 | 每升或每千克 | 每次洗涤 | 浓缩倍数不同,单次用量差好几倍 | 膳食补充剂 | 每千克或每片 | 每日剂量 | 每日建议服用量从一片到六片不等 | 墙面涂料 | 每升 | 每平方米 | 遮盖力和涂布率差异很大 | 打印耗材 | 每件 | 每页 | 页产量是这个品类唯一的通用尺子 | 宠物主粮 | 每千克 | 每天喂一只狗的成本 | 能量密度不同,日投喂量不同 | 这张表最有用的地方,是它把一个模糊的直觉变成了一条可执行的判断:只要这个品类的商品之间存在“一份用多少”的差异,法定单位就一定不够用。 ## 渠道字段装不下“每次”这个单位 问题在于,这个更有意义的单位,在下游几乎没有位置放。 Google商品数据里unit_pricing_measure支持的单位分几组:重量、体积、长度、面积,另外还有一组按件计的——ct表示计数,sheet表示张,item表示件。打印纸按张能表达,纸巾按张能表达,胶囊按粒也能凑合。 但“每次洗涤”、“每杯”、“每日剂量”这几个,一个都没有对应的单位代码。你想在渠道里表达“这瓶洗衣液每次洗涤0.21欧元”,做不到。这不是配置问题,是字段的取值范围里就没有这个东西。 ## 词表能装下,但只能降一级装 结构化数据这边稍微宽松些,但也只是稍微。UnitPriceSpecification里的unitCode要填UN/CEFACT通用代码,那套代码表里同样没有“次”。 剩下的路只有unitText,一个纯文本字段。你可以写per wash,也可以写每次洗涤,词表不会拦你。但一旦落进自由文本,这个值就退出了可计算的世界——没有机器会去比较两个字符串代表的单位是不是同一个。 这里有个很值得记住的规律:一个单位越贴近用户的真实使用场景,它越可能是这个品类独有的;越是品类独有,它越不可能有标准代码;越没有标准代码,它越只能以文本形式存在。可比较和有意义,在数据层面天然互斥。这一点和正文越本地化、结构化数据越要写回国际格式 (https://zhangwenbao.com/minor-language-structured-data-inlanguage-locale-schema.html)是同一个张力的两种长相。 ## 所以答案是两个都显示,而且有主次 既然一个负责合规与横向比价、一个负责说服,那就别让它们抢同一个位置。 法定那个必须在,必须清晰可读,必须按目标市场的规则算。有意义那个作为补充,紧挨着它,用更小的字号。英国的价格标示令第7条第4款把这个次序写死了:单位价格必须占主导,补充数量单位的价格所用字符不得大于单位价格。其他市场虽然没有明文,按这个次序做也不会错。 版式上有个小技巧:把两个数写成一行,中间用一个隔断,“每升8.40欧元 · 每次洗涤0.21欧元”。一行里读完,用户自己就完成了从合规口径到使用口径的换算,而这个换算原本要占掉他好几秒。 ## 那个有意义的数,是引擎算不出来的 这里有一个对可见性很关键的推论。法定单位价格,任何一个抓到你页面的引擎都能自己算——它有价格,它能从标题或规格里刮到含量,一次除法就出来了。 但“每次洗涤多少钱”这个数,引擎算不出来。它需要知道这瓶洗衣液一次该用多少毫升,而这个数只写在你的产品说明里,写在标签上,写在你的客服话术里。它是一个只有你才有的私有事实。 这意味着,在所有跟价格相关的信息里,使用口径的单位成本是最难被替代、也最容易被引用的那一个。电商查询意图的模式覆盖 (https://zhangwenbao.com/geo-consumer-intent-10-pattern-coverage-guide.html)里,价值型比较是出现频率最高的那一类查询,而这类查询的答案,恰恰卡在这个只有商家自己给得出的数上。 ## 补充装是这类商品唯一不用嘴说的卖点 做日化和家清的都知道,补充装和替换装是最难讲清楚价值的一类商品。你说它环保,买家半信半疑;你说它省钱,他得自己去算。 而单位价格恰好把这句话从形容词变成了数字。原装500毫升6.90欧元,补充装1升9.90欧元,两个数摆在那儿谁便宜要想一下;写成每升13.80欧元对每升9.90欧元,一秒钟就完了。 更妙的是这个论证不需要你说任何一句话。你只是把两个数按同一个分母摆出来,结论是买家自己得出的。所有由买家自己得出的结论,都比你写在文案里的那句更结实。 ## 把用量说明做成一页公开的、能被引用的内容 很多站把用量信息塞在商品详情的折叠区里,或者干脆只印在包装上。这是把一份稀缺资产藏起来了。 更好的做法是给它一个正经位置:一页讲清楚这个品类怎么用、一次用多少、不同水质或不同场景要怎么调整、按这个用量折算下来每次多少钱。这一页可以被收录、被引用、被拿去回答问题,而商品卡片上那个小字则从这一页取数,保证两处口径一致。 它还有一个附带好处:写这一页会逼你把每个商品的建议用量都补齐。而建议用量这个字段,和净含量一样,多半也躺在某个没人认领的角落里。把内容当结构化数据来生产 (https://zhangwenbao.com/content-engineering-structured-content-ai-search.html)说的就是这件事——先把事实补齐,再谈怎么呈现。 ## 这个数字摆在列表项的什么位置才不添乱? 版式、主次、移动端、变体合并、套装、排序,逐个说清楚,也说清楚哪几种做法是白做。 ## 主次关系:总价抢眼,单位价格安静 源研究给的排版结论 (https://baymard.com/blog/price-per-unit)很朴素:总价应当被设计得清晰突出,单位价格则应当被设计成不压过列表项里的其他信息、但需要它的用户能轻松找到。 这条和欧盟指令第4条第1款并不冲突。条文要求的是明确、易辨认、清晰可读,不是要求它跟总价一样大。两边说的其实是同一件事:够找得到,别喧宾夺主。 研究里也有正面样本。有零售商在卫生纸的列表价下面直接给出每卷多少钱,有站把每1千克多少钱放在总价旁边,还有站把每单位价格做得比总价低调一档但仍然一眼可见。三种做法的共同点是,两个数在同一个视觉块里,不用移动视线去别处找。 ## 位置:得在商品描述的近旁 英国的价格标示令第7条第1款把位置写成了规则:标示应给在商品旁边;就远程合同和广告而言,给在商品的视觉或文字描述的近旁;并且应当放在消费者无须向商家求助就能获知的位置。 这三句话对线上的翻译是:单位价格要在商品卡片里,不能只在详情页;在详情页里要在价格区,不能只在最下面那张规格表里;不能藏在需要展开的折叠块里。 最后一条尤其值得留意。折进标签页和手风琴的内容 (https://zhangwenbao.com/hidden-content-tabs-accordions-seo.html)在搜索层面上算不算数,一直有讨论空间;但在价格标示这件事上,法规的态度要明确得多——需要用户主动去点开才能看到的东西,够不着“无须求助即可获知”这个标准。 ## 移动端只有那么几行,怎么排 桌面端的商品卡片通常放得下四五行,移动端两列布局的卡片经常只有三行:图、标题、价格。往里塞第四个元素是有代价的。 比较可行的做法是把单位价格和总价合并到同一行,用一个小一号的字号跟在总价后面,中间加一个间隔符。这样它不占新行,视觉上又归在价格这个信息组里。 不建议做的是把它挪到卡片底部靠近加购按钮的地方。那个区域是行动区,用户在那儿的注意力是准备点击,不是准备比较。比较发生在他的目光横向扫过一排卡片的时候,所以这个数必须待在价格旁边。 ## 变体合并之后,显示的是哪个变体的单位价格 这是实现层面最容易出错的一处,而且错了很难看出来。 Baymard的变体合并研究 (https://baymard.com/blog/combine-variations-one-list-item)观察到,把同一商品的多个变体拆成多个列表项会带来两类严重的可用性问题:列表被同款不同色刷屏,以及变体散落在列表各处导致用户找不全。基准测试里仍有12%的站没有做合并。 做了合并的站,卡片上只剩一个价格位,通常显示的是起售价。那么问题来了:如果这个商品有250毫升和1升两个规格,卡片上显示的是250毫升那个的价格,单位价格就必须也是250毫升那个变体的。分子和分母必须来自同一个SKU,这句话听着像废话,但只要价格和含量是两条独立的取数路径,它就一定会在某个分支上被破坏。 ## 套装和组合装:先把里面有什么写清楚 Baymard在家居家具方向的套装内容物研究 (https://baymard.com/blog/include-contents-quantities-list-item-sets-bundles)里发现,用户在列表页看到套装商品时,常常判断不出里面到底包含哪些东西、每样几件,只能点进详情页去确认,而很多站在列表项里根本没给这个信息。 这件事和单位价格是一根链条上的两环。你连套装里有几件都没写,那个按总量算出来的单位价格对用户来说就是一个没有来源的数。他没法验证,也就没法信任。 所以顺序是:先在列表项里写清内容物与数量,再给单位价格。反过来做,用户看到的是一个凭空出现的数字。 ## 列表项该放什么,本来就是一道减法题 值得放在这里提一句的是,Baymard的基准数据显示有50%的站在列表项信息上没找到那个平衡——要么缺关键属性让用户没法判断,要么堆得太满。 单位价格是往这个已经很拥挤的空间里再加一个元素,所以它必须换掉某个东西,而不是叠加上去。多数站可以拿去换的是那些通用得没有信息量的标签:畅销、热卖、新品这一类。 判断标准很简单:这个元素能不能帮用户决定要不要点进去。单位价格能,“店长推荐”不能。产品页对齐机器理解逻辑 (https://zhangwenbao.com/ai-ready-product-page-optimization.html)的那一套思路,在列表项上同样成立,只是空间更紧张,取舍更狠。 ## 四种看着做了、其实没做的做法 第一种:只在详情页给单位价格,列表页不给。比较发生在列表页,这等于把功能建在了用不上的地方。 第二种:只给部分品类。通常是那些数据齐全的品类,也就是本来就不太需要的那些;数据缺的品类一律不显示,而那正是用户最需要帮忙算的地方。 第三种:单位写成看不懂的缩写。源研究里就记录过一个 €0.22 per 1UNI的例子,形式上有,实际上没人知道1UNI是什么。这在“明确无歧义”那条上是站不住的。 第四种:促销期间单位价格消失或者不更新。促销正是用户比价最密集的时段,这时候掉链子,前面所有工作等于白做。 ## 按尺寸裁切和分级定价的品类要另算 有两类商品的单位价格逻辑跟标准预包装不一样,值得单独说一下。 第一类是按长度或面积卖的:线缆、布料、地板、墙纸。这类商品在欧盟指令的定义里更接近散装——总价要等消费者说出要多少才算得出来,所以第3条第3款那条“散装只需标单位价格”是适用的。页面上的主角本来就该是每米或每平方米多少钱,总价跟着数量输入框动。 第二类是有分级定价的批发场景。买1件、10件、100件是三个价,那单位价格该按哪一档显示?我的做法是跟着当前展示的那一档走,并在阶梯表里把每一档的单位价格都列出来。分级定价与报价协商 (https://zhangwenbao.com/magento-2-b2b-company-account-shared-catalog-tier-pricing-negotiable-quote-operations.html)那一套配置里,这张阶梯表本来就存在,只是很少有人给它加一列。 ## 按单位价格排序,是这份数据唯一的高价值下游用途 把单位价格做出来之后,最容易想到的下一步是给排序菜单加一项“按单位价格从低到高”。这个功能确实值钱——它是唯一一个能让用户一眼看到真实性价比排序的入口,类目页的排序与筛选机制 (https://zhangwenbao.com/ecommerce-plp-collection-page-seo-mechanism-complete-guide.html)里很少有哪一项能给出这么直接的价值判断。 但它有一个硬前提:覆盖率必须接近满。只要有一批商品没有含量数据,排序就会把它们系统性地堆到一端,形成一个稳定的偏见——要么它们永远排最后,等于被隐藏;要么按空值排最前,等于被推荐。两种都糟。 所以这个功能的正确上线顺序是:先补数据,再上排序,且只在覆盖率达标的品类里开放。至于把单位价格做成筛选维度,我一般不建议——用户心里没有“每升5到10欧元”这种区间概念,这个筛选值几乎没人点。筛选条件的回显与总览 (https://zhangwenbao.com/shopify-collection-applied-filters-overview-ux.html)再做得好,也救不回一个用户根本不会去用的维度。 ## 一个正则表达式的默认值,怎么变成了德国站的合规风险 我自己的一次失手。数据没错,代码没错,两个各自合理的默认值撞在一起,出了一个只朝一个方向偏的错。 ## 那个站是做什么的 出海做家庭清洁与洗护耗材,洗衣液、洗衣凝珠、餐具洗涤浓缩液、多用途清洁剂,外加一整条补充装产品线。主力市场是德国和法国,商品数一千出头。 这个品类的生意结构很特殊(同期我们刚统一完品牌声音体系 (https://zhangwenbao.com/dtc-brand-voice-tone-of-voice-system.html),产品页和客服的口径是对得上的):首购看重的是味道和成分,复购看重的是划不划算。所以单位价格这件事在这里不是锦上添花,它就是复购决策本身。 触发我们做这件事的是两条客服工单。德国买家问:你们这瓶浓缩的到底比普通装省不省?我们当时的回答是让客服手算了一遍发给他。第二次再被问到的时候,我意识到这个算术应该由页面来做。 ## 动手之前,先撞上了那个熟悉的问题 排期评估的第一天就卡住了:后台里净含量这个字段,全站覆盖率六成多一点。补录一千个SKU,运营估了两周。 而商品标题里几乎每一条都写着规格。技术同学提了个方案:写个解析器从标题里刮,两天就能上,覆盖率能到九成五以上。 我同意了。现在回头看,那个决定的实质是:用两天换两周,代价是把一个没有治理的字段,变成了一个看起来有治理的字段。数据库里从此躺着一列干干净净的数字,谁也看不出它是从一串营销文案里刮下来的。 ## 头三个月,数据好得不像话 上线之后浓缩产品线的表现非常亮眼。加购率涨了三成多,品类页停留时长上去了,那两条客服工单代表的问题彻底消失。 我在月报里写了一句话,大意是单位价格的引入让浓缩线的性价比优势第一次被用户直观感知到。这句话当时听着很有道理,事后看每一个字都需要打问号。 于是我们顺理成章地加码:浓缩线拿到了品类页首屏的固定位置,进了邮件推荐模块,联盟客素材包也重做了一版,主打的就是性价比。 ## 第四个月,一封德语的信 发信的是一家律所,代表一家德国同行。文件里附了三张我们德国站的商品页截图,指出的问题是基础价格标示不实,依据是价格标示条例,配套主张的是不正当竞争。 核对花了不到二十分钟。我们那款主力浓缩洗涤液,德语标题写的是“浓缩液500毫升(相当于2升)”。解析器抓到的是括号里那个2升。 售价8.99欧元。按法定分母,也就是包装上那个500毫升,单位价格应该是每升17.98欧元。页面上显示的是每升4.50欧元。差4倍。 ## 为什么这个错误特别难被发现 因为它给出的商业结论,碰巧是对的。 标准款1升装卖5.99欧元,也就是每升5.99欧元。错误显示下,浓缩装每升4.50欧元,看起来比标准款便宜——而浓缩装确实是更划算的选择。方向是对的,只是理由错了,数字也是违法的。 正确显示出来是什么样呢?浓缩装每升17.98欧元,标准款每升5.99欧元,浓缩装是标准款的3倍。一个我们花了很多力气去主推的产品,在自己的品类页上变成了最贵的那一个。 ## 三条没早发现的原因 第一条:我们给这个功能写了二十多个测试用例,全部在验价格除以数量等不等于预期值。除法当然不会错,所以这些用例永远是绿的。没有任何一条用例问过:这个数量是从哪儿来的。验收清单是照着我们写了什么代码列的,不是照着这个数字应该怎么来列的。 第二条也是我觉得最值得写下来的一条。解析器取最后一个匹配到的数量,这是一个纯技术的默认值,写的时候完全合理。德语营销文案习惯把等效量放在括号里写在后面,这是一个纯营销的书写习惯,同样完全合理。两个各自都站得住的默认值撞在一起,合成了一个系统性的价格偏差——而且它只朝一个方向偏,因为等效量永远大于净含量,分母永远偏大,单位价格永远偏低。 第三条:这个错误会主动生产支持自己的证据。它让主推线看起来最便宜,销量就涨;销量涨了,我们给它更多曝光位;曝光多了,销量继续涨。四个月里这条产品线所有的数字都在说这个决定做对了,而真正能证伪它的人不在我们团队里。这跟我以前那次绿色标签的教训 (https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html)表面上有点像,但内核不同:那次错在一个概念从来没有定义,这次每一个概念都定义得很清楚,错的是两个正确默认值的组合。 ## 真正的代价不是罚款 很多人以为这类事的成本是被监管机构罚钱。在德国不是这样。这条赛道上最活跃的执行主体是竞争对手和行业协会,路径是发警告函,要求你签一份附带违约金的停止侵害承诺。 直接支出是律所费用,数额不算吓人。真正的成本在那份承诺书上:签下去之后,同一类问题再犯一次,就不再是重新走一遍程序,而是直接触发约定的违约金。 换句话说,这一签,我们把一个可以慢慢改的技术债,变成了一份有金额、有触发条件的合同义务。这才是这件事最贵的地方,也是我后来做跨境合规相关排期时优先级最高的判据。同样的道理在礼品订单的跨境链路 (https://zhangwenbao.com/gift-order-flow-cross-border-recipient-separation.html)上也成立:页面上一句话的承诺,兑现它的可能是三个你管不到的系统。 ## 改了三处 第一处,含量字段从一个自由文本拆成了结构化的三段:数值、单位、以及一个布尔位,标记这个数是不是稀释后的等效量。新品不填这三段不允许上架。标题解析器没有删掉,但降级成了一个提示工具——它只负责生成待补录清单,不再直接进渲染管线。 第二处,把分母做成了一张按市场加品类的映射表,代码里禁止出现写死的千克和升。德国那一行按价格标示条例第5条第5款,额外多了一列每次洗涤,作为法定单位之外的补充显示,而不是替代。 第三处最土,但事后看是三处里最值钱的:每次价格或含量变更,系统把新旧单位价格的比值打出来,偏离1超过阈值就转人工确认。因为错误的单位价格看起来永远是合理的,唯一能让它露馅的,是拿它跟它自己的历史比。 ## 把它救回来的不是改数字,是换分母 改完之后,浓缩线的单位价格从品类里最低变成了品类里最高,加购率两周内回落到上线之前的水平。这在意料之中,那三成多的增长本来就是靠一个错误的数字撑起来的。 真正把它救回来的是第二处改动里那一列附加单位。浓缩装一次用20毫升,一瓶500毫升能洗25次,折下来每次0.36欧元;标准款一次用75毫升,一瓶1升能洗13次多一点,每次约0.45欧元。按这个口径,浓缩装便宜两成。 同一件商品,同一个售价,换一个分母,从品类里最贵变成品类里最便宜,而两个数字都是对的,也都是合法的。这句话是这整篇文章的浓缩版。 还有一个我没预料到的收益:客服工单里“你们浓缩装怎么这么贵”这一类问题,在那一列上线之后基本消失了。之前我们靠文案去解释的东西,现在由一个数字自己完成了。跨境退货的预防体系 (https://zhangwenbao.com/cross-border-ecommerce-reduce-return-rate-prevention.html)里有一条同样的逻辑——把期望和事实的差距在下单之前就抹平,比事后补救便宜得多。 ## 从哪一步开始做,这件事才不会做成一次性项目? 四周路径、十六项自查、三条反信号,外加一段该写在帮助中心里的公共答案。 ## 第一周:一行代码都别改 这一周只干一件事,出三张清单。 第一张是覆盖率清单:按品类统计有多少商品填了净含量、填了的里面有多少同时有合法单位、这些单位一共有几种写法。第二张是来源清单:这些值分别来自供应商资料、标题解析还是人工录入,各占多少。第三张是市场清单(顺带把商品站点地图的分片口径 (https://zhangwenbao.com/ecommerce-product-sitemap-strategy-sharding-lastmod-image-index.html)也核一遍,两边用的应该是同一套市场划分):你在哪些国家有面向消费者的页面,每个国家的法定分母规则是什么。 三张清单出完,你会发现排期的重点跟一开始想的完全不一样。多数团队原本以为这是个前端任务,看完清单会明白它主要是个数据任务。 ## 第二周:把那张分母映射表写出来 四列:市场、品类、法定基准单位、附加单位。前三列填法规,第四列填这个品类里买家真正在意的口径,填不出来就空着,空着不丢人。 然后定一条规则并写进文档:第三列的值不允许被任何代码逻辑覆盖,第四列只能作为补充显示且字号更小。这条规则的价值在于,它把未来所有关于“要不要按某个更好懂的单位显示”的争论提前终结了——两个都显示,主次固定。 这周还要做一件小事:给含量字段找一个明确的责任人,把名字写在表上。这个动作的成本是零,效果比后面所有技术手段加起来都大。 ## 第三周:只在一个品类上线,带快照对比 挑一个覆盖率最高、规格差异最明显的品类先上。别一次铺全站,因为你需要一个能够仔细核对的样本量。 上线的同时把快照脚本跑起来:渲染结果里抓出每个商品的总价、含量、单位价格,落成一张表,人工抽三十条对着商品图上的包装标示核一遍。这三十条核完,你对整个数据源的信心程度会有一个非常真实的判断。 同一周里把品类内的离群检测也加上:同一个品类同一个规格档位里,单位价格显著偏离中位数的商品自动进人工队列。这条规则能抓住绝大多数分母错误,而且不需要任何外部数据。它和给零流量商品做体检 (https://zhangwenbao.com/zombie-sku-revival-performance-max.html)可以合成同一份周报,两者盯的都是目录里没人看的角落。 ## 第四周:铺开,并补上附加单位 确认第一个品类稳定之后再铺开,铺的顺序按覆盖率从高到低走,覆盖率不达标的品类先补数据再上线,不要为了“全站都有”而让一半商品显示空白。 附加单位这一列建议放在第四周而不是第一周。原因是它需要建议用量数据,而那个字段通常比净含量还缺。先把法定的那份做扎实,附加的那份可以按品类分批补。 四周结束时,你手里应该有的东西是:一张有人负责的映射表、一份能长期跑的快照对比脚本、一条离群检测规则,以及一个明确的上线门槛。这四样加起来,才是把它从一次性项目变成一项能力的分界线。想验证它到底带来了什么,先把测量框架 (https://zhangwenbao.com/measurement-framework-before-ga4-setup.html)定清楚再去看数,别急着埋点。 ## 上线前的十六项自查 - 列表页卡片上有单位价格,不只是详情页有 - 单位价格和总价在同一个视觉块里,不需要移动视线去找 - 总价比单位价格醒目,但单位价格清晰可读 - 单位写全,没有出现自造缩写 - 分母来自包装标示的净含量,不是毛重、不是等效量、不是箱规 - 需要标示沥干重的品类,分母用的是沥干重 - 每个市场按各自的法定基准单位显示,代码里没有写死的单位 - 多件装的总量与单件量都在卡片上写清楚了 - 变体合并后,显示的价格和显示的含量来自同一个SKU - 促销期间单位价格跟着现价重算,且没有消失 - 划线价旁边没有第二个单位价格 - 提交给渠道的基准量取的是该渠道支持的合法值 - 结构化数据里的参考数量和页面显示的口径一致 - 附加单位存在时,字号不大于法定单位价格 - 没有含量数据的商品显示空白,而不是显示一个错误的数 - 按单位价格排序只在覆盖率达标的品类里开放 这十六条里,第五条和第九条是最容易出事的两条,也是复盘那一节里我实际踩过的两个坑。 ## 三条反信号 第一条:单位价格的分布里出现了明显的双峰。同一个品类里一批商品的单位价格集中在某个值附近,另一批集中在它的几分之一处,那多半不是选品差异,是两批商品的分母口径不一样。 第二条:某个商品在按总价排序和按单位价格排序里的位次差异极大,且它不是大包装。这通常意味着它的含量字段有问题,而不是它真的性价比逆天。 第三条:单位价格上线之后某条产品线的数据涨得特别好,好到超出你的预期。这一条是我自己的教训——涨得意料之外地好,第一反应应该是去核对数据,而不是去做加码排期。 ## 引擎被问到哪个更划算的时候,会拿到什么 这里要分成两种情况说,因为它们的风险完全不同。 你的页面上没有单位价格的时候,引擎不会因此就不回答。它会拿它抓到的价格和它能从标题或规格区刮到的含量,自己做那次除法。也就是说,它会重现一遍你在复盘那一节里看到的整个过程,包括那个抓错数字的可能。 你的页面上有一个错误的单位价格的时候,情况更糟:引擎会直接采信。它不会去质疑一个看起来像是商家自己计算过的数字,而这个数字会被带进比较、带进推荐、带进它给别人的答案里。挑源机制里那条关于定价页解析的观察 (https://zhangwenbao.com/chatgpt-source-selection-network-traffic-fields.html)说明了一件事:模型对价格类信息的处理是有专门路径的,不是随便读读。集合页在AI购物里的位置 (https://zhangwenbao.com/shopify-collection-page-geo-ai-shopping.html)也印证了这一点,比较类问题的答案多半是从列表页上取的。 ## 那份公共答案该写在哪儿 商品卡片上那个小字是个性化的——它只回答“这一件多少钱一升”。而用户在看完它之后仍然会有的问题,是公共的:你们的基础价格按什么算、浓缩产品按哪个体积算、多件装按整包还是按单件算、促销时那个数是按现价还是原价。 这几个问题的答案应该有一个固定的公开位置,通常是帮助中心里的一页,或者品类页上的一段口径说明。写法可以很朴素:“德国站的基础价格按每升计算;浓缩类产品按瓶身标示的净含量计算,不按稀释后的体积;多件装按包装内商品总量计算。” 这三句话是别人写不出来的,因为它描述的是你自己的口径。它同时解决了三件事:给引擎一段可以直接引用的定义,给买家一个可核对的依据,给你自己的团队一份不会被改来改去的标准。产品描述的七项信号体检 (https://zhangwenbao.com/geo-ecommerce-optimizer-7-signal-audit-guide.html)里,口径类说明是最容易被漏掉、也最容易补上的一项。让内容被答案引擎优先引用 (https://zhangwenbao.com/aeo-answer-engine-optimization-guide.html)这件事上,这类只有你才有的口径说明,性价比高得离谱。 ## 最后一句 单位价格这件事的难度,从来不在那次除法上。它难在你得先承认,商品卡片上有一个数字,它的可靠性完全依赖一个从来没有人认领的字段。 把那个字段找到主人,剩下的都是工程问题。而在跨境这个语境里,找不找得到那个主人,决定的不只是转化率,还有一封信会不会在某个周二早上从德国寄过来。 ## 常见问题解答 ## 我只做美国市场,还需要显示单位价格吗? 法律上不需要,商业上很值得。美国联邦层面没有一部像欧盟98/6/EC那样的通用强制规定,单位价格标示主要靠部分州和地方的规则以及零售业惯例,各州差异不小。 但源研究给出的那个数字值得注意:86%的电商站没有为不同规格的商品提供单位价格,而这个缺失会导致用户错过更划算的商品、误判性价比,甚至直接放弃购买。测试里反复出现的场景是受试者停在列表页上心算,算不动就只比较少数几件,剩下的全部跳过。 换句话说,在美国市场这是一个转化率优化项,投入产出自己判断;在欧盟英国这些市场它是义务,没有判断空间。如果你计划未来开欧洲站,那不如现在就按义务的标准去建数据,省得到时候返工。 ## 浓缩类产品的单位价格,能不能按稀释之后的体积算? 不能。98/6/EC第4条第2款写得很明确:单位价格应参照依照国家与共同体规定所申报的数量。申报的数量就是包装上印的净含量,不是你算出来的等效量。 这条规则在实操里最容易被绕过,因为营销文案通常会把等效量写得很显眼,“500毫升相当于2升”这种句式在浓缩品类里几乎是标配。一旦你的系统从标题里取数,抓到的很可能就是那个更大的数,而结果是单位价格被系统性地做低。 正确做法是把等效量当成一个独立的营销信息去展示,比如放在商品描述里或者卖点区,但绝不让它进入单位价格的计算。如果你想给买家一个更贴近使用的成本口径,走附加单位那条路——在法定单位价格旁边多给一个每次使用多少钱,字号更小。 ## 促销打折的时候,单位价格该按现价还是划线价算? 按现价。指令对单位价格的定义是最终价格除以基准量,最终价格就是消费者实际要付的那个数,所以促销一生效,单位价格必须跟着重算。 需要额外注意的是划线价那一侧。2019/2161给98/6/EC加进来的第6a条要求,任何降价公告都要标示前价,而前价是降价前至少30天内的最低价,不是你价目表里的原价。C-330/23号判决进一步明确:以百分比形式宣布的降价,或者以突出优惠性质的促销措辞宣布的降价,都必须以那个前价为基准来确定。 实现上要小心的是,绝大多数系统里“原价”是一个静态字段,“前价”是一个需要查价格历史才能算出来的动态值。这两个字段长得太像,很容易被顺手混用。建议在促销上线前后各抓一次渲染快照对比,比事后核对文档可靠得多。 ## 六罐装的饮料,分母该用单罐容量还是包装总量? 取决于里面那六罐是不是打算单独销售的规格。2007/45/EC第5条第1款规定,两个或以上独立预包装构成多件装时,标称量适用于每一个独立预包装;第2款则规定,如果里面那些包装并不打算单独销售,标称量适用于整个预包装。 落到页面上,我的建议是两个数都给:卡片上写清“6罐 × 330毫升”,单位价格按总量1980毫升折算成每升多少钱。这样用户既知道里面是什么,又拿到了那个能横向比价的数。 技术上要盯的是商品建模。多件装通常是一个独立的SKU,如果它的含量字段是从单罐商品继承过来的,那分母就会小6倍,单位价格会高得离谱。这类错误在按单位价格排序的时候会立刻暴露——它会稳定地排在最贵的那一端。 ## 某个商品的净含量字段是空的,页面上该显示什么? 显示空白,什么都不写。不要猜,不要按品类均值填,也不要临时从标题里刮一个数出来救场。 理由是错误的单位价格比缺失的单位价格代价更高。缺失的时候,用户知道这个信息没有,他会自己去算或者干脆换一件;错误的时候,他会直接采信一个假数字,而这个数字还会被写进你的结构化数据、传给渠道、被答案引擎读走。 更重要的是,显示空白会让缺口留在页面上,运营看得见,从而形成补数据的压力。用一个猜出来的数把空白填上,等于把问题藏起来了——覆盖率报表上会显示九成五,实际可信的可能只有六成。这也是我最不建议直接用标题解析结果进渲染管线的原因。 ## 提交给渠道的基准量和我站上显示的不一样,会有问题吗? 不一定有问题,但你得知道哪一边是有法律后果的那一边。 Google商品数据的unit_pricing_base_measure文档里明确写着,为了让同一页面上所有广告和免费商品列表更可比,实际展示出来的基准量可能与你提交的不同。而它支持的整数只有1、10、100、2、4、8六个,另加75cl、750ml、50kg、1000kg四种组合,所以有些法定分母你根本没法在渠道里精确表达。 结论是分工要清楚:法定义务只能在你自己的商品页上兑现,那一层的分母必须严格按目标市场的规则来;渠道那一层尽量贴近,表达不了就选最接近的合法值。真正要避免的是反过来——为了让渠道那边好填,而把自己站上的分母改成一个不合法的值。 ## 权威参考资料 ## 广告法违禁词检测把本店销量最好标成高风险,而这句话是执法指南里的例外 - URL:https://zhangwenbao.com/ad-word-checker-exception-overlap-falsepositive-guide.html - 分类:DTC合规与法务 - 发布:2026-07-25 | 更新:2026-07-25 - 摘要:从自带示例里那句被判成高风险的自我比较表述入手,逐条量出例外识别、重叠仲裁、误报漏报三处边界,说明这份检测结果该当初筛用而不能当终审的原因。 - 关键词:广告法,电商运营,退款 > **TLDR**:摘要:这款工具的自带示例里有一句"本店销量最好的一款"。它被标成了高风险。而在同一个页面往下滚三屏,工具自己的使用说明里,这句话被当作《广告绝对化用语执法指南》例外情形的举例写着。同一个页面,同一句话,上面判违规,下面说没事。矛盾的根子不在词库选得好不好,在于例外情形是用固定短语硬记下来的:认得"本店最",认不得"本店销量最"。这篇把这条边界、以及词库匹配衍生出的误报与漏报逐条量出来,并说明这份结果该怎么用、不该怎么用。 > 摘要:这款工具的自带示例里有一句"本店销量最好的一款"。它被标成了高风险。而在同一个页面往下滚三屏,工具自己的使用说明里,这句话被当作《广告绝对化用语执法指南》例外情形的举例写着。同一个页面,同一句话,上面判违规,下面说没事。 矛盾的根子不在词库选得好不好,在于例外情形是用固定短语硬记下来的:认得"本店最",认不得"本店销量最"。这篇把这条边界、以及词库匹配衍生出的误报与漏报逐条量出来,并说明这份结果该怎么用、不该怎么用。 做电商和独立站的人,多半都听过那个数字:一个"最"字,罚二十万起。《广告法》第五十七条对违反第九条的处罚确实写着二十万元以上一百万元以下,情节严重的还能吊销执照。于是详情页文案改了又改,谁也不敢写得太满。 各种极限词检测工具就是这么火起来的。保哥也做了一款广告法违禁词检测 (https://zhangwenbao.com/tools/ad-word-checker.php),粘贴文案,标出风险词,附上法条和改写建议。这篇不讲怎么点按钮,讲的是这类工具在什么地方会骗你——包括我自己这款。 ## 点一下自带示例,它给自己判了多少分? 工具里有个加载示例按钮,塞进去的是一段148字的典型违规文案。这段文案是作者亲手写的,用来演示各类风险词,某种意义上是一份标准答案。 ## 结果先摆出来 跑完之后统计条给的是:高风险14处、中风险7处、可能属例外1处,去重合并后列出22条明细。命中的词从"最低价""国家免检""行业第一"一路排到"仅此一天""错过再等一年",覆盖面确实够宽。 大部分判得对。"国家免检"这个词早在2008年9月就随着食品质量免检制度一起被废止了,现在还在文案里用它,本身就构成虚假宣传。"三天见效""无效退款""无任何副作用"这几条属于典型的功效承诺。"排毒""消炎""杀菌"落在《广告法》第十七条禁止的疾病治疗功能表述里。这些都没有争议。 ## 问题出在最后一句 示例文案的最后一句是这么写的:本店销量最好的一款,最多可容纳三人使用,最长保质期十二个月。 这一句里塞了三个"最"字,而且是刻意塞的——它们对应的正是《广告绝对化用语执法指南》里的三类例外情形,用来演示工具能识别例外。跑完之后的结果是这样: 示例里的表述 | 工具判定 | 应对的例外情形 | 本店销量最好的一款 | 高风险 | 同一企业商品自我比较 | 最多可容纳三人使用 | 可能属例外 | 商品使用方法与数量 | 最长保质期十二个月 | 完全没有命中 | 商品使用时限 | 三处演示,一处判对,一处判反,还有一处它根本没看见。而这三句是作者为了展示"我能识别例外"专门写进去的。 ## 为什么说这是硬伤 把工具页面往下滚三屏,使用说明里有一节专门讲例外情形,里面白纸黑字举着例子:仅表示同一品牌或同一经营者商品自身比较的,比如"本店销量最好的一款"。 也就是说,同一个页面上,上半部分的工具把这句话标成高风险,下半部分的文档说这句话属于例外。这不是词库收得不够全的问题,这是实现和文档对同一句话给出了相反的结论。 ## 例外情形到底是怎么识别的? 要理解上面那个矛盾,得看它是怎么认"例外"的。答案比想象中朴素:靠背短语。 ## 可能属例外这一档,一共只有十个词 词库里标成"可能属例外"的条目全部列出来,就这么十条:最先、最初、最早、最多可、最长可、最少、最大努力、最好的服务、本店最、本品牌最。 它们不是语义规则,是十个固定的字符串。文案里出现这十个串中的任意一个,就提示例外;出现不了,就按普通词处理。 ## 差一个字,结论就翻过来 我做了几组只差一两个字的对照,结果非常整齐: 输入 | 命中的词 | 判定 | 本店最好的一款 | 本店最 | 可能属例外 | 本店销量最好的一款 | 最好 | 高风险 | 我们以最好的服务对待客户 | 最好的服务 | 可能属例外 | 我们以最优质的服务对待客户 | 最优 | 高风险 | 最多可容纳三人 | 最多可 | 可能属例外 | 最多容纳三人 | 无 | 没有命中 | 最长可保质十二个月 | 最长可 | 可能属例外 | 最长保质期十二个月 | 无 | 没有命中 | 规律清楚得刺眼:句子的性质完全没变,变的只是有没有凑上那十个字符串之一。"本店销量最好"和"本店最好"在法律意义上是同一件事,都是拿自家商品跟自家商品比;在这款工具眼里,一个高风险一个属例外。 ## 这个做法能不能修 能改进,但没法根治,这一点要说实话。 我可以把"本店销量最"也加进词表,把"最长保质期"补上,但这是在填一口填不满的井。中文里表达"自家跟自家比"的说法有无数种:本店、本品牌、本系列、我们家、这个系列里、同款中,再乘以各种插入语。硬编码短语的覆盖率永远追不上真实语言。 真要做对,需要的是判断这个"最"字指向的比较范围是什么,而那已经是语义分析的活儿,不是一个纯浏览器的词库工具该承诺的能力。所以我没有去扩词表——与其让它看起来更聪明,不如让你清楚它到底有多笨。 ## 指南里的例外,比工具文档写的还多 顺着这条线我把《广告绝对化用语执法指南》的原文重读了一遍,发现工具的使用说明其实是个压缩版。 指南第五条列了三类情形:仅表明服务态度、经营理念、企业文化、主观愿望的;仅表达目标追求的;与推销商品性能、质量无直接关联且不误导消费者的。第六条又列了六类:同一品牌或同一企业商品自我比较的;仅用于消费提示的;依据国家标准、行业标准、地方标准中含有绝对化用语能说明依据的;商品名称、规格型号、注册商标或专利中含有绝对化用语的;依据国家评定的奖项、称号中含有绝对化用语的;限定具体时间、地域条件下表述客观情况或事实信息的。 加起来九类。工具的文档把它们归纳成了五条,而词表里那十个字符串,实际能沾上边的只有其中三四类。像"商品名称、规格型号、注册商标里含有绝对化用语"这一类——你的注册商标就叫"最佳拍档"——工具没有任何办法识别,它只会老老实实给你标红。 ## 五个类别各自在管什么? 工具把词库分成五类,每类可以单独开关。这五类不是随手划的,各自对应着不同的法条,理解这个对应关系比记住具体哪些词有用得多。 ## 绝对化用语:罚单里出现频率最高的一类 对应《广告法》第九条第三项,也就是那句"使用国家级、最高级、最佳等用语"。执法实践中,同类含义的词一并适用——最好、第一、顶级、极致、首选、独家、唯一、冠军、领先、之最,都在射程内。 这一类是五类里唯一带例外档的,也是词最多的,74个占了词库四成。原因不难理解:公开处罚案例里,因为详情页写了"全网最低价""行业第一"被罚的商家,每年都有。 ## 国家机关与权威名义:想不到会踩的一类 对应第九条第二项,不得使用或者变相使用国家机关、国家机关工作人员的名义或者形象。国家免检、特供、专供、政府指定这些词在这一档。 容易被忽略的是"驰名商标"。按现行《商标法》的规定,生产经营者不得将驰名商标字样用于商品、商品包装或者容器上,也不得用于广告宣传、展览以及其他商业活动,违反的由负责商标执法的部门责令改正并处罚款。这跟广告法是两部法。工具把它收在国家权威这一类里,标注的法条对不上,但提示本身是必要的。 这里还藏着一个更普遍的问题:法条编号本身是会变的。驰名商标这一条,在2019年版商标法里是第十四条,2026年修订之后移到了第六十四条,内容没变位置变了。任何把法条编号写死在词库里的工具,都会随着法律修订慢慢过期。看到工具给的条号,最好还是回原文核一眼。 ## 虚假承诺与数据:门槛在能不能兑现 对应第二十八条,商品的性能、功能、产地、用途、质量、规格、成分、价格等信息与实际情况不符,对购买行为有实质性影响的,构成虚假广告。 这一类的判断标准跟别的类不同:不是词本身有问题,是你能不能兑现。"无效退款"如果你真的无条件退,那它就是一句承诺不是虚假宣传;"100%有效"如果有完整的检测报告支撑,性质也不一样。词库看不见你的证据,只能一律提示。 ## 疾病治疗与功效宣称:食品和日用品的高危区 对应第十七条,除医疗、药品、医疗器械广告外,其他任何广告不得涉及疾病治疗功能,也不得使用医疗用语或者易使推销的商品与药品、医疗器械相混淆的用语。 做食品、化妆品、保健用品的要格外注意这一档。消炎、杀菌、排毒、抗癌这类词在这些品类的文案里是典型违规,而不少运营写的时候完全没意识到——因为日常口语里这些词太常用了。抑菌率、修复细胞、活血化瘀这几个也在词库里。 ## 其他高风险表述:迷信、绝对承诺与限时话术 对应第九条第八项、第九项等,转运、招财、辟邪这类迷信内容,以及包过、包上岸、包就业这类教育培训领域的绝对承诺。 这一类里还收了限时限量的话术:仅此一天、最后一天、倒计时、错过再等一年。这些词本身不违法,但如果你的"仅此一天"每天都在挂着,那就成了虚假促销。工具的改写建议里写得很清楚:限时限量类表述必须与实际活动一致,并保留可核查的活动记录。 ## 两个词撞在一起,它保留哪一个? 这是我在这款工具里找到的最反直觉的一处,也是最值得单独讲的一处。 ## 一个词吃掉另一个词 先看两组单独测试:输入"全网最低价",命中"最低价",判高风险;输入"史上最低",命中"史上最低",判中风险。都对。 然后把它们拼起来,输入"史上最低价"。按常理,这个表述比前两个都更过分,应该至少和最严的那个一样严。实测结果是:高风险0处,中风险1处,只报了"史上最低",那个高风险的"最低价"连一次出现次数都没记上。 ## 原因在仲裁规则 两个词在文本里重叠了。"史上最低"从第0个字开始占四个字,"最低价"从第2个字开始占三个字,中间那两个字被两边都要。工具的处理办法是:按起始位置排序,位置靠前的先占坑,后面凡是跟已占区域重叠的,全部丢弃。 "史上最低"起始位置更靠前,它赢了。风险等级在这个仲裁过程里完全没有参与。 顺带说,同一个起始位置上的竞争它处理得是对的:起点相同时保留更长的那个词,所以"最好的服务"能盖过"最好"、"最先进"能盖过"最先"。真正的漏洞只出现在起点不同而区域重叠的情况。 ## 实际影响有多大 我把词库里所有互为子串的词对数了一遍,一共14对。其中大部分是同类同级的包含关系,仲裁结果无所谓。真正会翻车的是"前面那个词等级更低"的组合,"史上最低价"就是活生生一例。 这个坑的性质值得琢磨:它不是漏报一个不重要的词,而是文案写得越夸张,报出来的风险反而越轻。老老实实写"最低价"报高风险,前面加上"史上"两个字,反倒降成了中风险。这跟工具存在的目的正好相反。 ## 哪些命中是虚惊,哪些漏报会让人放心得太早? 词库匹配的本质是子串查找,它不认词、不认句子、不认上下文。这带来两个方向的偏差。 ## 误报:短词的杀伤范围 词库里有75个两字词,两个字在中文里太容易撞车了。几组实测: - 输入"这句话不一定成立",命中"一定",中风险。而"不一定"的意思跟"一定"正好相反 - 输入"帮助你一夜好眠",命中"一夜",高风险。词库收"一夜"是为了防"一夜见效"那类承诺 - 输入"赞助了冠军联赛",命中"冠军",中风险 这类误报没什么好办法躲,你只能自己判断。好在方向是安全的——多提示总比漏提示强。 不过要提醒一句:误报多了会有副作用。一份报告里如果三分之一的命中都是虚惊,人就会开始整批整批地跳过,真正该看的那几条也一起被跳过去了。这是所有告警类工具的通病,不是这一款独有的。我的做法是先按等级过一遍高风险,中风险留到最后扫,实在拿不准的单独记下来问法务。 ## 长词误报少,但也有 四字以上的词精准度明显高,"国家免检""行业第一""无效退款"这类基本不会误伤。但也不是完全没有——"权威机构"这个词,在"该结论已经权威机构复核"这样的句子里其实是正常表述,工具照样标中风险。 判断的诀窍是看这个词有没有指向你的商品。指向商品的绝对化表述才是第九条第三项管的事,泛泛地说"权威机构复核过"和宣称"本品经权威机构认证",性质完全不同,但工具只看见了那四个字。 ## 漏报:换个字符就隐身 这个方向更值得警惕。输入半角写法的"100%有效的方案",命中高风险;把它换成全角字符的写法,同样一句话,零命中。 词库里存的是半角百分号,全角的百分号在字符层面是另一个字符,子串匹配对不上。同理,中间插一个空格、插一个圆点、拆成图片里的文字,都能让检测失效。 这一点决定了这类工具的定位:它能帮你发现自己没意识到的问题,但拦不住存心绕过它的人。所以千万别把"检测通过"当成"文案安全"的证明——尤其别把它当成给客户或者给老板的验收依据。 ## 一个有意思的对照 我顺手把《广告法》第九条第三项的条文原文粘了进去,那句话是"使用国家级、最高级、最佳等用语"。结果三个词全部命中高风险。 法律条文在禁止这些词,工具判定条文本身违规。这当然是个玩笑式的结果,但它把"词库匹配没有语境"这件事演示得比任何解释都清楚。 更有意思的是反过来的一组:我把工具自己的免责声明整段粘进去,零命中;再把使用说明里列举违禁词的那一句粘进去,7处高风险3处中风险。这两个结果放在一起看,大概能让人明白这份报告到底在测量什么——它测的是字符串,不是意思。 ## 那句免责声明为什么能全身而过 零命中这个结果其实有点出人意料,因为那段话里有"最终以市场监管部门认定为准"这样的表述。我特意查了一下,"最终"这个词不在词库里,"一定"在,但那段话里恰好没出现。 换一句话就不一样了。输入"这句话不一定成立",命中"一定",中风险。中文里"不一定"含着"一定"两个字,子串查找不管前面那个否定词。所以免责声明躲过一劫,多少有点运气成分。 ## 顺手拿自己写的句子试了试 我挑了几句自己写文章时的口头禅丢进去,比如"这是唯一的判断标准,也是目前领先的做法,可以参考权威解读"。一句话里报出1处高风险2处中风险——唯一、领先、权威三个词全中。都是误报,但也提醒了我一件事:做内容的人写自己的稿子时,同样会不自觉地用上这些词。写商品文案时提着一口气避开,写博客时就放松了。 严格来说博客正文不算商业广告,风险等级完全不同。但如果你的文章里带着商品链接、带着自家产品的推荐,性质就模糊了。这条边界我建议按保守的来处理,写SEO文案的那套方法 (https://zhangwenbao.com/seo-copywriting-tips.html)里也一直强调用具体事实代替形容词,两边的要求正好一致。 ## 法条标注对不对?我修了两处 对一款法务向的工具来说,法条引用错了比词库不全严重得多。写这篇的时候我把每一条标注都对着原文核了一遍,查出两处需要更正。 ## 国家机关名义那条 工具原来的标注写的是"《广告法》第九条第一、二项:不得使用或变相使用国家机关、国家机关工作人员的名义或形象"。 核对原文,第九条第一项管的是国旗、国歌、国徽、军旗、军歌、军徽,跟国家机关名义是两回事;第二项才是"使用或者变相使用国家机关、国家机关工作人员的名义或者形象"。多带上一个第一项,属于引用不准。已改为第九条第二项。 ## 其他高风险那条 原来标注的是"第九条第六至八项等:不得含有淫秽迷信暴力内容,不得含有民族、种族、宗教、性别歧视内容"。 核对下来,含有淫秽、色情、赌博、迷信、恐怖、暴力内容的是第八项,含有民族、种族、宗教、性别歧视内容的是第九项。而第六项讲的是危害人身财产安全、泄露个人隐私,第七项讲的是妨碍社会公共秩序或者违背社会良好风尚,都不是标注里写的那回事。已改为第九条第八、九项,表述也照原文补全了。 ## 核对过的其余几条都是准的 把好的一面也说清楚。第十七条关于疾病治疗功能与医疗用语的表述、第二十八条关于虚假广告的界定、第五十七条二十万元以上一百万元以下并可吊销执照的罚则,逐条对下来都没有问题。使用说明里"国家免检制度2008年已废止"这条也核实无误。 顺便说一句,这次核对同时纠正了我自己的一个误判。我一度以为工具文档把执法指南的例外情形归纳错了,去读原文才发现,指南列的是九类、文档归纳成五类,是压缩不是出错。引规范之前必须真的把原文读一遍,凭印象写的法条细节,是这类内容最容易翻车的地方。 ## 这份词库到底有多大? 把词库整个解析了一遍,数据摆出来,你心里对它的能力边界会有个尺度。 ## 五类,184个词 类别 | 高风险 | 中风险 | 可能属例外 | 小计 | 绝对化用语 | 46 | 18 | 10 | 74 | 国家机关与权威名义 | 16 | 7 | 0 | 23 | 虚假承诺与数据 | 20 | 14 | 0 | 34 | 疾病治疗与功效宣称 | 21 | 14 | 0 | 35 | 其他高风险表述 | 10 | 8 | 0 | 18 | 合计 | 113 | 61 | 10 | 184 | 一眼能看出来的第一件事:可能属例外这一档只存在于绝对化用语类,其余四类一个都没有。这是有道理的,执法指南本来就是专门针对绝对化用语的,功效宣称类没有对应的例外规则。但你在用的时候要清楚:另外四类的命中,工具不会给你任何"这可能没事"的余地。 ## 词长分布与零重复 184个词里,两字词75个、三字词30个、四字词67个,剩下的是五到八字的长词。两字词占了四成,前面说的误报大多来自这一批。 一个正面的发现是:跨类别的重复词一个都没有。184个词全部唯一,没有出现同一个词同时挂在两个类别、或者同时标成两个等级的情况。词库维护得挺干净,这在手写词表里不常见。 ## 七万字要跑多久 拿一段7.2万字符的文案实测,从点击到结果渲染完成用了95毫秒。全部逻辑是184次全文子串扫描加一次排序,纯浏览器完成,文案不上传服务器。未发布的活动稿件拿来跑不用担心泄露。 ## 明细里那两行上下文是干什么的 每条命中下面会给一到两段上下文,把那个词放回原句里显示。窗口是固定的:命中词前后各取16个字符,最多显示两处出现位置。 这个设计挺实用,因为判断一处命中是不是误报,几乎完全取决于上下文。但要注意最多两处这个限制:如果同一个词在长文案里出现了十次,你只能在明细里看到前两处,剩下八处得回到上面的高亮预览里自己找。高亮预览把每一处都标了色,那才是逐处核对的地方。 ## 三个数字之外还有一个字数格 统计条一共四格:高风险、中风险、可能属例外,加上文案字数。前三个数的是去重合并前的命中处数,也就是说同一个词出现三次会算三处,跟下面明细里"出现3次"是对得上的。 ## 还有两处使用上的细节 一是改了类别开关不会自动重跑。取消勾选某一类之后,屏幕上的统计数字纹丝不动,必须再点一次检测按钮才会更新,界面上没有任何提示。别被上一次的结果误导。 二是文案字数那一格数的是字符不是汉字。它取的是字符串长度,一个表情符号会被算成两个。粘一段带表情的社媒文案进去,这个数字会偏大。这个口径问题在处理表情符号的场景里挺常见,我在Emoji表情生成器那篇 (https://zhangwenbao.com/emoji-generator-search-charcount-utf8mb4-cross-device-guide.html)里专门量过一次,同一个表情能数出四种长度。 ⚖ 动手试试:广告法违禁词检测 粘贴商品标题、详情页或落地页文案,按绝对化用语、国家权威、虚假承诺、功效宣称等类别逐处标出风险,附上对应法条与合规改写方向,并提示可能属于执法指南例外的用法。纯浏览器处理,文案不上传。 保哥自研免费在线工具,浏览器打开就能用。 → 打开广告法违禁词检测 (https://zhangwenbao.com/tools/ad-word-checker.php) ## 这份检测结果,该怎么用? 讲完了所有的坑,最后说说怎么把它用在正地方。我的建议是把它当成一份待核查清单,而不是一份判决书。 ## 红色不等于违法,绿色更不等于安全 这句话工具自己的免责声明里也写着,但值得再说一遍,因为多数人只看统计数字。 命中不等于违法:是否构成违规要看广告整体、行业属性和具体语境,认定权在市场监管部门。没命中也不等于安全:词库覆盖不了行业专项规定,判断不了内容真实性,还能被全角字符轻松绕过。 更实际的一条是:它完全判断不了真实性。你写"销量第一",如果真有第三方权威数据支撑并且注明了出处口径,性质和凭空吹是两回事;工具看不见你的证据,只能一律标红。 ## 把改写方向当成写作提示 每条命中下面都给了改写方向,那部分的实用价值其实高于风险等级本身。核心思路只有一条:把不可举证的断言换成可举证的具体事实。 "效果最好"换成具体的参数对比,"全网最低"换成"活动期间直降300元","第一品牌"换成带出处和统计时间的第三方数据。这么改完之后,文案不只是合规了,说服力通常还更强——具体数字本来就比形容词有力。这也是详情页文案的通用功夫,产品详情页那套做唯一内容的方法 (https://zhangwenbao.com/product-detail-page-onpage-seo-unique-content-engineering.html)里讲的是同一件事。 ## 跨境卖家别以为这事跟自己无关 做外贸和独立站的人常有个误解:面向海外销售就不受国内广告法约束。但只要广告在中国境内发布——国内平台投放、写给中国用户看的中文落地页、发在国内社媒的推广内容、招商页、代理商政策——都在监管范围内。 反过来,目标市场也有各自的规矩。美国FTC对功效宣称有事前证据的要求,广告主必须在发布之前就持有合理依据;欧盟对食品健康声称的管理更严,声称必须落在获批清单里。所以中英文两套素材要按各自的规则分别过一遍,简单互译是不行的。 ## 重要文案该送审就送审 最后这条最重要:这款工具、以及市面上所有同类工具,都不是法律意见。大额投放的素材、行业属于医疗药品保健食品教育培训房地产金融理财的、以及任何你自己心里没底的文案,该找法务找法务,该走专业审核走专业审核。 词库工具的位置很清楚:它是初筛,帮你在送审之前把明显的问题捞掉,省下往返沟通的时间。把它放在这个位置上,它很好用;把它当终审,迟早要出事。 ## 例外情形要能拿出依据 这一条常被误读,得单独说。执法指南列出例外情形,不等于你说一句"这属于例外"就没事了。指南里明确写着,属于例外情形但广告主无法证明其真实性的,仍然依照《广告法》有关规定查处。 换成大白话:说自家销量最好,得拿得出自家的销售数据;说依据国家标准评定,得有那份评定文件;说注册商标里本来就带绝对化用语,得有商标注册证。举证责任在你这边。工具那句"可能属例外"提示的是可能性,不是免死金牌。 ## 把检测记录留下来 这条是流程建议。大促这类批量出稿的场景,文案改了好几轮,最后谁也说不清哪一版发出去了。我的做法是每一轮定稿都跑一次检测,把统计结果和明细截图跟稿件存在一起。 真出了问题,这份记录能证明你尽到了审核义务;没出问题,它也是下一次做同类活动时的参照。这跟做邮件营销时留存用户同意记录 (https://zhangwenbao.com/dtc-email-list-building-lead-magnet-double-optin-compliance.html)是同一个思路——合规这件事,做过和能证明做过,是两回事。 ## 词库会滞后,这是没办法的事 执法口径会随着新规和典型案例调整,任何静态词库都会落在后面。2023年那份执法指南出来之后,"销量第一"这类表述的认定就比之前宽松了一些——指南明确了限定具体时间、地域条件下表述客观事实的情形一般不适用。 所以别把某一款工具的词库当成权威清单。它反映的是编写那一刻的理解,而合规是个持续跟进的事,不是一次性通关。 ## 顺手把稿子的格式也过一遍 合规检查完,文案通常还要过一道排版关——半角标点、直角引号、中英文空格这些。这两件事都属于发布前的最后一公里,放在同一个环节做效率最高,具体做法可以看中文排版规范化工具那篇 (https://zhangwenbao.com/chinese-typography-punctuation-paren-diff-panel-guide.html)里记的边界。 ## 常见问题解答 ## 命中了就一定违法吗? 不一定。工具做的是词库匹配,是否构成违法要看广告整体、行业属性和具体语境,最终认定权在市场监管部门。它判断不了内容真实性,也覆盖不了行业专项规定,只能当初筛用。 ## 为什么本店销量最好被判成高风险? 因为例外情形是用固定短语识别的。词表里有本店最这个串,没有本店销量最,于是这句话只命中了绝对化用语里的最好,按高风险处理。而《广告绝对化用语执法指南》第六条把同一品牌或同一企业商品自我比较列为例外情形。这属于工具的能力边界,遇到这类表述需要自己判断,必要时准备好自家的销售数据作为依据。 ## 可能属例外这一档一共有多少词? 十个:最先、最初、最早、最多可、最长可、最少、最大努力、最好的服务、本店最、本品牌最。而且这一档只存在于绝对化用语类别,国家权威、虚假承诺、功效宣称、其他风险这四类没有例外提示。 ## 为什么史上最低价只报了中风险? 两个词在文本里重叠了,工具按起始位置先到先得,位置靠前的史上最低占住了区域,后面重叠的最低价被整个丢弃,连出现次数都不计。风险等级没有参与这个仲裁。所以重叠位置报出来的等级可能偏低,看到相邻的高风险表述时值得手动多看一眼。 ## 把百分号换成全角能绕过检测吗? 能。词库存的是半角字符,全角百分号在字符层面是另一个字符,子串匹配对不上,同一句话会变成零命中。中间插空格、插圆点、做成图片文字也一样。这说明检测通过不等于文案安全,工具能帮你发现没意识到的问题,拦不住存心绕过的做法。 ## 违反广告法第九条罚多少? 《广告法》第五十七条规定,由市场监督管理部门责令停止发布广告,对广告主处二十万元以上一百万元以下罚款,情节严重的并可以吊销营业执照。另需说明,《广告绝对化用语执法指南》第九条、第十条也规定了初次使用、危害后果轻微并及时改正等情形下可以或者应当不予行政处罚。 ## 为什么国家免检是高风险词? 国家免检制度在2008年9月已经废止,当时国家质检总局停止实行食品类生产企业国家免检,相关管理办法一并废止。现在还用这个词本身就构成虚假宣传,同时涉及禁止使用国家机关名义的规定。 ## 做跨境电商也受国内广告法约束吗? 只要广告在中国境内发布就适用,包括国内平台投放、中文落地页、国内社媒推广内容、招商页与代理商政策。目标市场另有规则,美国FTC要求功效宣称在发布前就持有合理依据,欧盟对食品健康声称要求落在获批清单内,中英文两套文案要按各自规则分别过一遍。 ## 权威参考资料 ## 商品页写环保材质没人管的日子快结束了,欧盟9月27日起要你拿证据 - URL:https://zhangwenbao.com/green-claims-evidence-product-page-eu-rules.html - 分类:DTC合规与法务 - 发布:2026-06-17 | 更新:2026-06-17 - 摘要:欧盟新规2026年9月27日起适用,商品页上的环保形容词从此要能举证。本文按主张、范围、证据三层拆解可持续声明的写法,给出五条禁令对照、认证标签三档分法与形容词改写模板,并说明为什么同一次改写既能过合规,也能提高被AI引用的概率。 - 关键词:结构化数据,独立站,电商 > **TLDR**:摘要:欧盟那份简称EmpCo的指令(Directive (EU) 2024/825)已经过了成员国的转化期限,2026年9月27日起正式适用。它把四类做法直接写进了黑名单,其中两类几乎每个出海独立站都在做:孤零零一个“环保”“绿色”当卖点,以及给整件产品贴一个只有包装才配得上的标。这篇拆的是同一件事的两面——把形容词改写成带范围、带证据、带时效的事实句,你躲开的是罚单,顺手拿到的是生成式引擎唯一肯引用的那种句子。 > 摘要:欧盟那份简称EmpCo的指令(Directive (EU) 2024/825)已经过了成员国的转化期限,2026年9月27日起正式适用。它把四类做法直接写进了黑名单,其中两类几乎每个出海独立站都在做:孤零零一个“环保”“绿色”当卖点,以及给整件产品贴一个只有包装才配得上的标。这篇拆的是同一件事的两面——把形容词改写成带范围、带证据、带时效的事实句,你躲开的是罚单,顺手拿到的是生成式引擎唯一肯引用的那种句子。 ## 为什么写“环保”这两个字的成本,忽然变高了? 先把三件撞在同一年的事摆出来,它们各自都不算大,叠在一起才是新局面。 ## 三件事撞在了同一年,单看哪一件都不算大 做独立站的人对“环保”这两个字的感觉,这几年变化挺大。前些年写上去没坏处,不写也没人问;现在它更像一句需要备案的话。 变化不是某天突然发生的,是三条线在2026年撞到了一起。第一条是欧盟那份指令进入适用期,泛用的环保形容词从“随便写”变成“写了要能证明”。第二条是平台侧,可持续属性正在从一段自由文案变成一个有类型、有取值范围的字段。第三条更安静:生成式引擎开始大量替用户回答“这个牌子的东西到底环不环保”,而它挑得出的句子 (https://zhangwenbao.com/ai-search-citation-content-types-geo-strategy.html),跟合规审查挑得出的句子,长得一模一样。 单独看每一条都不至于让人调整做法:欧盟离我远、字段而已慢慢填、AI引用是玄学。但三条叠在一起,指向同一个动作:把商品页上那些漂亮的形容词,换成能被追问的事实句。这篇文章从头到尾就干这一件事。 ## 转化期限上个季度就过了,现在是缓冲期不是观望期 时间线值得单独说,因为很多人对“欧盟又出新规”已经麻木,默认它离落地还有好几年。这次不是。 指令要求成员国在2026年3月27日之前把它写进本国法律并公布,这个期限已经过去了,真正开始适用的日子是2026年9月27日。也就是说各国条文基本已经成型而执法还没启动——中间这三个多月,就是你手上全部的余量。 这个节奏其实很友好,不像有些规则那样公布即生效。它给了你一个季度去做一件本来就该做的事。出海站上一次这么大规模地按外部规则改页面,还是同意横幅 (https://zhangwenbao.com/seo-legal-compliance-gdpr-ccpa-consent-mode-cross-border-architecture.html)那一轮的事。但它也很不客气:期限之后再改,性质就从“主动整改”变成了“被投诉后整改”,这两件事在监管眼里、在客户眼里、在联盟客眼里都不是一回事。 ## 欧盟自己数过一遍:一半以上的绿色声明经不起看 你可能会怀疑这套规则是不是小题大做。欧盟委员会推动绿色声明立法时公布过一组数据,可以当成对整个市场的体检报告读。 数字是这样的:53%的绿色声明提供的是模糊、误导或没有依据的信息 (https://environment.ec.europa.eu/topics/circular-economy/green-claims_en),40%的声明完全拿不出支撑证据,一半的绿色标签验证机制薄弱甚至根本不存在。另外还有一个数字更能说明混乱程度:欧盟境内有230个可持续标签和100个绿色能源标签在同时流通,透明度参差不齐。 230这个数字最扎心。它意味着买家在你的商品页上看到一个绿色小图标时,大概率没见过它、也无从判断它值不值钱。而当一个符号既无法被识别又无法被验证,它在页面上就只剩下装饰功能——你花钱做的认证,和隔壁那个花五分钟在Canva上画的标,在用户眼里是同一个东西。这才是这套规则真正想解决的问题:不是禁止你说环保,是让说了真话的人能被区分出来。 ## 平台那边,可持续属性正在从文案变成字段 另一条线在技术侧,动静小但方向很清楚。 Schema.org在词汇表里加了Certification这个类型,专门用来描述“一份认证”。它要求填的东西包括发证机构、认证编号、当前状态是有效还是失效、上次审核日期、到期日、以及在哪些地区有效。挂载点是商品对象上的hasCertification属性。这一组字段几乎就是一份合规问卷的机器可读版。 Shopify那边把它做成了元字段,商品属性可以定义类型和取值范围;WooCommerce靠属性分类;Magento有更重的EAV体系,属性、属性集、作用域一层层来。三套系统的做法不同,但都在往同一个方向走:把“这件商品有什么环保属性”从一段文案,变成一条有结构、可查询、可筛选、可导出的数据。 当标准委员会和电商平台都开始为这类信息设计字段,说明它们判断这类信息以后要被机器读、被机器比、被机器引用,而不只是给人看一眼。 ## 先划清边界:这跟网页本身的碳排放不是一回事 说到“可持续”,站内已经有一篇讲得比较透,先把边界划清楚免得读串。 那篇讲的是网页自身的碳足迹和抓取经济学 (https://zhangwenbao.com/sustainable-low-carbon-seo-web-performance-crawl-economics.html)——页面多大、请求多少次、爬虫来一趟消耗多少资源,主角是你的网站这个技术产物。这篇讲的是你卖的东西身上的环保属性怎么对外表达,主角是商品和你说的那句话。两者只在一个地方擦边:那篇里有个观点是绿色徽章和碳计算器对排名没有直接作用,这篇会把它推进一步——徽章对排名没用,但徽章的举证材料对能不能被引用有用,而这两件事被很多人混为一谈了。 另外一篇容易混的是包装与开箱体验那篇 (https://zhangwenbao.com/dtc-packaging-unboxing-experience-retention-ugc.html)。那篇里有一节专门问“可持续包装是真需求还是营销噱头”,讨论的是包装这个实物该用什么材料、值不值得投钱。这篇不碰材料决策,只管一件事:你已经用了某种材料,那句话该怎么写在页面上才站得住。实物层归那篇,信息层归这篇。 ## 这篇文章要解决的,是三个很具体的问题 把范围收窄一点,免得写成政策解读。我想解决的是下面三个天天遇到的问题。 第一,商品页上那句现成的环保文案能不能留?不能的话改成什么样才算过关?这需要一个能拿着对照的判据,而不是“建议谨慎表述”这种废话。第二,你手上那几个认证标,哪些是资产、哪些是负债?花钱买的和自己画的,在新规则下待遇完全不同,得有个分档办法。第三,这套改造做完之后,除了不挨罚,还能换回来什么?如果答案只有“不挨罚”,那这件事在公司内部大概率排不上优先级,得有一个更硬的理由。 三个问题的答案分别在后面的第三节、第四节和第九节。中间那几节是把它们撑起来的地基。你要是时间紧,先跳到第二节把那个三层结构看完,其余的读起来会快很多。 ## 一条可持续声明拆开看,只有三个部件在真正干活 这一节是全篇的地基:主张、范围、证据,缺哪一个会出什么事,一个个说清楚。 ## 先拿一句真实文案下刀,看它能拆出几块 随便找一句独立站上常见的:“我们采用环保材质,践行可持续发展。”这句话读起来没毛病,写进商品页也不违和,很多品牌的关于我们页第一段就长这样。 但你试着扮演较真的买家追问三句:环保在哪儿?说的是整件商品还是其中一部分?谁验证过?三句问完,这段文案基本就空了。它有情绪、有立场,唯独没有一个可以被核对的点。 我后来习惯把任何一条可持续声明按这三问拆成三块:主张、范围、证据。这不是什么理论框架,只是把追问的顺序固定下来。好处是它能立刻告诉你缺什么——你写的那句话,缺的往往不是文采,是后面两块压根没写。 ## 第一层是主张:你到底在说哪一件好事 主张就是你想让买家记住的那个好处。麻烦在于,大部分品牌停在了形容词上。 形容词的问题不是不好听,是不承载信息。“环保”这个词可以指用了回收料,可以指少用了水,可以指工厂用绿电,可以指包装能降解,也可以指公司捐了钱。五种含义在同一个词底下,买家自己脑补一个,你自己心里想的是另一个,两边都觉得沟通完成了。 好的主张长什么样?它是一个能被证伪的陈述句。“外箱由回收纸浆制成”是主张,“环保包装”不是。“染色环节不使用偶氮染料”是主张,“绿色工艺”不是。判断方法特别土:把这句话交给一个跟你毫无关系的人,问他能不能设计一个检查动作去验证它。设计得出来就是主张,设计不出来就是形容词。 ## 第二层是范围:这句话管到哪儿为止 范围是三层里最少人写的一层,也最容易出事。 一件商品有很多部分,一次生产有很多环节。你的那句好话,究竟覆盖了多少?外箱是回收料,内衬呢?棉是有机的,缝纫线呢?干线运输买了绿电,末端派送呢?这些追问听着抬杠,却恰恰是执法和投诉的落点——法条把这类做法单独列了一条禁令:拿只涉及局部的事实,去做覆盖整件商品的声明。 法条里给的官方例子干净利落:一件商品打上“采用回收材料制成”,让人以为整件都是回收料,实际上只有包装是。这个例子我第一次读的时候心里咯噔一下,因为这几乎是所有品牌的默认写法——不是有意骗人,是写文案的人手里只有“包装用了回收料”这一条信息,而他要填的那个位置叫“产品卖点”。位置逼着他把范围放大了。 范围写清楚会不会显得没那么厉害?会。但它换来的是这句话可以被引用、可以被复述、可以在被质疑时原样重复一遍。一句可以原样重复的话,比一句需要临时解释的话值钱得多。 ## 第三层是证据:谁替你背书,到什么时候为止 证据这一层回答两个问题:谁说的,说到什么时候。 第一个是发证方。你自己测的、供应商口头说的、第三方机构现场审的,三者分量差着量级。第二个问题更容易被漏掉:认证是有期限的。一份2024年发的证书,到2026年可能已经过期,而页面上那个图标还挂了两年——它现在不是资产,是一个正在等待被人发现的问题。 还有个隐藏的第三问:这份证据在哪儿能查。真正扎实的做法是把认证编号写出来。编号这个东西很有意思,它本身不说明产品好坏,但它把“信不信我”变成了“你去查”,一句话就把举证责任转移成了可执行的动作。绝大多数买家永远不会真的去查,可正因为你敢让他去查,这句话的可信度就不一样了。 ## 三层齐了长什么样:一张改写对照表 把三层拼起来,效果是这样的。左边是常见写法,右边是补齐三层之后的写法,中间标出补的是哪一层。 常见写法 | 缺哪一层 | 补齐之后 | 环保包装 | 主张、范围、证据全缺 | 外箱与内衬均由消费后回收纸浆制成,回收料占比不低于80% | 有机棉T恤 | 缺范围 | 面料含95%认证有机棉,其余5%为弹性纤维;缝纫线与标签不在认证范围内 | 碳中和配送 | 缺范围、证据,且用词踩红线 | 德国境内末端派送由承运商的电动车队完成,干线段仍为常规运输 | 通过环保认证 | 缺证据主体 | 已获GOTS认证,证书编号XXXXXX,由认证机构签发,有效期至2027年3月 | 可持续面料 | 主张是形容词 | 面料由回收聚酯纤维制成,每米约相当于回收11只500毫升塑料瓶 | 无害化生产 | 主张无法证伪 | 染色环节不使用偶氮染料,成品经限用物质清单检测 | 你会发现右边那栏读起来一点都不性感,甚至有点像说明书。这是必然的——所有能被验证的句子,读起来都像说明书。而你要争取的那两类读者,一类是监管,一类是机器,两边恰好都只认说明书。 ## 缺哪一层,会分别出什么事 三层不是同等重要,缺不同的层翻车方式完全不同。 缺主张,也就是只有形容词,后果是最直接的:新规则下它本身就是被点名的做法,而且它在生成式引擎那里等于零信息量,不会被摘出来当答案。缺范围,是最贵的一种,因为它通常不会立刻出事,会安静地待着,直到某个较真的买家、某个竞争对手、或者某个消费者组织把它翻出来,那时候这句话已经被索引、被转述、被联盟客写进测评了。缺证据,翻车方式是慢性的:没人立刻质疑你,但你的声明始终无法进入任何一个需要引用来源的场景,等于花了成本做了改进,却拿不到对应的信任。 ## 这三层不是我编的,标准委员会已经把它做成字段了 如果你觉得这个三层结构像事后总结的框架,我给你一个更硬的旁证。 Schema.org里有个叫Certification的类型,用来在网页上描述一份认证。看看它要求填哪些字段:issuedBy记发证机构、certificationIdentification记认证编号并明确说明这个编号可以用来查证、auditDate记上次审核日期、expires记到期日、validIn记有效地域、certificationStatus记当前是有效还是失效 (https://schema.org/Certification)。它挂在商品对象的hasCertification属性下面。 把这组字段翻回中文看:谁发的、编号多少、什么时候审的、什么时候到期、在哪儿有效、现在还算不算数。这不就是我上面说的证据层加范围层吗?一群制定词汇标准的人,在完全不考虑欧盟指令的前提下,独立推导出了同一份清单。两拨人从两个方向走到同一个地方,通常说明这个地方不是谁的偏好,是事情本身的形状。站内有一篇讲结构化数据对AI搜索到底有没有用 (https://zhangwenbao.com/schema-markup-ai-search-truth.html),可以配着看;想知道自己页面上现在都有哪些字段、缺了什么,扒一遍结构化数据 (https://zhangwenbao.com/schema-extractor-structured-data-audit-guide.html)就清楚了。 ## 哪些词从9月27日起不能孤零零挂在商品页上? 欧盟把禁用清单写进了法条正文,这里逐条对照到独立站的真实文案上。 ## 法条不长,真正管着商品页的就五条 这份指令的正文还是法律文书那副样子,但对独立站的杀伤力集中在附件里——它往欧盟原有的不公平商业行为黑名单上插进了几条新的,跟卖货直接相关的有五条: - 第2a条:展示一个不基于认证方案、也不是公共机构设立的可持续标签。 - 第4a条:做出泛用环境声明,而你拿不出与该声明相关的公认卓越环境表现。 - 第4b条:对整件商品或整个企业做环境声明,而实际上只涉及商品的某个方面或企业的某项具体活动。 - 第4c条:基于温室气体抵消,宣称一件商品在温室气体方面具有中性、减少或正面的影响。 - 第10a条:把欧盟市场上该品类所有产品都必须满足的法定要求,当成自家产品的独特卖点。 黑名单这个位置很关键:列进去的做法不需要个案论证是否误导了消费者,在所有情形下都禁止。这跟“可能构成误导,需结合具体情况判断”是两个严厉程度。 ## 泛用环保声明:官方点名了一串词 第4a条里的“泛用环境声明”不是留给执法者发挥的模糊概念,法条正文直接给了例子清单。翻成中文大致是:环境友好、生态友好、绿色、大自然之友、生态的、环境正确、气候友好、对环境温和、碳友好、节能、可生物降解、生物基,以及任何暗示或造成卓越环境表现印象的类似表述。 看到这串词的第一反应通常是:那还能写什么?答案在定义里。法条对“泛用环境声明”的定义是——没有出现在可持续标签上,且没有在同一媒介上以清晰显著的方式给出限定说明的环境声明。关键在后半句:不是这些词不能用,是它们不能孤零零地用。 你把限定说明写在同一个位置,它就不再是泛用声明。写在另一个页面、藏在折叠区、放进底部小字,都不算“同一媒介、清晰显著”。这条对独立站的实际含义是:商品页上那个绿色小徽章,旁边必须跟着一句人话,而不是一个链接。 ## 官方自己给了一对例句,值得抄下来贴在工位上 法条里有一对对照例句,是我读完全篇觉得最有用的东西,它把抽象规则变成了可直接模仿的句式。 原文的意思是:“气候友好包装”属于泛用声明,而“生产这份包装所用能源100%来自可再生能源”属于具体声明,后者不落入这条禁令 (https://eur-lex.europa.eu/eli/dir/2024/825/oj)。 两句话讲的是同一件事,差别只在第二句回答了“凭什么”。它没更长也没更专业,只是把结论换成了依据。我建议把这一对句子当模板用:先写下你想说的那个形容词,然后逼自己回答一句“因为什么”,把答案留下、把形容词删掉。这个动作听起来简单,实际做的时候你会发现,有相当一部分形容词后面根本接不出“因为”——那些就是你原本就不该说的话。 ## 可持续、负责任、有良知:这三个词更难救 法条里还藏着一个细节,很多解读都漏了,但它对做品牌的人杀伤力最大。 大意是:企业不能仅仅靠公认的卓越环境表现,去支撑“有良知”“可持续”“负责任”这类声明,因为这些词除了环境属性之外还涉及社会属性。也就是说,哪怕你真的拿到了欧盟生态标签,那也只能支撑环境维度的说法;你要说自己“可持续”,还得同时对得起劳工、供应链、社会责任那一堆维度。 这条为什么要紧?因为“可持续”恰恰是中文品牌最爱用的词——听起来比“环保”高级、比“绿色”正式,很多人把它当安全牌,结果它的举证难度是最高那一档。真要用,只有一条路:把它降级成栏目名或者页面标题,别把它当成对某件具体商品的声明。 ## 碳中和这一类:基于抵消的说法被全面关死 第4c条力度最大,也最容易被中国卖家踩到:“碳中和”在国内语境里是个正面词,很多人不知道它在欧盟商品页上已属高压线。 法条把这类禁用表述也列了出来:气候中性、经认证的二氧化碳中和、碳正向、气候净零、气候补偿、降低气候影响、有限碳足迹。禁的理由写得很清楚——这类说法基于购买抵消额度,而抵消发生在产品价值链之外,与产品本身的实际生命周期影响不是一回事,消费者却会以为你说的是产品本身。 注意它没禁止你做碳抵消,也没禁止你宣传自己投资了环境项目,禁的是把价值链外的抵消翻译成对这件商品的环境评价。这两件事的界线,就是你那句话的主语是谁:主语是公司、说的是投资行为,可以;主语是这件商品、说的是它的影响,不行。 ## 最容易被忽略的一条:把法定义务当卖点 第10a条几乎没人讨论,命中的场景却特别常见。 它禁止的是:把该品类所有产品在欧盟市场上都必须满足的法定要求,包装成你家的独特卖点。举几个独立站上天天见的例子——玩具页面上写“符合欧盟安全标准”当作卖点,化妆品写“不含被禁用成分”,电子产品把CE标志当成品质认证来讲,纺织品把成分标注说成透明度承诺。这些要么是法律强制、要么是入市前提,全行业都得做到,它们不是你的优势。 这条给我的启发比禁令本身更有用:它逼着你分清哪些是门槛、哪些是差异。你把门槛当卖点讲,除了触线之外还有一个隐性代价——买家和引擎都会认为你没有真正的差异,因为你端出来的最好的东西,是所有人都有的东西。这一点跟站内讲价值主张与独特卖点怎么用属性共现喂给引擎 (https://zhangwenbao.com/vp-usp-entity-attribute-co-occurrence.html)那篇是同一个道理,只是这次由法条来强制执行。 ## 拿这五条去扫一遍你自己的站 规则读完,落到动作上只要半天。我按位置扫而不按页面扫,因为同一句文案往往在多个位置复用。 顺序是这样的:先扫商品页的徽章区和卖点短句,这里密度最高;再扫分类页的横幅和筛选值名称,这里最容易出现整体性的泛用声明;然后是关于我们与品牌故事页,这里“可持续”出现频率最高;接着是结账页与配送说明,碳中和配送多半藏在这儿;最后是邮件模板和广告与社媒素材 (https://zhangwenbao.com/overseas-social-media-marketing-red-lines-compliance-checklist.html),它们不在你的CMS里,也因此最容易被遗漏。 扫的时候只记两件事:这句话属于上面五条中的哪一条,以及它出现在多少个位置。第二个数字比第一个重要,因为它决定了改造的工作量,也决定了万一出事你要撤多少地方。这份清单做完,你对自己站上的风险敞口会第一次有个具体的数,而不是一种“应该没事吧”的感觉。 ## 你贴的那个标,到底是第三方认证还是自己造的? 标签这一层最容易翻车,因为造一个标的成本几乎为零,而拆一个标的成本极高。 ## 法条给“认证方案”下了定义,那就是一条硬线 第2a条禁的是展示“不基于认证方案、也不是公共机构设立”的可持续标签。杀伤力全在“认证方案”四个字上,而法条给了定义。 大意是:认证方案指的是一套第三方验证机制,用来证明某个产品、流程或企业符合特定要求,并据此允许使用相应的可持续标签;这套机制的条款和要求必须公开可得。法条还进一步要求,合规监督要由一个独立于方案所有方和商家的第三方来做,可以通过符合ISO 17065这类国际标准来体现,方案还必须写明出现不合规时怎么处理,包括暂停或撤销商家使用该标签的权利。 把这几句话拆成人话,就是四个动作:条款能不能公开查到、审核方是不是独立的第三方、有没有真实的审核环节、以及出问题能不能把标收回去。四个都满足,是认证方案;缺一个,你贴出来的那个图案在新规则下就不是标签,是风险。 ## 把手上的标分成三档,处理方式完全不同 我习惯先把所有出现在页面上的绿色图案摊到一张表,按下面三档归位。归完位,该怎么办自然就出来了。 档位 | 典型例子 | 新规则下的地位 | 该怎么处理 | 公共机构设立 | 欧盟生态标签、欧盟环境管理与审核体系、能效等级标识 | 明确允许展示 | 放在最显眼的位置,并把等级或编号一起写出来 | 第三方认证方案 | 纺织品的有机与生态类认证、森林与回收材料类认证 | 允许,前提是方案条款公开且有独立审核 | 标旁边补一句这个标管的是什么,并写上证书编号与有效期 | 自建或纯付费标 | 品牌自己设计的绿叶图标、只交钱就发的会员标、供应商随货附的图案 | 被明确禁止展示 | 下架图案;确有实事就改写成一句带范围的事实句 | 第三档是这次改造的主要工作量,也是最容易引发内部争执的地方,因为那个图标往往是市场部花钱设计的,有品牌资产的感觉。这里我的建议很直接:图案下架,内容保留。你真的少用了水、真的用了回收料,把这件事写成一句话,效果不会比一个没人认识的图标差。 ## 230个标里,一个买家认不出的标值多少钱 前面提到欧盟境内流通着230个可持续标签和100个绿色能源标签。这个数字除了说明市场混乱,还有一个更实际的推论。 假设你贴的标属于第二档,完全合法。买家看到它的时候,认得出的概率有多大?大概率认不出。那这个标在页面上起的作用是什么?它起的是“这里有东西被认证过”的模糊暗示,而不是具体的信任传递 (https://zhangwenbao.com/dtc-social-proof-system-reviews-ugc-trust-conversion.html)。这就解释了一个我反复见到的现象:品牌花了不少钱拿认证,转化数据上却看不出变化。钱没白花——认证本身确实推动了供应链改进,但页面上那个图案没有把这笔投入兑现成买家的信心。 兑现的办法就一个:给图案配一句人话。“这个认证要求全链条每一家加工厂都通过独立审核”比图案本身有效十倍,因为它把一个陌生符号翻译成了一个买家能理解的动作。图案负责被扫到,那句话负责被记住,两者缺一不可。 ## 自建标不是不能存在,是不能长成标的样子 有人会问:我们内部有一套自己的可持续标准,比供应商的还严,难道也不能说? 能说,但要换个说法。禁的是“展示可持续标签”这个行为形态——一个图案、一个印章、一个徽章,它在视觉上冒充了第三方背书。你把同样的内容写成文字,讲清楚这是你自家的标准、包含哪几项要求、由谁来检查,它就不是标签,是企业自述,性质完全不同。 差别在哪儿?在于视觉上的“章”暗示了外部权威,而文字自述明确了发言人是你自己。买家会自动给这两种信息不同的权重,这很正常,你也不吃亏——一个说清楚了的自建标准,可信度往往高于一个来路不明的图案。真正吃亏的是那种想吃两头好处的做法:用图案的形式,装第三方的样子,讲自己的标准。 ## 过期的标比没有标更麻烦 还有一类问题跟合不合规无关,纯是运营惰性:证书过期了,图标还挂着。 这事发生得特别自然。认证有效期通常一到三年,续证要重新审、要交钱、要供应商配合,任何一环卡住续期就往后拖。而页面上那个图标是一段静态HTML,没有人给它设过闹钟。于是它就一直在那儿,安静、体面、并且已经失效。 处理办法只有一个:给每个认证图标建一条记录,记下证书编号、发证方、到期日、负责续期的人,并在到期前提前一个季度提醒。这不算什么高明的方法,但它能挡住我见过的相当一部分翻车。顺带说一句,这也正好是把认证信息做成结构化字段的现实理由——一旦有了到期日这个字段,你就能写一条查询,把三个月内到期的全都列出来,而不是靠人记。 ## 一个反直觉的判断:标越少,可信度往往越高 最后说个跟直觉相反的经验:商品页上贴三个绿色图标的品牌,通常不如只贴一个的可信。 原因很简单:三个图标里几乎必然混着不同档位的东西。一个真正的第三方认证,加两个来源不明的装饰性图案,结果不是可信度累加,而是那个真认证被拉低到跟另外两个同一水平——买家不会逐个去分辨,他会整体判断这家店“喜欢贴标”。而喜欢贴标这个印象,本身就是低可信度的信号。 所以我的建议是做减法:留下你能拿出编号和有效期的那一个,其余全部转成文字。页面会变得素一点,但你留下的那一个从此可以被追问、被查证、被引用。这跟站内那篇讲独立站信任怎么分七层建起来 (https://zhangwenbao.com/dtc-ecommerce-trust-7tier-eeat-mechanism.html)的思路是一致的:信任信号的价值不看数量,看有没有一条能落到可验证的实体上。 ## 同样写“有机棉”,95%和70%在GOTS里是两个不同的字 范围这一层最少人写,也最容易被追问,拿纺织品这个最成熟的体系当尺子看。 ## 为什么拿纺织品当尺子:因为这一行的规则被磨得最细 范围这一层最难讲,因为它太依赖具体品类。但有一个品类的体系被磨了二十年,细到可以直接当参照物用,那就是纺织。 你要是做服装、家纺、箱包、宠物垫这类生意,下面这套就是你的作业。做别的品类也别跳过——它示范的是一个通用动作:怎么把一句“我们用的是好材料”,切成几条谁都无法含糊过去的界线。 ## 两档标签,差的不只是几个百分点 全球有机纺织品标准是这一行最常被引用的体系。它对“有机”这件事的处理,是把标签直接分成两档: - 标注为“Organic”的产品,认证有机纤维含量至少95%。 - 标注为“Made with Organic Materials”的产品,认证有机纤维含量至少70%。 - 进入体系的有机纤维本身,必须符合国际有机农业运动联盟认可的标准体系,也就是不使用合成农药、除草剂和转基因 (https://global-standard.org/the-standard/gots-key-features)。 两档标签在中文里都会被翻译成“有机”,这就是问题所在。一件70%的商品和一件95%的商品,在你的中文商品页上长得一模一样,而在证书体系里它们是两个不同的等级、对应两句不同的话。你照着供应商给的中文资料写文案,很可能无意中把70%写成了95%的口径——这不是谁在撒谎,是翻译过程中把一个精确的分档压平了。 ## “全链条每一家都要认证”这句话的分量 这个体系里还有一条要求,我认为是整套规则里最狠的:从纤维加工到成品,每一个参与加工的环节都必须通过认证,所有企业遵守同一套标准。想把一件产品作为认证产品来卖,链条上每一家公司都得拿到独立认证机构的认证。 为什么狠?因为它堵死了最常见的那种取巧:拿一张原料端的证书,去支撑整件成品的说法。原料是有机的,但染色厂不在体系内、缝制厂不在体系内,那件成品就不能顶着这个名头卖。这跟前面法条里第4b条讲的是同一件事——用局部事实做整体声明——只不过认证体系比法条更早、更具体地把它管住了。 体系还配了交易证书这个东西,用来证明材料和产品确实是沿着认证链条流转过来的。这一步把“范围”从一句自我描述,变成了一串可以被逐段核对的凭据。你回头看第二节讲的三层结构会更有感觉:范围这一层要做扎实,最终一定会长成某种形式的可追溯记录。 ## 跨境卖家最容易弄混的三种“有机” 实际操作里,同一个中文词底下经常藏着完全不同的东西。列三种最常见的: 第一种是原料有机而成品未认证。棉花确实是有机种植的,采购单上写得明明白白,但后续加工环节没有进入体系。这种情况你能说的是“采用有机种植的棉花”,不能说“这是一件有机棉T恤”,两句话在举证上差着一整条供应链。 第二种是把不同体系的标准混着说。有的认证管的是化学品残留和人体安全,有的管的是种植方式和全链条环保与社会责任,两者关注的维度不同,不能互相替代。拿着安全类的检测报告去支撑有机类的说法,是最常见的一种张冠李戴。 第三种是把公司层面的做法说成产品层面的属性。工厂装了光伏、办公室做了垃圾分类,这些是企业行为;一件具体商品的环境属性是另一码事。法条里对这条也有专门的说法,你可以讲企业整体的环境表现,前提是准确、可验证、不夸大,但不能让它听起来像在描述这件商品。 ## 不是纺织品怎么办:自己造一套范围限定 大部分品类没有这么成熟的体系,就得自己动手切界线。切法是固定的,问四个问题: 第一,这个属性覆盖商品的哪些部分?把商品拆成主体、辅料、包装三块,逐块标注,别让读者自己去猜。第二,它覆盖哪些环节?原料、生产、运输、使用、废弃,你的说法管到哪一段为止。第三,它覆盖哪些市场?很多环保措施只在某个仓、某条线、某个国家落地,那就写清楚国家。第四,它覆盖哪个时间段?从哪一批货开始,到什么时候为止。 四个问题答完,你的那句话会变长,也会变得不那么响亮。但它从此有了边界,而有边界的话才有被引用的资格——不管是被人引用还是被机器引用。 ## 向供应商要材料时,问题该怎么问 最后落到一个很实际的动作:怎么问供应商要东西。这一步做不好前面全是空谈,因为你的依据都来自他们。 不要问“你们的产品环保吗”,也不要问“有没有环保证书”。这两个问题的答案永远是肯定的,而且附件里会飞来一堆你看不懂的PDF。要问的是四个具体的:这份证书的发证机构是谁、证书编号是多少、有效期到哪天、以及认证覆盖的是哪些工序和哪些料号。 第四问最容易被绕开,也最重要。很多时候你会收到一份真实有效的证书,但它覆盖的料号不包含你正在采购的那一个。这不是供应商骗你,是你没问到点上——他给的确实是他们家的证书,只是你默认了它管到你这一单。把这四问做成邮件模板,每次开新品都发一遍,几个月之后你会攒出一份比任何合规咨询都实用的资料库。这套东西同时也是你做产品详情页原创内容 (https://zhangwenbao.com/product-detail-page-onpage-seo-unique-content-engineering.html)的原料,规格密集的品类还可以照B2B详情页的模块结构 (https://zhangwenbao.com/b2b-pdp-14-module-high-conversion-blueprint.html)给认证材料留个固定位置,那篇讲的是怎么摆脱供应商的通用文案,这里给的正好是替代它的具体素材来源。 ## 商品页上的可持续信息,分几层放、每层各放什么? 从徽章到属性区到详情段落,证据密度应该是递增的,位置错了信息就白给。 ## 先看一个大样本得出的观察:四分之一的站根本没把话说出来 做电商可用性研究的机构测过一批站,结论里有一条跟这个话题直接相关:25%的受测站点没有在商品页上突出品牌与商品的核心属性,包括回收材料、道德生产这类信息 (https://baymard.com/blog/sustainability-best-practices)。同一份研究里还有另外两个数字:37%的站在筛选器里直接使用行业行话而不加解释,60%的站完全没有站方与用户双来源的问答内容。 三个数字描述的是同一种状态:企业投了钱做改进,然后在页面上说得含含糊糊,或者干脆没说。研究方的建议是把它讲清楚、讲显眼。这个建议没错,但它有个隐含前提——你说的话不会被追责。前面三节讲完之后你已经知道,这个前提在欧盟市场上已经不成立了。 所以“讲清楚”这个动作要重新设计。不是讲得更大声,是按证据密度分层来讲。 ## 证据密度递增:越往下走,越要拿得出东西 我把商品页从上到下分成四层,每层承担的信息类型不同,能承受的举证强度也不同。 位置 | 放什么 | 字数上限 | 必须同时具备 | 主图旁的徽章位 | 只放公共机构标识或第三方认证标 | 图标加一个短标签 | 标旁边有一句人话,说明这个标管的是什么 | 属性区 | 结构化的事实条目,例如材质构成与占比 | 每条不超过一行 | 是字段而不是自由文本,能被筛选和导出 | 描述正文 | 带范围限定的完整句子 | 两到三句 | 每句都能回答“凭什么” | 详情与文档区 | 证书编号、有效期、检测项目、方法说明 | 不设上限 | 可折叠,但内容在HTML里而不是靠点击后加载 | 这张表最关键的是“字数上限”那一栏。上面两层必须短,因为它们出现在决策路径上,用户是扫过去的;下面两层可以长,因为读到那儿的人已经在认真研究了。把长论证放到第一屏,效果不是更有说服力,是把商品推下去了;品牌层面的长叙述更适合放在页脚那种收口位置 (https://zhangwenbao.com/ecommerce-footer-design-trust-conversion.html)。 ## 属性区是最被低估的位置 四层里投入产出比最高的是属性区,因为它同时服务三类读者,另外三层各只服务一类。 买家在这里扫描比较,引擎在这里抓取结构 (https://zhangwenbao.com/ai-ready-product-page-optimization.html),你自己在这里做筛选和导出。同一条“面料含95%认证有机棉”,写在描述里是一句话,写成属性是一条数据——它能被筛出来,能被拿去做分类页的筛选值,能被导进商品数据源,能被结构化数据引用。写在描述里的那句话,除了被人读到,什么都做不了。 各平台实现方式不同:Shopify靠元字段定义类型和取值范围,WooCommerce用属性分类,Magento那套属性与属性集的作用域管理 (https://zhangwenbao.com/magento-2-eav-product-attributes-attribute-sets-scope-management.html)更重也更灵活。选哪套不重要,重要的是别把这类信息写成自由文本。自由文本填的时候最省事,用起来处处受限,两年后你想批量修正一个说法,会发现它散落在八百个商品的描述段落里。 ## 问答区:60%的站空着,而它天生适合装这类问题 研究里那个60%说的是问答内容的缺失。为什么它对可持续话题特别要紧? 因为环保类疑问天生是长尾的、具体的、带情境的。“这个能不能回收”“包装是不是塑料的”“运输过程有没有用泡沫”“旧的能不能寄回来”——这些问题你在商品描述里根本预料不完,而它们恰恰是最认真的那批买家会问的。不知道从哪儿收集,去翻竞品的差评区 (https://zhangwenbao.com/competitor-review-gap-analysis-positioning.html),那里问得比你想得全。问答区是唯一一个可以容纳无限长尾的位置。 更有意思的是它的另一重作用。用户提问加上你的官方回答,构成的是一组自然语言的问答对,这是生成式引擎最容易摘取的内容形态之一。你在这里回答一个具体问题,等于同时干了三件事:解决了这个买家的疑问、给未来的买家留下了答案、给引擎准备了一段可以直接引用的素材。站内讲FAQ结构化数据在富结果被砍之后怎么改 (https://zhangwenbao.com/faq-schema-optimizer-rich-result-ai-citation-guide.html)那篇里有更细的做法,思路是通的。 ## 手机上,这些信息会掉到哪儿去 四层结构在桌面上排得下,到手机上就得重新算账,这里有个容易忽略的问题:折叠。 移动端商品页普遍把描述和详情做成手风琴,默认收起。这意味着你的第三层和第四层在手机上是零曝光的,除非用户主动点开。而移动端往往占你七成流量。结果就是:你辛苦补齐的范围限定和证据材料,绝大多数买家根本看不到,看到的只有第一层那个图标——恰恰是信息量最低、最容易引起误解的那一层。 怎么办?我的处理是把范围限定那半句往上提。不要写“采用有机棉”配一个图标,然后把“含量95%”藏在折叠区;直接把徽章旁边那行小字写成“认证有机棉95%”。多了三个字,但它把最关键的限定词放进了必然被看到的位置。判断标准很朴素:假设用户只看得到第一屏,你希望他记住的那句话,必须完整地出现在第一屏。 ## 一个真实的反面例子:证据堆太满会怎样 说完“要写”,也得说“写过头”。我见过一个做家居用品的站,可持续这块做得很认真,问题是把所有材料都堆到了第一屏。 主图下面依次是:三个认证图标、一段120字的环保理念、一个碳排放对比条形图、一句创始人寄语。等这些走完,加入购物车按钮已经在第二屏往下。他们的可持续投入是真的,材料也都经得起查,但转化数据很难看。 问题不在内容质量,在于他们把论证材料放到了决策位置上。买家在第一屏要做的判断是“这东西是不是我要找的”,不是“这家公司价值观如何”。价值观的说服要发生在他已经想买、正在找理由的时候,也就是第三层第四层。这件事跟站内讲高转化电商页面怎么按信息架构排序 (https://zhangwenbao.com/high-conversion-ecommerce-cro-seo-90day-playbook.html)那篇是一个道理:内容对不对是一回事,放在哪一步是另一回事,后者经常比前者更能决定成败。 ## 筛选器里那个“可持续”选项,为什么用户不敢点? 筛选值是全站语义最紧的地方,也是跨境翻译最容易把法律含义弄丢的地方。 ## 三分之一的站在筛选器里说行话,用户就不点了 前面提到的那份研究里有个37%:超过三分之一的受测站点在筛选标签里直接使用行业术语,不加任何解释。研究者记录到的用户反应很有代表性——看到一个写着“可持续”的筛选类型,用户的原话是不确定这里所谓的可持续到底指什么,筛选器这么多,一眼看过去很多都看不懂,那就不好用。 结果是他不点。代价不是少用一个功能,是他可能因此错过最适合自己的那批商品。你花钱做的认证、辛苦补的属性,在他这次访问里等于不存在。 这个损失比商品页上写错一句话更隐蔽,因为它不会产生任何投诉、任何差评、任何数据异常。用户只是安静地绕开了那一栏,然后按价格排了个序。 ## 用户不敢点,通常是这三个原因之一 用户的犹豫拆开看无非三种: 第一种是不知道这个词指什么。“可持续”“环保优选”“绿色系列”,这些词在你内部有定义,在用户那里没有。第二种是知道词的意思,但不知道点了之后会发生什么——是筛掉一半商品,还是只剩三件?用户对未知的收缩幅度是有恐惧的,尤其在他还没看够商品的时候。第三种最微妙:他觉得这个筛选可能会把价格筛高。可持续在很多人心里跟贵是绑定的,这个联想你不主动拆,它就一直在。 三种原因对应三种解法,而且都不需要改代码:给词配解释、给选项配数量、以及在解释里顺手说清楚价格关系。第二条最省事——在每个筛选值后面显示命中数量,用户的犹豫会明显下降,因为他知道点下去会剩多少。 ## 提示文案该写什么:不是定义,是效果 很多人给筛选值配提示,写的是词典式定义。这是最常见的一种浪费。 用户在筛选器前面停留的那两秒,想知道的不是这个词的学术含义,是点下去会得到什么。所以提示文案的正确写法是描述结果,不是解释概念。 对比一下。定义式:“可持续指在满足当代需求的同时不损害后代满足其需求的能力。”——这句话除了显得你很有文化,什么用都没有。效果式:“勾选后只显示获得第三方有机认证的商品,目前有42件。”——用户立刻知道该不该点。第二种写法还有个附带好处:它顺手把这个筛选值的举证依据说出来了,一句话同时满足了可用性和合规两边的要求。 ## 跨境翻译最容易丢的,恰恰是法律含义 接下来是跨境特有的那一层,也是这一节最想讲的。 一个筛选值从中文后台翻译成德语、法语、西语上线,中间会丢掉什么?很多人担心语感,真正危险的是法律含义。有些词在某些市场是被规范的术语,有明确的使用条件;翻译工具不知道这件事,它只负责把意思传达过去。 举个具体的:中文写“环保”,机器翻成德语可能给你一个在当地属于泛用环境声明的词;中文写“可降解”,翻过去可能对应一个有明确检测标准的术语,而你的产品并没有做过那项检测。你在中文站上写的是一句营销话术,翻译之后它变成了一句技术断言,而你完全不知道这件事发生了。 我的处理办法是给可持续类的筛选值建一份单独的术语表,每个词记四列:中文原词、目标市场语言、该市场是否为受规范术语、以及经过审核的译法。这份表不进翻译系统,进的是人工复核清单。词不多,几十个而已,但它是整个多语言站里最不能交给机器的几十个词。站内讲电商过滤器的参数处理 (https://zhangwenbao.com/ecommerce-category-page-filters-seo-tips.html)那篇管的是这些筛选怎么生成URL、要不要放行索引,属于治理层,类目页机制那篇 (https://zhangwenbao.com/ecommerce-plp-collection-page-seo-mechanism-complete-guide.html)讲的是这些值怎么和集合页配合;这里说的是它们在语义上准不准、能不能说,是内容层。 ## 筛选值本身也是声明,同一套规则照样管它 还有一个很多人没意识到的点:筛选值算不算“环境声明”? 按法条对可持续标签和环境声明的定义看,一个出现在筛选器里、暗示商品具有更好环境表现的标记,性质上跟商品页上那个徽章没有本质区别。你在筛选器里放一个“环保优选”,它就是一句对被筛出商品的整体评价。如果这个分类的依据是你自己拍脑袋定的,那你不仅是在误导用户,还是在批量生产同一句无依据的声明。 所以给筛选值定名的时候,判断标准和商品页文案完全一样:这个词能不能回答“凭什么”。答不上来的,要么改成一个纯描述性的词,比如直接用材料名称;要么就取消这个筛选维度。取消一个筛选维度听起来像倒退,但它比留着一个你无法解释的分类要安全得多,也诚实得多。 ## 一个折中做法:把评价性的词换成事实性的词 最好用的一招是把筛选值从评价换成事实。 “环保材质”改成“回收聚酯纤维”,“可持续包装”改成“无塑包装”,“绿色配送”改成“门店自提”。改完之后你会发现三件事同时变好了:用户看得懂了,因为事实名词不需要解释;举证压力没了,因为你只是在陈述用了什么;筛选结果也更准了,因为事实性的分类边界清晰,不会出现两个运营对同一件商品判断不一致的情况。 唯一的损失是那个词不再有情绪价值。但筛选器本来就不是抒情的地方,它是个工具栏。情绪留给品牌故事页,那里有足够的篇幅把话说完整。 ## 结账那一步给不给“绿色配送”,到底算不算数? 履约选项是唯一一处用户用行动而不是用眼睛表态的地方,也最容易踩另一条红线。 ## 近四成的站,在最后一步把选项藏起来了 那份研究的第四个数字是39%:将近四成的受测站点没有在结账页列出全部履约选项,哪怕这些选项在更早的环节是可见的。用户要么退回去找,要么以为没有,然后就放弃这一单 (https://zhangwenbao.com/dtc-checkout-abandonment-9-real-causes.html)。 这问题本身跟环保无关,是纯粹的可用性缺陷。但它在可持续话题下有额外分量,因为履约选项是整个购物流程里唯一一处——用户不是在看你说什么,而是在用一次真实选择表明他在乎什么。 他点了自提,就是自己承担了一趟路程去省一次派送。他选了合并发货,就是接受晚几天收货去换一个包裹。这些是有代价的选择,比在问卷里勾“我关注环保”真实一百倍。你把这些选项藏起来,等于把唯一一次能收集到真实偏好的机会关掉了。 ## 但这一步同时是两条红线的交叉口 先泼盆冷水:结账页恰恰是前面五条禁令里最容易踩中两条的位置。 第一条是碳中和那一类。很多物流服务商会给你一个“碳中和配送”的选项,通常是每单加几毛钱去买抵消额度。你把它原样搬到结账页上,就直接落进了第4c条——基于抵消宣称环境影响中性或减少,在所有情形下都禁止。这不是解释空间的问题,它是黑名单条目。 第二条是把法定义务当卖点。有些站在配送环节写“包装符合欧盟环保要求”“不使用受限塑料”,如果这些本来就是该市场所有商家都必须遵守的,那它就落进了第10a条。你以为自己在展示责任心,法条认为你在制造虚假的差异。 ## 自提是最干净的那个选项,也最少人做全 说完不能做的,说能做的。履约这块最扎实的绿色选项是自提和集中取货,它的环境优势不需要论证——少一趟上门派送就是少一趟,不用第三方来认证。 它的问题在别处:跨境独立站通常没有门店,自提这个选项听起来不适用。但它有个变体是可以做的,就是取货点配送。欧洲很多市场的包裹网点密度很高,把包裹送到网点而不是送到家门口,是一个成本更低、失败投递率更低、也确实更省的选项,很多买家本来就更喜欢它,因为不用在家等。 做这个选项的关键是别把它包装成环保情怀,就当成一个正常的配送方式提供,价格上给点优势,然后在旁边用一句纯事实的话说明区别:送到网点的包裹由集中路线派送。顺带一提,网点交寄通常也让退货那一段 (https://zhangwenbao.com/dtc-return-refund-policy-page-seo-trust-conversion-design.html)更短。至于这句话意味着什么,让用户自己下结论——你不下结论,就不需要举证。 ## 合并发货:少数几件你真的说得出口的事 另一个能说的是合并发货。一个订单拆成三个包裹从三个仓发出,和合并成一个包裹发出,差别是实打实的,而且这件事完全在你的控制范围内。 做法是在结账页给一个选项:允许合并发货,可能会晚两到三天。愿意等的人会勾,赶时间的人不会,两边都得到了自己想要的。你在这里可以写的事实句是“合并为一个包裹寄出”,不需要任何认证,也不涉及任何评价性形容词。 这个选项还有个我很喜欢的副作用:它给你一个数字。勾选率是多少,按市场分是多少,按客单价分是多少。这个数字比任何市场调研都可靠,因为它是真金白银换来的。你后面要不要在可持续这件事上继续投入、投在哪个市场,这个数字是最好的依据之一。站内那篇讲配送政策页怎么写才降弃购 (https://zhangwenbao.com/dtc-shipping-policy-page-seo-delivery-time-cost-transparency-conversion.html)的文章讲的是下单前的公开承诺页,这里讲的是下单那一刻的选项设计,两个位置得用同一套时效口径,别一边写三到五个工作日,另一边写一周内。 ## 把碳中和那句话删掉之后,位置空出来放什么 假设你听劝,把结账页那个“碳中和配送”删了,空出来的位置放什么?我建议放一句关于路线的事实。 比如:本单从德国仓发出,境内派送。或者:本单为跨境直邮,途经清关。这两句话都没有任何环境评价,但认真的买家读得懂——本地仓发货比跨境直邮的运输段短得多,这是常识,不需要你说出结论。 这种写法我叫它“把结论留给读者”。它在合规上是安全的,因为你只陈述了事实;在说服力上反而更强,因为用户自己推出来的结论比你灌给他的更牢固。而且它顺带解决了另一个长期问题:跨境买家经常搞不清这单货到底从哪儿发,写清楚发货地本身就在降低查件工单。 ## 美国那边的规则不同,但方法论一样 如果你的主力市场在北美,上面这套欧盟规则不直接适用,但别高兴太早,那边有一份存在多年的指引。 美国联邦贸易委员会有一份环境营销指引,它提供的是三类内容:适用于所有环境营销声明的通用原则、消费者可能如何理解特定声明以及营销方如何为这些声明提供依据、还有营销方如何对声明加以限定以避免误导消费者 (https://www.ftc.gov/legal-library/browse/rules/green-guides)。 注意第三条:如何对声明加以限定。这跟欧盟法条里那条“在同一媒介上清晰显著地给出限定说明”,讲的是同一件事。两个法域、不同年代、不同立法逻辑,落到具体建议上是重合的——因为它们面对的是同一个人类行为:人会把一个模糊的好词理解成对整体的承诺。你把范围限定写清楚,两边同时过关,这也是我不建议按市场分别写文案的原因,一套写扎实的说法是通吃的。 ## 为什么让你不挨罚的那次改写,恰好让AI敢引用你了? 这是全篇最关键的一跳:合规审查要的东西和生成式引擎要的东西,是同一份清单。 ## 先把结论摆出来:两套系统要的是同一份清单 前面八节讲的改造动作,你都可以只当成合规成本来做,做完之后除了睡得着觉没别的收益。但它有第二个用途,价值可能更大。 结论是:欧盟合规审查用来判断你那句话能不能说的标准,和生成式引擎用来判断你那句话能不能引的标准,高度重合。不是相似,是几乎同一份清单。你为了不挨罚做的那次改写,同时把这段内容变成了引擎肯用的形态。 这件事我一开始没意识到,是给客户改完文案后回头做AI可见度检查时发现的:改过的那批商品,在几个引擎里被提及的方式变了——从原来的完全不出现,变成了偶尔被当成具体例子引用。而我们做的事只有一件,就是把形容词换成了带范围和证据的事实句。 ## 一份清单,两个用途 把两边的要求并排放,重合度会很直观。 要求 | 合规审查为什么要 | 生成式引擎为什么要 | 具体而非泛用 | 泛用声明拿不出对应的卓越表现就属违规 | 形容词无法构成答案,没有可摘取的内容 | 限定范围 | 用局部事实做整体声明是黑名单条目 | 范围不清的句子引用出去会出错,模型倾向回避 | 标明来源 | 可持续标签必须基于第三方认证方案 | 有出处的陈述权重更高,也更容易被追溯 | 写清时效 | 过期认证不能继续展示 | 带时间标记的信息更容易判断是否仍然成立 | 同一位置给出依据 | 限定说明必须与声明在同一媒介上清晰显著 | 自足的段落才能被单独摘出来当答案 | 右边那一栏的每一条,我都能在站内之前写过的GEO内容里找到对应。这不是巧合。两套系统面对的是同一个难题:怎么在一堆自说自话的宣传里,识别出哪些话是可以拿去用的。人类监管者和语言模型给出的答案,居然长得差不多。 ## 可验证性是可引用性的前置条件 再往深一层:为什么带证据的句子更容易被引用? 因为引用这个动作本身有风险。任何要输出答案的系统,不管是人还是模型,都在规避一件事:把不成立的东西说出去。一句话越是能被独立核对,引用它的风险就越低,被选中的概率就越高。 “面料含95%认证有机棉,证书编号可查”这句话,引用者不需要相信你,他只需要知道这句话如果是假的会被戳穿——而一个愿意留下编号的人,通常不会在这上面撒谎。这是一种非常朴素的信任机制 (https://zhangwenbao.com/strengthen-authority-eeat-signals-ai-citations-2026.html),人类社会用了几千年,现在被搬进了机器的选择逻辑里。 站内讲事实密度怎么提高引用率 (https://zhangwenbao.com/boost-content-fact-density-ai-citations-2026.html)那篇讲的是同一件事的另一面:一段内容里能被核对的具体事实越多,它被摘取的可能性越大。可持续声明恰好是最容易做出高事实密度的题材——材质占比、认证编号、有效期、覆盖范围,全是硬数字。 ## 演示一遍:同一句话改写前后的命运 拿个具体的走一遍。原文案是:“我们坚持使用环保面料,为可持续时尚贡献力量。” 这句话在合规上踩两条:泛用环境声明,且“可持续”这个词涉及社会属性,很难支撑。在引擎那边它什么都不是——没有任何可以被提取的实体、数值或关系。用户问“有哪些品牌的T恤用了认证有机棉”,这句话不可能被选中,因为它没提到认证,也没提到含量。 改写后:“T恤主体面料含95%认证有机棉,其余5%为弹性纤维;缝纫线与织唛不在认证范围内。认证覆盖从纤维加工到成衣的全部工序。” 合规上,这句话不含任何泛用形容词,范围写得比追问还细,可以原样重复。引擎那边,它一下子有了三个可提取的点:材质构成、认证等级、覆盖范围。它现在有资格出现在“认证有机棉含量多少算数”这类问题的答案里——而这类问题恰恰是最有购买意图的那种。 字数从22个字变成了60多个字。这是唯一的代价。 ## 反过来也成立:GEO做得扎实的站,合规风险天然低 这个关系是双向的,值得单独指出来,它能改变你安排工作的顺序。 如果一个站长期按照可被引用的标准写内容——事实优先、数字具体、来源明确、时间清楚——那它在这次合规改造里要动的地方会非常少。反过来,一个长期靠形容词堆气氛的站,会发现要改的不是几句话,是整套内容风格。客单价越高越明显,高客单价那批品类 (https://zhangwenbao.com/high-ticket-dtc-content-trust-geo-strategy.html)的买家本来就要读更多字才肯下单。 所以这两件事不该分成两个项目做。我现在给客户排期,会直接把合规审查嵌进内容改造里,用同一批人、同一张检查表走一遍。理由很实在:分开做要读两遍页面,合起来做只读一遍,而两边的判据本来就是一个。 ## 但别为了被引用去注水,两边都不吃这套 有个坑要提前说。知道引擎喜欢具体数字之后,有人会走向另一个极端:堆一堆看着具体、其实经不起查的数字。 这是最坏的选择。编造的具体数字在合规上比模糊形容词严重得多——形容词至少还能辩解说是主观表达,一个编出来的百分比是没法辩解的。在引擎那边它也未必占便宜,因为一个没有任何外部佐证的数字,跟其他来源对不上的时候,反而会拉低整体可信度。 判断标准还是那个:这个数字你能不能在被追问时三十秒内拿出依据。拿不出来就别写,写一个范围、写一个下限、或者干脆只写定性的事实描述,都比编一个精确数字安全。 ## 两个要配着看的指标 这套改造怎么衡量?我用两个指标,单看任何一个都会被骗。 第一个是可持续相关内容的被引用次数——在几个主流引擎里,用你的品牌加上材质、认证、环保这类问题去问,看你的页面有没有被引用、被引用的是哪一句。这个数字直接反映改写有没有生效。第二个是可持续筛选或属性的使用率与它的转化差值:用了这个筛选的用户,加购率和整体比是高是低。 为什么要配着看?因为第一个指标可以靠猛写内容刷上去,第二个指标可以靠把筛选做得很显眼刷上去,但两个同时涨,通常意味着你说的话既被机器认可了,也真的帮买家做了决定。任何一个单独涨,都值得回头查一查是不是哪里做过头了。 ## 四周落地:第一周一句文案都别改 最后给个排期。四周,顺序不能颠倒。 第一周不改任何东西,只做清点:把全站所有出现环保类表述的位置扫出来,按前面那五条禁令归类,记下每一句出现在多少个位置。这一周的产出是一张表和一个数字——风险敞口有多大。跳过这一步直接改文案,你会漏掉邮件模板、广告素材和分类页横幅,那些地方改起来最麻烦。 第二周处理标签层:把所有绿色图案按三档归位,第三档全部下架,第二档补上编号和有效期。这一周动的是图片和模板,不动文字,工作量可控且效果最直接。 第三周才开始改写文案,从流量最高的那20个商品页开始,一句一句按三层结构补。别求全站一次做完,先做完这20个,把改写模板固化下来。第四周做两件事:把改写扩散到属性字段和筛选值,以及建立那份认证台账——编号、发证方、到期日、负责人、提醒时间。台账建完,这件事才算从一次性项目变成了日常。 ## 保哥的失手复盘:内容全是真的,为什么撤起来这么贵? 一次没有任何数据出错、也没有任何人撒谎,却让我赔进去两个月的改造。 ## 背景:一个家纺站,和一个为了凑数而生的筛选值 客户做家纺与床上用品,四件套、被芯、枕头、毛巾,主力市场德国和荷兰,一千多个SKU。品类本身跟可持续话题贴得很紧——有机棉、竹纤维、无荧光剂,买家是真的会问。 起点特别不起眼。优化分类页筛选器的时候我们发现,材质、尺寸、颜色、价格都有了,就缺一个能体现品牌调性的维度。运营提议加一个“环保优选”,我当时觉得挺好——买家确实关心,加上之后筛选器也更完整。 供应商那边正好有一份表,里面有一列标着是否环保。运营照着这列给三百多个SKU打了标,上线,筛选器里多了一个选项,商品页上多了一枚绿色小图标。整件事从提议到上线不到一周,没有人觉得这需要讨论。 ## 头两个月的数据,好到我在月报里专门写了一段 数据是真好看。这个筛选值的使用率排到所有筛选维度第三位,仅次于尺寸和价格;用了它的会话,加购率比整体高出四成多;带这个标的商品,页面停留时间也明显更长。 我在月报里写了一句“可持续标识的引入验证了目标客群的价值取向”,现在回想起来那句话写得挺神气的。客户也很满意,还问要不要在首页也做一个环保专区。我说做,反正内容都是现成的。 于是这个标签开始扩散。分类页有了环保系列的入口,导航里加了一项,邮件模板里的推荐位优先推带标的商品,联盟客的素材包里也放了这批商品,Google Merchant的商品数据里,我们把它写进了自定义标签。四个月里,它从一个筛选值长成了一条贯穿全站的产品线。 ## 第五个月,一封德语邮件 触发点是客服转来的一封邮件。一个德国买家,语气很客气,问的是:你们这个“环保优选”是按什么标准评定的?是哪家机构认证的吗? 说实话我第一反应是这人有点较真。但客服要回信,我得给个答案,于是去翻那份供应商的表。表里那一列确实叫“环保”,值是“是”和“否”。我问采购这个是怎么定的,采购说这是供应商自己填的。我又去问供应商,供应商那边的回复很坦率:他们内部的规则是标题里含有机、竹纤维、无荧光剂这几个词的就填是。 再往下查,运营那边还有个自己的补充规则:供应商没填的,如果商品描述里提到了“天然”或者“亲肤”,也补一个标。 那一刻我才看明白:这个贯穿全站四个月、被三百多个商品佩戴、影响了几万次点击的标识,它的定义是——标题里有某几个词。它不是被评出来的,是被匹配出来的。而且从头到尾,没有任何一个环节撒过谎,没有任何一份数据是伪造的,没有任何一行代码出错。每个人都在认真做自己那一段,只是从来没有人问过一句:这个标到底代表什么。 ## 为什么五个月都没人发现 事后我复盘过,答案有三条,每一条都让我不太舒服。 第一条,所有指标都在证明它是对的。使用率高、加购率高、停留时间长——这些数据只能告诉你用户喜欢这个筛选,不能告诉你这个筛选说的是不是真话。我拿一个衡量受欢迎程度的指标,去验证了一件关于真实性的事,而这两件事本来就不相干。 第二条,它是从筛选器长出来的,不是从内容长出来的。如果一开始有人提议“我们在商品页写一句环保声明”,一定会有人问依据。但提议“筛选器加一个维度”,它在所有人心里都是个交互问题,是产品经理的活,不是需要举证的内容。位置决定了它逃过了审查。 第三条,我自己也在用它。做首页专区、写邮件推荐位的时候,我把它当成一份可靠的商品分组在用,从来没往上游看一眼。一个东西被自己人反复使用之后,会自动获得一种可信的错觉——用得越多,越不会有人回头问它从哪来的。 ## 然后我发现,撤下来比挂上去贵得多 决定要撤的时候,我以为是个技术活:改数据、下图标、删筛选值,一两天的事。实际上改页面确实只花了三天,剩下的两个月全在别的地方。 清单是这样的:分类页的URL已经被索引了,得做重定向而不是直接删;导航里的入口删掉之后,站外还有一批指向它的外链;邮件已经发出去了几十万封,撤不回来; 联盟客的测评文章里写着“该品牌的环保系列”,得一个个联系,这类站外内容的处理流程在和法务配合的那套动作清单 (https://zhangwenbao.com/legal-counsel-seo-collaboration-7-actions-privacy-trademark-incident.html)里;Merchant的商品数据要重新提交并等待重新审核;最麻烦的是几个AI搜索工具里,问到这个品牌的可持续做法时,会把那个环保系列当成一个事实说出来——因为它确实在网上存在了五个月,有页面、有内链、有站外提及,从任何一个抓取者的角度看,它都像一件真事。 这就是我从这次事故里学到的最贵的一课:营销文案的撤回成本是页面级的,而一句声明的撤回成本是全网级的。你删掉页面上的字,只是删掉了源头;它在别人那里的副本,你没有删除权限。 ## 改了三处,六周之后重新上线 重做的时候,我们改了三件事。 第一,把评价性筛选值全部换成事实性的。“环保优选”没了,取而代之的是三个具体维度:认证有机棉、无荧光增白剂、可回收包装。每一个都对应一个能查的事实,而不是一个综合评价。选项从一个变成三个,筛选器更长了,但每一个都能解释。 第二,给每个维度定了准入依据,写进运营手册:认证有机棉必须有证书编号和有效期,无荧光增白剂必须有检测报告,可回收包装必须写明是哪一部分。没有材料的商品不打标,宁可这个维度下面商品少。 第三,也是我认为最重要的一条——给所有对外声明加了一道很土的关卡:任何要出现在页面上的可持续表述,提交的人要在一句话里写清楚“如果买家问依据,我们拿什么给他”。写不出来的不上线。这条规则后来被客户拿去用在了别的地方,效果都不错,因为它把一个需要专业判断的问题,变成了一个谁都能回答的问题。 六周后重新上线,三个新维度的合计使用率大概是原来那个“环保优选”的六成。少了四成,我认为完全值得——那四成本来就是被一个说不清的词吸引来的点击,它带来的转化建立在一个我们无法兑现的承诺上。 ## 这跟“自己给自己封第一”是同一类毛病 最后做个归类。这次的问题,本质上跟站内写过的自夸式榜单被点名之后怎么改 (https://zhangwenbao.com/self-promotional-listicles-ftc-google-crackdown.html)是同一个毛病的两种长相。 那种榜单的问题是:你把自己放进一份看起来客观的排名里,而这份排名的评选标准是你自己定的、甚至根本没定。读者以为看到的是第三方比较结果,实际上看到的是一句自我评价穿了件客观的外套。 我这个环保标一模一样。绿色图标在视觉上是一枚章,章这个形态天然暗示外部机构盖过;而它的评选标准是“标题里有某几个词”。系统一点错都没有,它百分之百准确地执行了我们定的规则,数据流转、标签匹配、页面渲染全部正确。错的是那条规则本身从一开始就不该存在——我们让一个没有定义的概念进入了生产流程,然后所有下游环节忠实地把它复制到了每一个角落。坏规则被执行得非常好,这种事最难发现,因为它没有任何异常信号,一切都在正常运转,只是运转的内容是空的。 要说有什么能防住第二类,我目前只找到一个办法,就是前面那道土关卡:任何一个新概念进入系统之前,先让提出它的人用一句话说清楚,被追问时拿什么出来。这句话答不上来,就别让它进来——进来之后,它跑得越顺,你越难把它请出去。 ## 常见问题解答 ## 我的主力市场不在欧盟,这套规则还需要管吗? 规则本身不适用,但那套写法值得照做。原因有三个。一是欧盟这套判据不是凭空发明的,它描述的是人怎么误读一个模糊的好词,这个心理机制在哪个市场都一样;美国那份环境营销指引也有一条讲怎么给声明加限定,说的是同一件事。二是内容一旦上线就是全网可见的,你没法保证只有目标市场的人看到,也没法阻止某个欧盟买家下单之后回头较真。三是最实际的:具体、带范围、带来源的写法,本来就是生成式引擎更容易引用的形态,这个收益跟你卖到哪儿没关系。 所以我的建议是不分市场,统一按最严的那套写。多写十几个字,省掉一整套按地区分版本的维护成本。 ## “环保”这两个字是不是彻底不能用了? 不是。禁的是它孤零零地出现,不是这个词本身。按法条对泛用环境声明的定义,只要你在同一个位置以清晰显著的方式给出了限定说明,它就不属于泛用声明。关键在“同一个位置”——把说明放在另一个页面、藏在折叠区、写成脚注,都不算。实操上最省事的做法是干脆不用这个词:直接写你做了什么,比如用了回收料、少了某道工序、包装不含塑料。这样既不需要额外补说明,读起来也更有信息量。 真要用这类词,把它留给栏目名和页面标题这种不针对具体商品的位置,风险会小很多。顺带提一句,“可持续”“负责任”这类词比“环保”更难支撑,因为它们还牵涉社会属性。 ## 已经买了碳中和配送服务,这笔钱白花了吗? 钱不算白花,但那句话不能那样说。被禁的是基于价值链外的抵消,去宣称这件商品在温室气体方面影响中性、减少或正面。法条同时明确,这不妨碍企业宣传自己在环境项目上的投入,包括碳信用项目,只要说法不误导、且符合其他法律要求。所以出路是换主语:主语是公司、说的是投资行为,可以;主语是这件商品、说的是它的环境影响,不行。具体到结账页,我的建议是把那个选项从“碳中和配送”改掉,要么改成纯事实的路线描述,要么就取消这个选项、把相关投入放到企业责任页去讲。顺便说,那个选项通常勾选率很低,取消它对转化几乎没有影响。 ## 自己做的检测报告能不能当证据? 能当依据,不能当标签。这是两件事。你送去第三方实验室做的检测报告,是很扎实的事实来源,完全可以支撑一句具体的陈述,比如某项物质未检出、某个指标低于某个限值——写出检测项目和方法就行。但它不能变成一枚挂在商品页上的绿色徽章,因为徽章属于可持续标签,法条要求标签必须基于第三方认证方案或由公共机构设立,而一份检测报告不构成认证方案。区别在于:认证方案有公开的条款、持续的合规监督、以及不合规时撤销标签的机制,检测报告只是某一批次某一时点的一次测量。判断方法很简单:能写成句子的就写成句子,别做成图案。 ## 做认证成本太高,小卖家有没有低成本的路? 有,而且效果未必差。认证是证据链里成本最高的一环,但它不是唯一一环。低成本的路是把“范围”这一层做到极致——认证做不起,就把你确实知道的事情写得比谁都清楚:主体用什么料、辅料用什么、包装分几部分各是什么、哪一段运输在境内、哪几个环节你没有信息。把不知道的也写出来,这一点尤其有效,因为大部分品牌都在假装全知。一个坦白说明边界的品牌,在买家眼里的可信度往往高于一个贴满图标却答不上细节的品牌。至于成本,这活儿只需要采购配合填几列表格,加起来不到一周。 ## 把文案改具体之后,转化会不会掉? 短期内某些指标会掉,而且掉的多半是那种被模糊好词吸引来的点击。我自己那次改造,相关筛选的使用率掉了约四成。但要看两个数字:一是这批流量的加购率有没有跟着掉,二是客服那边关于材质、认证、成分的问询量有没有变化。我遇到的情况通常是使用率降、加购率升、问询量降——因为页面替客服把话说清楚了。另一个不太容易立刻看到的收益是站外:具体的句子更容易被测评文章引用,也更容易出现在AI给出的答案里,这部分流量的滞后期大概是一两个季度。所以别用改造后第一个月的数据下结论,那个月你看到的只是筛掉了噪音。 ## 权威参考资料 ## 出海独立站怎么选同意管理平台(CMP)?四家主流工具横评与选型决策树 - URL:https://zhangwenbao.com/cmp-consent-management-platform-selection-cross-border.html - 分类:DTC合规与法务 - 发布:2026-06-14 | 更新:2026-06-14 - 摘要:选错CMP轻则白花钱,重则把GA4数据弄垮、还可能踩合规红线。这篇笔记站在出海中小卖家立场,把四类常见同意管理工具适合谁、坑在哪讲清楚,并给出部署后怎么验证同意模式真的生效的检查动作。 - 关键词:独立站,出海独立站,Consent Mode > **TLDR**:摘要:给出海独立站选同意管理平台,最贵的那家几乎从来不是最适合你的那家。OneTrust是给跨国集团准备的重型装备,你一个中小卖家扛回来,多半是花了冤枉钱还配不明白。保哥帮出海客户选CMP这些年,一条铁律是先看一个硬指标——支不支持谷歌的同意模式v2,不支持的再便宜也直接出局;剩下的,才在价格、部署难度、对GA4数据的影响里挑。这篇就把这套选法摊开讲。 > 摘要:给出海独立站选同意管理平台,最贵的那家几乎从来不是最适合你的那家。OneTrust是给跨国集团准备的重型装备,你一个中小卖家扛回来,多半是花了冤枉钱还配不明白。保哥帮出海客户选CMP这些年,一条铁律是先看一个硬指标——支不支持谷歌的同意模式v2,不支持的再便宜也直接出局;剩下的,才在价格、部署难度、对GA4数据的影响里挑。这篇就把这套选法摊开讲。 同意管理平台(CMP)是做出海、尤其是碰欧盟市场的独立站绕不开的一块。装它是为了合规,可一旦选错,麻烦比不装还多:要么花了大价钱买一堆用不上的企业功能,要么配置不当把GA4数据搞得稀烂,要么横幅设计糟糕,把好不容易拉来的访客挡在了同意弹窗后面。 这篇笔记不写成一份谁都适用的百科,而是站在出海中小卖家的立场,回答一个很实在的问题:我这样的站,到底该怎么选CMP?从它是干什么的讲起,到四类主流工具各适合谁、大概多少钱、部署后怎么验证生效,最后给一张能照着走的决策清单。 ## 同意管理平台(CMP)到底是干什么的? 先把概念钉清楚。CMP本质上是你网站的“隐私权控制台”,它干的活有这么几样:在用户进站时弹出Cookie同意横幅、管理用户的隐私偏好选择、根据用户的选择去控制各种追踪脚本要不要执行、把每一次同意记录保存下来、以及在需要时产出合规审计报告。 说白了,它是站在你的追踪工具(GA4、谷歌广告、Meta像素这些)和用户之间的一道闸门。用户没点同意,闸门关着,追踪脚本不许跑;用户点了同意,闸门打开,数据才开始正常采集。这道闸门之所以必须有,是因为GDPR、CCPA这些法规要求你在收集用户数据前先拿到合法的同意,而CMP就是帮你合规地拿到、并管理这些同意的工具。 对独立站来说,理解这一点很重要:CMP不是一个可有可无的插件,它直接卡在你所有数据采集的最上游。它配得好不好,决定了你后面看到的所有数据干不干净、合不合规。所以选它、配它,值得你认真对待,而不是随便抓一个免费横幅插件了事。 ## CMP和谷歌的同意模式是一回事吗? 这是新手最容易混的一个点,必须先掰开。一句话区分:CMP负责收集同意,同意模式(Consent Mode)负责传递同意信号。两者是上下游的协作关系,不是二选一。 具体怎么配合?用户在你的CMP弹出的横幅上点了“接受”或“拒绝”,这是CMP的活——它把用户的选择收集下来。可光收集没用,得让谷歌的工具知道用户到底同意了什么,这就轮到同意模式登场了。 同意模式v2用四个信号来传递用户的选择:ad_storage(广告类Cookie)、analytics_storage(分析类Cookie)、ad_user_data(广告数据使用授权)、ad_personalization(个性化广告授权)。CMP拿到用户选择后,通过这四个信号告诉GA4和谷歌广告“这个用户允许了什么、拒绝了什么”,谷歌的工具据此决定怎么采集、采集多少。 这就是为什么选CMP时“支不支持同意模式v2”是头号硬指标——如果你的CMP收集了同意却不会用这套信号传递给谷歌,那这两端就断了,你的GA4和广告投放会因为拿不到正确的同意信号而出问题。谷歌官方的同意模式设置指南 (https://developers.google.com/tag-platform/security/guides/consent)把这四个参数和默认状态怎么配讲得很细,选型时不妨拿它对照,看候选的CMP是不是真的把这套接全了。 ## 出海独立站不装CMP会有什么后果? 有人会想,我做的是欧美生意但又不大,能不能先不装、省点事?这个侥幸最好别有,后果分三层。 第一层是法律风险。GDPR的罚则不是吓唬人的,虽然真正开出天价罚单的多是大公司,但中小站收到投诉、被要求整改、甚至被处罚的案例并不少。你面向欧盟用户收集数据却没有合法的同意机制,这就是个明摆着的合规漏洞。第二层是广告账户风险。谷歌、Meta这些平台越来越要求广告主具备合规的同意机制,不合规可能影响你的广告投放权限和数据回传,这对靠投放吃饭的独立站是实打实的损失。第三层是数据本身的合法性——你在没有同意的情况下收集来的数据,用起来本身就站不住脚。 所以问题从来不是“要不要装CMP”,而是“装哪个、怎么配”。把它当成做欧美市场的入场券,而不是可选项,心态就摆正了。 ## 选CMP该先看哪几个硬指标? 市面上CMP几十家,挑花眼很正常。但其实有几个硬指标能帮你快速筛掉一大半,按优先级排下来是这样。 - 第一硬指标:支持谷歌同意模式v2。只要你用GA4或谷歌广告,这就是底线中的底线,不支持的一律出局,别看它别的功能吹得多好。前面讲过原因,这里不重复。 - 第二硬指标:支持IAB TCF框架。如果你的变现严重依赖欧洲的数字广告生态,那这个由行业组织维护的透明与同意框架就很重要,它是欧洲广告产业链上下游通用的同意标准。纯做自己独立站、不接广告联盟的卖家,这条的权重可以降一些。 - 第三硬指标:体量和预算匹配。这是最容易被忽略、却最影响体验的一条——别拿大企业的工具套小站。功能过剩的工具不仅贵,还配置复杂、维护吃力,对小团队是负担不是助力。 关于IAB的这套框架到底覆盖什么、有哪些参与方,可以参考IAB Europe官方的TCF介绍 (https://iabeurope.eu/transparency-consent-framework/),判断它对你的业务模式有多重要。把这三条硬指标过一遍,候选名单基本就收敛到三五家了。 ## OneTrust、Cookiebot、Osano、Usercentrics各适合谁? 到了最实际的部分——具体几家怎么对号入座。先用一张表把它们的定位摆清楚: 平台 | 定位特点 | 部署难度 | 大致适合谁 | OneTrust | 功能最全、合规覆盖广、跨系统集成强,但重 | 高 | 跨国大企业、集团网站 | TrustArc | 隐私治理完整、顾问服务强,偏强监管行业 | 高 | 金融、保险、医疗类企业 | Osano | 自动分类、部署快、与标签工具集成简单 | 中 | SaaS与中小企业 | Cookiebot | 自动扫描Cookie、支持同意模式v2、门槛低 | 低 | 独立站、电商、内容站 | 把这张表翻译成大白话。OneTrust和TrustArc是企业级重型装备,功能强、合规覆盖全、还配顾问服务,但部署复杂、价格高,是给有专门法务和合规团队的大公司用的。一个中小独立站上这套,好比开货车去买菜,浪费且难开。 Osano和Cookiebot才是大多数出海独立站该重点看的。它们部署轻、上手快、和标签管理工具集成顺,能自动扫描和分类你站上的Cookie,省掉大量手动配置。Cookiebot对支持同意模式v2这点做得到位,门槛又低,是独立站、电商站很顺手的选择。除了表里这四家,中小站常用的还有Usercentrics、Iubenda、CookieYes、Termly这些,定位类似、各有侧重,预算紧的可以重点看它们的免费档或低价档够不够用。选型的关键心态是:你要的是“够用且好配”,不是“功能最全”。 ## 这些工具大概要花多少钱? 价格是选型里绕不开、却又常被各家含糊带过的一块。这里给个量级上的判断,帮你心里有数。 大体分三档。最低一档是免费或几乎免费的——一些中小向的工具针对流量不大的站点提供免费层,功能够基础合规用,适合刚起步、预算紧的独立站先顶上。中间一档是按站点流量或域名数量阶梯计费的中小档,月费从几十到一两百美元不等,功能更全、技术支持更到位,是大多数稳定运营的独立站的合理选择。最高一档是企业级,OneTrust这类通常要走销售报价、按需定制,年费动辄几千上万美元起,这个价位段中小站基本不用考虑。 选价格档的诀窍,是按你真实的流量规模和合规复杂度来定,而不是被销售话术推着往上买。一个月流量几万的独立站,用免费档或低价档完全能满足合规需求,没必要为“以后可能用得上”的企业功能提前掏钱。等业务真做大了、合规要求真复杂了,再升级也不迟。记住,CMP是成本项不是利润项,能用小钱合规解决的,就别花大钱。 还有个常被忽略的成本陷阱:很多CMP按域名数或月独立访客数阶梯计费,看着低价档便宜,可一旦流量涨上去、或者你加了新域名,账单会悄悄往上跳。选之前务必把计费模型问清楚——是按域名算、按流量算、还是按页面浏览算,并对照你未来半年到一年的预期流量,算一笔总账。别只盯着入门价签,被阶梯计费在半路上加了价才回过神。 ## 有好几个独立站,能不能用一套CMP一起管? 做出海的不少人手上不止一个站,可能是同一品牌的多语言站,也可能是几个不同品类的独立站组成的小矩阵。这种情况下,CMP怎么选又多了一层考量。 结论是:能,但要选对类型。大多数成熟的CMP都支持在一个后台账户下管理多个域名,你不用给每个站单独买单独配,在一处统一管理同意策略、统一查看合规记录,省心不少。但要注意两点。第一,前面说的计费——多站往往意味着更高的档位,算总账时把所有站的流量加起来估。第二,不同站如果面向的市场不同(一个主攻欧盟、一个只做美国),你得确认这个CMP能给不同站配置不同的地区策略,而不是一刀切。 对有多站需求的卖家,选型时直接把“多域名管理”列进硬指标,优先看那些后台支持站点分组、能差异化配置的工具。一开始就按矩阵的规模选,比先用单站工具、后面再痛苦迁移要省事得多。反过来,如果你确定短期内就一个站,这条就不必过度纠结,别为用不上的多站能力多付费。 ## 免费的同意插件和付费CMP,差距到底在哪? 预算紧的独立站,最容易在这一步犯迷糊:建站平台的应用市场里一搜,免费的同意插件一大把,看着也能弹横幅,那花钱买CMP图什么?差距其实不小,藏在你看不见的地方。 免费插件大多只做了“门面”——把横幅显示出来,给你几个看着像那么回事的开关。但合规的关键不在显示,而在显示背后那套机制:用户拒绝时,追踪脚本是不是真的被拦住了?同意模式的四个信号有没有正确传递?每一次同意有没有被完整记录下来以备审计?用户来自不同地区,能不能自动适用不同的法规策略?这些免费插件往往要么压根没做,要么做得残缺。结果就是横幅弹得漂漂亮亮,底下该采的数据一点没少采,合规上等于裸奔。 付费CMP贵在哪?贵在它把这套底层机制做全了,而且会随着法规变化持续更新维护。它能自动扫描你站上有哪些Cookie、自动归类、自动对接同意模式,还提供合规记录和技术支持。免费和付费的真正差距,不是“有没有横幅”,而是“是真合规还是装样子”。对碰欧盟市场的独立站,这点差距足以决定你是真的安全,还是抱着颗定时炸弹在运营。 ## 能不能自己写个同意横幅,省掉CMP的钱? 技术好点的团队常冒出这个念头:不就是个弹窗加几个开关吗,自己写一个不就省了订阅费?保哥的建议是——除非你非常清楚自己在干什么,否则别。 原因在于,合规的同意管理远不止“弹个窗”那么简单。一个真正合规的横幅,背后要处理一堆细节:要能真正在用户同意前阻止追踪脚本执行、要正确对接同意模式的四个信号、要完整保存每一次同意记录以备审计、要能识别用户来自哪个地区从而适用不同法规、还要随着法规更新持续维护。你自己写的简易横幅,往往只做了“显示”这一层,底下的脚本拦截、信号传递、记录留存全是空的——看着合规,实则是个花架子,真出了合规问题一查就穿。 所以对绝大多数独立站,用成熟CMP的低价档,远比自己造一个半成品划算。你省下的不只是开发时间,更是把“合规这件容易翻车的事”交给了专门干这个、且会持续跟进法规变化的工具。自研横幅这条路,只有在你有专职合规和开发资源、且有非常特殊的需求时才值得考虑。对大多数人,这是个看着省钱、实则埋雷的选项。 ## 选CMP时,哪些和SEO数据有关的点必须盯住? 这是很多人选CMP时完全没想到、事后却被坑惨的一块。CMP装在数据采集的最上游,它怎么配,直接决定你的SEO和分析数据干不干净。选型时这几点务必盯住。 第一,它会不会拦住统计脚本的首屏加载。有些CMP的默认行为是在用户点同意前,把GA4脚本整个堵在门外,结果用户从谷歌搜索进来的第一个页面浏览根本没被记录,来源信息丢失,这次访问被错记成直接流量。这正是很多站换了CMP之后GA4直接流量莫名暴增 (https://zhangwenbao.com/ga4-direct-traffic-spike-diagnosis.html)的元凶之一。第二,它支不支持同意模式的“无Cookie建模”——配得好的话,即便用户拒绝,谷歌也能基于聚合信号做一定的转化建模,把数据损失降到最低;配不好,拒绝的用户就是彻底的数据黑洞。 第三,横幅的设计会不会伤转化和体验。一个挡住大半屏、关都关不掉的横幅,会实打实地推高跳出、压低转化,这对SEO的用户体验信号也不是好事。选CMP不能只看合规一头,得把它对数据质量和用户体验的连带影响一起算进来。这套同意机制怎么搭进整体的合规架构而不毁数据,是个更大的系统工程,前面聊过的出海合规架构怎么搭才不伤SEO数据 (https://zhangwenbao.com/seo-legal-compliance-gdpr-ccpa-consent-mode-cross-border-architecture.html)那篇讲得更系统,选型定下来后可以接着看。 ## 从0到1部署一个CMP,大致流程是怎样的? 选定工具之后,落地大致是这么几步,心里有个流程图,配起来不至于手忙脚乱。 第一步是接入。把CMP的脚本装到你的站点上,通常是通过标签管理工具,或者直接嵌进页面。这一步要确保CMP的脚本在所有追踪脚本之前加载,因为它得抢在GA4、广告像素动手之前先把同意的闸门架起来。第二步是扫描和分类。让CMP去扫一遍你站上到底有哪些Cookie和追踪技术,再把它们按类别归好——分析类、广告类、功能类等,这决定了横幅上给用户的开关怎么分组。 第三步是配同意模式。把CMP和谷歌同意模式接通,确保用户的选择能正确翻译成那四个信号传出去,并设好“默认拒绝、同意后开启”的逻辑(欧盟场景)。第四步是配地区策略,让欧盟用户走严格的opt-in、其他地区按当地法规走对应模式。第五步是横幅样式,调成既清楚呈现选项、又不杀转化的样子。这五步里,最容易被跳过又最致命的是第一步的加载顺序和第三步的同意模式对接——前者没做好,闸门形同虚设;后者没做好,谷歌工具拿不到正确信号。把这两步当重点盯,部署就成功了一大半。 ## 只做美国市场和要做欧盟市场,选型有什么不一样? 目标市场不同,对CMP的要求差别很大,这点直接影响你该花多少心思、多少钱。 如果你只做美国市场,合规压力相对小一些。美国是州层面的隐私法(以加州的CCPA/CPRA为代表),整体要求不像GDPR那么严,很多场景下“选择退出”(opt-out)模式就够用,也就是默认可以追踪、给用户一个退出的入口即可。这种情况下,一个轻量的CMP甚至基础档就能覆盖,没必要上重型工具。 但只要你的生意碰欧盟、英国这些GDPR管辖区,要求就陡然上一个台阶。GDPR要的是“选择进入”(opt-in),即必须在用户主动、明确同意之后才能追踪,默认状态得是拒绝。这意味着你的CMP必须能正确实现“默认拒绝、同意后开启”的逻辑,还得能按用户所在地区切换不同的合规策略——欧盟用户走严格的opt-in,美国用户走相对宽松的opt-out。所以选型前先想清楚你的核心市场在哪:纯美国市场别过度投入,碰欧盟市场则一定要确认工具能扛住GDPR的opt-in要求和地区识别能力。 ## 同意横幅怎么设计才既合规又不杀转化? 选定工具只是第一步,横幅怎么呈现,是合规和转化之间的一场拉锯。设计得好,合规且不碍事;设计得糙,要么不合规、要么把访客吓跑。这里讲几个平衡点。 先说合规这头的硬要求。“接受”和“拒绝”两个选项要给得同样显眼,不能把拒绝藏到二级菜单、只把接受做成大绿钮——这种诱导式设计在严格地区会被认定为无效同意。横幅的措辞要让用户清楚知道自己在同意什么,不能含糊其辞。这些是底线,踩了就是不合规。 再说转化这头的分寸。在满足合规的前提下,横幅能小就别大、能不挡内容就别挡。一个占据半屏、关都关不掉的弹窗,会实打实地推高跳出率、把人挡在内容之外,对移动端尤其要命。比较稳妥的做法是用底部或角落的条幅式横幅,既清楚呈现了选项,又不至于粗暴打断浏览。合规和体验不是对立的,真正对立的是“合规”和“想偷偷多收点数据的小心思”——你只要老老实实给足选项、又不刻意刷存在感,两头其实能兼顾。这块也直接关系SEO,糟糕的横幅伤的是用户体验信号,谷歌看在眼里。 ## CMP装好之后还要不要定期维护? 很多人把CMP当成“装一次就一劳永逸”的东西,这是个会慢慢出事的误解。隐私法规和行业框架一直在动,CMP是需要跟着维护的。 要维护的地方有几处。一是法规更新——隐私法本身在演进,比如同意模式从v1升到v2、行业的同意框架推出新版本要求成员限期采纳,这些都需要你确认CMP是否跟上、配置是否要调。二是站点本身的变化——你每上一个新的第三方工具、新的追踪脚本,都意味着多了一类需要纳入同意管理的Cookie,CMP的扫描和分类得重新跑一遍,别让新脚本漏在同意机制之外偷偷采集。三是定期复检——隔段时间就该把前面那套验证动作再走一遍,确认同意机制没有因为某次改动而悄悄失效。 把CMP当成一个需要持续照看的合规系统,而不是一劳永逸的摆设,是长期安全运营的基本心态。好在成熟的付费CMP大多会主动推送法规更新、自动重扫Cookie,把维护成本压得比较低——这也正是它比免费插件值钱的地方之一。 ## 部署之后怎么验证同意模式真的生效了? 选定、装好不等于万事大吉,最容易出事的恰恰是“以为配好了其实没生效”。这里给一套验证动作,部署后务必走一遍。 - 看默认状态对不对:在没点同意前,用浏览器的调试工具看同意信号的初始状态,欧盟场景下几个存储类信号应该默认是拒绝(denied),如果默认就是允许,那opt-in根本没实现。 - 看点同意后信号有没有更新:点一下“接受”,确认对应的同意信号从拒绝翻成了允许,且这个更新发生在页面跳转之前。信号没更新,说明CMP和同意模式没接通。 - 看追踪脚本的实际行为:拒绝同意时,确认GA4和广告像素确实没有写入受限的Cookie;同意后再确认它们正常工作。这一步能验出闸门是不是真的在起作用。 - 看GA4里的数据变化是否合理:上线后盯几天数据,部分下降正常,但若直接流量异常飙升或数据断崖式下跌,多半是配置出了问题,得回头查。 谷歌官方反复强调一点:同意的更新必须在任何页面跳转之前完成。验证时把这条当重点,它是最常见的失效原因。 多说一句验证的心态:别嫌这套动作麻烦。装CMP最大的风险不是装不上,而是“以为装好了其实没生效”——横幅弹得好好的,底下的拦截、信号、记录全是空的,你却毫不知情地裸奔了好几个月。这套验证花不了多少时间,却是你确认自己真的安全、而不是自我感觉安全的唯一办法。每次改动横幅配置、加新的追踪工具、或者CMP做了版本更新之后,都值得把它再快速跑一遍。对合规这件事,“看着对”和“验过是对的”之间,隔着的可能就是一张罚单或一段被污染的数据。 ## 装CMP最容易踩的几个坑是什么? 最后把几个高频坑集中拎出来,提前知道能少走弯路。 第一个坑,默认帮用户勾选同意。有人觉得默认勾上能多收点数据,省事又划算——这是典型的合规红线。GDPR明确要求同意必须是用户主动、明确做出的,预先勾选属于无效同意,查到就要罚,省的那点数据远不够赔。第二个坑,横幅设计反人类。把“拒绝”按钮藏得很深、只突出“接受”,或者横幅挡住整个页面关不掉,这既伤用户体验、压转化,在一些严格地区还可能被认定为诱导,属于不合规的“黑暗模式”。 第三个坑,装完不管法规更新。隐私法规和行业框架都在持续演进,CMP需要跟着更新配置,装完扔那儿不管,过段时间可能就不合规了。第四个坑,只测了“显示”没测“拦截”。很多人看横幅弹出来了就以为大功告成,根本没验证拒绝同意时脚本是不是真被拦住——结果横幅是摆设,底下照样在违规采集。这四个坑的共同点是“看着配好了,其实没配对”,避开它们的唯一办法就是认真做前面那套验证。 还有个第五坑值得单拎出来:忽略了同意横幅本身也在被GA4记录这件事,导致数据口径乱掉。横幅弹出和用户交互的过程,如果触发了额外的事件或改变了页面加载时序,可能让你的某些指标读数变得不直观。这不算严重错误,但会在你分析数据时添堵,最好在部署时就把横幅相关的行为对数据的影响摸清楚,免得日后看到诡异读数又得回头排查。说到底,CMP和数据分析是一体两面,选型和部署时多想一层数据侧的影响,后面能省下大量对着报表挠头的时间。 ## 一个DTC独立站换CMP的选型复盘 讲个保哥手上的真实案例。一个做户外用品、主攻欧美市场的DTC独立站,最早图省事装了个免费的简易同意插件,用了大半年,直到某次自查才发现问题一堆:横幅是弹了,可拒绝同意后GA4照样在采集,等于合规上是裸奔;而且这插件不支持同意模式v2,谷歌广告那边的数据回传一直不正常。 重新选型时,团队没有一上来就奔着功能最全的去,而是按硬指标筛。第一刀砍掉所有不支持同意模式v2的,名单立刻短了一截。第二步看预算和体量,这个站月流量中等、没有专职合规人员,企业级的重型工具直接排除。最后在几个中小向工具里,选了一个部署轻、能自动扫描Cookie、对同意模式支持到位的,落在中等价位档,月费在可接受范围。 换上之后做了完整验证:默认拒绝状态正确、点同意后信号正常翻转、拒绝时脚本确实被拦。上线初期GA4数据如预期有小幅下降——那是没同意的用户不再被完整追踪的正常结果,而不是故障。谷歌广告的数据回传也恢复了正常。这个案子的教训很典型:贪图免费插件省下的那点钱,最后用“合规裸奔加数据失真”双倍还了回来。选CMP该花的钱不能省,但也确实不必为用不上的企业功能多花。 这个复盘里还有个容易被忽略的细节值得说。团队一开始之所以踩坑,根子在于把CMP当成了“装个插件应付检查”的事,而不是“卡在数据上游的关键系统”。正是这个认知偏差,让他们既没认真选、也没认真验。换工具时,真正变了的不只是那个CMP,而是他们对待合规这件事的态度——从“弹个窗就算合规”,变成了“得确认底下那套机制真的在工作”。 很多合规事故,表面是工具选错,根上是没把它当回事。等真出了问题——数据失真、广告回传断、甚至收到投诉——再回头补救的成本,远比一开始认真选一次高得多。对所有做欧美生意的独立站,这笔账都值得提前算清楚:选CMP花的是小钱和一点时间,配错CMP赔的可能是数据、广告账户和合规安全这几样里的好几样。 ## 出海独立站CMP选型决策清单 把这篇浓缩成一张能照着走的清单,选型时挨条过,每一条都能答上来再下单,基本就不会买错: - 候选CMP是否支持谷歌同意模式v2?这是底线,不支持的一律直接淘汰,别犹豫。 - 你的核心市场在哪?碰欧盟必须确认它能扛GDPR的opt-in和地区识别。 - 它的价格档和你的真实流量规模、预算匹配吗?别为用不上的企业功能买单。 - 部署难度你的团队扛得住吗?没有专职技术就优先选部署轻、自动化高的。 - 它会不会拦住统计脚本首屏加载、把来源搞丢、推高直接流量? - 横幅设计会不会伤转化和用户体验?拒绝按钮别藏、别挡满屏,移动端尤其要克制。 - 装完是否走了完整验证——默认状态、信号翻转、脚本拦截、数据变化四项都查过? - 计费模型是按域名、流量还是页面浏览算?对照未来半年到一年的预期流量算过总账了吗? ## 常见问题解答 小的出海独立站有必要装CMP吗?只要你面向欧盟等有隐私法规的市场、又用了GA4或广告像素,基本就得装。它负责合规收集同意,没有它,你的追踪可能从一开始就站不住脚。 CMP和谷歌同意模式是一回事吗?不是。CMP负责弹横幅、收集用户的同意选择;同意模式负责把这个选择翻译成信号传给谷歌的工具。两者要搭配用,CMP在前、同意模式在后。 选CMP最该先看哪个硬指标?先看它支不支持谷歌同意模式v2。你只要用GA4或谷歌广告,这一条就是底线,不支持的直接淘汰,别管它别的功能多花哨。 Cookiebot、OneTrust这些差别大吗?怎么选?差在体量和价格。OneTrust偏大企业、功能全但重;Cookiebot、Osano这类部署轻、上手快,更适合中小独立站。按你的规模和预算选,别为用不上的企业功能买单。 装了CMP之后GA4数据掉了一大截正常吗?部分掉是正常的,因为没同意的用户不再被完整追踪。但掉得过猛要查配置,可能是同意模式没配好、或横幅把统计脚本整个拦死了,这种要修。 同意横幅默认帮用户勾选同意行不行?不行,这是典型的合规红线。GDPR要求同意必须是用户主动、明确做出的,默认勾选属于无效同意,查到要罚,省的这点数据远不够赔。 ## 权威参考资料