小语种的问答长尾没多少人搜,可整个语种里认真写完整回答的也没几家
本文目录
- 英文那套长尾算法搬到小语种,为什么会失灵?
- 长尾模型有两个没写出来的前提
- 词形变化把每条的量又摊薄一次
- 工具的零不等于需求的零
- 条数少了之后,整个模型的经济性就变了
- 换个方向问:这门语言里有多少人在认真写回答?
- 把问题从需求侧挪到供给侧
- 供给侧稀缺度怎么量
- 稀缺度和搜索量是两条独立的轴
- 富结果被砍掉之后,写问答的理由还剩什么?
- 那两次削减动了什么
- 英文市场消失的那个动机,小语种从来没有过
- 小语种写问答的动机在别处
- 怎么判断你的语种属于哪一档供给?
- 第一档:本地有活跃的问答社区
- 第二档:只有零散的论坛帖和评论区
- 第三档:几乎没有原生问答内容
- 三档各自的动作完全不同
- 疑问句在你的语言里会不会改写实词?
- 不改写的语言:加个疑问词就行
- 改写的语言:动词形态跟着变
- 语序型:靠位置提问,正则筛不出来
- 三类语言的关键词表要分开建
- 这门语言的问句到底长什么样?
- 疑问词表怎么建
- 口语问法和书面问法的差距
- 拼写错误和缩写要不要收
- 一个问题该占一个页面,还是只占一段?
- 独立页的适用条件
- 集中页的适用条件
- 嵌在正文里的适用条件
- 三种形态的判定顺序
- 回答要写多长,才既被人读也被机器摘?
- 第一段就要把答案说完
- 后面几段解决为什么和例外
- 长度按信息单元数控制,不按字符数
- 怎么验证这批内容有没有白写?
- 三个月内该看哪几个数
- 别用总流量判断
- 留对照组的做法
- 哪些语种现在就该停手?
- 停手的两个信号
- 停手之后资源往哪挪
- 常见问题解答
- 小语种的长尾内容还值得写吗?
- 怎么量一门语言的内容供给有多稀缺?
- 富结果被砍了,问答内容是不是该跟着砍?
- 一个问题该独立成页还是并进现有页面?
- 各语言的疑问句差别有多大,词表能不能共用?
- 回答写多长合适?
- 三个月看不到流量,该不该停?
- 权威参考资料
摘要:英文长尾的逻辑是单条量小但条数极多,靠数量取胜。换到小语种,词形变化把每条的量又摊薄一次,工具还测不到,条数和量同时缩水,这个模型就不成立了。但问答内容在小语种里仍然值得写,理由不在需求那一侧:这些语言的网页里,肯把一个问题从头到尾讲清楚的页面本来就没几个。
英文那套长尾算法搬到小语种,为什么会失灵?
长尾模型有两个没写出来的前提
英文世界讲长尾,讲的是一条曲线:头部几百个词占掉一半流量,剩下一半散在几十万个词里。
这条曲线成立要靠两个前提。第一个前提是尾部足够长,也就是不同写法的数量足够多。
第二个前提是每一种写法都有人搜,哪怕一个月只有三次。三次乘以几十万,仍然是个可观的数字。
这两个前提在英文里都成立,所以长尾策略在英文站上是个稳赚的买卖。
换到一门使用者只有八百万的语言,第二个前提先垮。一个月三次这种量级,在小盘子里直接变成零。
但真正致命的是第一个前提也会垮,而且垮的方式跟大多数人预期的相反。
直觉上会觉得语言越小,写法应该越集中,尾巴应该更短。实际情况更微妙:写法的种类不但没少,反而因为词形变化多出好几倍,可是每一种写法分到的搜索次数被切得更碎,碎到统计工具直接把它记成零。尾巴变长了,但整条尾巴的高度被压到了地面以下,这跟尾巴变短是两回事,处理办法也完全不同。
词形变化把每条的量又摊薄一次
拿一个具体的例子说。园艺工具里有个常见品类,中文叫修枝剪。
在英语里,用户搜的写法基本就是单复数两种,再加一两个同义说法。
在芬兰语这种有十五个格的语言里,同一个名词能变出十几种形态,而且词干本身还会跟着变。
用户在搜索框里打的是哪一种形态,取决于他脑子里那句话的语法结构。
于是一个在英语里量级是一千的词,在这门语言里可能被切成十四份,每份七十。
七十这个数字在多数工具的显示门槛之下,于是它们统一显示为零或者没有数据。
工具返回的那个零是数据缺口不是需求缺口,这条老结论在长尾这件事上表现得最刺眼:越是长尾,被摊薄得越厉害,被记成零的概率越高。也就是说工具的失明区域,跟你最想开发的区域,几乎完全重合。
词干还原本来是用来对付这件事的。公开的词干算法把一门语言的变形规则写成了可执行的步骤,把十几种形态归回一个词根。问题是关键词工具的量是按具体形态统计的,归并发生在你这一侧,工具那一侧的零早就已经报出来了。
工具的零不等于需求的零
这里要分清两种零。第一种是真的没人搜,第二种是搜的人数低于工具的统计精度。
两种零在界面上长得一模一样,都是一个横杠或者一个零。
区分它们的办法不在工具里,在你自己的日志里。站内搜索框的记录、客服的聊天记录、评论区的提问,都是一手材料。
保哥做园艺工具那个项目时,让团队把一年的客服对话导出来做词频,结果拉出三百多条问句,其中八成在关键词工具里查不到任何数据。
这三百条不是凭空想出来的,是真实用户一个字一个字打给客服看的。
所以工具说没有需求的时候,正确的反应不是相信,也不是不信,而是去找第二个数据源来交叉验证。
交叉验证还有一层意义:客服记录里的问法是最口语的,跟用户在搜索框里的打法高度接近,比正式的产品文案更接近真实查询。很多团队做小语种关键词表的时候,翻遍了竞品页面却从来没打开过自己的客服后台,这份材料就躺在公司内部,一分钱不要。
条数少了之后,整个模型的经济性就变了
假设你在英语里做长尾,投入一千篇内容,每篇每月带来十次点击。
换到一门小语种,同样一千篇,每篇每月可能只有一次点击。
如果内容的生产成本是一样的,这笔账立刻变得不划算。
而小语种的生产成本通常还更高,因为要找母语写手,或者要过一轮审校。
成本更高、单产更低,两头一挤,纯按流量算账的话结论就是不做。
所以很多团队做到这一步就停了,这个决策在自己的算法框架里是自洽的。
但这个框架本身有个盲点:它把内容当成一个只有流量产出的东西。一旦你把被引用、被复制、被当成参考答案这些也算成产出,账就完全不一样了,而这些产出恰恰跟你写得好不好、别人写得多不多有关,跟搜索量的绝对值关系不大。
把这笔账再拆一层会更清楚。英文市场对长尾的标准定义里,判断一个词属不属于长尾靠的是搜索量的绝对值。这个定义在小语种里直接失效,因为整门语言的搜索量都低于那个阈值,照它划的话所有词都是长尾,一个能用的分类都得不到。
换个方向问:这门语言里有多少人在认真写回答?
把问题从需求侧挪到供给侧
前面那笔账算的是需求:有多少人在搜。现在换一个问法,算一算供给:有多少人在写。
这个切换看着简单,结论会反过来。因为需求和供给在小语种里都很小,但缩水的比例完全不同。
需求侧缩水,是按使用人口的比例缩的。八百万人口的语言,需求大约是英语的百分之一。
供给侧缩水的比例要夸张得多。网页内容的语言份额统计里,排在十名开外的语言份额已经掉到千分之几。
而且网页数量还不等于回答数量。小语种的网页里,商品页、目录页、新闻页占了绝大多数。
把一个问题从头到尾讲清楚的页面,在这些语言里稀少到可以手工数完。
这就是本文的核心:需求侧按人口比例缩,供给侧按更陡的比例缩,两条线之间张开了一个口子。你要评估的不是这门语言的搜索量够不够养活一批内容,而是这个口子有多宽。口子越宽,同样一篇内容能占到的相对位置就越靠前。
这个切换还有一个附带效果:它把评估的主动权拿了回来。需求侧的数字要靠外部工具,工具说没有你就没辙;供给侧的数字自己就能测,打开搜索结果数一遍即可,不依赖任何人的数据源。对一个连关键词工具都覆盖不到的语言来说,能自己测出来的指标本身就是稀缺品。
供给侧稀缺度怎么量
量法不用复杂,二十分钟能做完。挑十条你的品类里最典型的问句。
每一条在目标语言的搜索结果里看前二十条,数一下有几条是在正面回答这个问题的。
正面回答的定义要卡死:有一段完整的文字直接说明结论,而不是一个商品列表或者一句宣传语。
十条查询乘以二十条结果是两百格,数出来的比例就是这门语言这个品类的供给密度。
英语里做同样的动作,这个比例通常在四成以上。小语种里能到一成就算高的。
我在几门欧洲小语种上做过这件事,最低的一门只有百分之三,两百格里六格。
这个数字要按品类分别测,不能一门语言测一次就套用到全站。同一门语言里,消费电子的供给密度可能不低,而园艺、家居维修这些品类几乎空白,因为写这些内容的人不在互联网内容产业里。供给密度是语言和品类的交叉属性,不是语言的属性。
稀缺度和搜索量是两条独立的轴
把这两个指标画成一个坐标系,横轴是搜索量,纵轴是供给稀缺度。
右上角是量大且没人写,这种格子基本不存在,存在也早被人占了。
右下角是量大但写的人也多,这是英语市场大部分品类的位置,竞争激烈。
左上角是量小但几乎没人写,这正是小语种问答内容的典型位置。
左下角是量小写的人也不少,这种组合意味着别人比你更懂这个市场,该退。
四个格子里,只有左上角适合用低成本的方式持续投入,而它恰好是纯按搜索量排序时最先被砍掉的那一格。
这个坐标系还有一个用法:把它跟生成式搜索的语种覆盖顺序叠起来看。已经被覆盖的语言,左上角的价值兑现得更快;还没被覆盖的语言,左上角的内容会先以常规形式积累,等覆盖过来再一次性兑现。两种情况都不构成不做的理由,只是回报时间不同。
富结果被砍掉之后,写问答的理由还剩什么?
那两次削减动了什么
今年八月和九月,搜索结果页上两类富结果被大幅削减。
八月那次动的是问答型标注的展示范围,从所有站点收窄到政府和医疗类站点。
九月那次动的是操作步骤型标注,桌面端的展示被整个取消。
对英语市场的内容团队来说,这两次改动砍掉的是一个非常具体的动机。
过去几年,很多站写问答段落的理由就是拿那个额外的展示位,占屏面积大,点击率高。
展示位没了,这个理由自然也就没了,于是一批团队开始把问答内容列进裁撤清单。
值得注意的是这两次削减都只动了展示层,没有动内容层。标注还在,页面上的问答段落也还在,被拿掉的只是结果页上那个额外的展现形式。这个区分很重要,因为把展示层的变化当成内容层的判决,是这一年里我见过最多的一次误读。
英文市场消失的那个动机,小语种从来没有过
把时间倒回去看,小语种站写问答内容的时候,很少是冲着富结果去的。
原因很朴素:那些额外的展示形式在小语种里的出现率本来就低得多。
标注要生效,需要搜索引擎对这门语言的解析足够有把握,而这份把握在小语种上一直是不足的。
所以小语种团队即使做了标注,看到富结果的概率也远低于英语站。
既然从来没吃到过这块红利,红利取消这件事对他们就没有实质影响。
这是一个少见的情形:一次让英语市场重新算账的改动,在小语种市场那边的输入项根本就是零,账不用重算。
这一点在内部沟通时要说清楚,否则总部按英语市场的结论下一刀切的指令,小语种这边跟着砍,砍掉的是自己本来就没吃到红利、但另有理由存在的那部分内容。这种因为口径不同而被误伤的情况,在跨市场的内容治理里出现得比想象中频繁。
小语种写问答的动机在别处
动机一共三条,跟富结果一条都不沾。
第一条是覆盖用户真实的问法。很多语言的疑问句形态跟陈述句差很远,不专门写就接不住。
第二条是填供给空白。前面那个供给密度的数字已经说明了空白有多大。
第三条是给机器提供可摘取的段落。生成式结果需要的是一段能独立成立的回答,而不是一整页商品。
三条动机里,第三条是这一年才明显起来的,前两条在此之前就一直成立。
换句话说,就算把生成式搜索这一层整个拿掉,前两条理由也足够支撑这件事。
把动机拆清楚有个实际好处:将来任何一次结果页改版,你都能对照这三条看它动的是哪一条。动了第三条就调整回答的写法,前两条没被动到就不用改战略。动机拆得越细,对外部变化的反应就越精确,也越不容易被裹挟着做整体性的决定。
怎么判断你的语种属于哪一档供给?
第一档:本地有活跃的问答社区
判定动作很简单:拿你测供给密度那十条查询,看结果里有没有反复出现同一个本地社区域名。
如果有,而且它们排在前几位,说明这门语言有成规模的原生问答供给。
这一档的典型代表是几门东亚语言和几门大的欧洲语言,本地社区体量都不小。
在这一档里写问答内容,你面对的是真实竞争,而且对手的内容是真人写的、带具体经历的。
硬碰硬地写通用问答,赢面不大。正确的做法是往社区覆盖不到的地方去。
社区覆盖不到的通常是三类:需要专业设备才能验证的、涉及最新法规的、需要长期跟踪才能回答的。
还有一类容易被忘掉:需要把两三个来源拼起来才能回答的问题。社区里的回答是一个人凭一次经验写的,很少有人会为了回答一个问题去查三份资料再交叉。这类需要整合的问题,正是内容团队相对个人回答者唯一稳定的优势,而它跟语言大小无关。
第二档:只有零散的论坛帖和评论区
这一档最常见。搜索结果里能看到讨论,但都散落在通用论坛、社交平台的截图、商品评论区里。
特征是内容存在但不成形:没有标题,没有结构,一个帖子里混着三个不相干的问题。
这一档是最好的机会区。需求被证实存在,供给却处于未组织状态。
你要做的不是创造需求,是把已经存在的散装讨论重新组织一遍。
方法上很省力:把论坛里出现频率最高的十个问题挑出来,每个写一段结构清楚的回答。
这批内容的可信度还有个天然来源,就是它源自真实讨论,不是凭空想的选题。
操作时有一条纪律要守住:只借问题,不搬答案。把别人帖子里的回答改写一遍发到自己站上,既有版权风险,也丢掉了这件事的全部意义。问题是公共的,答案必须是你自己的,最好还带上你这边能提供而个人回答者提供不了的东西,比如实测数据、多个型号的对比、或者官方口径的核对结果。
第三档:几乎没有原生问答内容
这一档的特征是,你测的十条查询里,有七八条的前二十位全是商品页和目录页。
连零散讨论都很少,用户似乎从来没在这门语言里公开问过这些问题。
这时要先排除一个可能:用户可能在用另一门语言问。多语言市场里这种情况很普遍。
比如某些市场的用户遇到技术问题时直接用英语搜,因为他们知道本地语言里没有答案。
如果确认是这种情况,那么写本地语言的问答内容确实收益有限,用户根本不在这门语言里提问。
如果不是,也就是用户确实在用本地语言问但找不到答案,那这就是最好的一档:需求存在,供给为零。
区分这两种情况的办法是看站内数据而不是外部工具。你的站如果同时有本地语言版和英语版,看看本地市场的用户实际访问的是哪一个版本、在哪个版本上停留更久、从哪个版本下单。这个判断只要有一个月的数据就能做出来,比任何外部推测都可靠。
三档各自的动作完全不同
第一档的动作是差异化:挑社区答不了的问题,用整合和实测建立优势。
第二档的动作是组织化:把散装讨论重新梳理成结构清楚的回答。
第三档的动作是先验证再投入:确认用户是否真的在用这门语言提问,确认了再动手。
三档的投入强度也不同。第二档投入产出比最高,第一档次之,第三档最不确定。
如果预算只够做一档,选第二档,几乎没有例外。
而多数团队的默认做法是按语言的市场规模排预算,排出来的顺序跟这个恰好相反。
按市场规模排预算之所以在这件事上会错,是因为市场规模同时决定了需求和竞争,两者相互抵消。而供给密度只决定竞争,不决定需求,所以它是一个更干净的排序指标。凡是同时影响正反两侧的指标,都不适合单独拿来排优先级。
三档之间是会迁移的,而且迁移方向通常是从第三档往第二档走。一门语言的互联网内容一旦开始积累,最先出现的就是零散讨论。所以这个分档每年要重测一次,去年判成第三档的语言今年可能已经进了第二档,而第二档正是投入产出比最高的那一档,错过它的窗口有点可惜。
疑问句在你的语言里会不会改写实词?
不改写的语言:加个疑问词就行
先说最省事的一类。有些语言的疑问句就是在陈述句前面加一个疑问词,其余部分原样不动。
印尼语属于这一类。问怎么样在句首加一个词,句子的其他成分基本不变。
印尼语的书写与语法概览里能看到,它的动词不随人称和时态变形,这在做关键词表时是巨大的便利。
这一类语言里,问答内容的关键词表可以直接从陈述型关键词表推出来。
做法是把疑问词当成前缀,跟原有的词组做笛卡尔积,再筛掉不通顺的组合。
一张两百行的陈述词表,配六个疑问词,能推出上千个候选,人工筛一遍留下三百个。
这类语言还有个额外的好处:陈述式的页面和疑问式的页面在字面上高度重合,同一个页面往往能同时接住两类查询,不必为问答内容单独建页。这也意味着在这类语言里,问答内容的边际成本特别低,几乎就是在现有页面上多加一个小标题的事。
要确认一门语言属不属于这一类,可以查它的语法概况。语言数据库里的条目会标明它的形态类型。孤立语和分析型语言基本都落在这一类,这也解释了为什么东南亚几门语言的关键词工程量明显小于欧洲那几门屈折语。
改写的语言:动词形态跟着变
另一类语言里,把陈述句变成疑问句会牵动实词本身。
日语是最典型的例子。问句和陈述句在动词的形态上就不一样,礼貌层级还会再叠一层变化。
敬语层级会整段改写动词这件事,在疑问句上表现得更集中。
结果是,用户打出来的问句形态和你页面上写的形态,字面可能一个字都对不上。
这一类语言的问答关键词表必须单独建,不能从陈述词表推。
建表的原料只能来自真实语料:客服记录、站内搜索、社区帖子标题。
屈折程度高的语言在这里还要再加一层麻烦,因为疑问句里的名词可能还要换一个格。屈折语里锚文本的精确匹配本来就是假的,到了问句上,连能不能对上都成了问题。
韩语是另一个例子。它的疑问句要换一套句尾形态,而且这套形态还跟对话对象的关系挂钩。依存句法项目里韩语的形态标注说明把这些变化列得很清楚,可以拿来估工作量。估出来的结论通常是:这类语言的问答词表得单独排一个人月,不能算进原有词表的维护里。
语序型:靠位置提问,正则筛不出来
第三类最麻烦。有些语言的疑问句不靠疑问词,靠语序调整或者句末的语气成分。
这类句子里可能一个疑问词都没有,只是把动词提到了前面。
用带疑问词的正则去筛报表,这一类问句会被整批漏掉。
漏掉的后果是你会低估这门语言的问答型流量占比,进而低估这件事的价值。
解决办法不是把正则写得更复杂,而是换一个入口:从站内搜索日志里看真实的句式分布。
站内搜索没有筛选规则的问题,用户打什么就记什么。
另一个务实的办法是承认这个偏差并把它写进口径。如果你知道这门语言的疑问句有三成不带疑问词,那么正则筛出来的比例乘一个固定的修正系数,虽然不精确,但至少前后一致,趋势判断不受影响。一个已知方向的系统偏差,远比一个不知道存不存在的偏差安全。
还有一个更隐蔽的漏法:有些语言把疑问语气放在句子最后一个音节上,写下来只是一个很短的助词。这个助词在分词时经常被当成噪声去掉,于是查询到了报表里就变成了纯陈述句。碰到这类语言,报表侧的筛选基本可以放弃,直接以站内搜索日志为准。
三类语言的关键词表要分开建
把三类归拢一下:不改写的可以推导,改写的必须采集,语序型的要靠日志。
三种建表方式的成本差别很大,从低到高大概是一比三比五。
做多语言排期时,这个成本差应该直接体现在工时估算里,而不是按语言数量平均分。
判断一门语言属于哪一类,只要找一个母语者问一个问题:把这句陈述变成问句,哪些词会变。
回答如果是不用变,第一类;如果指着动词说这个要变,第二类;如果说词不变但顺序要换,第三类。
一门语言三分钟出结论,十门语言半小时排完。
这个判据的可靠性来自它问的是母语者的直觉而不是语法知识。不需要对方懂语言学,也不需要查资料,任何一个说这门语言的人都能立刻回答。依存句法标注项目里各语言的形态特征说明可以用来事后核对,但不必拿它当第一手判据,那样反而慢。
建表之前还有一步值得做:把语言和地区分开标注。同一门语言在两个地区的口语问法可能差得很远,而语言标签规范里语言与地区子标签的分离写法正好给了你一个现成的结构。词表里多一列地区,将来要拆的时候不用重做。
这门语言的问句到底长什么样?
疑问词表怎么建
先列这门语言里最常用的六到八个疑问词,覆盖怎么、什么、多少、哪个、为什么、什么时候几类意思。
每个疑问词后面接的语法结构不一样,要分别记一个示例句。
然后把品类词代进去,看哪些组合读起来自然,哪些明显不通。
这一步必须母语者过一遍,机器判断不了自然不自然。半小时的事。
建完之后这张表几乎不会过时,疑问词是语言里最稳定的那一层,十年也不会变。
相比之下品类词每两年就要更新一次,所以两张表要分开维护,不要合成一张。
这张表还有个隐藏用途:它可以直接拿来做报表的筛选规则。把六到八个疑问词写进正则,就能把问答型查询从总曝光里分出来,这个比例是判断这门语言值不值得继续投入的核心指标之一,也是覆盖前那几条基线曲线里最先要存的一条。
如果手边没有母语者,还有个替代办法:去看公开的多语言问答数据集。按语言类型多样性挑语种建的那套问答数据里,每门语言都有大量真人写的问句,直接看它们的开头结构就能把疑问词摸个八九不离十。免费,而且比凭空想靠谱得多。
口语问法和书面问法的差距
多数语言里,人写下来的问法和嘴上说的问法不是一回事,差距的大小按语言而定。
差距小的语言,一套词表够用。差距大的语言,得建两套。
判断差距的办法是看同一个问题在社区帖子标题里和在正式文章标题里怎么写。
如果两者结构明显不同,说明这门语言的语域分层比较硬,得分开处理。
用户在搜索框里打的通常介于两者之间:比口语正式,比书面随意。
所以词表要以搜索日志里的实际写法为准,社区和文章只是两个参照极。
语音输入把查询整体推向口语那一端的趋势在小语种市场同样存在,而且因为这些市场的移动端占比更高,推动力比英语市场还大一些。这意味着口语那一套词表的权重会逐年上升,两套表的比重要每年重新分配一次。
两套词表并不意味着两套内容。多数情况下是同一篇回答,标题用书面问法,正文第一段里把口语问法原样复述一遍。这样两种打法都能对上,页面却只有一个。分成两个页面去接两种问法,是这件事上最常见也最费力不讨好的做法。
拼写错误和缩写要不要收
带变音符号的语言里,用户经常不打符号。这算不算错误,要不要收进词表。
我的做法是收,但单独标记,不跟标准拼法混在一起。
原因是这两类词的处理方式不同:标准拼法用来写标题和正文,非标准拼法用来做覆盖检查。
覆盖检查的意思是确认搜索引擎能把两种拼法归到一起,如果能,你就不用为它单独做页面。
缩写的情况类似。有些语言的社区里流行大量缩写,正式内容里从不出现。
缩写一般不进标题,但可以在正文里出现一次,作为一个理解上的桥。
这里有个反面案例值得说。有个团队为了覆盖非标准拼法,专门建了一批只改拼写的页面,结果这批页面互相竞争,把原本表现不错的标准拼法页面也拖了下去。覆盖变体的正确位置是同一页的正文里,不是一批新页面,这条在同语言内部的页面竞争那一层已经讲得很清楚了。
一个问题该占一个页面,还是只占一段?
独立页的适用条件
独立成页的条件有三条,要同时满足。
第一,这个问题的完整回答需要超过八百字,而且展开之后信息密度不掉。
第二,这个问题在搜索日志里有稳定的、可识别的查询量,不是偶发的。
第三,回答的内容跟你现有的任何页面主题都不重合,塞进去会显得突兀。
三条里少任何一条,独立成页都是亏的:页面会太薄,或者会跟老页面互相抢。
小语种站尤其要克制,因为页面总数少的时候,每多一个薄页面对整站的稀释都更明显。
还有一条实操上的提醒:独立页一旦建了就要长期维护,而小语种站的维护人力通常是最紧的。判断一个问题该不该独立成页时,把两年后谁来更新它这个问题一起考虑进去,能砍掉一半的候选。
还有一条容易被忽视的判据:这个问题会不会随时间失效。涉及具体型号、当季价格、临时政策的问题,写成独立页之后过一年就成了负资产,改也不是删也不是。这类问题更适合放进集中页,改起来只动一段,不牵动整个页面的存在。
集中页的适用条件
集中页就是把十几二十个相关问题放在同一页,每个一段回答。
适用条件是这些问题彼此相关、单个回答都不长、而且用户经常一次问好几个。
典型的场景是配送、退换、保修这类政策型问题,用户脑子里本来就是一串。
集中页在小语种站里性价比最高,因为它用一个页面接住了一批长尾查询。
做集中页有个细节:每个问题要用独立的小标题,并且标题就是问句本身。
这样每一段都能被单独定位,也能被单独摘出来,不至于整页一锅粥。
集中页还有一个常被忽略的好处:它天然适合小语种的内容生产节奏。你不需要一次凑够一篇文章的量,攒够三五个问题就能先发一版,之后每季度往里加几条。这种可增量的形态,对一个只有半个人力的语言版本来说,比任何长篇规划都现实。
嵌在正文里的适用条件
第三种形态是把问答直接写进现有页面的正文,不单独立段也不建新页。
适用条件是这个问题跟页面主题强相关,而且回答只要两三句话。
比如商品页上关于尺寸怎么选的问题,写进商品描述里比单独建页合适得多。
这种做法的好处是零新增页面,坏处是可摘取性差一些,因为它没有独立的标题。
折中办法是给它一个小标题,标题写成问句,但不单独成页。
这样既保住了可定位性,又没有增加页面数量。
选这一形态还有个隐含前提:现有页面本身要有一定的权重和收录状态。如果这个页面自己都进不去索引,把回答塞进去等于埋掉。所以嵌入的对象要挑表现好的页面,别挑那些正等着被优化的页面。
嵌入的时候位置也有讲究。放在页面最底部的问答段落,被摘取的概率明显低于放在正文中段的。合理的位置是紧跟在与这个问题相关的那段描述之后,形成一个自然的追问。硬塞到页尾的那种,读者不看,机器也不容易判断它跟主题的关系。
三种形态的判定顺序
判定顺序是从省事的往费事的走,而不是反过来。
第一问:能不能嵌进现有页面。能就嵌,判定结束。
第二问:能不能跟其他问题合成一个集中页。能就合,判定结束。
第三问:三条独立成页的条件是否全部满足。全满足才建新页。
这个顺序能把新增页面的数量压到最低,而小语种站最怕的就是页面数量失控。
照这个顺序走,一百个候选问题最后大概只有五到十个会变成独立页面。
顺序反过来做的团队,通常会在半年后得到一百个只有三百字的页面,然后花另外半年把它们合并掉。这个来回我见过不止一次,而它完全可以靠一个三问的判定表避免掉,成本是开会时多花二十分钟。
这个判定表最好写在一张纸上贴出来,因为它真正的作用是拦住临时起意。选题会上有人提出一个问题很值得写一篇,判定表能立刻把讨论拉回到三个具体条件上,而不是变成对这个问题重不重要的主观辩论。省下来的会议时间比省下来的页面还多。
回答要写多长,才既被人读也被机器摘?
第一段就要把答案说完
不管后面写多少,第一段必须是一个能独立成立的完整回答。
独立成立的意思是:把这一段单独摘出来,读的人不需要看上下文也能明白。
所以第一段里不能出现这个、上面提到的、如前所述这类指代。
也不能只给一半答案然后说详见下文,这在可摘取性上等于没有答案。
结论要放在第一句,理由放第二句,边界条件放第三句。三句话结构最稳。
用户在网页上的阅读方式是扫而不是读,这条老结论跟机器摘取的需求指向了同一个写法,算是难得的一致。
把结论前置这件事在有些语言里会有点别扭,因为它们的书面习惯是先铺陈后结论。这时候要做的不是照搬语言习惯,而是在结论前面加一个极短的引子,一句话十来个字,既照顾阅读习惯又不影响摘取。母语审校常会建议把引子加长,这一条要顶住。
后面几段解决为什么和例外
第一段给结论,后面的段落负责回答两件事:为什么是这个结论,什么情况下不成立。
为什么那一段要给出机制或者依据,不能只是把结论换个说法再说一遍。
例外那一段是小语种内容里最有价值的部分,因为它通常涉及本地的具体条件。
本地的税费规则、本地的配送时效、本地常见的电压和接口标准,这些在通用回答里永远不会出现。
写清楚例外,等于给这篇回答加了一个别人抄不走的部分。
而抄不走的部分,正是在被引用这件事上最容易胜出的部分。
例外这一段还有一个好处:它是判断内容有没有本地化到位的最直接的检验。一篇小语种问答如果通篇没有任何只在这个市场成立的信息,那它多半是从别的语言翻过来的,读者感觉得到,母语审校的验收清单里也应该把这一条列成硬项。
长度按信息单元数控制,不按字符数
写多长这个问题,用字符数回答在跨语言的场景下总是错的。
同一段内容翻成不同语言,长度能差出四成,按字符数定的上限在一半语言上不适用。
换成数信息单元:一个结论算一个,一条依据算一个,一个例外算一个,一个数字算一个。
一段完整的问答回答,五到八个信息单元是合适的区间。
低于五个显得单薄,高于八个用户读不完,机器摘取时也容易只取到前半截。
这个口径的好处是它跨语言稳定,翻译不会改变事实的条数,验收时人工数一遍就行。
信息单元这套数法还能顺手解决另一个问题:不同语言版本之间的内容一致性检查。以前要靠对照译文,现在只要数两边的单元数对不对得上,差一个就说明有内容在翻译过程中掉了。这个检查一个不懂目标语言的人也能做。
顺便说一个容易被漏掉的单元:本地格式本身就算一个信息单元。价格用什么分隔符、日期怎么排、单位写不写,这些在区域数据的数字与货币格式定义里都有标准答案,写对了读者会觉得这段话是本地人写的,写错了整段的可信度都要打折。
怎么验证这批内容有没有白写?
三个月内该看哪几个数
第一个数是这批页面的收录比例。小语种站的收录本来就慢,这个数先看。
第二个数是问答型查询带来的曝光量,用前面那张疑问词表做筛选。
第三个数是这批页面的平均排名位置,看它有没有在往上走。
三个数都不是流量,因为三个月内小语种问答内容的流量绝对值一定很难看。
用一个必然难看的数去做判断,结论只能是砍掉,而这个结论是被指标选择逼出来的。
零搜索量关键词到底有没有用这个老问题,本质上就是在争论该用哪个指标来判它的死活。
第四个数可以看但不必强求:这批页面被站内其他页面引用的次数。如果你的内链是按主题自动生成的,问答页会自然地被引用进来,引用次数上升说明这批内容在站内的语义位置站住了。这个数比外部指标反应更快,两三周就能看到变化。
别用总流量判断
总流量在这件事上是最没用的指标,原因有三个。
第一,问答内容带来的流量在总量里占比很小,被大盘波动淹没。
第二,小语种站的总流量本来就受季节和汇率影响大,噪声比信号强。
第三,这批内容的价值有一部分不落在自身流量上,落在被引用和被复制上。
被复制这件事听着像坏事,其实是个正面信号:说明你的回答成了这门语言里的参考答案。
参考答案的位置一旦占住,后来者要么引用你,要么绕开这个问题。
要监测被引用和被复制,做法很土但有效:把回答里那句最独特的话拿去搜一遍,看有多少个域名出现了几乎相同的表述。每季度做一次,十分钟。数字在涨,说明你写的东西正在这门语言里扩散,哪怕自身流量还没起来。
留对照组的做法
选两个条件相近的品类,一个做问答内容,一个不做,同期观察。
条件相近的意思是流量量级接近、季节性接近、没有在跑其他改动。
三个月后比较两组在问答型查询上的曝光变化,差值才是这件事的真实效果。
没有对照组的话,任何变化都可以被解释成大盘波动,谁也说服不了谁。
对照组的成本是零,只是少做一个品类,而这一个品类的机会成本远小于结论不可信的代价。
选对照组时要避开正在做促销的品类,也要避开刚上新品的品类,这两类的自然波动太大。
对照组做完之后,那个不做的品类要补上,而且要记得补。我见过一个项目把对照组一直空着,两年后才想起来那个品类从来没做过问答内容,白白空了两年。对照组是实验设计,不是长期策略,实验结束就该收口。
对照组的结论还有一个额外用途:它是你下次申请预算时唯一拿得出手的东西。没有对照组,你只能说做了之后数据涨了;有对照组,你能说做了的那组比没做的那组多涨了多少。这两句话在预算会上的分量完全不一样,而成本差只是少做一个品类。
哪些语种现在就该停手?
停手的两个信号
第一个信号:用户在这门语言里根本不提问,他们用另一门语言问。
这个信号靠站内数据判断,看本地市场的用户实际访问哪个语言版本、在哪个版本停留更久。
确认之后,把问答内容做在他们实际使用的那门语言上,而不是名义上的本地语言。
第二个信号:本地问答社区已经把这个品类的常见问题答得又全又好。
这时候硬碰硬地写通用问答,投入产出比会很差,除非你能拿出实测或者整合类的内容。
两个信号里出现任何一个,就该重新评估,而不是继续按原计划铺量。
要强调的是停手不等于放弃这个市场。停的是通用问答这一种内容形态,其他形态照做。同一个词在两个市场问的不是一件事,同理,同一种内容形态在两个市场的价值也可以差得很远,停掉一种形态是正常的排期调整,不是市场判决。
停手之后资源往哪挪
第一个去处是把资源挪到供给密度更低的品类上,还是同一门语言。
前面说过供给密度是语言和品类的交叉属性,同一门语言里不同品类能差好几倍。
第二个去处是挪到同一档里的另一门语言。第二档语言的机会普遍好于第一档。
第三个去处是把已有的问答内容做深,而不是做多。把十篇写成参考级,胜过写五十篇泛泛的。
保哥常说的一句话在这里同样成立:在供给稀缺的市场里,深度是唯一不会被稀释的东西。
三个去处按确定性排序,第一个最稳,第三个见效最慢但护城河最深。
资源挪动的时候有个纪律要守:挪走之前先把已发的内容整理成一份清单,标明各自的状态和最后更新时间。没有这份清单,半年后想回来接着做,会发现没人记得当初做到哪一步了,等于从零开始。
还有一个去处经常被忘掉:把资源挪回到架构和技术那一侧。国际化SEO的通用检查清单里那些跟语言无关的项目,比如版本标注、跳转逻辑、索引控制,在小语种站上出问题的概率一点不低,而且修好了对所有内容形态都有效,不像内容那样只惠及自己那一批页面。
常见问题解答
小语种的长尾内容还值得写吗?
值得,但理由跟英文市场不一样。英文长尾靠的是条数极多、每条量小、加起来可观,这个模型在小语种里不成立,因为词形变化把每条的量又摊薄一次,工具还测不出来。真正的理由在供给那一侧:这些语言的网页里,肯把一个问题从头到尾讲清楚的页面本来就没几个。需求按人口比例缩水,供给按更陡的比例缩水,中间张开的口子就是机会所在。
怎么量一门语言的内容供给有多稀缺?
挑十条品类里最典型的问句,每条看目标语言搜索结果的前二十位,数其中有几条在正面回答这个问题。正面回答要卡死定义:有一段完整文字直接给结论,商品列表和宣传语都不算。两百格数下来的比例就是供给密度。英语里通常四成以上,小语种能到一成就算高的。要注意这个数字必须按品类分别测,同一门语言里消费电子和园艺工具能差好几倍。
富结果被砍了,问答内容是不是该跟着砍?
英语市场砍的理由成立,小语种市场不成立。因为那两次削减动的只是展示层,而小语种站原本就很少吃到那块展示红利,取消对它们的输入项是零。小语种写问答的动机另有三条:接住跟陈述句差别很大的疑问句形态、填补供给空白、给机器提供可独立摘取的段落。三条都跟富结果无关,所以按英语市场的结论一刀切,砍掉的是本来另有理由存在的内容。
一个问题该独立成页还是并进现有页面?
按从省事到费事的顺序判定。先问能不能嵌进现有相关页面,能就嵌;再问能不能跟其他问题合成一个集中页,能就合;最后才看独立成页的三个条件是否全满足,也就是完整回答超过八百字且密度不掉、有稳定可识别的查询量、跟现有页面主题都不重合。照这个顺序,一百个候选问题最后大概只有五到十个会变成独立页面,其余都被前两步消化掉了。
各语言的疑问句差别有多大,词表能不能共用?
按疑问句会不会改写实词分三类。第一类只在句首加疑问词,其余不动,词表可以从陈述词表推导;第二类会改动词形态甚至名词的格,词表必须从真实语料单独采集;第三类靠语序或句末成分提问,句子里可能一个疑问词都没有,只能从站内搜索日志里看句式分布。判定方法是找母语者问一句:把这句陈述改成问句,哪些词会变。一门语言三分钟出结论。
回答写多长合适?
别用字符数,用信息单元数。一个结论算一个单元,一条依据算一个,一个例外算一个,一个具体数字算一个,五到八个是合适的区间。字符数在跨语言场景下必然失真,同一段内容翻成不同语言长度能差四成。信息单元这个口径跨语言稳定,因为翻译不会改变事实的条数,还能顺手做版本一致性检查:两边单元数对不上,就说明翻译过程中掉了内容。
三个月看不到流量,该不该停?
不该用总流量做这个判断。小语种问答内容三个月内的流量绝对值一定很难看,用一个必然难看的数去判死活,结论是被指标选择逼出来的。该看的是三个数:这批页面的收录比例、用疑问词表筛出来的问答型曝光量、这批页面的平均排名走向。同时留一个条件相近的品类当对照组,三个月后比较两组的曝光差值,那个差值才是真实效果。
权威参考资料
本文标题:《小语种的问答长尾没多少人搜,可整个语种里认真写完整回答的也没几家》
本文链接:https://zhangwenbao.com/minor-language-qa-long-tail-content-value-ai-era.html
版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0