品牌名进德语市场,比怎么拼更早要定的一件事是它算公的还是母的
本文目录
- 为什么德语页面上的品牌名,同一个站里出现了三种冠词?
- 一次德国汽车配件站的全站扫描
- 冠词只是露在外面的那一截
- 这类不一致过不了任何一道现有的检查
- 判据是这个词有没有一个被公认的性别
- 本族词的性别是查得到的,新借词的性别谁说了算?
- 德语根本没有一个负责这件事的机构
- 法语有裁判,可是判了也没人听
- 俄语那次官方承认走的是另一条路
- 唯一真正说了算的是用法的分布
- 一个词的性别定错了,会在页面上连锁到几处?
- 冠词是第一处也是最显眼的一处
- 形容词词尾是第二处,也是最难自查的一处
- 模板拼出来的句子会把错误批量复制
- 代词回指会把错误带到相邻段落
- 这件事会掉搜索量吗,还是只伤转化?
- 搜索这一侧几乎不受影响
- 受伤的是转化和品牌感知
- 这是为什么它能活很多年
- 怎么给它估一个能拿去汇报的数
- 借词的性别有没有可预测的倾向?
- 三条倾向各自都有道理
- 三条打架的时候没有优先级
- 品牌名比普通借词更不稳定
- 缩写和字母组合是另一种情况
- 品牌名这一格该由谁来填?
- 你能定的是写法,定不了的是性别
- 跟地名那件事又不一样
- 标注的责任应该落在数据这一侧
- 什么时候该改主意
- 法语、俄语、荷兰语的情况一样吗?
- 法语只有两个性,冲突反而更尖锐
- 俄语的性别还牵着变格走
- 荷兰语的两性合并留下了历史包袱
- 没有性别的语言反而要注意别的事
- 页面上哪些位置必须统一,哪些位置可以两可?
- 模板与结构化数据必须统一
- 正文里出现一次不同不算事故
- 用户生成内容一律不动
- 广告素材要单独确认一遍
- 一套半天能定下来的品牌性别决策流程
- 第一步,圈出需要处理的全集
- 第二步,查词典和语料拿到现状
- 第三步,拿不准的交给本地用户来判
- 第四步,落进数据字段并同步出去
- 哪些事不归这一层管
- 性数一致的执行不在这篇里
- 包容写法是另一条线
- 引擎那一半交给平台层
- 常见问题解答
- 不懂德语,怎么自己查一个品牌名该用哪个冠词?
- 三种写法都有人用,选哪个的收益差别大吗?
- 只改模板不改历史内容,行不行?
- 这件事跟包容写法是不是同一个问题?
- 新品牌上线时能不能提前避开这个问题?
- 怎么让写手真的按对照表来写?
- 这批词的性别多久会变一次?
- 权威参考资料
摘要:德语、法语、俄语要求每个名词都归进一个性别,本族词的性别是词典里查得到的事实,新借进来的词却不是,它的性别是一场还在进行的投票,而品牌名永远是这门语言里最新的那个词。归属没定意味着同一个词有两三种都合法的写法,冠词不同、形容词词尾跟着不同、代词回指也不同。更麻烦的是它不掉搜索量,只伤页面读起来像不像本地人写的,于是在以流量为口径的复盘里永远不会被发现。本文讲清这一格该由谁填、错了会连锁到几处、三条分配倾向为什么互相打架,以及半天能定下来的决策流程。
为什么德语页面上的品牌名,同一个站里出现了三种冠词?
一次德国汽车配件站的全站扫描
有个客户做德国市场的汽车配件,主营刹车片、机油滤清器、雨刷这几条线,自有品牌加代理品牌一共二十来个。
他们的德语内容做得相当认真,商品页、安装教程、选购指南三套内容都请了本地写手。
问题是在一次内容审计里被顺手发现的:同一个自有品牌名,在站内三处不同的页面上跟着三个不同的冠词。
保哥让他们把全站含品牌名的句子拉出来做了一次扫描,结果是二十多个品牌里有七个存在这种情况。
更麻烦的不是数量,是没有一个人能说清楚哪一种才是对的。写手说他按语感写的,审校说三种都能接受,品牌手册里对这件事一个字都没有。这不是有人违反了规范,是从来就没有过一条规范。
后来把这七个品牌的相关句子按写作时间排了一下,发现更有意思的现象:同一个写手在不同月份写的稿子里,用的冠词也不一样。也就是说这不是人和人之间的分歧,是这个词在这门语言里本来就还没定下来,而每一次写作都相当于投了一票。
这次扫描还有个副产品:他们顺手统计了一下这七个品牌各自出现了多少次不同写法,发现分布极不均匀。销量最高的那两个品牌反而是不一致最严重的,因为它们的页面最多、经手的写手也最多,写得越多分歧积累得越厉害。
冠词只是露在外面的那一截
如果这件事只影响冠词,那还算好办。
问题是德语里名词的性别会往外辐射,跟它搭配的形容词要跟着改词尾。
代词回指也要跟着改,上一句提到这个品牌,下一句用哪个代词指它,取决于同一个判断。
复合词的构成方式在个别情况下也会受影响。
于是一个没定下来的性别,会在一段两百字的商品描述里产生五到八处不一致,而每一处单看都只是一个小词,小到任何一次通读都会滑过去。
辐射范围这件事有个直观的估法:数一数商品描述里有多少个修饰这个品牌名的形容词,再加上代词出现的次数,基本就是这一个判断会影响的位置数。数完之后多数人会重新评估这件事的优先级。
这类不一致过不了任何一道现有的检查
把这七个品牌的页面拿去跑一遍常规检查,什么都查不出来。
拼写检查没问题,因为每一种写法本身都是合法的德语。
翻译质量检查没问题,因为这些句子本来就是德国人写的。
术语一致性检查也没问题,因为术语库里存的是品牌名这个字符串,而字符串在三种写法里完全一样,变的是它前面那个词。
这一点跟强调标记漂移那一篇的结构很像:校验项做到了周围的字符这一级,却没有一项在问它罩住的是不是同一个东西。这里也是同样的错位,检查器盯着品牌名本身,而出问题的是它旁边那个词。
顺着这条线还能得出一个推论:凡是错误发生在词与词的关系上而不是词本身上的,现有的自动检查基本都抓不到,因为它们的最小检查单位是词。要抓这一类只能靠规则去看搭配,而搭配规则要按语言各写一套,成本高得多。
判据是这个词有没有一个被公认的性别
要判断一个词会不会出这个问题,只需要问一句:这门语言里有没有人能说清楚它是什么性。
本族的老词一定有,词典给一个答案,全国上下没有分歧。
进来几十年的借词多半也有,因为投票已经投完了。
最近十几年才出现的词、以及所有的品牌名,通常没有。
所以这件事的风险面是可以提前圈出来的:把词表里出现时间最近的那一批词挑出来,再加上全部品牌名,就是需要处理的全集。这份全集通常只有几十条,比多数人预想的小得多。
圈范围的时候可以顺手做个排序:按这个词在站上出现的次数从多到少排,前面十几个处理完,全站的不一致就消掉大半。剩下的长尾可以放进下一轮,不必一次做完。
本族词的性别是查得到的,新借词的性别谁说了算?
德语根本没有一个负责这件事的机构
这是本文最值得记住的一条事实。
德语有一个官方的正字法委员会,它发布的规则集是各国行政和学校系统认的那一份。
但那份规则集管的是拼写、断词、连字符和标点,性别归属完全不在它的管辖范围内。
也就是说,德语在这个问题上连一个有权裁决的机构都不存在。
词典在这里扮演的角色是记录者而不是裁决者。它把社会上正在流通的用法收进来,两种都常见就两种都收,并不会告诉你该用哪一个。你去查词典想找一个答案,拿回来的是一份现状报告。
这一点对沟通很有用。团队里经常有人问一句权威怎么说,而这个问题在这里根本没有对应的答案。把没有权威机构这件事先讲清楚,后面关于看数据做决定的讨论才进行得下去,否则总有人觉得肯定有个标准答案只是我们没找到。
法语有裁判,可是判了也没人听
法语那边的情况正好构成一个绝佳的对照。
法语有一个历史悠久的语言机构,它确实有资格对这类问题表态。
2020年它就一个当时的新词做了公开表态,理由讲得很清楚:这个缩写背后的核心词是阴性的,所以整个缩写应该按阴性用。
结论在逻辑上无懈可击,媒体也报道了。
然后事情就变成了一个很有意思的社会实验:民间的日常说法在此后相当长一段时间里仍然大量沿用阳性写法,两种写法一直并行。有裁判的语言和没裁判的语言,最后落到页面上的处境几乎一样。
这件事还有一层值得琢磨:那次表态之所以广为人知,恰恰是因为它引发了争议。如果它当时就被普遍接受,这件事根本不会被记住。所以裁决被讨论得越热闹,往往说明它离生效越远。
俄语那次官方承认走的是另一条路
俄语提供了第三种样本。
有一个表示咖啡的借词,长期以来被规定为阳性,而口语里几乎所有人都当中性用。
2009年官方公布的一批规范词典承认了口语中的中性用法,等于是规范向用法让了一步。
注意这个方向:不是用法被纠正过来,是规范被改过去了。
把三门语言放在一起看,结论就很清楚了:没有裁判的会一直投票下去,有裁判的判了也未必算数,而真正会变的往往是规范这一侧。你在做本地化决策时,不能把词典或者官方表态当成一个可以照抄的答案,它只是众多输入里的一个。
俄语这个样本还提示了一件事:规范让步这件事是有前提的,前提是用法的分布已经悬殊到无法忽视。所以你在页面上看到的比例如果只是六四开,那离规范改口还早得很,得按两种并存来处理。
唯一真正说了算的是用法的分布
既然没有权威可以依靠,那就只能看数据。
德语的数字词典项目会给词条挂上基于语料的用法说明,双性词在那里能看到两种写法各自的流通情况。
这个数据的意义不在于告诉你哪个对,而在于告诉你哪个更常见。
对做内容的人来说,更常见就是唯一有操作意义的答案。
这条方法论跟生命度那一篇是同一套:凡是词典自己给出两个并列答案的地方,跟着词典走这条通用策略就没有输出了,你必须自己去看分布。两件事踩的是同一个坑的两个位置。
看分布的时候要留意语料的时间跨度。一个词如果是近十年才进来的,用几十年跨度的语料算出来的比例会被早期的空白稀释,正确的做法是只看最近几年的切片。
一个词的性别定错了,会在页面上连锁到几处?
冠词是第一处也是最显眼的一处
连锁的第一环是冠词本身。
它出现在标题、面包屑、按钮文案、商品名称这些最显眼的位置。
德语用户对这个词的敏感度极高,因为它在句子里出现的频率高到几乎每句都有。
用错了不会造成理解障碍,但会立刻产生一种说不上来的别扭感。
这种别扭感的杀伤力在于它无法被具体指出来。用户不会写邮件告诉你冠词用错了,他只会觉得这个站有点怪,然后去了别家,而你在任何数据里都看不到原因。
还有一个位置的冠词特别值得单独核一遍,就是导航和分类名。那些文本在全站每一页都出现,一旦定错,用户在任何一个页面上都会遇到它,而且它是最不容易被内容团队想起来去改的一块。
形容词词尾是第二处,也是最难自查的一处
第二环是形容词。
德语的形容词词尾要跟名词的性、数、格同时保持一致,是一张三维的表。
性别选错了,这张表里对应的那一格就跟着错,词尾也就错了。
而形容词词尾的错误比冠词更难被非母语者发现,因为差别常常只有一两个字母。
这一层跟意大利语性数一致那一篇讲的是同一个机制,区别在于那一篇处理的是已有词的一致关系,这一篇处理的是那个词的性别本身还没定。前者是执行问题,后者是取值问题,取值错了执行得再规范也是错的。
形容词这一层还有个隐蔽的放大器:德语的词尾同时受性、数、格三个维度控制,而同一个词尾形式可能对应多个组合。于是错误的性别有时会碰巧生成一个正确的词尾,让你误以为没问题,直到换一个格的时候才暴露出来。
模板拼出来的句子会把错误批量复制
第三环出现在模板上。
商品标题、分类页描述、结构化数据的名称字段,这些位置的文本大多是模板拼出来的。
模板里的冠词和形容词是写死的,名词是变量。
一旦某个品牌的性别在数据里标错了,这个错误会被复制到这个品牌名下的每一个页面上。
多语言模板那一篇讲过性数一致会让替换失效,这里是同一个机制的上游:那一篇假设名词的性别是已知的,只是模板没做计算;这一篇是性别这个输入本身就填错了,模板算得再对也输出错的结果。
模板这一处还有个容易忽略的位置,就是页面标题和描述的自动生成规则。那两处的文本不出现在正文里,做内容审核时常常整块被跳过,可它们恰恰是搜索结果页上唯一露出的部分。
代词回指会把错误带到相邻段落
第四环最容易被漏掉。
正文里提到一次品牌之后,后面用代词指代它,代词要跟性别一致。
写手在写第二段的时候未必会回头确认第一段用的是哪个冠词。
于是同一篇文章内部出现前后不一致,这种不一致对本地读者来说比一直错下去更刺眼。
可以记一条经验:一直用错的页面读起来像是外国人写的,前后不一致的页面读起来像是几个人拼的。后者对品牌观感的伤害更大,因为它同时暴露了没有规范和没有校对两件事。
代词这一层还有个实际的规避办法:在需要回指的地方直接重复品牌名,别用代词。重复品牌名在德语商品文案里完全自然,还顺带提高了品牌词的出现密度,属于一举两得。
这件事会掉搜索量吗,还是只伤转化?
搜索这一侧几乎不受影响
先说一个可能让人松一口气的结论。
用户在搜索框里输入时极少带冠词,搜品牌名就是打品牌名本身。
所以性别选错并不会让你的品牌词搜不到,也不会直接影响这个词的排名。
这跟变格、复合词、变音符号那几类问题完全不同,那些是真的会让字符串对不上。
换句话说,这是少数几个只在页面内部发生、不在查询侧发生的语言层问题。它不改变匹配,只改变阅读体验。
不过有一个例外要提:如果品牌名恰好跟某个普通词同形,用户偶尔会带上冠词来消歧。这种情况很少,但一旦发生,两个形态的查询量都要覆盖,处理方式跟别的多形态问题没有区别。
受伤的是转化和品牌感知
影响落在用户进站之后的那几秒。
页面读起来自然不自然,直接决定了他愿不愿意相信这是一家本地经营的店。
汽车配件这类品类尤其吃这一层,因为买错了要退货,用户天然更谨慎。
而信任信号在小语种市场的权重比在英语市场高,这一点在落地页信任信号那一篇里已经量过一次。
所以这件事的正确定位是转化优化,不是流量优化。把它排进关键词项目里会一直排不上号,因为它不产生任何流量预期;把它排进转化优化项目里,它的性价比立刻变得很好看,因为改动成本极低。
汽车配件这个品类还有个额外的敏感点:用户要靠页面上的描述判断这个件跟自己的车匹不匹配,所以他会逐字读规格区。逐字读的时候,语言上的别扭感被放大得比浏览式阅读厉害得多。
这是为什么它能活很多年
把上面两条合起来,就能解释为什么这类问题的存活时间特别长。
所有以流量为口径的复盘都看不见它。
所有以转化率为口径的复盘会看到数字偏低,但归因时会先怀疑价格、配送、支付方式这些更显眼的因素。
语言细节排在归因清单的最后面,而清单通常在中间就停了。
保哥的经验是:只伤转化不伤流量的问题,平均存活时间比两头都伤的问题长好几年,不是因为它难修,是因为没有任何一张报表会主动把它推到你面前。
这类问题还有一个共同的特征:它们几乎总是被偶然发现的。不是通过某个流程、某张报表,而是某个人碰巧在某一天注意到了。所以真正的改进不是修好这一次,是把它变成一条会被定期执行的检查。
怎么给它估一个能拿去汇报的数
要立项还是得有数字,这里有个可行的办法。
把存在不一致的那几个品牌的页面挑出来,跟没有问题的品牌页做转化率对比。
样本不会很干净,但只要差距稳定存在,方向就够用了。
更省事的做法是直接算改动成本:几十条词、半天工作量、一次发布。
成本低到这个程度的时候,其实不需要精确的收益估算。汇报时把话说成这样就够了:我们花半天时间可以消除全站七个品牌的语言不一致,这件事本身不需要论证收益。
汇报时还有一个角度很好用:把三种写法的截图并排放在一页上。视觉证据在这件事上比任何数字都有效,因为不一致这件事本身就是用眼睛看出来的,不需要懂德语也能一眼看懂。
借词的性别有没有可预测的倾向?
三条倾向各自都有道理
虽然没有规则,但确实有倾向,而且主要是三条。
第一条看词的形式,词尾长什么样就往哪个性别靠。
第二条看语义,这个东西在本族语里对应的那个词是什么性,借词就跟着它。
第三条看上位词,这个词属于哪个大类,就跟着那个大类的通行性别。
跨语言的类型学调查把性别归属系统大致分成形式型和语义型两类,而德语这样的语言两种机制同时起作用,这就是三条倾向能同时存在的根源。
这三条倾向还有一个共同的局限:它们都是描述性的,是语言学家总结出来的规律,不是使用者遵循的规则。使用者靠的是听过别人怎么说,而这一点没有任何倾向能预测。
三条打架的时候没有优先级
麻烦在于这三条经常指向不同的答案。
某个知名的食品品牌就是最常被引用的例子:按词尾像一类,按语义像另一类,按上位词又像第三类。
三条各指一个方向,于是三种冠词在民间同时流通了几十年,至今没有收敛。
而语言里没有任何一条元规则告诉你三条冲突时该听谁的。
这就是为什么这件事不能交给规则引擎处理。三条倾向可以帮你缩小范围、可以帮你解释为什么会有分歧,但它们给不出一个可以自动执行的答案。
说到底这跟颜色范畴那件事有点像:属性枚举值那一篇讲的是切分位置由语言的历史约定决定,这里是归类结果由历史约定决定。两件事的共同点是交付物都只能是一张要维护的表,而不是一段能跑的逻辑。
品牌名比普通借词更不稳定
品牌名在这件事上还有一层额外的不确定。
普通借词至少在原语言里有一个词类和一个含义,三条倾向都有抓手。
品牌名往往是生造的,词尾可能不像任何一类,语义上也没有明确对应。
于是三条倾向里有两条直接失效,只剩上位词这一条勉强能用。
这条推论有个直接的应用:如果你正在为新市场取名,词尾选得像目标语言里某一类词,可以省掉后面所有的麻烦。这属于命名阶段就能解决的事,一旦名字定了再想改就晚了。
还有一种情况会让品牌名更不稳定:品牌名在本地语言里恰好跟某个词读音接近。这时候用户的直觉会被那个词牵着走,而那个词的性别未必是你希望的那个。上线前让本地同事念一遍所有品牌名,这一步成本极低。
缩写和字母组合是另一种情况
还有一类要单独说,就是首字母缩写。
缩写的性别通常跟着它展开之后那个核心词走,这一条相当稳定。
但前提是本地用户知道它展开是什么,不知道的话就退回到按词尾猜。
所以同一个缩写在行业内和行业外可能被安上不同的性别。
这一层跟首字母缩略语那一篇是连着的:那一篇说的是缩写在小语种里会长出本地形态,这里补的是它还会被安上一个性别,而这个性别取决于受众知不知道它的全称。
缩写还有一个特殊之处:它在书面和口头场景下的展开程度不同。写在页面上的时候读者看得到全称,说出口的时候只有几个字母,于是同一个缩写在两个场景下可能被安上不同的性别,而你的内容要同时服务这两个场景。
品牌名这一格该由谁来填?
你能定的是写法,定不了的是性别
把品牌名这件事往上抽一层,会看到一个很清楚的分工。
品牌名怎么拼、大小写怎么写、要不要加空格,这些完全在你手里。
品牌名音译那一篇讲的就是这一半:一个名字在市场上长出三种写法之后,你要主动收敛成一种并把另外两种留在匹配层。
而性别这一格不在你手里,它由这门语言的使用者在几年时间里投出来。
两件事的动作方向因此完全相反:写法要收敛,性别只能跟随。把它们写进同一份品牌规范里,最容易犯的错误就是用管写法的方式去管性别,然后规定一个跟民间用法相反的答案。
这条分工还有一个更一般的表述:凡是你能在上线前定死的,属于品牌资产;凡是要在上线后持续观察的,属于市场事实。把两类东西记在同一份文档里是很多混乱的起点,因为它们的复核节奏差了一个数量级。
跟地名那件事又不一样
这里值得跟另一个相邻的话题划清界线。
地名本地名与外来名那一篇讲的是同一个地方在不同语言里有不同的名字,每门语言各持一份使用权。
那是跨语言的分歧,处理办法是承认多种都对,按市场分别落地。
本文这件事是同一门语言内部还没投完票,处理办法是选一个流通度更高的然后全站统一。
一个要发散,一个要收敛,两者最容易被混为一谈的地方在于它们都表现为一个东西有好几种说法。判断办法很简单:分歧发生在语言之间还是语言内部。
这条界线还能推广到别的场合。同一个东西有多种说法时,先问分歧发生在哪一层:跨语言的要发散,语言内部的要收敛,同一个人不同时候的要统一。三种情形的处理动作完全不同,而它们在表面上长得一模一样。
标注的责任应该落在数据这一侧
定下来之后,这个结论应该存在哪里。
最稳的位置是商品数据里的一个字段,跟品牌名存在一起。
存在文案规范文档里的问题是没人会去看,存在写手脑子里的问题是换人就丢。
存进数据字段之后,模板可以直接取用,写手也可以在编辑器里看到。
这一步还有个附带的好处:字段一旦存在,它就有了负责人和变更记录。谁在什么时候把某个品牌从一个性别改到另一个,这件事从此有据可查,而不是变成一场每年重来一次的口头争论。
字段这件事还有一个附带价值:它让这个结论可以被下游系统消费。商品数据要同步给比价平台、广告平台和渠道商,字段里有值它们才拿得到,写在文档里的结论走不出你的团队。
什么时候该改主意
定了之后并不是永远不动。
触发改动的信号主要有两个:本地媒体的写法出现明显偏移,或者用户生成内容里另一种写法占了上风。
第二个信号更可靠,因为它离你的真实买家更近。
复核频率不用高,一年一次足够,这类变化以数年为单位。
这一点跟代际用词那一篇提出的保质期字段是同一套做法:不会有任何机构发公告通知你该改了,你只能主动排一次日历,而排日历这件事只要写进词表就不会被忘掉。
改主意的时候有个操作建议:把旧写法保留在站内搜索的同义词表里,别一起删掉。用户的习惯改得比页面慢,留着旧写法几乎没有成本,删掉却会让一批老用户搜不到。
法语、俄语、荷兰语的情况一样吗?
法语只有两个性,冲突反而更尖锐
法语只区分阴阳两性,没有中性这个缓冲区。
性别数量越少,两个选项之间的对立就越直接,中间地带也越少。
而且法语的形容词和过去分词都要跟着变,连锁范围不比德语小。
好在法语的借词性别倾向里,词尾这一条比德语更强势,可预测性稍好一些。
做法语站时可以先按词尾猜一个,再去语料里验一遍,命中率通常不低。这个顺序在德语上就行不通,因为德语三条倾向的强度更接近。
法语这边还有一个额外的复杂度:过去分词在某些结构里也要跟着变,而那些结构在商品描述里出现得相当频繁。所以法语站上这个判断的连锁面比德语宽,只是每一处的差异更小、更难被发现。
俄语的性别还牵着变格走
俄语的情况更复杂一层。
性别不只影响修饰语,它还决定这个名词走哪一套变格。
选错性别等于选错整张词尾表,影响面比德语大得多。
不过俄语有个缓解因素:很多外来词干脆不变格,绕开了整张表。
判断一个外来词在俄语里变不变格,看它的结尾是不是符合本族词的形态模式。不符合的多半不变,这条经验跟俄语变格那一篇里讲的形态判断是同一条线索。
俄语还有一个实操上的提醒:品牌名如果被本地人当成可变格的词处理,那它的性别会同时决定变格表和修饰语形态,两条线一起错。这时候排查要从变格形态入手,因为那一层的差异在字符串上更明显。
荷兰语的两性合并留下了历史包袱
荷兰语提供了第四种样本。
它历史上的阴阳两性在实际使用中已经合并成一类,只跟中性对立。
结果是冠词层面只剩两个选项,但代词回指那一层仍然保留着旧的三分。
于是同一个词,冠词好定,代词难定,两层的判断依据不一样。
做荷兰语站时要把这两层分开处理,别指望定了冠词代词就自动跟着对。这也是荷兰语与佛兰芒市场那一篇里提到的那类差异之一,两个市场在这一层上的习惯还不完全一致。
荷兰语的这种两层不同步还有一个衍生问题:写作规范和口语习惯在代词这一层的差距特别大,规范推荐的写法在日常对话里几乎听不到。做面向消费者的文案时,跟着口语走通常更安全。
没有性别的语言反而要注意别的事
最后说一句反面。
芬兰语、土耳其语、日语这些语言没有语法性别,本文这一整套完全用不上。
但它们把复杂度放在了别处,比如后缀链和敬语层级。
所以做多语言站时,这一项检查应该只在需要的语言上跑,不必做成全局清单里的一条。
把不适用的检查项塞进全局清单是很多本地化流程臃肿的起点,每门语言只跑它真正会踩的那几项,清单才有人愿意执行。
这条提醒还可以反过来用:给每门语言维护一张适用检查项的清单,新开市场时先勾选适用项。这份清单本身就是本地化经验的沉淀,比一份所有语言共用的通用清单有用得多。
页面上哪些位置必须统一,哪些位置可以两可?
模板与结构化数据必须统一
必须统一的位置有一个共同特征:它们是机器批量产出的。
商品标题模板、分类页描述、结构化数据的名称与描述字段,这几处一处定错就是成千上万页。
所以这几处应该直接读商品数据里的那个字段,而不是让写手每次现判断。
这一步做完,全站绝大部分的出现次数就已经统一了。
值得单独提醒的是结构化数据这一处的修复周期最长,改完要等重新抓取和重新处理,所以它应该排在改动清单的最前面而不是最后面。
还有一个位置容易被漏掉,就是站内搜索结果页上的商品标题。那一处的文本通常来自另一套模板,跟商品页的模板不是同一份代码,改的时候要单独确认一遍。
正文里出现一次不同不算事故
正文的要求可以宽一些。
一篇长文里偶尔出现一次另一种写法,本地读者基本不会注意到。
把正文也管到滴水不漏,需要付出的校对成本跟收益不成比例。
合理的做法是给写手一份品牌性别对照表,写的时候能对上就对上。
要盯紧的只有一种情况:同一篇文章内部前后不一致。这一条可以写成一句很简单的自查,也可以让编辑器做一次简单的比对,成本几乎为零。
正文这一层还可以借力工具:把品牌名和它的性别做成编辑器里的自动提示,写手打到这个词的时候直接看见。这比事后校对便宜得多,也比要求他记住一份对照表现实得多。
用户生成内容一律不动
评论、问答、晒单这些内容不在管辖范围内。
用户怎么写就怎么留着,那是最真实的用法样本。
而且这批内容恰恰是你判断风向的数据来源,改了等于把温度计砸了。
需要做的只是定期统计一下里面两种写法的比例。
这条原则跟本站好几篇的结论一致:用户生成内容既不受你的规范约束,也不应该受,它的价值就在于没有被编辑加工过。
统计用户生成内容的时候有个技巧:按时间分段统计,看比例有没有在移动。静态的比例只告诉你现状,移动的方向才告诉你该不该准备改主意。
广告素材要单独确认一遍
还有一个容易漏的位置是投放素材。
广告文案通常由另一拨人做,甚至由代理商做,他们拿不到你的品牌数据字段。
于是站上统一了,广告里还是三种写法。
而广告是很多用户第一次见到这个品牌名的地方,第一印象的权重更高。
把那张对照表同步给投放方是个五分钟的动作,但它经常被漏掉,因为品牌规范的分发范围通常只覆盖内部。
投放素材还有一层风险:广告平台的动态创意会自动拼接文案片段,拼出来的句子没有人逐条看过。用了这类功能的账户,最好把品牌名相关的片段单独锁定,不参与自动组合。
一套半天能定下来的品牌性别决策流程
第一步,圈出需要处理的全集
先确定范围,别一上来就查。
全集等于所有品牌名,加上词表里最近十年才出现的那批词。
老词不用管,它们的性别早就定了,词典里查一次就行。
这一步做完通常剩下几十条,工作量立刻可控。
圈范围的时候可以顺手把型号和纯字母组合排除掉,那一类在句子里通常不带冠词,也就不会踩到这个问题。
另外提醒一句,代理品牌和自有品牌要分开处理。代理品牌在本地市场往往已经流通多年,性别早就定了,照抄现状即可;自有品牌才是真正需要你做判断的那一批,而它们通常也是页面数量最多的那一批。
第二步,查词典和语料拿到现状
逐条去查,两个来源就够。
词典看它收了几个答案,收一个就照着用,收两个就进下一步。
语料看两种写法各自的流通情况,取更常见的那个。
整个过程是机械的,交给任何一个会用浏览器的人都能做。
需要留意的是查语料时把品牌名和冠词一起查,单查品牌名拿不到任何有用的分布,因为字符串在两种情况下完全一样。
查的时候建议把结果连同来源一起记下来,别只记结论。半年后有人提出异议时,一条带来源的记录能在两分钟内结束讨论,而一个孤零零的结论只会引发第二轮争论。
第三步,拿不准的交给本地用户来判
还剩几条实在拿不准的,别自己拍板。
最好的判据来自你自己的用户生成内容,统计一下评论里两种写法的比例。
没有足够的评论就去本地论坛和社交平台看同行怎么写。
实在还是对半开的,选一个然后记录下来,重要的是全站统一而不是选对。
这一点值得说明白:在两种写法都合法且流通度接近的情况下,统一带来的收益远大于选对带来的收益,因为不一致是唯一会被读者察觉的那个问题。
本地用户这一侧还有个免费的数据源:客服的聊天记录。用户在跟客服打字的时候完全不设防,写出来的是最自然的形态,而且这批数据通常没有任何人从语言角度看过。
第四步,落进数据字段并同步出去
最后一步是分发。
结论写进商品数据的品牌字段,模板改成读这个字段。
同一份对照表同步给写手、投放方和代理商。
在词表里给这个字段加一列复核日期,一年一次。
做完这四步,这件事就从一个每次都要重新讨论的问题变成了一条可以查的记录。而这类语言问题的最终解法几乎都是这样:不是找到正确答案,是让答案有个固定的存放位置。
分发这一步还有个容易漏的对象是翻译供应商。他们手里往往有自己的术语库,如果不同步,下一批交付回来的稿子又会带上另一种写法,前面做的统一等于白做一轮。
分发完之后建议留一个可以随时查的位置,比如内部知识库里的一张单页表格。这件事最容易发生的退化不是有人写错,而是新来的人根本不知道有过这个决定,于是又按自己的语感开始写。
哪些事不归这一层管
性数一致的执行不在这篇里
这篇只解决一件事:这个词的性别取值该填什么。
填进去之后形容词该怎么变、模板该怎么算,那是执行层的事。
那部分在意大利语性数一致那一篇和多语言模板那一篇里都讲过。
两件事的先后顺序不能反:取值没定的时候去优化执行,等于把一个错误算得更准。
混着谈的常见后果是团队花了很大力气去做模板的形态计算,而输入里那几个品牌的性别始终是错的。
顺序反了还有个更隐蔽的后果:模板的形态计算做得越精细,错误的性别产生的不一致就越整齐,整齐到看起来像是有意为之,反而更不容易被怀疑。
包容写法是另一条线
德语站上还有另一个跟性别有关的话题,就是指人名词的包容写法。
那件事讨论的是同一个概念要不要覆盖两种性别的人,属于社会语言层面的选择。
包容写法那一篇的结论是正文里已经铺开而搜索框里的采纳率是零。
本文说的是名词本身归哪个语法性,跟指的人是男是女没有关系,一把椅子也有性别。
两件事共用性别这个词,讨论时最容易串线。分开的办法是问一句:这件事涉及的是人还是物。涉及人的归那一篇,涉及物的归这一篇。
两件事还有一个实际的交集:指人的职位名词既涉及包容写法,也涉及语法性别,两条规则会在同一个词上同时生效。碰到这类词时按包容写法那一篇的位置分区先定,再在选定的形态上应用本文的一致性要求。
引擎那一半交给平台层
最后照例还有一半功课不在语言这一层。
搜索引擎会不会把带不同冠词的短语当成同一个查询,这属于引擎的行为。
本站把引擎那一半放在平台与多引擎那个方向里单独讲,这篇不展开。
好在本文这件事跟引擎行为的关系比别的语言问题都小,因为它几乎不发生在查询侧。
这也是它值得单独立项的理由:它的收益不依赖任何外部系统的行为,改完就生效,唯一的变量是你自己的页面。
这一点也让本文的验收变得特别简单:不需要等抓取、不需要等排名、不需要等任何外部系统的反应,改完刷新页面就能确认。这在语言层的改动里是很少见的待遇。
常见问题解答
不懂德语,怎么自己查一个品牌名该用哪个冠词?
有一条基本不需要语言能力的路径。先在德语的数字词典项目里查这个词,如果它收了唯一一个答案,照抄就行。收了两个答案的进下一步:把三种冠词分别加在品牌名前面组成短语,逐个丢进搜索引擎看结果数量,再去本地社交平台各搜一遍看真实用法。数量差一个数量级以上的直接定档,接近的就取用户生成内容里更常见的那一个。整个过程你需要的只是复制粘贴和比较数字。
要提醒的是搜索结果数不能当精确数据用,它只用来判断量级,别拿它做小差距的比较。另外品牌名如果跟某个普通词撞了,结果里会混进大量不相干的页面,这种情况要加一个品类词把范围收窄。另外提醒一句,搜索结果数量在不同地区和不同登录状态下会有差别,比较的时候要在同一个环境里跑完全部候选,别今天查一个明天查一个。
三种写法都有人用,选哪个的收益差别大吗?
差别比想象中小,因为这件事的收益主要来自统一而不是来自选对。三种写法都合法的前提下,读者不会因为你选了流通度第二的那个而觉得不对,他只会因为同一个站里出现三种而觉得不专业。所以决策时不必反复权衡,取流通度更高的那个然后全站执行到底就可以。真正需要慎重的是后面改主意这件事,改一次要动模板、结构化数据、广告素材和历史内容,成本比第一次定下来高好几倍。
所以第一次定的时候把依据记下来,下次有人提出异议时可以直接看记录,而不是重新吵一遍。如果实在有分歧,让本地同事投个票,然后把票数一起记进去。还有一点值得记住:统一之后如果有人提出应该用另一种,讨论的成本已经从选哪个变成了值不值得改,后者比前者好收敛得多。
只改模板不改历史内容,行不行?
可以,而且这是投入产出比最好的起步方案。模板和结构化数据覆盖了绝大部分的出现次数,改这两处的成本是一次性的,效果是全站的。历史正文里的零星不一致对读者的影响小得多,可以放着慢慢改,或者在下次内容更新时顺手处理。唯一建议优先处理的历史内容是流量最高的那十来个页面,那些页面的曝光量决定了它们的影响面。
另外提醒一句,改模板之前先确认商品数据里那个字段已经填好了,字段是空的时候模板会按默认值输出,而默认值通常就是当初写死的那一个,等于什么都没改。另外一个提醒是历史内容里如果有大量结构化数据,那部分要跟着模板一起改,否则页面上统一了而机器读到的还是旧值。
这件事跟包容写法是不是同一个问题?
不是,两者只是共用了性别这个词。包容写法讨论的是指人的名词要不要同时覆盖男性和女性,属于社会层面的表达选择,它的核心矛盾是正文里已经普及而搜索框里没人用。本文讨论的是任何一个名词在语法上归哪一类,跟它指的东西是不是人完全无关,一个刹车片也有性别。两件事的落地位置也不同,包容写法主要影响正文和标题的措辞,语法性别主要影响冠词和形容词词尾。
分辨的办法是问一句这件事涉及的是人还是物。如果团队里经常有人把两者混着谈,建议在文档里给它们各起一个不含性别二字的内部叫法,能省掉很多无谓的讨论。如果实在分不清,可以看这个词指的东西能不能被雇佣,能的归包容写法那一篇,不能的归这一篇,这个土办法几乎不会错。
新品牌上线时能不能提前避开这个问题?
能,而且这是唯一一个可以在源头解决的环节。取名阶段如果把词尾设计成目标语言里某一类词的常见形式,本地用户的直觉会高度一致,三条分配倾向不会打架,性别自然就定了。这件事的成本几乎为零,前提是取名的时候有人想到要问一句这个名字在德语里读起来像什么类型的词。可惜大多数命名流程只考虑发音好不好听、商标能不能注册、域名有没有被占,语言归类这一项从来不在清单上。
如果你所在的公司还有新品牌要推,把这一条加进命名评审清单里,是本文里投入产出比最高的一个动作。另外提醒一句,命名评审时问的不该是这个名字在德语里是什么性,而该是本地同事第一反应会给它配哪个冠词,前者没有答案,后者有。
怎么让写手真的按对照表来写?
别指望文档,把它放进他每天都会打开的地方。最有效的做法是在内容管理系统的编辑界面上,把品牌名和它的性别一起显示出来,写手写到那个词的时候一眼就能看见。次一级的做法是做一个简单的检查规则,提交时扫一遍看有没有用错的冠词,命中就提示一下。这两个动作的共同点是把规范放在动作发生的那一刻,而不是放在一份需要主动去查的文档里。
经验上,任何需要写手主动去查的规范,执行率都会随着时间衰减,而嵌进工具里的规则不会。如果两个都做不到,退一步至少把对照表贴在写作模板的顶部,让它跟着稿子一起走。还有一个很轻的做法是把对照表做成一张图片贴在团队的常用文档首页,图片不会被折叠,也不需要点开链接,命中率比纯文字链接高不少。
这批词的性别多久会变一次?
变化很慢,以数年为单位,所以一年复核一次完全够用。真正需要留意的不是老词的漂移,是新词的加入:每年新增的品牌、新引进的品类词,都要在上线时跑一次这个流程。复核的动作很轻,重新查一遍语料分布,看那几个原本对半开的词有没有明显偏向某一边。另外有一个信号值得盯,就是本地媒体和行业刊物的写法,它们通常比大众用法先一步收敛。
建议把复核安排在每年做词表维护的时候一起做,两件事的数据来源重叠度很高,合并起来几乎不增加额外工时。另外建议把每次复核的结论和当时看到的分布一起存档,几年下来这份档案本身就变成了判断这个词有没有在移动的最好依据。
本文标题:《品牌名进德语市场,比怎么拼更早要定的一件事是它算公的还是母的》
本文链接:https://zhangwenbao.com/minor-language-loanword-gender-assignment-brand-article.html
版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0