日语页面写得越客气,跟用户在搜索框里打的那串字差得越远
本文目录
- 敬语不是一把刻度尺,它是三套同时在跑的系统
- 丁寧語管的是你跟读者之间的距离
- 尊敬語和謙譲語管的是这个动作朝谁走
- 美化語是另一件事,别把它塞进档位表
- 三套系统可以叠加,所以出错的组合比想象中多
- 为什么说方向错了比档位错了严重得多?
- 把尊敬語用在自家身上是一类硬错
- 把謙譲語用在用户身上同样是硬错
- 两个不需要日语能力也能用的方向判据
- 方向错误在页面上的分布是有规律的
- 用户在搜索框里打的到底是哪一档?
- 查询侧几乎全是常体和裸词
- 页面侧几乎全是敬体
- 字面不重合会漏掉哪三类词
- 敬语层级到底影不影响排名,还是只影响转化?
- 它影响的是词形匹配那一环,不是礼貌分
- 段落级抽取那一侧,敬体长句是吃亏的
- 专业度和权威度那一侧,敬语能加分吗
- 六个页面位置各该用哪一档
- 标题和大标题:把名词形留出来
- 元描述:敬体可以,但裸词得塞进去
- 问答区的问句必须用用户的口吻
- 按钮和表单标签:短、无歧义、不许上尊敬語
- 客服话术和邮件可以比商品页高一档
- 二重敬語为什么在商品页上代价更大?
- 什么样的句子算二重敬語
- 日本人也犯,但页面上的后果不一样
- 过度敬语让商品页读起来像培训手册
- 关键词表要不要按敬语形态展开?
- 两列对照表:用户打的形态和页面出现的形态
- 哪些词需要同时收两种形态
- 动词性查询和名词性查询的分工
- 假名和汉字的选择跟敬语档位有关系吗?
- 敬语前缀写成假名还是汉字
- 敬体文本里汉字比例通常更高
- 检索形态优先还是读感优先
- 团队里没人懂日语,这件事怎么验收?
- 三条不依赖语言能力的自检
- 该问母语审校哪三个问题
- 客服工单是最好也最便宜的语料
- 这套判断能搬到别的语言上吗?
- 韩语的阶称跟日语最像,但坑不在同一处
- 判据换成一句话:档位差有没有改变字面
- 常见问题解答
- 日语站到底该用敬体还是常体?
- 敬语用错了会被搜索引擎判罚吗?
- 把商品页改成常体会不会显得不专业?
- 机器翻译能处理好敬语吗?
- 敬语档位需要按品类区分吗?
- 怎么判断我的日语页面是不是过度敬语了?
- 没有日语母语者,这套东西能落地吗?
- 权威参考资料
摘要:日语的敬语不是一把从随便到客气的刻度尺,而是三套并行的系统:丁寧語管的是跟读者的距离,尊敬語和謙譲語管的是动作朝谁走。方向选错比档位选高选低严重得多,把尊敬語用到自家身上,母语者一眼就看出这站不是日本人做的。更麻烦的是检索那一侧:用户在搜索框里打的几乎全是常体裸词,页面上写的全是敬体长句,同一个意思在字面上根本不是同一串字。
敬语不是一把刻度尺,它是三套同时在跑的系统
丁寧語管的是你跟读者之间的距离
中文母语的运营第一次接触敬语,脑子里装的多半是一条从随便到客气的滑杆。
这条滑杆确实存在,它就是丁寧語。
買う是常体,買います是敬体,同一个动作,同一个方向,只是说话人跟听话人之间的距离拉开了一截。
丁寧語的特点是它只关心听的人是谁,不关心动作是谁做的。
所以它可以整段整页地统一,一个商品详情页从头到尾用ます形,读起来是干净的。
绝大多数出海团队对敬语的理解到这里就停了,然后把整站的敬体档位往上一推,以为这就叫做了本地化。
问题是丁寧語只占三分之一。它是三套系统里唯一一套可以整页统一处理的,也是唯一一套改错了不会让页面显得可笑的。真正会出事的另外两套,判断依据完全不在距离这个维度上,而是在动作的方向上,而方向这件事没法整页统一,只能一句一句看。日语选词那篇讲的是同一个词有几种写法,这篇讲的是同一个动作有几种说法,两件事经常被混成一件。
尊敬語和謙譲語管的是这个动作朝谁走
尊敬語抬的是动作的执行者,謙譲語压的是动作的执行者。
关键在于,被抬和被压的那个人,不是随便挑的。
用户做的动作用尊敬語,站方做的动作用謙譲語,这条方向是死的。
ご購入いただく是用户在买,承ります是站方在接单,两句话的礼貌程度差不多,方向正好相反。
换句话说,同一个礼貌档位,可以有两个方向,选错方向不是不够客气的问题,是把两边的位置搞反了。
日本人从小在这套系统里长大,方向感几乎是本能,不需要想。
非母语团队没有这个本能,于是最常见的翻车方式是:翻译工具给出一个看起来很客气的句子,运营看着挺好就用了,结果那句话把自家公司抬到了用户头上。这类错误的代价不是不礼貌,而是不像本地人写的,母语者读到会本能地停顿一下,然后开始怀疑这家店到底在哪里。信任就是在这半秒钟里掉下去的。
美化語是另一件事,别把它塞进档位表
お茶、ご飯、お店,这些词前面挂着的お和ご,很多人也当成敬语来处理。
它们属于美化語,作用是让词本身显得体面,跟抬谁压谁没关系。
美化語不带方向,所以它不参与前面那套方向判断。
它真正的影响落在别处:加不加这个前缀,词的字面就变了。
お問い合わせ和問い合わせ在页面上是两个不同的字符串,用户搜的往往是后者。
把美化語混进档位表的后果,是团队会拿判断礼貌的标准去处理一件本质上是关键词写法的事。
保哥见过一个日本站的导航栏,六个一级入口里有五个带着お或者ご,看着确实庄重,问题是这五个词在关键词工具里的检索形态全是不带前缀的裸词。导航的锚文本因此一个都对不上,而导航恰恰是站内锚文本密度最高的地方。这件事跟礼貌一点关系都没有,纯粹是字面覆盖被前缀吃掉了。
三套系统可以叠加,所以出错的组合比想象中多
一句日语可以同时带上丁寧語的ます、尊敬語的お~になる、以及美化語的お。
三套系统各自独立取值,组合数量就上去了。
这解释了一个现象:为什么日语的礼貌表达看起来有那么多层。
它不是一个维度上分了很多档,而是三个维度各分了两三档,乘起来的结果。
理解成乘法而不是加法,很多困惑会自动消失。
比如为什么有些句子听着又客气又别扭,往往是某一个维度取到了顶,另一个维度还停在底。
对做站的人来说,乘法这个理解有个实际好处:它告诉你不需要背表。你只要在每一句话上问清楚三个问题——听的人是谁、做动作的是谁、这个词要不要体面化——三个答案确定了,句子的形态就唯一确定了。这比记住几十个动词的敬语变形靠谱得多,也是非母语团队唯一能自己扛住的部分。
为什么说方向错了比档位错了严重得多?
把尊敬語用在自家身上是一类硬错
弊社がお届けになります,这句话语法上没毛病,用起来是错的。
お届けになる是尊敬語,抬的是送货的那一方,而送货的是自己。
自己抬自己,在日语的语感里不是傲慢,是荒唐。
它的效果接近于一个人用第三人称尊称介绍自己。
档位错误不一样,档位低了只是显得随意,高了只是显得生分。
方向错误是逻辑错误,它不在礼貌这条轴上,而在关系这条轴上。
这类错误在机器翻译输出里出现的频率相当高,因为翻译模型判断不了这个动作的执行者是站方还是用户——中文原文里根本没有这个信息,配送时间为三到五天这句话里,没有任何成分标出谁在配送。模型只能靠上下文猜,一猜就有一半概率猜反。机器翻译直接发布的风险线那篇讲过一条判据,敬语方向就是最典型的那种机器判断不了、母语者一眼就看出的错。
把謙譲語用在用户身上同样是硬错
反过来的错法出现得少一些,但杀伤力一样。
お客様が拝見する,这句是把用户的动作压低了。
拝見是謙譲語,只能用在自己看的时候。
用在用户身上,等于当着客人的面把客人矮化了一截。
这种错误在按钮文案和表单提示里最容易出现,因为那些位置的主语通常被省略掉了。
主语一省,翻译的人就失去了唯一的方向线索。
保哥后来给日语站定过一条硬规矩:凡是要送去翻译或者送去校对的短文案,一律在中文原稿的括号里补一句主语是谁。这条规矩不花钱,也不需要谁懂日语,却把方向类错误的返工量压掉了一大半。原因很简单——不是译者不会,是原稿从来没告诉过他这个动作是谁做的。
补一句判断技巧:謙譲語里有一批词是专用的,拝見、伺う、申す,看到这几个词就该立刻检查主语是不是站方。这批专用词数量有限,承る的词条那样的变形表里就能查到,做成一张二十几行的检查表就够用,不需要掌握整套变形规则。
两个不需要日语能力也能用的方向判据
第一问:这个动作是谁做的。
用户做的,走尊敬語;站方做的,走謙譲語。
第二问:这句话里被省略的主语有没有可能被误认成另一方。
有可能,就把主语补回去,哪怕啰嗦一点。
这两问都不需要判断日语句子的对错,只需要判断中文原意里的角色,中文母语者完全做得到。
把这两问写进翻译交付单,验收时逐条对照,方向类错误基本就拦住了。
这套判据的价值在于它把一个语言能力问题换成了一个流程问题。团队里没人懂日语,照样能定义清楚什么算错、错在哪一步、该由谁在哪个环节补上信息。母语审校的验收清单那篇提过同一个思路:验收项要写成不依赖语言能力的形式,否则整条质量线只能挂在一个母语者的判断上,人一走就断。
方向错误在页面上的分布是有规律的
把一个日语站的方向错误标出来,分布几乎总是同一个形状。
商品描述正文里最少,因为句子长,主语通常写出来了。
按钮、表单标签、弹窗提示里最多,因为这些地方字数被压到极限,主语第一个被砍掉。
客服自动回复邮件里次多,因为那些模板往往是一次性写完就再没人看过。
知道这个分布,检查就有了先后顺序:先扫短文案,再扫邮件模板,最后才轮到正文。
反过来的顺序是最浪费人力的,正文占了全站九成的字数,却贡献不到两成的方向错误。
保哥给一个卖电子琴和吉他配件的日本站做过一次全站扫描,一共找出四十多处方向错误,其中三十一处在按钮和表单提示上,正文只有五处,剩下的全在下单确认邮件里。那封确认邮件是全站阅读率最高的一段文字,却也是最久没人碰过的一段——它在两年前上线时被翻译过一次,此后再没有任何人读过它。
用户在搜索框里打的到底是哪一档?
查询侧几乎全是常体和裸词
翻一遍日语站的搜索词报告,会看到一件很稳定的事。
用户打进搜索框的几乎没有敬体。
返品 いつまで、サイズ 交換 方法、送料 いくら,全是短、平、不带任何礼貌成分的形态。
这不难理解,用户是在对着一个框打字,不是在跟人说话。
搜索框不会因为你客气就多给你几条结果,用户很清楚这一点。
更进一步,用户还会主动砍掉助词,只留下几个实词,因为经验告诉他们这样搜得更准。
这个现象在任何语言里都存在,但在日语里后果格外大:别的语言从礼貌形态退回裸词,词干基本不变,德语的Sie和du换来换去,动词词干还在那儿;日语从お買い求めになる退回買う,中间掉的不只是礼貌,是整串字符。字面重合度低到匹配环节根本认不出这是同一个动作。
页面侧几乎全是敬体
再翻页面这一侧,情况正好相反。
商品页、政策页、帮助中心,从头到尾都是ます和です。
这是对的,日语商业文本本来就该这么写。
但它带来一个副作用:页面上的字面形态跟用户输入的字面形态系统性地错开。
不是偶尔错开,是每一个动词性表达都错开。
名词还好,ブーツ就是ブーツ,敬体不敬体都不改它。
所以裂缝的位置很精确:它只出现在动词性和形容词性的表达上,名词性的关键词完全不受影响。这也解释了为什么很多日语站的品类词排名正常、问题型长尾却一片空白——品类词是名词,天生不受敬语影响;而问题型查询里必定有一个动词,那个动词在你的页面上穿着敬体的外衣,在用户的输入里光着身子。
字面不重合会漏掉哪三类词
第一类是操作型查询:怎么退、怎么换、怎么改地址。
第二类是条件型查询:能不能退、几天内能退、超过期限还能不能。
第三类是状态型查询:有没有货、什么时候到、发到哪一步了。
这三类的共同点是核心信息都挂在动词上。
页面上这三件事其实都写了,写得还挺清楚,只是全写成了敬体长句。
用户搜的那串裸词,在整个页面里一次都没有以那个形态出现过。
这就是为什么很多日语站的帮助中心内容写得比竞品还全,自然流量却低一大截。内容没问题,覆盖也没问题,问题出在字面上:搜索引擎抓到的是页面上真实出现的字符串,不是页面表达的意思。意思对上了但字面没对上,在很多匹配环节里等于没对上,尤其是那些依赖精确形态的场景。关键词工具没数据时的替代办法那篇讲的补数据思路,在这里同样管用。
敬语层级到底影不影响排名,还是只影响转化?
它影响的是词形匹配那一环,不是礼貌分
这个问题的标准答案是敬语只影响转化,跟排名无关。
这个答案对了一半。
搜索引擎确实不给礼貌打分,没有任何一个环节在衡量你的页面客气不客气。
但敬语档位不是一个只存在于语气层的东西,它会真实地改写页面上的字符串。
字符串一变,字面匹配、锚文本、结构化数据里的取值全跟着变。
所以敬语通过词形这条通道,间接地落在了排名这一侧。
把话说得更准确一点:敬语本身不是排名因素,敬语造成的词形差异是。这个区分很重要,因为它决定了该往哪儿使劲——不需要为了排名把页面写得不客气,只需要保证用户可能输入的那个形态在页面上真实出现过至少一次。礼貌照旧,覆盖补上,两件事不冲突。
还有一条通道容易被忽略:站内锚文本。敬语档位一高,锚文本就会从裸词变成一整个短句,而锚文本是站内传递主题的主要载体之一。导航和面包屑这两处的档位选择,实际影响的是全站的主题信号,不只是那一行字好不好看。
段落级抽取那一侧,敬体长句是吃亏的
近年搜索结果里越来越多地直接抽出页面中的某一段来回答问题。
被抽中的段落有个共同特征:短、直接、答案在前面。
敬语档位一高,句子就长,答案往往被推到句尾。
返品は商品到着後14日以内に承っておりますこの一句,核心信息14日夹在中间,前后各挂着一截礼貌成分。
同样的意思写成短句,14日会跳到很靠前的位置。
这不是要求你放弃敬体,而是提醒你敬体和答案前置这两件事需要一起设计。
可行的做法是分层:段落的第一句用最短的敬体把答案说完,第二句再补条件和例外。这样礼貌没丢,抽取友好度也保住了。段落级排名的工程做法那篇讲的可抽取块设计,在日语站上要多考虑一层敬语带来的句长膨胀,同样一句话的日语敬体版本通常比常体版本长出三到四成。
句长膨胀的幅度可以量化。同一句话的常体版本和敬体版本,字符数通常差三到四成,再叠上尊敬語会到七成以上。日语这类东亚字符宽度的标准里定义的全宽字符,一个字占的版面也更大,结果是答案在句中的相对位置和在屏幕上的位置一起后移。
专业度和权威度那一侧,敬语能加分吗
能,但加的方式跟大多数人想的不同。
敬语用得对,加的不是分,是不减分。
一个日语页面如果敬语方向错乱、档位忽高忽低,读者的第一反应是这内容不是本地人写的。
这个判断一旦成立,后面所有的专业性表述都会被打折。
评估这类信号的时候,语言的自然度是本地评估员最容易感知的那一层。
他们不需要懂你的行业,只需要读三段就能判断这是不是母语者写的。
所以敬语在专业度和权威度这条线上的作用是门槛而不是加分项:写对了,读者才会开始看你的内容本身;写错了,内容再好也过不了第一道感知关。质量评估指南的自查清单那篇里那套自查逻辑放到日语站上,第一条就该是找个母语者盲读三段,问他这站看着像哪国人做的。
还有个更实际的理由:本地评估员和真实用户是同一批人,感知路径也一样。他们不会逐句分析敬语对错,只会在读到第三段时形成一个模糊判断——这站像不像本地开的。这个判断一旦形成就很难翻盘,后面再好的证据也只是在跟第一印象拔河。
六个页面位置各该用哪一档
标题和大标题:把名词形留出来
标题这个位置的首要任务是被搜到,不是显得客气。
日语的标题传统上本来就偏向体言止め,也就是用名词收尾。
ブーツの返品方法比ブーツを返品なさる方法自然得多,也短得多。
名词形还有一个额外好处:它不带敬语方向,不存在抬错人的风险。
所以标题这一格的规则很简单,能用名词形就用名词形。
敬语让位给检索,在这个位置上不会有任何人觉得失礼。
下面这张表是保哥给日语站定的位置与档位对照,用了两年,中间只改过一格。它的用法不是查着写文案,而是反过来当审计单——上线前按位置逐格核对,看哪一格的实际档位跟表里对不上。
| 页面位置 | 丁寧語档位 | 尊敬語/謙譲語 | 首要目标 | 常见错法 |
|---|---|---|---|---|
| 标题与大标题 | 不用,走名词形 | 一律不用 | 检索覆盖 | 套上敬语后关键词被拆散 |
| 元描述 | ます形 | 不用 | 点击率与覆盖并重 | 写成纯敬语句,裸词一个不剩 |
| 正文段落 | ます形 | 按方向用 | 可读与自然 | 方向错、档位忽高忽低 |
| 问答的问句 | 常体或短敬体 | 不用 | 贴用户口吻 | 把问句也写成敬语长句 |
| 按钮与表单标签 | 短ます形或名词形 | 一律不用 | 无歧义 | 主语省略导致方向错 |
| 客服话术与邮件 | ます形起步 | 按方向用,可高一档 | 关系维护 | 模板写完两年没人再读 |
这张表最容易被误读的是元描述那一格。它不参与排名,很多人因此认为怎么写都行,实际上它决定用户看到结果时会不会停下来。敬体是给人的,裸词是给眼睛的,两者要在同一段一百来个字符里共存,日语的字符预算比英文紧得多。
元描述:敬体可以,但裸词得塞进去
元描述是给人看的,写成敬体没问题。
它的坑在于很多人把它当成一段客气的宣传语来写。
写完一读,通篇是ございます和いたします,实词没剩几个。
这段文字不参与排名,但它决定用户看不看你这条结果。
用户扫一眼描述,找的是自己刚才打进去的那几个字。
那几个字全是裸词,你的描述里一个都没有,用户的眼睛就滑过去了。
务实的写法是前半句放裸词组成的事实陈述,后半句再用敬体收口。这样既有字面命中,读起来也不生硬。日语描述的字符预算本来就紧,礼貌成分吃掉的每一个字符,都是从事实那边扣出来的。
还有个细节:日语的元描述在移动端截断得更早,礼貌成分往往正好占掉开头那一截。把事实性的短句放在最前面,即使被截断,用户看到的那半句仍然带着他刚才输入的那几个字。电商体验趋势的用户研究更新里的扫读结论说得很直白,用户在结果页上停留的时间是以秒计的。
问答区的问句必须用用户的口吻
整个页面上,问答区的问句是唯一一处应该主动降档的地方。
因为这一行的角色是复述用户的问题,不是站方在说话。
返品はいつまで这样的短问句,比丁寧に返品期限についてお教えいただけますか自然得多。
用户的原话什么样,这一行就该什么样。
答句再切回敬体,一问一答两档,读起来完全不违和。
这种一低一高的组合在日语的商业文本里很常见,客服的问答集就是这么写的。
这一格是整张表里性价比最高的一格:它同时解决了字面覆盖和结构化数据的取值问题,而且改起来不需要动正文一个字。把二十条问句从敬语长句改成用户口吻的裸问句,是保哥在日语站上做过的投入产出比最高的一次改动,用了不到一天。
要提醒的是降档只限于问句本身。答句还是敬体,而且答句第一句必须把答案说完。敬语在日语里的重要性里讲的那种日常场景,跟页面上的一问一答其实是同一个结构——问的人随意,答的人客气,两边都不觉得别扭。
按钮和表单标签:短、无歧义、不许上尊敬語
按钮上的字数预算按个位数算。
敬语一进来,字数立刻翻倍。
更麻烦的是主语被压缩掉之后,方向判断失去依据。
所以这一格的规则是尊敬語和謙譲語一律不用,只留最短的ます形或者干脆名词形。
カートに入れる、購入手続きへ,这类形态在日本电商里是标准写法。
用户不会因为按钮不客气就不点,倒是会因为按钮太长而找不到重点。
表单标签同理,而且还要加一条:标签里的名词形往往就是用户搜索时用的形态,お届け先和配送先这两种写法,后者在搜索里出现得多得多。这一格顺手就做了字面覆盖,条件是别把前缀挂上去。
按钮文案还有一条日语特有的约束:假名和汉字混排的比例会影响识别速度。全假名的按钮在小字号下辨识度低,全汉字又显得生硬。稳妥写法是动词用汉字、助词用假名,カートに入れる正是这个结构,扫一眼过去重心自然落在汉字上。
客服话术和邮件可以比商品页高一档
整站统一档位是最常见的错。
商品页是商品在说话,客服邮件是人在说话,两者本来就不该同档。
客服这一侧档位高一点是自然的,日本用户也确实期待这个。
但这一格有个隐藏风险:邮件模板通常在上线时翻译一次,此后再没人读过。
而这些模板的阅读量往往超过大部分商品页。
把邮件模板纳入定期复检,是这一格唯一需要的动作。
顺带一提,客服邮件里的敬语档位还有个功能是商品页给不了的:它能表达歉意的层次。发错货、延迟发货、缺货这三种情况在日语里对应的道歉表达是有明确梯度的,用错梯度比用错档位更容易激怒人。这一层已经超出了本文的范围,属于客服培训的内容,但它提醒我们敬语在不同页面上承担的功能并不相同。
二重敬語为什么在商品页上代价更大?
什么样的句子算二重敬語
同一个动作上叠了两层同方向的敬语,就叫二重敬語。
お召し上がりになられる是最常被拿来当例子的那一个,召し上がる本身已经是尊敬語,后面再加られる就多了一层。
官方语言机构的敬语指导文件里明确把这类形态列为不推荐。
它不是语法错误,是过头。
日本人自己也常犯,尤其是在紧张的场合,比如新人接电话。
所以你会在真实的日本服务业里听到不少二重敬語,这也是很多团队困惑的来源。
困惑的解法是分清场合:口语里的二重敬語是即时产生的,说完就散了,听的人多半只感到对方很客气;写在页面上的二重敬語是固定下来的,读者可以停下来反复看,而且它会出现在几百个页面的同一个位置上。同一个表达,在口语里是紧张,在页面上是风格。
还有一类形态介于合规和过头之间:させていただく。它在现代日语里用得极广,官方指导文件也承认难以简单判错,但页面上密集出现同样显得卑微。把它当成计数指标而不是对错判断,一页超过三次就标出来复核,比争论对错可操作得多。
日本人也犯,但页面上的后果不一样
口语容错高,文本容错低,这条在任何语言里都成立。
日语的特殊之处在于差距特别大。
一个二重敬語在页面上出现一次不要紧,问题是它通常不会只出现一次。
模板化的站点会把同一句话渲染到成百上千个页面上。
读者第一次读觉得客气,第三次读开始觉得别扭,第十次读就变成这站有点怪。
而搜索引擎看到的是同一串文本在全站高频重复。
这里有个容易被忽略的连带效应:过度敬语的句子长,重复度又高,会让全站的模板文本占比上升。对以短内容为主的商品站来说,这个比例本来就紧张,礼貌成分把它推得更高。当一个品类页的可见文本里有四成是各个模块的客套话时,真正描述商品的那六成就被稀释了。
模板文本这个占比不是凭感觉判断的。把一个品类页的可见文本导出来,按模块归类统计字符数,客套话超过三成就该动手。这个数字在日本头部电商上通常在一成五到两成之间,超出太多的站,读起来的观感会明显不一样。
过度敬语让商品页读起来像培训手册
这是最实际的那个后果。
日本电商的头部站点,商品页的文案其实相当克制。
敬体是基础,但不堆砌,句子短,信息密度高。
把敬语档位一路推到顶的页面,读起来像新人培训教材,而不像在卖东西。
用户要的是尺寸、材质、什么时候到,不是一段又一段的谦辞。
过度客气在日本市场并不加分,它传递的信号是这家店不太熟练。
三条可以机械检查的过度模式:同一句里出现两个以上敬语标记;させていただく这个形态在一页里超过三次;一个句子超过六十个字符还没出现实词。这三条都能写成脚本,不需要日语能力,检出来的结果交给母语审校复核。保哥用这三条扫过一个日语站,两百多个页面里命中了六十几处,其中八成集中在同一批模板上,改三个模板就全清了。
关键词表要不要按敬语形态展开?
两列对照表:用户打的形态和页面出现的形态
这是本文最实用的那个落地物,做法极简。
把关键词表加一列,左边写用户实际打的形态,右边写这个意思在你页面上出现的形态。
两列一样的,跳过。
两列不一样的,标出来,这就是裂缝清单。
裂缝清单不需要你去改正文,只需要保证那个裸词形态在页面的某一处真实出现。
问答的问句、表格的表头、面包屑、图片说明,都是可以放裸词的地方。
这张表最反直觉的一点是:它不要求你把页面写得更口语。恰恰相反,正文该多客气还是多客气,你只是在页面上另外找了几个不需要礼貌成分的位置,把用户输入的那串字面安置进去。语言风格和字面覆盖被分到了两个不同的容器里,谁也不用迁就谁。
| 意思 | 用户打的形态 | 页面上原有的形态 | 裂缝 | 安置位置 |
|---|---|---|---|---|
| 退货期限 | 返品 いつまで | 返品は商品到着後14日以内に承っております | 有 | 问答问句 |
| 换尺码 | サイズ 交換 方法 | サイズのご交換をご希望の場合は | 有 | 表格表头 |
| 运费 | 送料 いくら | 送料は全国一律でございます | 有 | 问答问句 |
| 商品品类 | ブーツ | ブーツ | 无 | 不需处理 |
| 库存状态 | 在庫 あり | ただいま在庫がございます | 有 | 标签与面包屑 |
裂缝那一列不必追求全覆盖。先处理既有裂缝、搜索量又集中的行,通常十行里有三四行值得动。剩下的记录在案,下次改版顺手带上。硬要一次补齐,页面会被塞成关键词清单,那是另一种伤害。
哪些词需要同时收两种形态
不是所有词都值得收两遍。
判据是这个词的核心信息挂不挂在动词上。
挂在动词上的,收两种;纯名词的,收一种就够。
另一个判据是搜索量的分布:如果裸词形态的量级明显高于礼貌形态,那礼貌形态就不必单独做页面。
日语的实际情况几乎总是裸词形态占绝对多数。
所以真正需要的操作是单向的:把裸词补进页面,而不是把敬语形态补进关键词表。
这里要跟锚文本那件事分开看。屈折语里锚文本会变形那篇讲的是词形随语法环境自动变化,站方管不住;日语敬语是站方主动选的档位,完全管得住。前者要靠版面位置绕开,后者只要定一张表就能定死,这是两种性质不同的词形问题。
判断搜索量分布时会遇到日语的额外麻烦:假名与汉字两种写法本来就在分流,敬语档位又切一刀,同一个意思可能散在四五个形态上。拿日语形态素解析器MeCab把它们还原成同一个原形,先按写法合并再按档位合并,剩下的才是真正要覆盖的形态数。
动词性查询和名词性查询的分工
名词性查询进品类页和商品页。
动词性查询进帮助中心和问答区。
这个分工在英文站也成立,但在日语站上它多了一层意义。
因为动词性查询正是敬语裂缝的全部所在地。
把它们集中安置到帮助中心,等于把裂缝集中到一处来治理。
帮助中心的文本风格本来就允许更接近口语,治理成本因此很低。
这条分工还顺带解决了一个老问题:商品页要不要为了长尾去堆问答。答案是不必,日语站尤其不必——商品页堆问答会把敬语档位搅乱,而帮助中心天然容得下用户口吻的问句。两类页面各管一类查询,风格也就各自稳定了。
帮助中心还承担着另一层功能:法定告知。日本的特定商取引法对通信销售有一批必须表示的事项,退货条件正在其中。这些文本天然是敬体的,而它们跟用户口吻的问句放在同一页并不冲突,一个负责合规,一个负责被搜到。
假名和汉字的选择跟敬语档位有关系吗?
敬语前缀写成假名还是汉字
お和ご这两个前缀,写成假名是主流。
御问い合わせ这种全汉字写法在现代商业文本里已经少见。
这件事本身不影响敬语档位,只影响字面。
但既然影响字面,它就影响覆盖。
所以规则跟前面一致:跟着主流写法走,不必纠结,真正要盯的是有没有一个不带前缀的形态在页面上出现过。
前缀本身不是关键词,去掉前缀的那个词才是。
顺带说一个容易踩的坑:某些词去掉前缀之后意思会变,或者变得不自然,比如ご飯。这类词属于美化語里已经词汇化的那一批,前缀是词的一部分,不能拆。分辨方法是查词典看有没有独立词条,这一步不需要日语能力,查完标注在词表里就行。
前缀这件事还牵扯到排序和检索的规范化。お和ご在很多系统的排序键里是要被剥掉的,否则同一批商品会因为前缀分成两堆。这属于区域数据标记语言的通用部分里排序与规范化那一块的常规处理,跟展示层写哪种形态是两回事。
敬体文本里汉字比例通常更高
这是一个统计上的倾向,不是规则。
敬语表达偏书面,书面文本的汉字比例本来就高。
这个倾向会轻微改变页面的字面构成。
对检索的影响是间接的,主要落在同一个词的假名写法和汉字写法哪个更容易被搜到。
这件事跟敬语没有因果关系,只是相关。
把两件事分开处理,判断会清晰很多。
具体的分工是:写法这一层交给选词那套方法,档位这一层交给本文这张位置表。两者会在同一个词上相遇,但决策依据不同——写法看的是哪种形态被搜得多,档位看的是这个位置在跟谁说话。同一个词在标题里用汉字裸词、在正文里用假名敬体,一点也不矛盾。
汉字比例还有一个跟版面有关的连带影响:汉字和假名的字面宽度一样,信息密度却更高,同样一行装得下更多意思。而日语的换行位置由Unicode的行断算法决定,敬体长句在窄屏上折行的落点更难控制,移动端的标题区尤其明显。
检索形态优先还是读感优先
这是团队里最容易吵起来的一件事。
母语审校倾向读感,运营倾向检索形态。
两边都有道理,所以需要一条事先约定的优先级。
保哥用的规则是按位置分权:标题、问答问句、表头这三处检索形态优先,其余位置读感优先。
规则写在验收单上,争议就不再需要每次重新吵一遍。
更重要的是它让母语审校知道自己在哪些格子里说了算。
没有这条约定的团队会陷入一种拉锯:审校把裸词改成敬语,运营又改回来,来回几轮之后双方都开始怀疑对方不专业。多语言内容的生产流水线那篇讲过,这类冲突几乎全部源于没有事先划分决策权,而不是源于谁的判断错了。
划分决策权还有个附带好处:审校的意见可以被统计。哪一格争议最多,说明那一格的规则写得不够清楚,下一版规范就该改那一格。语气的四个维度那套拆法可以直接借来当规范的骨架,把语气拆成几条独立的轴,每条轴单独约定。
团队里没人懂日语,这件事怎么验收?
三条不依赖语言能力的自检
第一条是主语补全率:抽查一百条短文案,看有多少条在中文原稿里标出了动作的执行者。
这一条完全不涉及日语,中文原稿就能查。
第二条是裸词出现率:拿关键词表里的裸词形态,在页面全文里做字符串检索,看命中几个。
命中为零的词,就是裂缝。
第三条是句长分布:统计页面上句子的字符数,看有没有一批超长句集中在同一个模板里。
超长句扎堆的地方,通常就是敬语堆砌的地方。
这三条能在半天内跑完,结果是一份具体到行的清单,交给母语审校时不再是请帮我看看这个页面自不自然,而是这三十七处请逐条判断。审校的效率会高好几倍,因为判断的对象从整体印象变成了单点事实。语言能力这件事没法外包给流程,但判断的范围可以由流程来划定。
第二条那个裸词检索还有个升级版:不只查词在不在,还查它出现在哪一类标签里。想知道某个形态在真实书面语里常不常见,去现代日语书面语均衡语料库查一次频次比凭感觉强。把命中位置和频次一起统计出来,清单的优先级排序就自动有了。
该问母语审校哪三个问题
第一个问题:这一句里的动作是谁做的,敬语方向对不对。
这是唯一必须由母语者回答的问题,也是最值钱的那个。
第二个问题:这个档位跟这个位置匹配吗,是不是过头了。
第三个问题:这句话如果去掉所有礼貌成分,意思还完整吗。
第三个问题的用意是找出那些靠礼貌成分撑起来的空句子。
三个问题都是封闭式的,答案非黑即白,不需要审校写小作文。
把这三问做成一张表,每行一句待判文案,三列打勾,审校一小时能过掉两三百条。开放式的请你润色一下会让同一个人一小时只能过掉三十条,而且返回的结果没法统计、没法复用、下次换个人又是另一套标准。母语审校验收清单那篇的核心主张就是这个:把审校的输出格式定死。
这三问还有个用法是招人时当面试题。给候选审校三句真实的站上文案,让他按三问各判一次。答得干脆的人,通常也是交付最稳的那个;把三问答成一段感想的人,日后每次返稿都会是一段感想。面试成本十分钟,省下的是后面几个月的来回。
客服工单是最好也最便宜的语料
要知道日本用户怎么说话,不用去买语料库。
你自己的客服工单里全是。
用户写给客服的第一句话,用的是他自己的表达习惯。
把半年的工单导出来,按词频排一遍,裸词形态和真实说法就出来了。
这批词的商业价值极高,因为写这些话的人已经是买家或者准买家。
关键词工具给不了这个,它给的是聚合后的形态,前面已经说过那层损耗。
做这件事有个额外收获:工单里会出现一批你从没想过的问法。日本用户描述尺码问题时的说法跟中文运营脑子里的翻译版本经常对不上,而这些说法一旦补进帮助中心,命中的都是购买意图最强的那批查询。同一份关键词表在两个市场的意图分叉那篇讲的分叉现象,在工单语料里看得最清楚。
工单语料还有一个别处拿不到的信息:同一个问题的两种问法背后往往是两类人。问返品 いつまで的多半已经收到货,问返品 できますか的多半还没下单。同一批词按购买阶段分个组,落地页该接哪一半就清楚了。
这套判断能搬到别的语言上吗?
韩语的阶称跟日语最像,但坑不在同一处
韩语也有成体系的敬语,而且档位比日语还多一层。
但韩语的检索裂缝主要不是敬语造成的。
它更大的麻烦在空格和助词上,同一个词加不加助词、空格切在哪里,直接决定能不能被搜到。
所以韩语站要先解决切分,再谈档位。
日语正好反过来,切分由引擎的词典处理,档位才是站方能控制的变量。
两门语言看着像,优先级完全不同。
这个对比说明一件事:礼貌层级这个语法特征本身并不决定你要花多少工程量,决定工程量的是这个特征有没有改写字面、以及站方能不能控制它。韩语的空格与助词那篇里那条空格与语义单元的尺子,量的就是这个。
顺带把日语这一侧的边界说清楚:分词交给引擎的词典,不等于站方无事可做。面向商用的日语分词器Sudachi这类工具能让你在本地复现引擎大致会怎么切你的标题,切出来的结果跟你想强调的那个词对不对得上,跑一次就知道。
判据换成一句话:档位差有没有改变字面
德语的Sie和du、法语的vous和tu,也是礼貌层级。
但它们换来换去,句子里的实词基本不动。
用户搜的那个名词、那个动词词干,两种档位下是同一串字符。
所以德法两语的礼貌选择是纯粹的品牌语气问题,跟检索无关。
日语不是,日语的档位差会整段改写动词。
这就是判据:先问档位差改不改字面,改的才需要做覆盖这层工作。
这条判据可以直接拿去筛你手上所有的目标语种,半小时就能筛完。改字面的那几门语言进检索治理清单,不改的那些交给品牌语气规范,两条线彻底分开。下面这张表是三门语言按这个判据的对照,第三列是真正要做的动作。
| 语言 | 礼貌层级 | 档位差改字面吗 | 检索影响 | 该做的动作 |
|---|---|---|---|---|
| 日语 | 三套并行,含方向 | 改,动词整段变形 | 大,动词性查询全线错位 | 按位置定档,补裸词覆盖 |
| 韩语 | 多档阶称 | 改,但空格与助词影响更大 | 中,主因在切分 | 先治切分,再谈档位 |
| 德语与法语 | 两档称呼 | 基本不改实词 | 几乎没有 | 只写进品牌语气规范 |
表里第三列那个改不改字面的判断,可以用更机械的办法做:把同一句话的两种档位分别丢进分词器,比较切出来的实词集合。集合一样就是不改字面,集合不一样就要做覆盖。日语的通用依存标注里对动词形态的标注方式,正好能说明变的是哪一层。
常见问题解答
日语站到底该用敬体还是常体?
整站基调用敬体,这一点在日本商业站上没有争议。真正要决定的不是二选一,而是哪几个位置例外。标题、问答的问句、表格表头、按钮这四处走常体或者名词形,其余位置敬体。这样定完,全站风格是统一的敬体,同时用户输入的那批裸词也在页面上有了落脚点。把它写成一张位置表贴在文案规范里,比要求每个人自己拿捏可靠得多。
敬语用错了会被搜索引擎判罚吗?
不会。没有任何一个环节在给礼貌程度打分,敬语错了也不构成质量问题的判定依据。它的影响是间接的两条:一条是词形改变导致字面覆盖丢失,这条落在匹配上;另一条是母语读者感知到内容不像本地人写的,这条落在停留、回访和评估员的整体印象上。两条都不是判罚,但两条叠起来足以让一个内容不错的站长期跑不出量。
把商品页改成常体会不会显得不专业?
会,所以不要整页改。本文主张的从来不是降低敬语档位,而是在保持敬体的前提下,另外找几个不需要礼貌成分的位置来安置裸词。表头、面包屑、问答问句、图片说明这些地方在日语站上本来就不用敬体,把裸词放进去既不违和也不失礼。风格和覆盖是两件事,不必让其中一件迁就另一件。
机器翻译能处理好敬语吗?
档位能处理个大概,方向经常出错。原因不在模型能力,在于中文原文里通常根本没有写明动作的执行者,配送时间为三到五天这句话里没有任何成分标出谁在配送,模型只能猜。解法不是换更好的翻译工具,是在中文原稿上补主语。这一步由中文运营完成,成本几乎为零,却能把方向类错误砍掉大半。
敬语档位需要按品类区分吗?
需要,但区分的幅度比想象中小。高客单价、面向年长客群的品类可以整体高半档;面向年轻客群的品类可以更接近口语。真正要按品类区分的其实是另一件事——道歉和补偿类文案的表达梯度,这一层跟客单价强相关。商品页的常规档位在各品类之间的差别没那么大,不值得为它维护多套规范。
怎么判断我的日语页面是不是过度敬语了?
三条机械规则可以先跑一遍:同一句里出现两个以上敬语标记、させていただく在一页里超过三次、句子超过六十个字符还没出现实词。三条都能写成脚本,命中的结果交给母语审校复核。经验上命中会高度集中在少数几个模板上,改几个模板就能清掉大部分。这比逐页人工通读省事得多,也更容易在下次上线前重跑一遍。
没有日语母语者,这套东西能落地吗?
能落地一大半。主语补全、裸词覆盖检查、句长分布、三条过度敬语规则,这四件事都不需要日语能力。剩下必须由母语者判断的只有敬语方向对不对,以及档位跟位置匹不匹配这两项,而这两项可以打包成封闭式问题,按小时外包给一位母语审校。把不需要母语能力的部分先做完,再去买那一小块判断,是预算有限时最合理的顺序。
权威参考资料
本文标题:《日语页面写得越客气,跟用户在搜索框里打的那串字差得越远》
本文链接:https://zhangwenbao.com/japanese-seo-keigo-politeness-levels-conversion-ranking.html
版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0