Google首选来源深链实测:114个媒体站里8个把读者带进空搜索
本文目录
- Google首选来源按钮有几种部署方式?嵌入式按钮和深链有什么区别?
- 这次首选来源部署实测怎么取样、怎么判定?
- 852个站点里有多少部署了首选来源入口?
- 首选来源入口放在首页还是文章页?嵌入式按钮用得多吗?
- 首选来源深链的q参数有哪几种写法?
- 哪些q写法会让谷歌来源偏好设置页返回“无结果”?
- 为什么同一个q参数会列出多个候选来源?
- 候选列表里的同名仿冒来源有多大风险?
- 未登录读者点击首选来源深链会看到什么?
- 首选来源入口怎么部署才能避免这些问题?
- 常见问题解答
- 首选来源深链的q参数应该填域名还是完整网址?
- 子域名上的出版物怎么写深链?
- 嵌入式按钮和深链哪个效果更好?
- 怎么知道有多少读者把我设成了首选来源?
- 在来源偏好设置工具里搜不到自己的站怎么办?
- 候选列表里出现冒用我品牌名称的站点怎么办?
- 权威参考资料
摘要:852个可访问的站点里,114个在页面上放了谷歌首选来源入口,法国主流媒体的部署率是45.1%,新闻类站点是25.4%,SEO与营销类站点只有3.3%。这114个站里93个只把入口放在文章页,用谷歌嵌入式按钮的只有3个,其余都是手写的深链。把111种不同的
q参数逐个放进谷歌的来源偏好设置页核对:不带协议的www.写法一律返回“无结果”,空值只给读者一个空搜索框,8个站至少有一条深链落空;另有32个站的深链会列出2到6个候选来源,其中两家的候选里混着与正牌同名的垃圾站。
谷歌在2026年4月把首选来源(Preferred Sources)扩展到全部搜索语言,5月又把“首选”标记带进了AI概览和AI模式。对新闻出版商来说,读者把自己设为首选来源,意味着在“热门新闻”(Top Stories)里出现的机会更大,在AI回答里还能带上一个醒目的标记。谷歌给出的推广手段很简单:在页面上放一个按钮,或者放一条指向来源偏好设置页的深链。
入口上线后能否正常完成添加,谷歌不提供任何反馈,Search Console里也没有对应报表。本文的实测分两步:先抓取852个站点的首页和文章页,找出部署了首选来源入口的114个站;再把这些站深链里的q参数逐个放进谷歌的设置页,记录读者点击后实际看到的内容。
站内此前已经写过这个功能本身:首选来源扩展到16种语言时中文站的处境,以及首选来源进入AI概览和AI模式后的变化。这两篇讨论的是功能该不该做、对排名意味着什么;本文只讨论部署层面的一件事:入口放上去以后,读者能不能顺利选中你。
Google首选来源按钮有几种部署方式?嵌入式按钮和深链有什么区别?
谷歌搜索中心的首选来源文档给出了三种做法,最后一次更新是2026年9月10日:
- 标准JavaScript实现(谷歌推荐):在
<head>里加载news.google.com/swg/js/v1/publisher.js,再在页面上放一个带google-add-preferred-source-btn属性的div。脚本会自动渲染一个按读者浏览器语言本地化的按钮,读者确认后返回原页面。 - 高级JavaScript实现:沿用同一套脚本,用自己的设计素材或在特定交互节点上调用接口触发同一套流程。
- 深链实现:不能跑脚本的情况下,放一个指向
https://www.google.com/preferences/source?q=加站点域名的链接,文字链或图片链都可以,也可以用在邮件和社交帖子里。
两种主流做法的用户流程并不一样。Search Engine Journal的作者在按钮接入教程里用手机实测过:嵌入式按钮打开的是一个已经锁定该出版物的确认页,读者点一下“添加”就完成,随后被送回文章;深链打开的是通用的来源偏好设置页,搜索框里预填了站点,读者还要自己勾选复选框,而且不会自动返回文章。
文档里有一处容易被忽略的措辞差异。深链的格式说明写的是q=Your_Website's_URL,也就是“网站网址”;紧跟着的两个示例写的却是q=example.com,一个不带协议、不带www的裸域名。填网址还是填域名,文档没有说死。下文会看到,这个差异在实际部署里被放大成了几种不同的写法,其中一部分在谷歌那一端解析不出来。
另一条硬性限制是资格范围:只有域名级和子域名级的站点能出现在来源偏好设置工具里,example.com/blog这样的子目录不在其中。文档建议先在工具里搜一下自己的站,搜得到再部署入口。
这次首选来源部署实测怎么取样、怎么判定?
样本分三组,目的是对比不同类型站点的部署差异:
| 样本组 | 来源 | 首页可访问 | 取到文章页 |
|---|---|---|---|
| 法国主流媒体 | 法国ACPM数字媒体排行里的品牌站 | 82 | 81 |
| 新闻类站点 | Tranco前一万里robots.txt声明了Googlebot-News或新闻站点地图的主机 | 232 | 205 |
| SEO与营销类站点 | 此前批次积累的出版商、SEO工具、营销博客清单 | 538 | 411 |
| 合计 | 852 | 697 |
采集在2026年9月17日完成,出口位于新加坡,请求用curl_cffi模拟Chrome的TLS指纹,法国媒体组的请求头语言设为法语。每个站取首页,再从首页链接里挑一篇结构像文章的页面,两个页面都保存原始HTML。判定规则是三条:
- 页面里出现指向
google.com/preferences/source的链接,记为“有深链”,同时解析出q参数。 - 页面里出现
google-add-preferred-source-btn属性,记为“有嵌入式按钮”;另外记录页面加载了哪一种news.google.com/swg/js/v1/脚本。 - 对加载了
publisher.js的7个站,再用真浏览器渲染一遍,确认按钮容器是否存在、是否有可见尺寸。
谷歌那一端的核对同样在9月17日完成:用一个已登录的谷歌账号,把114个站里出现过的111种q取值逐个打开,点击搜索框使候选列表展开,读取列表内容。全程只读,不勾选任何来源,账号的偏好设置没有变化。
这套方法有两个边界需要先说明。第一,判定基于原始HTML,完全由脚本在客户端插入、且不留任何标记的入口会被漏掉,所以114是下限。第二,候选列表的内容可能随账号语言、地区和时间变化,本文记录的是这一次看到的结果。
852个站点里有多少部署了首选来源入口?
| 样本组 | 首页可访问 | 部署了入口 | 部署率 |
|---|---|---|---|
| 法国主流媒体 | 82 | 37 | 45.1% |
| 新闻类站点 | 232 | 59 | 25.4% |
| SEO与营销类站点 | 538 | 18 | 3.3% |
| 合计 | 852 | 114 | 13.4% |
法国媒体的部署率最高,接近一半,地方日报占了很大比例:L'Est Républicain、Le Républicain Lorrain、Le JSL、L'Union、Courrier picard、Paris-Normandie、La Voix du Nord都在其中。同一集团旗下的站点写法往往一致,比如La Dépêche集团的La Dépêche、Midi Libre、L'Indépendant都用裸域名,Prisma Media旗下的Voici、Capital、Femme Actuelle、Geo、Ça m'intéresse都用带https://www.的完整网址,看得出是集团层面统一改的模板。
新闻类站点四分之一部署,覆盖了BBC、华盛顿邮报、每日邮报、明镜周刊、德国《世界报》、VnExpress等。SEO与营销类站点里部署的主要是本身就在做新闻的那部分,比如Search Engine Journal、Search Engine Land、Search Engine Roundtable、Ad Age、VentureBeat;纯工具站和营销博客基本没有动。
这个分布和功能本身的触发条件是一致的。首选来源只对会触发“热门新闻”的查询起作用,不做时效性内容的站点即使部署了入口,读者选了也很少能看到效果。站内首选来源信号拆解那篇按站型给过适配度判断,这里的实测数据与它的结论方向相同。
首选来源入口放在首页还是文章页?嵌入式按钮用得多吗?
114个站里,93个只在文章页放了入口,首页没有;18个首页和文章页都有;3个只在首页有,其中dejan.ai没能取到文章页,Search Engine Journal抽到的是一个网络研讨会落地页,不是普通文章。媒体的做法很统一:在文章正文末尾或作者信息附近放一行“在谷歌上把我们设为首选来源”,和“在Google新闻上关注我们”并列。
谷歌推荐的嵌入式按钮反而很少见。原始HTML里带google-add-preferred-source-btn属性的只有3个站:Search Engine Roundtable、塞尔维亚的Blic,以及一家写了按钮接入教程的营销机构。加载了publisher.js的站有7个,多出来的4个(Search Engine Journal、CoinDesk、dejan.ai、阿根廷的Infobae)页面上只有深链或者什么入口都没有,脚本加载了却没有被用来渲染按钮。
渲染检查的结果也不整齐。Search Engine Roundtable首页的按钮容器有可见尺寸;它的文章页也有容器,但高度为0,读者看不到。Blic的文章页有两个容器,一个可见一个不可见。按钮有没有渲染出来,只看HTML源码判断不了,必须在浏览器里确认。
放置位置本身没有对错,但它决定了入口能覆盖多少读者。从搜索、社交和聚合平台进来的读者多数直接落在文章页,文章页放入口是合理的;可如果只放在文章页,而文章模板里的深链又写错了,那么全站所有入口会同时失效,下文的CNET就是这种情况。
首选来源深链的q参数有哪几种写法?
114个站的深链里一共解析出119个站点与q取值的组合(有5个站在同一页上用了两种不同的写法),分布如下:
| q写法 | 数量 | 示例 | 谷歌端结果 |
|---|---|---|---|
| 裸域名 | 91 | lemonde.fr、bbc.com | 全部能匹配到本站 |
| 带协议的完整网址 | 18 | https://www.voici.fr、https://time.com | 17个能匹配;1个末尾多了反斜杠,无结果 |
| 空值 | 4 | ?q= | 只打开一个空搜索框 |
| 不带协议的www主机名 | 3 | www.cnet.com、www.rtl.fr | 全部无结果 |
| 品牌名或不带后缀的名称 | 3 | hindustan times、outlookindia | 能匹配,但会带出多个候选 |
裸域名占了四分之三,这是谷歌文档示例的写法,也是最稳妥的写法。带协议的完整网址来自对“Your_Website's_URL”的字面理解,法国Prisma Media系、印度的Moneycontrol和ABP、美国的Time、Benzinga、Bored Panda都这么写。
子域名出版物的写法值得单独说一句。Ouest-France的文章页抽到的是旗下足球站madeinfoot.ouest-france.fr的文章,深链就写了q=madeinfoot.ouest-france.fr;雅虎新加坡的新闻和生活方式频道分别写了sg.news.yahoo.com和sg.style.yahoo.com。这些都是按子域名独立登记的出版物,写法是对的,谷歌端也各自只列出一个结果。
哪些q写法会让谷歌来源偏好设置页返回“无结果”?
在来源偏好设置页上逐个核对后,能让读者落空的写法有四类:
- 不带协议的
www.写法一律无结果。样本里的www.cnet.com、www.rtl.fr、www.hindustantimes.com,以及另外对照测试的www.voici.fr、www.theguardian.com,全部显示“无结果”;而同样的主机名加上https://,或者去掉www.,都能正常匹配。看起来谷歌只会识别并剥掉完整网址里的协议和www,不会单独处理开头的www.。 - 子目录无结果。
searchenginejournal.com/category/news显示“无结果”,与文档中子目录不具备资格的说明一致。 - 多余字符无结果。Content Marketing Institute的一条深链写成了
https://contentmarketinginstitute.com\,末尾多出一个反斜杠,谷歌端无结果;同页另一条不带反斜杠的深链正常。 - 空值不报错,但什么也没有。
?q=打开的是一个空搜索框,读者必须自己输入站名再去找。
按站汇总,114个站里有8个至少有一条深链落空:
| 站点 | 页面上的q取值 | 谷歌端结果 | 影响 |
|---|---|---|---|
| CNET | www.cnet.com | 无结果 | 首页和文章页的深链全部落空 |
| Notre Temps | 空值 | 空搜索框 | 文章页唯一的深链落空 |
| Igniting Business | 空值 | 空搜索框 | 深链落空,同页另有嵌入式按钮 |
| RTL | https://www.rtl.fr与www.rtl.fr | 前者正常,后者无结果 | 同页两条入口一好一坏 |
| Hindustan Times | hindustan times与www.hindustantimes.com | 前者列出2个候选,后者无结果 | 同页两条入口一条落空 |
| Tom's Hardware | 空值与tomshardware.com | 前者空框,后者正常 | 文章正文里的内联链接落空 |
| VnExpress | 空值与vnexpress.net | 前者空框,后者正常 | 同页两条入口一条落空 |
| Content Marketing Institute | 带反斜杠与不带反斜杠两种 | 前者无结果,后者正常 | 同页两条入口一条落空 |
CNET的情况最典型:首页和文章页的深链都把q写成了www.cnet.com,两处入口点进去都是“无结果”。而cnet.com本身在工具里能搜到,删掉开头的www.就能恢复。Tom's Hardware的空值出现在文章正文的一句推广语里,同一页面上另有一条写对的深链,内联链接很可能是编辑手工加的,没有复用统一的地址。
这些问题在站点这一侧没有任何报错。链接本身返回200,页面正常打开,只有读者真的点进去才会发现搜不到。
为什么同一个q参数会列出多个候选来源?
能匹配到的站点里,74个点开后只列出自己;32个站的深链会列出2到6个候选。本次核对的所有列表里,正确的出版物都排在第一位,但读者需要自己在列表里找到并勾选它。候选来源大致有三类:
| 候选类型 | 例子 | 说明 |
|---|---|---|
| 同一集团的子站或语言版 | euronews.com带出法语、阿拉伯语、波兰语、西班牙语4个子站;goodreturns带出5个语言子站;protothema.gr带出英文版 | 本身是合法的独立出版物,但读者可能勾错语言版 |
| 前缀相同的无关站点 | nbc.com带出nbc.com.pg、nbc.com.my等5个;cbr.com带出乌拉圭、阿根廷、巴西等5个;space.com带出space.commerce.gov | 与本站毫无关系,只是域名前缀相同 |
| 寄生在第三方平台上的主机名 | outlookindia带出挂在escortbook、pbworks、sharepoint、mypixieset上的4个主机;spiegel.de带出spiegel.de.malavida.com | 来源不明,显示在正牌下方 |
从结果看,匹配逻辑近似前缀匹配加名称匹配:web.de会带出web.dev,space.com会带出space.comfortzoneskin.ru,hindustan times这样的品牌名则会同时匹配到hindustantimes.com和母公司htmedia.in。域名越短、越像通用词,候选越多,本次列出6个候选的站是CBR、Euronews、Goodreturns、NBC、Space.com和Time。
这对深链的用户流程有直接影响。嵌入式按钮打开的是锁定该出版物的确认页,不存在选错的问题;深链把选择交给了读者,候选越多,读者勾错或放弃的可能越大。
候选列表里的同名仿冒来源有多大风险?
两家法国和欧洲媒体的候选列表里出现了显示名称与正牌完全相同的站点:
q=ladepeche.fr列出3个候选,显示名都是“ladepeche.fr”,其中两个的实际主机是hartaslot.blog和pub1ff1ovma.travellertrip.blog。q=euronews.com列出的6个候选里,最后一个显示名是“Euronews.com”,实际主机是amp1don.bobojala.blog。
列表里显示名称用的是较大的字号,主机名是下方一行小字。读者如果只看名称,勾错的概率不低;勾错之后,“首选”标记会被加在一个与该媒体无关的站点上,而媒体方完全不会知道。outlookindia那组虽然没有冒用显示名,但4个候选主机名都以outlookindia开头,形态相同。
这类仿冒来源能进入工具的原因,文档没有解释。能确定的是,出版商可以控制的只有q参数:写成完整、准确的域名,候选列表会比写成品牌名或残缺名称时短,但不能保证列表里只有自己。能彻底避免选错的只有嵌入式按钮。
未登录读者点击首选来源深链会看到什么?
来源偏好设置是账号级功能。用未登录的浏览器打开任何一条深链,谷歌都会先跳转到账号登录页,continue参数里保留了原本的q值,登录完成后才进入设置页。没有登录谷歌账号的手机浏览器读者,点击入口后看到的第一屏是登录框。
这不是部署错误,但它影响转化预期。一条深链从点击到完成,读者可能要经过登录、等待列表展开、在候选里找到正确的出版物、勾选、再自己返回文章这几步;嵌入式按钮把中间的选择和返回两步省掉了。
来源偏好设置工具的收录范围也不算窄。核对过程中搜了一下本站zhangwenbao.com,工具里能找到,显示名是站点标题。能不能搜到,只是“具备被选的资格”,与会不会出现在“热门新闻”里是两回事。
首选来源入口怎么部署才能避免这些问题?
根据本次实测,部署和自查可以按下面的顺序做:
- 先在谷歌来源偏好设置工具里搜索自己的域名,确认能搜到,并记下工具里显示的主机名是带不带子域名的那一个。
- 能加载脚本的页面优先用嵌入式按钮,读者只需确认一次,不会在候选列表里选错。按钮上线后在真实浏览器里检查容器是否有可见尺寸。
- 必须用深链时,
q填裸域名,例如q=example.com;如果出版物登记在子域名上,就填完整的子域名。不要写www.开头却不带协议的主机名,不要带路径,不要留空。 - 把深链地址放进一个模板变量里集中维护,不要让编辑在正文里手写。Tom's Hardware的空值问题就出在手写的内联链接上。
- 把每一条深链地址实际打开一遍,点开搜索框,看列表里有几个候选、自己是否排在第一、有没有同名的仿冒站点。如果候选很多,在入口文案里写明完整域名,帮助读者辨认。
- 给入口加点击埋点。Search Console没有首选来源的专门报表,埋点是唯一能看到“有多少人点了”的数据;至于点了之后有多少人完成了勾选,站点这一侧无法获知。
如果站点还开通了谷歌的搜索资料页,首选来源、Discover关注和搜索资料是三个独立的入口,站内Google搜索资料开通指南对它们的关系做过梳理,部署时可以一并规划。
常见问题解答
首选来源深链的q参数应该填域名还是完整网址?
填裸域名最稳妥,比如q=example.com,这是谷歌文档示例的写法。本次实测中带https://的完整网址也能被正确识别,但不带协议、以www.开头的写法全部返回无结果,路径和多余字符也会导致无结果。
子域名上的出版物怎么写深链?
写完整的子域名,比如q=news.example.com。谷歌文档说明域名级和子域名级站点都具备资格,子目录不具备。实测中Ouest-France旗下子站和雅虎新加坡的频道都按子域名单独登记,各自只匹配到一个结果。
嵌入式按钮和深链哪个效果更好?
谷歌推荐嵌入式按钮。它打开的是锁定本出版物的确认页,读者确认后自动返回原文;深链打开的是通用设置页,读者需要在候选列表里自己勾选,而且不会自动返回。本次样本里32个站的深链会列出多个候选,这个问题只有深链才有。
怎么知道有多少读者把我设成了首选来源?
目前没有官方报表。站点能做的是给入口加点击埋点,统计点击次数;完成勾选的人数、以及首选来源带来的“热门新闻”曝光变化,谷歌都没有单独提供。
在来源偏好设置工具里搜不到自己的站怎么办?
先确认搜索的是域名或子域名,而不是带路径的网址。仍然搜不到时,说明站点暂时不在工具的收录范围内,这时部署入口没有意义,谷歌文档也建议先确认能搜到再部署。工具页面还提示,来源如果不定期更新,可能无法使用。
候选列表里出现冒用我品牌名称的站点怎么办?
出版商无法直接从工具里移除它们。可以做的是尽量改用嵌入式按钮,避免读者在列表里自行选择;使用深链时在入口文案里写明完整域名,方便读者辨认;必要时通过谷歌的相关反馈渠道报告冒用情况。
权威参考资料
本文标题:《Google首选来源深链实测:114个媒体站里8个把读者带进空搜索》
本文链接:https://zhangwenbao.com/google-preferred-sources-deeplink-audit.html
版权声明:本文原创,转载与引用请注明作者与原文链接。许可协议: CC BY 4.0