Typecho各类页面meta robots和canonical配置:5类页面差异
Typecho 默认主题对所有页面统一输出 follow,index 不够精细,导致分页权重稀释、搜索页低质量索引爆炸、归档页占用爬虫预算。本文按首页、文章页、单页、分类页、标签页、搜索页、归档页七种类型给出 meta robots 与 canonical 完整规则代码(基于 getCurrentPage 与 archiveUrl 末尾斜杠归一),可直接粘贴 header.php 立即生效。
标签
保哥笔记 技术SEO 标签下共 50 篇文章合集,含《技术SEO一堆问题先修哪个?500站实测排出来的优先》《Core Web Vitals在AI搜索时代还值不值》《电商SEO最重要的5点:从AI爬虫到accessib》等,与 Core Web Vitals、AI爬虫、结构化数据 主题密切相关,覆盖 SEO/GEO 实战角度的深度解析与可落地方案。
Typecho 默认主题对所有页面统一输出 follow,index 不够精细,导致分页权重稀释、搜索页低质量索引爆炸、归档页占用爬虫预算。本文按首页、文章页、单页、分类页、标签页、搜索页、归档页七种类型给出 meta robots 与 canonical 完整规则代码(基于 getCurrentPage 与 archiveUrl 末尾斜杠归一),可直接粘贴 header.php 立即生效。
电商筛选器一不小心就把Googlebot爬行预算吃光,乱写robots.txt Disallow又会把高搜索价值的色彩品牌价格筛选页一起屏蔽。保哥用2个真实案例(Magento 2跨境站爬行预算从92%浪费修到71%命中商品页,国内ECShop站因过度Disallow长尾流量损失70%)演示3类判别法和5档阶梯式处理策略,并附WooCommerce、Shopify、百度SEO的具体写法。
rel canonical 是建议告诉搜索引擎权重归属哪个 URL,meta robots noindex 是命令告诉搜索引擎别索引此页。两者解决的是不同问题不能互相替代。本文给出 5 个仅用 canonical 的场景与 5 个需要叠加 noindex 的场景,配 X-Robots-Tag HTTP 头进阶用法、5 类常见错误避坑、9 项 FAQ。
A/B 测试用 301 替代 302 让原始 URL 被去索引、把 H1 主关键词换成另一个让排名分裂——这两个真实事故说明产品团队和 SEO 团队对边界认识不一致。本文按抓取一致性、页面速度、URL 结构、排名波动、测试结束清理五层拆解风险,给出 Google Search Central 官方 5 条规则与一份 12 项实操检查表。
把 button onclick、JS 跳转、a href javascript:void(0) 与传统 a 链接放在一起,从抓取层、权重层、可访问性层、UX 层四个维度拆开分析。配 2.4 万 SKU 电商站全 button 改 a 后收录率从 38% 涨到 81% 的实测数据,给出具体的链接形态决策表。
14种AI客户端、3类抓取经济学、5种日志里的病:别再照官方文档和llms.txt模板猜了。这篇用一个能复现请求指纹的模拟器加访问日志反查,把robots、llms.txt、渲染策略从凭感觉改成可验证的工程,再讲清怎么固化成每季度自动复跑的能力
做瑜伽服装的出海独立站客户,改版上线第3天自然流量掉了将近四成。开发团队很委屈:预发布环境点过一圈,页面都正常。问题是他们只用人类浏览器看过,从没用爬虫视角压过——移动端列表页靠JS异步加载,爬虫拿到的是空壳。这篇把预发布环境压测拆成8个可执行维度:镜像生产到什么程度、为什么要多用户代理爬、JS渲染怎么开关双测、SEO元素怎么批量跨页型测、性能基准为什么要先在生产立、哪些边界用例最爱爆雷、为什么每次上线都得重测老bug,最后给一份按上线…
GPTBot普遍不渲染JavaScript,CSR站点对AI爬虫几乎透明。本文实测四象限渲染策略对AI引用率的影响、三家不同栈改造前后数据对照,给一组可在自己服务器跑出来的UA模拟命令,配hydration后改DOM等隐性坑的排查清单。
HTTPS到底是不是Google排名因素?证书要选DV还是OV、EV?HTTP迁HTTPS要不要逐页301、哪些环节最容易出错?这篇用一份完整流程清单回答这几个问题。本文从SSL与TLS的关系讲起,对照三种证书的差异和选型逻辑,把HTTP到HTTPS迁移拆成十五个具体动作,配混合内容Mixed Content的三层排查方法、HSTS与CSP等安全头的配置建议,再给迁移后的监控指标清单,最后用一个出海珠宝配饰独立站HTTPS迁移12周从掉…
页面速度对Google排名的权重到底有多大?怎么判断站点在哪一档?要先改图片还是先改服务端?本文从2010年到2026年的算法时间线讲起,拆解LCP、INP、CLS三个指标各自的阈值和触发条件,对照PSI、Lighthouse、WebPageTest、CrUX四个测速工具的数据源差异,把图片资源、JavaScript与CSS、服务端响应三层影响因素分别配诊断方法和修复ROI优先级矩阵,再讲怎么把速度数据接入90天闭环决策流程,最后给一个…
Page Experience 不是单一信号是 Google 把 6 项体验类排名因素打包成的综合框架:Core Web Vitals 三件套加上行动友善、HTTPS、避免侵入式插页广告。本文给完整演变时间线(2014→2024 INP 取代 FID)、6 项各自的阈值与测量、Page Experience 的真实权重与门槛效应、6 项优化的 ROI 排序、用 Search Console 监控整体的方法、什么情况下反而是浪费时间,以及…
域名选择是SEO决策成本最高的一步——5年后想换品牌等于推倒重来。过去3年帮28家出海独立站做域名选型实操,跑出来一些反常识结论:EMD不再香、老域名70%是坑、多TLD防御性注册过头反而稀释品牌信号。本文把TLD 7类的SEO信号差异、品牌词对EMD的决策路径、老域名收购6维度评估法、新站沙盒期28客户实测数据、Google惩罚域名识别8步审查清单、出海hreflang矩阵下的域名编排、北美宠物用品DTC 5国域名矩阵14周翻4倍真账…
织梦 DedeCMS 编辑器上传图片自动塞 width 与 height 属性导致移动端撑破屏幕的根因,给出修改 arc.archives.class.php 的三行 preg_replace 安全版本(用字符类避免正则贪婪问题)、DOMDocument 替代方案性能与正确性对比、配套响应式 CSS 兜底、老文章静态页批量更新与 CDN 缓存清理三步走。
团队一般是把供应商给的图直接入库,alt留空让后台自动填成文件名,半年后发现图片入口一直没量才回头翻源码。这里按数清六个可写位置、文件名统一走拉丁转写、alt按信息单元数而不是字符数定长、图片关键词表单独建成五列、图上文字按四档处理、上线后挂断言脚本查空alt六步收口。
团队一般是先把hreflang的值整块抄进inLanguage,再让前端把价格日期按当地写法输出,直到富媒体结果整批消失才回头查标记。这里按分清页面层与标记层两个方向、按语言格式书写系统三类拆字段、把地区子标签摘出内容属性、给品牌名配好本地名与拉丁别名、把价格日期还原成机器格式六步收口。
过期域名复用不是买个老域名301一下就有信任。Google从2020年起对过期域名的信任继承启动独立判定流水线,70%复用项目活不过6个月——不是域名差,是复用方法错。本文拆解Google所有权切换检测的6信号、信任继承的6类信号哪些真假能继承、收购前的4维尽调、12个月接手节奏、AI时代过期域名的新红利、ROI怎么算不被卖家忽悠。
nofollow、sponsored、ugc到底分别标什么类型的链接?自己网站上的联盟链接、赞助贴、用户评论区链接该怎么标,标错又会踩中哪些处罚红线?这篇按链接类型逐类给出对照与判断口径。
团队一般是先拿英文站那套锚文本配比红线去审俄语站,报告里精确匹配只有个位数,于是加了一轮内链才发现越加越乱。这里按认清变形是默认状态、把审计口径从字符串换成词干、按六个锚位置定允不允许变形、划锚边界只取核心词、锁定目标页标题的主格形态、按季度重跑词干口径复核六步收口。
收录静悄悄掉,技术 SEO 没毛病,外链也都还在——很可能 WAF 把 Googlebot 和 AI 爬虫一并拦了。本文按现代 Bot Management 怎么识别 bot、误拦的早期信号有哪些、GSC 与日志双向确诊路径、Cloudflare 与 Akamai 与 Imperva 与 AWS 与自建 nginx 五种环境的放行配置、AI 爬虫该放还是该挡六件事讲透,配一份半年掉 60% 收录的真实复盘。
PHP 动态生成 JavaScript 弹窗时 alert 文本里的 \n 换行符不生效是因为字符串经过两次解析层级未对齐。本文从最小复现、PHP 双引号与单引号转义规则差异、json_encode 安全标志位组合、动态拼接 JS 的 XSS 风险、CSP 严格模式禁用 inline script 五个层面把这个看起来很小的问题彻底拆开。