你有没有过这种经历:花了两周写了一篇自己很满意的文章,发布后每天盯着 Analytics,结果一周过去了,总访问量还是个位数。
大部分人第一反应是”内容不够好”,然后开始改标题、加关键词、再写一篇。
但很多时候,问题根本不在内容。你的内容可能很好,只是 Google 根本不知道它存在,或者知道了但没法正常访问。
技术 SEO 就是干这个的——确保搜索引擎能顺利发现、爬取、理解和索引你的网站。以下 6 个问题是最常见也最好修的。
1. 页面没被索引
这是最基础但也最容易被忽视的问题。你写了 100 篇文章,Google 可能只索引了 60 篇。
怎么查:
打开 Google Search Console → 页面索引 → 查看”未索引”的数量和原因。
最常见的几种情况:
- “Crawled – currently not indexed”:Google 爬了但没收录。通常因为内容质量不够,或者和已有页面太相似。2025 年 Google 核心更新后,这个标签的数量在很多站上增加了——Google 对内容质量的要求在变严。(来源:Google Search Central,August 2025 Core Update)
- “Discovered – currently not indexed”:Google 知道有这个 URL 但还没去爬。常见原因是爬取预算不够——如果你网站上有太多低价值页面(分类页、标签页、分页),Google 的爬虫可能在那些页面上浪费了配额
- “Excluded by ‘noindex’ tag”:你的页面被设置了 noindex。检查是不是误加了
修复步骤:
- 对于”被爬未索引”的页面:增加 500 字以上的实质性内容,确保每个页面有独特的价值
- 对于”发现未爬”的页面:提交 Sitemap,增加内链,减少低价值页面的数量
- 检查是否有 noindex 误标:用 Screaming Frog(免费版可查 500 个 URL)或者浏览器查看页面源代码,搜索
2. robots.txt 意外屏蔽了重要页面
robots.txt 是用来告诉搜索引擎哪些页面可以爬、哪些不可以。但一个常见的错误是——不小心把重要目录给屏蔽了。
怎么查:
Search Console → robots.txt Tester(在设置菜单里),输入你的 robots.txt 内容,测试几个重要页面的 URL 是否被允许爬取。
常见的坑:
- 复制粘贴别人的 robots.txt 没改,不小心把
/blog/或者/content/屏蔽了 - 开发环境配置直接部署到生产环境,robots.txt 里还有
Disallow: / - 用了某些 SEO 插件,插件自动生成了一个过于严格的 robots.txt
修复:
直接在网站根目录访问 https://你的域名/robots.txt,确认内容是否正确。一个标准的 robots.txt 长这样:
User-agent: *
Allow: /
Sitemap: https://你的域名/sitemap_index.xml
如果网站还在开发阶段可以用 Disallow: /,但上线后一定要记得改回来。
3. Core Web Vitals 不达标
Google 从 2021 年开始把 Core Web Vitals 作为排名信号之一。到 2026 年,这三个指标依然直接影响用户体验和搜索排名。
三个关键指标:
- LCP(最大内容绘制):页面主要内容加载完成的时间,建议 < 2.5 秒
- FID / INP(首次输入延迟 / 交互到下次绘制):用户操作页面到页面响应的时间,建议 < 200 毫秒。Google 在 2024 年 3 月用 INP 替换了 FID
- CLS(累计布局偏移):页面加载过程中的视觉稳定性,建议 < 0.1
怎么查:
Search Console → Core Web Vitals 报告,会直接告诉你哪些页面有问题。也可以用 PageSpeed Insights(https://pagespeed.web.dev/)输入 URL 查看详细诊断。
常见修复:
- LCP 慢:优化图片(WebP 格式、压缩)、启用 CDN、移除阻塞渲染的资源
- INP 高:减少 JavaScript 执行时间,延迟加载非关键脚本
- CLS 高:给图片和视频设置明确的宽高,不要动态插入内容导致布局变化
根据 HTTP Archive 2025 年的数据,只有约 38% 的移动端网站通过了 Core Web Vitals 的所有三项指标。这意味着如果你修好了,就已经比 60% 的网站做得好了。
4. 重复内容和软 404
重复内容不是 Google 惩罚你的理由,但它会导致"资源浪费"——Google 的爬虫花了时间在重复页面上,就没时间去爬你的新内容。
常见重复内容来源:
- 带参数的分页 URL(
?page=1和?page=2内容一样) - HTTP 和 HTTPS 都能访问(没做 301 重定向)
- www 和非 www 都能访问
- 标签页和分类页展示相同的内容
软 404 更隐蔽——页面返回 200 OK,但内容是"404 找不到"或者"内容为空"。Google 的爬虫会把这个页面当正常页面处理,实际上用户点进来看到的是空白页。
怎么查:
Search Console → 页面索引 → 索引覆盖面,查看是否有"Submitted URL not found (404)"或"Soft 404"错误。也可以用 Screaming Frog 爬你的站,检查返回 200 但内容过短的页面。
修复:
- 使用
rel="canonical"标签指定哪个是主版本 - HTTP 重定向到 HTTPS,www 重定向到非 www(或者反过来,保持一致)
- 内容过少的页面要么扩充内容,要么返回 404
5. Sitemap 没有及时更新
Sitemap 是你的"内容清单"——告诉 Google 你的网站有哪些重要页面。但很多人建站时提交一次 Sitemap 就再也不管了。
常见问题:
- 新发布的内容没有出现在 Sitemap 中
- Sitemap 包含了大量低价值页面(标签页、搜索结果页)
- Sitemap 里还有已经删除的页面(返回 404)
怎么查:
Search Console → Sitemaps,查看提交的 Sitemap 有多少页面被成功索引。如果索引比例低于 80%,说明 Sitemap 质量有问题。
修复:
- 确保 CMS 或网站程序能自动更新 Sitemap
- WordPress 可以用 Yoast SEO 或 Rank Math,它们会自动处理
- 手动创建的 Sitemap,每次发布新文章后记得更新
6. 移动端体验问题
全球超过 60% 的搜索来自移动设备。Google 从 2019 年开始使用移动优先索引——爬虫会先用移动端版本抓取你的网站。
怎么查:
Search Console → 移动端可用性报告。Google 会直接列出影响移动端体验的问题。或者用 Mobile-Friendly Test(https://search.google.com/test/mobile-friendly)测试单个页面。
常见问题:
- 字体太小,在手机上需要放大才能看
- 点击元素太近,容易误触
- 内容宽度超过屏幕,需要横向滚动
- 弹窗覆盖了主要内容
修复:
- 使用响应式设计,一个 HTML 适配所有屏幕
- 测试主流手机屏幕尺寸(375px 宽度是常见的最小尺寸)
- 不要用 Flash(这个现在应该没人用了吧)
一个快速自查流程
以上 6 个问题,花 30 分钟就能排查完:
- Search Console 索引报告(5 分钟):看有多少页面没被索引,原因是什么
- robots.txt 检查(2 分钟):确保没有误屏蔽
- Core Web Vitals 报告(5 分钟):看是否有页面不达标
- Sitemap 检查(3 分钟):看索引比例是否正常
- 移动端可用性报告(3 分钟):看有没有移动端问题
- 手动随机检查 3-5 个页面(10 分钟):看看是否有软 404、重复内容
做完这一轮,你基本能定位 90% 的技术 SEO 问题。剩下的就是逐个修复了。
技术 SEO 不是一次性的工作。网站改版、加新功能、迁移服务器,每一次变动都可能引入新的技术问题。每季度做一次全面检查,比出了问题再救要省心得多。
参考来源:Google Search Central 博客(https://developers.google.com/search/blog);HTTP Archive 2025 Web Almanac;Google Search Console 帮助文档(https://support.google.com/webmasters/answer/9128668);PageSpeed Insights 文档。
