SEO Guide · 02

从“搜索引擎怎么工作”,到一套能落地的 SEO 方法。

6 个主题模块 20 个可折叠章节 适合快速复习与工作查阅
20 节

搜索基础

先理解搜索引擎的工作方式,再决定要优化什么。

SEO 是什么,以及它真正要解决什么

SEO(搜索引擎优化)是持续改进网站的内容、结构与可信度,让搜索引擎更容易发现、理解和推荐页面,并最终带来相关流量与业务机会。

排名不是终点。更完整的目标链路是:可抓取 → 可索引 → 与查询相关 → 获得点击 → 满足需求 → 产生转化。

常见类型包括站内 SEO、站外 SEO、技术 SEO、本地 SEO、电商 SEO、新闻 SEO 与国际 SEO。不同网站的优先级不同,但底层逻辑都围绕“帮助用户找到最合适的答案”。

搜索引擎的三个基本步骤:抓取、索引、排名

1. 抓取(Crawl)

搜索引擎通过已知外链、站内链接和网站地图发现页面。爬虫访问前通常会读取 robots.txt,但 robots.txt 主要控制抓取,不等同于保证不被索引。

2. 索引(Index)

搜索引擎分析正文、图片、视频、结构化数据与页面关系,再决定是否把页面存入索引库。被抓取不代表一定被索引。

3. 排名(Rank)

当用户搜索时,系统会结合相关性、内容质量、站点信号、页面体验、时效性和上下文,从索引中选择并排序结果。

影响排名的信号:不要迷信“200 个固定因素”

公开讨论中常出现“200 个排名因素”,但更实用的做法是关注几类可行动的信号:

  • 内容是否准确、完整、原创并满足搜索意图;
  • 内部链接与外部链接是否帮助判断主题和权威性;
  • 移动端体验、加载性能与页面稳定性是否良好;
  • 网站与作者是否展示经验、专业性、权威性与可信度;
  • 结构化数据、HTTPS 与清晰架构是否减少理解成本。

新站建立信任通常需要时间,但不存在适用于所有网站的固定“6–12 个月沙盒期”。进度取决于竞争度、内容质量、抓取与站点信号。

Google 重要算法更新怎么理解
  • Panda:针对低质量、重复与薄弱内容。
  • Penguin:降低操纵性链接与过度优化的收益。
  • Hummingbird / BERT:更好理解自然语言、上下文与搜索意图。
  • RankBrain:机器学习参与查询与结果匹配。
  • 移动优先索引:以移动版内容作为主要索引与评估基础。
  • 核心更新:广泛调整系统对内容质量与相关性的判断。

算法名称适合帮助理解历史趋势,真正可持续的策略仍是高质量内容、健康技术基础与长期可信度。

站内与站外 SEO

一个负责页面自身质量,一个负责网站在外部生态中的可信信号。

站内 SEO:你能直接控制的部分

站内 SEO 包括内容深度与广度、信息架构、内部链接、标题与描述、H1–H3、图片 alt、URL 和页面体验。

  • 内容:围绕一个明确意图,覆盖用户完成任务需要的信息。
  • HTML:Title、Description、标题层级和链接文本要清晰表达主题。
  • 体验:移动端友好、速度合理、布局稳定、内容易读。
  • 原创与可信:有来源、有经验、有可验证证据,避免大规模复制或拼接。
站外 SEO:链接、声誉与真实影响力

站外 SEO 的核心不是“链接越多越好”,而是相关网站是否愿意自然引用你的页面,以及品牌是否在真实社区与行业中建立声誉。

  • 优先相关性、编辑价值与来源质量,而不是只看 DA/DR/AS。
  • 锚文本是可点击链接中的文字;自然锚文本通常包含品牌、网址和语义描述的混合。
  • 人工评估指南中的 E-E-A-T 不直接给页面打排名分,但体现了搜索系统追求的质量方向。
  • 参与度指标可帮助分析页面,但不要简单把跳出率等同为直接排名因素。
需要避开的黑帽与操纵性做法
  • 向搜索引擎和用户展示不同内容的 cloaking;
  • 关键词堆砌、隐藏文字与隐藏链接;
  • 批量购买、交换或自动生成低价值链接;
  • 页脚堆放大量无关关键词与链接;
  • 大规模生成没有独立价值的页面;
  • 侵入式跳转、误导性结构化数据与其他欺骗行为。
判断标准:如果一个动作只有“操纵排名”这一项价值,而无法改善用户体验、内容或可发现性,它通常风险很高。

关键词策略

关键词研究的本质,是理解人们如何表达需求,以及页面应该怎样回应。

关键词研究:先识别意图,再看搜索量

研究时至少记录:关键词、搜索意图、主题簇、排名页面类型、竞争度、业务价值与优先级。不要只凭搜索量决定内容。

信息型学习、理解、解决问题,如“canonical 是什么”。
导航型寻找特定品牌或页面,如“Ahrefs login”。
商业调查型比较和筛选,如“best SEO tools”。
交易型准备执行购买或注册,如“buy Semrush plan”。

同一个词可能有混合意图。创建内容前先观察 SERP 上主流页面类型,再选择一个主要意图,不要让单页同时承担互相冲突的任务。

关键词的常见类型与用法
  • 短尾词:范围广、量大、竞争强,适合定义主题或分类页。
  • 长尾词:更具体、意图清晰,适合产品页、FAQ 和解决方案内容。
  • 新鲜词:依赖热点,流量快起快落。
  • 常青词:需求长期稳定,需要持续更新保持准确。
  • 产品定义词:描述产品类型、属性、型号与用途。
  • 地理词:结合城市、区域与“near me”等本地意图。
  • 语义相关概念:不必机械追求所谓 LSI 关键词,重点是自然覆盖主题中的实体、问题和术语。
如何确定核心关键词与内容地图
  1. 列出产品、服务、用户痛点和真实用语。
  2. 用 GSC、Ahrefs、Semrush、客户问答与 SERP 扩展词表。
  3. 按意图与主题聚类,避免每个近义词都建一页。
  4. 为每个词簇匹配页面类型:主页、分类页、产品页、服务页或博客。
  5. 结合当前权重、竞争度、商业价值和制作成本排序。

核心关键词会随产品、市场与排名变化而调整。搜索量阈值不能只按“网站年龄”机械决定,应结合站点实力和 SERP 竞争现实。

关键词与销售漏斗如何对应
  • 认知:解释问题与概念,获得第一次接触。
  • 兴趣:教程、清单、案例与对比,帮助深入研究。
  • 决策:产品对比、方案页、定价、证明与 FAQ。
  • 行动:试用、购买、咨询、下载等明确 CTA。

SEO 通常只是获客起点。还要通过 GA4、CRM 或订单数据评估从内容到线索、购买与复购的完整路径。

网站与内容架构

让用户和爬虫都能在少量点击中理解网站。

SEO 友好的页面设计清单
  • 图片使用有意义的文件名和描述性 alt;纯装饰图可用空 alt。
  • 视频和音频提供标题、说明、字幕或文字稿。
  • 重要内容不要只在复杂交互后才加载;折叠内容也应存在于可访问 DOM 中。
  • 以移动端为优先,保证字体、触摸目标、布局与加载体验。
  • 每页有唯一且描述准确的 Title、H1 与主内容。
  • 用 GSC URL 检查确认 Google 实际看到的页面。
网站架构:分类、层级与点击深度

理想结构通常是:主页 → 核心分类 → 子分类/主题页 → 详情页。分类应该反映用户的查找逻辑,而不是内部组织结构。

  • 重要页面应从导航、分类或相关页面获得稳定内链。
  • 尽量让主要页面在少量点击内可达,但“四次点击”是经验法则,不是绝对规则。
  • 新页面进入已有主题分类,避免形成孤儿页。
  • 面包屑、相关推荐和上下文链接共同传递关系与权重。
内部链接如何传递语义与优先级

内链帮助搜索引擎发现页面、理解主题关系,也帮助用户继续完成任务。高价值页面应该从相关的中尾与长尾页面获得自然链接。

  • 使用能描述目标内容的锚文本,避免所有链接都写“点击这里”。
  • 从高流量、高外链或枢纽页面链接到重要页面。
  • 避免全站模板中堆放大量低相关链接。
  • 定期检查孤儿页、断链、重定向链和过深页面。
常见页面类型与各自任务
  • 主页:解释品牌、核心价值与主要入口。
  • 分类/集合页:承接中短尾商业词,帮助筛选产品或服务。
  • 产品/服务页:回答规格、利益、证据、风险与购买问题。
  • 博客/指南:覆盖信息需求并连接到下一步。
  • 关于、联系、FAQ:补足信任与决策信息。
  • 政策页:提供隐私、运输、退款等必要规则,不必强求自然排名。

URL 与国际化

URL 既是地址,也是网站信息架构的外显。

URL 的组成部分
  • 协议:优先 HTTPS。
  • 域名与 TLD:例如 example.com;TLD 本身不是权威保证。
  • 子域名:如 shop.example.com,适合需要明显隔离的业务。
  • 路径/子目录:如 example.com/guides/seo-url。
  • 参数:如筛选、排序、站内搜索和 UTM 跟踪参数。
https://www.example.com/guides/seo-url?source=newsletter
SEO 友好 URL 的实践
  1. 简短、稳定、能描述页面主题。
  2. 单词之间使用连字符,统一小写。
  3. 自然包含主题词,不做关键词堆砌。
  4. 避免不必要日期、冗长标题与无意义参数。
  5. 参数页面做好抓取、索引与 canonical 管理。
  6. 旧 URL 改动时配置一对一 301,并更新内链与站点地图。

“子文件夹一定优于子域名”不是绝对规则。多数场景下子目录更容易统一维护信号,但业务隔离、技术与权限也会影响选择。

国际与本地化 URL 结构

常见方案包括国家顶级域名(example.fr)、子域名(fr.example.com)与子目录(example.com/fr/)。选择后应保持一致并建立清晰导航。

hreflang 示例

<link rel="alternate" href="https://example.com/" hreflang="en-us">
<link rel="alternate" href="https://example.com/fr/" hreflang="fr-fr">
  • 每个语言/地区版本都要互相引用,并包含自引用。
  • 语言与地区代码要有效;通常还应提供 x-default。
  • 不只是翻译文字,还要本地化货币、时区、联系方式与文化语境。
  • hreflang 帮助选择正确版本,不能替代 canonical。

索引与规范化

控制哪些页面可被发现、哪些页面应该进入索引、哪个版本是主版本。

提高页面被发现和索引的机会
  1. 在 GSC 验证站点并提交只包含规范 URL 的 XML Sitemap。
  2. 确保页面返回 200、允许抓取且没有 noindex。
  3. 通过导航、分类和正文内链让页面不成为孤儿页。
  4. 提供独特、完整且能满足实际需求的内容。
  5. 改善移动端体验、加载速度与服务器稳定性。
  6. 清理重复、薄弱、过时或无搜索价值的页面。

提交站点地图只是发现信号,不是索引保证。Google 最终仍会根据质量、重复情况和资源分配决定是否索引。

robots.txt 与 noindex 的区别
  • robots.txt:告诉爬虫哪些路径不应抓取;被屏蔽的 URL 仍可能因外部链接而出现在索引中。
  • meta robots noindex:要求搜索引擎不要把页面保留在索引中,但爬虫需要能访问页面才能看到该指令。
  • 登录/私密内容:应使用身份验证,不要依赖 robots.txt 保护隐私。
<meta name="robots" content="noindex,follow">
Canonical:为重复或近似页面指定主版本

规范化用于合并重复或高度相似 URL 的信号,例如带追踪参数、排序参数、打印版或同内容的多个路径。

<link rel="canonical" href="https://example.com/preferred-page/">
  • canonical 是强提示,不是绝对指令。
  • 规范 URL 应可索引、返回 200,并出现在内链与站点地图中。
  • 不要把内容完全不同的页面都 canonical 到首页。
  • 若旧页永久迁移且无需保留,应优先使用 301。
不同规范化方法怎么选
  • 301 重定向:旧页面永久迁移,用户与爬虫都应到新地址。
  • rel=canonical:多个版本仍需可访问,但希望聚合到主版本。
  • Sitemap:只提交首选 URL,作为弱规范信号。
  • 统一内链:所有站内链接都指向首选 URL,减少矛盾信号。
  • 参数控制:从产生源头减少无价值组合,并避免无限抓取空间。