从“搜索引擎怎么工作”,到一套能落地的 SEO 方法。
搜索基础
先理解搜索引擎的工作方式,再决定要优化什么。
SEO 是什么,以及它真正要解决什么
SEO(搜索引擎优化)是持续改进网站的内容、结构与可信度,让搜索引擎更容易发现、理解和推荐页面,并最终带来相关流量与业务机会。
常见类型包括站内 SEO、站外 SEO、技术 SEO、本地 SEO、电商 SEO、新闻 SEO 与国际 SEO。不同网站的优先级不同,但底层逻辑都围绕“帮助用户找到最合适的答案”。
搜索引擎的三个基本步骤:抓取、索引、排名
1. 抓取(Crawl)
搜索引擎通过已知外链、站内链接和网站地图发现页面。爬虫访问前通常会读取 robots.txt,但 robots.txt 主要控制抓取,不等同于保证不被索引。
2. 索引(Index)
搜索引擎分析正文、图片、视频、结构化数据与页面关系,再决定是否把页面存入索引库。被抓取不代表一定被索引。
3. 排名(Rank)
当用户搜索时,系统会结合相关性、内容质量、站点信号、页面体验、时效性和上下文,从索引中选择并排序结果。
影响排名的信号:不要迷信“200 个固定因素”
公开讨论中常出现“200 个排名因素”,但更实用的做法是关注几类可行动的信号:
- 内容是否准确、完整、原创并满足搜索意图;
- 内部链接与外部链接是否帮助判断主题和权威性;
- 移动端体验、加载性能与页面稳定性是否良好;
- 网站与作者是否展示经验、专业性、权威性与可信度;
- 结构化数据、HTTPS 与清晰架构是否减少理解成本。
新站建立信任通常需要时间,但不存在适用于所有网站的固定“6–12 个月沙盒期”。进度取决于竞争度、内容质量、抓取与站点信号。
Google 重要算法更新怎么理解
- Panda:针对低质量、重复与薄弱内容。
- Penguin:降低操纵性链接与过度优化的收益。
- Hummingbird / BERT:更好理解自然语言、上下文与搜索意图。
- RankBrain:机器学习参与查询与结果匹配。
- 移动优先索引:以移动版内容作为主要索引与评估基础。
- 核心更新:广泛调整系统对内容质量与相关性的判断。
算法名称适合帮助理解历史趋势,真正可持续的策略仍是高质量内容、健康技术基础与长期可信度。
站内与站外 SEO
一个负责页面自身质量,一个负责网站在外部生态中的可信信号。
站内 SEO:你能直接控制的部分
站内 SEO 包括内容深度与广度、信息架构、内部链接、标题与描述、H1–H3、图片 alt、URL 和页面体验。
- 内容:围绕一个明确意图,覆盖用户完成任务需要的信息。
- HTML:Title、Description、标题层级和链接文本要清晰表达主题。
- 体验:移动端友好、速度合理、布局稳定、内容易读。
- 原创与可信:有来源、有经验、有可验证证据,避免大规模复制或拼接。
站外 SEO:链接、声誉与真实影响力
站外 SEO 的核心不是“链接越多越好”,而是相关网站是否愿意自然引用你的页面,以及品牌是否在真实社区与行业中建立声誉。
- 优先相关性、编辑价值与来源质量,而不是只看 DA/DR/AS。
- 锚文本是可点击链接中的文字;自然锚文本通常包含品牌、网址和语义描述的混合。
- 人工评估指南中的 E-E-A-T 不直接给页面打排名分,但体现了搜索系统追求的质量方向。
- 参与度指标可帮助分析页面,但不要简单把跳出率等同为直接排名因素。
需要避开的黑帽与操纵性做法
- 向搜索引擎和用户展示不同内容的 cloaking;
- 关键词堆砌、隐藏文字与隐藏链接;
- 批量购买、交换或自动生成低价值链接;
- 页脚堆放大量无关关键词与链接;
- 大规模生成没有独立价值的页面;
- 侵入式跳转、误导性结构化数据与其他欺骗行为。
关键词策略
关键词研究的本质,是理解人们如何表达需求,以及页面应该怎样回应。
关键词研究:先识别意图,再看搜索量
研究时至少记录:关键词、搜索意图、主题簇、排名页面类型、竞争度、业务价值与优先级。不要只凭搜索量决定内容。
同一个词可能有混合意图。创建内容前先观察 SERP 上主流页面类型,再选择一个主要意图,不要让单页同时承担互相冲突的任务。
关键词的常见类型与用法
- 短尾词:范围广、量大、竞争强,适合定义主题或分类页。
- 长尾词:更具体、意图清晰,适合产品页、FAQ 和解决方案内容。
- 新鲜词:依赖热点,流量快起快落。
- 常青词:需求长期稳定,需要持续更新保持准确。
- 产品定义词:描述产品类型、属性、型号与用途。
- 地理词:结合城市、区域与“near me”等本地意图。
- 语义相关概念:不必机械追求所谓 LSI 关键词,重点是自然覆盖主题中的实体、问题和术语。
如何确定核心关键词与内容地图
- 列出产品、服务、用户痛点和真实用语。
- 用 GSC、Ahrefs、Semrush、客户问答与 SERP 扩展词表。
- 按意图与主题聚类,避免每个近义词都建一页。
- 为每个词簇匹配页面类型:主页、分类页、产品页、服务页或博客。
- 结合当前权重、竞争度、商业价值和制作成本排序。
核心关键词会随产品、市场与排名变化而调整。搜索量阈值不能只按“网站年龄”机械决定,应结合站点实力和 SERP 竞争现实。
关键词与销售漏斗如何对应
- 认知:解释问题与概念,获得第一次接触。
- 兴趣:教程、清单、案例与对比,帮助深入研究。
- 决策:产品对比、方案页、定价、证明与 FAQ。
- 行动:试用、购买、咨询、下载等明确 CTA。
SEO 通常只是获客起点。还要通过 GA4、CRM 或订单数据评估从内容到线索、购买与复购的完整路径。
网站与内容架构
让用户和爬虫都能在少量点击中理解网站。
SEO 友好的页面设计清单
- 图片使用有意义的文件名和描述性 alt;纯装饰图可用空 alt。
- 视频和音频提供标题、说明、字幕或文字稿。
- 重要内容不要只在复杂交互后才加载;折叠内容也应存在于可访问 DOM 中。
- 以移动端为优先,保证字体、触摸目标、布局与加载体验。
- 每页有唯一且描述准确的 Title、H1 与主内容。
- 用 GSC URL 检查确认 Google 实际看到的页面。
网站架构:分类、层级与点击深度
理想结构通常是:主页 → 核心分类 → 子分类/主题页 → 详情页。分类应该反映用户的查找逻辑,而不是内部组织结构。
- 重要页面应从导航、分类或相关页面获得稳定内链。
- 尽量让主要页面在少量点击内可达,但“四次点击”是经验法则,不是绝对规则。
- 新页面进入已有主题分类,避免形成孤儿页。
- 面包屑、相关推荐和上下文链接共同传递关系与权重。
内部链接如何传递语义与优先级
内链帮助搜索引擎发现页面、理解主题关系,也帮助用户继续完成任务。高价值页面应该从相关的中尾与长尾页面获得自然链接。
- 使用能描述目标内容的锚文本,避免所有链接都写“点击这里”。
- 从高流量、高外链或枢纽页面链接到重要页面。
- 避免全站模板中堆放大量低相关链接。
- 定期检查孤儿页、断链、重定向链和过深页面。
常见页面类型与各自任务
- 主页:解释品牌、核心价值与主要入口。
- 分类/集合页:承接中短尾商业词,帮助筛选产品或服务。
- 产品/服务页:回答规格、利益、证据、风险与购买问题。
- 博客/指南:覆盖信息需求并连接到下一步。
- 关于、联系、FAQ:补足信任与决策信息。
- 政策页:提供隐私、运输、退款等必要规则,不必强求自然排名。
URL 与国际化
URL 既是地址,也是网站信息架构的外显。
URL 的组成部分
- 协议:优先 HTTPS。
- 域名与 TLD:例如 example.com;TLD 本身不是权威保证。
- 子域名:如 shop.example.com,适合需要明显隔离的业务。
- 路径/子目录:如 example.com/guides/seo-url。
- 参数:如筛选、排序、站内搜索和 UTM 跟踪参数。
SEO 友好 URL 的实践
- 简短、稳定、能描述页面主题。
- 单词之间使用连字符,统一小写。
- 自然包含主题词,不做关键词堆砌。
- 避免不必要日期、冗长标题与无意义参数。
- 参数页面做好抓取、索引与 canonical 管理。
- 旧 URL 改动时配置一对一 301,并更新内链与站点地图。
“子文件夹一定优于子域名”不是绝对规则。多数场景下子目录更容易统一维护信号,但业务隔离、技术与权限也会影响选择。
国际与本地化 URL 结构
常见方案包括国家顶级域名(example.fr)、子域名(fr.example.com)与子目录(example.com/fr/)。选择后应保持一致并建立清晰导航。
hreflang 示例
<link rel="alternate" href="https://example.com/fr/" hreflang="fr-fr">
- 每个语言/地区版本都要互相引用,并包含自引用。
- 语言与地区代码要有效;通常还应提供 x-default。
- 不只是翻译文字,还要本地化货币、时区、联系方式与文化语境。
- hreflang 帮助选择正确版本,不能替代 canonical。
索引与规范化
控制哪些页面可被发现、哪些页面应该进入索引、哪个版本是主版本。
提高页面被发现和索引的机会
- 在 GSC 验证站点并提交只包含规范 URL 的 XML Sitemap。
- 确保页面返回 200、允许抓取且没有 noindex。
- 通过导航、分类和正文内链让页面不成为孤儿页。
- 提供独特、完整且能满足实际需求的内容。
- 改善移动端体验、加载速度与服务器稳定性。
- 清理重复、薄弱、过时或无搜索价值的页面。
提交站点地图只是发现信号,不是索引保证。Google 最终仍会根据质量、重复情况和资源分配决定是否索引。
robots.txt 与 noindex 的区别
- robots.txt:告诉爬虫哪些路径不应抓取;被屏蔽的 URL 仍可能因外部链接而出现在索引中。
- meta robots noindex:要求搜索引擎不要把页面保留在索引中,但爬虫需要能访问页面才能看到该指令。
- 登录/私密内容:应使用身份验证,不要依赖 robots.txt 保护隐私。
Canonical:为重复或近似页面指定主版本
规范化用于合并重复或高度相似 URL 的信号,例如带追踪参数、排序参数、打印版或同内容的多个路径。
- canonical 是强提示,不是绝对指令。
- 规范 URL 应可索引、返回 200,并出现在内链与站点地图中。
- 不要把内容完全不同的页面都 canonical 到首页。
- 若旧页永久迁移且无需保留,应优先使用 301。
不同规范化方法怎么选
- 301 重定向:旧页面永久迁移,用户与爬虫都应到新地址。
- rel=canonical:多个版本仍需可访问,但希望聚合到主版本。
- Sitemap:只提交首选 URL,作为弱规范信号。
- 统一内链:所有站内链接都指向首选 URL,减少矛盾信号。
- 参数控制:从产生源头减少无价值组合,并避免无限抓取空间。
