SEO kỹ thuật

MỘT hoàn tất hướng dẫn để SEO kỹ thuật — một đơn giản-language Beginner Hướng dẫn và một các hệ thống-cấp độ Advanced Hướng dẫn để crawling, kết xuất, lập chỉ mục, và xếp hạng.

Xuất bản lần đầu: 25 thg 6, 2026 · Cập nhật lần cuối: 8 thg 8, 2026 · Advanced
Ngôn ngữ

Hai các hướng dẫn trong một. Đó Beginner Hướng dẫn giải thích SEO kỹ thuật từ scratch — đó crawl → chỉ mục → xếp hạng pipeline, đó handful of foundations mỗi site cần, cách kiểm tra của bạn own site, và mà myths để bỏ qua. Đó Advanced Hướng dẫn goes các hệ thống-deep: ngân sách crawl, đó kết xuất decision, canonicalization ~40 các tín hiệu, liên kết nội bộ, Core Web Vitals as three tách biệt các vấn đề, ongoing monitoring, migrations, và AI tìm kiếm. Đó throughline là đó một I luôn come lại để — SEO kỹ thuật là đó hầu hết quan trọng part of SEO until điều này không. đây là đó foundation đó lets nội dung và links xếp hạng, không một xếp hạng trick of của nó own. Bạn không thể xếp hạng một trang Google sẽ không chỉ mục, so đó highest-giá trị hoạt động là thường đó hầu hết boring.

TL;DR — SEO kỹ thuật là đó giống nhau crawl → render → chỉ mục → serve pipeline on mỗi site — có không tách biệt “technical SEO algorithm” (bản dịch) «SEO kỹ thuật algorithm» — và đây là một foundation, không phải là yếu tố xếp hạng of của nó own. Treat đó pipeline as một series of gates và diagnose một trang là stuck tại trước thay đổi bất cứ điều gì. Đó leverage là mostly negative (không losing điều gì bạn đã earned), so đó boring structural hoạt động — canonicalization, các chuyển hướng, liên kết nội bộ — pays best, và điều này compounds tại quy mô. Hầu hết các trang không cần để manage ngân sách crawl; kết xuất là một tách biệt step đó có thể lag; Core Web Vitals là three distinct các vấn đề và một minor xếp hạng lever; canonicalization là một weighted decision trên ~40 các tín hiệu; và từ 2025 on, AI tìm kiếm gates eligibility on sạch kỹ thuật các tín hiệu trước điều này ranks hoặc cites bạn. Đó highest skill ở đây là prioritization — knowing điều cần bỏ qua.

kỹ thuật SEO decides eligibility, không position

SEO kỹ thuật là đó một part of SEO whose payoff là gần như hoàn toàn negative: của nó job là để giữ bạn từ losing thứ hạng, không để win them. Google không hand out positions cho sạch plumbing. Đó giống nhau crawling, lập chỉ mục, và xếp hạng các hệ thống chạy liệu trang web của bạn là pristine hoặc một disaster — có không tách biệt “technical SEO algorithm” (bản dịch) «SEO kỹ thuật algorithm» sitting behind them. Điều gì SEO kỹ thuật thực ra decides là liệu của bạn các trang có thể enter những các hệ thống tại all, và liệu đó engine understands them correctly khi họ là trong.

So đó right mental model không “do technical SEO to rank.” (bản dịch) «làm SEO kỹ thuật để xếp hạng.» đây là “do technical SEO so your content and links are allowed to rank.” (bản dịch) «làm SEO kỹ thuật so nội dung của bạn và links là được phép để xếp hạng.» Đó inversion là đó toàn bộ reason đó unglamorous hoạt động — canonicalization, các chuyển hướng, liên kết nội bộ — là đó highest-giá trị hoạt động, và vì sao đó single hầu hết hữu ích skill trong này discipline là prioritization: knowing điều cần cách sửa và, chỉ as thường, điều cần leave alone.

pipeline, as gates

Mọi thứ hangs off một pipeline, và đó operative clause từ Google là “not all pages make it through each stage.” (bản dịch) «không all các trang làm điều này qua mỗi stage.» Evidence for this claim Google Search describes crawling, indexing, and serving as three stages; discovery is part of the crawling stage, and not every page advances through each stage. Scope: Google Search documentation; conceptual explanation, not a promise of ranking outcomes. Confidence: high · Verified: Google: How Search Works không picture một conveyor belt đó carries mỗi trang để đó finish. Picture một series of gates, mỗi với của nó own truyền/fail:

  • Crawl — phát hiện (links + sitemaps + push các giao thức) plus đó fetch. MỘT trang không có gì links để, hoặc một disallowed trong robots.txt, có thể không bao giờ arrive.
  • Render — Google chạy của bạn JavaScript trong một gần đây headless Chrome (đó Web Kết xuất Service) trước điều này có thể fully understand đó trang. Này là một tách biệt step từ đó fetch, đây là stateless, và điều này có thể lag.
  • Chỉ mục — đó engine xử lý đó trang, picks một canonical among duplicates, và decides liệu để store điều này. “Indexing isn’t guaranteed” (bản dịch) «Lập chỉ mục không guaranteed» ngay cả khi crawling và kết xuất succeed.
  • Serve — query understanding, thì xếp hạng trên nhiều automated các hệ thống, thì đó tìm kiếm features layered on top.

giữ crawl ≠ render ≠ chỉ mục ≠ xếp hạng tách biệt trong của bạn head và phần lớn của kỹ thuật SEO dừng là mysterious. Khi trang underperforms, bạn không guess và bạn không thay đổi ten điều — bạn tìm mà gate nó thất bại và khắc phục đó stage.

Một honest caveat trước khi bạn treat bất kỳ pipeline mô tả as gospel, including mine: đây là một model, không đó mã nguồn. Cách Tìm kiếm Hoạt động là một talk I cho tại conferences đó walks qua này toàn bộ pipeline (slides on SlideShare), và I open điều này với một warning I’ll repeat ở đây: “this is my understanding of systems… not going to be 100% complete or accurate.” (bản dịch) «này là my understanding of các hệ thống… không going để là 100% hoàn tất hoặc chính xác.» Hold điều này loosely và dùng điều này để reason về các vấn đề.

Ai thực ra làm crawling

“Googlebot” sounds như một program. nó family — desktop, mobile ( một đó matters, since lập chỉ mục là mobile-đầu tiên), image, news, video, và quảng cáo các crawler — all drawing từ giống nhau ngân sách crawl pool, mà là Vì sao runaway image hoặc parameter crawl có thể starve crawling của bạn nội dung thực.

Và đây là không chỉ các công cụ tìm kiếm anymore. Khi I analyzed Cloudflare Radar crawl dữ liệu (an Ahrefs piece I wrote on đó new wave of bots), tìm kiếm-engine các crawler vẫn được crawl đó hầu hết, nhưng AI bots đã là firmly trong second place và on track để overtake them. Nếu bạn đọc của bạn logs, đó cast of characters có changed — và managing điều này (mà AI các crawler bạn cho phép, và confirming đó ones hitting bạn là ai they claim) là hiện tại part of đó job.

Ngân sách crawl: Khi nó matters, và Khi nó không

Google defines ngân sách crawl as “the set of URLs that Google can and wants to crawl,” (bản dịch) «đó set of URLs đó Google có thể và wants để crawl,» set by crawl capacity (máy chủ của bạn health) và crawl demand (popularity và staleness). Bạn raise effective budget hai ways: cho bots hơn capacity, hoặc — far hơn thường — dừng wasting điều này. Consolidate duplicates, block thấp-giá trị spaces, trả về 404/410 cho permanently đã biến mất các trang, cách sửa soft 404s, giữ sitemaps hiện tại với chính xác lastmod, và tránh dài chuyển hướng chains.

Đó reassuring part, và I’ll giữ saying điều này: hầu hết các trang không cần để worry về ngân sách crawl. Google itself tells bạn đó nếu của bạn các trang là generally được crawl đó giống nhau day họ là published, “you don’t need to read this guide.” (bản dịch) «bạn không cần để đọc này hướng dẫn.» Điều này bắt đầu để bite khoảng 1M+ các trang, hoặc 10k+ các trang đó thay đổi rapidly. Dưới đó, spend của bạn energy elsewhere. Evidence for this claim Google says crawl-budget guidance is mainly relevant to very large sites, including sites with over one million unique pages or over ten thousand rapidly changing pages. Scope: Google Search guidance; the page-count examples are diagnostic starting points, not hard eligibility thresholds. Confidence: high · Verified: Google: Large site crawl budget guide Bing Fabrice Canel frames đó giống nhau ý tưởng hơn bluntly: ít hơn là hơn — ít hơn URLs để crawl là tốt hơn cho SEO.

robots.txt: crawl control, không chỉ mục control

phần lớn quan trọng phân biệt trong điều này toàn bộ file: robots.txt controls crawling, không lập chỉ mục. Disallowing URL dừng bots từ fetching nó — nó làm không giữ nó out của chỉ mục. disallowed trang có thể vẫn là được lập chỉ mục (URL chỉ, Không có nội dung) nếu khác các trang link để nó, và tệ hơn, nếu bạn disallow trang bạn cũng dừng Google từ bao giờ seeing noindex tag on nó.

So rules là:

  • Muốn trang đã biến mất từ tìm kiếm? Cho phép crawling và thêm noindex. không bao giờ sử dụng robots.txt để deindex.
  • Muốn bots để skip thấp-giá trị URL space (internal tìm kiếm, infinite faceted combinations) và không care về lập chỉ mục? robots.txt disallow là đúng.
  • Managing AI các crawler? Đây là cũng nơi bạn cho phép hoặc block GPTBot, ClaudeBot, PerplexityBot, CCBot và friends — strategic decision, không default.

Canonicalization: weighted decision, không command

Canonicalization là nơi một lot of advanced SEO kỹ thuật lives, và đây là widely misunderstood. rel="canonical" là một hint, không một directive. Google weighs điều này so với nhiều other các tín hiệu — các chuyển hướng, liên kết nội bộ, sitemap inclusion, HTTPS, URL structure — khi điều này picks đó representative URL. My deep dive on canonicalization diễn đạt đó count khoảng 40 các tín hiệu đó feed canonical selection, mà là vì sao bạn sometimes see “Duplicate, Google chose different canonical than user” (bản dịch) «Duplicate, Google chose khác nhau canonical hơn người dùng» trong Search Console: của bạn tag đã là outvoted.

practical implications:

  • không gửi conflicting các tín hiệu. I spent năm on enterprise các trang (I ran SEO kỹ thuật trong-house tại IBM), và trong một talk I cho called Enterprise SEO Chaos I cho thấy real các trang đó “redirected to one version, canonicaled to a second, and internally linked to a third.” (bản dịch) «được chuyển hướng để một version, canonicaled để một second, và internally linked để một third.» Pick một URL và làm mỗi tín hiệu agree.
  • Tín hiệu strength khoảng ranks chuyển hướng > rel="canonical" > internal links > sitemap. MỘT 301 là một nhiều stronger statement hơn một canonical tag.
  • Duplicate nội dung không một hình phạt. Google Gary Illyes có đã nói khoảng 60% of đó web là duplicate nội dung, và Google xử lý some of điều này as thông thường — không một spam violation. Đó cost là split các tín hiệu và wasted crawling, không một punishment. Đó cách sửa là consolidation, không panic.

Và một note on JavaScript: I khi ran một kiểm thử — injecting một rel="canonical" qua JavaScript on một trang đó đã có none trong đó HTML — và Google honored điều này, mặc dù điều này đã có publicly đã nói điều này sẽ không. Sau đó surfaced, Google đã cập nhật của nó JavaScript SEO tài liệu. Đó lesson không “use JS canonicals” (bản dịch) «dùng JS canonicals»; đây là đó này stuff là testable, và đó tài liệu không luôn đó cuối cùng word.

kết xuất decision

Kết xuất là đó step hầu hết overviews skip, và đây là nơi JavaScript các trang nhận vào trouble. “During the crawl, Google renders the page and runs any JavaScript it finds using a recent version of Chrome.” (bản dịch) «During đó crawl, Google renders đó trang và chạy bất kỳ JavaScript điều này tìm thấy dùng một gần đây version of Chrome.» Evidence for this claim Google processes JavaScript pages in crawling, rendering, and indexing phases and uses a recent version of Chrome for rendering. Scope: Google Search JavaScript processing; rendering and indexing remain subject to technical and quality constraints. Confidence: high · Verified: Google: JavaScript SEO basics đây là một tách biệt, stateless service, điều này có thể bộ nhớ đệm các tài nguyên cho weeks, và điều này có thể lag đó ban đầu fetch — so một JS-phụ thuộc thay đổi có thể take một trong khi để là reflected.

JavaScript không đó enemy ở đây. As I put điều này trong my hướng dẫn để JavaScript SEO, JavaScript không phải bad cho SEO, và đây là không evil — đây là chỉ khác nhau từ điều gì nhiều SEOs là được dùng để. Đó real decision là cách bạn render:

  • máy chủ-side kết xuất (SSR) — safest Đối với SEO; HTML arrives hoàn tất.
  • Static generation (SSG/pre-kết xuất) — best của cả hai worlds cho nội dung đó không thay đổi theo yêu cầu.
  • Client-side kết xuất (CSR) — highest risk; nội dung chỉ tồn tại sau khi JS chạy, so bạn’re betting on render step.
  • Dynamic kết xuất — Google calls nó workaround, không khuyến nghị; Bing là nhiều hơn favorable. Treat nó as bridge, không đích.

Hai traps để know cold. đầu tiên, lazy-loading: Googlebot không scroll hoặc nhấp, so nội dung đó chỉ loads on interaction có thể stay invisible — hãy đảm bảo nó loads Khi nó trong viewport. thứ hai, links: Google có thể chỉ follow link đó thực <a href> element. routerLink hoặc nhấp handler với không href không phải crawlable link. Verify được kết xuất output so với thô HTML với URL Inspection tool bất cứ khi nào bạn suspect khoảng trống.

trang web architecture và liên kết nội bộ

Liên kết nội bộ làm three jobs tại khi: they help bots discover các trang, they distribute PageRank, và they truyền topical context qua anchor text. John Mueller có called liên kết nội bộ “super critical for SEO” (bản dịch) «super cốt yếu cho SEO» và một of đó biggest levers bạn có on của bạn own site — và I agree. đây là một of đó highest-ROI điều bạn control trực tiếp.

một vài các hệ thống-cấp độ points:

  • Orphan các trang — các trang không có gì links để — là đầu tiên điều để hunt cho. nếu nó không linked, nó barely discoverable và nhận gần như không equity.
  • Architecture là crawl-funnel management. quan trọng các trang belong close để home trang; deep, nhấp-distant các trang nhận được crawl ít hơn và xếp hạng tệ hơn.
  • PageRank sculpting với nofollow là dead (since 2009). Nofollowing internal links làm đó equity evaporate thay vì redistribute. Manage flow với thực architecture, không nofollow tricks.

Core Web Vitals: three các vấn đề, không một

Đó biggest practitioner lỗi với trang experience là treating điều này as một single “make the site faster” (bản dịch) «làm đó site nhanh hơn» vấn đề. Core Web Vitals là three distinct các vấn đề với khác nhau root gây ra và khác nhau các cách sửa:

  • LCP (Largest Contentful Paint) — loading. Driven by thời gian phản hồi của máy chủ, render-blocking các tài nguyên, và cách fast đó main nội dung asset loads. Đích dưới 2,5 seconds.
  • INP (Interaction để Tiếp theo Paint) — interactivity. Driven by JavaScript execution blocking đó main chuỗi trao đổi. Đích dưới 200 milliseconds. (INP replaced FID trong 2024 — nếu bạn vẫn see FID anywhere, đó advice là stale.)
  • CLS (Cumulative Layout Shift) — visual stability. Driven by images không có dimensions, muộn-loading fonts, và injected nội dung. Đích dưới 0,1.

Hai điều quan trọng beyond definitions. Trường dữ liệu, không lab dữ liệu: Google ranks on thực-người dùng CrUX dữ liệu, không của bạn Lighthouse score, so Lighthouse 65 với good trường dữ liệu beats Lighthouse 100 với bad trường dữ liệu. và proportion: I’ll là honest — I không think Core Web Vitals có nhiều impact on SEO, và trừ khi trang web là extremely chậm I generally sẽ không prioritize sửa them cho thứ hạng. Làm hoạt động cho người dùng và conversions; chỉ không oversell nó as xếp hạng lever.

Dữ liệu có cấu trúc: các tín hiệu Đối với tìm kiếm và AI

Dữ liệu có cấu trúc (sử dụng JSON-LD) không xếp hạng bạn, nhưng nó làm các trang eligible cho rich kết quả và increasingly helps AI các hệ thống parse của bạn nội dung cho citation. nó genuinely hữu ích — và genuinely oversold as tín hiệu xếp hạng. My honest cách diễn đạt: phần lớn của SEO là đang làm basics well, và nội dung và links move needle nhiều hơn schema làm. Implement nó nơi nó unlocks rich kết quả hoặc clarifies entity; không expect nó để lift thứ hạng on của nó own. (và note: schema markup các URL không phải crawlable liên kết nội bộ — Mueller có confirmed điều này.)

International, briefly

nếu bạn phục vụ multiple languages hoặc regions, sử dụng distinct các URL theo version và hreflang các chú thích để map them, và ưu tiên ccTLDs hoặc subdirectories over URL parameters. không auto-chuyển hướng by IP — Google explicitly warns so với nó và nó breaks crawling. SEO quốc tế là deep đủ để là của nó own pillar; Đây là chỉ kỹ thuật handshake.

kỹ thuật SEO là ongoing hệ thống, không một-time audit

cách diễn đạt mỗi đối thủ hướng dẫn nhận sai: kỹ thuật SEO không phải checklist bạn hoàn tất sau khi. Các trang thay đổi constantly — deploys break canonical tags, phát hành slips noindex vào template, new quảng cáo script tanks INP, chuyển hướng chains accumulate. mature practice là monitoring và regression detection:

  • Watch GSC trang lập chỉ mục cho sudden thay đổi trong được lập chỉ mục được tính và excluded statuses.
  • Watch Crawl Số liệu và của bạn nhật ký cho phản hồi-code spikes và crawl-pattern shifts.
  • Re-validate crawl, render, và các chuyển hướng sau khi mỗi significant deployment.

On tệp nhật ký cụ thể: I được sử dụng để treat them as sau khi-mỗi-một vài-năm khắc phục sự cố tool. đó changed. nhật ký là hiện tại clearest place để see mà AI các crawler là thực ra hitting bạn và Cách thường — điều gì đó không khác tool hiển thị bạn as trực tiếp — so cho anyone ai cares về AI tìm kiếm, họ’ve become lot nhiều hơn hữu ích hơn họ là.

trang web migrations: highest-stakes event

migration — new domain, HTTP để HTTPS, replatform, URL restructure — là single highest-stakes kỹ thuật event, vì nó touches mỗi URL tại sau khi. Map old để new 1:1, sử dụng 301/308 vĩnh viễn các chuyển hướng, giữ them trong place indefinitely (I sẽ không rush để xóa them — couple của chuyển hướng hops là không có gì để worry về), và sử dụng GSC Thay đổi của Address tool nơi nó áp dụng. Migrations có thể là phức tạp và involve lot của mọi người, nhưng không panic — Bạn có thể khắc phục gần như bất cứ điều gì đó goes sai. có đầy đủ trang web Migrations cluster dưới điều này pillar.

kỹ thuật SEO cho AI tìm kiếm

Đó modern shift, và điều này cuts so với đó lazy “technical SEO is dead” (bản dịch) «SEO kỹ thuật là dead» take: từ 2025 on, AI tìm kiếm các hệ thống decide eligibility trước they bao giờ xếp hạng hoặc cite. Để là quoted trong an AI câu trả lời trang của bạn generally có để là cleanly canonicalized, fast đủ, renderable không có heroics, và structured đủ để là parsed với confidence. Messy các tín hiệu không chỉ thấp hơn một xếp hạng hiện tại — they có thể xóa bạn từ đó câu trả lời hoàn toàn. Vì Bing chỉ mục feeds nhiều LLM các câu trả lời, Bing Quản trị viên web Tools và IndexNow quan trọng hơn Bing tìm kiếm share suggests. Kỹ thuật hygiene matters hơn trong đó AI era, không ít hơn.

nơi leverage thực ra là

nếu bạn take một điều từ điều này hướng dẫn, làm nó prioritization. Spend của bạn time on lập chỉ mục, canonicalization, liên kết nội bộ, và sạch migrations — hoạt động đó decides liệu các trang exist trong tìm kiếm và consolidate của họ equity. không lose sleep over ngân sách crawl, Core Web Vitals, duplicate nội dung, hoặc ngắn chuyển hướng chains trừ khi bạn có cụ thể, diagnosed vấn đề. và không chase perfection — I doubt có major trang web đó technically perfect, và nếu ở đó là, I’d worry họ là wasting các tài nguyên on điều đó không quan trọng thay vì điều đó làm.

điều này hub maps rest của pillar: Cách Tìm kiếm Hoạt động, trang web Migrations, On-trang, công cụ tìm kiếm Tools, và JavaScript SEO. Bắt đầu wherever của bạn trang web là breaking — pipeline tells bạn mà gate để xem xét đầu tiên.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.