SEO cho trang danh mục

Các trang danh mục (PLP, trang bộ sưu tập) thường là những trang có đòn bẩy lớn nhất nhưng cũng tiềm ẩn nhiều rủi ro kỹ thuật nhất trên một cửa hàng thương mại điện tử. Bài viết này hướng dẫn cách xếp hạng chúng, xử lý phân trang sau khi rel=prev/next không còn được Google sử dụng, quyết định URL bộ lọc nào nên lập chỉ mục, bổ sung nội dung mà không nhồi nhét từ khóa và dẫn trình thu thập dữ liệu đến mọi sản phẩm.

1 tín hiệu bằng chứng trên trang này

Trang danh mục (PLP, trang bộ sưu tập) nhóm sản phẩm theo một phân loại và thường đảm nhiệm hai việc: xếp hạng cho các truy vấn thương mại rộng, đồng thời chuyển trình thu thập dữ liệu và giá trị liên kết đến các sản phẩm bên dưới. Hai cạm bẫy kỹ thuật chính là điều hướng theo bộ lọc tạo ra gần như vô hạn URL và phân trang. Nguyên tắc chính xác cho năm 2026: Google không còn dùng rel=prev/next (từ năm 2019), vì vậy đừng đặt canonical của các trang phân trang về trang 1; hãy để từng trang tự được lập chỉ mục hoặc trỏ đến một trang 'xem tất cả'. Trang danh mục chỉ có lưới sản phẩm có thể khó xếp hạng, nhưng theo Mueller, nội dung bổ sung là hữu ích chứ không bắt buộc; một khối văn bản nhồi từ khóa ở chân trang là cách làm sai. Công cụ URL Parameters của GSC đã bị ngừng (2022); hãy kiểm soát tham số bằng robots.txt và canonical.

Tóm tắt — Trang danh mục vừa có đòn bẩy lớn nhất vừa nguy hiểm nhất về kỹ thuật trên cửa hàng: chúng xếp hạng cho truy vấn thương mại rộng và chuyển hoạt động thu thập dữ liệu + PageRank đến sản phẩm. Nguyên tắc năm 2026: Google không còn dùng rel=prev/next (từ tháng 3/2019); đừng đặt canonical của trang phân trang về trang 1 vì sẽ che khuất sản phẩm từ trang 2 trở đi. Hãy để từng trang đặt canonical về chính nó hoặc trỏ đến trang “xem tất cả” thực sự dùng được. Điều hướng theo bộ lọc là mối đe dọa chính: chặn nhiễu bằng robots.txt, lập chỉ mục tín hiệu có nhu cầu thật. Công cụ URL Parameters của GSC đã bị ngừng tháng 4/2022. Nội dung bổ sung là hữu ích, không bắt buộc; đừng nhồi từ khóa ở chân trang. BreadcrumbList phù hợp, còn mã đánh dấu kết quả nhiều định dạng Product không dành cho trang liệt kê nhiều sản phẩm.

Vì sao trang danh mục là điểm tạo đòn bẩy

Trang danh mục vừa là đích xếp hạng, vừa là lối vào mà Google dùng để tiếp cận từng sản phẩm bên dưới. Nguồn: /ecommerce-seo/categories-and-merchandising/category-page-seo/

Mô hình wireframe của trang danh mục làm nổi bật bốn vùng quan trọng với SEO: phần giới thiệu ngắn gọn, URL bộ lọc và sắp xếp được kiểm soát, liên kết sản phẩm có thể thu thập dữ liệu và phân trang với URL riêng, canonical tự tham chiếu cùng liên kết thật đến trang kế tiếp.

© Patrick Stox LLC · CC BY 4.0 ·

Trên phần lớn cửa hàng, trang danh mục đồng thời là những trang giá trị nhất và mong manh nhất. Chúng có giá trị vì khớp với truy vấn thương mại rộng — “giày chạy bộ”, “máy tính xách tay dưới $500” — có lượng tìm kiếm lớn hơn nhiều so với truy vấn về một sản phẩm. Chúng mong manh vì mỗi trang cũng là nút phân phối hoạt động thu thập dữ liệu và giá trị liên kết: Google chủ yếu đến trang sản phẩm bằng cách đi theo liên kết trên trang danh mục. Google nói thẳng: “If category pages don’t include direct links to all products in a category, Googlebot might not find all of your products by crawling alone.” (bản dịch) “Nếu trang danh mục không có liên kết trực tiếp đến mọi sản phẩm trong danh mục, Googlebot có thể không tìm thấy tất cả sản phẩm chỉ bằng hoạt động thu thập dữ liệu.” Bằng chứng cho nhận định này Google warns that products may not be found by crawling when category pages do not link directly to them. Phạm vi: Use crawlable anchor links and pagination or load-more implementations Google can follow. Độ tin cậy: cao · Đã xác minh: Google: Ecommerce site structure

Vì vậy trang danh mục làm hai việc cùng lúc: xếp hạng cho truy vấn của chính nó và làm lối vào cho mọi thứ bên dưới. Phần lớn công việc SEO sau đây nhằm tránh làm hỏng một trong hai việc.

Điều hướng theo bộ lọc — yếu tố dễ gây hại nhất

Chặn nhiễu, lập chỉ mục tín hiệu — bốn hướng xử lý cho mỗi URL theo khía cạnh. Nguồn: /ecommerce-seo/categories-and-merchandising/category-page-seo/

Một URL theo khía cạnh có thể dẫn đến bốn kết quả. Các tổ hợp sắp xếp, theo dõi và bộ lọc dư thừa bị chặn thu thập dữ liệu. Những tổ hợp có nhu cầu thấp nhưng vẫn hữu ích cho điều hướng sẽ đặt canonical về danh mục cơ sở. Những tổ hợp có nhu cầu tìm kiếm thực sẽ trở thành trang đích được tối ưu và có canonical tự tham chiếu. Tổ hợp trống hoặc vô nghĩa trả về 404.

© Patrick Stox LLC · CC BY 4.0 ·

Giao diện lọc và sắp xếp phía trên trang danh mục là điều hướng theo bộ lọc. Ở dạng tham số URL phổ biến, đây là nguồn gây vấn đề thu thập dữ liệu lớn nhất trên web. Google nêu hai tác hại. Thứ nhất là thu thập quá mức vì “the crawlers will typically access a very large number of faceted navigation URLs before the crawlers’ processes determine the URLs are in fact useless,” (bản dịch) “trình thu thập dữ liệu thường sẽ truy cập rất nhiều URL điều hướng theo bộ lọc trước khi xác định chúng thực sự vô dụng”; thứ hai là phát hiện chậm hơn vì “if crawling is spent on useless URLs, the crawlers have less time to spend on new, useful URLs.” (bản dịch) “nếu thời gian thu thập bị dành cho URL vô dụng, trình thu thập sẽ có ít thời gian hơn cho URL mới và hữu ích”. Bằng chứng cho nhận định này Google documents infinite faceted URL spaces as a source of overcrawling and wasted resources. Phạm vi: Google recommends preventing crawl when faceted URLs do not need to be indexed. Độ tin cậy: cao · Đã xác minh: Google: Managing faceted navigation Gary Illyes cho rằng điều hướng theo bộ lọc chiếm khoảng một nửa vấn đề thu thập quá mức được báo cáo cho Google và mô tả hậu quả là “exploding your URL space from a balmy 1000 URLs to a scorching 1 million.” (bản dịch) “làm không gian URL bùng nổ từ 1.000 URL dễ chịu lên 1 triệu URL nóng bỏng”.

Không cần nhắc lại toàn bộ bài phân tích điều hướng theo bộ lọc; quyết định cho trang danh mục có thể tóm gọn: chặn nhiễu, lập chỉ mục tín hiệu.

  • Chặn bằng robots.txt: các biến thể thứ tự sắp xếp (?sort=price), tham số phiên/theo dõi và những tổ hợp bộ lọc chỉ chia lại cùng một tập sản phẩm. Google trực tiếp khuyến nghị cách này: “Oftentimes there’s no good reason to allow crawling of filtered items… instead, allow crawling of just the individual items’ pages along with a dedicated listing page that shows all products without filters applied.” (bản dịch) “Thông thường không có lý do chính đáng để cho phép thu thập các mục đã lọc… thay vào đó, chỉ cho phép thu thập từng trang sản phẩm cùng với một trang liệt kê riêng hiển thị mọi sản phẩm mà không áp dụng bộ lọc.”
  • Canonical về danh mục gốc: dành cho tổ hợp bộ lọc có nhu cầu tìm kiếm thấp mà bạn muốn người dùng vẫn điều hướng được nhưng không lập chỉ mục riêng. Lưu ý canonical là công cụ tác động chậm hơn — Google nói nó “may, over time, decrease the crawl volume” (bản dịch) “theo thời gian, có thể làm giảm khối lượng thu thập dữ liệu” — vì từng biến thể vẫn phải được thu thập trước khi tín hiệu có hiệu lực.
  • Lập chỉ mục + tối ưu: dành cho tổ hợp bộ lọc có nhu cầu tìm kiếm thật (ví dụ bộ lọc “giày chạy bộ màu đỏ” mà người dùng thực sự tìm). Những trang này xứng đáng có URL riêng, tiêu đề và H1 riêng, một câu nội dung riêng cùng canonical tự tham chiếu. Hãy nghiên cứu từ khóa trước — đừng lập chỉ mục bộ lọc chỉ dựa trên phỏng đoán.
  • Trả 404 cho ngõ cụt: trả về 404 cho các tổ hợp bộ lọc trống hoặc vô nghĩa để chúng không tích tụ thành rác có thể thu thập dữ liệu.

Lưu ý về một biện pháp kiểm soát đã lỗi thời: công cụ URL Parameters của Search Console không còn nữa (ngừng hoạt động tháng 4/2022). Hiện Google tự động xử lý tham số và từng cho biết chỉ khoảng 1% cấu hình trong công cụ thực sự mang lại tác dụng. Nếu bạn từng dựa vào nó để kiểm soát URL bộ lọc, đòn bẩy đó đã mất — robots.txt và canonical là các biện pháp thay thế.

Phân trang năm 2026 — cách thực sự hoạt động

Đây là phần có nhiều lời khuyên lỗi thời lưu truyền nhất, nên dưới đây là nguyên tắc chính xác cần bám theo:

rel=prev/next đã chết. Tháng 3/2019, Google xác nhận họ đã âm thầm ngừng dùng các thẻ này từ nhiều năm trước: “Google no longer uses these tags, although these links may still be used by other search engines.” (bản dịch) “Google không còn dùng các thẻ này, dù những công cụ tìm kiếm khác vẫn có thể sử dụng các liên kết đó.” Đừng triển khai rel=prev/next như giải pháp phân trang — nó không có tác dụng với Google. (Duy trì nó cho Bing và công cụ khác không tốn nhiều công sức, nhưng đó không phải chiến lược.)

Không canonical các trang phân trang về trang 1. Sai lầm này âm thầm loại một phần lớn danh mục sản phẩm khỏi chỉ mục. Bài viết của Google về lỗi canonical nói rõ: “Specifying a rel=canonical from page 2 (or any later page) to page 1 is not correct use of rel=canonical.” (bản dịch) “Đặt rel=canonical từ trang 2 — hoặc bất kỳ trang sau nào — về trang 1 không phải là cách dùng rel=canonical đúng.” Nếu làm vậy, các sản phẩm chỉ xuất hiện từ trang 2 trở đi có thể không bao giờ được lập chỉ mục. Mỗi trang phân trang nên đặt canonical về chính nó — Google: “Don’t use the first page of a paginated sequence as the canonical page.” (bản dịch) “Đừng dùng trang đầu tiên của chuỗi phân trang làm trang canonical.”

Mô hình hiện tại gồm một trong hai phương án:

  1. Mỗi trang phân trang được lập chỉ mục dựa trên giá trị riêng. Gán cho từng trang một URL riêng (?page=2, không dùng đoạn nhận dạng # — “Google ignores fragment identifiers” (bản dịch) “Google bỏ qua đoạn nhận dạng”), canonical tự tham chiếu và liên kết <a href> tuần tự đến trang tiếp theo để Googlebot có thể thu thập cả chuỗi: “Include links from each page to the following page using <a href> tags.” (bản dịch) “Hãy đặt liên kết từ mỗi trang đến trang kế tiếp bằng thẻ liên kết HTML.”
  2. Dùng trang “xem tất cả” làm canonical, nếu bạn có trang đó và nó tải trong thời gian chấp nhận được. Khi tồn tại một trang xem tất cả duy nhất, hãy trỏ các trang thành phần trong chuỗi phân trang về đó. Cách này chỉ hiệu quả khi trang xem tất cả thực sự dùng được — đừng ép một trang chứa 10 000 sản phẩm phải tải chỉ để đáp ứng mô hình này.

Cuộn vô hạn / tải thêm cần triển khai JavaScript SEO đúng cách: mỗi “trang” kết quả phải có URL phân trang thật, đồng thời dùng sitemap hoặc nguồn cấp Merchant Center làm lớp dự phòng cho việc khám phá để sản phẩm không mắc kẹt sau sự kiện cuộn. Với kết quả phân trang trống, hãy trả về 404 thay vì phục vụ một vỏ trang rỗng có thể được lập chỉ mục.

Cấu trúc URL

Chọn một trong hai mẫu và sử dụng nhất quán:

  • Cấp cao nhất — /laptops/. Gần trang chủ nhất (nhỉnh hơn đôi chút về giá trị liên kết), nhưng phải cạnh tranh với mọi thứ khác ở thư mục gốc và trở nên cồng kềnh khi quy mô tăng.
  • Danh mục cha + con — /electronics/laptops/. Mô tả rõ hơn, củng cố hệ thống phân cấp và mở rộng gọn gàng. Đây là cách phần lớn danh mục sản phẩm lớn sử dụng, đồng thời là mẫu website này thường dùng cho các cụm chủ đề.

Thay đổi cấu trúc về sau đồng nghĩa với chuyển hướng, nên việc cam kết dùng nhất quán quan trọng hơn chính lựa chọn. Ngoài đường dẫn, hãy dùng tham số ?key=value (“Use ?key=value URL parameters rather than ?value, where possible” (bản dịch) “Khi có thể, hãy dùng tham số URL ?key=value thay vì ?value”), không bao giờ lặp cùng một tham số hai lần (“Googlebot may ignore one of the values otherwise” (bản dịch) “Nếu không, Googlebot có thể bỏ qua một trong các giá trị”) và loại tham số phiên/theo dõi khỏi liên kết nội bộ (“Avoid internally linking to temporary parameters, such as session-IDs, tracking codes, user-relative values” (bản dịch) “Tránh liên kết nội bộ đến các tham số tạm thời như ID phiên, mã theo dõi hoặc giá trị phụ thuộc người dùng”). Giữ URL giống hệt nhau trong liên kết nội bộ, sitemap và thẻ canonical.

Một quy tắc URL khác nên được thiết lập sẵn: danh mục trống nên trả về noindex hoặc 404 — Google: “If a category has no items, use a noindex robots meta tag. If your site detects that a category has become empty… consider returning a 404.” (bản dịch) “Nếu danh mục không có mục nào, hãy dùng thẻ meta robots noindex. Nếu website phát hiện một danh mục đã trở thành trống… hãy cân nhắc trả về 404.”

Vấn đề “danh mục mỏng” — thêm nội dung mà không nhồi từ khóa

Đây là chỗ lời khuyên cần tinh tế, cũng là nơi nhiều cửa hàng sửa quá tay thành nhồi nhét từ khóa. Quan điểm chính xác là:

Một trang danh mục chỉ có lưới sản phẩm mà không có ngữ cảnh có thể khó xếp hạng trên Google. Mueller, tháng 3/2019: “When the ecommerce category pages don’t have any other content at all, other than links to the products, then it’s really hard for us to rank those pages.” (bản dịch) “Khi trang danh mục thương mại điện tử hoàn toàn không có nội dung nào khác ngoài liên kết đến sản phẩm, chúng tôi thực sự rất khó xếp hạng những trang đó.”

Nhưng nội dung bổ sung chỉ hữu ích, không bắt buộc. Mueller cũng nói về việc liệu tên sản phẩm có đủ sức truyền đạt hay không: “If the names of the products are clear enough to us to understand… then it’s clear that this is a list of running shoes. You don’t need to put in extra text there.” (bản dịch) “Nếu tên sản phẩm đủ rõ để chúng tôi hiểu… thì rõ ràng đây là danh sách giày chạy bộ. Bạn không cần thêm văn bản ở đó.” Về số từ, ông nói: “We don’t have any limits. There’s no limit… you have to have some information on a page so that we understand what the topic is. But that’s generally very little information.” (bản dịch) “Chúng tôi không đặt giới hạn nào. Không có giới hạn… trang cần có một ít thông tin để chúng tôi hiểu chủ đề là gì. Nhưng nhìn chung chỉ cần rất ít thông tin.”

Kiểu triển khai sai là một khối văn bản nhồi từ khóa ở chân trang. Mueller gọi đúng bản chất của nó: “From our point of view that’s essentially keyword stuffing. So that’s something which I would try to avoid.” (bản dịch) “Theo quan điểm của chúng tôi, về cơ bản đó là nhồi nhét từ khóa. Vì vậy tôi sẽ cố tránh cách làm đó.” Hướng dẫn của ông về cách làm đúng: “I’d try to stick to really informative content and put that in places where you think that users will be able to see it.” (bản dịch) “Tôi sẽ tập trung vào nội dung thực sự hữu ích và đặt nó ở những vị trí mà bạn cho rằng người dùng có thể nhìn thấy.”

Vì vậy, quy tắc thực tế là:

  • Chỉ thêm nội dung khi nó xứng đáng có mặt — một đoạn giới thiệu ngắn nhưng thật sự hữu ích (vài câu trả lời một câu hỏi quyết định mua hàng), hướng dẫn mua cho danh mục từ khóa chính có nhu cầu thông tin thật hoặc phần câu hỏi thường gặp mà người mua thực sự hỏi.
  • Đặt nội dung ở nơi người dùng nhìn thấy (phía trên trang, hòa vào trải nghiệm), không giấu thành một bức tường chữ ở cuối trang.
  • Một lượng nhỏ nội dung mẫu trùng lặp giữa các danh mục con vẫn ổn — Mueller: “If you’re talking about a very small amount of text then having that duplicated is absolutely no problem.” (bản dịch) “Nếu chỉ nói đến một lượng văn bản rất nhỏ thì việc nội dung đó bị trùng lặp hoàn toàn không thành vấn đề.”

Cũng cần thừa nhận một mâu thuẫn thật: nhiều người làm SEO vẫn thêm văn bản ở chân trang vì thử nghiệm của họ cho thấy cách đó còn hiệu quả — câu đáp quen thuộc trong cộng đồng là “I’ll stop doing it when it stops working.” (bản dịch) “Tôi sẽ ngừng làm khi nó không còn hiệu quả.” Theo tôi, đó là một canh bạc mong manh trước tín hiệu spam đã được ghi nhận. Nếu thêm nội dung, hãy viết loại nội dung mà người mua thực sự muốn đọc.

Liên kết nội bộ — nhiệm vụ làm lối vào

Trang danh mục là nút phân phối PageRank, vì vậy hãy coi liên kết là thành phần chịu lực:

  • Liên kết đến mọi sản phẩm trong danh mục (hoặc phân trang để tất cả đều có thể truy cập qua <a href>). Nếu thực sự không thể, sitemap hoặc nguồn cấp Merchant Center là phương án dự phòng — nhưng liên kết trên trang vẫn là cơ chế chính.
  • Dùng liên kết <a href> thật, không dùng trình xử lý nhấp chuột bằng JS: “Use <a href> tags when creating links to other content. Don’t use JavaScript events on other HTML DOM elements for navigation.” (bản dịch) “Hãy dùng thẻ liên kết HTML khi tạo liên kết đến nội dung khác. Đừng dùng sự kiện JavaScript trên các phần tử HTML DOM khác để điều hướng.”
  • Số lượng liên kết phát tín hiệu về tầm quan trọng. Google: “The more links a page has to it within a site, the higher the relative importance.” (bản dịch) “Một trang càng nhận được nhiều liên kết trong website thì tầm quan trọng tương đối của nó càng cao.” Liên kết các danh mục tốt nhất từ trang chủ và nội dung liên quan; đưa sản phẩm bán chạy lên từ vị trí cao hơn trong hệ thống phân cấp.
  • Breadcrumb trong cả giao diện lẫn schema BreadcrumbList củng cố hệ thống phân cấp và cung cấp cho Google ngữ cảnh văn bản neo rõ ràng.

Thẻ tiêu đề, mô tả meta và H1

  • Tiêu đề: bao gồm tên danh mục (từ khóa chính). Các mẫu như [Category] — [Brand] hoặc [Category]: [N] Products — [Brand] đều dùng được. Với trang phân trang, bạn có thể giữ nguyên tiêu đề (Google cố nhận diện chuỗi) hoặc nối thêm — Page N.
  • Mô tả meta: tạo theo chương trình là phương án phù hợp và được khuyến khích ở quy mô lớn — tập trung vào ngôn ngữ hỗ trợ quyết định mua hàng (khoảng giá, số sản phẩm, thương hiệu).
  • H1: diễn đạt tương ứng với tiêu đề; một H1 rõ ràng là gọn nhất về ngữ nghĩa, dù theo Mueller, nhiều H1 cũng không làm thứ hạng của bạn sụp đổ.

Dữ liệu có cấu trúc

  • BreadcrumbList — có. Đây là dữ liệu có cấu trúc quan trọng với trang danh mục: nó giúp Google “understand the hierarchy of pages on your site” (bản dịch) “hiểu hệ thống phân cấp trang trên website của bạn” và tạo hiển thị breadcrumb trong SERP. Google hướng dẫn đánh dấu “a typical user path to a page, instead of mirroring the URL structure.” (bản dịch) “một đường đi điển hình của người dùng đến trang, thay vì phản chiếu cấu trúc URL”.
  • Mã đánh dấu kết quả nhiều định dạng Product — không. Đừng đặt mã đánh dấu kết quả nhiều định dạng Product trên trang liệt kê nhiều sản phẩm; kết quả nhiều định dạng sản phẩm của Google hỗ trợ trang một sản phẩm, không hỗ trợ trang danh sách.
  • CollectionPage / ItemList — tùy chọn. Hiện không có kết quả nhiều định dạng riêng của Google, nhưng chúng có thể giúp máy đọc danh sách dễ hơn. FAQPage có thể đáng dùng nếu bạn có phần hỏi đáp thực sự hữu ích và được tích hợp tự nhiên.

Theo dõi

  • Báo cáo Lập chỉ mục trang của GSC — theo dõi xem số URL tham số/bộ lọc trong các nhóm bị loại trừ có tăng vọt hay không; đó là dấu hiệu chiến lược bộ lọc bị rò rỉ.
  • Crawl Stats — nếu Googlebot dành quá nhiều thời gian cho URL có tham số, hãy siết quy tắc robots.txt hoặc canonical.
  • Rich Results Test / URL Inspection — xác thực BreadcrumbList và kiểm tra cách trang danh mục thực sự được kết xuất và lập chỉ mục.
  • Site Audit — kiểm tra độ sâu thu thập dữ liệu, sản phẩm mồ côi và số liên kết nội bộ trên mỗi trang.

Vị trí của chủ đề này

SEO trang danh mục là một phần của cấu trúc website thương mại điện tử. Các quyết định về bộ lọc ở trên được trình bày đầy đủ trong bài về điều hướng theo bộ lọc; với loại trang ở đầu kia của liên kết — trang sản phẩm riêng lẻ — hãy xem bài SEO trang sản phẩm; còn để hiểu toàn bộ hệ thống phân cấp liên kết với nhau ra sao, hãy xem kiến trúc website thương mại điện tử.

Thêm ghi chú chuyên gia

Ghim trích dẫn chuyên gia

Người mới? Hãy tạo hồ sơ chưa có người xác nhận cho họ tại /admin/experts/ → Ghim trích dẫn chuyên gia trước.