SEO
Faceted Navigation là gì? Cách kiểm soát bộ lọc để tránh phình URL
Năm bộ lọc, mỗi bộ vài lựa chọn, cộng thêm sắp xếp — một danh mục 60 sản phẩm có thể sinh ra số URL nhiều hơn cả website. Bot không biết URL nào đáng đọc.
ScalioCập nhật 9 phút đọc

Faceted navigation (điều hướng theo thuộc tính) là hệ thống bộ lọc cho phép người mua thu hẹp danh sách theo màu, kích cỡ, giá, chất liệu, thương hiệu — rất quen thuộc trên shop thời trang, cửa hàng nội thất, trang tuyển sinh khoá học. Faceted navigation SEO là việc quyết định URL nào sinh ra từ bộ lọc được phép thu thập và lập chỉ mục, URL nào không, để bộ lọc vẫn tiện cho người mua mà không biến website thành mê cung cho bot.

Vấn đề nằm ở phép nhân. Mỗi lựa chọn lọc thêm vào URL một tham số; kết hợp nhiều bộ lọc, thứ tự tham số khác nhau, thêm sắp xếp và phân trang, số URL tăng theo cấp số nhân trong khi nội dung gần như trùng nhau. Hướng dẫn quản lý faceted navigation của Google Search Central xếp đây vào nhóm nguyên nhân phổ biến khiến bot thu thập quá nhiều URL không cần thiết. Với một shop nhỏ, hậu quả thường thấy là trang sản phẩm mới chậm được phát hiện và Search Console đầy URL lọc “đã thu thập nhưng không được lập chỉ mục”.
Không phải bộ lọc nào cũng như nhau
| Loại tham số | Ví dụ | Thay đổi nội dung? | Thường xử lý |
|---|---|---|---|
| Lọc có nhu cầu tìm kiếm | Váy công sở màu đen | Có, và người ta tìm đúng cụm này | Tạo trang có thể index, URL gọn, nội dung riêng |
| Lọc không có nhu cầu tìm kiếm | Giá 347.000–512.000đ, size S + M + XL | Có, nhưng không ai tìm | Không cần index; hạn chế thu thập |
| Sắp xếp | Sắp theo giá tăng dần | Không — cùng sản phẩm, khác thứ tự | Không index; không để bot đi vào |
| Hiển thị | Xem dạng lưới/danh sách, 24 hay 48 mục | Không | Không index; tốt nhất không tạo URL |
| Theo dõi, phiên | utm_source, session id | Không | Không nên xuất hiện trong liên kết nội bộ |
Phân trang (?page=2) cũng là tham số nhưng mang nội dung khác nhau và cần được thu thập — xem pagination SEO. Đừng gộp chung phân trang với sắp xếp khi đặt quy tắc chặn.
Cần chuẩn bị gì
- Danh sách toàn bộ bộ lọc trên website và cách mỗi bộ lọc tạo URL (tham số, đường dẫn, hay không đổi URL).
- Dữ liệu từ khoá cho các tổ hợp danh mục + thuộc tính, từ công cụ nghiên cứu từ khoá hoặc truy vấn thật trong Search Console.
- Dữ liệu thu thập: báo cáo Lập chỉ mục trang, báo cáo Thống kê thu thập dữ liệu, hoặc log máy chủ nếu có.
- Người làm web có quyền đổi cách sinh URL, robots.txt, thẻ meta robots và canonical.
Quy trình kiểm soát bộ lọc 6 bước
Bước 1. Lập danh sách bộ lọc
Đi qua từng danh mục, bấm thử từng bộ lọc, ghi lại URL sinh ra. Ghi rõ: tham số tên gì, có cho chọn nhiều giá trị không, thứ tự tham số có cố định không (?mau=den&size=m và ?size=m&mau=den có ra hai URL khác nhau không), và bộ lọc không có kết quả thì trả về gì. Bảng này là nền cho mọi quyết định sau.
Bước 2. Chọn tổ hợp có nhu cầu tìm kiếm
Chỉ một phần nhỏ tổ hợp có người tìm: thường là danh mục + một thuộc tính mà người mua hay gõ (màu, chất liệu, dịp sử dụng, đối tượng). Dùng search intent để kiểm tra: người tìm “váy linen đi biển” muốn xem một danh sách sản phẩm — trang lọc phù hợp. Nhóm các cụm gần nghĩa bằng keyword clustering để tránh tạo hai trang lọc tranh nhau một truy vấn.
Bước 3. Quy định URL được index
Tổ hợp được chọn nên trở thành trang đích thật: URL gọn và cố định, tiêu đề và H1 riêng, một đoạn giới thiệu ngắn, có trong sitemap và được liên kết từ danh mục cha. Mọi tổ hợp còn lại thì không cần index. Google gợi ý giữ cách viết tham số chuẩn (dùng dấu & phân tách), thứ tự tham số cố định, và trả mã 404 cho tổ hợp không có sản phẩm nào thay vì trang rỗng mã 200.
Bước 4. Chặn đường crawl vô hạn
Với URL lọc không cần xuất hiện trên Google, cách tiết kiệm lượt thu thập nhất theo hướng dẫn của Google là không cho bot đi vào: chặn mẫu tham số đó trong robots.txt, hoặc để bộ lọc dùng fragment (#) thay vì tham số nên không sinh URL mới. Lưu ý: noindex giúp trang không vào chỉ mục nhưng bot vẫn phải tải trang để đọc noindex; còn đã chặn trong robots.txt thì bot không đọc được noindex. Chọn một cách cho mỗi nhóm URL, đừng chồng cả hai lên cùng một URL.
Bước 5. Hợp nhất tín hiệu liên kết
Liên kết nội bộ nên trỏ vào URL chuẩn: menu, breadcrumb, khối “mua theo màu” dẫn tới trang lọc đã chọn index chứ không dẫn tới biến thể tham số lộn xộn. Với biến thể gần như trùng một trang chuẩn (ví dụ cùng tổ hợp nhưng khác thứ tự tham số), đặt canonical về URL chuẩn — nhớ rằng canonical là gợi ý, không thay được việc sửa cách sinh URL.
Bước 6. Theo dõi log và index
Sau khi áp dụng, theo dõi báo cáo Lập chỉ mục trang: số URL lọc bị “thu thập nhưng không index” nên giảm dần, trang lọc đã chọn nên được index. Nếu có log máy chủ, phân tích log cho thấy trực tiếp tỷ trọng lượt bot vào URL tham số trước và sau thay đổi. Mỗi khi thêm bộ lọc mới, lặp lại bước 1 cho bộ lọc đó.
Ví dụ thực hành: shop giày thể thao
Ví dụ giả định: một shop giày có danh mục “Giày chạy bộ” với bộ lọc giới tính, size, màu, thương hiệu, khoảng giá và sắp xếp. Chỉ riêng bộ lọc size cho chọn nhiều giá trị đã tạo ra hàng nghìn tổ hợp.
| Tổ hợp | Có người tìm? | Quyết định |
|---|---|---|
| Giày chạy bộ nam | Có | Trang đích /giay-chay-bo/nam, được index, có đoạn giới thiệu riêng |
| Giày chạy bộ nữ màu trắng | Có | Trang đích riêng, liên kết từ danh mục nữ |
| Giày chạy bộ size 39 + 40 + 42 | Không | Chặn thu thập mẫu tham số size nhiều giá trị |
| Giá 1,2–1,7 triệu | Không | Chặn thu thập mẫu tham số giá |
| Sắp xếp bán chạy | Không | Chặn thu thập; không đặt trong liên kết a href có thể thu thập |
| Nam + màu tím + size 46 | Không, và không có sản phẩm | Trả 404 |
Người mua vẫn dùng đủ mọi bộ lọc như cũ; chỉ có bot được dẫn tới vài chục trang đáng index thay vì hàng nghìn biến thể.
AI giúp được gì
- Gom danh sách URL tham số thành mẫu (pattern) để thấy nhóm nào chiếm nhiều nhất.
- Gợi ý tổ hợp danh mục + thuộc tính có khả năng có người tìm — sau đó bạn kiểm chứng bằng dữ liệu từ khoá thật.
- Viết nháp đoạn giới thiệu cho từng trang lọc được chọn index, để trang không chỉ là lưới sản phẩm.
Đừng để AI tự viết quy tắc robots.txt rồi dán lên máy chủ: một ký tự đại diện sai có thể chặn cả danh mục chính. Mọi quy tắc cần được kiểm thử trên danh sách URL mẫu trước khi phát hành.
Sai lầm thường gặp
- Để mọi tổ hợp lọc mở cho bot rồi trông vào canonical để “dọn”.
- Chặn luôn cả trang lọc có nhu cầu tìm kiếm, mất cơ hội xếp hạng cho cụm dài.
- Vừa chặn robots.txt vừa đặt noindex cho cùng nhóm URL.
- Tổ hợp không có sản phẩm trả mã 200, tạo ra hàng loạt trang rỗng.
- Thứ tự tham số thay đổi theo thứ tự bấm, nhân đôi số URL trùng.
Câu hỏi thường gặp
Nên chặn URL bộ lọc bằng robots.txt hay noindex?
Nếu mục tiêu là không để bot tốn lượt vào URL lọc không cần thiết, chặn thu thập (robots.txt hoặc không sinh URL) hiệu quả hơn. Noindex giữ trang ngoài chỉ mục nhưng bot vẫn phải tải trang. Không dùng cả hai cho cùng một URL.
Trang bộ lọc có thể xếp hạng trên Google không?
Có, nếu tổ hợp đó có người tìm và trang được làm như một trang đích thật: URL gọn, tiêu đề riêng, nội dung giới thiệu, được liên kết nội bộ và có trong sitemap.
Shop nhỏ vài chục sản phẩm có cần lo faceted navigation không?
Ít hơn, nhưng vẫn nên kiểm tra số URL bộ lọc sinh ra. Chỉ vài bộ lọc cho chọn nhiều giá trị cũng có thể tạo số URL lớn hơn nhiều lần số sản phẩm.
Trang lọc đáng index cần lời giới thiệu riêng — viết cùng Scalio theo giọng thương hiệu của bạn.
Điền hồ sơ thương hiệu một lần: Scalio lập chiến lược, viết bài theo đúng giọng của bạn, xếp lịch đăng và chấm điểm marketing.
Tạo tài khoản miễn phí

