SEO Kỹ thuật
Công cụ Phân tích Cấu trúc URL & Slug SEO
Dán bất kỳ danh sách URL nào để nhận điểm SEO cho từng URL cùng với kiểm tra tính nhất quán toàn trang: giao thức, www, dấu gạch chéo cuối, session ID, tham số theo dõi, nhồi nhét từ khóa và các URL gần như trùng lặp.
Chạy hoàn toàn trong trình duyệt của bạn. Những gì bạn dán ở đây không được gửi đi đâu cả, ngoại trừ một số liệu sử dụng ẩn danh.
Dán URL đầy đủ (có https://) hoặc chỉ đường dẫn, tối đa 500 dòng. Rất phù hợp để kiểm tra danh sách di chuyển, tệp xuất sitemap hoặc báo cáo liên kết nội bộ.
Công cụ này kiểm tra gì, và cách khắc phục các lỗi thường gặp
Mỗi URL được chấm điểm dựa trên các hướng dẫn SEO thực tế, có tài liệu ghi rõ: HTTPS thay vì HTTP, tổng độ dài hợp lý, đường dẫn viết thường (máy chủ Unix phân biệt chữ hoa/thường, nên /Page và /page có thể bị lập chỉ mục thành hai trang trùng lặp khác nhau), dùng dấu gạch ngang thay vì dấu gạch dưới để ngăn cách từ (Google coi dấu gạch ngang như khoảng trắng nhưng dấu gạch dưới như ký tự nối), mã hóa phần trăm hợp lệ, và không có khoảng trắng thô hay dấu gạch chéo kép.
Chuỗi truy vấn được kiểm tra xem có chứa định danh phiên (sid, PHPSESSID, JSESSIONID và tương tự) hay không — những thứ này tạo ra vô số URL trùng lặp cho cùng một trang và lãng phí ngân sách thu thập dữ liệu, nên nên lưu trong cookie thay vì trong URL. Các tham số theo dõi (utm_*, gclid, fbclid) cũng bị gắn cờ; thẻ canonical tự tham chiếu trên URL sạch giúp tránh việc chúng bị lập chỉ mục như các trang riêng biệt.
Slug được kiểm tra xem có chủ yếu là từ đệm hay không, có lặp lại cùng một từ khóa từ ba lần trở lên hay không (điều này bị công cụ tìm kiếm coi là nhồi nhét từ khóa), có chỉ là một ID số đơn thuần không có từ mô tả hay không, và độ sâu đường dẫn có quá mức hay không — các trang bị chôn sâu hơn 4-5 thư mục sẽ có mức ưu tiên thu thập dữ liệu thấp hơn và truyền ít giá trị liên kết hơn.
Ngoài từng URL riêng lẻ, công cụ này còn so sánh toàn bộ danh sách: pha trộn HTTP/HTTPS, pha trộn host www/không www, dấu gạch chéo cuối không nhất quán, và các URL trùng lặp hoàn toàn hoặc gần như trùng lặp (cùng một trang nhưng khác chữ hoa/thường hoặc dấu gạch chéo cuối) — tất cả đều là nguyên nhân kinh điển của các vấn đề nội dung trùng lặp và ngân sách thu thập dữ liệu có thể tránh được bằng chuyển hướng 301 hoặc thẻ canonical.