Công cụ kiểm tra khả năng index miễn phí
Trước khi một trang có thể xuất hiện trong kết quả tìm kiếm, công cụ tìm kiếm phải truy cập được, đọc được và được phép index trang đó. Công cụ này thực hiện sáu bước kiểm tra kỹ thuật thường cản trở việc index nhất và đánh dấu mọi vấn đề cần khắc phục. Dán URL để quét.
Công cụ này kiểm tra những gì
- Mã trạng thái HTTP: trang cần trả về mã 200. Chuỗi chuyển hướng và phản hồi 4xx hoặc 5xx sẽ chặn việc index hoặc đưa công cụ tìm kiếm đến nơi khác.
- HTTPS: trang cần tải qua kết nối bảo mật, không chuyển hướng sang URL không an toàn hoặc URL khác.
- Robots.txt: tệp robots.txt không được chặn trình thu thập dữ liệu truy cập đường dẫn của trang.
- Noindex: không được có
noindextrong thẻ meta robots hoặc header X-Robots-Tag, vì chỉ thị này yêu cầu công cụ tìm kiếm bỏ qua trang. - Canonical: thẻ canonical cần trỏ về chính trang đó, nếu không công cụ tìm kiếm sẽ index URL được chỉ định thay thế.
- Sitemap: sitemap giúp công cụ tìm kiếm khám phá trang và nhận biết khi trang thay đổi.
Có thể index không đồng nghĩa với đã được index
Vượt qua mọi bước kiểm tra nghĩa là không có trở ngại kỹ thuật nào đối với công cụ tìm kiếm. Tuy nhiên, điều đó không đảm bảo trang có trong chỉ mục, vì công cụ tìm kiếm vẫn tự quyết định trang nào đáng được đưa vào. Hãy dùng Công cụ kiểm tra index Google miễn phí của chúng tôi để xem trang có thực sự nằm trong Google không, và đọc vì sao trang được crawl nhưng không được index nếu chưa có.
Câu hỏi thường gặp
"Có thể index" nghĩa là gì?
Một trang có thể index khi công cụ tìm kiếm tải được trang thành công và không có gì trên trang hoặc máy chủ yêu cầu bỏ qua trang đó. Đây là điều kiện kỹ thuật tiên quyết để xuất hiện trong kết quả tìm kiếm, chứ không phải sự đảm bảo.
Trang của tôi vượt qua mọi bước kiểm tra. Tại sao vẫn chưa có trên Google?
Trang mới có thể mất vài ngày đến vài tuần để được crawl, và Google có thể chọn không index những trang bị coi là nội dung mỏng hoặc trùng lặp. Hãy kiểm tra trạng thái trang bằng công cụ Kiểm tra URL của Search Console hoặc một công cụ kiểm tra index miễn phí, sau đó củng cố liên kết nội bộ và nội dung nếu cần.
Thiếu sitemap có phải là vấn đề không?
Không phải lúc nào cũng vậy. Các trang web nhỏ, liên kết nội bộ tốt vẫn được index mà không cần sitemap. Với trang web lớn hơn hoặc các trang có ít liên kết nội bộ, sitemap giúp công cụ tìm kiếm tìm thấy URL mới và URL được cập nhật hiệu quả hơn rõ rệt.
robots.txt có thể xóa trang khỏi kết quả tìm kiếm không?
Không. robots.txt chỉ ngăn việc thu thập dữ liệu, và trang bị chặn vẫn có thể xuất hiện trong kết quả nếu các trang web khác liên kết đến nó. Để giữ trang ngoài chỉ mục, hãy cho phép thu thập dữ liệu và sử dụng noindex.
Bước kiểm tra này có áp dụng cho Bing và các công cụ tìm kiếm khác không?
Có. Các tín hiệu kỹ thuật này là tiêu chuẩn chung của các công cụ tìm kiếm lớn, vì vậy trang vượt qua kiểm tra ở đây có thể index về mặt kỹ thuật trên Google, Bing và các công cụ khác.