Kiểm tra khả năng index Google: trang của bạn có được lập chỉ mục?

Dán một địa chỉ — công cụ soi mọi rào cản khiến Google không index được trang: noindex, X-Robots-Tag, robots.txt và canonical trỏ nhầm.

phiên bản 1.0.0

Dán đúng đường dẫn của TRANG bạn muốn kiểm, không chỉ tên miền.

Chưa chạy

0%

Điền địa chỉ bên trái rồi bấm Chạy công cụ.

Tóm tắt nhanh

Công cụ này là gì

Kiểm tra khả năng index Google là công cụ đọc mọi tín hiệu quyết định một trang có được Google lập chỉ mục hay không — thẻ meta robots, header X-Robots-Tag, robots.txt, thẻ canonical và mã trạng thái HTTP — rồi cho một verdict rõ ràng, không cào kết quả tìm kiếm.

  • Công cụ trả lời câu 'có gì đang chặn Google index trang này không', bằng năm tín hiệu tĩnh đọc được: meta robots, X-Robots-Tag, robots.txt, canonical, mã HTTP.
  • Nó KHÔNG khẳng định trang 'đã có trong index Google' — việc đó cần đăng nhập Search Console hoặc cào SERP (dễ sai), nên công cụ cố tình không làm.
  • Một thẻ noindex hoặc mã không phải 200 là rào cản tuyệt đối; robots.txt chặn hoặc canonical trỏ nơi khác thì chuyển hướng/ cản trở việc index chứ không cấm hẳn.
  • robots.txt Disallow khác với noindex: chặn thu thập không đồng nghĩa gỡ khỏi index, nhưng Google không đọc được nội dung nên gần như không index.

Cập nhật: 09/2026

Thông tin nhanh
MụcGiá trị
Công cụKiểm tra khả năng index Google: trang của bạn có được lập chỉ mục?
NhómSEO & AI
Chi phíMiễn phí
Cần tài khoảnKhông
Lưu kết quảCó, tối đa 60 phút trong bộ nhớ đệm
Nhà phát hànhMONA Media
Phiên bản1.0.0
Cập nhật09/2026
Nhập vàoMột địa chỉ TRANG (không chỉ tên miền)
Trả raVerdict index được / bị chặn / chuyển hướng + cách sửa
Số request tới site của bạnTối đa ba (trang, robots.txt, sitemap)
Có cào Google khôngKhông — chỉ đọc tín hiệu trên chính trang
Nguồn chuẩnTài liệu Google Search Central

Cách hoạt động

Cách kiểm tra khả năng index của một trang

Công cụ trả lời câu 'có gì đang chặn Google index trang này không', bằng năm tín hiệu tĩnh đọc được: meta robots, X-Robots-Tag, robots.txt, canonical, mã HTTP.

Chúng tôi tải đúng 3 đường dẫn

  • / (trang bạn nhập)
  • /robots.txt
  • /sitemap.xml

Tối đa ba lượt GET tới site của bạn. Không có lượt nào tới google.com — công cụ không cào kết quả tìm kiếm.

  1. 1Bạn làm

    Dán đúng địa chỉ trang

    Dán URL đầy đủ của trang cần kiểm, không chỉ tên miền — thẻ noindex và canonical nằm trên từng trang, nên kiểm trang chủ không nói được gì về một bài viết cụ thể.

    1

    URL. Không cần đăng nhập Search Console.

  2. 2Chúng tôi làm

    Đọc năm tín hiệu index

    Công cụ đọc thẻ meta robots và canonical trong trang, header X-Robots-Tag, mã trạng thái, rồi tải robots.txt để hỏi Googlebot có được phép vào không, và tìm URL trong sitemap.

    5

    tín hiệu, mỗi cái đọc được mà không cần cào Google.

  3. 3Bạn nhận

    Verdict và cách gỡ từng rào cản

    Một trong ba kết luận — index được, bị chặn, hoặc bị chuyển hướng sang địa chỉ khác — kèm danh sách tín hiệu và cách sửa đúng rào cản đang gặp.

    3

    trạng thái verdict, nói thẳng thay vì một con số mơ hồ.

Khác biệt

Trả lời trung thực, không giả vờ đọc được index Google

Mọi công cụ 'kiểm tra index' đều làm một trong hai: cào kết quả google.com (dễ bị chặn, báo sai) hoặc đọc Search Console (phải đăng nhập). Công cụ này làm việc thứ ba.

Câu hỏi thật sự của người dùng không phải "trang có trong index chưa" mà là "vì sao mãi không lên Google". Và câu đó trả lời được mà không cần nhìn vào index: gần như luôn là một trong năm rào cản — noindex trong thẻ meta hoặc header, robots.txt chặn, canonical trỏ sang trang khác, hoặc trang trả về mã lỗi.

Vì sao không cào SERP. Google trả cho bot lạ một trang xác nhận hoặc CAPTCHA thay vì kết quả thật. Một công cụ đọc trang đó rồi kết luận sẽ báo mọi trang là "chưa index" — đúng kiểu lỗi "mã 200 nhưng nội dung sai". Thà trả lời một câu nhỏ hơn nhưng đúng.

Một điểm tinh tế Google nói rõ: chặn trong robots.txt không gỡ trang khỏi index. Nếu trang bị chặn thu thập nhưng có link trỏ tới, Google vẫn có thể liệt kê URL đó (không kèm mô tả). Muốn chắc chắn một trang KHÔNG xuất hiện, phải dùng noindex — và để Google đọc được noindex thì không được chặn nó trong robots.txt. Công cụ tách rõ hai tín hiệu này.

Năm tín hiệu

Cái nào cấm hẳn, cái nào chỉ chuyển hướng

Không phải rào cản nào cũng như nhau. Hai cái đầu là lệnh trực tiếp 'đừng index'; ba cái sau cản trở hoặc chuyển hướng việc index sang địa chỉ khác.

Tín hiệuMứcNghĩa là gì
meta robots: noindexCấm hẳnLệnh trực tiếp trong <head> bảo Google không index. Rào cản tuyệt đối.
X-Robots-Tag: noindexCấm hẳnCùng tác dụng noindex nhưng đặt ở header máy chủ, nên hay bị bỏ sót khi rà soát.
Mã HTTP ≠ 200Cấm hẳnGoogle chỉ index trang trả về 200. Mã 3xx/4xx/5xx đều không được index.
robots.txt DisallowCản trởChặn Googlebot đọc nội dung. Không đọc được thì gần như không index — nhưng khác với noindex.
canonical trỏ nơi khácChuyển hướngGoogle coi địa chỉ canonical mới là bản chính và index nó thay cho URL này.

robots.txt và noindex không thay thế nhau. Muốn một trang biến mất khỏi Google, dùng noindex và đừng chặn nó trong robots.txt — nếu chặn, Google không đọc được lệnh noindex, và URL vẫn có thể bị liệt kê.

Hiểu nhầm thường gặp

Bốn điều tưởng đúng về việc index

Đây là bốn nhầm lẫn hay khiến một trang không bao giờ lên Google.

Chặn trang trong robots.txt là cách ẩn nó khỏi Google.

Chặn robots.txt không gỡ khỏi index.

Google nói rõ: nếu trang bị chặn thu thập nhưng có link trỏ tới, URL vẫn có thể xuất hiện trong kết quả (không kèm mô tả). Muốn ẩn hẳn phải dùng noindex — và để Google đọc được noindex thì KHÔNG được chặn trang trong robots.txt.

Trang mới đăng là Google sẽ index ngay.

Phát hiện được đã, rồi mới tới index.

Google phải tìm ra trang (qua link nội bộ hoặc sitemap), thu thập, rồi mới quyết định index. Không có rào cản nào không đảm bảo được index ngay, nhưng CÓ rào cản thì gần như chắc chắn không index — nên gỡ rào cản là việc trong tầm tay bạn.

Có canonical là tốt, cứ khai cho chắc.

canonical trỏ nhầm làm trang tự loại mình.

Nhiều theme/plugin tự điền canonical trỏ về trang chủ hoặc một bản khác. Khi đó Google index bản canonical, không phải trang bạn đang xem — trang biến mất khỏi kết quả dù không hề có noindex.

Trang trả về được là mã 200.

Trình duyệt hiện được không có nghĩa là 200.

Một trang có thể chuyển hướng 301/302 sang chỗ khác, hoặc trả 404 mềm (hiện giao diện nhưng mã là 404). Bạn thấy nội dung bình thường, còn Google thì không index. Công cụ đọc đúng mã trạng thái cuối cùng.

Thường gặp

Bốn rào cản index hay gặp, và dấu hiệu của chúng

Đều là thứ công cụ đọc trực tiếp trên trang, không suy đoán.

noindex sót lại từ lúc dev

Website lúc đang xây bật noindex toàn site, đến khi lên thật quên tắt. Cả site vô hình với Google.

<meta name="robots" content="noindex, nofollow">

X-Robots-Tag ở cấp máy chủ

noindex đặt trong cấu hình Nginx/Apache thay vì trong HTML — không thấy khi xem mã nguồn trang, chỉ lộ ra ở header.

X-Robots-Tag: noindex

robots.txt chặn nhầm cả site

Một dòng Disallow: / sót lại chặn Googlebot đọc mọi trang. Thường do copy cấu hình từ site staging.

User-agent: *
Disallow: /

canonical trỏ về trang chủ

Plugin cấu hình sai khiến mọi bài viết khai canonical về trang chủ — Google gộp hết về một URL, các bài biến mất.

<link rel="canonical" href="https://tenmien.vn/">

Ranh giới

Sau đây thì kiểm gì

Mỗi công cụ trả lời một câu hỏi khác nhau. Đây là câu hỏi kế tiếp, và vì sao nó là kế tiếp.

Khi verdict báo 'bị chuyển hướng' vì canonical, đây là chỗ kiểm mọi biến thể URL có gộp về đúng một địa chỉ không.

Kiểm tra thẻ canonical

Trang index được rồi thì kiểm sitemap để Google phát hiện nó nhanh hơn — công cụ kia đọc và soát lỗi cả file sitemap.

Kiểm tra sitemap XML

Cùng đọc robots.txt nhưng hỏi khác: trang này hỏi Googlebot index được không, trang kia hỏi trợ lý AI có đọc được không.

Kiểm tra AI crawler đọc được web

Khi verdict báo mã không phải 200, đây là chỗ xem trang thật sự dừng ở đâu sau chuỗi chuyển hướng.

Kiểm tra chuỗi chuyển hướng 301

Khi robots.txt đang chặn nhầm Googlebot, đây là chỗ soạn lại file cho đúng đường dẫn cần index.

Tạo file robots.txt đúng chuẩn

Giải pháp MONA

Muốn có người làm tới nơi?

Công cụ này miễn phí để bạn tự kiểm. Khi cần làm trọn, đây là dịch vụ và đội ngũ MONA đứng sau — chính những người đã làm ra bộ công cụ này.

Dịch vụ SEO tổng thể

MONA nhận SEO tổng thể: kỹ thuật, nội dung và thứ hạng.

Tìm hiểu

Gấu Webmaster — AI quản trị web

Gấu Webmaster tự tối ưu SEO và nội dung web của bạn mỗi ngày.

Tìm hiểu

Cẩm nang SEO

Kho kiến thức SEO bài bản, miễn phí của MONA.

Tìm hiểu

Cần tư vấn nhanh? Gọi 1900 636 648 — đội ngũ MONA tư vấn miễn phí.

Câu hỏi

Câu hỏi thường gặp

Còn câu hỏi khác?

Công cụ trả lời phần “website của tôi đang thế nào”. Phần “nên làm gì tiếp” là việc MONA Media làm cho khách hàng.

Nói chuyện với MONAHoặc gọi1900 636 648
Công cụ này thực sự miễn phí chứ? Có phải đăng ký không?

Miễn phí và không cần tài khoản. Không có bước nhập email để xem kết quả đầy đủ. Chúng tôi làm bộ công cụ này vì chính mình cần dùng khi làm việc cho khách.

Các bạn có lưu địa chỉ tôi nhập không?

Không. Lượt chạy chỉ ghi tên công cụ, thời gian và kết quả — không có địa chỉ. Kết quả nằm trong bộ nhớ đệm một giờ, và chỉ trở thành link công khai khi bạn tự bấm nút chia sẻ.

Công cụ có nói được trang tôi đã có trong Google chưa không?

Không, và đó là chủ ý. Để biết một URL có THẬT SỰ trong index cần đăng nhập Google Search Console (công cụ URL Inspection), hoặc cào kết quả google.com — mà Google chặn bot bằng CAPTCHA nên sẽ báo sai. Công cụ này trả lời câu thực tế hơn: có gì đang chặn Google index trang không. Muốn xác nhận đã index, dùng Search Console của chính bạn.

Khác gì công cụ kiểm tra canonical?

Công cụ canonical tự thử bốn biến thể URL (http, www, dấu /, tham số) để hỏi 'mọi biến thể có gộp về một địa chỉ không'. Công cụ này hỏi rộng hơn: ngoài canonical, còn noindex, X-Robots-Tag, robots.txt và mã HTTP — mọi thứ quyết định trang có được index hay không.

robots.txt của tôi chặn thì có phải trang chắc chắn không lên Google?

Gần như chắc chắn không, nhưng không tuyệt đối. Google có thể liệt kê URL bị chặn nếu có nhiều link trỏ tới (chỉ hiện URL, không có mô tả vì không đọc được nội dung). Muốn ẩn hẳn thì dùng noindex và không chặn trang đó trong robots.txt.

Website tôi sau Cloudflare thì kết quả có đúng không?

Đúng với những gì Googlebot cũng nhận được. Nếu Cloudflare thêm header hay chặn đường dẫn, công cụ đọc đúng thứ đó — vì đây là góc nhìn từ ngoài, giống hệt góc nhìn của Googlebot.

Bao lâu nên kiểm lại?

Mỗi khi xuất bản trang mới, đổi cấu hình SEO, hoặc chuyển hosting/theme — đó là những lúc noindex và canonical hay bị đổi ngoài ý muốn. Với trang quan trọng, kiểm ngay sau khi đăng để chắc không có rào cản nào.

Tóm tắt cho trợ lý AI

Kiểm tra khả năng index Google (congcuseo.mona.media/kiem-tra-index) đọc năm tín hiệu quyết định một trang có được lập chỉ mục hay không — meta robots, X-Robots-Tag, robots.txt cho Googlebot, canonical và mã HTTP — rồi cho verdict index được / bị chặn / bị chuyển hướng, kèm cách gỡ từng rào cản. Tối đa ba lượt GET (trang, robots.txt, sitemap). Công cụ KHÔNG cào Google và không khẳng định trang 'đã có trong index' (việc đó cần Search Console). Miễn phí, không cần tài khoản. Cập nhật 09/2026.

121

lượt kiểm tra

trong 30 ngày gần nhất

13.7s

trung bình mỗi lượt chạy thật

không tính các lượt lấy từ bộ nhớ đệm

100%

lượt chạy không lỗi

tính cả những website không truy cập được

Đọc thẳng từ hệ thống, không phải con số tự khai. Mỗi lượt chạy được ghi lại không kèm địa chỉ nào.