noindex sót lại từ lúc dev
Website lúc đang xây bật noindex toàn site, đến khi lên thật quên tắt. Cả site vô hình với Google.
<meta name="robots" content="noindex, nofollow">Dán một địa chỉ — công cụ soi mọi rào cản khiến Google không index được trang: noindex, X-Robots-Tag, robots.txt và canonical trỏ nhầm.
phiên bản 1.0.0
Chưa chạy
0%Điền địa chỉ bên trái rồi bấm Chạy công cụ.
Tóm tắt nhanh
Kiểm tra khả năng index Google là công cụ đọc mọi tín hiệu quyết định một trang có được Google lập chỉ mục hay không — thẻ meta robots, header X-Robots-Tag, robots.txt, thẻ canonical và mã trạng thái HTTP — rồi cho một verdict rõ ràng, không cào kết quả tìm kiếm.
Cập nhật: 09/2026
| Mục | Giá trị |
|---|---|
| Công cụ | Kiểm tra khả năng index Google: trang của bạn có được lập chỉ mục? |
| Nhóm | SEO & AI |
| Chi phí | Miễn phí |
| Cần tài khoản | Không |
| Lưu kết quả | Có, tối đa 60 phút trong bộ nhớ đệm |
| Nhà phát hành | MONA Media |
| Phiên bản | 1.0.0 |
| Cập nhật | 09/2026 |
| Nhập vào | Một địa chỉ TRANG (không chỉ tên miền) |
| Trả ra | Verdict index được / bị chặn / chuyển hướng + cách sửa |
| Số request tới site của bạn | Tối đa ba (trang, robots.txt, sitemap) |
| Có cào Google không | Không — chỉ đọc tín hiệu trên chính trang |
| Nguồn chuẩn | Tài liệu Google Search Central |
Cách hoạt động
Công cụ trả lời câu 'có gì đang chặn Google index trang này không', bằng năm tín hiệu tĩnh đọc được: meta robots, X-Robots-Tag, robots.txt, canonical, mã HTTP.
Chúng tôi tải đúng 3 đường dẫn
Tối đa ba lượt GET tới site của bạn. Không có lượt nào tới google.com — công cụ không cào kết quả tìm kiếm.
Dán URL đầy đủ của trang cần kiểm, không chỉ tên miền — thẻ noindex và canonical nằm trên từng trang, nên kiểm trang chủ không nói được gì về một bài viết cụ thể.
1
URL. Không cần đăng nhập Search Console.
Công cụ đọc thẻ meta robots và canonical trong trang, header X-Robots-Tag, mã trạng thái, rồi tải robots.txt để hỏi Googlebot có được phép vào không, và tìm URL trong sitemap.
5
tín hiệu, mỗi cái đọc được mà không cần cào Google.
Một trong ba kết luận — index được, bị chặn, hoặc bị chuyển hướng sang địa chỉ khác — kèm danh sách tín hiệu và cách sửa đúng rào cản đang gặp.
3
trạng thái verdict, nói thẳng thay vì một con số mơ hồ.
Khác biệt
Mọi công cụ 'kiểm tra index' đều làm một trong hai: cào kết quả google.com (dễ bị chặn, báo sai) hoặc đọc Search Console (phải đăng nhập). Công cụ này làm việc thứ ba.
Câu hỏi thật sự của người dùng không phải "trang có trong index chưa" mà là "vì sao mãi không lên Google". Và câu đó trả lời được mà không cần nhìn vào index: gần như luôn là một trong năm rào cản — noindex trong thẻ meta hoặc header, robots.txt chặn, canonical trỏ sang trang khác, hoặc trang trả về mã lỗi.
Vì sao không cào SERP. Google trả cho bot lạ một trang xác nhận hoặc CAPTCHA thay vì kết quả thật. Một công cụ đọc trang đó rồi kết luận sẽ báo mọi trang là "chưa index" — đúng kiểu lỗi "mã 200 nhưng nội dung sai". Thà trả lời một câu nhỏ hơn nhưng đúng.
Một điểm tinh tế Google nói rõ: chặn trong robots.txt không gỡ trang khỏi index. Nếu trang bị chặn thu thập nhưng có link trỏ tới, Google vẫn có thể liệt kê URL đó (không kèm mô tả). Muốn chắc chắn một trang KHÔNG xuất hiện, phải dùng noindex — và để Google đọc được noindex thì không được chặn nó trong robots.txt. Công cụ tách rõ hai tín hiệu này.
Năm tín hiệu
Không phải rào cản nào cũng như nhau. Hai cái đầu là lệnh trực tiếp 'đừng index'; ba cái sau cản trở hoặc chuyển hướng việc index sang địa chỉ khác.
| Tín hiệu | Mức | Nghĩa là gì |
|---|---|---|
| meta robots: noindex | Cấm hẳn | Lệnh trực tiếp trong <head> bảo Google không index. Rào cản tuyệt đối. |
| X-Robots-Tag: noindex | Cấm hẳn | Cùng tác dụng noindex nhưng đặt ở header máy chủ, nên hay bị bỏ sót khi rà soát. |
| Mã HTTP ≠ 200 | Cấm hẳn | Google chỉ index trang trả về 200. Mã 3xx/4xx/5xx đều không được index. |
| robots.txt Disallow | Cản trở | Chặn Googlebot đọc nội dung. Không đọc được thì gần như không index — nhưng khác với noindex. |
| canonical trỏ nơi khác | Chuyển hướng | Google coi địa chỉ canonical mới là bản chính và index nó thay cho URL này. |
robots.txt và noindex không thay thế nhau. Muốn một trang biến mất khỏi Google, dùng noindex và đừng chặn nó trong robots.txt — nếu chặn, Google không đọc được lệnh noindex, và URL vẫn có thể bị liệt kê.
Hiểu nhầm thường gặp
Đây là bốn nhầm lẫn hay khiến một trang không bao giờ lên Google.
Bạn nghĩ
Thực tế
Chặn robots.txt không gỡ khỏi index.
Google nói rõ: nếu trang bị chặn thu thập nhưng có link trỏ tới, URL vẫn có thể xuất hiện trong kết quả (không kèm mô tả). Muốn ẩn hẳn phải dùng noindex — và để Google đọc được noindex thì KHÔNG được chặn trang trong robots.txt.
Phát hiện được đã, rồi mới tới index.
Google phải tìm ra trang (qua link nội bộ hoặc sitemap), thu thập, rồi mới quyết định index. Không có rào cản nào không đảm bảo được index ngay, nhưng CÓ rào cản thì gần như chắc chắn không index — nên gỡ rào cản là việc trong tầm tay bạn.
canonical trỏ nhầm làm trang tự loại mình.
Nhiều theme/plugin tự điền canonical trỏ về trang chủ hoặc một bản khác. Khi đó Google index bản canonical, không phải trang bạn đang xem — trang biến mất khỏi kết quả dù không hề có noindex.
Trình duyệt hiện được không có nghĩa là 200.
Một trang có thể chuyển hướng 301/302 sang chỗ khác, hoặc trả 404 mềm (hiện giao diện nhưng mã là 404). Bạn thấy nội dung bình thường, còn Google thì không index. Công cụ đọc đúng mã trạng thái cuối cùng.
Thường gặp
Đều là thứ công cụ đọc trực tiếp trên trang, không suy đoán.
Website lúc đang xây bật noindex toàn site, đến khi lên thật quên tắt. Cả site vô hình với Google.
<meta name="robots" content="noindex, nofollow">noindex đặt trong cấu hình Nginx/Apache thay vì trong HTML — không thấy khi xem mã nguồn trang, chỉ lộ ra ở header.
X-Robots-Tag: noindexMột dòng Disallow: / sót lại chặn Googlebot đọc mọi trang. Thường do copy cấu hình từ site staging.
User-agent: *
Disallow: /Plugin cấu hình sai khiến mọi bài viết khai canonical về trang chủ — Google gộp hết về một URL, các bài biến mất.
<link rel="canonical" href="https://tenmien.vn/">Ranh giới
Mỗi công cụ trả lời một câu hỏi khác nhau. Đây là câu hỏi kế tiếp, và vì sao nó là kế tiếp.
Khi verdict báo 'bị chuyển hướng' vì canonical, đây là chỗ kiểm mọi biến thể URL có gộp về đúng một địa chỉ không.
Kiểm tra thẻ canonicalTrang index được rồi thì kiểm sitemap để Google phát hiện nó nhanh hơn — công cụ kia đọc và soát lỗi cả file sitemap.
Kiểm tra sitemap XMLCùng đọc robots.txt nhưng hỏi khác: trang này hỏi Googlebot index được không, trang kia hỏi trợ lý AI có đọc được không.
Kiểm tra AI crawler đọc được webKhi verdict báo mã không phải 200, đây là chỗ xem trang thật sự dừng ở đâu sau chuỗi chuyển hướng.
Kiểm tra chuỗi chuyển hướng 301Khi robots.txt đang chặn nhầm Googlebot, đây là chỗ soạn lại file cho đúng đường dẫn cần index.
Tạo file robots.txt đúng chuẩnGiải pháp MONA
Công cụ này miễn phí để bạn tự kiểm. Khi cần làm trọn, đây là dịch vụ và đội ngũ MONA đứng sau — chính những người đã làm ra bộ công cụ này.
Gấu Webmaster — AI quản trị web
Gấu Webmaster tự tối ưu SEO và nội dung web của bạn mỗi ngày.
Tìm hiểuCần tư vấn nhanh? Gọi 1900 636 648 — đội ngũ MONA tư vấn miễn phí.
Câu hỏi
Còn câu hỏi khác?
Công cụ trả lời phần “website của tôi đang thế nào”. Phần “nên làm gì tiếp” là việc MONA Media làm cho khách hàng.
Nói chuyện với MONAHoặc gọi1900 636 648Miễn phí và không cần tài khoản. Không có bước nhập email để xem kết quả đầy đủ. Chúng tôi làm bộ công cụ này vì chính mình cần dùng khi làm việc cho khách.
Không. Lượt chạy chỉ ghi tên công cụ, thời gian và kết quả — không có địa chỉ. Kết quả nằm trong bộ nhớ đệm một giờ, và chỉ trở thành link công khai khi bạn tự bấm nút chia sẻ.
Không, và đó là chủ ý. Để biết một URL có THẬT SỰ trong index cần đăng nhập Google Search Console (công cụ URL Inspection), hoặc cào kết quả google.com — mà Google chặn bot bằng CAPTCHA nên sẽ báo sai. Công cụ này trả lời câu thực tế hơn: có gì đang chặn Google index trang không. Muốn xác nhận đã index, dùng Search Console của chính bạn.
Công cụ canonical tự thử bốn biến thể URL (http, www, dấu /, tham số) để hỏi 'mọi biến thể có gộp về một địa chỉ không'. Công cụ này hỏi rộng hơn: ngoài canonical, còn noindex, X-Robots-Tag, robots.txt và mã HTTP — mọi thứ quyết định trang có được index hay không.
Gần như chắc chắn không, nhưng không tuyệt đối. Google có thể liệt kê URL bị chặn nếu có nhiều link trỏ tới (chỉ hiện URL, không có mô tả vì không đọc được nội dung). Muốn ẩn hẳn thì dùng noindex và không chặn trang đó trong robots.txt.
Đúng với những gì Googlebot cũng nhận được. Nếu Cloudflare thêm header hay chặn đường dẫn, công cụ đọc đúng thứ đó — vì đây là góc nhìn từ ngoài, giống hệt góc nhìn của Googlebot.
Mỗi khi xuất bản trang mới, đổi cấu hình SEO, hoặc chuyển hosting/theme — đó là những lúc noindex và canonical hay bị đổi ngoài ý muốn. Với trang quan trọng, kiểm ngay sau khi đăng để chắc không có rào cản nào.
Tóm tắt cho trợ lý AI
Kiểm tra khả năng index Google (congcuseo.mona.media/kiem-tra-index) đọc năm tín hiệu quyết định một trang có được lập chỉ mục hay không — meta robots, X-Robots-Tag, robots.txt cho Googlebot, canonical và mã HTTP — rồi cho verdict index được / bị chặn / bị chuyển hướng, kèm cách gỡ từng rào cản. Tối đa ba lượt GET (trang, robots.txt, sitemap). Công cụ KHÔNG cào Google và không khẳng định trang 'đã có trong index' (việc đó cần Search Console). Miễn phí, không cần tài khoản. Cập nhật 09/2026.
Nguồn
121
lượt kiểm tra
trong 30 ngày gần nhất
13.7s
trung bình mỗi lượt chạy thật
không tính các lượt lấy từ bộ nhớ đệm
100%
lượt chạy không lỗi
tính cả những website không truy cập được
Đọc thẳng từ hệ thống, không phải con số tự khai. Mỗi lượt chạy được ghi lại không kèm địa chỉ nào.