Về trình thu thập của chúng tôi

MonaBot là gì?

MonaBot là trình tải trang của bộ công cụ SEO MONA. Nó chỉ gọi tới website của bạn khi có người nhập đúng địa chỉ đó vào một công cụ trên trang này và bấm kiểm tra — không bò tự động, không chạy theo lịch, không đi lần theo liên kết sang website khác.

Nhận diện

Dòng bạn thấy trong access log

Mọi yêu cầu MonaBot gửi đi đều mang đúng chuỗi này. Không có chuỗi nào khác, và nó không giả làm trình duyệt.

User-Agent
MonaBot/1.0 (+https://congcuseo.mona.media/bot)

Phạm vi

Đúng năm địa chỉ, cho một lượt kiểm tra

Công cụ kiểm tra AI crawler gọi chừng này URL rồi dừng. Nó không duyệt hết website của bạn.

Địa chỉĐể làm gì
/robots.txtĐọc luật bạn đặt cho từng bot — đây là thứ đang được kiểm tra
/llms.txtKiểm tra file dành cho trợ lý AI đã có chưa
/llms-full.txtBản đầy đủ của file trên
/sitemap.xmlKiểm tra sitemap có tồn tại và có đọc được không
/Trang chủ, để xem có dữ liệu có cấu trúc (JSON-LD) và có nội dung khi tắt JavaScript không

Hai công cụ khác đọc nhiều hơn, vì việc của chúng đòi hỏi thế: công cụ tạo llms.txt đọc sitemap rồi tải các trang trong đó — tối đa đúng bằng con số bạn tự chọn, mặc định 50 trang và không bao giờ quá 200; công cụ tạo schema chỉ đọc trang chủ. Cả hai cũng chỉ chạy khi có người bấm.

Giới hạn

Nó được phép làm tới đâu

Những con số này nằm trong code, không phải trong lời hứa: một công cụ kiểm tra website mà làm chậm chính website đó thì tự phủ định mình.

Số kết nối cùng lúc tới một máy chủtối đa 4
Thời gian chờ mỗi yêu cầu20 giây, rồi bỏ
Số lần chuyển hướng đi theotối đa 3, và kiểm tra lại địa chỉ ở từng bước — riêng công cụ kiểm tra redirect đi tới 10, vì đếm chặng là việc của nó
Dung lượng tải về mỗi trangtối đa 2 MB với HTML, 512 KB với file text
Giao thức và cổngchỉ http/https, cổng 80, 443, 8080, 8443
Địa chỉ nội bộtừ chối — không gọi được vào 127.0.0.1, 10.x, 192.168.x hay 169.254.x

MonaBot không chạy JavaScript, không điền form, không đăng nhập, không gửi cookie, và không lưu địa chỉ bạn nhập. Số lượt chạy còn bị giới hạn theo địa chỉ IP người dùng — mặc định 20 lượt mỗi giờ cho một công cụ, và 6 lượt cho công cụ so sánh nhiều website.

Chặn

Nếu bạn không muốn MonaBot ghé qua

Nói thẳng: MonaBot KHÔNG đọc robots.txt để xin phép, nên thêm một dòng Disallow ở đó sẽ không chặn được nó. Lý do là chính việc nó làm — nó tải robots.txt của bạn để đọc và giải thích luật trong đó cho bạn; một công cụ tuân theo Disallow sẽ không bao giờ đọc nổi file cần đọc. Muốn chặn thì chặn theo user-agent ở tầng máy chủ.

nginx
# Chặn MonaBot ở tầng máy chủ (nginx)
if ($http_user_agent ~* "MonaBot") {
    return 403;
}
Apache
# Chặn MonaBot ở tầng máy chủ (Apache .htaccess)
RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} MonaBot [NC]
RewriteRule .* - [F,L]

Cloudflare hay WAF khác thì tạo một luật chặn theo User-Agent chứa MonaBot. Sau khi chặn, các công cụ trên trang này sẽ báo “không truy cập được” với website của bạn — kể cả khi chính bạn là người bấm kiểm tra.

Liên hệ

MonaBot gây phiền, hoặc bạn cần hỏi thêm

Bot này do MONA Media vận hành. Nếu nó tải quá nhiều, đến sai lúc, hoặc bạn muốn nó ngừng hẳn với tên miền của mình, gọi hotline là cách nhanh nhất.

1900 636 648 Công ty TNHH MONA MEDIA, 1073/23 Cách Mạng Tháng Tám, phường Tân Sơn Nhất, TP.HCM.

Muốn biết các bot KHÁC đang đọc website của bạn thì sao? Thư viện bot có hồ sơ từng con, và công cụ kiểm tra AI crawler cho biết con nào đang bị website của bạn chặn.

1

lượt kiểm tra

trong 30 ngày gần nhất

<1ms

trung bình mỗi lượt chạy thật

không tính các lượt lấy từ bộ nhớ đệm

0%

lượt chạy không lỗi

tính cả những website không truy cập được

Đọc thẳng từ hệ thống, không phải con số tự khai. Mỗi lượt chạy được ghi lại không kèm địa chỉ nào.