Trình tạo robots.txt

Build your file

Select crawler groups to block. Search crawlers remain allowed unless you explicitly select them.

This non-standard directive is emitted only for Bingbot. Google does not process it; Bing documents 1–20 second values. It is omitted if you block Bingbot.

Open in robots.txt Tester

Chạy hoàn toàn trong trình duyệt của bạn — nội dung bạn dán không được tải lên hay lưu trữ. Everything here, including matching and copy output, runs in your browser. Nothing is uploaded. Số đếm kết quả ẩn danh theo từng lần chạy có thể được dùng cho nghiên cứu tổng hợp; URL, tên miền, IP và mã định danh không bao giờ được bao gồm, và không công bố số liệu thống kê khi có dưới 100 lần chạy.

Generated robots.txt

Blocking ≠ deindexing. A Disallow asks compliant crawlers not to fetch a URL; it does not remove a URL already known to a search engine.

Live match preview

Need a full bot × URL matrix? Open robots.txt Tester →
Phản hồi
Báo lỗi

Có gì đó không hoạt động trong Trình tạo robots.txt? Hãy cho chúng tôi biết điều gì đã xảy ra — báo cáo được gửi thẳng đến hàng đợi phân loại riêng tư, không phải danh sách công khai.

Thông tin sẽ được gửi
 Dữ liệu nhập vào công cụ, tệp tải lên, nguồn đã dán, kết quả đầy đủ, tham số truy vấn và đoạn URL không được tự động đính kèm. Bạn có thể sửa hoặc xóa đoạn đã chọn ở trên. Siêu dữ liệu trình duyệt và chống lạm dụng được xử lý để ngăn spam. 

Giới thiệu công cụ

Tạo robots.txt từ nhóm trình thu thập, đường dẫn Allow/Disallow, giới hạn tốc độ và URL sơ đồ trang.

Tính năng

  • Chọn nhóm hoặc từng trình thu thập.
  • Xem trước cách quy tắc khớp URL mẫu.
  • Phát hiện nhóm trùng và chỉ thị không chuẩn.
  • Sao chép tệp hoặc mở trong trình kiểm tra robots.txt.

Cách hoạt động

Công cụ hợp nhất lựa chọn thành nhóm tác nhân, chuẩn hóa đường dẫn và URL sơ đồ trang rồi chạy bộ kiểm tra cú pháp trước khi tạo tệp.

Giới hạn

  • robots.txt không phải cơ chế kiểm soát truy cập.
  • Disallow không xóa URL khỏi chỉ mục.
  • Không phải mọi trình thu thập đều tự nguyện tuân thủ.

Câu hỏi thường gặp

Chặn trình thu thập có xóa các trang của tôi khỏi chỉ mục không?

Không. robots.txt kiểm soát việc thu thập dữ liệu, không kiểm soát URL có còn trong chỉ mục hay không. Hãy dùng chỉ thị noindex trên trang có thể thu thập khi bạn cần tín hiệu xóa khỏi chỉ mục.

Mọi trình thu thập có tuân thủ tệp này không?

Không. robots.txt là lựa chọn thu thập dữ liệu tự nguyện và công khai, không phải cơ chế kiểm soát truy cập. Hãy dùng xác thực, WAF hoặc giới hạn tốc độ để bảo vệ nội dung riêng tư.

Tại sao tôi cần một dòng Sitemap?

Dòng này cung cấp cho trình thu thập một URL tuyệt đối, rõ ràng đến sitemap XML của bạn. Đây là tùy chọn nhưng thường hữu ích cho khả năng khám phá.

Bước tiếp theoTrình kiểm tra robots.txt — verify it with a direct check. Hướng dẫn có bằng tiếng Anh.