Trình xác minh Googlebot
Crawler lists updated 24 days ago.
Published range snapshot is stale. Refresh the operator range files before relying on an IP-range verdict, then rerun the check.
Các lần kiểm tra chạy từ máy chủ của chúng tôi; chúng tôi tải URL bạn nhập và không lưu kết quả. Submitted IPs are checked in memory, never stored. Anonymous aggregate verdict counts feed our research posts; domains are counted once via an anonymized hash, never stored in the clear. Số đếm kết quả ẩn danh theo từng lần chạy có thể được dùng cho nghiên cứu tổng hợp; URL, tên miền, IP và mã định danh không bao giờ được bao gồm, và không công bố số liệu thống kê khi có dưới 100 lần chạy.
Bulk IPs or access-log lines
Paste up to 500 IPs or log lines. Published-range matching and user-agent claim extraction run entirely in your browser. Use Spot-check only for the few rows where you want live reverse-DNS confirmation.
Hộ chiếu trang web Ngữ cảnh cục bộ cho trang đã lưu này
Dữ liệu cục bộ
Các mục tiêu đã lưu, danh sách có tên và bản tóm tắt kiểm tra gần đây chỉ được giữ trong trình duyệt này.
Why this verdict
Reproduce this result in an agent
Uses the same inputs as the result above. No request is made from this panel.
MCP tool
Arguments
Next steps
- Browse the crawler & AI bot reference
Compare search, AI-training, and AI-search bots, their published ranges, and what can actually be verified.
- Read the AI crawler reference
Understand the major crawlers, their purpose, and the trade-offs before blocking them.
- Check URL status codes
Use a URL list when you need to triage affected requests, not just one IP.
Copy-paste rules for the exact IP. Blocking a single IP is whack-a-mole — for persistent fake-crawler traffic, block by ASN or use your firewall's bot rules.
Đánh giá công cụ này
Supported bots and verification methods
Not every operator makes verification possible. Some publish IP ranges and support reverse DNS, some publish ranges only, and some publish nothing at all — a user agent alone proves nothing, since any script can send any user-agent string.
| Bot | Operator | Type | Published IP list | Reverse DNS |
|---|---|---|---|---|
| Googlebot · docs | Search | ✅ 315 ranges | ✅ .googlebot.com, .google.com | |
| Google special crawlers · docs | Search | ✅ 270 ranges | ✅ .google.com | |
| Google user-triggered fetchers · docs | User-triggered | ✅ 1550 ranges | ✅ .gae.googleusercontent.com, .google.com, .googleusercontent.com | |
| Bingbot · docs | Microsoft | Search | ✅ 28 ranges | ✅ .search.msn.com |
| YandexBot · docs | Yandex | Search | ❌ none | ✅ .yandex.ru, .yandex.net, .yandex.com |
| Baiduspider · docs | Baidu | Search | ❌ none | ❌ |
| Yeti · docs | Naver | Search | ❌ none | ❌ |
| GPTBot · docs | OpenAI | AI training | ✅ 21 ranges | ❌ |
| OAI-SearchBot · docs | OpenAI | AI search | ✅ 35 ranges | ❌ |
| ChatGPT-User · docs | OpenAI | User-triggered | ✅ 258 ranges | ❌ |
| ClaudeBot · docs | Anthropic | AI training | ✅ 20 ranges | ❌ |
| PerplexityBot · docs | Perplexity | AI search | ✅ 8 ranges | ❌ |
| Perplexity-User · docs | Perplexity | User-triggered | ✅ 4 ranges | ❌ |
| Applebot · docs | Apple | Search | ✅ 12 ranges | ✅ .applebot.apple.com |
| Amazonbot · docs | Amazon | AI training | ❌ none | ✅ .crawl.amazonbot.amazon |
| DuckDuckBot · docs | DuckDuckGo | Search | ✅ 481 ranges | ❌ |
| Meta-ExternalAgent · docs | Meta | AI training | ❌ none | ❌ |
| Bytespider | ByteDance | AI training | ❌ none | ❌ |
How verification works
- Published-range check. The IP is matched against the operator's official IP range list (the same JSON files Google, Microsoft, OpenAI, Perplexity, Apple, and DuckDuckGo publish), refreshed weekly.
- Forward-confirmed reverse DNS (FCrDNS). For bots that support it, the IP's PTR record must resolve to an official hostname (e.g.
crawl-66-249-66-1.googlebot.com) at a domain-label boundary, and a forward lookup of that hostname must answer the exact same IP. Both directions must agree — a PTR record alone is trivially fakeable. - Naming the spoofer. When a claim fails both checks, the IP's actual network owner is looked up via its ASN, so the verdict says who it really is instead of just "not Googlebot."
The verdict tiers are deliberately distinct: reverse-DNS confirmed is proof; a published-list match is strong but not confirmation; and unverifiable bots such as Bytespider and Meta publish no machine-readable range list — treat those user agents with suspicion. ClaudeBot now has an official published list, so it can return a list match even though Anthropic does not document reverse-DNS verification.
Need evidence across many requests? Use the Log File Analyzer to inspect crawl budget by bot and section, status-code waste, and spoofing signals. Log parsing stays in your browser.
Giới thiệu công cụ
Kiểm tra tuyên bố danh tính của trình thu thập bằng dải IP công bố và DNS ngược xác nhận xuôi.
Tính năng
- Đối chiếu dải IP chính thức.
- Hỗ trợ xác minh FCrDNS trực tiếp.
- Phân tích hàng loạt trong trình duyệt.
- Tra chủ mạng khi phát hiện giả mạo.
Cách hoạt động
Công cụ so IP với dải CIDR công bố; khi nhà vận hành hỗ trợ, nó xác minh PTR và tra cứu xuôi phải trả đúng cùng IP trước khi xác nhận.
Giới hạn
- Chuỗi tác nhân người dùng không chứng minh danh tính.
- Một số nhà vận hành không công bố phương thức xác minh.
- Kiểm tra trực tiếp bị giới hạn tốc độ.
Câu hỏi thường gặp
Làm cách nào xác minh Googlebot là thật?
Lấy địa chỉ IP từ nhật ký máy chủ, không dựa vào chuỗi `user`-`agent` có thể giả mạo, rồi kiểm tra hai cách: đối chiếu dải IP Googlebot công bố và chạy `DNS` ngược được xác nhận chuyển tiếp. Bản ghi `PTR` phải phân giải đến tên máy chủ kết thúc bằng googlebot.com hoặc google.com, và tra cứu chuyển tiếp tên đó phải trả về cùng IP. Công cụ tự động thực hiện cả hai.
`DNS` ngược được xác nhận chuyển tiếp (`FCrDNS`) là gì?
`FCrDNS` là kiểm tra `DNS` hai chiều. Tra cứu ngược đổi IP thành tên máy chủ qua `PTR`; tra cứu chuyển tiếp tên đó phải quay lại đúng IP. Cả hai chiều phải thống nhất tại ranh giới miền chính thức. `PTR` riêng lẻ không chứng minh gì vì chủ khối IP có thể đặt chuỗi tùy ý.
Tại sao trình thu thập hiển thị “không thể xác minh”?
Một số nhà vận hành như `Bytespider` và trình thu thập của Meta không công bố dải IP hoặc hỗ trợ `DNS` ngược nên không có kiểm tra có thẩm quyền. Công cụ báo không thể xác minh thay vì đoán. `Anthropic` hiện công bố danh sách IP chính thức; kết quả khớp được báo là khớp danh sách, không phải xác nhận `DNS`, và `user`-`agent` vẫn có thể giả mạo.
Tôi có thể chặn trình thu thập giả bằng IP không?
Có; công cụ cung cấp quy tắc chặn cho `Cloudflare`, `nginx` và `Apache` khi kết luận giả mạo. Nhưng chặn từng IP chỉ là xử lý tạm thời vì kẻ giả mạo đổi địa chỉ. Với lưu lượng dai dẳng, chặn theo `ASN` hoặc dùng quy tắc quản lý `bot` của tường lửa hiệu quả hơn.
Việc kiểm tra IP ở đây có lưu hoặc ghi nhật ký không?
Không. IP được kiểm tra trong bộ nhớ với danh sách dải công bố và `DNS` trực tiếp, không ghi vào kho. Danh sách dải được làm mới hàng tuần từ nguồn chính thức nên kết luận dựa trên dữ liệu mới tối đa vài ngày.
Các vấn đề thường gặp và cách khắc phục
- Lỗi IP trình thu thập nằm ngoài dải do nhà vận hành công bố Cách khắc phục: Coi trình thu thập là chưa xác minh và chặn hoặc điều tra cho đến khi IP khớp một dải đã công bố.
- Lỗi DNS ngược không khớp trình thu thập tự nhận Cách khắc phục: Coi yêu cầu là chưa xác minh trừ khi DNS ngược kết thúc bằng tên miền do nhà vận hành trình thu thập công bố; chặn hoặc điều tra trường hợp không khớp.
- Lỗi DNS xuôi không xác nhận máy chủ ngược Cách khắc phục: Phân giải tên máy chủ DNS ngược và yêu cầu tên đó ánh xạ trở lại IP yêu cầu trước khi tin cậy trình thu thập.
- Cảnh báo Không thể xác minh dứt khoát danh tính trình thu thập Cách khắc phục: Thu thập bằng chứng còn thiếu và coi kết quả là chưa xác minh cho đến khi có thể xác nhận.
- Cảnh báo Ảnh chụp dải đã công bố đã cũ Cách khắc phục: Làm mới ảnh chụp dải của nhà vận hành và chạy lại xác minh trước khi tin cậy kết luận IP.