로그 파일 분석기

Free, no signup. Server logs answer a question your analytics can't: what are crawlers actually doing on your site. Drop one in and see crawl budget by bot and by section, how much is wasted on 404s and redirects, how AI crawlers compare to search engines, and which requests are impostors faking a crawler user-agent.

Handles nginx / Apache (combined & common), IIS / W3C Extended, and JSON logs (incl. Cloudflare Logpush) — format auto-detected. Crawler ranges updated 24 days ago.

Drop your access log here
or ·
Multiple files allowed. Big logs stream in chunks.

전체 과정이 브라우저에서 실행되며, 붙여넣은 내용은 업로드되거나 저장되지 않습니다. Spot-checking a suspicious IP against the Googlebot Verifier sends only that IP to our server. 익명 실행별 결과 계수는 종합 연구에 사용될 수 있습니다. URL, 도메인, IP 및 식별자는 절대 포함되지 않으며 100회 미만의 실행에 대한 통계는 공개하지 않습니다.

피드백
버그 신고

로그 파일 분석기에서 문제가 발생했나요? 무슨 일이 있었는지 알려 주세요. 신고는 공개 목록이 아니라 비공개 분류 대기열로 바로 전송됩니다.

전송될 정보
 도구 입력, 업로드, 붙여넣은 소스, 전체 결과, 쿼리 매개변수 또는 URL 조각은 자동으로 첨부되지 않습니다. 위에서 선택한 구절을 수정하거나 삭제할 수 있습니다. 브라우저 및 악용 방지 메타데이터는 스팸 방지를 위해 처리됩니다. 

이 도구 정보

서버 액세스 로그는 사이트에서 크롤러가 실제로 어떻게 동작하는지 보여 줍니다. 어떤 URL을 요청하고 어떤 상태 코드를 받으며 크롤링 예산을 어디에서 낭비하는지 확인할 수 있습니다. 이 도구는 기존 검색 크롤러(예: Googlebot), AI 검색 및 학습 크롤러를 구분하고 IP 및 DNS 증거로 의심스러운 사용자 에이전트를 표시합니다.

nginx, Apache, IIS/W3C 및 JSON(Cloudflare Logpush 포함) 형식을 브라우저에서 로컬로 분석하며 아무것도 업로드하지 않습니다. 결과는 크롤링 동작을 설명할 뿐 색인 생성을 설명하지는 않습니다.

기능

  • 확인됨, 사칭됨, 검증 불가 요청 수와 상태 분포 및 낭비 비율을 포함한 봇별 크롤링 예산.
  • 섹션별 검색, AI 검색 및 학습 봇 분석과 시간에 따른 일일 추세.
  • 의심스러운 IP에 대한 역방향 DNS 및 ASN 확인을 포함한 사칭 보고서.
  • 복사해 사용할 수 있는 robots.txt Disallow 줄과 봇 및 낭비 URL의 CSV 내보내기를 포함한 우선순위 추천.

작동 방식

업로드 영역에 하나 이상의 로그 파일을 끌어놓거나 예시 데이터를 사용합니다. 형식을 자동으로 감지하고 큰 파일은 조각 단위로 스트리밍하며 각 줄에 봇, IP, 상태 및 경로 속성을 부여합니다. 그런 다음 분석기가 예산, 낭비 및 추세를 계산하고 의심스러운 IP를 실시간으로 확인해 구체적인 수정 사항을 우선순위별로 정렬합니다.

제한사항

  • 이 도구는 서버가 기록한 요청만 볼 수 있으므로 크롤러가 URL을 선택한 이유나 색인 생성 여부를 설명할 수 없습니다.
  • 공개 IP 범위가 없는 크롤러는 진짜 또는 가짜로 분류하지 않고 검증 불가로 남깁니다.
  • 섹션은 URL 경로에서 추론되므로 로그를 보여 주는 관점일 뿐 사이트 상태에 대한 완전한 보고서는 아닙니다.

자주 묻는 질문

내 로그 파일이 업로드되나요?

아니요. 파싱과 분석은 브라우저의 Web Worker에서 전부 실행됩니다. 파일은 디스크에서 조각 단위로 읽어 로컬에서 처리하며 서버로 전송하지 않습니다. 유일한 예외는 사칭자 보고서의 선택적 IP 점검으로, 로그가 아닌 IP 주소 하나를 검증 API에 보내 순방향 확인 역방향 DNS 및 ASN 조회를 수행합니다. 탭을 닫으면 분석된 데이터가 모두 사라집니다.

어떤 로그 형식을 지원하나요?

형식을 자동으로 감지합니다. nginx와 Apache combined 및 common 형식, IIS / W3C Extended, Cloudflare Logpush를 포함한 JSON 로그를 읽습니다. 여러 파일을 한 번에 넣을 수 있으며 큰 로그는 조각 단위로 스트리밍하므로 수 기가바이트의 액세스 로그도 탭을 멈추게 하지 않습니다.

실제 크롤러와 위조 크롤러를 어떻게 구분하나요?

각 요청을 사용자 에이전트로 알려진 크롤러와 연결한 뒤 출처 IP를 운영자가 공개한 IP 범위와 대조하며, Googlebot Verifier와 같은 주간 갱신 목록을 사용합니다. Google 범위 밖의 IP에서 Googlebot 사용자 에이전트를 보내면 사칭 가능성이 높다고 표시합니다. ByteDance의 Bytespider처럼 범위를 공개하지 않는 운영자는 해당 요청을 사칭이 아니라 검증 불가로 표시합니다.

낭비된 크롤링 예산의 기준은 무엇인가요?

유용한 `304 Not Modified` 재검증을 제외하고 리디렉션을 받거나, 404 또는 410 같은 4xx 오류를 받거나, 5xx 서버 오류를 받은 크롤러 요청입니다. 도구는 봇, 섹션 및 개별 URL별로 낭비를 합산해 영향이 큰 수정 지점을 보여 줍니다.

robots.txt로 위조 크롤러를 차단할 수 있나요?

아니요. 사칭자는 robots.txt를 무시하려고 크롤러 사용자 에이전트를 보내므로 Disallow 줄은 효과가 없습니다. 에지 또는 방화벽에서 IP나 ASN으로 차단하세요. robots.txt는 원하지 않는 섹션에서 예산을 낭비하는 진짜 크롤러에 적합하며 추천 패널이 복사해 사용할 수 있는 Disallow 줄을 생성합니다.

다음 단계robots.txt 생성기 — generate the corrected version. 안내는 영어로 제공됩니다.