AI 크롤러를 모두 막거나 무조건 허용하는 것만이 답은 아니다. Cloudflare가 제안하는 ‘허가 기반 인터넷’은 누가 어떤 콘텐츠에 접근하는지 살펴보고, 사이트 운영자가 크롤러와 페이지별로 허용·차단·유료 접근 조건을 정하도록 하자는 구상이다. 다만 이는 Cloudflare의 비전과 제품 방향이지, 모든 퍼블리셔에게 효과가 입증된 표준이나 현재 보편적으로 쓸 수 있는 요금제가 아니다.
왜 콘텐츠 접근에 ‘허가’가 쟁점이 됐나
검색 유입과 AI 답변은 다른 교환일 수 있다
전통적인 검색 크롤러는 웹페이지를 색인하고 검색 결과를 통해 방문자를 원문 사이트로 보내는 흐름에 기여했다. 생성형 AI 서비스는 수집한 자료를 바탕으로 검색 개요나 직접 답변을 만들 수 있어, 이용자가 원문 사이트에 들어오지 않을 가능성이 있다. Cloudflare는 이 변화가 광고·구독 수익, 출처 추적, 지식재산 통제에 부담을 줄 수 있다고 주장한다. 이는 회사가 제시한 문제 정의이며, 모든 사이트에서 방문자나 매출이 실제로 감소했다는 독립적인 실증 결과를 뜻하지는 않는다.
콘텐츠로 광고 수익을 얻거나 유료 구독자를 모으는 운영자라면 핵심 질문은 단순히 ‘AI가 읽어도 되는가’가 아니다. 어떤 크롤러가 어느 페이지를 읽는지, 그 접근이 검색 노출이나 이용자 유입에 어떤 가치가 있는지, 수집이 원문 방문을 대체할 위험은 없는지를 함께 판단해야 한다.
Cloudflare가 제시한 요청 증가 수치의 범위
Cloudflare가 Cloudflare Radar 자료를 인용해 밝힌 바에 따르면, 2024년 7월부터 2025년 7월까지 GPTBot의 원시 요청은 147%, Meta-ExternalAgent의 원시 요청은 843% 증가했다. 이 수치는 해당 기간에 이 두 크롤러가 보낸 원시 요청의 변화이지, 전체 AI 트래픽이나 전체 웹 크롤링의 증가율은 아니다. 공개된 설명에는 수치의 분모와 수집 방법 등 상세 방법론이 제시되지 않았으므로, 요청량을 곧바로 콘텐츠 사용량이나 피해 규모로 해석해서는 안 된다.
#1 Best Overall
AI 크롤러 통제와 악성 봇 방어는 별개의 정책이다
AI 크롤러는 콘텐츠를 수집하는 자동화 프로그램을 가리키지만, 자동화 트래픽이 모두 같은 목적이나 위험을 가진 것은 아니다. Cloudflare는 봇이 계정 공격, 웹 애플리케이션 취약점 탐색, 스팸, 부정 구매, 성능 저하를 일으킬 수 있다고 설명한다. IP나 위치 차단을 피하거나 사람과 비슷한 행동을 보이는 봇도 거론한다. 이는 가능한 위험 유형에 대한 설명이지, 특정 사이트의 공격 발생률을 수치로 나타낸 것은 아니다.
따라서 콘텐츠 사용 허가와 보안 대응을 한 가지 차단 규칙에 맡기면 정당한 크롤러까지 막거나 악성 자동화를 놓칠 수 있다. 검색 노출을 원하는 페이지, 외부 AI 학습에 쓰이지 않기를 바라는 자료, 로그인이나 거래 기능처럼 자동화 공격에 취약한 영역은 서로 다른 기준으로 다루는 편이 낫다.
Rank #2
- Ideal for Gifting
- Ideal for a bookworm
- Compact for travelling
사이트 운영자가 검토할 대응 수단
요청을 제한하고 비정상 행동에 대응하기
Cloudflare의 설명에는 요청률 제한, CAPTCHA 없는 챌린지, 다중 인증(MFA), 로그와 행동 이상 탐지 같은 보안 통제가 포함된다. 목적은 원치 않는 자동화가 서비스나 계정에 가하는 부담을 줄이는 것이다. 트래픽 기록을 바탕으로 정상 사용자와 봇의 행동 기준선을 세우고 실시간 위협 정보를 확인하는 방식도 제시한다. 이런 수단은 보안 대응에 관한 것이며, 어떤 크롤러가 콘텐츠를 사용할 권리가 있는지를 결정하는 정책과는 구분해야 한다.
크롤러 신원과 페이지별 접근을 살펴보기
Cloudflare는 봇 접근을 감사하고, 요청 서명 같은 암호학적 신원 확인 수단을 이용하며, 봇별·페이지별로 허용 또는 차단하는 거버넌스를 제안한다. 운영자가 검토할 때는 다음 질문을 기준으로 삼을 수 있다.
Quick wins for a faster PC:
Repair Windows errors before they cause bigger problemsFix Now →Scan for outdated or missing drivers - takes under a minuteDriver Scan →Clear out junk files and repair common Windows errorsFree Scan →Rank #3
- 감사 가시성: 어떤 봇이 어느 페이지에 언제 접근했는지 확인할 수 있는가?
- 식별 신뢰성: 봇이 내세우는 신원과 목적을 확인할 수 있는가?
- 정책 세분성: 크롤러마다, 페이지마다 다른 접근 규칙을 둘 수 있는가?
- 보안 대응: 요청률 제한과 이상 탐지 등 악성 자동화 방어가 함께 제공되는가?
- 가치 교환: 단순 허용·차단 외에 조건부 허가나 요금 청구를 지원하는가?
이 질문은 기능을 비교하는 기준이지, 특정 제품이 봇의 신원을 항상 정확히 판별하거나 정책 위반을 완전히 막는다는 보장은 아니다. Cloudflare의 봇 솔루션 문서는 봇 관리 범주를 설명하지만, 각 기능의 현재 이용 조건은 해당 제품 문서에서 별도로 확인해야 한다.
콘텐츠 유형별로 허용 기준을 나누기
사이트 전체를 한 번에 열거나 닫기보다 콘텐츠의 목적과 수익 모델을 기준으로 정책을 설계할 수 있다. 예를 들어 공개 개발자 문서는 AI 서비스나 검색 도구에 노출되길 원할 수 있지만, 유료 구독 콘텐츠나 데이터베이스형 자료는 별도 기준이 필요할 수 있다. 이는 일반적인 정책 설계 예시이며, 특정 크롤러가 실제로 어떤 방식으로 콘텐츠를 이용하는지는 접근 기록과 서비스의 공개 정책 등을 확인해야 한다.
Rank #4
| 접근 정책 | 고려할 상황 | 운영상 점검할 점 |
|---|---|---|
| 허용 | 검색 노출이나 AI 서비스에서의 발견 가능성이 콘텐츠 목표와 맞는 경우 | 허용 대상 봇과 공개할 페이지 범위를 정하고 접근 기록을 확인한다. |
| 차단 | 특정 크롤러의 수집을 원하지 않거나 보안상 자동화 요청을 제한해야 하는 경우 | 차단 범위가 원하는 검색·서비스 노출까지 막지 않는지 살핀다. |
| 조건부 허가·유료 접근 | 접근을 허용할 수는 있지만 콘텐츠 사용에 조건이나 대가를 두고 싶은 경우 | 요금, 지원 봇, 자격 및 적용 범위가 실제로 제공되는지 확인한다. |
Pay per crawl은 발표된 방향과 현재 이용 가능성을 구분해야 한다
Cloudflare는 2025년 7월 1일, 신규 가입 도메인에서 AI 크롤러 허용 여부를 선택하게 하고 콘텐츠 소유자가 크롤러 접근을 감사하거나 요금을 청구할 수 있는 Pay per crawl을 소개했다. 공동 창업자 겸 CEO Matthew Prince는 발표문에서 “If the Internet is going to survive the age of AI, we need to give publishers the control they deserve and build a new economic model that works for everyone – creators, consumers, tomorrow’s AI founders, and the future of the web itself.”라고 말했다. 이 인용과 기능 소개는 Cloudflare가 내세운 비전과 발표 내용으로 읽어야지, 업계 전체의 합의나 이미 확립된 수익 모델로 받아들여서는 안 된다.
발표가 있었다는 사실만으로 현재 모든 계정에서 Pay per crawl을 쓸 수 있다거나, 지원 크롤러·가격·지역·자격 조건이 특정 방식으로 정해졌다고 단정할 수는 없다. 도입을 검토하는 운영자는 Cloudflare의 최신 제품 안내에서 자신의 계정과 도메인에 적용되는 조건을 확인해야 한다.
The Tool Desk
Outbyte PC Repair FREERepair Windows errors before they cause bigger problemsFix Now →Outbyte Driver Updater FREEScan for outdated or missing drivers - takes under a minuteDriver Scan →Best Value
- It can be a gift option
- Comes with secure packaging
- Helpful in various ways
운영 정책을 정할 때의 순서
- 콘텐츠를 구분한다. 공개 정보, 유료 자료, 검색 유입이 중요한 페이지, 계정·거래 기능이 있는 영역을 나눈다.
- 현재 접근을 살핀다. 가능한 로그와 봇 관리 도구에서 크롤러의 이름, 요청 시점, 접근 페이지를 확인한다. 기록만으로 봇의 목적까지 확정할 수 있다고 가정하지 않는다.
- 목표를 정한다. 페이지별로 검색·AI 노출을 원하는지, 수집을 제한할지, 조건부 허가를 검토할지 결정한다.
- 보안 규칙을 별도로 둔다. 콘텐츠 접근 정책과 함께 요청률 제한, 인증, 이상 행동 대응 등 사이트 위험에 맞는 통제를 검토한다.
- 작은 범위에서 변경하고 점검한다. 정책 적용 후 허용한 크롤러의 접근과 원치 않는 요청, 사용자 경험에 생긴 변화를 기록해 규칙을 조정한다.
- 유료 접근은 조건을 확인한 뒤 판단한다. 서비스 제공 여부, 대상 봇, 가격과 적용 조건이 확인되지 않았다면 예상 수익을 전제로 사업 계획을 세우지 않는다.
‘허가 기반 인터넷’이 해결하지 못하는 질문
Cloudflare CSO Grant Bourzikas는 공식 글에서 “With these capabilities, Cloudflare — along with the world’s leading publishers and AI companies — is building a permission-based model for the Internet.”라고 밝혔다. 이 표현은 회사의 방향을 설명하는 문장이다. 접근 감사를 할 수 있다고 해서 콘텐츠의 권리 관계가 자동으로 정리되는 것은 아니며, 신원 확인·차단·요금 부과가 모든 수집을 완벽히 통제한다고 보장하지도 않는다.
또한 사이트별로 AI 크롤링이 방문자 수나 수익에 미치는 영향은 다를 수 있다. 공개 자료만으로는 특정 사이트의 적정 허용 범위나 유료화 가격을 산출할 수 없다. 운영자는 자신의 트래픽·구독·광고 구조와 콘텐츠 가치에 맞춰 정책을 정하고, 제품의 실제 기능 상태와 약관을 확인해야 한다.




