그 답변에 여러분의 페이지가 필요하지 않기 때문입니다. 2025년 3월 Tow Center는 여덟 개 생성형 검색 도구에 걸쳐 1,600건의 쿼리를 돌렸고, 발췌문을 붙여 넣은 뒤 기사 제목, 발행사, 날짜, URL을 대라고 요구했습니다. “플랫폼들은 의도적으로 크롤러를 차단한 발행사에서 정보를 가져왔다”는 소제목 아래, 한 어시스턴트의 무료 등급은 페이월 뒤에 있는 National Geographic 기사에서 뽑은 발췌 열 건을 모두 정확히 식별했습니다. 이 발행사는 해당 크롤러를 disallow해 두었고 그 회사와 아무런 관계도 없었습니다.1
차단을 우회하는 경로는 세 가지이고, 다툼이 있는 것은 세 번째뿐입니다. 첫째는 전재입니다. USA Today는 어떤 어시스턴트의 크롤러를 차단하는데, 그 어시스턴트는 Yahoo News가 다시 실은 같은 기사의 판본을 인용했습니다. 둘째는 제3자 보도로, 어떤 에이전트가 발행사를 직접 건드리지 않으려 할 때 쓴 대안이었습니다. “그 기사에 관한 트윗, 전재본, 다른 매체의 인용, 웹 전반의 관련 보도를 끌어모은 합성 요약”이었습니다.2 셋째는 불준수입니다. 2025년 8월 4일 Cloudflare는 robots.txt로 모든 것을 disallow한, 새로 등록해 색인된 적 없는 도메인을 등록했다고 보고하면서, 그럼에도 한 어시스턴트가 그 업체가 공개한 주소 범위 밖의 일반 Chrome user agent에서 그 도메인들에 관한 상세한 내용을 반환했다고 밝혔습니다. Cloudflare는 그 업체를 검증된 봇 목록에서 제외했고, 업체는 다음 날 은밀한 크롤링을 부인했으며, 이 분쟁은 아직 해결되지 않았습니다.3
그 요약이 기억해 둘 만한 한 문장입니다. “검색 결과에서 노출을 원하던 발행사는 그것을 얻지 못했고, 옵트아웃을 원하던 쪽의 콘텐츠는 그들의 뜻에 반해 계속 보였다.”1 파일 하나는 두 실패 중 어느 쪽도 깔끔하게 통제하지 못합니다.