방법론

"데이터 수집 인터넷 전반에 걸쳐 AI 작성 콘텐츠의 유병률에 대한 더 나은 그림을 얻기 위해, 우리는 2008년부터 거슬러 올라가는 방대한 웹 아카이브를 수집하고 유지 관리하는 비영리 단체인 Common Crawl에서 샘플링한 웹페이지 데이터를 사용했습니다. 대략 한 달에 한 번, Common Crawl은 관찰 가능한 인터넷의 "크롤링"을 완료하여 스냅샷을 생성합니다 [...]"