유럽과 캐나다가 기술 주권 확보를 위해 독립적인 디지털 인프라를 구축한다
AI 요약의 오류로 웹의 정보 저장 기반이 무너지는 상황에서, 유럽 각국 정부는 수십만 대의 업무용 컴퓨터에서 Microsoft 제품을 오픈소스 대안으로 교체하고 있다. 이는 해외 플랫폼에 의존하는 기술 구조를 국가 주권 차원에서 재편하려는 선택이다.
프랑스는 해외 플랫폼을 국가 사이버 보안의 위협으로 규정했다. 이에 따라 프랑스 국회와 군부, 유럽 의회는 유럽 내 호스팅 기반의 Qwant(유럽 검색 서비스)를 채택했다. 공무원에게는 WhatsApp이나 Signal 대신 자국 메시징 앱인 Tchap(정부 전용 통신 앱) 사용을 요구한다.
캐나다는 공공 인터넷 구축을 위해 기존의 학술 디지털 기반을 활용한다. Library and Archives Canada(캐나다 도서관 및 기록 보관소)가 연방정부의 웹 기록과 역사 자료를 보존하며, CANARIE(국가 연구 및 교육 네트워크)는 대학과 연구자를 위한 전용 네트워크 구축을 지원한다.
학술지 출판 영역에서도 상업 플랫폼의 영향력을 배제한다. Simon Fraser University의 Public Knowledge Project는 2002년부터 Open Journal Systems(오픈소스 학술지 관리 시스템)를 제공했다. 이를 통해 수천 개의 학술지가 대형 상업 플랫폼 밖에서 독립적으로 출판한다.
독일 법원은 Google AI Overview의 거짓 정보 생성에 대해 편집 책임을 인정했다
국가 차원의 인프라 구축 노력과 달리, 상업적 AI 서비스의 확산은 정보의 정확성과 보존이라는 새로운 법적·경제적 문제를 야기하고 있다. 독일 법원은 AI Overview(구글의 생성형 AI 검색 요약 서비스)가 두 출판사를 사기성 사업 관행과 잘못 연결해 거짓 진술을 생성한 사건에서 구글의 책임을 인정했다. 법원은 검색 엔진이 정보를 단순히 가리키는 데 그치지 않고, 내용을 추출해 자체 문장으로 다시 쓴 행위에 주목했다. 이는 단순한 경로 안내가 아니라 새로운 콘텐츠를 직접 작성한 행위이며, 따라서 구글이 작성자로서의 편집 책임을 전적으로 부담해야 한다는 판결이다.
기업의 자산 관리 효율성 판단에 따라 웹 기록이 삭제되는 사례도 발생한다. 디즈니는 자회사들을 통해 10년 넘게 FiveThirtyEight(데이터 기반 분석 저널리즘 매체)를 소유했으나, 창립자 네이트 실버가 2023년 떠나고 2025년 3월 남은 직원들까지 모두 해고된 뒤 아카이브 거의 전부를 삭제했다. 디즈니는 새로운 저널리즘 생산이 중단되고 광고 수익이 발생하지 않는 비활성 자산으로 판단해 기록 보존보다 유지 비용 절감이라는 경제적 판단을 우선했다.
웹 데이터의 휘발성과 AI 요약의 오류에 대응하는 전략
웹 기반 정보를 신뢰해 서비스를 구축하는 개발자는 AI 요약이 생성하는 기본 사실 오류와 원문 접근 차단 가능성을 점검해야 한다. Google의 AI Overview는 실제와 다른 일몰 시각을 제공해 사용자가 일몰을 놓치게 만드는 오류를 범했다. AI가 사용자와 원문 사이에 배치되면서 기반 페이지가 서버에 남아 있어도 사용자가 정확한 정보에 도달하는 경로가 사실상 차단된다.
AI 시스템이 콘텐츠를 직접 수집해 결과에 제시하면서 Wikipedia의 방문자와 기부금이 감소하고 있다. 이는 운영 자금 부족으로 이어져 지식 기반 인프라 자체의 생존을 위협한다. Internet Archive(웹 페이지 보관 서비스)는 사이버 공격과 고비용 소송, 언론사의 크롤러 차단으로 인해 웹 백업 수행에 어려움을 겪는다. 언론사들은 보관된 페이지가 AI 기업에 저작물을 간접 제공하는 통로가 될 것을 우려해 Wayback Machine(웹 아카이브 서비스)의 크롤러를 차단했다.
따라서 외부 웹 데이터의 휘발성과 오염 가능성을 상수로 두고 데이터 소스의 영속성을 검증하는 데이터 거버넌스 체크리스트를 도입해야 한다. 웹 기반 RAG(검색 증강 생성) 구축 시 원문 URL의 생존 여부와 아카이브 존재 여부를 확인하는 검증 단계를 추가한다.
웹의 정보 저장 기반이 무너지고 AI가 그 빈자리를 잘못된 요약으로 채우는 시대다. 이제 데이터의 '접근 가능성'은 검색 엔진의 친절함이 아니라, 독립적인 아카이브와 엄격한 데이터 거버넌스에 의해 결정된다.




