본문 바로가기

IT & AI

AI 검색이 원문을 가릴 때, 웹의 기억도 함께 사라져요

728x90

AI 검색이 원문을 가릴 때, 웹의 기억도 함께 사라져요

AI 뉴스 썸네일
AI 뉴스 썸네일

AI 검색이 틀린 답을 내놓는 문제는 환각에서 끝나지 않아요. 검색 결과가 원문 방문을 줄이고, 웹페이지를 보존할 경제적 동기까지 약하게 만들 수 있어요. 기록이 삭제되거나 검색에서 밀려나면 정확한 원문이 존재해도 독자는 찾기 어려워져요. 1

핵심 요약

구분핵심왜 볼 만한가요
AI 검색Google AI 요약이 기본 사실을 틀리거나 원문보다 앞에 노출돼요잘못된 답뿐 아니라 원문 발견 경로까지 함께 살펴야 해요
웹 보존FiveThirtyEight 아카이브 삭제와 링크 부패가 기록 손실을 보여줘요웹에 한 번 공개된 자료도 계속 남는다고 믿기 어려워요
지식 생태계Wikipedia와 Internet Archive가 트래픽, 기부, 소송, 크롤링 제한에 압박받아요AI가 쓰는 지식 기반을 누가 유지할지 비용 문제가 남아요
공공 인프라유럽 일부 기관은 Qwant, Tchap, 오픈소스 도구를 채택해요검색과 메시징을 공공 디지털 인프라로 보는 접근이에요

1. AI가 답을 대신할수록 원문으로 가는 길은 좁아져요

The Walrus는 Google의 AI 요약이 일몰 시각처럼 확인 가능한 사실도 잘못 제시한 사례에서 이야기를 시작해요. 오류 하나만 보면 검색 품질 문제로 보일 수 있어요. 하지만 AI 답변이 검색 결과 상단에서 원문을 밀어내면, 정확한 페이지가 남아 있어도 사용자가 발견하지 못할 수 있어요. 기업이 AI 검색 결과에 영향을 주려고 공개 게시판에 콘텐츠를 심는 현상까지 더해지면 요약의 재료부터 오염될 수 있어요. 2

웹의 기록은 원래도 불안정했어요. 주소가 바뀌거나 운영자가 사이트를 닫으면 링크는 끊겨요. 이번 글은 Disney가 FiveThirtyEight 운영을 끝낸 뒤 과거 아카이브 대부분을 삭제한 사례를 들어, 기업이 수익을 내지 못하는 기록을 언제든 정리할 수 있다는 점을 짚어요. 책은 다른 도서관에서 다시 찾을 가능성이 있지만, 삭제된 웹페이지는 존재했다는 흔적조차 사라질 수 있어요.

728x90

Wikipedia와 Internet Archive의 사정도 연결돼 있어요. AI 서비스가 Wikipedia 내용을 읽고 검색 화면에서 곧바로 답하면 방문자는 원문을 클릭할 이유가 줄어요. 방문 감소가 관심과 기부 감소로 이어지면 자원봉사 기반 백과사전의 유지 비용을 감당하기 어려워져요. Internet Archive는 방대한 저장 비용에 더해 사이버 공격과 저작권 소송을 겪고 있어요. AI 학습에 보관 자료가 쓰일 수 있다는 우려로 언론사가 Wayback Machine 크롤러를 막으면 새 기록을 남길 범위도 좁아져요. 3

이 문제는 AI 모델의 정확도만 높인다고 풀리지 않아요. 모델이 인용할 원문을 누가 만들고, 오래 보관하고, 다시 찾을 수 있게 색인할지 정해야 해요. 검색 서비스가 출처 링크와 수정 이력을 분명히 보여주는지도 함께 봐야 해요. 콘텐츠 제작자에게 방문과 수익이 돌아오지 않으면 공개 웹에 새 정보를 올릴 동기가 줄 수 있어요.

글은 유럽의 대응도 소개해요. 프랑스 정부 기관은 유럽에서 호스팅되는 검색 서비스 Qwant와 정부용 메시징 앱 Tchap을 채택했어요. 여러 공공기관은 Microsoft 제품을 오픈소스 대안으로 바꾸고 있어요. 모든 국가가 같은 선택을 할 필요는 없지만, 검색과 메시징을 무료 소비자 서비스가 아닌 공공 업무 기반으로 다룬다는 점은 분명해요. 정부와 대학, 도서관이 보존 비용을 나눠 맡으면 한 기업의 사업 판단으로 기록 전체가 사라질 위험을 줄일 수 있어요.

서비스를 고를 때 확인할 기준

AI 검색을 제품에 붙이는 팀이라면 답변 정확도만 측정하면 부족해요. 답변이 어느 문서에서 나왔는지, 원문 링크가 실제로 열리는지, 오래된 자료와 최신 자료를 구분하는지 확인해야 해요. 출처가 삭제됐을 때 보관본으로 연결할 방법과 잘못된 요약을 고치는 절차도 필요해요.

콘텐츠를 운영하는 팀은 중요한 문서를 자체 도메인에 남기고 버전과 날짜를 표시하는 편이 좋아요. 외부 플랫폼에만 글을 두면 계정 정책이나 사업 종료에 따라 기록을 잃을 수 있어요. 정기 백업과 영구 링크, 사이트맵을 함께 관리하면 검색 서비스가 바뀌어도 원문을 복구하기 쉬워요.

왜 중요한가요

AI 서비스의 품질은 모델 성능과 지식 기반의 상태에 함께 좌우돼요. 검색 결과가 원문 방문을 끊고 원문 제작자의 수익까지 줄이면, 다음 세대 모델이 참고할 새 자료도 줄어들어요. 삭제된 페이지와 오염된 게시물이 늘수록 답을 검증하는 비용은 개발자, 연구자, 독자에게 돌아와요. 2

웹 보존은 거대한 아카이브 한 곳에만 맡길 일도 아니에요. 공공기관과 대학은 행정·학술 기록을 보관하고, 서비스 운영자는 출처와 변경 이력을 남기고, 검색 사업자는 원문을 가리지 않는 연결 방식을 마련할 수 있어요. 사용자가 요약에서 원문으로 이동할 수 있어야 오류를 발견하고 기록의 맥락도 확인할 수 있어요.

참고 자료

  1. AI가 웹을 잠식하면서 인터넷의 집단 기억이 사라지고 있음 — GeekNews
  2. Google Search Is Dying. What Comes Next Is Worse — The Walrus
  3. GeekNews 토픽 32400 Markdown — GeekNews
728x90