구글이 AI 모델 학습 데이터의 저작권 문제를 둘러싼 새로운 정책 방향을 제시하며 논쟁의 중심에 섰습니다.
AI 저작권 이슈, 학습 데이터가 핵심인가?
최근 구글은 AI 규제에 관한 21페이지 분량의 정책 보고서를 발표했습니다. 켄 워커(Google의 글로벌 정책 담당 부사장)가 작성한 이 문서는 AI 모델 학습 방식에 대한 법적 관점을 담고 있습니다.
또한 구글은 공개된 웹 데이터를 활용한 AI 학습이 미국의 '공정 이용(Fair Use, 저작권자의 허락 없이 특정 조건 하에 저작물을 사용하는 권리)' 범위에 해당한다고 주장합니다. 이는 마치 미술 전공 학생이 갤러리를 돌아다니며 영감을 얻는 것과 같다는 논리입니다.
결국 구글은 데이터 입력(Input) 단계가 아니라, AI가 만들어낸 결과물(Output) 단계에서 저작권 문제를 관리해야 한다고 강조합니다. 즉, 학습 과정 자체보다는 생성된 콘텐츠가 기존 저작물을 직접적으로 복제했는지가 중요하다는 입장입니다.
창작자와 AI 기업 간의 법적 갈등
하지만 이러한 구글의 주장은 현재 진행 중인 여러 법적 분쟁과 정면으로 충돌하고 있습니다. 음악 산업계는 AI 기업들의 학습 방식이 저작권을 대규모로 침해하고 있다고 맞서고 있습니다.
- RIAA(미국 레코드 산업 협회, 주요 음반사들의 권익을 대변하는 단체)와 음반 출판사들은 AI 음악 플랫폼들이 저작권이 있는 곡들을 무단 학습했다고 소송을 제기했습니다.
- 음악 출판사들은 앤스 오픽(Anthropic, 생성형 AI 기업)이 클로드(Claude, AI 챗봇)를 학습시키는 과정에서 가사를 무단 사용했다며 거액의 손해배상을 청구했습니다.
- 독립 예술가들은 구글의 음악 생성 모델이 유튜브의 저작권 있는 녹음물을 무단으로 학습했다며 소송을 제기한 상태입니다.
이처럼 AI 모델의 학습 데이터 확보 방식은 창작자들의 권리와 기업의 기술 발전 사이에서 치열한 공방을 일으키고 있습니다.
구글이 제안하는 AI 규제의 미래
한편 구글은 과도한 규제가 기술 발전을 저해하는 것을 막기 위한 대안으로 '프런티어 AI 규제 기구(FARO)' 설립을 제안했습니다. 이는 산업계가 자금을 지원하고 정부 기관이 감독하는 독립적인 기구를 의미합니다.
또한 구글은 다음과 같은 운영 원칙을 제시했습니다.
- 데이터 기반의 접근 방식을 통해 실질적인 이익과 피해를 검증해야 합니다.
- 웹사이트 소유자가 자신의 콘텐츠 사용 여부를 제어할 수 있는 기술적 수단을 제공해야 합니다.
- 기존의 통지 및 삭제(Notice-and-takedown, 저작권 침해 신고 시 콘텐츠를 내리는 절차) 시스템을 통해 침해 문제를 해결해야 합니다.
결국 구글은 AI 학습이 기술적 혁신을 위한 '변형적 사용'임을 강조하며, 규제의 초점이 모델 개발 과정이 아닌 최종 결과물의 침해 여부에 맞춰져야 한다는 입장을 고수하고 있습니다.
원문 출처: Metal Injection | AI 기자 하은이 번역·재작성한 콘텐츠입니다
댓글
댓글 없음:
댓글 쓰기