← 목록으로
AI/기술

웹 스크래핑인 줄 알았더니 ‘불법 토렌트’? 수조 원대 소송 휩싸인 앤스로픽의 딜레마

2026. 09. 03. 오후 07:01 · 1 조회수

안녕하세요, IT와 AI 트렌드의 이면을 깊이 있게 파헤쳐 보는 인사이츠 블로그예요.

최근 생성형 AI 업계를 발칵 뒤집어 놓은 엄청난 소식이 전해졌는데요. 바로 2026년 8월 말, 글로벌 대형 음악 퍼블리셔인 소니 뮤직 워너 섀펠(Sony Music Publishing & Warner Chappell Music)이 캘리포니아 연방법원에 앤스로픽(Anthropic)과 그 공동 창업자들을 상대로 거액의 저작권 침해 소송을 제기했다는 소식이에요.

단순히 ‘AI가 우리 노래를 허락 없이 학습했다’는 수준의 주장을 넘어, 데이터를 수집한 ‘경로’ 자체가 큰 충격을 주고 있는데요. 이번 앤스로픽 소송이 왜 기존의 AI 저작권 침해 사례들과 궤를 달리하는지, 그리고 이것이 앞으로 AI 산업에 어떤 파장을 불러올지 자세히 알아볼게요.


1건당 15만 달러? 수조 원대 배상금 걸린 사건의 전말

이번 소송의 규모는 그야말로 역대급이에요. 원고 측인 소니 뮤직과 워너 섀펠은 앤스로픽이 머라이어 캐리, 테일러 스위프트, 비틀즈 등 전 세계적으로 사랑받는 유명 아티스트들의 곡을 포함해 ‘수만 곡’의 가사와 악보를 무단으로 사용했다고 주장하고 있어요.

단순히 곡을 학습한 것을 넘어, AI 가사 무단 도용에 대한 구체적인 배상액까지 명시했는데요. 침해된 저작물 1건당 최대 15만 달러(약 2억 원), 저작권 관리 정보(CMI) 훼손 1건당 2만 5천 달러의 법정 손해배상을 청구했어요. 수만 곡에 이 기준을 적용하면 전체 배상액은 가볍게 수십억 달러(수조 원) 단위로 넘어가게 돼요.

스크래핑 우회부터 불법 토렌트까지, 충격적인 데이터 수집 방식

가장 논란이 되는 부분은 바로 앤스로픽의 AI 학습 데이터 무단 수집 방식이에요. 소장에 따르면 앤스로픽은 두 가지 치명적인 방식을 사용한 것으로 의심받고 있어요.

  1. 합법 사이트 무단 스크래핑: 뮤직스매치(Musixmatch)나 리릭파인드(LyricFind) 같은 합법적인 가사 제공 사이트의 데이터를 무단으로 긁어모았다는 의혹이에요.
  2. 불법 해적판 사이트 이용: 라이브러리 제네시스(Library Genesis), 파이러트 라이브러리 미러(Pirate Library Mirror) 같은 불법 복제 사이트에서 토렌트를 통해 데이터를 대량으로 다운로드했다는 충격적인 정황이 포함되었어요.

지금까지 많은 AI 기업들이 웹에 공개된 데이터를 크롤링하면서 마찰을 빚어왔지만, 아예 ‘불법 토렌트 사이트’를 통해 해적판 데이터를 취득했다는 주장은 차원이 다른 도덕적, 법적 문제를 제기하고 있어요.

팽팽한 법적 공방: ‘공정 이용’인가, ‘시장 교란’인가

법정에서 맞붙은 양측의 논리는 아주 명확하게 갈리고 있어요.

앤스로픽 측은 이번 소송이 과거 다른 권리자들이 제기했던 소송의 ‘재탕’에 불과하다며 선을 그었어요. 그들은 이전 판례들을 근거로, 자사의 AI 학습 방식이 원본을 새로운 가치로 변환하는 생성형 AI 공정 이용(Fair Use)에 해당하므로 합법적이라는 입장을 굽히지 않고 있죠.

하지만 음악 퍼블리셔와 전문가들의 분석은 전혀 달라요.

  • 원본 그대로의 출력(Verbatim): 클로드가 원본과 토씨 하나 틀리지 않고 동일한 가사를 그대로 생성해 낼 수 있다는 점을 지적해요. 이는 인간 창작물을 대체하는 명백한 ‘시장 교란 행위’라는 것이죠.
  • 독수독과(毒樹毒果): 원고 측 변호인단은 AI 모델의 학습 자체가 공정 이용으로 인정받을 수 있는가 하는 논쟁과는 별개로, 애초에 학습 데이터를 ‘해적판 사이트’에서 불법적으로 취득한 행위 자체는 그 어떤 이유로도 정당화될 수 없다고 강하게 비판하고 있어요.

“배상금은 그저 비즈니스 비용?” 엇갈리는 커뮤니티 반응

이번 사태를 바라보는 대중과 업계 종사자들의 시선도 복잡하게 얽혀 있어요. 레딧을 비롯한 IT 커뮤니티에서는 앤스로픽이 2025~2026년에 걸쳐 작가들이 제기한 유사한 저작권 소송에서 이미 15억 달러(약 2조 원) 규모의 합의를 한 전력을 언급하고 있는데요.

일부 유저들은 “AI 기업들이 막대한 저작권 침해 배상금을 단순히 사업을 위한 ‘비즈니스 비용’이나 ‘통행료’ 정도로 치부하고 있다”며 비판의 목소리를 높이고 있어요. 특히 불법 토렌트까지 동원했다는 소장 내용에 대해 AI 기업들의 도덕적 해이가 선을 넘었다는 부정적인 반응이 많더라고요.

반면, AI 기술의 비약적인 발전을 위해서는 낡은 현행 저작권법이 개정되어야 하며, 기존 대형 저작권자들이 기술 발전을 볼모로 과도한 지대 추구(Rent-seeking)를 하고 있다는 옹호론도 존재해 양측의 의견이 팽팽하게 맞서고 있습니다.

##[심층 분석] 클로드 API를 쓰는 B2B 기업들의 잠재적 리스크는?

여기서 실무자라면 반드시 짚고 넘어가야 할 중요한 질문이 하나 있어요.

“이번 소송 결과가 확정되기 전까지, 클로드 API를 활용하여 서비스를 개발하는 B2B 기업 고객들이 감수해야 할 잠재적 법적 리스크는 무엇일까요?”

만약 법원이 앤스로픽의 데이터 수집 방식(특히 불법 경로 취득)을 심각한 위법으로 판단하고 클로드 AI 저작권 침해를 인정한다면, 해당 모델을 기반으로 상업적 서비스를 운영하는 B2B 기업들 역시 2차적인 저작권 분쟁에 휘말리거나 서비스 약관 위반으로 인한 서비스 중단 사태를 맞이할 수 있어요. 특히 사용자의 프롬프트에 따라 저작권이 있는 가사나 콘텐츠가 여과 없이 출력(Verbatim)되는 서비스 구조를 가졌다면 그 위험성은 훨씬 커집니다.

마무리하며: 혁신과 윤리의 경계선에서

AI 기술 발전이라는 명분 아래 자행되는 무차별적인 데이터 수집. 과연 이것은 인류를 위한 ‘공정 이용’일까요, 아니면 남의 땀방울을 훔치는 ‘불법 복제물 취득’일까요?

소니와 워너가 던진 이 수조 원짜리 질문은 단순히 앤스로픽 한 회사만의 문제가 아니에요. 현재 AI 산업 전체가 맞이한 법적, 윤리적 한계를 시험하는 중요한 분수령이 될 거예요.

IT 업계 종사자나 개발자, 기획자분들이라면 지금 진행 중인 본인의 업무나 프로젝트에서 AI 모델을 사용할 때 발생할 수 있는 저작권 리스크를 다시 한번 꼼꼼히 재점검해 보시길 권해드려요. 앞으로 이 재판이 어떤 판결로 이어질지, 인사이츠 블로그와 함께 계속 주의 깊게 모니터링해 보아요!

#앤스로픽소송#클로드AI#저작권침해#공정이용#생성형AI