CNN이 목요일 펄플렉시티를 상대로 소송을 제기했다. AI 검색 스타트업이 허가 없이 기사를 '그대로 복사'해 생성한다는 혐의다. 또한 펄플렉시티가 CNN의 유료 구독 페이월 뒤에 있는 콘텐츠를 사용자에게 제공해 뉴스 조직의 비즈니스 모델을 직접 훼손하고 있다고 주장했다.
무슨 일이 있었나
더버지에 따르면, 이 소송은 뉴욕 연방 법원에 제기되었으며, 펄플렉시티의 AI 기반 검색 엔진이 사용자 질문에 응답하며 CNN 기사를 '그대로' 재생산한다고 주장한다. 소장은 이것이 공정 사용을 훨씬 넘어서 라이선스 없이 저작권 콘텐츠를 사실상 재발행하는 행위라고 주장한다. 단순한 복제를 넘어, CNN은 펄플렉시티가 적극적으로 페이월을 우회해 구독 전용 자료를 무료로 제공한다고 주장한다.
펄플렉시티는 여러 출처의 정보를 종합하고 요약된 답변을 인용과 함께 제공하는 대화형 AI 도구, 즉 '답변 엔진'으로 자리매김하고 있다. CNN은 이 종합 과정이 사실상 전체 복사에 불과하며, 원 게시자의 트래픽과 수익을 해치는 방식으로 맥락과 출처 표시가 제거되었다고 주장한다.
이번 소송은 AI 기업과 콘텐츠 창작자 간의 법적 분쟁이 격화되는 패턴을 따른다. 펄플렉시티는 이미 올해 초 포브스로부터 내용 증지 편지를 받았으며, 뉴스 수집 게시자들은 점점 더 자신들의 작업물을 긁어가 재가공하는 AI 도구에 도전장을 내밀고 있다.
왜 중요한가
이 소송은 AI 업계에 중요한 시점에 제기되었다. 법원은 여전히 저작권 데이터 학습과 파생 콘텐츠 생성이 공정 사용인지 침해인지를 두고 씨름 중이다. 뉴욕타임스 대 오픈AI 사건이 초기 판례를 만들고 있지만, CNN 소송은 AI 도구가 기사를 거의 그대로 재현할 때 무슨 일이 일어나는가라는 질문을 더욱 날카롭게 만든다.
'그대로' 복사했다는 주장이 핵심이다. AI 관련 저작권 분쟁 대부분은 모델 구축을 위해 수십억 웹페이지를 긁어가는 학습 데이터에 초점이 맞춰져 있었다. 이 사건은 출력물, 즉 사용자에게 제공되는 실제 텍스트에 관한 것이다. 판사가 펄플렉시티의 요약이 침해 복사본이라고 판단한다면, AI 검색 전체 카테고리가 게시자를 인용하고 보상하는 방식을 재고해야 할 수 있다.
뉴스 조직에게 이 문제는 생존과 직결된다. 검색 엔진에서 유입되는 트래픽은 구독과 광고 수익을 창출한다. AI 도구가 사용자를 원본 기사로 보내지 않고 질문에 답변한다면, 그 트래픽은 사라진다. CNN의 페이월은 구독자 수익으로 전환하는 업계의 광범위한 움직임의 일부이며, 이를 우회하는 것은 그 전략을 직접 훼손하는 것이다.
시장 및 업계 파장
이 소송은 투자자와 게시자 모두에게 신호를 보낸다. 펄플렉시티 같은 AI 검색 스타트업은 전통적인 검색을 대체할 수 있다는 전제로 상당한 자금을 유치했다. 펄플렉시티는 최근 라운드에서 30억 달러의 가치를 인정받았다. 하지만 저작권 침해에 따른 법적 비용이 쌓이면 그 가치 평가가 위험해질 수 있다.
게시자들은 예의주시하고 있다. 여러 주요 미디어 기업들은 이미 오픈AI와의 라이선스 계약을 체결했다. 여기에는 AP 통신, 악셀 슈프링어, 파이낸셜 타임스와의 계약이 포함된다. 뉴욕타임스와 이제 CNN 같은 다른 기업들은 소송을 선택하고 있다. 이 사건의 결과는 라이선스가 기본 비즈니스 모델이 될지, 아니면 장기적인 법적 공방이 뉴스 분야에서 AI 도입을 늦출지를 결정할 수 있다.
더 넓은 기술 업계에서 이번 판결은 웹 콘텐츠를 요약하는 모든 AI 도구(챗봇부터 검색 엔진까지)가 출력을 구성하는 방식에 영향을 미칠 수 있다. 그대로 복사하는 것이 불법으로 판명되면, 기업들은 더 정교한 요약 기술에 투자하거나 짧은 인용문만 사용할 때도 콘텐츠 라이선스 비용을 지불해야 할 수 있다.
경쟁 구도
펄플렉시티만 게시자의 반발에 직면한 것은 아니다. 오픈AI는 뉴욕타임스와 작가 단체로부터 소송을 당했으며, 데이터 사용에 대해 게시자와 계속 협상 중이다. 구글의 AI 오버뷰도 명확한 출처 표시 없이 콘텐츠를 가져온다는 비판을 받아왔다.
펄플렉시티를 차별화하는 점은 비즈니스 모델이다. 구글이나 빙처럼 자체 색인된 웹 데이터를 호스팅하지 않는다. 대신 타사 검색 API와 실시간 웹 스크래핑에 의존해 답변을 생성한다. 이로 인해 라이브 게시자 콘텐츠에 더 의존하게 되고, 직접 복사 혐의에 더 취약해진다.
CNN의 소송은 게시자들 사이의 증가하는 분열도 부각시킨다. 애틀랜틱과 복스 미디어 같은 일부는 오픈AI와 라이선스 계약을 체결했다. 다른 이들은 더 강경한 입장을 취하고 있다. 펄플렉시티 사건은 라이선스를 체결한 게시자는 적절한 출처 표시와 보상을 받고, 그렇지 않은 게시자는 우회되거나 소송을 당하는 양층 시스템을 가속화할 수 있다.
향후 전망
이 사건은 실질적인 판결까지 수개월이 걸릴 것으로 보인다. 펄플렉시티는 이전에 자신의 도구가 콘텐츠를 변형하고 인용을 제공하기 때문에 공정 사용에 해당한다고 주장해 왔다. CNN의 '그대로' 복사 주장은 그 이야기에 직접 도전한다.
핵심 절차적 단계는 증거 개시(discovery)로, 펄플렉시티가 모델이 응답을 생성하는 방식을 공개해야 할 수 있다. 이로 인해 회사가 비밀로 유지하려 했던 내부 프로세스가 드러날 수 있다. 한편 CNN은 펄플렉시티의 출력과 연결된 구체적인 손해(구독 감소, 광고 수익 감소)를 입증해야 한다.
판사는 펄플렉시티가 검색 엔진인지 콘텐츠 재발행자인지도 저울질할 수 있다. 구글 같은 전통적인 검색 엔진은 스니펫을 보여주는 것으로 공정 사용 보호를 오랫동안 받아왔지만, 펄플렉시티의 전체 문단 답변은 그 경계를 모호하게 만든다. 사건이 진행됨에 따라 기술 업계 그룹과 미디어 협회의 의견서(amicus briefs)가 제출될 것으로 예상된다.
업계에 주는 의미
투자자: AI 검색 스타트업은 이제 상당한 법적 위험을 안고 있다. 콘텐츠 라이선싱과 공정 사용 방어에 대한 실사가 새로운 자금 조달 라운드 전에 표준이 될 것이다.
게시자: 이 사건은 소송이 더 효과적인 전략인지 라이선스가 더 효과적인지에 대한 시험대다. CNN의 승리는 다른 미디어 기업이 협상보다 소송을 선택하도록 자극할 수 있고, 패배는 모두를 의무적 라이선스 체계로 몰아갈 수 있다.
AI 기업: '학습 데이터는 공정 사용'이라는 안전지대가 좁아지고 있다. 실시간 답변 엔진을 구축하는 기업들은 적극적으로 콘텐츠 라이선스를 확보하거나, 그대로 출력을 피하기 위해 시스템을 재설계해야 한다. 강제 패러프레이즈를 수행하는 검색 증강 생성(retrieval-augmented generation) 같은 기술적 해결책이 법적 필수 사항이 될 수 있다.
규제 기관: 법원은 입법을 앞지르는 판례를 만들고 있다. 이 사건은 미국 저작권청과 의회가 AI 저작권 규칙, 특히 기존 저작물의 거의 정확한 복사본을 생성하는 생성형 모델에 접근하는 방식에 영향을 미칠 수 있다.
자주 묻는 질문
펄플렉시티가 정확히 무엇인가요? 펄플렉시티는 여러 웹 출처의 정보를 종합하고 그 출처를 인용하여 대화형 답변을 생성하는 AI 기반 검색 엔진입니다.
CNN은 소송에서 무엇을 주장하나요? CNN은 펄플렉시티가 허가 없이 기사를 '그대로' 재생산하며, 때로는 전체 문단 이상을 복사하고, CNN의 유료 구독 페이월 뒤에 있어야 할 콘텐츠를 제공한다고 주장합니다.
펄플렉시티가 이전에 소송을 당한 적이 있나요? 네. 포브스가 올해 초 내용 증지 편지를 보냈고, 다른 게시자들도 법적 조치를 위협한 바 있습니다. 이번이 회사에 대한 첫 번째 주요 저작권 소송입니다.
이 사건이 뉴욕타임스 대 오픈AI 사건과 비슷한가요? 두 사건 모두 AI 도구에 의한 저작권 침해 주장을 포함하지만, CNN 소송은 학습 데이터보다는 출력(그대로 복사)에 더 초점을 맞추고 있습니다. 법적 논점은 겹치지만 구별됩니다.
펄플렉시티가 공정 사용을 주장하여 이길 수 있나요? 가능하지만, '그대로' 복사했다는 특성은 일반적으로 변형적 사용에 유리한 공정 사용 방어를 약화시킵니다. 결과는 법원이 변형을 어떻게 정의하느냐에 달려 있습니다.
CNN이 이기면 어떻게 되나요? 승리하면 펄플렉시티가 요약 방식을 변경하거나, 라이선스 비용을 지불하거나, 페이월 콘텐츠에 대한 접근을 차단해야 할 수 있습니다. 또한 다른 게시자들이 AI 검색 도구를 상대로 소송을 제기하는 강력한 판례가 될 것입니다.
결론
CNN의 펄플렉시티 소송은 AI 기업이 저작권 콘텐츠를 어떻게 사용하는지에 대한 더 광범위한 전쟁의 최전선이다. 그대로 복사와 페이월 우회를 주장함으로써 CNN은 법적 질문을 학습 데이터를 넘어 AI 생성 출력의 메커니즘으로 좁힌다. 그 결과는 AI 검색 엔진이 라이선스를 통해 게시자와 공존할지, 아니면 소송을 통해 싸울지를 결정할 것이며, 전체 기술 업계가 주목하고 있다.