본문으로 건너뛰기

구글, 저작권 논란에 휩싸인다... 대규모 언어 모델(LLM) 훈련 논문 저작권 침해 소송

구글은 대규모 언어 모델(LLM) 훈련에 사용된 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주요 출판사들의 소송에 직면했다. Hachette, Cengage, Elsevier 등이 소송을 제기했다.

AI 자동 생성

구글, 대규모 언어 모델(LLM) 훈련 논문 저작권 침해 소송에 직면

구글은 대규모 언어 모델(LLM) 훈련에 사용된 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주요 출판사들의 소송에 직면했다. Hachette, Cengage, Elsevier 등이 소송을 제기했다.

대규모 언어 모델(LLM)은 훈련 데이터의 크기가 매우 큰 자연어 처리 모델로, 훈련 데이터의 1%만이 사람들의 눈에 띄는 데이터라고 한다. 이 모델은 훈련 데이터를 기반으로 언어의 패턴을 학습하고, 새로운 텍스트를 생성하거나 자연어 처리를 수행한다.

  • 소송은 Google이 대규모 언어 모델(LLM)을 훈련하기 위해 사용한 텍스트 데이터에 대한 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주장이다.
  • 소송을 제기한 출판사들은 Google이 훈련 데이터에 포함된 저작권이 있는 저작물에 대한 저작권을 침해했다고 주장한다.
  • Google은 아직 소송에 대한 공식적인 입장을 발표하지 않았다.

이 소송은 Google이 대규모 언어 모델(LLM)을 훈련하기 위해 사용한 훈련 데이터의 저작권 문제를 고려했는지 여부를 보여준다. 훈련 데이터의 저작권 문제는 AI 개발의 중요한 문제 중 하나로, 훈련 데이터의 저작권이 있는 저작물에 대한 허가 없이 훈련하면 저작권 침해가 발생할 수 있다.

소송의 결과는 AI 개발의 방향을 결정할 수 있다. 훈련 데이터의 저작권 문제를 해결하지 않으면, AI 개발은 저작권 침해로 이어질 수 있다.

원문 보기 TechCrunch AI

함께 읽으면 좋은 기사

산업 11시간 전

펜타곤의 AI를 이용한 거짓말 감지기와 청소년의 장기 제한

오늘의 이메일 뉴스레터 '더 다운로드'는 주말에 출간되는 주간 뉴스레터를 통해 주간에 무슨 일이 벌어지고 있는지 기술 관련 최신 소식을 전달합니다. 펜타곤은 30만 달러를 들여 인공지능(AI) 기반 거짓말 감지기를 만들고 싶다. 미국 정부는 향상된 거짓말 감지기를 만드는 데 5년 동안 3억 3000만 달러를 들이고 싶다. 펜타곤은 2025년부터 2030년까지 5년 동안 3억 3000만 달러를

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.