구글, 저작권 논란에 휩싸인다... 대규모 언어 모델(LLM) 훈련 논문 저작권 침해 소송
구글은 대규모 언어 모델(LLM) 훈련에 사용된 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주요 출판사들의 소송에 직면했다. Hachette, Cengage, Elsevier 등이 소송을 제기했다.
구글, 대규모 언어 모델(LLM) 훈련 논문 저작권 침해 소송에 직면
구글은 대규모 언어 모델(LLM) 훈련에 사용된 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주요 출판사들의 소송에 직면했다. Hachette, Cengage, Elsevier 등이 소송을 제기했다.
대규모 언어 모델(LLM)은 훈련 데이터의 크기가 매우 큰 자연어 처리 모델로, 훈련 데이터의 1%만이 사람들의 눈에 띄는 데이터라고 한다. 이 모델은 훈련 데이터를 기반으로 언어의 패턴을 학습하고, 새로운 텍스트를 생성하거나 자연어 처리를 수행한다.
- 소송은 Google이 대규모 언어 모델(LLM)을 훈련하기 위해 사용한 텍스트 데이터에 대한 저작권이 있는 저작물에 대한 허가 없이 훈련했다는 주장이다.
- 소송을 제기한 출판사들은 Google이 훈련 데이터에 포함된 저작권이 있는 저작물에 대한 저작권을 침해했다고 주장한다.
- Google은 아직 소송에 대한 공식적인 입장을 발표하지 않았다.
이 소송은 Google이 대규모 언어 모델(LLM)을 훈련하기 위해 사용한 훈련 데이터의 저작권 문제를 고려했는지 여부를 보여준다. 훈련 데이터의 저작권 문제는 AI 개발의 중요한 문제 중 하나로, 훈련 데이터의 저작권이 있는 저작물에 대한 허가 없이 훈련하면 저작권 침해가 발생할 수 있다.
소송의 결과는 AI 개발의 방향을 결정할 수 있다. 훈련 데이터의 저작권 문제를 해결하지 않으면, AI 개발은 저작권 침해로 이어질 수 있다.
함께 읽으면 좋은 기사
오픈아이 에이전트가 UN 웹사이트를 '강제로' 스캔하다
오픈아이 에이전트가 UN 통상개발회의 통계 사이트를 16,000번 이상 방문하여 데이터를 수집한 사실이 밝혀졌습니다. 이 사건은 AI의 위험성을 다시 한번 제기합니다.
정신 건강 벤치마크 소개: MentalHealthBench
MentalHealthBench는 실제적인 정신 건강 대화에서 안전하고 도움이 되는 AI 응답을 평가하기 위한 전문가가 제공하는 벤치마크입니다. AI 모델이 정신 건강 관련 대화에서 안전하고 도움이 되는지 평가할 수 있도록 도와줍니다.
펜타곤의 AI를 이용한 거짓말 감지기와 청소년의 장기 제한
오늘의 이메일 뉴스레터 '더 다운로드'는 주말에 출간되는 주간 뉴스레터를 통해 주간에 무슨 일이 벌어지고 있는지 기술 관련 최신 소식을 전달합니다. 펜타곤은 30만 달러를 들여 인공지능(AI) 기반 거짓말 감지기를 만들고 싶다. 미국 정부는 향상된 거짓말 감지기를 만드는 데 5년 동안 3억 3000만 달러를 들이고 싶다. 펜타곤은 2025년부터 2030년까지 5년 동안 3억 3000만 달러를
펜타곤, 30억 달러로 AI-powered 거짓말 탐지기 개발
펜타곤은 향후 5년 동안 거짓말 탐지기를 개선하기 위해 30억 달러를 투자할 계획입니다. 이 프로그램은 인공 지능과 머신 러닝을 사용하는 점수 알고리즘 및 거리감 센싱 기법을 개발할 것입니다. 이 기술은 군대와 국가 안보에 큰 영향을 미칠 것입니다.
Nvidia가 개발자에게 게임 최적화 도움을 줄 AI 챗봇 특허를 받다
Nvidia는 게임 최적화에 도움을 줄 수 있는 새로운 챗봇을 개발 중인 것으로 나타났습니다. 이 챗봇은 개발자가 게임 최적화에 필요한 지침을 받을 수 있도록 도와줄 것입니다. 이 챗봇은 게임 개발자들에게 게임 최적화에 대한 지식을 제공하여 게임의 성능을 향상시킬 것입니다.
미국 상장 이전, 영국의 인공지능 기업 네오클라우드(Nscale)가 변환가능자금 3.36조 원에 투자유치
세인트 포인트, 엔비디아 등이 지원하는 자금은 대규모 AI 데이터 센터 구축을 지원하기 위해 사용될 예정입니다.
관련 콘텐츠 더 보기
다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.