본문으로 건너뛰기

#DeepSeek

29개의 기사

AI 모델 4월 24일

중국 DeepSeek, 1년 만에 미국 경쟁자들을 경쾌하게 뒤흔든 다음세대 AI 모델 V4 발표

중국 AI 기업 DeepSeek은 1년 만에 개발한 다음세대 AI 모델 V4를 공개했다. 이 모델은 미국의 경쟁자들인 Anthropic, Google, OpenAI의 폐쇄형 시스템과 경쟁할 수 있는 오픈 소스 모델로 개발되었다. DeepSeek은 V4가 이전 모델보다 크게 개선된 모델로, 코드 작성 능력에서 특히 큰 발전을 이루었다고 밝혔다.

AI 모델 4월 8일

네바야-녀야 사상에 기반한 지식적 사유를 위한 대형 언어 모델의 미세 조정: 프라마나

네바야-녀야 사상에 기반한 지식적 사유를 위한 대형 언어 모델의 미세 조정: 프라마나 대규모 언어 모델(LLM)은 유창한 텍스트를 생성하지만 체계적인 사유에 어려움을 겪으며, 종종 자신감 있지만 근거 없는 주장을 내세운다. 애플 연구원들은 수학 문제에 불필요한 문맥을 추가했을 때 LLM의 성능이 65% 감소했다. 부식된 패턴 매칭이 명백한 사유 아래에 있는 것으로 드러났다. 이러한 지식적 격차, 증거에 대한 추적 가능한 근거를 바탕으로 주장을 지지할 수 없는 제한이 AI의 신뢰성을 제한한다. 우

인기 태그