본문으로 건너뛰기

학습을 중단할 때는 언제 도움이 되는가? : 합리적 모델의 조기 종료에 대한 비용에 대한 연구

AI 자동 생성

이 논문은 [논리 언어 모델](https://ko.wikipedia.org/wiki/%EB%85%BC%EB%A6%BC_%EB%9D%BC%EB%84%A4%EC%96%B8_%EB%AA%A8%EB%8D%B8)에서 [종료 규칙](https://ko.wikipedia.org/wiki/%EC%A2%85%EB%A3%8C_%EA%B3%84%EC%B8%B5)을 학습하는 방법에 대해 연구합니다. 논문은 [LearnStop](https://arxiv.org/abs/2606.30852)이라는 이름의 [체크포인트](https://ko.wikipedia.org/wiki/%EC%B2%B4%ED%8F%AC%ED%8A%B8) 종료 규칙을 제시합니다. 이 규칙은 현재 [논리 언어 모델](https://ko.wikipedia.org/wiki/%EB%85%BC%EB%A6%BC_%EB%9D%BC%EB%84%A6%EC%96%B8_%EB%AA%A8%EB%8D%B8)의 [이미지](https://ko.wikipedia.org/wiki/%EC%9D%B8%EC%A6%9D)에서 짧은 답변을 추출하고, [답변의 자신감](https://ko.wikipedia.org/wiki/%EB%8B%B4%EB%B0%98_%EC%8B%A0%EC%A6%9D), [불확도](https://ko.wikipedia.org/wiki/%EB%B6%80%EC%8B%A0%EB%8F%84), [이미지 투표](https://ko.wikipedia.org/wiki/%EC%9D%B8%EC%A6%9D_%ED%88%AC%EB%B8%8C_%EC%9D%B8%EC%9E%90), [답변의 안정성](https://ko.wikipedia.org/wiki/%EB%8B%B4%EB%B0%98_%EC%95%85%EC%A7%80%EC%84%B1), [백트래킹 마커의 밀도](https://ko.wikipedia.org/wiki/%EB%B0%94%EC%9D%B8%ED%8A%B8%EB%9E%AC%ED%81%9C_%EB%A7%88%ED%81%90_%EC%97%B4%EC%A7%84_%EB%AA%A8%EB%8D%B8)와 같은 온라인 특징으로부터 [이미지의 정확성](https://ko.wikipedia.org/wiki/%EC%9D%B8%EC%A6%9D_%EC%A0%95%EC%A2%85%EC%A7%84)을 예측합니다. 논문은 18개의 [작업-모델](https://ko.wikipedia.org/wiki/%EC%9E%91%EB%AA%A8) 설정을 사용하여 [GSM8K](https://arxiv.org/abs/2003.00046), [MATH-500](https://arxiv.org/abs/2003.00046), [MMLU-Pro](https://arxiv.org/abs/2204.04035), [AIME-90](https://arxiv.org/abs/2003.00046), [GPQA](https://arxiv.org/abs/2003.00046), [Qwen3](https://arxiv.org/abs/2003.00046), [DeepSeek-R1](https://arxiv.org/abs/2003.00046)와 같은 [GPT-3](https://ko.wikipedia.org/wiki/GPT-3)와 같은 [대규모 언어 모델](https://ko.wikipedia.org/wiki/%EB%8C%80%EA%B3%84%EC%9C%BC_%EC%96%B8%EA%B5%BD_%EB%AA%A8%EB%8D%B8)들을 사용하여 [LearnStop](https://arxiv.org/abs/2606.30852)의 효과를 평가합니다. 논문은 [LearnStop](https://arxiv.org/abs/2606.30852)가 [GSM8K](https://arxiv.org/abs/2003.00046)와 같은 [자유 형식 수학](https://ko.wikipedia.org/wiki/%EC%9E%90%EB%A6%AC_%ED%98%95%ED%94%8C_%EC%88%98%ED%97%98)에서 [학습된 다중 특징 종료](https://ko.wikipedia.org/wiki/%EC%9E%90%EB%A6%AC%EC%9E%A0_%EB%8B%A4%EC%A4%91_%

원문 보기 arXiv AI

함께 읽으면 좋은 기사

AI 모델 1일 전

소니와 유니버설 뮤직 그룹이 다시 소니우에 법적 조치 시행

소니(Sony)와 유니버설 뮤직 그룹(Universal Music Group)은 다시 한 번 선오(Suno)와 법적 분쟁을 제기했습니다. 소니와 유니버설 뮤직 그룹은 새로운 모델 v6가 이전 모델의 사용자 출력을 기반으로 학습했는데, 이전 모델은 유튜브(Youtube)와 같은 출처에서 불법적으로 음악을 훔치고 학습한 것이란 이유로 저작권 침해를 주장합니다. 소니와 유니버설 뮤직 그룹은 유니버

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.