시각성 겹침: 방향성 기원 내 개중량 모델 계통
가중치가 공개된 모델은 종종 최적화, 정렬, 병합, 다시 공개되는 과정을 거치게 되며, 모델의 기원에 대한 감사는 단순히 체크포인트가 관련되어 있는지 여부를 확인하는 것만이 아닌, 체크포인트 중 누가 먼저 만들어졌는지 또한 확인해야 하는 상황이 발생합니다. 현재까지 존재하는 모델 기원에 대한 방법들은 주로 기존에 알려진 모델을 대상으로 하는 감사 설정에 설계되어 있으며, 주어진 모델 중 한 모델을 사고 모델이라고 가정하고, 다른 모델이 사고 모델과 관련되어 있는지 여부를 테스트하는 방식으로 진행됩니다. 이러한 감사는 출처에서 의심되는 모델까지의 테스트로 프레임워크가 정의되지만, 실제로 이러한 증거는 종종 대칭적이며, 표현 유사성, 가중치 유사성, 행위적 인프린트, 또는 상관 통계에 의존합니다. 대칭적 pair-wise 비교는 관련성에 대해 감지할 수 있지만, 체크포인트 A와 B 사이의 관계의 방향을 알 수는 없습니다. 따라서 우리는 지역적인 기하학적 비교를 제시합니다: 두 체크포인트를 직접 비교하는 것이 아닌, 같은 패밀리 내에 있는 세 번째 체크포인트를 witness로 추가하고, 각 후보 엔드포인트 주변의 기하학을 비교하는 것입니다. 방향은 후보 중 어느 하나가 branching 부모와 더 유사한지를 묻는 것으로 결정됩니다. 이러한 아이디어에 의해 мот리브되고, empirical 관찰된 parent-anchored 및 child-anchored witness-overlap 분포 간의 비대칭성에 의해 Motivated, 우리는 Witness Overlap, prompt-free, training-free white-box test를 제안합니다. 16개의 패밀리에서 176개의 LLM 체크포인트를 대상으로 한 one-witness test는 Frobenius cosine를 사용하여 95.3%의 정확도로 parent-child 관계를 정렬할 수 있습니다. 우리는 furthermore, root identification, sibling discrimination, VLM 및 diffusion 패밀리의 일반화, 그리고 chain-structured ordering에 대한 평가를 수행했습니다. signal은 가중치 노이즈 및 희소 제거에 대한 robustness를 보여주며, proposed SVD weight reduction variant는 Frobenius cosine보다 더 robust한 robustness를 보여줍니다.
함께 읽으면 좋은 기사
AI를 자산으로, 비용으로만 볼 것인가
고객들이 AI 비용에 대해 이야기할 때, 대화는 보통 토큰 가격으로 시작하고 cloud에서 가장 강력한 모델에 접근할 수 있는지에 대해 끝나곤 합니다. 그들이 항상 그 정도의 능력 필요하다는 건 항상 그렇지는 않습니다. 하지만 그 정도로 대화가 진행되곤 합니다. AI는 실험에서 생산으로 옮겨갈 때, 모델 선택은...
AI가 과학적 발견을 하는 시점은 언제인가?
AI 기술 회사인 Anthropic은 대규모 언어 모델(Claude agents)을 통해 생물학 문제를 해결하고자 하는 연구를 진행 중입니다. 연구 결과, AI가 과학적 발견을 하는 시점에 대해 궁금해하시는 분들을 위해 자세한 내용을 소개합니다.
플로리다 주의
플로리다 주 법무장관은 OpenAI를 상대로
LLM이 문맥을 이해할 수 있는가? 지식 그래프 기반 평가 프레임워크
대규모 언어 모델(LLMs)가 언어 능력에 대해 놀라운 성과를 보인 것은 사실이지만, 그 모델의 심장에 깊이 있는 질문 하나가 남아 있다: 이러한 모델들이 정말로 문맥을 이해하거나 단순히 무려 대규모 패턴 매칭에만 능통한 것일까? 대규모 언어 모델에서 문맥 이해는 주어진 문맥에서 관련 정보를 정확하게 추출하고, 그것을 일관된 내부 표현으로 통합하고, 그 문맥을 바탕으로 사실적이고 문맥적으로
링그의 AI-agent가 OpenAI를 통해 고객 문의의 65% 이상을 해결합니다.
Ringg는 GPT-5.6을 사용하여 음성, 채팅, WhatsApp, 웹 등 다국어 에이전트를 90% 비용이 덜 들이는 GPT-4.1보다 운영합니다.
인비디오, GPT-6 Astra를 통해 3배 향상된 컬러 그레이딩
인비디오는 GPT-6 Astra를 통해 편집 계획을 더 정확하게 짤 수 있으며, 컬러 교정과 그레이딩을 3배 향상시켰습니다. 또한 1일 동안 50개의 커스텀 효과를 생성할 수 있습니다. 대규모 언어 모델(LLM) 기술을 활용하여 컬러 그레이딩을 개선하는 방안에 대해 알아보겠습니다.
관련 콘텐츠 더 보기
다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.