본문으로 건너뛰기

컨텍스트 리랭킹과 삭감을 위한 협력 게임 관점의 셰플리 컨텍스트 삭감

AI 자동 생성

modern Retrieval-Augmented Generation(RAG) 시스템의 효율성을 향상시키기 위해 Context reranking과 pruning은 필수적이 되면서도 해석 가능한 통합 프레임워크는 여전히 탐구되지 않은 상태이다. 이전 연구는 주로 어휘 검색, 크로스 인코더 아키텍처, 모델 학습 distillation, Low-Rank Adaptation(LoRA) 등에 중점을 두었고, 대부분의 경우 가정에 기반한 손실 함수와 경험적 attribution을 사용했다. 이 논문은 Shapley Context Pruning(SCP) framework를 제시하는데, 이는 중요도 attribution을 위해 컨텍스트를 협력 게임으로 모델링하는 협력 게임 이론의 관점을 Establish하여 Context reranking을 위한 새로운 프레임워크를 제시한다. fine-grained과 coarse-grained 표현의 균형을 맞추기 위해, 우리는 Deep Sets architecture를 사용하여 문장 수준에서 순열 불변값 함수를 근사하고, pre-trained language models를 문장 embedder로 사용하여 pair-wise margin ranking loss를 최적화한다. 실용적인 확장성을 보장하면서 수학적 엄격성을 희생하지 않기 위해, 우리는 Monte-Carlo sampling을 사용하여 효율적인 훈련과 추론을 제공하고, Top-K subset ranking을 보존하기 위한 공식적인 이론적 오차한계와 샘플 복잡도 보장을 제공한다. 또한, 우리는 comprehensive 실험을 수행하는데, supporting-sentence recall, Needle-in-the-Haystack(NIAH) 평가, long-context QA, multi-hop reasoning을 포함하여 embedding quality와 attribution strategy에 대한 rigorous ablation studies를 수행한다. 모델은 robust baseline에 대한 competitive downstream QA 성능을 달성한다.

원문 보기 arXiv AI

함께 읽으면 좋은 기사

AI 모델 23시간 전

소니와 유니버설 뮤직 그룹이 다시 소니우에 법적 조치 시행

소니(Sony)와 유니버설 뮤직 그룹(Universal Music Group)은 다시 한 번 선오(Suno)와 법적 분쟁을 제기했습니다. 소니와 유니버설 뮤직 그룹은 새로운 모델 v6가 이전 모델의 사용자 출력을 기반으로 학습했는데, 이전 모델은 유튜브(Youtube)와 같은 출처에서 불법적으로 음악을 훔치고 학습한 것이란 이유로 저작권 침해를 주장합니다. 소니와 유니버설 뮤직 그룹은 유니버

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.