본문으로 건너뛰기

사회 동력 예측을 위한 적대적 보상 추정 기반 생성 학습 (GLARE: Generative Learning via Adversarial Reward Estimation For Social Dynamics Forecasting)

AI 자동 생성

회의 지속을 위해는 장기 다인 회의에서 agenda 추적, 발언자 역할, 참여자 의도 및 불일치 추적이 필요하다. 우리는 2,207 개의 실세계 회의와 24,794 개의 미래 지향적 쿼리에서 Meeting Dynamic Forecasting Benchmark(MDFB)를 소개한다. 회의 전면과 활성 질문이 주어졌을 때, 모델은 한 번의 호출로 가능성 있는 다중 회전 연속성을 생성한다. 우리는 유용성---질문 진행---과 인간 유사성---가능한 대화 흐름 및 역할 일관성---을 평가한다. 정확한 미래 재현이 요구되지 않는다. 또한 우리는 GLARE, 조건부 언어 생성을 위한 적대적 모방 학습의 적응형 버전을 제시한다. 판별기에서는 관찰된 연속성을 현재 배우자가 생성한 샘플들 위에 두고, 판별기 점수가 KL-정규화된 정책 보상을 제공한다. 현재 정책 음의에 대한 재학습은 보상 지형을 배우자가 진화하는 동안에 진화시킨다. GLARE는 유용성에서 평균 인간 평가 승률 0.66, 인간 유사성에서 평균 인간 평가 승률 0.70을 달성하며, SFT와 SPIN을 능가하는 반면에 관찰된 인간 연속성을 넘지 않는다. 또한 MDFB는 일반 용도의 모델을 비교하기 위한 사회적 추론 장을 제공하는 실세계 회의의 예시로도 사용된다.

원문 보기 arXiv AI

함께 읽으면 좋은 기사

AI 모델 23시간 전

소니와 유니버설 뮤직 그룹이 다시 소니우에 법적 조치 시행

소니(Sony)와 유니버설 뮤직 그룹(Universal Music Group)은 다시 한 번 선오(Suno)와 법적 분쟁을 제기했습니다. 소니와 유니버설 뮤직 그룹은 새로운 모델 v6가 이전 모델의 사용자 출력을 기반으로 학습했는데, 이전 모델은 유튜브(Youtube)와 같은 출처에서 불법적으로 음악을 훔치고 학습한 것이란 이유로 저작권 침해를 주장합니다. 소니와 유니버설 뮤직 그룹은 유니버

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.