본문으로 건너뛰기

선호도에 대한 임베딩, 의미에 대한 임베딩이 아님

AI 자동 생성

현재 AI 기술은 참여자가 고정된 후보에 대한 투표 대신 자유 형식의 텍스트로 의견을 표명하는 집단 의사 결정을 열어주고 있다. 이러한 의견을 벡터 공간에 임베딩하는 자연스러운 아이디어는, 시설 위치 문제와 공정 클러스터링과 관련된 대규모 언어 모델(LLM) 기존 문맥에 이론을 적용할 수 있게 해준다. 그러나 표준 텍스트 임베딩은 의미 유사성을 측정하며, 시설 위치 문제와 공정 클러스터링에서는 '선호도 유사성'이 필요하다. 이는 참여자가 텍스트와 얼마나 згод인지가 거리와 반비례해야 한다는 것을 의미한다. 주요 임베딩은 의미 유사성과 선호도 유사성 사이의 상관관계를 통해 coarse 선호도 신호를 물려받지만, 상관관계가 깨지면 선호도를 포착하지 못한다. 우리는 이 문제를 안정성 문제로 공식화한다. 텍스트 임베딩 모델은 선호도 관련 신호(stance와 values)와 의미적인 방해(style과 wording)를 모두 포함하며, 두 신호는 관찰적으로 상관관계가 있기 때문에 방해에 의존하는 기하학은 방해가 아니더라도 선호도에 맞는 것으로 보일 수 있다. 우리는 이 상관관계를 깨는 합성 훈련 데이터를 설계하여, 방해에 지배된 코사인과.significantly 선호도 예측을 향상시키는 최적 스코어러를 증명한다.

원문 보기 arXiv AI

함께 읽으면 좋은 기사

연구 3일 전

스트로크 위험도 예측을 위한 새로운 AI 기술: MedGate-Fusion

스트로크 위험도를 예측하는 것은 원치 않는 병력이 발생하기 전에 중요한 역할을 합니다. 그러나 이 과제는 의사들이 주기적으로 기록하는 생리학적 바이오마커와 비구조적인 의료 기록의 사이에 분산되어 있는 초기 위험 신호를 식별하는 어려움으로 인해 힘들어집니다. MedGate-Fusion은 이러한 문제를 해결하기 위해 처음 만나는 의료 기록의 의미론적 이야기와 10개의 정기적으로 기록된 위험 표시자를 통합하는 멀티 모달 게이트 아키텍처를 제안합니다. 이 아키텍처는 대규모 언어 모델(LLM)과 같은 기존의 AI 기술을 사용하여 의료 기록의 의미를 추출하고 생리학적 바이오마커의 정보를 통합하여 스트로크 위험도를 예측합니다.

연구 3일 전

기존의 전제 조건자들이 생의학 표준 표 데이터 학습을 개선하는가? 표준 표 데이터 학습 최적화에 대한 실증 연구

최근 구조화된 생물학적 데이터 분석에 있어서 표준화된 기초 모델(tabular foundation model)이 강력한 잠재력을 보인다. 그 중 하나인 TabPFN은 낮은 데이터 표준화 분류 작업에서 효과적인 접근 방식으로 나타났지만, 최적화 및 조건화 전략의 생물학적 세부 튜닝에 대한 영향은 여전히 크게 연구되지 않았다. 본 연구에서, 우리는 59 개의 생물학적 데이터셋(Alzheimer'

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.