LLM의 심리학적 측정 재평가: 자가 보고가 행동을 예측할 때 그리고 왜
대규모 언어 모델(LLM)의 행동 경향을 저렴한 심리학적 프로브로 예측하는 것은 안전한 배포를 위해 중요하지만, 자가 보고(self-report, SR)가 행동을 신뢰롭게 예측해야만 한다. 최근 연구에서 대규모 언어 모델의 SR-행동 분리 현상을 문서화했지만, 이에 근거한 것은 인간에서 특정 행동을 예측하는 데 약한 broaden 특성(broad personality traits)인 '5대