다양한 문서에서 지식 그래프 생성을 위한 ontology-_guided, deduplication-aware extraction layer
대규모 언어 모델(LLM)은 구조화되지 않은 문서에서 엔티티와 관계를 꾸준히 추출하지만 불일치가 발생한다: 문서 간 유형의 어휘가 분열되어 있다, 동일한 사람의 이름이 여러 버전으로 나타난다, 관계가 중복되어 있으며 이름을 공유하는 개별 인물은 침묵적인 혼동의 위험이 있다. 이 논문은 프로덕션 추출層을 설계, 구현, 그리고 경험적 정교화를 통해 실시간 문서 스트림을 형식적 온톨로지와 일치하는