본문으로 건너뛰기

검색

전체 기사

연구 4월 7일

TRACE-KG: 복잡한 문서에서 문맥을 zengin한 지식 그래프를 만드는 새로운 방법

지식 그래프 생성은 일반적으로 정의된 온톨로지나 스키마-free 추출에 의존합니다. 온톨로지 기반 파이프라인은 일관된 타입을 강제하지만 비용이 많이 들고 유지보수가 필요하며, 스키마-free 방법은 긴 기술 문서에 있는 밀도 높은 문맥 의존 정보에서 약한 전역 조직을 생산합니다. TRACE-KG를 제안하며, 이는 정의된 온톨로지 없이 문맥을 zengin한 지식 그래프와 유도된 스키마를 동시에 생성하는 다중 모드 프레임워크입니다.

LLM PC 4월 7일

컨텍스트 제어를 위한 새로운 접근: 공유 반복 상태의 개입

컨텍스트에 의존하는 시퀀셜 디시전 메이킹을 위해, 기존의 방법은 컨텍스트를 직접 입력하거나 반복 메모리를 증가시키는 두 가지 방법을 사용합니다. 하지만 우리는 공유 반복 상태에 대한 개입을 통해 컨텍스트에 의존성을 실현할 수 있는 새로운 방법을 제안합니다. 이 방법은 반복 코어가 공유 전 개입 상태를 생성하고, 컨텍스트가 추가적인, 컨텍스트 인덱스된 연산자로 작용하는 개입 기반 반복 아키텍처를 사용합니다. 이 아이디어를 부분 관찰 가능성의 컨텍스트 스위칭 시퀀셜 디시전 태스크에 적용하여, 서로 다른 모델 가족을 비교합니다.

연구 4월 7일

표준화된 표 질문 답변을 위한 멀티모달 사고 최적화: TABQAWORLD

멀티모달 사고를 이용한 표 질문 답변을 위한 새로운 프레임워크인 TABQAWORLD을 소개합니다. 이 프레임워크는 표의 상태를 읽어내는 데 있어 텍스트 serialize의 오류를 줄이며, inference compute와 cost를 줄입니다. TABQAWORLD은 표의 동작을 jointly optimize하는 프레임워크로, representation과 estimation을 동시에 최적화합니다.

연구 4월 7일

허블의 인과 판단 조건: 베이즈 형식화가 추상화한 것

허블의 인과 판단 체계는 세 가지 대표적 조건을 필요로 한다. 경험적 기반, 구조화된 검색, 생기 전달. 이 연구는 허블의 텍스트에서 이 조건을 추출하고 인과 심리학의 핵심 요소로 이를 주장한다. 후속 프레임워크인 베이즈 확률론과 예측 처리까지의 형식화 경로를 따라 이 조건의 운명을 추적한다. 대규모 언어 모델(LLM)은 통계적 업데이트를 수행하는 반면 세 가지 조건을 만족하지 못하는 것으로 나타나, 이전에 배경 조건으로 간주되었던 허블의 프레임워크의 요구 사항을 드러내게 한다.

AI 모델 4월 7일

위성 판독기: 의료 영상 판독기 평가를 위한 신뢰할 수 있는 LLM 심판

의료 영상 판독기 평가에 대한 최근 연구는 주로 LLM 기반 지표를 설계하고 작은 모델을 사용하여 흉부 X-ray에 초점을 맞추었습니다. 그러나 다른 모달리티와 해부학에 대한 이러한 접근법이 robust한지 여부는 아직 명확하지 않습니다. LLM 심판을 위한 가장 적합한 모델과 명령어 구성은 무엇인지 확인하고자 합니다. 우리는 전문가와 LLM 기반 평가 간의 강한 상관 분석을 수행합니다. 우리는 existing LLM-as-a-judge 지표 (RadFact, GREEN, FineRadScore)와 VERT, 제안된 LLM 기반 지표를 비교합니다. VERT는 open-와 closed-source 모델 (사유와 비사유)과 다양한 크기를 가진 2개의 전문가 기반 데이터 세트 (RadEval, RaTE-Eval)에서 여러 모달리티와 해부학을 다룹니다. 우리는 RaTE-Eval에서 few-shot 접근 방식, ensembling, 및 parameter-efficient fine-tuning을 평가합니다. 지표의 행동을 더 잘 이해하기 위해, 우리는 시스템 에러 검출 및 분류 연구를 수행하여 expert 판단과 지표의 정합성을 평가하고 낮은 및 높은 정합성 영역을 식별합니다. 결과는 GREEN에 비해 VERT가 11.7%까지의 상관관계를 향상시킨다는 것을 보여줍니다. 또한 Qwen3 30B를 1,300개의 훈련 샘플만 사용하여 25%까지의 성능 향상을 달성할 수 있습니다. 또한 fine-tuned 모델은 37.2배까지의 inference 시간을 줄일 수 있습니다. 이러한 결과는 LLM 기반 심판의 효과성을 강조하고 가벼운 적응으로 신뢰할 수 있는 평가를 달성할 수 있음을 보여줍니다.

에이전트 4월 7일

돌을 던지듯 6마리의 새가 날아가다: 에이전트와 에이전트십에 대한 고찰

대규모 언어 모델(LLM)에서 대규모 물체를 유도 폐쇄로 대신 다루는 '여섯 새 이론'에 기반하여 에이전트십을 설명하는 새로운 접근법을 제시합니다. 에이전트십에 대한 경험적 토론은 지속성(물체로서 존재)과 제어(역추론 차이)를 혼동하여 에이전트십 주장의 테스트와 위조를 용이하게 합니다. 이 연구에서는 에이전트십을 '여섯 새 이론'에 기반하여 구체적으로 설명합니다.

연구 4월 7일

최소 집합 덮개 문제의 구조적 분할: 유니버스 분해성을 이용한 메타 헷위스트 최적화

최소 집합 덮개 문제는 과학 및 공학 분야에서 광범위하게 적용되는 NP-Hard 조합 최적화 문제입니다. 하지만 대부분의 방법은 유니버스 내의 잠재적인 내재적 구조적 특성을 무시하고, 유니버스를 단일 구조로 다룹니다. 이 COMPUTER SCIENCE 논문에서는 유니버스 분할 가능성(UNIVERSE SEGMENTABILITY) 개념을 조사하고, 내재적 구조적 분해를 이용한 헷위스트 최적화 방법을 제안합니다. 분할 된 서브 문제를 GRASP 메타 헷위스트로 해결하고, 부분적인 해결책을 조합하여 합리성을 유지합니다. 표준 벤치마크 인스턴스 및 대규모 시뮬레이션 데이터셋에 대한 실험 결과, 자연적인 유니버스 분할을 이용한 방법이 해의 품질과 확장성을 향상시킵니다.