본문으로 건너뛰기

#arXiv

1187개의 기사

에이전트 4월 8일

순수한 CSI를 사용하지 않는 계층적 다중 에이전트强화 학습을 위한 재구성 가능한 반사기 학습

다중 에이전트 강화 학습을 이용한 계층적 CSI-free 네트워크 구축 다중파 초고주파 네트워크를 위한 지능형 라디오 환경 구축을 위한 반사면의 재구성 가능성은 큰 잠재력을 가지고 있다. 그러나 채널 상태 정보(CSI) 추정의 막대한 계산 부하와 중앙 집중식 최적화의 내재된 차원 폭발은 실용적인 대규모 배포를 막고 있다. 이러한 막대한 부하를 극복하기 위해, 우리는 계층적 다중 에이전트 강화 학습(HMARL) 아키텍처를 이용하여 기계적으로 재구성 가능한 반사면을 제어하는 CSI-free 패러다임

에이전트 4월 8일

컴퓨터 사용 에이전트를 위한 의도-조건에 의한 행동 평가 시스템

컴퓨터 사용 에이전트를 위한 의도-조건에 의한 행동 평가 시스템(arXiv:2604.05157v1) 컴퓨터 사용 에이전트(CUAs)는 대규모 언어 모델을 사용하여 데스크톱 환경에서 GUI 연산을 수행하지만, 행동의 품질을 평가하지 않고 행동을 생성하는 결과로, 이후의 단계에서 불가피한 오류가 연쇄적으로 발생한다. 우리는 IntentScore라는 목적에 대한 계획에 대한 보상 모델을 제안한다. IntentScore는 3대 운영 체제를 포괄하는 398K개의 오프라인 GUI 상호 작용 단계를 기반

에이전트 4월 8일

자동화된 AI 연구 논문 작성을 위한 다중 에이전트 프레임워크: PaperOrchestra

자동화된 AI 연구 논문 작성을 위한 다중 에이전트 프레임워크: PaperOrchestra 논문 작성을 위한 연구 자료를 구조화된 문헌으로 변환하는 것은 AI를 이용한 과학적 발견의 중요한 과제 중 하나이다. 기존의 자율적인 작가는 특정 실험 파이프라인에 강하게 결합되어 있으며, 표면적인 문헌 검토만 수행한다. PaperOrchestra라는 다중 에이전트 프레임워크를 소개한다. 이 프레임워크는 논문 작성을 위한 자유로운 자료를 대량의 LaTeX 문헌으로 변환할 수 있으며, 문헌 검토 및 시각화(

에이전트 4월 8일

순차적 메타인지 판단에서 작동적 비가환성

순차적 메타인지 판단에서 작동적 비가환성 메타인지란 내 자신의认知 과정을 모니터링하고 조절하는 것을 의미한다. 이는 내부 상태를 평가하고 업데이트한 후, 수정된 기준으로 다시 평가하는 순차적인 과정을 포함한다. 인식에서 순차적 효과는 잘 문서화되어 있지만, 이러한 효과가 고전적인 상태 변화나 더 깊은 구조적 비가환성을 나타내는지 여부는 불분명하다. 우리는 이러한 구별을 명확히 하기 위해 작동적 프레임워크를 개발한다. 우리의 형식화에서 메타인지 평가는 내부 상태 공간에 대한 확률적 읽아웃을 통해

AI 모델 4월 8일

네바야-녀야 사상에 기반한 지식적 사유를 위한 대형 언어 모델의 미세 조정: 프라마나

네바야-녀야 사상에 기반한 지식적 사유를 위한 대형 언어 모델의 미세 조정: 프라마나 대규모 언어 모델(LLM)은 유창한 텍스트를 생성하지만 체계적인 사유에 어려움을 겪으며, 종종 자신감 있지만 근거 없는 주장을 내세운다. 애플 연구원들은 수학 문제에 불필요한 문맥을 추가했을 때 LLM의 성능이 65% 감소했다. 부식된 패턴 매칭이 명백한 사유 아래에 있는 것으로 드러났다. 이러한 지식적 격차, 증거에 대한 추적 가능한 근거를 바탕으로 주장을 지지할 수 없는 제한이 AI의 신뢰성을 제한한다. 우

인기 태그