본문으로 건너뛰기

#arXiv

1186개의 기사

에이전트 6월 11일

금융 및 수치 연산 reasoning을 위한 Market-of-Claims Code Agent: MoCA-Agent

금융 및 표 형식 질문에 대한 답변은 유창한 논리만으로는 충분하지 않다. 답변은 정확한 사실, 공식, 단위, 부호 및 척도를 기반으로 하여야 한다. 단일 잘못된 행 또는 잘못된 연산이 조용히 합리적인 하지만 오류인 결과를 생성할 수 있다. 우리는 \textsc{MOCA-Agent}라는 시장의 요구 사항에 따라 코드 에이전트를 소개한다. 이 시스템은 자유 형식의 다중 에이전트 토론을 claim

에이전트 6월 11일

장기 연구 요원에 대한 학문적 탐구의 영역

연구 자동화.agent가 이제 과학적 후보자를 평가하고 선택할 수 있으며, 그 평가 기준은 일반적으로 지역, 슬라이스 또는 집단의 다각화된 공간에서 합산된 값입니다. 하지만 과학적 유효성이 이러한 분산 구조에 존재할 경우, 합산된 값은 잘못된 후보자를 최우선 순위로 매길 수 있습니다. 헤드라인 숫자가 향상되면서 구조 underneath가 뒤집히기 때문에, 숫자에 기반하여 결정한 경우에는 qu

LLM PC 6월 11일

미래 행동 예측을 학습 과제로 보다

인공지능 시스템에 대한 신뢰는 시스템이 어떻게 작동하는지 설명을 통해 종종 기반을 두고, 설명을 통해 새로운 입력에 대한 시스템의 행동을 예측한다. 그러나 대규모 추론 모델(LLM)에서 이 전통적인 경로는 특히 추론 단위 하나의 생성에 대한 설명 방법이 자연스럽게 장거리 경로로 일반화되지 않으며, 경로 자체가 자연어로 읽히면 종종 신뢰할 수 없는 경우가 많다. 따라서 우리는 설명 단계를 생략

에이전트 6월 11일

인프라마인드: 인프라웨어 멀티 에이전트 오케스트레이션

인프라마인드는 현재의 멀티 에이전트 LLM 오케스트레이션 방법의 한계를 보완하는 새로운 프레임워크입니다. 인프라마인드는 실시간 시스템 부하와 남은 예산에 따라 모델과 역할 선택을 조건화하여 더 간단한 그래프를 부하가 심한 경우와 더 풍부한 그래프를 부하가 낮은 경우에 선택합니다. 또한, 인프라마인드는 각 에이전트 단계에서 모델별 큐 깊이, 캐시 사용률 및 응답 지연 시간을 관찰하여 어떤 모델을 호출하고 얼마나 깊게 논리를 reasoning 하여야 하는지 결정합니다.

에이전트 6월 11일

인간 협상 자동 매개자: 구조화된 LLM PIPE라인을 통해 협상 전 매개

인간 협상 이전에 발생하는 준비 단계인 미디어션(pre-mediation)은 양측이 공정한 합의를 달성하기 위한 중요한 역할을 하지만 비용, 시간, 전문 미디어터에 대한 접근 제한으로 인해 자주 누락된다. 우리는 직접 인간 협상 이전의 미디어션을 자동화하는 시스템을 제시한다. 이 시스템은 대규모 언어 모델(LLM) 모듈로 구성된 구조화된 pipe-line으로 구현되어, 통합 협상 환경에서 미

에이전트 6월 11일

자기 조절적 명확성 요청 시기 판단: 계층적 언어 agent를 위한 자기 조절적 명확성 요청

인공 지능이 계층적인 사고에서 실패를 겪을 때, 그 실패는 종종 중간에 결정점에서 발생하는데 그 이유는 agent가 잘못된 branch에 집착하는 것이고 그 이유는 agent가 중요한 정보가 부족하다는 것을 인식하지 못하기 때문이다. 그러한 clarify를 외부 불확실성 트리거로 다루기보다는, ACTION-RATING이라는 새로운 형식을 제안한다. 이 형식은 agent의 행동 공간 내에 cl

에이전트 6월 11일

인공지능.agent가 과학적 결론을 합성할 수 있나요?

과학적 인공지능(AI) agent는 증거를 검색하고, 출처를 통해 논리적으로 연결하고, 결과를 합성하여 중요한 결정을 내리는 데 점점 더 많이 사용되고 있습니다. 그러나 의료 분야와 같은 높은 책임의 영역에서 이를 수행할 수 있는 능력은 불분명합니다. 우리는 SciConBench라는 9.11K개의 질문과 전문가가 쓴 체계적 검토를 통해 얻은 결론을 사용하여 개방형 도메인 과학적 결론 합성을

AI 모델 6월 11일

AGI의 토대는 hippocampal 명시적 기억: 대규모 언어 모델(LLM)의 한계를 넘어

대규모 언어 모델(LLM)이 다양한 업무에서 놀라운 능력을 보여주면서 인공 일반 지능(AI) 개발에 대한 기대가 높아지고 있습니다. 하지만 LLM의 학습 메커니즘은 인간의 암묵적 기억과 매우 유사하며, 이는 AGI를 달성하기 위한 높은 계층적인认知 기능, 즉 장기 전략 계획, 메타인지, symbol reasoning을 암묵적 통계 학습만으로는 충분히 구현할 수 없다는 것을 의미합니다.

AI 모델 6월 11일

explicit한 요소에서 암시적 의도까지: 의사 결정 가능한 행동 추론을 위한 사전 정의 라이브러리

arXiv:2606.11207v1 발표 형식: 새로운 내용 SemantiClean을 소개합니다. 이 모듈식 프레임워크는 전자상거래 세션 데이터에서 구조화된 의미론적 신호를 추출하고 구매 의도, 고객 구분, 제품 친화도와 같은 플러그인 추론 목표를 위한 공유 요소 라이브러리를 통해 추론합니다. 전통적인 종단-종단 예측기가 오로지 정확도만 최적화하는 것과 달리, SemantiClean은 감사성,

AI 모델 6월 10일

자율학습 정책 최적화에 대한 시각 피드백을 통한 코드와 시각적 장치 연결

코드 생성하는 대규모 언어 모델(LLM)은 프로그램을 작성하여 비차분 렌더러에 의해 실행되는 차트, 웹 페이지, 슬라이드와 같은 시각적 아티팩트를 생성하는 경향이 있다. 렌더링 결과를 관찰하기 전에 코드를 작성하는 것은 시각적 아티팩트의 시각적 명료한 결함을 포함하는 실행 가능한 코드를 자주 생성한다. 이 결함에는 겹치는 요소, 잘려진 텍스트, 깨진 정렬, 낮은 CONTRAST,과 OVERF

에이전트 6월 10일

LLM으로 구동되는 동작과 운동학적 제약을 고려한 이동 이상 생성

인간의 이동 경로 이상은 공간 데이터 마이닝을 발전시키기 위해 매우 중요하지만, 실제 연구는 ground-truth 데이터 세트의 부족으로 심각하게 제한되고 있다. 여러 실용적인 및 시뮬레이션된 인간 이동 경로 집합이 존재한다고 하더라도, 이 데이터 세트들은 정상적인 이동 패턴만 캡처하고 이상을 주석으로 붙이지 않는다. 이러한 특정한 부족은 이상적인 사건의 통계적 희소성에 의해 직접적으로 유

에이전트 6월 10일

공간 기억이 저장해야 하는 것: 언어 agent의 기억 장소 시스템에 대한 가려짐 테스트

언어 agent의 '기억 장소' 시스템은 각 기억을 세계 좌표에 고정하여, 기하학이 텍스트 못하는 것이라고 가정합니다. 연구진은 이 가정을 테스트하고, 3개의 결과를 보고합니다. 첫 번째로, 공간 근접성을 선형 블렌드에 포함시키는 기억 장소의 기본 설정이 도움이 되지 않고, 오히려 나쁠 수 있습니다. 두 번째로, 기억 recall과 가시성이 분리되어야 합니다. 세 번째로, 가시성을 제공하는 지시선과 voxel digital differential analyzer(DDA)는 텍스트와 live FoV cone 모두 0.000점을 받았지만, cone-plus-DDA는 0.982점을 받았습니다.

AI 모델 6월 10일

context-aware에서 conflict-aware로: LLM의 지식 충돌에 대한 일반화된 대조적 디코딩

대규모 언어 모델(LLM)이 검색 또는 증강된 콘텍스트에서 생성할 때, 외부 콘텍스트와 파라미터 프리오리 간의 충돌이 신뢰성의 주요 약점으로 남아있다. 기존의 대조적 디코딩 방법은 \emph{context-aware} 패러다임을 따르며, 콘텍스트의 신뢰성을 가정하여 콘텍스트를 파라미터 프리오리 위에 우선시한다. 우리는 이에 대하여 \textbf{conflict-aware} 패러다임을 일반화시켜, 충돌 신호에 따라 프리오리와 콘텍스트 간의 권한을 동적으로 할당한다. 또한, affine combination의 결과로 얻은 \textbf{power family}의 \textbf{regime asymmetry}를 보여주며, 기존의 대조적 디코딩 방법은 이 패러다임의 일종으로, 대체로 추출에 의존한다.

에이전트 6월 10일

심2스케줄러: 자율 개방석면 스케줄링을 위한 시뮬레이터 지시 대규모 언어 모델 프레임워크

개방석면 스케줄링은 복잡한 지질학적 및 운영 제약 조건 하에서 경제적 수익을 최대화하는 중요한 과정입니다. 새로운 연구에서는 자율적 의사결정 요소로 작동하는 대규모 언어 모델을 사용하여 시뮬레이터를 이용한 스케줄링 프레임워크를 개발하였습니다. 이 프레임워크는 closed 환경에서 작동하며, 데이터 보안을 보장하는 zero-shot 방식으로 작동합니다.

AI 모델 6월 10일

SOTA 판정자들이 실제 인간의 사고와 싸우는 이유: RealMath-Eval

대규모 언어 모델(LLM)이 고등학생 수학 문제를 거의 완벽하게 해결하는 성과를 거두었지만, 실제 인간 학생들의 다양한 추론 과정을 평가하는 능력은 여전히 충분히 조사되지 않았다고 합니다. 이 차이를 메우기 위해 우리는 **RealMath-Eval**이라는 224 개의 실제 고등학교 시험 응답을 엄격하게 주석화한 벤치마크를 제시합니다. 초기 평가 결과에 따르면, thậm chí 최신의 대규모

에이전트 6월 10일

자기개선 루프: ActiveGraph에서 LongMemEval을 위한 Auditable, Held-Out-Gated 개선 루프

AI 시스템의 자기개선 루프를 신뢰하기 어렵습니다. 실패를 기록하고, 진단을 재연하고, 개선 또는 폐기 결정을 기록하는 데 어려움이 있습니다. 이 문제를 해결하기 위해 Event-Sourced Agent Runtime을 사용하여 제어된 개선 루프를 첫 번째급 워크플로우로 만듭니다. Regimes는 ActiveGraph에서 작동하는 자기개선 루프를 소개합니다. 이 루프는 실패한 평가를 진단하고, pipeline에서 개선점을 제안하고, 정적 검증, 샌드박스 실행, 인 샘플 평가 및 외 샘플 검증을 거쳐 개선점을 승인합니다.

AI 모델 6월 10일

최소주의 유전 알고리즘

유전 알고리즘(GP)은 두 가지 중요한 통찰력을 바탕으로 있습니다. 첫째, 어떤 학습 과제도 기본적으로 프로그램 유도 문제로 포기할 수 있으며, 목표는 상징적 계층적 모델을 구문 tree로 표현하는 것입니다. 둘째, 이 문제를 탐색 문제로 포기하고, 진화를 사용하여 원하는 모델을 찾습니다. GP이 제안된 이후, GP는 다양한 과제와 문제 영역에서 명예로운 결과를 냈습니다. 이 연구는 GP의

AI 모델 6월 10일

더 적은 맥락, 더 나은 agent: 장기 목표를 가진 도구 사용 LLM agent를 위한 효율적인 맥락 엔지니어링

대규모 언어 모델(LLM)이 기업 워크플로우에서 자율 제어하는 agent로 배치된 경우, 기업 시스템에서 TOOL RESPONSE가 verbose하다는 문제가 발생하여 Context Overflow, Stale-State Error, 고인식 비용이 발생하는 문제가 있다. Microsoft Dynamics 365 Finance and Operations를 사용한 자동 지출 항목화 작업에서 Mo

LLM PC 6월 10일

감각부터 결정을 내리는 과정: 다중 모드 LLM에서 청각과 시각 인식 정보 흐름

멀티모달 대규모 언어 모델(Multimodal Large Language Models, MLLMs)은 들을 수 있고 보이도록 만들 수 있지만, 실제로 음성과 시각적 신호가 어떻게 네트워크를 통해 답변을 형성하는지 알기 어렵습니다. 연구와 실세계 응용에서 그 역할이 점점 커지면서도, 음성과 시각적 토큰이 최종 예측에 어떤 영향을 미치는지에 대한 내부 경로가 아직까지도 잘 이해되지 않은 상태입니

AI 모델 6월 10일

인공지능 보조 최적화 하에 탐색적 반응성과 적응적 경직성

연구 논문 'arXiv:2606.10086v1'은 인공지능(AI) 보조 최적화 환경에서 탐색적 적응의 이론을 개발했습니다. 이 논문의 중심 주장은 AI 시스템의 장기적 적응 효과가 예측 지원과 탐색적 반응성의 상호 작용에 크게 의존한다는 것입니다. 이를 위해 이 연구에서는 지식 지형이 다양한 지역적으로 강화된 구성으로 특징지은 지적 및 institutional 시스템이 시간에 따라 진화하는

에이전트 6월 10일

배치 시점 메모리화(Deployment-Time Memorization) 기반의 기반 모델 agent

기반 모델 에이전트는 점점 더 오랜 기간 동안 사용자를 기억하며, 사용자와의 상호 작용을 통해 기억을 구현하는 대신 모델의 가중치를 위한 속성으로만 기억을 고려한다. 현재의 연구는 가중치 기반의 기억을 다루거나 고정된 메모리 설정을 감사하는 것에 초점을 맞추고 있지만, 사용자 개인화의 유용성, 추출 위험, 삭제 신뢰성을 함께 고려하는 방법은 아직 없다. 우리는 배포 시점에서의 기억을 연구하고

AI 모델 6월 10일

산업계 세계 모델

사업체들은 생산성을 높이고 비용을 줄이기 위해 제품과 서비스를 개선하는 데 AI를 활용하는 경우가 많습니다. 그러나 AI의 변혁적인 잠재력은 사전 정의된 작업을 자동화하는 것만큼이나 지능적인 시스템을 통해 고급 전략적 목표에 따라 사업을 계획하고 최적화하여 실행하는 데 있습니다. 이 논문은 사업 세계 모델(BWM, Business World Model)의 개념과 구조를 소개합니다. BWM은

인기 태그