본문으로 건너뛰기

#arXiv

1177개의 기사

AI 모델 8월 13일

일체형에서 모듈형으로 : 세그먼트 단위 자동 프롬프트 최적화

자동 프롬프트 최적화(Automatic Prompt Optimization, APO)는 프롬프트를 일괄적으로 수정하는 경향이 있어, 한 가지 성능이 향상되면 다른 성능이 저하될 수 있습니다. 우리는 SAPO라는 세그먼트 기반 APO 방법을 제시하고 있습니다. SAPO는 프롬프트를 역할, 문맥, 작업, 출력 형식으로 분해한 다음, 상위 5개와 하위 5개의 예제에 기반하여 대상 향상을 적용합니다

AI 모델 8월 13일

복제된 잠재 저장소의 내용 주소 읽기 : MaSRead

연구자들은 latent space에서 추론하는 독립 agent들이 텍스트 대신 계산된 상태를 key-value 캐시 프래그먼트로 공유할 수 있음을 발견했습니다. 이러한 프래그먼트는 conflict-free replicated data type에 의해 병합되며, 배달 순서나 복제 여부에 관계없이 수렴합니다. 그러나 encode 시점에 알려지지 않은 후속 질의로 인해 병합 캐시를 신뢰할 수 없습

에이전트 8월 13일

자동세계모델 벤치마크: 자율세계모델 연구를 위한 새로운 표준

세계 모델링은 현재 환경에 따라 다양한 아키텍처, 학습 목표 및 상태 표현이 상호 작용하는 복잡한 분야입니다. 이를 해결하기 위해 AI 코드 기반.agent가 자율적으로 연구할 수 있는 환경을 제공하는 새로운 벤치마크가 등장했습니다. 이 벤치마크는 8개의 게임 환경을 대상으로 하며, 고정된 컴퓨팅 비용 내에서 제공된 세계 모델링의 기초를 개선하는 것을 목표로 합니다.

에이전트 8월 13일

작고 저렴한 의사소통 모델링: 노트북에서 대형 LLM--agent 사회를 시뮬레이션하기

대규모 언어 모델(LLM) agent들의 사회를 시뮬레이션하는 것은 비용이 많이 들지만, 이러한 시뮬레이션에서 묻는 질문은 일반적으로 거시적인 차원에서 발생한다. 예를 들어, phase behavior, stylised facts, 그리고 agent들의 수 N에 따라 scaling하는 것들에 대한 질문이다. 이에 대한 해결책으로, 통계 물리학의 관찰을 방법으로 변환한다. 그 방법은 대규모 언

AI 모델 8월 13일

경로 플립 감지보다 손상 修復 여부를 판단하는 것이 더 어려운 문제: 대규모 언어 모델의 Quantized Mixture-of-Experts에서 Causal Route-Mediated 손상

대규모 언어 모델(LLM)에서 Top-k Mixture-of-Experts(MoE) 경로가 불연속적이기 때문에, 배포를 위한 숫자적인 간섭 - 4비트 KV 캐시 양자화 읽기와 보호된 BF16 게이트 - 토큰을 결정 경계를 넘어가는 방식으로 밀어내고 경로를 바꾸는 것을 유발한다. 이 연구는 새로운 손상 완화를 제안하지 않지만, 경로 매개 변수 손상에 대한 원인 관계적 도구, 경험적 발견, 그리고 감지한 한계 결과를 제공한다.

LLM PC 8월 13일

Bayesian 모델 칼리브레이션을 위한 문헌 정보를 기반으로 한 전역 분포 설계

Bayesian 기반의 프로세스 기반 모델의 감리 작업을 위해서는 각 모델의 매개변수에 대한 사전 분포가 필요하다. 많은 연구자들은 이 작업을 수행하기 위해 유니폼 사전 분포를 사용한다. 하지만 유니폼 사전 분포를 사용하는 이유는 이 작업을 수행하기 위한 도메인 지식과 통계 지식이 필요하고, 이를 통해 유의미한 사전 분포를 구축하는 데 시간이 많이 걸린다는 것이다. 우리는 Distribird

에이전트 8월 13일

다중 LLM agent 시스템의 협력적인 대화 결과를 위한 동적 조절

대규모 언어 모델(LLM) 간의 상호 작용에서 구조적으로 반대되는 목표를 가진 두 대규모 언어 모델 agent가 여러 차례 상호 작용할 때, 공통 목표 함수의 부재는 경쟁보다는 붕괴로 이어진다: 방문자는 항복하고, 사이트 agent는 접근 방식을 변화시키지 않고, 대화는 두 agent의 선언된 목표를 달성하지 못한 채 종료된다. 이 논문은 공통 목표 함수가 부족한 경우 대체할 수 있는 통제

에이전트 8월 12일

LLM agent가 협상할 때: 공급망에서 동적 협상과 개인 정보 보호

LLM agent가 의사결정 지원에서 자율 구매로 전환할 때, 기업은 위임된 협상자들이 가치를 창출하고 예측할 수 있게 하는지, 그리고 손실이 나는 계약을 피할 수 있는지 알 필요가 있습니다. 우리는 이 문제를 canonical supply chain bargaining 문제에서 연구했습니다: 구매자가 판매자와 quantity-payment 계약을 맺기 위해 협상을 합니다. 구매자는 판매자가

에이전트 8월 12일

능력 기반 의사결정 AI 시스템에서 동적 동맹 형성과 의사소통 가격 설정

현대적 인지 AI 시스템은 다양한 언어 모델 agent를 조합하여 무기한으로 다양한 능력을 갖추고 있지만, 대부분의 아키텍처는 통신을 미리 결정하거나 전체 방송을 허용합니다. 두 가지 모두는 활성 agent의 수와 통신 링크의 수에 따라 토큰 비용, 지연 시간,冗余성, 오류 확산이 증가하는 등 효율성이 떨어질 수 있습니다. 우리는 agent 선택과 통신을 작업에 조건된 네트워크 유틸리티 $U

AI 모델 8월 12일

미래를 식별하는 것: 깊은 강화학습의 앞서 보는 설명

강화 학습(DRL) agent는 복잡한 환경에서 강한 성능을 달성하지만, 그 결정 프로세스는 여전히 이해하기 어렵다. 우리는 SPOT(Sampling Policy Observation Tree, 샘플링 정책 관찰 Tree)이라고 하는 모델-무관적이고 샘플링 기반 프레임워크를 소개한다. 정책과 환경 시뮬레이터에 접근할 경우, SPOT는 행동을 샘플링하고 결과하는 후손 상태를 재귀적으로 시뮬레이

AI 모델 8월 12일

디지털 농업을 위한 클로즈드-루프 LLM 공동 조종기

이 연구에서는 대규모 언어 모델(LLMs)을 복잡한 생물학적 시스템에 적용하여 데이터 분석에서 자율 AI로의 실험을 진화시켰다. 이 프레임워크는 49 채널의 식물 센서 네트워크의 데이터를 기반으로 하며, 다중 스펙트럼, 전기화학적, 및 이온화 모드 등 다양한 모드를 포함한다. 시스템의 실시간 자연 언어 해석 기능을 통해 전문가와 비전문가 모두에게 접근성을 높였다. 그러나 시스템의 핵심 장점은

AI 모델 8월 11일

자연어를 SHACL로 번역하는 벤치마크套件

arXiv:2608.07530v1 발표 유형: 새로운 초록: SHACL은 RDF 지식 그래프(RDF KGs)의 충족성을 검증하는 핵심 기술입니다. 그러나 SHACL 형태를 만드는 것은 대부분의 전문가가 가지고 있지 않은 기술적 전문성을 요구합니다. 자연어 요구 사항을 SHACL로 번역하는 자연어 2 SHACL(NL2SHACL)는 이 장벽을 낮출 수 있습니다. 그러나 NL2SHACL에 대한 전

AI 모델 8월 11일

확신과 실수 간의 격차: 탐사들이 놓치는 오류를 발견하는 경우

arXiv:2608.07528v1 발표 형식: 새로운 논문 요약: 선형 탐침은 자연어 모델에서 거의 완벽한 정확도로 오류를 감지할 수 있지만, 이를 신뢰할 수 있는 오류 예측으로 옮길 수는 없다. 따라서 이는 직접적인 배포 모니터링의 분리와 관련이 있다. 다중-hop 계산 chain에서 오류 감지를 위한 탐침은 최종 답안의 정확성에 대한 정보를 제공하지 않는다. 또한 구조화된 신뢰도 형식으로

AI 모델 8월 11일

데이터 중심적인 병렬로 긴 시퀀스 변수를 학습하는 방법

데이터 자체가 런타임을 조절하는 Data-Centric Parallel(DCP) 방법을 제시했다. DCP의 핵심 원칙은 데이터가 런타임을 직접 조절하는 것이다. 이를 통해, 각 배치의 시퀀스 길이에 따라 직접 런타임 설정(예: 병렬 크기, 기울기 누적, 재계산)을 동적으로 조절할 수 있다. 실험 결과로, 32개의 H200 GPU에서 DCP 방법이 2.88배의 속도 향상을 달성했다. 또한, 모

AI 모델 8월 11일

인간 주행을 모델링하는 능동적 추론 모델 내의 감정

arXiv:2608.07480v1 발표 형식: 새로운 발표 요약: 적극적 추론(active inference)이 행동을 적절히 조절하고 불확실성을 감소시키기 위해 목표 지향 행동과 균형을 이루는 원리적인 프레임워크로 등장했습니다. 생물학적 시스템과 인공 시스템에 걸쳐 성공적으로 적용되었으며, 최근에는 인간의 운전에도 적용되었습니다. 그러나 기존의 적극적 추론 모델은 운전의 행동을 결정하는 중

AI 모델 8월 11일

구조 이론에서의 결정화: 폐쇄성, 비교 가능성 및 공동 허용성에 의한 통합 프레임워크

arXiv:2608.07476v1 발표 형식: 새로운 요약: plural 구조 이론에서 표준 해석을 생성하는 공식적인 framework를 개발한다. 구조 이론은 서명,_axioms, 그리고 inference 정책으로 구성된 triple T = ({\Sigma}, A, I)로 정의되며, 이 이론의 허용된 해석 가족은 구조적 결론에 대한 전역 일관성 assignments를 모두 포함한다. 표준화

연구 8월 11일

흐름별 흐름: 콘텐츠 판단 회피를 통한 고 손실 영역의 AI 출력 관리

인공지능(AI) 출력 속도 V가 인간 인지 능력 C_max을 초과할 경우, 인간이 AI의 결과를 검토하는 과정이 구조적으로 불가능해지는 것을 이전 연구에서 확인했다. 그러나 단순히 AI 출력 속도만 고려하는 것이 아니라, AI 출력 속도 V와 각 항목당 인지 부하 L의 곱을 고려해야 한다. 인지 부하 L에는 항목 분류(triage), 판단, 반응이 포함되는데, 이들 반응은 인공지능 능력 향상

연구 8월 11일

평가 가능한 인공지능을 위한 논증적 기초 방향

arXiv:2608.07473v1 발표 종류: 새로운 논문 요약: 평가적 인공지능(Evaluative AI, EAI)은 인간의 의사결정을 지원하기 위해 최근 제안된 방법 중 하나로, 단일 추천을 내놓지 않고 대립하는 가설과 그에 대한 증거를 함께 제시하는 방식이다. 이 논문에서는 인공지능의 평가적 측면을 지원하기 위한 공식적인, 계산 가능한 기반을 제공할 수 있는 인공지능 논증(computa

LLM PC 8월 10일

세계 모델에서 중요한 것에 집중하는 TaskSense

대규모 언어 모델(LLM)을 통해 학습된 시각적 제어 모델은 일반적으로 compact한 잠재 상태를 학습하기 위해 관찰치를 재구성하는 것을 통해 정보를 전체 시각적 입력에 걸쳐 보존하도록 암묵적으로 장려합니다. 그러나 과제 관련 내용은 관찰치의 작은 부분만을 차지하며 배경 잡음 및 가리키는 요소는 유용한 표현적 능력을 소모합니다. 시각 재구성과 제어 목표 사이의 불일치로 인해 잠재 표현은 과

AI 모델 8월 10일

지식 기반 지능형 agent를 이용한 똑똑한 학사 경로 계획

공식 대학 출처에서 학위 계획을 수립하려면 두 가지 문제를 순서대로 해결해야 한다. 우선 기관의 교과과정이.catalog, 학과 페이지, JSON 엔드ポイント, PDF와 같은 공통 스키마가 없는 문서들에서 재구축되어야 하며, 그 다음에는 학습자 별 경로가 부수적 논리와 중복 요구 사항 제약 조건 하에서 최적화되어야 한다. 두 가지를 결합하면 각 실패 모드가 다른 것을 숨기게 되는데, 현재 계

에이전트 8월 10일

웹 개발을 위한 LLM 훈련을 위한 자가 진화하는 프로그래밍 평가기

대규모 언어 모델(LLM)이 자연어 설명으로부터 완전한 웹사이트를 생성하는 데 증가하고 있다. 이에 따라 강화 학습이 기능적 격차를 줄이기 위해 중심적인 접근 방식이 되었다. 이 훈련 방식은 보상 디자인에 의해 병목 현상이 된다. 개방된 요구 사항에 대한 브라우저 스크립트는 실행 가능하지만 비용이 많이 들며, VLM과 GUI-agent 평가자도 확대하지만 결정적 상태를 관찰하기 전에 판결을

인기 태그