본문으로 건너뛰기

#arXiv

1186개의 기사

에이전트 7월 2일

농업 SAGE: 시뮬레이션 기반의 멀티 에이전트 LLM을 이용한 상황에 맞는 농업 सल롱 생성

농업 고문 시스템은 고전적인 농업 지침이 일관성 있는 증거 기반 추천을 제공하지만 계절 중간의 변동성과 동적 불확실성을 무시한다는 기본적 인 긴장감을 겪고 있다. 최근 대규모 언어 모델(LLM)으로 구동되는 고문 시스템은 신뢰할 수 있는 농업 지침을 제시하지만 생리학적으로 설득력이 없다고 판단되는 추천을 생성하는 위험을 부여한다. Agri-SAGE는 위 두 가지 한계를 해결하기 위해 데이터베

에이전트 7월 2일

개인화란 역행위 계획: 구조적 잡음 제거를 통해 의사소통 슬라이드 생성을 위한 잠재적 설계 의도 학습

슬라이드 디자인은 데크 테마와 페이지 레이아웃을 모두 개인화해야 하지만, 현재의 인공지능(AI) agent 기반 방법은 미세하게, 페이지 단위로 디자인하기 어렵습니다. 단지 미리 정의된 템플릿이나 사용자 verbose한 지시만으로는, 잠재적인 디자인 의도를 포착하지 못하여, 페이지 단위 슬라이드 개인화(Page-level Slide Personalization, PSP) 문제를 해결하지 못합

에이전트 7월 2일

운영 중인 자율성 관리: 단일 및 다중-agent 사이버 물리 시스템을 위한 안전성 및 규제

자율적 인 agent 들은 연속적인 인간 감독 없이 운영할 때 공통적인 오류 모드에 직면합니다. 이러한 오류 모드는 안전성 위반, 불안정한 동작 및 오류 상태 처리 미흡으로 인해 발생합니다. 우리는 \system{}을 개발하여, 5개의 실행 기어 (\Gobs{}, \Gsug{}, \Gplan{}, \Gexec{}, \Gint{})와 유용성 게이트 및 이벤트 기반 fallback을 결합합니다. 이 기법은 단일 agent 경우의 정적 안정성, 실행 안전성, 최종 안정화, fallback 완전성 및 기어 제한 Markov 결정 프로세스와의 동등성을 증명합니다. 다중 agent 사이버 물리 시스템(CPS)에서, 우리는established \smart{} managed-autonomy lifecycle을 적용하고, runtime 증거를 \Stable{}/\Meta{}/\Assisted{}/\Regulated{}의 네 가지 규제 상태로 맵핑합니다. 이 기법은 분산 안전성 및 안정성 보장을 제공하며, zero-collision 보장을 포함합니다.

에이전트 7월 2일

메모시네: 인공지능이 생성한 워크플로의 유효성 검증 및 修復을 위한 Transaction Processing

대규모 언어 모델(LLM), 해결책, 및 agent 팀들이 점점 더 많은 워크플로우 작업, 수리, 및 계획을 생성하고 있지만 생성된 작업이 문법적으로 유효하지만陈腐, 불가능, 충돌, 또는 증거를 수리한 것이 파괴하는 경우도 있다. 우리는 Agentic Transaction Processing (ATP), 작업을 생성한 것이 불신하는 제안으로 다루는 거래 모델을 소개한다. ATP는 제안이 명확

AI 모델 7월 2일

Seed2.0: 현실 세계 복잡성 해결을 위한 지능의 전진

Seed2.0 모델 시리즈는 복잡한 현실 세계 문제를 해결하는 데 의미 있는 발전을 이루었습니다. Seed2.0 모델은 사용자의 실제 필요를 파악하고, 이러한 필요를 기반으로 하는 현실적이고 복잡한 시나리오를 기반으로 하는 신뢰할 수 있는 평가 시스템을 구축합니다. Seed2.0 모델은 현실 세계의 복잡한 문제를 해결하는 데 필요한 두 가지 持続적인挑战, namely long-tail knowledge와 complex instruction following을 해결하였으며, 이러한 문제를 해결하는 데 있어 높은 신뢰성을 확보하였습니다. Seed2.0 모델은 또한 world-leading reasoning intelligence, visual understanding, and search capabilities를 제공하여, 다양한 사용자들의 일반적인 필요를 충족시키는 데 도움을 줍니다.

연구 7월 2일

Epistemic AI Literacy를 위한 지적 목적과 과정: 학생-인공지능 공동 프로그래밍을 위한 Epistemic Aims와 Processes의 탐색

학생이 인공지능을 사용하여 프로그래밍을 할 때, 지적 목적과 지적 과정은 학습의 중심적 역할을 한다. 연구팀은 Epistemic AI Literacy(EAIL)라는 개념적 프레임워크를 제시하여, 인공지능 문해력은 다양한 영역에서 동적 인공지능-인간 상호작용을 통해 발생하는 프로세스-지향적 지적 phenomenon으로 재구성한다. 연구결과, 학생-인공지능 상호작용에서 78.8%가 비마스터리 목적과 불신뢰할 수 있는 지적 전략을 사용하며, 반면 11.1%만이 고도의 지적 참여를 보여준다.

에이전트 7월 2일

컨텍스트 밴디트 감독 게임에 대한 두 가지 정보 불균형의 문제

AI.agent의 런타임 인간 감시를 연구할 때, 개인 정보가 양방향으로 흐른다. 인간은 reward function을 개인적으로 알고 있으면서, AI.agent는 제안한 행동의 품질을 개인적으로 알고 있다. 이 어이 없이는 자율 로봇이나 소프트웨어 agent가 상황을 검토할 때 자연스럽게 발생하는 편견이다. 협력적 역학 학습(CIRL)과 감시 게임을 바탕으로, 두 단계의 비대칭 정보를 갖는

AI 모델 7월 2일

희귀병 진단을 넘어 인간의 어노테이션을 초과하는 자율적 의학적 사고 RareDxR1

다기성 질병의 차별진단은 치료가 매우 중요하지만도 어려운 임상 과제로, 의사들은 복잡하고 구조화되지 않은 환자 증상에서 정확한 현상 유형을 식별하고 광범위한 검색 공간 내에서 세밀한 논리를 수행해야 합니다. 그러나 기존의 AI 접근 방식은 일반적으로 pipe-line 기반의 현상 유형 추출 또는 검색-augmented 생성에 의존하며, 이는 사전 정의된 개념 체계, 검색 병목 현상 및 진단

연구 7월 2일

비행 경로 계획을 위한 지원하는 비행 중 항공 교통 제어를 위한 솔루션 공간 경로 계획

기술이 발전함에 따라 공항 교통 관리를 위한 경로 계획 알고리즘들이 많이 제안되었다. 그러나 전술 제어에서 실제로 적용되는 것은 매우 제한적이다. 이는 알고리즘 설계 우선 순위와 항공 교통 제어원들의 요구가 맞지 않는다는 것을 보여준다. 이에 따라 결정 지원 솔루션을 개발해야 하는 필요성이 대두된다. 결정 지원 솔루션은 해석 가능한 솔루션, 계산 효율성, 그리고 인간의 사용을 위해 명시적으로

에이전트 7월 2일

실패를 안전하게 관리하는 개방형 웹 데이터 수집을 위한 제약 조건 및 검증 가능한 agent 프레임워크

대규모 언어 모델(LLM)과 agent는 자연어 요구사항으로 웹 스크래퍼를 생성할 수 있지만 직접 생성은 의존성 오류, 깨진 선택자, 스키마 불일치, 그리고 다형성 페이지 구조로 인해 신뢰성이 낮다. 우리는 제약을 가한, 검증 가능한 agent 프레임워크를 제안한다. 이 프레임워크는 대규모 언어 모델의 출력을 자유쓸쓸한 코드에서 형식화된 JSON 수집기 구성으로 옮겨준다. 이 프레임워크는 6

AI 모델 7월 2일

MMM 데이터 모델 - 분산 가능 지식 공유소에서의 지식 상호운용성에 대한 규범적인 명세

정보 시스템은 문서 중심으로 구축되는데, 문서는 인쇄 생산과 선형적인 읽기 용도로 최적화된 독립된 단위이다. 문서 중심의 조직은 지식 구조, 업데이트, 공유 및 재사용에 제약을 가한다. 공식적인 접근 방식은 일부 제약을 해결하지만, 공식적인 구조보다 다른 시스템 속성인 인간 사용성 및 범위에 우선순위를 두기 때문에 광범위한 CONTRIBUTION 및 ADOPTION을 달성하는 데 어려움을 겪

연구 7월 2일

부정한 도덕성: 도덕 계산의 공간을 정의하는 것

윤리적 판단은 일반적으로 고정된 윤리 이론(의무 이론, 결과 이론, 도덕적 덕행 이론)에 따라 모델링되었습니다. 이들은 정적 규칙이나 가치 함수로 구현되었습니다. 우리는 Bounded Morality라는 형식적인 프레임워크를 제안합니다. 이 프레임워크는 유한한 agents가 직면하는 윤리적 문제의 계산적 수요를 분석하기 위해 사용됩니다. 허버트 시몬의 한계 합리성 개념을 확장하여, 우리는 윤

AI 모델 7월 2일

인공지능과 인간 상호작용의 선호도 동적 관리

인공지능(AI)과 인간의 선호도 조화에 대한 대부분의 접근 방식은 인간의 선호도를 추론하고 최적화하는 고정 목표로 다루어 왔습니다. 그러나 선호도는 상호작용 특히 적응 기술과 함께 생성되며 동적이고 층별로 구성된다는广泛한 실험적 증거와 충돌합니다. 인공지능 시스템이 더 지속적이고 개인화된 사회적으로 고정된 시스템으로 변할수록, 그들은 시간이 지남에 따라 사람들이 주의를 기울이며 가치하고 지지

에이전트 7월 1일

회귀의 비밀: 인공 지능의 내재된 규제 부담

인공 지능은 내부적으로 안정성을 유지하기 위해 투자하는 노력이 증가하는 동안 안정성을 유지하는 것만으로 평가되는 경우가 많다. 하지만 이러한 내재된 규제 부담은 노이즈, 지연, 또는 변하는 요구 사항을 처리하는 인공 지능에 중요한 문제이다. 이 연구에서는 내재된 규제 부담이 과거에 의존하는지 여부를 조사하기 위해 컴퓨터 모델을 사용하여 인공 지능을 변경하는 과정을 시뮬레이션한다.

에이전트 7월 1일

자율 AI agent의 행동을 관리하는 증명 가능한 규칙을 위한 시스템

인공지능(AI)代理가 인간의 대표로 중요한 행동을 수행하는 경우가 점점 더 많아지는데, 이 행동에는 금융 거래, 외부 커뮤니케이션, 기업 워크플로우 등이 포함된다. 현재代理기반 인프라는 식별 연합(ID federation)과 위임 인증(Authorized delegation)을 통해 로드의 인증과 자원 접근 제어를 수행하지만, 현재의 행동 및 운영 환경에서 허용된 행동을 결정할 수 없다. 우

에이전트 7월 1일

퍼트리얼 관찰 하의 멀티 에이전트 강화 학습에서 하이퍼 프로퍼티를 활용한 하이포레: Hyperproperty-Guided Multi-Agent Reinforcement Learning under Partial Observation

Formal 명세는 학습 과정에 대한 강력한 도구로, 보상 형성보다 다음과 같은 이점을 제공한다: 1. 수학적 엄밀성 2. 목표와 제약을 지정할 수 있는 표현력 3. 목표 달성을 위한 전략을 정의할 수 있는 능력 그러나 Multi-Agent Reinforcement Learning (MARL)에서 이러한 이점은 주로 탐구되지 않았다. 이 논문에서는 Partial Observability 하에

연구 7월 1일

신경망-베이즈-symbolic 잔차 주의점 얕은 네트워크: 사이버 보안 위험 평가에 대한 설명 가능한 깊은 학습

신경망-베이즈-symbolic 잔차 주의점 얕은 네트워크(NBS-RASN)는 오픈 소스 생태계에서 설명 가능한 사이버 보안 위험 평가를 위한 하이브리드 신경망 아키텍처입니다. 깊은 모델들이 정확성에 대한 희생으로 해석성을 포기하는 것과는 달리, 우리의 얕은 네트워크는 80개의 해석 가능한 뉴런과 12개의 층으로 구성되어 있습니다. 또한, gatekeeper가 5개의 epistemological axioms(정확성, 유발성, 거부 가능성, 투명성, 완전성)를 강제로 적용하기 전에 전파를 진행합니다.

에이전트 7월 1일

AI가 SILICON으로 가는 고속 경로를 열다! AgRefactor: Self-Evolving Agentic Workflow for HLS Compatibility and Performance

High-Level Synthesis(HLS) 기술을 이용한 소프트웨어를 SILICON으로 변환하는 과정이 쉽지 않다. 그러나, 새로운 AI 기술인 AgRefactor는 이 문제를 해결하기 위해 개발되었다. AgRefactor는 대규모 언어 모델(LLM) 기반의 다기능 워크플로우로, 소프트웨어를 HLS 호환 프로그램으로 변환하는 과정을 자동화한다.

AI 모델 7월 1일

강력한 판넬(LLM) 심사관 집단

대규모 언어 모델(LLM) 심사위원단은 여러 심사위원의 합의 점수를 보고하는 심사위원단(PoLL)의 합의 점수에 대한 합의점을 달성한 심사위원단이 단독 심사위원의 대규모 언어 모델 평가에 대한 실제 대안이 되었지만, 그 통계적 행동은 아직도 잘 이해되지 않았다. 우리는 대규모 언어 모델 심사위원단을 Huber 오염 모델 underneath 에서 formalize하고 PoLL가 positive

에이전트 7월 1일

법에 의한 여러 agent들의 의사결정 탐구

인공지능은 법학 분야에 점점 더 많이 적용되고おり, 정의에 대한 접근성을 증가시킬 수 있다. 하나의 특정 운동이 인기를 얻고 있는 것은, 대규모 언어 모델(LLM) 기반 인공지능 agent가 자율적인 행동을 할 수 있는 agentic AI이다. 법적 영역에서 다중 agent 접근 방식은 여전히 거의 탐구되지 않았다. 이 논문에서, 우리는 법적 추론 작업을 위한 LLM을 사용한 다중 agent

인기 태그