본문으로 건너뛰기

#arXiv

1187개의 기사

AI 모델 5월 23일

증언의 형태: 구술 역사 아카이브를 위한 확장 가능한 프레임워크

홀로코스트 연구에서 연구자들은 종종 두 가지 형태의 구두 생존자 증언을 구별했습니다 : USC 쇼아 재단의 인터뷰는 Yale Fortunoff 비디오 아카이브가 일반적으로 더 자유로운 형태, 개방형 스타일을 선호하는 반면, 구두 역사 아카이브에 대한 구조화 된, 인터뷰가 지시 된 형식을 따르는 경향이 있습니다. 이 구별은 학문적 인 연구와 나중의 아카이브의 개발에 영향을 미쳤습니다. 이 연구에서 USC 쇼아 재단의 인터뷰는 두 컬렉션에서 1,600 개 이상의 증언의 대규모 컴퓨팅 분석을 수행함으로

AI 모델 5월 23일

MindLoom: Frontier-Level Reasoning Data Synthesis를 위한 생각 모드를 구성하기

MindLoom: Frontier-Level Reasoning Data Synthesis arXiv:2605.21630v1 Announce Type: new Abstract: LLMs는 논리에서 상당한 진전을 이룬 반면, 체계적으로 국경 수준의 논리 데이터를 생산하는 것은 여전히 어렵습니다. 기존의 합성 방법은 종종 문제 어려움을 지배하는 구조적 요소에 대한 제한된 시각성을 가지고 있으며, 이는 좁은 다양성과 불안정한 기본적인 어려움 제어 과정을 초래할 수 있습니다. 이 작업에서, 우리는 논리 문

LLM PC 5월 23일

TO-Agents: 선호도 가이드 토폴로지 최적화를 위한 멀티 에이전트 AI 파이프라인

TO-Agent Selector: A Multi-Agent AI Pipeline for Preference-Guided Topology Optimization arXiv:2605.21622v1 이러한 효과적인 발표 유형 : 새로운 추론 : 메모리 최적화는 효율적인 피드백을 생성 할 수 있지만 디자이너는 종종 원하는 시각적 스타일, 제품 경험 또는 파이프터 최적화 설정을 원하는 파이프터 설정으로 수동으로 번역해야합니다. 우리는 TO-Agents, 천연 언어 설계 의도를 iterative topolo

AI 모델 5월 23일

LLMs에서 분포 외 정렬 실패를 위한 모니터 벤치마크 및 개선에 대한 리뷰 보기

벤치마킹 및 대형 언어 모델 (LLMs)의 보안 및 조정 실패를 개선하는 모니터는 LLMs arXiv:2605.21602v1에서 배포 외부 조정 실패에 대한 특이한 벤치마킹 또는 응답 패턴입니다.이 발표 작업 유형 : 새로운 추론 : 대형 언어 모델 (LLMs)의 많은 보안 및 조정 실패는 배포 외부 (OOD) 상황 때문에 발생합니다 : 모델 개발자가 예측하지 못한 특이한 벤치마킹 또는 응답 패턴. 우리는 시스템적으로 LLM 모니터링 파이프라인이 우리의 자신의 모니터를 훈련하는 데 사용할 수 있는

에이전트 5월 22일

전기차 배터리 고장 감지 및 진단을 위한 VBFDD-에이전트: 배터리 디지털 신호의 서술적 텍스트 모델링

VBFDD-Agent for Electric Vehicle Battery Frame Fault Detection and Diagnosis: Descriptive Text Modeling of Battery Digital Signals arXiv:2605.20742v1 Announce Proposal Type: New Abstract: 전기 차량의 급속한 확산으로 리튬 이온 배터리의 안전성과 신뢰성은 중요한 우려가되었습니다. 효과적인 변형 탐지은 배터리 안전한 작동을 보장하기 위해 필수적입니다. 그

에이전트 5월 22일

선언적 데이터 서비스: 데이터 시스템 구성 위한 구조화된 에이전트 발견 리뷰 보기

오류 보고서 데이터 서비스 : 구성 데이터 시스템을 구성하기위한 구조화 된 에이전트 데이터 프레임 탐색 arXiv:2605.20690v1 광고 유형 : 새로운 추론 : 에이전트 연구는 LLM 기반 검색이 벤치마크 조건 하에서 새로운 알고리즘, 디자인 및 코드를 찾을 수 있음을 보여주었습니다. 패러다임을 멀티 시스템 데이터 백엔드에 번역하는 것은 더 어려운 문제를 야기합니다 : 검색 공간은 heterogeneous이며, 검사자는 배포 된 스택이 실제로 실행되는지 여부이며, 구성 지식은 사전 훈련에서

에이전트 5월 22일

COAgents: Routing Problems Search Space를 배우고 탐색하는 멀티 에이전트 프레임 워크

COAgents는 21 VROMO 강력한 도메인입니다: 멀티 에이전트 코드 프레임 워크를 배우고 루팅 문제를 탐색하기위한 스페이스 arXiv:2605.20618v1 광고 유형 : 새로운 추론 : 차량 루팅 문제 (VRP)는 많은 실제 시스템에 필수적이지만, 그들은 그들의 조합 복잡성에 대한 복합적 복잡성으로 인해 계산 불가능합니다. 전통적인 heuristics는 로컬 개선을위한 수작업 규칙에 의존하며, 때때로 \textit{jumps}는 로컬 최소한을 피하기 위해 남아 있습니다. 그러나 종종 다양

에이전트 5월 22일

HANA(Hierarchical Agent-Native Network Architecture)에 대한 리뷰 보기

자동화에서 자율주행: 계급 네트워크 아키텍처 (HANA) arXiv:2605.20608v1 발표 유형: 새로운 추론: 레벨 4/5 자율주행 네트워크 (AN)를 실현하는 것은 정적 자동화에서 에이전트 원주민 인텔리전스로의 전환을 요구합니다. 고체 스크립트에 의존하는 현재 운영은 명칭 조건을 제외한 인텔리전스를 처리하기 위해 인텔리전스 기관이 부족합니다. 이를 해결하기 위해이 편지는 높은 수준의 자율주행을 허용하는 계급 다수 에이전트 참조 아키텍처를 제안합니다. 프레임 워크에는 5G 코어 환경 내에서

연구 5월 22일

Mahjax : JAX에서 강화 학습을위한 GPU 가속화 된 Mahjong 시뮬레이터

Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX arXiv:2605.20577v1 Announce Type: new Abstract: Riichi Mahjong은 스토하스틱과 고차원 상태 공간에 의해 특징을 갖춘 멀티 플레이어, 불완전한 정보 게임입니다. 이러한 특성은 강화 학습에서 복잡한 실제 의사 결정 문제를 반영하는 독특한 조합을 제공합니다. 이전 연구는 정책을 사전 교육하기 위해 인간 플레이 로그에서

연구 5월 22일

인공지능 에이전트와 개인성 엔지니어링 : 협상 연구를위한 새로운 방법론

AI 에이전트와 개인성 엔지니어링 : 협상 연구를위한 새로운 방법론 arXiv:2605.20554v1 발표 유형 : 새로운 추론 : 캐논적 협상 이론에 따르면 사람들의 성공은 경쟁 요구 사항을 얼마나 잘 균형 잡는지에 달려 있습니다. AI 에이전트는 동일한 제한에 직면하지 않으며, 다른 사람에 대한 우려와 자신에 대한 우려를 보여주고, 사람들에게 부드럽고 문제에 어려움을 겪고 있습니다. 그러나 사람들은 이러한 긴장감을 관리하기 위해 어려움을 겪고 있으므로 연구자들은 통제 된 조건에서 필드 처방을

에이전트 5월 22일

AgentAtlas : LLM 에이전트를위한 결과 리더보드 이상

에이전트 Remlas : LLM 에이전트에 대한 단일 닫힌 도구 리더보드 arXiv:2605.20530v1 고정 유형 발표 : 새로운 추론 : 대형 언어 모델 에이전트는 이제 코드베이스, 브라우저, 운영 체제, 달력, 파일 및 도구 생태계에 작용하지만, 그들을 평가하는 데 사용 된 벤치마크는 더 이상 분할되지 않습니다 : 각각 측정의 다른 유닛을 강조합니다 (마지막 작업 성공, 도구 호출 유효성, 반복 트래픽 일관성54, 경로 보안, 또는 공격 강도). 2024-2025 작업의 라인은 단일 정확도

연구 5월 22일

$ECUAS_n$: 불확실성 증대 시스템의 원칙적 평가를 위한 계산기 가족

$ECUAS_n$: 불확실성 증대 시스템의 원칙 평가를위한 계수의 가족 arXiv:2605.20490v2 발표 유형: 새로운 추론: 높은 점수의 자동화 된 의사 결정에서 예측 불확실성에 대한 액세스는 사용자가 - 인간 또는 다운스트림 시스템 - 응용 프로그램 특정 비용 거래에 기초한 예측을 수락하거나 거부 할 수 있도록하는 데 필수적입니다. 불확실성 증대 (UA) 시스템 - 즉 예측과 불확실성 점수를 모두 출력하는 시스템 - 현재 문서에서 다양한 방법으로 평가되고 있으며, 분리 된 계수를 사용하여

에이전트 5월 22일

국경 AI 능력을 측정하기위한 오픈 월드 평가

프랜차이즈 인공지능 능력을 측정하기 위한 오픈 월드 평가 arXiv:2605.20520v1 발표 유형: 새로운 추론: 벤치마크 기반 평가는 프랜차이즈 인공지능 진전을 추적하기 위해 중요하다. 그러나 그것은 정확하게 지정, 자동적으로 등급, 최적화하기 쉽고 낮은 예산과 짧은 시간 경계로 실행할 수있는 작업을 우선시할 수 있기 때문에 배포 된 능력을 과도하고 과도 할 수 있습니다. 이 논문에서 우리는 최근의 오픈 월드 평가를 조사하고, 그들의 강점과 한계를 식별하고, CRUX (오픈 월드 업데이트를위

연구 5월 22일

Horn Logic Reasoning에 대한 고품질 삽입

고품질 인테리어링을 위한 고품질 인테리어링 arXiv:2605.20467v1 광고 유형 : 새로운 추론 : 신경 네트워크는 논리적 인테리어링에 의해 만들어진 선택을 순위로 훈련 할 수 있습니다.이 과정의 핵심 단계는 유용한 인테리어링, 즉 논리적 인테리어링의 숫자 표현을 만드는 것입니다. 이 논문은 더 나은 결과를 가져올 수있는 인테리어링을 만드는 여러 가지 접근 방식을 소개하고 평가합니다. 우리는 앵커, 긍정적 인 예제, 그리고 부정적인 예제로 구성된 예제를 필요로하는 삼중 손실을 사용하여 인테

에이전트 5월 22일

AgentCo-op: 상호 운용 가능한 다중 에이전트 워크플로우의 검색 기반 합성에 대한 리뷰 보기

AgentCo-op: 상호운용성이 가능한 다중 에이전트 워크플로우의 검색 기반 합성 리뷰 보기 AgentCo-op: 상호운용성이 가능한 다중 에이전트 워크플로우의 검색 기반 데이터 합성 arXiv:2605.20425v1 알림 유형: 신규 초록: AgentCo-op 기반 워크플로우 설계는 특히 교육용 데이터 세트가 없고, 신뢰할 수 있는 스칼라 평가 지표가 없으며, 기존 도구와 에이전트 간에 표준화된 인터페이스가 없는 개방형 과학 환경에서 특히 어렵습니다. 우리는 AgentCo-op를 제안합니다.

에이전트 5월 22일

OSCToM: 높은 수준의 이론적 사고를 위한 강화 학습 기반 적대적 생성에 관한 연구

OSCToM: RL-Guided Data Efficient Adversarial Generation for High-Order Theory of Mind arXiv:2605.20423v1 Announce Type: New Abstract: Large Language Models (LLMs)는 많은 언어 작업에서 잘 수행하지만, 그들의 마음의 이론 (ToM) 논리는 여전히 복잡한 사회 환경에서 불균형합니다. ExploreToM을 포함한 기존 벤치마크는 항상 이러한 설정을 어렵게 만드는 회귀 신념과

에이전트 5월 22일

닫힌 루프 최적화, 시뮬레이션 및 모델링 오케스트레이션을 위한 Augmented Agent 도구

Closed-loop Optimization,Simulation,and Modeling Orchestration arXiv:2605.20190v1 Announce Type: New Abstract: Iterative Industrial Design-Simulation Optimization은 CAD-CAE 시멘틱 격차에 의해 병합됩니다 : 다양한 커플링 제약하에 유효한 기하학 편집으로 시뮬레이션 피드백을 번역합니다.이 격차를 채우기 위해 우리는 COSMO-Agent (Closed-loop Opti

에이전트 5월 22일

SOLAR : 평생 학습 및 지속적인 적응을위한 자체 최적화 오픈 엔드 자율 에이전트

SOLAR: Self-Optimizing Open-Ended Autonomous Agent for Lifelong Learning and Continual Adaptation arXiv:2605.20189v1 Announce Type: new Outward Abstract: 대형 언어 모델 (LLMs)의 놀라운 성공에도 불구하고 동적, 실시간 학습 패러다임 내의 이러한 제한을 해결하기 위해, 그들은 여전히 풍부한 수동 데이터 치료를 필요로하거나 재발성하지 않고 대형 언어 모델 (LLMs)에 적응하

에이전트 5월 20일

_agentKnowledge_ - AGENT의 지식 프레임워크

Semantic Web Services 커뮤니티는 2십년 전부터 agent가 다른 ontological commitment을 가진 web service를 발견, 합성, 호출할 수 있는지 물어봤습니다. 그 대답은 OWL-S와 WSMO였습니다. 현재 Knowledge Graph(KG) metadata 표준인 VoID와 DCAT은 KG가 무엇을 포함하고 있는지 설명하지만, agent가 KG에서 무엇을 증명할 수 있는지, empty 결과에 대한 closure 가정, agent의 task vocabulary가 schema에 기반을 두고 있는지 등은 NOTHING을 말하지 않습니다. 우리는 이러한 지식을 KG 설정에 다시 돌아가고 확장합니다. Agent Knowledge Framework는 4차원 formal framework에서 나온 Agentic Affordance Profile(AAP)로 정의됩니다. AAP는 VoID와 DCAT 위에 있는 semantic layer로 KG 선택, 합성, failure diagnosis를 agent planning time에서 원칙적으로 할 수 있도록 합니다.

에이전트 5월 20일

자동화 도구 사용에서의 의사 결정권 확장: 신뢰 도출의 공식화

자동화 도구 사용에서의 의사 결정권 확장: 신뢰 도출의 공식화 자동화 도구 사용에서 의사 결정권 확장 공식화, 즉 자동화된 에이전트가 제안하는 행동이 자율적으로 실행되거나 인간 승인 필요 여부를 결정하는 것을 인간의 위험 동의 함수를 관찰하는 프로빗 likelihood에 의한 가우시안 프로세스 포스트리어를 유지하는 정책 게이트웨이로 preference-learning 문제로 간주한다. 자동화 도구 사용에서 의사 결정권 확장 공식화는 구조적으로 Preferential Bayesian Optim

에이전트 5월 20일

워크플로우 학습을 위한 인터페이스 제약 하의 확실히 수렴하는 방법 학습

워크플로우 학습을 위한 인터페이스 제약 하의 확실히 수렴하는 방법 학습 워크플로우 학습을 위한 인터페이스 제약 하에서, 각 에이전트는 공유된 artifact와 자신의 개인 상태에 대한 지역 함수만 관찰하고, 중앙 집중식 학습자가 공동 경로에 접근하지 않는 다중 에이전트 대규모 언어 모델(LLM) 파이프라인의 운영 영역을 연구합니다. 이 영역을 인터페이스 제약 하의 반semi-Markov 결정 과정(IC-SMDP)으로 구체화하고, 에이전트 간의 교차 조정은 매 이관마다 정확히 하나의 스칼라로 디자

에이전트 5월 20일

POLAR-Bench: 프라이버시-유틸리티 트레이드오프를 위한 LLM 에이전트의 진단 벤치마크

POLAR-Bench: 프라이버시-유틸리티 트레이드오프를 위한 대규모 언어 모델(LLM) 에이전트의 진단 벤치마크 대규모 언어 모델(LLM) 에이전트는 점점 더 사용자의 개인 정보에 접근하고 사용자의 대리인으로서 세 번째 당사자 시스템과 상호 작용할 때 사용자의 의도에 따라 행동한다. 사용자는 공유할 수 있는 것과 공유하지 말아야 하는 것을 정의하고 에이전트는 세 번째 당사자 시스템이 적대적으로 행동하는 경우에도 그 의도를 강력하게 따르도록 해야 한다. POLAR-Bench(정책에 의한 적대

인기 태그