본문으로 건너뛰기

#arXiv

1186개의 기사

에이전트 7월 9일

LLM을 이용한 agent-based modeling의 논리적 추론

학습형 모델링(ABM)은 수백만 명의 개인과 그 상호 작용을 모델링 할 수 있는 능력을 가지고 있으며, 정책 결정에 유용하다. 그러나 ABM은 전통적으로 정적 전제에 의존해왔다. 이는 모델이 실시간으로 변하는 상황에 적응하지 못하게 한다. 우리 연구에서는 이러한 정보 결핍을 해결하기 위한 새로운 접근법을 제공한다. 대규모 언어 모델(LLM)은 인간의 의사 결정 예측에 새로운 기회를 제공한다.

AI 모델 7월 9일

인맥 내 검색이 도움이 될 때 : 반사 주도적인 사유의 샘플링 복잡도 이론

대규모 언어 모델(LLM)들을 확장된 논리 추론을 통해 훈련하면, 모델이 순차적으로 해결책 시도들을 생성, 비판, 수정할 수 있는 인컨텍스트 탐색(in-context search) 방식을 사용할 수 있다. 인컨텍스트 탐색을 근사적 추론으로 모델링하고, 기초 모델이 사전 분포를 정의하고, 자기 반영(self-reflection)이 후속 업데이트를 위한 피드백을 제공하는 것을 분석한다. 또한,

에이전트 7월 9일

코딩 에이전트 평가를 위한 생산성 평가 경로 검토: AgentLens

AgentLens라는 대규모 언어 모델(LLM) 평가 도구를 제시합니다. 일반적으로 코드 에이전트 평가 도구는 단일 비트로 평가되지만(작업이 성공했는지 여부), 실제로 이러한 에이전트를 사용하는 사람들은 에이전트가 명령을 따르는 방식, 도구를 사용하는 방식, 자신의 작업을 검증하는 방식, 오류를 복원하는 방식, 사용자와 대화를 하는 방식에 대한 모든 경로를 경험합니다. AgentLens는 이

AI 모델 7월 8일

헤딩 특정 활성화 조종으로 도구 사용을 제어한다.

대규모 언어 모델(LLM)과 관련된 도구를 활용한 확장된 모델은 파라메트릭 지식 이외의 기능을 확장시키지만, 불필요하게 도구를 호출하는 경향이 있다. 우리는 도구 사용 결정을 추출하고 조작할 수 있는 안정적인 내부 표현이 존재하는지 조사하고자 한다. 이는 모델의 파라메트릭 지식에 직접적인 인코딩이 없는 도구가 추론 시점에 전체적으로 존재하는 конт텍스트에 존재한다는 점을 고려할 때, 이는

에이전트 7월 8일

리더보드 너머: 대형 언어 모델 agent의 도구 사용, 계획, 논리적 오류 통합

대규모 언어 모델(LLM) 에이전트는 점점 더 자신의 도구를 사용하는 능력, 다단계 작업을 계획하는 능력, 다른 에이전트와 협력하는 능력, 그리고 장기간의 시야를 갖는 능력에 대해 평가되고 있습니다. 보고된 벤치마크 향상은 종종 다른 평가 활동에 기록된 반복적인 실패 모드를 가려두고 있습니다. 이 연구는 27개의 벤치마크, 분류, 감사 논문(2023-2026)을 종합하여 에이전트의 한계를 설

에이전트 7월 8일

정적 평가를 넘어서: 대규모 에이전트 강화 학습을 위한 시뮬레이션 환경 구축

Large Language Models(LLM)가 자율 요소로 발전하면서, 전통적인 정적 평가가 다단계 의사 결정을 포착하지 못하는 문제가 발생한다. 우리는 AgenticAI-Supervisor라는 API와 UI를 통한 RL 게임 환경을 소개한다. 이 환경은 환경 생성과 확장 가능한 실행을 분리시켜준다. 환경 결과가 검증가능한 실행으로 이동하면서, 플랫폼은 고유의 신뢰도 높은 추적을 생성하고

AI 모델 7월 8일

인공 지능을 이용한 대규모 언어 모델의 소비자 인사이트 생성

학술 논문(arXiv:2607.05761v1) 발표 현대 데이터 주도 마케팅은 소비자 데이터를 많이 필요로 하지만, 이러한 데이터를 수집하는 것은 비용이 많이 들고 시간이 오래 걸리며 확장하기 어렵다. 이 연구에서는 대규모 언어 모델(LLM)이 프로젝티브 기술(projective techniques)에서 합성 소비자 데이터를 생성할 수 있는지 조사한다. 프로젝티브 기술은 소비자와의 관계, 감

에이전트 7월 8일

산업급 수준의 CAD_AGENT : 전문가 지식 distillation 기반의 전문 지식 distillation

산업 제품의 컴퓨터 aided design(CAD)가 필요로 하는 대규모 언어 모델(LLM)로 인한 절차적 모델링, 강력한 특성 의존성, 편집 가능한 기하학적 파라미터, 및 B-Rep 실행의 생산급 성능은 현재의 텍스트를 CAD로 변환하는 방법들이 promise한 진전에도 불구하고, 사용자 지시가 모호하거나 미약하거나, 또는 고급 디자인 의도만 설명한 경우에는 여전히 어려움을 겪고 있다. 또

에이전트 7월 8일

메모리 아키텍처를 위한 Akashic: 메모리 주의(Low-Overhead LLM Inference Service)와 MemAttention

대규모 언어 모델(LLM) 기반.agent 시스템은 멀티 턴 상호 작용, 도구 호출, 및 크로스 세션 워크 플로우를 포함한 다양한 컨텍스트를 연속적으로 축적합니다. 이 모든 요청에 대해 전체 역사 재생은 impractical해지며, 긴 컨텍스트는 prefll 비용을 증가시키고, 컨텍스트 한계를 초과하고, 그리고 task 관련 증거를 불필요한 콘텐츠에 묻힐 수 있어, 서비스 효율성과 출력 품질을 저하시킵니다.

에이전트 7월 8일

LLM 과학적 발견 에이전트의 ауд이티블 질문 형성

과학적 발견을 도와주는 대규모 언어 모델(LLM) 시스템은 아이디어 생성, 문헌 통합, 실험 계획, 보고서 작성과 같은 과제를 수행하지만, 과학자들이 검토해야 할 첫 번째 연구 질문은 여전히 어려울 수 있다. 연구 질문이 생소하지 않으면서도 과학자들이 검토해야 할 기작, 거짓말자, 또는 가정에 노출되지 않을 수 있다. 우리는 과학적 대규모 언어 모델 agent를 위한 첫 원리 연구 질문 형성

에이전트 7월 8일

장편 소설을 위한 Narratology에 기반한 이야기 세계 모델: Story Writer 기억

장편 소설 작가들은 기억이 진화하는 이야기 상태에 대한 다중 점프 질문에 답해야 합니다. 예를 들어, 어떤 이는 비밀을 알고 있었고 그 비밀을 언제 알게 되었는지, 사건이 누군가의 비밀을 드러내는 설명보다 이전에 일어났는지, 설정이 성공적으로 끝났는지, 어떤 이는 관계가 어떻게 변했는지. 일반적인 정보 추출 시스템과 agent-memory 시스템은 entity와 fact를 표현하지만 narr

AI 모델 7월 8일

자동 CAD 생성을 위한 기초 모델

최근 대규모 언어 모델(LLM)과 시각-언어 모델(VLM)의 발전으로 자연어 설명으로부터 매개변수 3D 디자인을 자동으로 생성할 수 있게 되었습니다. 이 장에서는 CAD 디자인의 자동 생성을 위한 기초 모델에 대한 경험적 연구를 제시하며, 97개의 엔지니어링 디자인 문제를 포함하는 고유한 평가 PIPELINE과 커밋된 벤치마크를 사용합니다. LLMForge라는 다중 모델 텍스트- CAD 프레

AI 모델 7월 8일

블록 기반 프로그래밍을 위한 작은 언어 모델을 튜터로 사용하는 벤치마크

대규모 언어 모델(LLM)이 교육자 역할로 사용되는 것은 점점 더 연구되고 있지만 K-12 교육 환경에서 이를 배치하는 것은 개인 정보 보호, 비용, 특허 모델에 의존하는 문제를 일으킨다. 작은 언어 모델(SLM)은 훌륭한 대안을 제공하지만 특정 교육 환경에 적합한 모델을 선택하는 것은 여전히 어려운 문제이며, 대상 도메인인 블록 기반 프로그래밍과 같은 경우 모델 훈련 데이터에서 크게 부족하

LLM PC 7월 8일

그래프에서 기울기까지: 물리적 지침에 의한 구조적 attribution을 위한 Cyber-Physical IoT 시스템과 그 이상

인공지능에서 설명 가능성 방법은 시스템이 특정 입력에 따라 어떤 방식으로 행동하는지의根本 원인과 그 영향력을 드러내어 더 깊은 이해를 가능하게합니다. 기존의 설명 가능성 방법과는 달리, 인과적 설명은 주로 입력 변수와 출력 변수 간의 상관관계만 강조하는 것에 초점을 맞추며, 대신에 intervene하는 질문에 초점을 맞추어 더 강력한 이해를 제공합니다. 이는 특히 고위험 영역에서 자동화된 결

에이전트 7월 8일

인공 지능 시스템을 이용한 생물 정보학 연구 결과를 논문으로 작성하기

최근 대규모 언어 모델(LLM) 기술의 발전으로 인해 논문 작성을 위한 끝에서 끝까지 자동화된 시스템이 개발되었습니다. 그러나 기존의 시스템은 세 가지 중요한 결함을 보유하고 있습니다: (i) 생성된 주장들이 증명 가능한 문헌에 대한 명확한 근거를 가지고 있지 않습니다, (ii) 실험 결과가 실제로 수행되지 않고 가짜로 생성됩니다, (iii) AI가 생성한 논문이 실세계에서 출판할 수 있는

에이전트 7월 7일

예측 시장 agent의 믿음-to-거래 layer : 미래 예측을 넘어서

미래 사건을 예측하는 것은 일반적인 인공지능의 테스트베드로써 관심을 끌고 있는 분야입니다. 이 평가를 기반으로 하는 자연스러운 방법은 모델이 예측 시장에서 거래를 하게 하는 것입니다. 거래는 단순히 예측을 하기만 하는 것보다 더 많은 요구사항이 필요합니다. 최근 벤치마크에서는 조정된 확률 점수를 거래 결과와 큰 차이로 보고하고 있습니다. 우리는 Raven-Agent를 제안하고 있습니다. 우리

연구 7월 7일

동적 조립 흐름 공장 생산 일정 관리를 위한 다 제품 배송을 고려한 슬라이딩 윈도우 기반 강화 학습

arXiv:2607.02941v1 발표 형식: 새로운 논문 요약: 다중 제품 조립 배달은 처리와 조립을 통합하는 하이브리드 제조 시스템에서 실시간 계획을 위한 중요한 과제를 부과한다. 동적 주문 도착은同時적으로 공급 의존성과 가능한 작업-기계 할당의 집합을 변경한다. 이 논문은 복잡한 조립 제약 조건을 고려한 유연한 조립 흐름 공장 계획 문제의 종단-ToEnd 온라인 계획을 위한 슬라이딩 윈

인기 태그