본문으로 건너뛰기

#arXiv

1177개의 기사

AI 모델 9월 17일

AI는 전략적 충돌에 준비되어 있지 않다

AI는 전략적 충돌을 위해 준비되어 있지 않다고 주장합니다. AI는 대규모 언어 모델(LLM) 기반의 사회적 시뮬레이션을 통해 적대자, institution, 상승, 계획의 취약성, 교전의 원칙, 위기 대응 등을 모델링할 수 있습니다. 하지만 이러한 AI는 전략적 충돌을 위한 계획, 교전의 원칙, 정책, 위기 대응 등에 사용하기 전에 안전성을 입증할 수 있는 사례를 확보해야 합니다.

연구 9월 17일

사격 사건 중 적응적인 대피 경로 최적화를 위한 GNN 기반 PPO 알고리즘

질서와 안정성을 유지하기 위해 즉시 구조 방위를 위한 시스템이 필요해졌습니다. 효과적인 구조 방출 시스템은 위협 노출을 최소화하면서도 적대적 불확실성과 사람 밀집 현상을 고려해야 합니다. 현재 문헌에서 제시된 방법들은 레이아웃에 특정 정책에만 제한되어 있으며 대규모 레이아웃에서 계산적으로 처리하기 어렵습니다. 실제 지침은 단순히 피해자들에게 "달리기", "숨기기", 또는 "싸우기"라고만 조언

AI 모델 9월 17일

언어 모델의 안정적인 오류 수정: 기능 보존을 위한 냉동 기초 조정

연구에서는 다음의 실제적인 문제를 다룹니다: .freeze된 언어 모델의 출력에 오류가 있는 경우, 작은 수정 모듈이 오류를 수정할 수 있을까요? 오류 수정이 기초적인 기능을 저하하지 않도록 할 수 있을까요? CRN v2를 제안합니다. 이는 4.65억 텍스트 모듈의 약 0.73%인 34M trainable 매개변수를 가지고 있는, 로짓 수준의軽량 오류 수정 모듈입니다. CRN v2는 Gemm

AI 모델 9월 17일

신경망 아키텍처를 위한 정보거리(Fisher 정보 거리)를 사용한 최적 절단(Pruning)

연구자들은 새로운 매개변수 삭감 기법을 개발했다. 이 기법은 모델 공간 내에서 미분 기하학 거리를 사용하여 출처되었다. 매개변수를 삭감하는 것은 매개변수의 값을 0으로 설정하는 것을 의미하며, 매개변수가 사라진 초평면으로 모델을 이동하는 것을 나타낸다. 매개변수가 사라진 초평면까지의 최소 거리는 모델 공간에서 피셔 정보 기하학 기약을 통해 자연스럽게 계산된다. 이 거리는 실제 모델의 변경과

에이전트 9월 15일

작고 강력한 언어 모델 오케스트레이션: OrchSLM의 동적 기계 학습

작고 강력한 언어 모델(SLM)을 이용한 오케스트레이션은 대규모 언어 모델(LLM)과 비교하여 더 낮은 연산 비용과 더 빠른 응답 시간을 제공합니다. 그러나 SLM의 제한된 용량과 맥락 창은 장기적인 논리적 추론과 상호 작용-heavy 오케스트레이션 전략을 제한합니다. 이에 대한 해결책으로, 비대면 오케스트레이션 전략을 제시하고, 이에 대한 기계 학습 동적 기계 학습 프레임워크 OrchSLM을 개발합니다.

에이전트 9월 15일

기계 속으로 통치: 실시간 AI 정책 강제에 적응 가능한 지능 구조

기업의 인공지능(AI) 도입률은 전 세계적으로 78%에 이르렀지만, 그에 따라서 규제를 수립하고 시행하는 인프라가 따라가지 못하고 있습니다. 이 논문은 규제 기간 내에 감사할 수 있고 변조의 증거를 제공할 수 없는 감사 증거를 생산할 수 없는 조직을 유지하는 구조적인 조건을 '증명 부족'이라고 합니다. 스탠퍼드 2026 AI 지수 보고서(362건의 사례), IBM/Ponemon 2026 데이

에이전트 9월 15일

원인파악은 탐색 문제입니다: 장기적인 agent 실패의 계속적인 탐색

인공지능(AI) agent가 장기 목표를 달성하는 데 사용되는 기록의 양이 증가하고 있다. 이러한 기록 내에서 실패를 진단하는 것은 신뢰성에 필수적이기 때문에 결과 단계의 신호를 행동 가능한 조치를 변환시킨다. 이러한 데이터의 규모가 인간의 검토를 실용적으로 만들지 않기 때문에, 자동화된 원인 인식 Attribution (RCA)의 필요성이 생겼다. 그러나 대규모 언어 모델(LLM)을 사용한

AI 모델 9월 15일

시계열 언어 모델에서 합성적 사고를 유도하는 시간 생각:

타임 시리즈 멀티 모달 대규모 언어 모델(TS-MLLMs)은 최근 대규모 언어 모델(LLMs)의 추론 능력을 활용하여 질문-답변 작업을 수행하기 시작했습니다. 그러나 이러한 모델들은 종종 동적 시간 패턴을 포착하지 못하고, 고위험 응용 프로그램인 의료와 같은 경우에는 암시적 추론만 제공하여 중요한 설명을 제공하지 못합니다. 반복 학습(RL)-기반 타임 시리즈 언어 모델은 이러한 문제를 해결하

에이전트 9월 15일

물리적 인공지능의 자기 적응형 향상: LLM agent가 장기 물리적 작업을 관리할 수 있을까?

대규모 언어 모델(LLM) agent는 인간의 개입 없이 장기간의 물리적 작업을 자동으로 관리하는 데 hứ부한 길을 제공합니다. 그러나 물리적 작업은 agent가 환경을 지속적으로 관찰하고 결과적인 행동을 하며 환경이 변하는 동안에도 효과를 유지해야 합니다. 기존의 방법은 대부분 대규모 데이터와 재학습을 필요로 하거나 주로 가상 세계에서 작동하는 agent에 초점을 맞추고 있습니다. 이 연구

에이전트 9월 15일

LLM 판권 소유권: 전문적인 특허 작성 기관을 위한 LLM 심판자 평가

AI 생성된 출력물을 평가하고 개선하기 위해 점점 더 많이 사용되는 대규모 언어 모델(LLM) 심사관의 신뢰성은 복잡한 전문 업무에 대해 아직 rõ하지 않습니다. 우리는 AI-agent 평가를 위한 끝에서 끝까지 특허 출원 테스트베드를 통해 이 문제를 연구합니다. 분리된 LLM 심사관이 생성된 특허 초안을 평가하고 반복적인 수정을 위한 구조화된 feedback를 제공합니다. 다중 발명물과 d

연구 9월 15일

다양한 목표를 가진 bayesian 최적화에서 유사성과 다양성을 분리하는 방법

Multi-목적 베이지안 최적화(MOBO)는 여러 목적을 가진 비결정적 함수를 최적화하는 효율적인 접근 방식입니다. MOBO의 목표는 파레토 전면을 충분히 근사화하는 것입니다. 즉, 1) 좋은 수렴성(파레토 전면 근접성)과 2) 좋은 다양성(파레토 전면에 걸쳐있는 다양성)을 갖춘 높은 품질의 해결책 집합을 얻는 것입니다. 기존의 MOBO 방법들은 일반적으로 이러한 두 가지 과제를 동시에 해결

AI 모델 9월 14일

사회 동력 예측을 위한 적대적 보상 추정 기반 생성 학습 (GLARE: Generative Learning via Adversarial Reward Estimation For Social Dynamics Forecasting)

회의 지속을 위해는 장기 다인 회의에서 agenda 추적, 발언자 역할, 참여자 의도 및 불일치 추적이 필요하다. 우리는 2,207 개의 실세계 회의와 24,794 개의 미래 지향적 쿼리에서 Meeting Dynamic Forecasting Benchmark(MDFB)를 소개한다. 회의 전면과 활성 질문이 주어졌을 때, 모델은 한 번의 호출로 가능성 있는 다중 회전 연속성을 생성한다. 우리는

AI 모델 9월 14일

LLM이 사용하는 드래프트-검증-수정 Pipe라인이 의사소통의 암묵적 모호성 문제를 해결할 수 있을까?

LLM이 사용하는 드래프트-검증-수정 Pipe라인을 통해 의사소통의 암묵적 모호성 문제를 해결할 수 있는지 연구한 결과, GPT-5.2와 Gemini 3 Pro가 높은 성능을 보였다. 그러나 Pipe라인의 오류가 발생할 경우, 모호한 의사소통이 재발할 수 있으므로, Pipe라인의 설계에 주의가 필요하다.

연구 9월 14일

과학 문헌에서 발굴한 것: 재료과학에서 원자층 증착과 이탈 처리를 위한 프로세스 스키마

arXiv:2609.12139v1 발표 형식: 새로운 abstract: 원자층 증착(Atomic Layer Deposition, ALD)과 원자층 에칭(Atomic Layer Etching, ALE)은 재료 과학에서 실험과 시뮬레이션 문헌에서 공통적으로 보고되지만, 비교와 기계가 작동할 수 있는 재사용을 방해한다. 우리는 ALD와 ALE 실험 및 시뮬레이션 과정에 대한 네 개의 도메인 전문가

AI 모델 9월 14일

성공적인 지식 그래프 편집이 정확한 답변을 대체할 때: 매개변수 지원을 초과하는 rank 수준의 근접성

지식 그래프 임베딩(Knowledge Graph Embedding, KGE) 모델을 편집하여 원하는 답변을 추천하는 것만으로는 올바른 답변을 목록에서 밀어내는 문제를 해결하지 못할 수 있다. 단지 편집된 매개 변수를 재사용하는 사실만을 기반으로 하는 지역성 테스트는 rank-displacement 효과를 놓칠 수 있다. 우리는 세 가지 범위에서 공통 rank-displacement 감사 절차

AI 모델 9월 14일

언어는 정량적 사고를 위한 충분한 토대가 아니며, 결과적인 영역은 큰 정량적 모델이 필요하다.

학습된 기계 학습 모델이 실제로 중요한 수치적 결정을 내리려면 대규모 언어 모델(LLM)의 발전이 필요하다는 가정은 일반적이다. 예를 들어, 가격 위험을 평가하는 것, 자본을 배분하는 것, 환자들을 분류하는 것, 또는 네트워크 침투를 방지하는 것과 같은 결정은 언어 모델의 발전으로부터 나와야 한다. 그러나 언어 모델은 인간이 세계를 설명한 표현에 훈련된 것이다. 이 설명은 수치 기록의 손실적

AI 모델 9월 14일

언어 모델 및 전제 조건의 능력에 따라 풀링을 통한 사건 예측

Hy브리드 예측에서 언어 모델은 여러 신호 중 하나일 때 자주 사용된다. 시스템은 이미 시장, 대중, 통계적 예측을 가지고 있어 모델이 유용한 정보를 제공하는지 여부를 결정해야 한다. 따라서 독립된 모델 정확성보다는 상대적 compétence, 즉 모델이 제공하는 외부 예측의 외재적 예측 외에 추가적인 가치가 있는지 여부가 중요하다. 브라이어 손실(Brier loss)에서, 모델의 불일치가

연구 9월 14일

전체 심장의 읽기: 중첩-주의 방지 가면 자기 인코더를 이용한 다중 모드 심장 표현 학습

심장 질환의 진단은 ECG, 초음파 카디오그래피, 흉부 엑스레이, 임상 변수 등 각기 다른 부분이지만 상호 관련된 심장 생리학의 측면을 포괄하는 다양한 방법들을 통합하는 것으로 나아간다. 그러나 대부분의 의료 기초 모델은 모드별로 구분되어 있으며, 대부분 모드별로만 학습이 진행되어야 한다. 이러한 방법은 임상진료사들이 자연스럽게 통합하는 교차 모드 증거를 무시하고, 각 모드 내의 구조를 무시

에이전트 9월 14일

어그제티브 코딩에서 하네스 효과 분리: 오염 제어를 위한 개인 전용 공간

대형 언어 모델(LLM)을 조작하는 시스템인 '해쉬'(harness)가 개발되었다. 이 해쉬는 대형 언어 모델과 함께 사용되는 도구, 프롬프트, 제어 흐름으로, 대형 언어 모델을 자율 소프트웨어 개발자로 변형시킨다. 해쉬는 각 벤더가 대형 언어 모델과 함께 사용하는 해쉬를 제공하며, 사용자는 벤더가 제공하는 해쉬와 대형 언어 모델을 사용할 경우 더 많은 작업을 해결할 수 있다고 가정한다. 이

인기 태그