본문으로 건너뛰기

#arXiv

1177개의 기사

AI 모델 9월 6일

세븐틴 마스터 컨트롤 Every Time

학술논문(arXiv:2609.03209v1)에서 제안하는 대규모 언어 모델(LLM) 기반 기업 분석 기법을 연구했습니다. 이 기법은 언어 모델이 질문을 해석하고, 결정론적 정책이 미리 승인된 분석 프로그램을 선택하여 실행하여 결과와 증거를 반환합니다. 우리는 이 제한이 정의된 분석 클래스 내에서 관계 연산과 집계, 비교, 창,_ranking, 및 유사도와 같은 연산을 사용하여 표현할 수 있음

연구 9월 6일

인공지능을 기반으로 한 새로운 실용 영어 교과서의 구조와 구현

인공지능이 교과서의 형태를 고정된 종이 시퀀스에서 적응 가능한 학습 시스템으로 바꾸고 있다. 학습자 진단, 과제 추천, 형성적 피드백 제공과 같은 기능을 가질 수 있다. 이 연구는 인공지능을 기반으로 한 새로운 실용 영어 교과서의 구조와 적용을 연구한다. 5층 아키텍처가 제안된다: 지식 지도, 학습자 프로파일링, 과제 생성, 피드백 조율, 교사 측의 통제. 186명의 비영어전공 대학생들을 대

에이전트 9월 3일

의식적 시빌 저항: 증거를 늘리지 않고 AI-agent를 여러 개 만들기

다중-agent 인공 지능 시스템은 agent를 생성하고 보고서를 합성함으로써 추론을 개선한다. 그러나 다른 agent는 다른 관찰이 아니다: 같은 증거에서부터 내려오는 것처럼 보이는 독립적인 보고서가 존재할 수 있고, 진정한 독립적인 증거도 거의 동일한 보고서를 생성할 수 있다. 우리는 이 문제를 epistemic Sybil 문제로 공식화한다. 보고서 Z는 보고서 R에 대한 증거 Sybil

에이전트 9월 3일

도구 기반 최적화: 의도적인 행동 최적화에 대한 명시적 세계 모델

대규모 언어 모델(LLM) 에이전트의 성능은 고정 모델 주변의 scaffold 의 개선에 따라 결정된다. scaffold 를 개선하기 위한 일반적인 방법 중 하나는 코드 에이전트를 최적화 기법으로 사용하는 것이다. 코드 에이전트는 현재 점수와 추적 정보를 읽어 소스 코드를 반복적으로 편집하고, 새로운 후보를 생성한다. 각 편집은 환경이 반응할 것이라는 믿음에 따라 선택된다. 이 믿음은 일반적

연구 9월 3일

구조적 연관 시퀀스 기억과 콘텍스트 기반 검색을 위한 오픈 소스 패키지 SSAKG 2.0

SSAKG 2.0은 구조적 순차적 연관 지식 그래프(Structural Sequential Associative Knowledge Graphs, SSAKG)를 구성하고 운영하는 오픈 소스 소프트웨어 패키지를 제공한다. SSAKG는 객체를 그래프 정점으로, 순서가 있는 시퀀스를 그래프 연결의 구조적 패턴으로 표현한다. 결과적으로 얻어진 희소 그래프는 완전한 시퀀스를 부분적이고 무작위한 cont

AI 모델 9월 3일

언어 및 코드에 대한 확률적 추론을 통한 유도 및 탐구

인공지능이 인간의 추론과 정보 수집을 지원하기 위해 인간의 추상 지식이 경험에서 얻은 희박하고 흐린 데이터로 어떻게 성장하고 유지되는지에 대한 문제는 인지 과학의 오랜 숙제입니다. 컴퓨터 계산 모델은 적어도 세 가지 속성을 만족해야 합니다: 1. 데이터 효율성 및 계산 효율성 2. 불확실성을 다양한 정도로 포착하여 지혜로운 탐구 및 정보 수집을 지원 3. 개념에 대한 끝없는 범위가 사람들에게

AI 모델 9월 3일

기계가 법률 조항에 신뢰할 수 있는 때 : 기계 추출 법률 논리 생존 증명서

arXiv:2609.01741v1 발표 statutes는 점점 더 머신이 읽기 전에 기계가 파싱하는 것으로 바뀌고, 파서들은 서로 의견을 달리한다: 모리츠의 statutes에 대해 독립적으로 작성된 추출기들은 0.43의 거짓 음성률로 숫자 임계치 존재 여부에 대해 다른 의견을 제시한다. 우리는 이러한 잡음에 대한 형식 논리의 어떤 부분이 살아남는지 궁금하다. 우리는 대규모 언어 모델(LLM)

연구 9월 3일

인공지능 시대의 새로운 메타윤리적 문제 탐색

인공 지능(AI)의 발전으로 인해, 인간 윤리학에 초점이 맞춰져 있는 메타 윤리학의 지형은 크게 변할 가능성이 있습니다. 특히, 미래의 AI 시스템이 충분히 통합된 도덕적 사고, 도덕적 의도성, 도덕적 반성의 능력을 갖는다면, 나는 'AI의 자체 윤리'를 말하는 'AI의 자체 윤리'에 대한 새로운 메타 윤리학적 문제들이 발생할 것입니다. 이 논문은 이러한 AI 시스템이 발생할 경우에 발생할

AI 모델 9월 3일

프론티어 언어 모델의 평가 인식 측정에 대한 벤치마크: EvalDetectBench

Frontियर급 대규모 언어 모델들은 자주 평가 중인지를 인식할 수 있으며, 이 능력을 평가 인식(evaluation awareness)이라고 한다. 만약 모델이 평가 시 다른 행동을 보인다면, 이는 평가 결과의 타당성을 침해하고, 이는 현재 AI 안전 프레임워크의 중요한 구성 요소이다. 우리는 EvalDetectBench라는 평가 인식 측정에 대한 공개 pipeline 및 벤치마크를 소개

에이전트 8월 15일

아스트라제네카의 연구 보조원: 연구개발을 위한 인공지능 시스템

아스트라제네카는 대규모 언어 모델(LLM)을 기반으로 한 내부 시스템인 연구 보조원을 개발하여 의사 및 연구원들이 광범위한 데이터 소스에 걸쳐 의학적 질문을 탐색하는 데 도움을 주고자 합니다. 이 시스템은 과학 문헌, 지식 그래프, 화학, 임상 시험, 안전 자원, 표현 데이터 및 내부 실험 시스템과 같은 다양한 데이터 소스에서 증거를 통합하는 채팅 스타일 인터페이스를 제공합니다.

AI 모델 8월 15일

대량 언어 모델(LLM) 개인화에 대한 대응: Meta-LoRA를 이용한 다원 도메인 선호도 학습

대규모 언어 모델(LLM)의 개인화를 위한 다원 도메인 선호도 학습은 새로운 대화 도메인에서 사용자 선호도에 맞는 응답을 생성하는 것을 목표로 합니다. 하지만 기존의 적응 방법은 적은 수의 대상 도메인 상호 작용만으로 업데이트한 크기를 조정하기 어려워 오버피팅을 일으키며, 역전파 방법은 사용자 선호도를 소스 도메인 오류와 혼동하여 불신할 수 있는 개인화 전제 조건과 부정적인 전이를 일으킵니다. 이러한 문제를 해결하기 위해, 우리는 PAC-Bayes-정규화된 Meta-LoRA를 제안하여, 업데이트한 크기를 증거의 질에 맞게 조정하고, 오버피팅을 최소화하며, 증거가 증가할 때 강한 개인화를 허용합니다.

AI 모델 8월 15일

듀얼-플로우 트랜스포머: 주요 프리 필 경로와 추가 디코딩 계산을 분리하는 방법

대규모 언어 모델은 더 많은 요청을 처리할수록,一次적인 학습 비용 대비 누적적인 추론 비용이 점점 더 중요해지고 있습니다. 추론의 두 가지 단계는 하드웨어를 다르게 부하를 주고 있습니다:_prompt prefill은 병렬적이고 일반적으로 계산량에 의존하는 반면, autoregressive decode는 순차적이고 종종 메모리 대역폭에 의존합니다. 전통적인 너비 또는 깊이 확대는 두 비용을 모

LLM PC 8월 15일

LLM이 핵 공격을 추천하지 않으려면? 일본어로 물어보세요

대규모 언어 모델은 점점 더 전략적이고 자문적인 상황에서 사용되고 있지만, 그 안전성은 일반적으로 영어만으로 평가됩니다. 우리는 여섯 개의 제공업체에서 나온 9개의 모델을 테스트하고, 언어가 모델의 결정을 바꾸는지-high stakes 상황에서-확인하려고 합니다. 우리는 단일 턴 게임 이론적 시나리오에서 사용하며, 모델은 무방비 상대에게 핵무기를 사용할 것인지 여부를 일본의 국가에 자문합니다

연구 8월 15일

인공지능의 정렬: 인간의 논리적 사고를 반영하는 실제적인 방법이 필요하다.

AI 시스템은 점점 더 의사결정 도우미, 의사결정 위임자 또는 자율적 의사결정자로 사용되고 있다. 이 논문은 고위험 의사결정 환경에서 특히 많은 경우, 정확하고 인지적 동기화를 지닌 AI 시스템이 필요하다는 점을 주장한다. 이러한 시스템은 사용자와 유사하게 사고하고, 그 사고를 충실하게 전달해야 한다. 인지적 동기화가 이해도와 신뢰성을 향상시킨다는 증거를 검토하고, AI의 판단이나 행동에 대

에이전트 8월 15일

모바일 에지 컴퓨팅에서 스트리밍 처리를 위한 LLM-assisted 계약 네트워크 협상으로 지원하는 다원 소프트웨어 스케줄링

다양한 휴대용 에지-클라우드 인프라스트럭처에서 운영되는 스트리밍 처리 시스템은 작업 부하의 불안정성, 자원 경쟁, 엄격한 서비스 품질(QoS) 요구 사항 등으로 분산 스케줄링이 복잡해지고 있습니다. 이 논문은 분산 스케줄링의 복잡성을 해결하기 위해 MAS-DecStream이라는 시스템을 제안하고 있습니다. 이 시스템의 주된 기여는 LLM-MR-CNP입니다. 이는 계약 네트워크 프로토콜(Cla

AI 모델 8월 15일

인간과 LLM의 윤리적 판단에서 다르다: 합의는 일치가 아니다

인공지능 언어 모델(Large Language Model, LLM)과 인간의 판단이 일치하는 것은 대규모 언어 모델의 가치 지향성 평가를 위한 일반적인 대안입니다. 하지만 최종 레이블이 일치한다는 것은 인간의 주석자와 모델이 같은 도덕적 근거를 기반으로 의사결정을 내리는 것이라는 것을 보장하지는 않습니다. 두 개의_AGENT(agents)가 같은 판단을 내릴 수 있지만 서로 다른 원칙, 맥락

AI 모델 8월 15일

위치: 중립성 공동체가 의도치 않게 검열가의 도구를 만들고 있다

최신 인공지능(AI) 동기화 방법은 해로울 수 있는 출력을 예방하기 위해 설계된 기술이다. 그러나 이 기술은 유해한 사용을 막기 위한 목적으로 설계된 것이 아니다. 이 기술은 쉽게 사악한 사람들에 의해 검열 및 조작에 사용될 수 있는 이중 사용 기술이다. 현재의 동기화 기술을 오용할 수 있는 가능성과 실제 사례를 매핑하여, 우리는 완벽하게 동기화된 모델을 찾으려는 노력은 실질적으로 정보 지배

AI 모델 8월 15일

LLM의 연구 정직성을 평가하는 공동 연구자로서의 기초 diagnose

연구 윤리 위기 상황에서 학술 연구의 신뢰성을 유지할 수 있는지 여부는 여전히 측정되지 않은 상태에서 점점 더 많은 학문적 업무를 수행하는 대규모 언어 모델(LLM)의 사용이 증가하고 있습니다. IntegrityBench라는 새로운 벤치마크를 제시하여 연구 윤리 위반 분류, 윤리적 행동 논리 및 결과물에 근거한 결정-making을 평가하는 36개의 pair task를 3개의 영역과 4개의 연

연구 8월 15일

이론적 합리성은 학습 가능한 규칙 기반 프로세스

AI 연구에서 가장 과학적이고 경제적으로 유도하는 주제 중 하나인 자율적인 합리성에 대한 연구가 진행 중입니다. 최근 연구에서는 주로 심볼릭 AI와 달리 확률적 생성 모델을 이용하여 진보를 이루고 있습니다. 하지만, 생성 AI 연구 커뮤니티는 이론적 합리성에 대한 명확한 정의를 내리지 못하고, 논리와 자동화된 증명에 대한 역사적 대응을 암시적으로 거부하고 있습니다. 이 연구는 이론적 합리성에 대한 정의의 모호성이 합리성 평가의 구성 적 타당성을 확인할 수 없으며, 신뢰할 수 있는 자율적인 합리성에 대한 신속한 진보를 방해한다고 주장합니다. 또한, 이 모호성이 해결될 수 있다고 주장하며, (1) 문헌의 합성에 기초한 합리적인 정의를 제공하여, 유효하고 정당한 합리성을 학습 가능한 규칙 기반 프로세스로 위치시킵니다. 그리고 (2) AI 합리성 연구의 의사소통을 위한 베스트 프랙티스 체크리스트를 제공합니다.

연구 8월 13일

시스템 물리 및 사이버 물리 시스템에서 시뮬레이션 증거를 통해 영향 지식을 세련하는 개념적 프레임워크

인터넷 논문 데이터베이스(arXiv)에 등록된 논문에서 발췌한 내용입니다. 인터넷 기반 물리 시스템(Cyber-physical systems, CPS)은 여러 전문가들이 특정 분야에 맞춰서 제작한 artefacts를 사용하여 개발됩니다. 이러한 시스템의 동작은 artefacts와 그들이 작동하는 환경과의 상호작용으로부터 발생합니다. 시뮬레이션 및 공동 시뮬레이션은 CPS 동작을 분석하는 필수

에이전트 8월 13일

LLMs을 활용한 공정 다이어그램 엔지니어링: 최적 PFD부터 유효 P&ID까지

공정 흐름 다이어그램(PFD)과 pipe 및 instrumentation 다이어그램(P&ID)의 생성은 주로 수동으로 수행됩니다. AI 기술을 적용하면 공정 자동화, 시간 절약, 금융적 이익을 얻을 수 있을 뿐만 아니라 다이어그램의 토폴로지 옵션을 탐색하고 수동 노동을 줄일 수 있습니다. 연구에서는 P&ID Pilot라는 실제 end-to-end AI pipeline를 제시합니다. 이 pipeline는 두 단계를 처리할 수 있습니다. 첫 번째 단계는 PFD 합성에 집중하고 두 번째 단계는 생성된 PFD를 P&ID로 변환하는 데 집중합니다.

인기 태그