AI는 전략적 충돌에 준비되어 있지 않다
AI는 전략적 충돌을 위해 준비되어 있지 않다고 주장합니다. AI는 대규모 언어 모델(LLM) 기반의 사회적 시뮬레이션을 통해 적대자, institution, 상승, 계획의 취약성, 교전의 원칙, 위기 대응 등을 모델링할 수 있습니다. 하지만 이러한 AI는 전략적 충돌을 위한 계획, 교전의 원칙, 정책, 위기 대응 등에 사용하기 전에 안전성을 입증할 수 있는 사례를 확보해야 합니다.
1177개의 기사
AI는 전략적 충돌을 위해 준비되어 있지 않다고 주장합니다. AI는 대규모 언어 모델(LLM) 기반의 사회적 시뮬레이션을 통해 적대자, institution, 상승, 계획의 취약성, 교전의 원칙, 위기 대응 등을 모델링할 수 있습니다. 하지만 이러한 AI는 전략적 충돌을 위한 계획, 교전의 원칙, 정책, 위기 대응 등에 사용하기 전에 안전성을 입증할 수 있는 사례를 확보해야 합니다.
질서와 안정성을 유지하기 위해 즉시 구조 방위를 위한 시스템이 필요해졌습니다. 효과적인 구조 방출 시스템은 위협 노출을 최소화하면서도 적대적 불확실성과 사람 밀집 현상을 고려해야 합니다. 현재 문헌에서 제시된 방법들은 레이아웃에 특정 정책에만 제한되어 있으며 대규모 레이아웃에서 계산적으로 처리하기 어렵습니다. 실제 지침은 단순히 피해자들에게 "달리기", "숨기기", 또는 "싸우기"라고만 조언
연구에서는 다음의 실제적인 문제를 다룹니다: .freeze된 언어 모델의 출력에 오류가 있는 경우, 작은 수정 모듈이 오류를 수정할 수 있을까요? 오류 수정이 기초적인 기능을 저하하지 않도록 할 수 있을까요? CRN v2를 제안합니다. 이는 4.65억 텍스트 모듈의 약 0.73%인 34M trainable 매개변수를 가지고 있는, 로짓 수준의軽량 오류 수정 모듈입니다. CRN v2는 Gemm
연구자들은 새로운 매개변수 삭감 기법을 개발했다. 이 기법은 모델 공간 내에서 미분 기하학 거리를 사용하여 출처되었다. 매개변수를 삭감하는 것은 매개변수의 값을 0으로 설정하는 것을 의미하며, 매개변수가 사라진 초평면으로 모델을 이동하는 것을 나타낸다. 매개변수가 사라진 초평면까지의 최소 거리는 모델 공간에서 피셔 정보 기하학 기약을 통해 자연스럽게 계산된다. 이 거리는 실제 모델의 변경과
작고 강력한 언어 모델(SLM)을 이용한 오케스트레이션은 대규모 언어 모델(LLM)과 비교하여 더 낮은 연산 비용과 더 빠른 응답 시간을 제공합니다. 그러나 SLM의 제한된 용량과 맥락 창은 장기적인 논리적 추론과 상호 작용-heavy 오케스트레이션 전략을 제한합니다. 이에 대한 해결책으로, 비대면 오케스트레이션 전략을 제시하고, 이에 대한 기계 학습 동적 기계 학습 프레임워크 OrchSLM을 개발합니다.
기업의 인공지능(AI) 도입률은 전 세계적으로 78%에 이르렀지만, 그에 따라서 규제를 수립하고 시행하는 인프라가 따라가지 못하고 있습니다. 이 논문은 규제 기간 내에 감사할 수 있고 변조의 증거를 제공할 수 없는 감사 증거를 생산할 수 없는 조직을 유지하는 구조적인 조건을 '증명 부족'이라고 합니다. 스탠퍼드 2026 AI 지수 보고서(362건의 사례), IBM/Ponemon 2026 데이
인공지능(AI) agent가 장기 목표를 달성하는 데 사용되는 기록의 양이 증가하고 있다. 이러한 기록 내에서 실패를 진단하는 것은 신뢰성에 필수적이기 때문에 결과 단계의 신호를 행동 가능한 조치를 변환시킨다. 이러한 데이터의 규모가 인간의 검토를 실용적으로 만들지 않기 때문에, 자동화된 원인 인식 Attribution (RCA)의 필요성이 생겼다. 그러나 대규모 언어 모델(LLM)을 사용한
타임 시리즈 멀티 모달 대규모 언어 모델(TS-MLLMs)은 최근 대규모 언어 모델(LLMs)의 추론 능력을 활용하여 질문-답변 작업을 수행하기 시작했습니다. 그러나 이러한 모델들은 종종 동적 시간 패턴을 포착하지 못하고, 고위험 응용 프로그램인 의료와 같은 경우에는 암시적 추론만 제공하여 중요한 설명을 제공하지 못합니다. 반복 학습(RL)-기반 타임 시리즈 언어 모델은 이러한 문제를 해결하
연구자들이 이전에 개발한 방법을 기반으로 새로운 과학적 질문을 탐구할 수 있도록 지원하는 LabAgent를 제안했습니다. 이 LabAgent는 이전 연구의 결과를 정확하게 재현하고, 새로운 연구를 진행하는 데 도움을 줄 수 있는 메커니즘을 제공합니다.
대규모 언어 모델(LLM) agent는 인간의 개입 없이 장기간의 물리적 작업을 자동으로 관리하는 데 hứ부한 길을 제공합니다. 그러나 물리적 작업은 agent가 환경을 지속적으로 관찰하고 결과적인 행동을 하며 환경이 변하는 동안에도 효과를 유지해야 합니다. 기존의 방법은 대부분 대규모 데이터와 재학습을 필요로 하거나 주로 가상 세계에서 작동하는 agent에 초점을 맞추고 있습니다. 이 연구
AI 생성된 출력물을 평가하고 개선하기 위해 점점 더 많이 사용되는 대규모 언어 모델(LLM) 심사관의 신뢰성은 복잡한 전문 업무에 대해 아직 rõ하지 않습니다. 우리는 AI-agent 평가를 위한 끝에서 끝까지 특허 출원 테스트베드를 통해 이 문제를 연구합니다. 분리된 LLM 심사관이 생성된 특허 초안을 평가하고 반복적인 수정을 위한 구조화된 feedback를 제공합니다. 다중 발명물과 d
자기 개선의 재귀적 특성은 이전에 정의되지 않은 새로운 인공지능 프레임워크를 제안합니다. 이 연구는 반복적인 정책 개선과 재귀적 자기 개선을 한 가지 학습 패러다임의 두 가지 사례로 묘사하는 새로운 공식 프레임워크를 제안합니다.
Multi-목적 베이지안 최적화(MOBO)는 여러 목적을 가진 비결정적 함수를 최적화하는 효율적인 접근 방식입니다. MOBO의 목표는 파레토 전면을 충분히 근사화하는 것입니다. 즉, 1) 좋은 수렴성(파레토 전면 근접성)과 2) 좋은 다양성(파레토 전면에 걸쳐있는 다양성)을 갖춘 높은 품질의 해결책 집합을 얻는 것입니다. 기존의 MOBO 방법들은 일반적으로 이러한 두 가지 과제를 동시에 해결
ZGCM-1은 열린 웹을 비롯한 다양한 데이터를 처리할 수 있는 효율적인 기초 모델입니다. 이 모델은 내부적인 사고와 외부 도구 사용을 결합하여 파라미터 용량 제한을 극복합니다. ZGCM-1은 수학적 추론 및 의사결정 탐색에서 경쟁력을 유지하는 대규모 언어 모델(LLM)과 비슷한 성능을 나타냅니다.
회의 지속을 위해는 장기 다인 회의에서 agenda 추적, 발언자 역할, 참여자 의도 및 불일치 추적이 필요하다. 우리는 2,207 개의 실세계 회의와 24,794 개의 미래 지향적 쿼리에서 Meeting Dynamic Forecasting Benchmark(MDFB)를 소개한다. 회의 전면과 활성 질문이 주어졌을 때, 모델은 한 번의 호출로 가능성 있는 다중 회전 연속성을 생성한다. 우리는
LLM이 사용하는 드래프트-검증-수정 Pipe라인을 통해 의사소통의 암묵적 모호성 문제를 해결할 수 있는지 연구한 결과, GPT-5.2와 Gemini 3 Pro가 높은 성능을 보였다. 그러나 Pipe라인의 오류가 발생할 경우, 모호한 의사소통이 재발할 수 있으므로, Pipe라인의 설계에 주의가 필요하다.
arXiv:2609.12139v1 발표 형식: 새로운 abstract: 원자층 증착(Atomic Layer Deposition, ALD)과 원자층 에칭(Atomic Layer Etching, ALE)은 재료 과학에서 실험과 시뮬레이션 문헌에서 공통적으로 보고되지만, 비교와 기계가 작동할 수 있는 재사용을 방해한다. 우리는 ALD와 ALE 실험 및 시뮬레이션 과정에 대한 네 개의 도메인 전문가
지식 그래프 임베딩(Knowledge Graph Embedding, KGE) 모델을 편집하여 원하는 답변을 추천하는 것만으로는 올바른 답변을 목록에서 밀어내는 문제를 해결하지 못할 수 있다. 단지 편집된 매개 변수를 재사용하는 사실만을 기반으로 하는 지역성 테스트는 rank-displacement 효과를 놓칠 수 있다. 우리는 세 가지 범위에서 공통 rank-displacement 감사 절차
파라미터 효율적인 이중 U-형 신경 연산자 DU-NO를 소개합니다. 이 모델은 근해 역학에서 높은 정확도를 제공하는 FUNWAVE-TVD와 같은 파동 모델의 비용을 줄이는 데 도움을 줄 것입니다. DU-NO는 U-FNO와 같은 대규모 언어 모델(LLM)과 비교하여 10배 적은 파라미터로 더 높은 정확도를 제공합니다.
학습된 기계 학습 모델이 실제로 중요한 수치적 결정을 내리려면 대규모 언어 모델(LLM)의 발전이 필요하다는 가정은 일반적이다. 예를 들어, 가격 위험을 평가하는 것, 자본을 배분하는 것, 환자들을 분류하는 것, 또는 네트워크 침투를 방지하는 것과 같은 결정은 언어 모델의 발전으로부터 나와야 한다. 그러나 언어 모델은 인간이 세계를 설명한 표현에 훈련된 것이다. 이 설명은 수치 기록의 손실적
Hy브리드 예측에서 언어 모델은 여러 신호 중 하나일 때 자주 사용된다. 시스템은 이미 시장, 대중, 통계적 예측을 가지고 있어 모델이 유용한 정보를 제공하는지 여부를 결정해야 한다. 따라서 독립된 모델 정확성보다는 상대적 compétence, 즉 모델이 제공하는 외부 예측의 외재적 예측 외에 추가적인 가치가 있는지 여부가 중요하다. 브라이어 손실(Brier loss)에서, 모델의 불일치가
심장 질환의 진단은 ECG, 초음파 카디오그래피, 흉부 엑스레이, 임상 변수 등 각기 다른 부분이지만 상호 관련된 심장 생리학의 측면을 포괄하는 다양한 방법들을 통합하는 것으로 나아간다. 그러나 대부분의 의료 기초 모델은 모드별로 구분되어 있으며, 대부분 모드별로만 학습이 진행되어야 한다. 이러한 방법은 임상진료사들이 자연스럽게 통합하는 교차 모드 증거를 무시하고, 각 모드 내의 구조를 무시
대형 언어 모델(LLM)을 조작하는 시스템인 '해쉬'(harness)가 개발되었다. 이 해쉬는 대형 언어 모델과 함께 사용되는 도구, 프롬프트, 제어 흐름으로, 대형 언어 모델을 자율 소프트웨어 개발자로 변형시킨다. 해쉬는 각 벤더가 대형 언어 모델과 함께 사용하는 해쉬를 제공하며, 사용자는 벤더가 제공하는 해쉬와 대형 언어 모델을 사용할 경우 더 많은 작업을 해결할 수 있다고 가정한다. 이
AI 연구팀은 협업 프론티어 35B 지능력에 도달하는 열린 비용-성능 경계선을 구축하기 위해 새로운 모델인 코캄미-1.0을 발표했습니다. 이 모델은 복잡한 워크플로우를 수행하는 데 있어 효율성을 높여서 더 많은 모델 호출을 처리할 수 있습니다.