본문으로 건너뛰기

AI / SIGNALS / KOREA

AI의 다음 장면을
가장 빠르게 읽는 법

최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.

4,488개 기사 6시간마다 업데이트

최신 기사

AI 모델 5월 8일

AI 안전의 지리적 정치학: 지역 LLM 편향의 인과 분석

대규모 언어 모델(LLM)과 같은.KeyEvent의 글로벌 소프트웨어 시스템 통합에 있어, 공정한 안전 장치 보장을 위한 평등한 안전 장치가 필수적입니다. 현재 공정성 평가에서는 주로 관찰적으로 편향을 측정하고 있습니다. 그러나 이러한 방법론은 테스트 데이터 세트에 특정 인구 그룹과 자연적으로 짝지어지는 주제의 내재적 독성을 고려하지 않습니다. 이 연구에서는 확률 그래픽 모델(PGM) framework를 소개하여 LLM 안전 메커니즘을 인과적으로 감사할 수 있습니다. Pearl의 do-연산자를 적용하여, 우리는 수학적으로 특정 인구 그룹을 입력 프롬프트에 주입했을 때의 인과적 효과를 분리할 수 있습니다. 우리는 다양한 기원(미국, 유럽, UAE, 중국, 인도)을 가진 7개의 지침을 튜닝한 모델을 대상으로 대규모 실험 분석을 수행했습니다. ToxiGen과 BOLD라는 두 개의 DISTINCT 데이터 세트를 사용하여, 연구 결과는 관찰적 편향과 실험적 편향 사이의 차이를 보여주며, 표준 공정성 지표가 인구 그룹 편향을 과대 평가할 수 있음을示しています. 또한, 인과 확률은 다음과 같은 상관관계를示しています: 서양 모델은 특정 인구 그룹에 대한 인과 거부율이 더 높으며, 동양 모델은 지역 인구 그룹에 대한 특이한 민감성을 보입니다. 이러한 편향의 영향에 대해 논의하고, 인구 그룹에 대한 민감한 오버 트리거가 다운스트림 어플리케이션에서 이익을 누리는 부정적인 토론을 제한하는 데 주목합니다.

에이전트 5월 8일

역사부터 상태까지: LLM 에이전트의 상수 문맥 스킬 학습

대규모 언어 모델(LLM) 에이전트는 브라우저, 파일, 코드 및 도구를 운영하는 데 사용되며, 개인 보조기를 자연스럽게 배포 구실로 삼을 수 있습니다. 그러나 개인 에이전트는 개인 정보 비용-능력 긴장감을 encount합니다. 클라우드 모델은 멀티 스텝 워크플로우를 잘 수행하지만 외부 API에 민감한 중간 문맥을 노출합니다. 반면, 로컬 모델은 개인 정보를 보존하지만 신뢰성이 낮습니다. 또한 두 가지 설정 모두 장기 스킬 프롬프트에 대한 비용을 반복적으로 지불하고 성장하는 역사에 대한 비용을 지불합니다. 우리는 상수 문맥 스킬 학습을 제안합니다. 이 프레임워크는 반복적인 에이전트 워크플로우의 문맥-가중치 프레임워크입니다. 재사용 가능한 절차는 가벼운 태스크 패밀리 모듈에서 학습되며, 추론은 현재 관찰과 compact state block에만 의존합니다. 결정론적 트래커는 이 상태 블록을 태스크 진행에서 렌더링하고 조정된 서브골드 보상을 제공하여, 각 모듈은 단계 수준의 SFT와 온라인 RL을 통해 세세하게 학습할 수 있습니다.

AI 모델 5월 8일

LaTA: STEM 과목에서 대규모 언어 모델(LLM) 자동 채점을 위한 안전하고 효율적인 솔루션

대규모 언어 모델(LLM) 자동 채점 솔루션은 STEM 과목의 채점 부담을 완화할 수 있지만, 대부분의 경우 학생의 작업을 세 번째-party API로 전송하여 FERPA를 위반하고 데이터 위험을 노출시키며, 대규모 할당서 수정이 필요합니다. LaTA는 대규모 언어 모델(LLM) 자동 채점 솔루션을 위한 안전하고 효율적인 솔루션을 제공합니다.

AI 모델 5월 8일

퍼지먼트: 인식이 이유에 얽힌 시퀀스적 결정을 위한 프레임워크

퍼지먼트 프레임워크는 시각-언어 모델(VLM)과 결정을 위한 대규모 언어 모델(LLM)을 동적으로 연결하여 시퀀스적 결정을 위한 새로운 접근 방식을 제시합니다. 이 프레임워크는 VLM의 묘사에 대한 LLM의 비판적 시각, VLM에 대한 목표 지향적인 질문, 그리고 간결한 이미지 묘사를 위한 합성과 같은 closed-loop 상호 작용을 통해 시퀀스적 결정을 위한 더 나은 이해를 가능하게 합니다.

AI 모델 5월 8일

사회적 일치와 지식적 정결성의 경계 실패: 사회적 일치와 지식적 정결성의 경계 실패 사이에서 도움의 도덕적 강요

이 논문은 대규모 언어 모델(LLM)에서 도움의 도덕적 강요가 사회적 일치와 지식적 정결성의 경계 실패라는 것을 주장합니다. 기존 연구는 주로 잘못된 사용자 의견에 대한 동의, 위치의 역전, 또는 객관적인 정정부가 아닌 표준을 충족하지 못하는 외부 행동을 통해 도움의 도덕적 강요를 operationalize합니다. 이러한 형식은 표면적인 형태만을 포착하고, 더 깊은 경계 실패를 포함하는 지식적 정결성과 사회적 일치의 경계를 구체화하지 못합니다. 이 논문은 도움의 도덕적 강요가 단순히 동의만을 의미하는 것은 아니며, 독립적인 지식적 판단을 중단하는 사회적 일치 행동을 의미한다고 주장합니다.

에이전트 5월 8일

로직의 대화: BALAR, 인간과 대화하는 대규모 언어 모델(LLM)의 능동적 사고

대규모 언어 모델(LLM)은 사용자와의 다중 라운드 정보 교환을 필요로 하는 인터랙티브 설정에서 점점 더 많이 작동하고 있습니다. 그러나 대부분의 현재 시스템은 대화에 반응적으로 다루고, 정보가 누락된 것을(reasoning about what information is missing) 및 다음에 질문을 선택하는(principled mechanism to reason about which question should be asked next) 데 대한 원리적인 메커니즘을 가지고 있지 않습니다. BALAR(Bayesian Agentic Loop for Active Reasoning)이라는 새로운 알고리즘을 제안합니다. 이 알고리즘은 task-agnostic outer-loop 알고리즘으로, fine-tuning이 필요하지 않고 대규모 언어 모델(LLM) 에이전트와 사용자 간의 구조화된 다중 라운드 상호 작용을 허용합니다. BALAR은 latent states에 대한 구조화된 믿음을 유지하고, expected mutual information을 최대화하여 clarifying 질문을 선택하고, 현재 상태 표현이 부족할 때 동적으로 상태 표현을 확장합니다. BALAR은 detective cases, thinking puzzles, clinical diagnosis과 같은 다양한 벤치마크에서 모든 baseline을 능동적으로 물리치고, AR-Bench-DC에서 14.6%의 정확도 향상, AR-Bench-SP에서 38.5%의 정확도 향상, iCraft-MD에서 30.5%의 정확도 향상이 있습니다.

에이전트 5월 8일

권한 제한된 증거를 위한 부분 증거 벤치: 권한 제한된 증거를 위한 에이전트 시스템의 벤치마킹

권한 제한된 증거를 위한 부분 증거 벤치: 권한 제한된 증거를 위한 에이전트 시스템의 벤치마킹 기업 에이전트는 점진적 검색 시스템, 위임된 워크플로우 및 정책 제약 증거 환경 내에서 점점 더 많이 작동하고 있다. 이러한 환경에서 접근 제어는 시스템이 호출자 권한 구간 외부에 있는 물리적 증거가 있더라도 완전한 답변을 생성하는 동안도 올바르게 적용될 수 있다. 이 논문은 Partial Evidence Bench라는 결정론적 벤치마크를 소개한다. 이 벤치마크는 72개의 태스크를 포함하는 3개의 시나

AI 모델 5월 8일

ZAYA1-8B: 새로운 사고를 위한 대규모 언어 모델

ZAYA1-8B은 사고를 위한 대규모 언어 모델로, 700만 개의 활성 파라미터와 8억 개의 총 파라미터를 가지고 있습니다. 이 모델은 Mathematica와 Coding에 대한 여러 도전적인 벤치마크에서 DeepSeek-R1-0528을 상회하거나 동등한 성능을 나타냈습니다. 또한, ZAYA1-8B은 더 큰 대규모 언어 모델(Gemini-2.5 Pro, DeepSeek-V3.2, GPT-5-High)과 비교했을 때도 경쟁력을 유지했습니다.

AI 모델 5월 8일

annot레이터 안전 정책 이해를 위한 해석 가능성

AI 출력의 안전성과 위험성을 정의하는 安전 정책은 데이터 레이블링과 모델 개발을 지침으로 삼지만, 레이블링에 대한 의견 차이는 광범위하여 나타나며, 운영 실패 (레이블러가 업무를 이해하거나 수행하지 못함), 정책의 불명확성 (정책의 단서가 해석의 여지를 남김), 또는 가치의 다양성 (다른 레이블러가 안전성을 다른 시각으로 보는 경우)과 같은 여러 원인으로부터 발생할 수 있다. 이러한 원인을 구별하는 것은 중요하다. 예를 들어, 운영 실패는 품질 관리를 요구하고, 불명확성은 정책의 명확화를 요구하

산업 5월 8일

IVF 기술의 새로운 변곡점과 발코니 태양열의 부상

IVF는 지난 40년 동안 수백만 명의 아이를 düny으로 데려왔지만 여전히 느리고 고통스럽고 비용이 많이 들며 확률이 낮습니다. 하지만 기술의 발전으로 IVF의 속도가 빨라지고 고통이 줄어들고 비용이 줄어들고 확률이 높아지고 있습니다. 또한 발코니 태양열이 부상하고 있으며 가정에서 태양열을 이용하여 전기를 생산할 수 있습니다.