본문으로 건너뛰기

AI / SIGNALS / KOREA

AI의 다음 장면을
가장 빠르게 읽는 법

최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.

4,454개 기사 6시간마다 업데이트

최신 기사

에이전트 6월 11일

트리서커: 트리 구조화된 실패와 되돌아가는 깊은 검색

트리서커는 깊은 검색에서 제어된 실패와 되돌아가는 framework를 제안합니다. 트리서커는 트리 구조화된 상태에서 branch-and-return search를 사용하여 탐색을 조직합니다. 트리서커는 textual UCB signals를 사용하여 promising branch, uncertain alternative, 또는 unproductive continuation을 선택합니다. 트리서커는 실패와 되돌아가는 loop를 지원하기 위해 evidence, uncertainty, conflicts, progress, 및 failure cues를 attached branch에 저장합니다.

연구 6월 11일

촉각 지식 reasoning을 개방된 세계에 적용하기 위한 대규모 데이터 및 행동 인식 표현을 사용한 TOUCH THINKER

손감각은 상호작용하는 agent가 물리적 세계를 이해하는 데 중요한 모달리티입니다. 최근 연구에서는 손가락 신호를 언어 시스템에 통합하여 촉각 지식 reasoning을 수행했지만, 실용적인 개방 세계 환경으로 이러한 시스템을 확장하는 것은 두 가지 주요 지연 요인으로 인해 어려움을 겪고 있습니다. (1) 현재 촉각 지식 reasoning 데이터셋은 형식과 규모에서 제한적이기 때문에 촉각 관찰

에이전트 6월 11일

슬라이딩 윈도우 주의형 강화 학습이 수학적 추론에서 주의형 주의를 경쟁력 있는 것으로 만듭니다.

논문 제목: arXiv:2606.11634v1 논문 요약: 합리적이고 의사결정적인 대규모 언어 모델(LLM)의 속도는 빠르게 향상되었지만, 이에 따라 긴 문맥에 대한 추론의 필요성이 증가했습니다. 그러나 SELF-ATTENTION(SA)이 문맥 길이에 비례하여 성능이 향상되므로, 이에 대한 해결책을 찾기 위해 SWARR(Sliding-Window Attention with Reinforced

에이전트 6월 11일

HERO: 환경 관찰을 통한 주체적 자기 분리(self-distillation) 위한 후향적 개선된 반영(Reflection)

강화 학습은 일반적으로 경로의 종료 결과를 통해 멀티 턴 에이전트 기능을 향상시킵니다. 이로 인해 각 중간 턴에 대한 크레딧 assignments를 결정하는 것이 어렵습니다. 최근 정책 기반의 자가 distillation 방법은 유리한 feedback를 token-level supervision으로 변환하여 자가 교사와 같은 promising 대안을 제공합니다. 그러나 이 패러다임을 멀티 턴

에이전트 6월 11일

Agent 능력 조직이 런타임 동작을 어떻게 변경하는지 측정하는 방법

arXiv:2606.11543v1 발표 유형: 새로운 요약: Agent Skills은 추론 시 절차 지식에 대한 대규모 언어 모델(LLM) agent를 증강하지만, 현재 벤치마크는 Skill이 말하는 내용과 구성이 어떻게 다른지 거의 구별하지 못합니다. 우리는 Progresssive Disclosure를 통해 이 구별을 연구합니다. Progresssive Disclosure는 짧은 루트 파일

에이전트 6월 11일

금융 및 수치 연산 reasoning을 위한 Market-of-Claims Code Agent: MoCA-Agent

금융 및 표 형식 질문에 대한 답변은 유창한 논리만으로는 충분하지 않다. 답변은 정확한 사실, 공식, 단위, 부호 및 척도를 기반으로 하여야 한다. 단일 잘못된 행 또는 잘못된 연산이 조용히 합리적인 하지만 오류인 결과를 생성할 수 있다. 우리는 \textsc{MOCA-Agent}라는 시장의 요구 사항에 따라 코드 에이전트를 소개한다. 이 시스템은 자유 형식의 다중 에이전트 토론을 claim

에이전트 6월 11일

장기 연구 요원에 대한 학문적 탐구의 영역

연구 자동화.agent가 이제 과학적 후보자를 평가하고 선택할 수 있으며, 그 평가 기준은 일반적으로 지역, 슬라이스 또는 집단의 다각화된 공간에서 합산된 값입니다. 하지만 과학적 유효성이 이러한 분산 구조에 존재할 경우, 합산된 값은 잘못된 후보자를 최우선 순위로 매길 수 있습니다. 헤드라인 숫자가 향상되면서 구조 underneath가 뒤집히기 때문에, 숫자에 기반하여 결정한 경우에는 qu

LLM PC 6월 11일

미래 행동 예측을 학습 과제로 보다

인공지능 시스템에 대한 신뢰는 시스템이 어떻게 작동하는지 설명을 통해 종종 기반을 두고, 설명을 통해 새로운 입력에 대한 시스템의 행동을 예측한다. 그러나 대규모 추론 모델(LLM)에서 이 전통적인 경로는 특히 추론 단위 하나의 생성에 대한 설명 방법이 자연스럽게 장거리 경로로 일반화되지 않으며, 경로 자체가 자연어로 읽히면 종종 신뢰할 수 없는 경우가 많다. 따라서 우리는 설명 단계를 생략

에이전트 6월 11일

인프라마인드: 인프라웨어 멀티 에이전트 오케스트레이션

인프라마인드는 현재의 멀티 에이전트 LLM 오케스트레이션 방법의 한계를 보완하는 새로운 프레임워크입니다. 인프라마인드는 실시간 시스템 부하와 남은 예산에 따라 모델과 역할 선택을 조건화하여 더 간단한 그래프를 부하가 심한 경우와 더 풍부한 그래프를 부하가 낮은 경우에 선택합니다. 또한, 인프라마인드는 각 에이전트 단계에서 모델별 큐 깊이, 캐시 사용률 및 응답 지연 시간을 관찰하여 어떤 모델을 호출하고 얼마나 깊게 논리를 reasoning 하여야 하는지 결정합니다.

에이전트 6월 11일

인간 협상 자동 매개자: 구조화된 LLM PIPE라인을 통해 협상 전 매개

인간 협상 이전에 발생하는 준비 단계인 미디어션(pre-mediation)은 양측이 공정한 합의를 달성하기 위한 중요한 역할을 하지만 비용, 시간, 전문 미디어터에 대한 접근 제한으로 인해 자주 누락된다. 우리는 직접 인간 협상 이전의 미디어션을 자동화하는 시스템을 제시한다. 이 시스템은 대규모 언어 모델(LLM) 모듈로 구성된 구조화된 pipe-line으로 구현되어, 통합 협상 환경에서 미

에이전트 6월 11일

자기 조절적 명확성 요청 시기 판단: 계층적 언어 agent를 위한 자기 조절적 명확성 요청

인공 지능이 계층적인 사고에서 실패를 겪을 때, 그 실패는 종종 중간에 결정점에서 발생하는데 그 이유는 agent가 잘못된 branch에 집착하는 것이고 그 이유는 agent가 중요한 정보가 부족하다는 것을 인식하지 못하기 때문이다. 그러한 clarify를 외부 불확실성 트리거로 다루기보다는, ACTION-RATING이라는 새로운 형식을 제안한다. 이 형식은 agent의 행동 공간 내에 cl

에이전트 6월 11일

인공지능.agent가 과학적 결론을 합성할 수 있나요?

과학적 인공지능(AI) agent는 증거를 검색하고, 출처를 통해 논리적으로 연결하고, 결과를 합성하여 중요한 결정을 내리는 데 점점 더 많이 사용되고 있습니다. 그러나 의료 분야와 같은 높은 책임의 영역에서 이를 수행할 수 있는 능력은 불분명합니다. 우리는 SciConBench라는 9.11K개의 질문과 전문가가 쓴 체계적 검토를 통해 얻은 결론을 사용하여 개방형 도메인 과학적 결론 합성을

AI 모델 6월 11일

AGI의 토대는 hippocampal 명시적 기억: 대규모 언어 모델(LLM)의 한계를 넘어

대규모 언어 모델(LLM)이 다양한 업무에서 놀라운 능력을 보여주면서 인공 일반 지능(AI) 개발에 대한 기대가 높아지고 있습니다. 하지만 LLM의 학습 메커니즘은 인간의 암묵적 기억과 매우 유사하며, 이는 AGI를 달성하기 위한 높은 계층적인认知 기능, 즉 장기 전략 계획, 메타인지, symbol reasoning을 암묵적 통계 학습만으로는 충분히 구현할 수 없다는 것을 의미합니다.

AI 모델 6월 11일

explicit한 요소에서 암시적 의도까지: 의사 결정 가능한 행동 추론을 위한 사전 정의 라이브러리

arXiv:2606.11207v1 발표 형식: 새로운 내용 SemantiClean을 소개합니다. 이 모듈식 프레임워크는 전자상거래 세션 데이터에서 구조화된 의미론적 신호를 추출하고 구매 의도, 고객 구분, 제품 친화도와 같은 플러그인 추론 목표를 위한 공유 요소 라이브러리를 통해 추론합니다. 전통적인 종단-종단 예측기가 오로지 정확도만 최적화하는 것과 달리, SemantiClean은 감사성,

산업 6월 11일

스τερο이드 올림픽과 더 안전한 미토스

이것은 현재의 다운로드(The Download)입니다. 이는 매일 기술 세계에서 무슨 일이 일어나는지 알려주는 주간 뉴스레터입니다. '스테로이드 올림픽'은 무대가 되었고, 우리 문화의 창틀을 열었습니다. -아미트 카트발라(Amit Katwala) 몇 주 전, 5000만 달러짜리 경기장(arena)으로 casino 주차장에서 지어졌습니다. 그곳은 유튜브(Youtube)의 CEO 사장(CEO)가