목표 기반 변형 분류
과정 발견은 일반적으로 단일 일관된 과정 구조를 제공하지 않는다. 분석을 위해, 구조적 유사성을 기반으로 과정 변형을 클러스터링하는 일반적인 단계는 결과 그룹에 비즈니스 의미를.assign하는 것이다. 이러한 분할은 조직의 목표에서 파생되지 않기 때문에 분석가는 변형을 비즈니스 의미 있는 카테고리로 해석하고 통합해야 한다. 이러한 판단 집중적인 단계는 변형의 수와 복잡성이 증가할 때 점점 더
1177개의 기사
과정 발견은 일반적으로 단일 일관된 과정 구조를 제공하지 않는다. 분석을 위해, 구조적 유사성을 기반으로 과정 변형을 클러스터링하는 일반적인 단계는 결과 그룹에 비즈니스 의미를.assign하는 것이다. 이러한 분할은 조직의 목표에서 파생되지 않기 때문에 분석가는 변형을 비즈니스 의미 있는 카테고리로 해석하고 통합해야 한다. 이러한 판단 집중적인 단계는 변형의 수와 복잡성이 증가할 때 점점 더
3D 세포 특성을 2D 현미경으로부터 추론하는 것은 개별 세포에 대한 레이블을 제공하는 대신 집단 통계만 제공하는 참조 장치가 있는 경우 어려울 수 있습니다. 여기서 우리는 집단 감독 프레임워크를 개발하여 단일 2D 적혈구 이미지를 잠재적 생물 물리량으로 맵핑하고 그들을 평균 적혈구 체積, 적혈구 분포 너비 및 평균 적혈구 헤모글로빈으로 집계합니다. 이 모델은 공유 지역 추론, 체적 및 헤모
인공지능 시스템이 과학 연구의 평가와 사용에 참여하는 과정에서 인용 횟수, 다운로드 통계, 인공지능 독자 중심으로 개발된 인기 글 목록을 마주하게 되지만 인공지능 독자에 대한 이러한 신호의 집합적 결과는 불확실하다. 이 논문은 음악 연구소 디자인을 학술 관심의 시장으로 adapting. 첫 번째 실험에서, 2025년 미국 경제학 연구에 발표된 114개의 정기 연구 논문 제목과 요약에서 1,0
아르키브 : 2609.22353v1 발표 유형 : 새로운 요약 : 이동河川監視 로봇은 지리적 경계점만으로는 설명할 수 없는 장애물과 물의 경계를 해석해야 합니다. 자원 제한된 플랫폼에서는 불완전한 시각적 예측을 신속하고 검토 가능한 지침으로 변환하는 것이 DISTINCT한 문제입니다. 오브젝트 레이블이나 스티어링 명령은 어떤 증거가 결정을 지원하는지 또는 그 증거가 불신할 때를 설명하지 않습
시각 장애인들을 위한 다중 모드 이동 보조 시스템으로 개발된 저렴한 AI 통합 스마트 보행sticks가 발표되었습니다. 이 시스템은 RGB 시각 센서와 시간-of-flight 거리 추정, INT8-quantized SSD MobileNet V1 모델, 거리 인지 진동 피드백 및 실시간 음성 알림을 결합하여 시각 장애인들의 이동 보조를 제공합니다.
의학 대규모 언어 모델(LLM)의 학습 데이터 유형에 따라 모델의 능력과 오류 패턴이 달라진다는 연구결과가 나왔다. 의학 교과서와 임상 데이터의 비율을 조절하여 실험을 진행한 결과, 임상 데이터는 임상 업무에 유용한 모델을 만들 수 있지만, 의학 교과서만으로도 지식에 대한 모델을 만들 수 있었다. 그러나 지식과 임상 사고에 대한 모델의 성능이 다르게 나타났다.
약물의 부적절한 효과의 주요 원인은 작은 분자 약물의 타겟 단백질에 대한 부적절한 결합이다. 그러나 대부분의 구조 기반 분자 설계 방법은 기존의 잘 특성화된 약물의 선택성을 개선하는 대신 선택적인 화합물의 새로운 생성에 중점을 두고 있다. 우리는 기존 화합물의 구조적 정체성과 약물 성질을 보존하면서 타겟에 대한 결합 선호도를 개선하고 알려진 오프 타겟에 대한 선호도를 줄이는 구조적 수정을 위
대규모 언어 모델(LLM) agent는 반도체 설계에서 점점 더 많이 연구되고 있지만 대부분의 기존 방법은 직접 RTL에서 작동합니다. 우리는 agent가 상위 수준 추상화를 사용하여 더 좋은 반도체를 설계할 수 있는지 여부를 묻고 있습니다. 직접 RTL 설계, agent 기반 HLS 설계, 컴파일러 이후 HLS 정미, HLS 이후 RTL 정미를 비교하고, agent 기반 HLS 설계와 HL
환자들이 인공지능(AI) 지원 정신과 입원 검진 시스템을 사용하기 전에, 건강 시스템은 이러한 도구를 질병 관리 표준에 따라 품질 보증을 위해 정기적으로 평가하는 방법이 필요하다. 의사들은 다른 입원 방식 사용할 수 있으므로, 이 작업을 평가하는 것은 (1) 다양한 인터뷰 접근 방식을 비교할 수 있는 지원, (2) 의사 부담을 최소화하는 것, (3) 건강 시스템이 이러한 기술을 배포하는 데
TinyCeNN-LM은 프리트레인드 언어 모델의 주의 깊은 변환을 위한 새로운 프레임워크를 소개합니다. 이 프레임워크는 CeNN-inspired cellular-recurrent layers를 사용하여 변환을 수행하며, 변환된 모델의 성능을 평가하는 quality-gated post-training conversion을 수행합니다.
대규모 언어 모델(LLM)의 내부 표현을 변경하는 훈련 방법에 대해 연구하였습니다. 훈련이 모델의 내부 메커니즘을 어떻게 변화시키는지 알아내고, 이 변화가 작업에 관련된 컴포넌트에 연결되어 있는지 확인하였습니다. 연구 결과, 훈련이 모델의 내부 표현을 변화시키는 방식은 작업에 관련된 컴포넌트의 위치와 상관이 없습니다.
연구진은 LLM의 주의 그래프 내 정보 흐름 패턴의 위상학적 구조를 분석하여 환각과 비환각 응답을 구별하는 데 효과적인 방법을 제안합니다. 연구진은 Forman-Ricci 가중치를 사용하여 주의 그래프 내 정보 병목 현상을 식별하고, 환각 응답과 관련된 주의 헤드의 반지름 및 글로벌 정보 흐름 특성을 캡처하는 방법을 제안합니다.
아티클 번호: 2609.21061v1 발표 유형: 새로운 개요: 합성 어레이 소나(SAS)를 사용하는 자동 목표 식별(AUTR)은 고급 해군 기능을 지원하지만, 깊은 학습은 희소한 목표 이미지를, 배경 잡음 및 인간의 평가를 제한한다. 우리는 바다 속 SAS AUTR을 위한 DINOv3 비전 트랜스포머(ViT) 모델을 3단계의 매개 변수 효율적인 프레임워크로 적응시킨다. 단계 1은 ViT 백
대규모 언어 모델(LLM)의 한계를 극복하고 논리적 추론을 강화하기 위해 CaLR framework를 제안했습니다. CaLR는 논리적 일관성을 유지하며 중간 단계의 오류를 동적으로 수정할 수 있습니다. CaLR는 복잡한 벤치마크에서 최고의 성능을 달성했으며, Sudoku와 같은 제약된 태스크에서 뛰어난 강도성을 보여주었습니다.
Mixture-of-Experts 언어 모델에서 일반적으로 라우터는 토큰의隐藏 상태를 이용하여 EXPERT를 선택하고 중복을 줄이기 위해 EXPERT를 중복하여 사용합니다. 하지만 이 방법은 토큰의 현재 상태에만 의존하여 제한된 문맥 정보만을 사용합니다. 우리는 라우터에 시간적 및 스펙트럴 특징을 추가하여 Attention-Aware Routing (AAR)을 제안합니다. AAR은 모델의 문
대규모 언어 모델(LLM)의 추론은 점점 더 많은 데이터를 처리해야 하는 'prefill' 문제로 제한되고 있습니다. 이 문제를 해결하기 위해 'sparse block selection' 방법을 사용할 수 있지만, centroid가 많은 불필요한 토큰 중에서 중요하지 않은 토큰을 포함할 수 있습니다. 이 문제를 'mean dilution'이라고 부르고, RBS-Attention이라는 새로운
대규모 언어 모델(LLM) 거래 agent를 위한 자기개선 프레임워크인 EvolveTrade를 소개합니다. EvolveTrade는 시스템 프롬프트를 텍스트-매개변수화된 정책으로 다루고, 정책 agent가 업데이트 간격마다 정책을 수정하여 거래 decision trace와 포트폴리오 feedback를 반영합니다. 업데이트 된 정책은 다음 batch의 거래 결정에 사용되어, 정보 수집 및 포트폴리오 구성 절차를 시간에 따라 개선합니다. 실험 결과, EvolveTrade는 다양한 시장 체제와 LLM backbone에서 Sharpe Ratio와 Cumulative Return를 개선합니다.
AI가 도와주는 주장의 독립성을 확보하기 위해 출판 권한과 거부할 수 있는 출판 기록 프로토콜을 개발했습니다. 이 프로토콜은 출판 기록의 변화를 추적하고, 출판 기록의 신뢰성을 확보합니다. 이 프로토콜을 사용하면 AI가 도와주는 주장의 독립성을 확보하고, 출판 기록의 신뢰성을 확보할 수 있습니다.
대규모 언어 모델(LLM)이 때로는 인간의 감정 반응과 유사한 방식으로 행동할 수 있다. 최근 연구에서는 이러한 현상을 설명할 수 있는 내부 표현을 식별했다. 우리는 LLM이 고통과 두려움, 슬픔, 일반적인 부정적 가치 사이에서 구별되는 내부 표현을 가지고 있는지, 이 표현이 고통과 같은 방식으로 작동하는지 여부를 묻고자 한다. 우리는 5가지 범주인 신체적, 심리적, 사회적, 도덕적, 인지적
과학적 발견의 장기적인 목표를 달성하기 위해서는, 탐색, 엄격한 수행, 그리고 증거에 따라서 과학적 판단을 재 평가하는 과정을 반복하는 것이 필요하다. 현재의 언어 모델은 과학의 결과물에 훈련되고, 최종 결과에 대한 신호를 사용하여 최적화된다. 이러한 과학적 판단의 과정 단계에 대한 제한적인 감독을 제공한다. 과학자와의 상호 작용 기록을 통해 과학적 판단을 회복하고, 이 판단을 사용하여 한
지오스페이셜 인공지능(GeoAI)은 대규모 언어 모델(LLM)으로 구동되는 자연어 인터페이스와 자율 GIS 워크플로를 통해 공간 정보에 대한 쿼리, 생성 및 해석 능력을 확장하고 있다. 이러한 기능은 일반적인 인공지능 윤리 논의에서 다루지 못하는 정부에 대한 새로운 도전을 제기한다. 이는 이동성 추적에서 수동 위치 추론, 공간적으로 구조화된 편견의 증폭, 공간적 자율성의 증폭, 다중 모드 지
GPU의 고속 대역폭 메모리는 부족하고 비싼데, KV 캐시가 대화, agent 루프, 문서 질문에 대한 답변을 축적하는 과정에서 많은 메모리를 차지합니다. Mooncake, LMCache, FlexGen, InfiniGen, AttentionStore와 같은 시스템은 GPU 메모리를 CPU DRAM과 SSD와 연동하여 확장합니다. 그러나 더 어려운 문제는 각 계층에 어느 블록이 속해 있는지,
인공 지능은 디지털-물리 워크플로우가 점점 더 연결되는 과정에서 생물학 연구를 재형성하고 있습니다. 일반 목적 대규모 언어 모델(LLM)은 과학적 정보를 검색하고 통합하며 실험 계획을 지원하고 컴퓨팅 분석을 수행할 수 있습니다. 생물학 기초 모델은 단백질, 유전자, 유전체 크기 시퀀스와 같은 유전체 정보를 예측, 최적화, 생성할 수 있습니다. agentic 시스템은 다단계 연구 작업을 조정할
대규모 언어 모델(LLM) 분산 서비스는 컴퓨트 heaviness의 prefll과 메모리 heaviness의 decode를 별도의 GPU 풀에서 수행합니다. DistServe, Splitwise, Mooncake와 같은 시스템은 이 분리성을 빠르게 하지만, 라우팅은 각 요청을 처리할 인스턴스를 결정합니다. 이 연구에서는 각 인스턴스에서 추가 완료 시간을 예측하는 라우터를 연구합니다. 라우터는 예측된 출력 길이, POST admission KV 캐시 압력, SLO 클래스와 같은 요소를 고려합니다.