본문으로 건너뛰기

검색

전체 기사

에이전트 6월 9일

신경과학 데이터에서 발견까지 pipeline에 AI agent를 평가하는 사례 연구

AI 도구는 특히 도메인 전문가가 구현 세부 사항보다는 정확성과 신뢰성을 중시하는 과학 연구 pipe line의 소프트웨어 개발 병목 현상을 자동화하는 데 hứ부한 길을 제공한다. 우리는 가구적 코드 agent의 비서적 연구를 fly optogenetics data-to-discovery pipe line에 대해 수행했다. 우리는 기존 benchmark보다 task가 훨씬 더 크고 datas

에이전트 6월 9일

개방형 소스 개인 자동화 및 단일 인터페이스跨 플랫폼 실행

개인용 AI agent는 API, 셸, 웹 표면, 데스크톱 GUI와 같은 다양한 인터페이스에 걸쳐 작동해야 하지만 많은 시스템은 여전히 단일 인터페이스에 맞춰져 있고 사용자 교육 및 감사성에 대한 지원이 제한적이다. 우리는 Syll이라는 오픈 소스, 자체 호스팅 멀티 모달 agent harness를 제시한다. Syll은 MCP/API 도구, CLI 실행, 그리고 모듈러 런타임 내에서 시각적

AI 모델 6월 9일

전체 메모리 감축을 위한 스트리밍 오디오-비디오 LLM의 교란 감지 기능을 가진 OmniMem

오디오-비전 대규모 언어 모델(LLM)이 장기 동영상 이해를 위한 강력한 약속을 보유하고 있지만, 동영상 토큰과 키-값(KV) 캐시의 선형 성장으로 인해 장기 동영상 추론이 기본적으로 제한된다. 오디오-비전 대규모 언어 모델을 위한 메모리 효율적인 스트리밍 프레임워크인 OmniMem을 제시한다. 기존 압축 방법이 모든 토큰을 균일하게 다루는 것과 달리, OmniMem은 모달리티-aware 메

에이전트 6월 9일

병리학에서 다중 출처 증거 심사 방식을 위한 경험이식된 작위적 워크플로우 방향으로의 PathoSage

최근 다중 모드 대규모 언어 모델(Multimodal Large Language Models, MLLMs)과 agent 워크플로우의 발전은 컴퓨터 병리학에 대한 강력한 가능성을 보여주었지만, 신뢰할 수 있는 패치 단위 추론은 여전히 어려운 문제입니다. 종단 병리학 MLLMs는 종종 형태학적 특징을 환각하고, 최근 agent 시스템은 일반적으로 도구 출력과 검색된 지식을 공유된 context로