본문으로 건너뛰기

AI / SIGNALS / KOREA

AI의 다음 장면을
가장 빠르게 읽는 법

최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.

4,407개 기사 6시간마다 업데이트

최신 기사

산업 7월 23일

뉴욕 전망을 새롭게 바꿀 수 있는 전력 선이 장애를 만나고 있다.

7월 3일, 지역에서 열풍이 번진 가운데 뉴욕주의 전력망은 캐나다로부터 52 기가와트-시간의 전기를 수입했는데, 이는 그날 총 전력需求의約 9%를 충족하는 충분한 양이다. 그 중 일부는 퀘벡에서 퀸스까지 339마일을 달리는 champlain hudson power express (CHPE)라고 불리는 전력 선로를 통해 수입된 전력이다.

도구 7월 23일

지크벤치 7은 더 나은 벤치마킹을 위해 컴퓨터나 스마트폰을 더 힘들게 합니다.

프리메이트 랩스(Primate Labs)는 인기 있는 벤치마킹 도구인 지크 벤치(Geekbench)의 최신 버전인 지크 벤치 7(Geekbench 7)을 출시합니다. 지크 벤치 7에는 새로운 비디오 및 오디오 인코딩/디코딩 테스트, 다중 코어 테스트의 재설계 및 CPU 및 GPU가 처리할 수 있는 더 큰 데이터셋이 포함되어 있습니다. 지크 벤치 7은 지크 벤치 6과 외관과 동작이 거의 동일하

산업 7월 23일

요페(Yope)는 알고리즘이나 광고 없이 개인용 소셜 네트워크를 구축하기 위해 1.23억 달러를 huy었습니다.

Yope이라는 친구들과 가족의 사적인 그룹을 중심으로 성장중인 소셜 앱은 1억 2천 300만 달러의 시드 펀딩을 확보했다. 창립자들은 크리에이터와 알고리즘 기반 피드에 집중하기보다는 메신저, 사진 공유, 실제 세계 관계를 강화하기 위해 설계된 AI 기능을 바탕으로 작고 사적인 커뮤니티로 가는 소셜 네트워크의 미래를 믿고 있다.

허깅페이스 7월 23일

4비트 diffusion inference를 diffuser에 적용하기

Meta는 새로운 대화 AI 플랫폼인 Llama 2를 출시했습니다. 이 플랫폼은 Meta의 대규모 언어 모델(LLM) 기반으로 개발되었으며, 사용자들이 AI와 자연스럽게 대화할 수 있도록 설계되었습니다. Llama 2는 이전 버전의 AI와 달리 더 강력하고 유연한 대화 능력을 갖추고 있습니다. AI는 사용자들이 말하는 대로 질문을 던질 수 있고, 사용자들의 경험과 지식을 기반으로 새로운 아이

AI 모델 7월 23일

LLM agent를 위한 프로파일 그래프 메모리: 내재된 엔터티 간 전이의 이야기 프로필을 통해

장기 기억은 세션 간 상호 작용하는 LLM agent에 필수적이나 현재 기억 평가 지표는 주로 단일 hop recall를 평가하며, 다중 hop 연관은 거의 측정되지 않았다. 우리는 세 가지 contribution을 제시한다. 첫째로, 우리는 MemHop이라는 다중 hop 기억 평가 지표를 1,000 개의 질문과 hop 깊이 1-5, 10 개의 사회 네트워크 시나리오를 포함하여, per-ho

AI 모델 7월 23일

LISA: 선형 인덱스 스파스 주의(LISA) - 효율적인 장기 논리적 추론을 위한 새로운 기술

장기 논리적 추론 모델의 최근 발전으로 인해 테스트 시간 척도 패러다임 하에서 더 긴 추론 문맥 길이가 증가하고 있습니다. 그러나 표준 자기 주의의 O(n^2) 계산 복잡성으로 인해 장기-CoT 논리적 추론의 배포는 생산 환경에서 제한됩니다. 이를 해결하기 위해 우리는 LISA(LISA)를 제안합니다. LISA는 원래 모델에 플러그 앤 플레이 주의 대체 모듈로 사용할 수 있는 플러그 앤 플레이 주의 대체 모듈입니다. LISA는 원래 모델에 두 가지 가벼운 구성 요소를 병렬로 통합합니다: (1) 선형 주의 모듈이 장거리 기억을 제공하는 O(n) 시간 복잡도; (2) 광속 인덱서가 전체 문맥에서 토큰의 상위 M을 선택하여 광속 자기 주의에 입력합니다. 두 가지 Branch는 게이트 메커니즘을 통해 결합되며, n 토큰을 생성하는 데 O(n^2)에서 O(nM) (M << n)로의 예측 복잡성을 줄입니다.

AI 모델 7월 23일

확률적 프라임-듀얼 디코딩을 위한 다목적 생성 추천 시스템

추천 시스템(RS)의 최근 발전은 생성 모델링을 통해 상당한 성능 향상을 보여주었다. 실제로는 추천이 종종 아이템 속성을 정의한 제약이나 공정성 제약과 같은 여러 목표를 만족해야 하는 순서가 있는 아이템 목록인 슬레이트를 구성하는 데 관여한다. 존재하는 다목적 접근법은 대부분 비생산적 환경을 위한 후처리 기술에 의존하거나 모델 훈련에auxiliary 목표를 직접 통합한다. 후자는 대규모 시스

에이전트 7월 23일

도구 사용하는 LLM agent의 구조화된 런타임 안전성: NEXUS

대규모 언어 모델(LLM) 에이전트가 점점 더 큰 영향을 미치는 행동을 수행하기 때문에 실행 중 안전성을 감시하는 것이 필수적이 되었다. 우리는 NEXUS (Neural EXecution Utility and Safety)라는 구조화된 계획 안전 모니터를 제시한다. NEXUS는 공식적인 조치 정책을 적용하여 네 가지 행동 중 하나를 선택할 수 있다: 허용, 차단, 확인 요청, 또는 수정 요청

AI 모델 7월 23일

대형 언어 모델에서 정보 판단

기존의 검색 엔진을 대체할 대규모 언어 모델(LLM)은 인터넷과 같은 외부 지식 소스를 사용하기도 한다. 이 모델들이 정보를 적절히 가중치로 부여하며, 신뢰할 수 있는 소스를 더 많이 고려하고 (소스 판단력) 진실한 정보가 더 가까워질 때 claim을 더 많이 업데이트 하는가? 우리는 이 문제를 정보 판단력으로 정의하고, 세 가지 명제적 원칙에 기반한 interpretable metrics를

연구 7월 23일

스프레드시트 형식 전환을 위한 자연어를 활용한 자동 전환 시스템

세계적으로 수백만 명이 사용하는 스프레드시트 어플리케이션의 공식 작성은 여전히 큰 장벽이다. 기존 접근 방법은 정적인 지도 학습 데이터에 의존하는데, 이는 한정된 레이블링 데이터에 의해 빠르게飽和된다. 이 논문에서 우리는 FORMULASPIN이라는 자기 플레이 프레임워크를 소개한다. 이는 지도 학습의 초과fine-tuning의 한계를 깨뜨리는 자기 개선의 반복을 가능하게 하며, 추가적인 데이

LLM PC 7월 23일

인텔 TDX 하위 NVIDIA H100에서 신뢰할 수 있는 GPU 추론 성능 측정

기밀 처리는 sensitive한 입력을 처리하거나 사설 모델 자산을 보호하기 위해 AI 인식 작업을 위한 실질적인 배포 요구 조건이 되고 있습니다. 그러나 GPU 가속된 대규모 언어 모델 서비스를 위해 기밀 처리를 활성화하는 성능 비용은 작업 부하에 따라 달라지고 operationally 중요합니다. 이 논문은 NVIDIA H100 80GB GPU를 Intel TDX 기밀 인스턴스에 호스트한

에이전트 7월 23일

OpenEvoShield: 오픈월드 다중 agent 시스템 공격을 위한 이중 비정상 지속적인 방어

LLM 기반 다기능.agent 시스템(LLM-MAS)은 점점 더 안전한 애플리케이션에서 배포되고 있으며, 공격자가 서로간의 통신을 통해 해로운 행동을 퍼뜨리기 위해 악성 명령을 주입하는 공격을 받고 있습니다. 정적 위협과 달리 이러한 공격은 두 배의 동적 공격입니다. 공격자는 배포된 방어를 반영하여 주입 전략을 개선하고 정상 agent의 행동은 시스템 확장과 함께 드리프트합니다. 기존 방어는