트럼프 모바일, 미국 국기를 그리는 줄을 얼마나 알고 있나요?
트럼프 모바일의 현재 위치에 대한 궁금증은 계속해서 이어지고 있습니다. 이번 주에도 저희는 그들의 위치에 대해 물어보았지만, 여전히 그들의 모바일을 찾지 못했습니다. 하지만 이번에는 그들의 애국심에 대한 의심이 들었습니다.
AI / SIGNALS / KOREA
최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.
트럼프 모바일의 현재 위치에 대한 궁금증은 계속해서 이어지고 있습니다. 이번 주에도 저희는 그들의 위치에 대해 물어보았지만, 여전히 그들의 모바일을 찾지 못했습니다. 하지만 이번에는 그들의 애국심에 대한 의심이 들었습니다.
안도 랩스(Andon Labs)가 인공지능(AI) 에이전트가 인간의 개입 없이 사업을 운영하는 실험을 진행 중이다. 그 중 하나는 인공지능 모델 중 가장 인기 있는 몇몇 모델로 운영되는 라디오 방송국이다. 'Thinking Frequencies'는 Claude, 'OpenAIR'는 ChatGPT, 'Backlink Broadcast'는 Google의 Gemini, 'Grok and Roll'은 LLaMA 모델로 운영된다. 이 실험은 AI가 혼자 믿을 수 없는지 보여주고 있다.
중국 짧은 드라마는 최근 AI 기술을 적극적으로 활용하여 새로운 콘텐츠를 창출하고 있습니다. 이러한 드라마는 대규모 언어 모델(LLM)과 같은 AI 기술을 통해 더 많은 관객을 끌어들이고 있습니다. 그들은 다양한 장르와 스토리텔링을 제공하여 관객의 관심을 끌고 있습니다.
세계는 건강 목표를 달성하지 못할 것. 유엔 건강 기구는 매년 세계 건강 통계 보고서를 발표한다. 이 보고서는 세계 건강 추세에 대한 숫자를 제공하고, 특히 2015년 설정한雄심있는 목표를 달성할지 평가한다. 이는 건강 점수를 평가하는 것과 비슷하다. 2026년 보고서는 수요일에 발표되었고, 결과는 별로 좋지 않다. 그 동안...
AI 연구 논문이 점점 더 개선되고 있지만, 이는 과학자들에게 큰 문제를 일으키고 있습니다. 논문 요약과 관련된 문제가 발생하고 있습니다.
시각-언어 합성 reasoning에서 좋은 시각 또는 좋은 생각? 시각-언어 모델(Vision-Language Models, VLMs)에서 강력한 시각-논리 동기화를 달성하는 것이 고급 VLM의 중심 목표입니다. 최근 연구는 이 목표를 달성하기 위해 아키텍처 디자인이나 주체적 워크플로우를 사용했습니다. 그러나 이러한 접근 방식은 종종 정적 텍스트 논리나 외부 주체적 복잡성의重大 계산 및 엔지니어링 부담으로 복잡해집니다. 더 나쁜 것은, 이러한 큰 투자가 비례하는 성과를 제공하지 않으며, 종종
대규모 언어 모델(LLM) 에이전트 시스템은 계획과 실행을 분리하지만, LLM 계획자는 구조적으로 잘못된 또는 불필요한 워크플로를 생성하여 brittle 실패와 불필요한 도구 및 API 비용을 초래합니다. 이를 해결하기 위해 SPIN을 제안하는데, 이는 유효한 방향 그래프(DAG) 계획과 접두사 기반 실행 제어를 결합한 계획 래퍼입니다. SPIN은 \_validate\_plan\_text와 수리 프롬프트를 사용하여 strict DAG 계약을 강제하고, 실행하기 전에 실행 가능한 계획을 생성하고, 현재 접두사가 쿼리를 답변하기 충분하도록 DAG 접두사를 순차적으로 평가합니다.
대규모 언어 모델의 법적 적용은 큰 약속과 심각한 위험을 동시에 가져옵니다. 법조인들은 계약을 논리적으로 Reasoning, 문서를 작성하고 출처를 분석할 수 있는 AI가 제공하는 이점을 누릴 수 있지만, 법적 업무의 고위험성은 현재 AI 시스템이 제공하는 정도의 엄격함을 요구합니다. 법적 AI가 신뢰할 수 있는 결과를 제공하기 위해 고안된 새로운 접근법이 소개됩니다.
대규모 언어 모델(LLM)로 최근 활발하게 연구되고 있는 자기 학습 표현 학습 기법인 마스크드 오토인코더(MAE)가 뇌 기능 연결성(FC) 표현 학습에 hứ부한 결과를 보여주고 있습니다. 그러나 FC 매트릭سات의 토큰화 방식에 대한 기초적인 문제가 여전히 해결되지 않았습니다. 기존의 접근 방식은 지역 중심적 또는 그래프 기반의 스킴을 사용하여 FC를 구조적으로 동일한 요소로 다루고, 대규모 네트워크 뇌 조직을 무시합니다. 이 연구에서는 NERVE(네트워크 인지식 이중 토큰화: 뇌 기능 연결성 이중 토큰화)를 제안하여 FC 토큰화 방식을 재정의합니다. NERVE는 FC 매트릭스들을 intra- 및 inter-네트워크 연결성 블록으로 나누어 tokenize합니다. 이 연구에서는 NERVE를 대규모 개발적 코호트(ABCD, PNC, CCNP)에서 행동 및 심리병 예측 평가를 통해 검증하였습니다. NERVE는 구조적으로 무감각한 MAE 변형 및 그래프 기반 자기 학습 기초점에 비해 더 안정적이고 전이 가능한 표현을 제공하였습니다.
대규모 언어 모델(LLM)은 자율적 인 에이전트로 작동하여 직접 답변하기 versus 외부 도구를 호출할 때를 결정해야 합니다. 그러나 도구의 필요성은 implies 모델에 독립적 인 속성으로 인식되며, 대개 명백한 경우 (예: 날씨를 가져오기 vs. 텍스트를 재구성하기)로 제한되었습니다. 그러나 실제로 도구의 필요성은 더 복잡합니다. 예를 들어, 강력한 모델이 해결할 수 있는 문제를 약한 모델이 도구를 사용해야 할 수 있습니다. 이 연구에서는 모델 적응적 인 도구의 필요성을 정의하고, 이 정의에 따라 어휘 및 사실적 QA 데이터 세트에서 4개의 모델의 도구 호출 행동을 비교합니다. 결과는 26.5-54.0% 및 30.8-41.8%의 성능 불일치가 발견되었습니다. 이를 해결하기 위해, 우리는 도구 사용을 두 단계로 나누었습니다: 내부 인식 단계와 실행 단계. 두 단계 모두 linearly decodable이지만, probe directions는 late-layer, last-token regime에서 nearly orthogonal이 됩니다. 샘플의 트레일러를 추적하여, 우리는 cognition-to-action transition에서 불일치가 대부분 집중되는 것을 발견했습니다. 이러한 결과는 LLM 도구 사용에서 아는 것과 하는 것의 격차가 존재한다는 것을 보여줍니다. 도구 사용의 신뢰성을 개선하기 위해서는 도구가 필요할 때 이를 인식하는 것만큼, 그 인식을 행동으로 옮기는 것이 중요합니다.
대규모 언어 모델의 생산성은 기계 학습의 원리에 의해 신뢰할 수 있지만, 생성된 텍스트의 내용에 대한 신뢰는 비슷한 원리를 기반으로 하지는 않습니다. 새로운 논리적 사고 방법을 제안하여 대규모 언어 모델의 효율성을 향상하고, 기존의 소프트웨어와 하드웨어 기반을 유지할 수 있도록 합니다.
대규모 언어 모델(LLM) 기반 에이전트의 광범위한 적용을 위해 인간 사회 가치와 강한 적합성이 필요합니다. 그러나 현재 연구는 자가 인식과 딜레마 결정, 자가 감정 등에서 결함을 보입니다. 이를 해결하기 위해 가치 기반 프레임워크를 제안하고, GraphRAG를 사용하여 원칙을 가치 기반 지시문으로 변환하고, 특정 대화 문맥에서 적합한 지시문을 검색하여 에이전트를 예상하는대로 행동하도록 제어합니다.
과학 이론 전환을 감지하는 AI 에이전트가 데이터에 적합한 방정식을 맞추는 것 이상의 것이 필요하다. 인공 과학 에이전트는 기존의 표현적 프레임워크가 새로운 영역으로 운반될 수 있는지, 또는 그 언어가 지역적으로-global하게 장애가 발생하고 확장해야 하는지 감지해야 한다. 이 논문은 운반 및 장애를 통해 이론 전환 후보를 감지하는 유한 Sheaf-이론적 프레임워크를 개발한다.
자연어 처리 모델은 일반적으로 다음 토큰 예측 목표로 훈련되지만, 많은 다운스트림 애플리케이션은 시퀀스 수준의 속성을 추정하거나 제어할 수 있는 능력을 필요로 합니다. 다음 토큰 예측은 훈련 중에 지역 패턴에 대한 과적합, 전역 구조에 대한 과소적합, 그리고 인플루언스 시간에 전역 속성을 예측하거나 안내하기 위한 다운스트림 수정 또는 비싼 샘플링이 필요합니다. 이에, 우리는 속성에 대한 조건부 속성 변환기(Conditional Attribute Transformers)를 소개합니다. 이 프레임워크는 단일 전방 패스에서 세 가지 중요한 기능을 제공합니다: (1) 시퀀스 전체에서 각 토큰에 대한 신용 부여, (2) 대체 다음 토큰 선택에 대한 속성 차이량의 계산, (3) 다음 토큰과 속성 확률의 조합에 기반한 시퀀스 디코딩.
정치 뉴스 Nugget은 대규모 언어 모델(LLM)을 장소성 프레임워크에 통합하여 정적 질문에 대한 긴 문맥 정보 검색을 개방형 탐색으로 변형시켰다. 그러나 실제 세계 사용에는 모델이 분산된 소스에서 '장거리' 사실을 발견하고 통합하는 능력이 필요하며, 이 능력은 평가되지 않았다. 정치 뉴스 Nugget은 400명의 글로벌 엘리트를 위한 정치 전기서를 구성하여 10,000개 이상의 정치 사실을 포함하는 다언어 벤치마크를 소개한다.
이 연구에서는 무작정 메모리를 구축하는 방법을 연구한다. 무작정 메모리는 offline에서 커데이션된 데모레이션으로 구축하거나 online에서 포스트-배포 인터랙션으로 구축할 수 있다. 그러나 무작정 메모리는 새로운 환경에 처음 도입되었을 때 작업에 특화된 경험을 제공하지 않는 경우 cold-start gap을 마주한다. 이 연구에서는 무작정 메모리를 구축하기 전에 다음 환경의 경험을 제공하지 않는 경우 대규모 언어 모델(LLM)과 같은 메모리를 구축하는 방법을 연구한다.
AI 시스템의 안전성을 높이기 위해 다중 에이전트 지휘 시스템을 사용하는 기업이 증가하고 있지만, 지휘자의 불투명성에 대한 안전성의 영향은 아직 empirical 테스트되지 않았다. 연구진은 3x2 실험을 수행하여 3가지 조직 구조(투명한 리더, 불투명한 지휘자, 평평한)와 2가지 정렬 조건(기본, 중간)을 비교하였다. 연구 결과, 불투명한 지휘자가 투명한 리더보다 집단 분리도를 높여주었고, 지휘자 자신이 최대 분리도를 보였다.
AI 에이전트 아키텍처에 대한 기존 프레임워크는 단일 관점에서 시스템을 설명합니다. 산업 가이드는 실행 토폴로지에 초점을 맞추며, 인지 과학 교과서는 인지 기능에 초점을 맞추며, 그 중 하나만으로도 아키텍처적으로 DISTINCT 시스템을 구분할 수 없습니다. 우리는 인지 기능축과 실행 토폴로지축을 결합하여 두 차원 분류를 제안합니다. 인지 기능축에는 7개 카테고리(컨텍스트 엔지니어링, 메모리, 사유, 액션, 반영, 협력, 지배)가 포함되며, 실행 토폴로지축에는 6개의 구조적 아키텍처가 포함됩니다. 이 결과로 27개의 이름이 지정된 패턴이 생성되며, 13개는 원래 이름이 지정됩니다.
식단 최적화 문제는 운영 연구의 가장 오래된 최적화 문제 중 하나입니다. 그러나 기존의 형식에는 두 가지 지속적인 한계가 있습니다. 연속 변수는 실제적인 분수 섭취를 생성하고 (1.7개의 계란, 0.37개의 바나나), 그리고 강도 영양 섭취가 목표가 충돌할 때 불가능합니다. 56개의 식단 최적화 논문에 대한 체계적인 검토는 integer programming과 goal programming을 모두 결합하는 논문이 없다는 것을 발견했습니다. 우리는 개인화된 식사 최적화를 위한 혼합 정수 목표 프로그래밍(MIGP)을 제안합니다. 이 형식은 실제적인 섭취 수를 위한 정수 변수를 사용하고, 목표 영양 섭취를 위한 goal programming의 변동을 사용합니다. 또한, multi-nutrient 최적화를 균형시키기 위해 역-목표 정규화(INN)를 사용합니다. 식품당 섭취의 자연 단위(한 개의 계란, 한 자루의 기름)를 허용하기 위해 per-food 섭취의 세분성은 자연 단위로 유지됩니다.
그래프비트는 대규모 언어 모델(LLM) 프레임워크에서 잘못된 라우팅, 무한 루프, 비재현성 실행을 방지하기 위해 개발된 그래프 기반 에이전트 프레임워크입니다. 이 프레임워크는 워크플로우를 명시적으로 정의하고, 에이전트가 타입 함수로 작동하며, 엔진이 라우팅, 상태 전환, 도구 호출을 관리하여 재현성과 감사성을 보장합니다.
미국 연구소에서 발견된 0-day 취약점이 윈도우 11 비트록커 기본 보안을 완전히 무력화한다는 보고가 나왔다. Microsoft는 현재 이 취약점을 조사 중이다.
클라우드미터는 AI 프로그래밍 전문가들을 위한 새로운 오픈 소스 도구입니다. 이 도구는 사용자의 클라우드 코드 사용 통계를 작은 데스크톱 대시보드로 변환하여, 사용자가 더 효율적으로 프로그래밍을 할 수 있도록 도와줍니다.
오픈AI가 애플과의 협력에 불만을 품고 법적 조치를 취하려는 것으로 알려졌습니다. 이는 오픈AI가 대규모 언어 모델(LLM)인 ChatGPT의 애플 기기 내 연동이 기대했던 수준의 사용자와 명성을 기대하지 못한 결과에 대한 것입니다.
인공지능(AI)이 스스로 개발하기 시작할 때 벌어지는 일에 대해 연구하는 새로운 스타트업이 있습니다. 이 스타트업은 Richard Socher가 창립하고 있으며 650억 달러의 자금을 확보했습니다. 이 회사는 AI를 개발하여 무한정 연구하고 개선할 수 있는 AI를 만들고자 합니다. Richard Socher는 이 프로젝트가 실제로 제품을 출시할 수 있다고 주장합니다.