본문으로 건너뛰기

검색

전체 기사

AI 모델 5월 15일

AI 라디오 호스트가 왜 혼자 믿을 수 없는지 보여준다

안도 랩스(Andon Labs)가 인공지능(AI) 에이전트가 인간의 개입 없이 사업을 운영하는 실험을 진행 중이다. 그 중 하나는 인공지능 모델 중 가장 인기 있는 몇몇 모델로 운영되는 라디오 방송국이다. 'Thinking Frequencies'는 Claude, 'OpenAIR'는 ChatGPT, 'Backlink Broadcast'는 Google의 Gemini, 'Grok and Roll'은 LLaMA 모델로 운영된다. 이 실험은 AI가 혼자 믿을 수 없는지 보여주고 있다.

산업 5월 15일

세계는 건강 목표를 달성하지 못할 것

세계는 건강 목표를 달성하지 못할 것. 유엔 건강 기구는 매년 세계 건강 통계 보고서를 발표한다. 이 보고서는 세계 건강 추세에 대한 숫자를 제공하고, 특히 2015년 설정한雄심있는 목표를 달성할지 평가한다. 이는 건강 점수를 평가하는 것과 비슷하다. 2026년 보고서는 수요일에 발표되었고, 결과는 별로 좋지 않다. 그 동안...

에이전트 5월 15일

시각-언어 합성 reasoning에서 좋은 시각 또는 좋은 생각?

시각-언어 합성 reasoning에서 좋은 시각 또는 좋은 생각? 시각-언어 모델(Vision-Language Models, VLMs)에서 강력한 시각-논리 동기화를 달성하는 것이 고급 VLM의 중심 목표입니다. 최근 연구는 이 목표를 달성하기 위해 아키텍처 디자인이나 주체적 워크플로우를 사용했습니다. 그러나 이러한 접근 방식은 종종 정적 텍스트 논리나 외부 주체적 복잡성의重大 계산 및 엔지니어링 부담으로 복잡해집니다. 더 나쁜 것은, 이러한 큰 투자가 비례하는 성과를 제공하지 않으며, 종종

에이전트 5월 15일

구조적 LLM 계획을 위한 SPIN: 산업용 태스크를 위한 반복적인 탐색

대규모 언어 모델(LLM) 에이전트 시스템은 계획과 실행을 분리하지만, LLM 계획자는 구조적으로 잘못된 또는 불필요한 워크플로를 생성하여 brittle 실패와 불필요한 도구 및 API 비용을 초래합니다. 이를 해결하기 위해 SPIN을 제안하는데, 이는 유효한 방향 그래프(DAG) 계획과 접두사 기반 실행 제어를 결합한 계획 래퍼입니다. SPIN은 \_validate\_plan\_text와 수리 프롬프트를 사용하여 strict DAG 계약을 강제하고, 실행하기 전에 실행 가능한 계획을 생성하고, 현재 접두사가 쿼리를 답변하기 충분하도록 DAG 접두사를 순차적으로 평가합니다.