샘 알트만의 프로젝트 월드, Tinder를 시작으로 인간 확인제국을 확장한다.
월드가 개발한 Orb-centered anonymous verification 프로젝트가 관심을 끌면서, 월드는 새로운 파트너십을 통해 영향력을 확장할 계획이다. 이를 통해 Tinder와 같은 대중적인 플랫폼에 인간 확인을 도입할 계획이다.
AI / SIGNALS / KOREA
최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.
월드가 개발한 Orb-centered anonymous verification 프로젝트가 관심을 끌면서, 월드는 새로운 파트너십을 통해 영향력을 확장할 계획이다. 이를 통해 Tinder와 같은 대중적인 플랫폼에 인간 확인을 도입할 계획이다.
Anthropic은 최근 대규모 언어 모델(LLM)인 Claude Mythos Preview를 발표하여 정부의 반발을 가라앉히는 데 성공했다. 이 모델은 보안에 중점을 두고 있으며, 정부의 기대에 부응하는 것으로 평가되고 있다.
Tinder에서 orb을 통해 자신의 정체성을 확인하는 사용자에게 5개의 무료 인지도 보강이 제공될 예정입니다. 이 orb은 OpenAI CEO Sam Altman이 공동 창립한 World에서 처음으로 테스트되었습니다.
오픈AI가 Sora 비디오 생성 도구를 포기한 지 한 달 만에, 빌 피블스(Bill Peebles)가 오픈AI를 떠나는 소식이 들렸다. 오픈AI는 '사이드 퀘스트'를 피하기 위해 우선순위를 변경하고 있으며, 피블스의 떠남은 최근 변경 중 하나이다.
네안데르탈 человека와 인류의 교배 이론이 많은 사람들에게 관심을 끌고 있습니다. 이 이론에 따르면, 인류와 네안데르탈 인간이 교배를 한 결과, 많은 사람들이 내 안의 네안데르탈인이라는 개념을 가지고 있습니다. 하지만, 이 이론이 실제로 맞는 것일까?
미국 매사추세츠 공과대학교(MIT)에서 열린 파이데이 행사에서 30개의 파이를 만드는 과정에 대한 이야기를 소개합니다. Ellie는 파이데이 행사를 기획하고 30개의 파이를 만드는 과정을 담당했습니다.
미국과 세계 곳곳에서 AI 센터 프로젝트의 폭발적인 성장에 반대하는 현지 공동체가 반발하고 있습니다. 현지 법원, 공동체 활동, 정치인과 강력한 회의를 통해 일반 대중은 주요 센터 프로젝트의 취소에 강요하고 있습니다. 이로 인해 AI 초규모 제공자들은 수억 달러의 지연 비용을 부과받고 있습니다.
AI insiders와 일반인 사이의 격차는 점점 벌어지는 중이다. OpenAI는 다양한 분야의 앱과 쇼를 인수하고 있으며, 신발 회사도 AI 인프라스트럭처로 реб랜딩을 시도하고 있다. Anthropic은 공개적으로 공개할 수 없는 강력한 모델을 발표했다.
인간 중심 기술은 클라우드 디자인을 통해 비디자foo 설립자 및 제품 매니저 등 디자인 배경이 없는 사람들에게 아이디어를 더 쉽게 공유할 수 있도록 도와준다. 클라우드 디자인은 빠르게 시각화할 수 있는 기능이 있어 비즈니스 아이디어를 더 효과적으로 전달할 수 있다.
OpenAI가 금융 앱부터 토크 쇼까지 사들이고, 특정 신발 회사도 AI 인프라 플레이로 리브랜딩하는 가운데, 인공지능 전문가와 일반인 사이의 격차가 벌어지고 있다. Anthropic은 공개적으로 공개하지 않은 모델을 발표했지만, 충분히 공개할 수 있었다고 주장하고 있다.
인공지능(AI)은 피할 수 없는 것이라는 유혹이 다시 고개를 들었다. 최신 인공지능(AI)의 광기 시기跡으로, 신발 회사인 Allbirds가 인공지능(AI) 회사라는 것을 세계에 알렸고, 잠시 동안 주식 가격이 7배로 급등하는 일도 있었다. 뉴버드 인공지능(AI)의 이야기 같은데, 이번 주에 일어난 일들로 인해 우리는 이런 생각을 하게 되었다. 인공지능(AI)은 이미 최고점에 도달했을까, [...]
다이리 퀸은 미국과 캐나다의 수십 개 드라이브 스루에서 AI 챗봇을 도입하여 드라이브 스루 서비스를 빨리하고 고객이 주문에 더 많은 음식을 추가하도록 유도하고자 합니다.
인체제사적인 기기인 시카메라가 나쁜 AI 시가를 생성하는 기기입니다. 이 기기는 단순하고 애매한 디자인으로 인체제사적인 감각을 자아내며, 실제로도 구매를 고려할만큼 매력적입니다. 하지만 이 기기는 단순히 매력적일 뿐만 아니라, 나쁜 AI 시가를 생성하는 기기이기도 합니다.
여름 여행을 계획하고 적은 비용으로 즐기기 위해 구글의 최신 도구를 활용하세요. 구글의 도움으로 여행을 더 나은 방식으로 계획하고 다음 목적지에 대한 탐험을 시작하세요.
언어 모델(LLM)과 OCR(광학 문자 인식) 기술을 결합하여 다언어 OCR 모델을 개발할 수 있습니다. 합성 데이터를 활용하여 모델을 빠르게 학습시키고, 다양한 언어를 지원하는 모델을 구축할 수 있습니다.
로봇 연구자들은 과거에 인간의身体의 놀라운 복잡성을匹敵하거나 초과하길 꿈꾸었지만, 현실은 자동차 공장용 로봇 팔을 개선하는 것으로 끝났습니다. 로봇의 과학 소설적 꿈을 실현하기 위해 많은 연구자들은 C-3P0과 같은 로봇을 목표로 삼았지만, 그들은 Roomba와 같은 로봇을 만들었습니다. 로봇이 학습하는 방식은 과거와 현재의 역사에 대한 간략한 설명입니다.
기술 산업의传奇 인 스테워트 브랜드가 쓴 새로운 책 '모든 것을 고치는 의의'(Maintenance: Of Everything, Part One)가 나오고 있습니다. 이 책은 "유지 보수에 대한 시민화의 중요성에 대한 포괄적인 개요"를 제공하는 시리즈 첫 번째 책으로 promise합니다. 브랜드의 여러 전기 작가 중 한 명은 브랜드를 저항 문화와 사이버 문화의 핵심 인물로 묘사했으며, 브랜드는 '유지 보수'를 통해 우리에게...
지오 에이전트 벤치(GeoAgentBench)는 지리 정보 시스템(GIS)과 대규모 언어 모델(LLM)의 통합이 자율 공간 분석의 새로운 패러다임을 열고 있습니다. 그러나 이러한 LLM 기반 에이전트를 평가하는 것은 복잡한 공간 워크플로우의 특성으로 인해 어려울 수 있습니다. existing 벤치마크는 정적 텍스트 또는 코드 매칭에 의존하여, 동적 런타임 피드백과 공간 출력의 다중 모드 특성을 무시합니다. 이를 해결하기 위해, 우리는 지오 에이전트 벤치(GABench)를 도입합니다. GABench는 117 개의 원자 GIS 도구를 통합하여, 6 개의 핵심 GIS 도메인에서 53 개의 일반적인 공간 분석 과제를 제공합니다. 정확한 매개 변수 구성이 동적 GIS 환경에서 실행 성공의 주요 요인은 인식하고, Parameter Execution Accuracy(PEA) 지표를 설계하여, implicit 매개 변수 추론의 신뢰도를 측정합니다. 또한, Vision-Language Model(VLM) 기반 검증을 제안하여, 데이터-공간 정확도와 cartographic 스타일 준수도를 평가합니다. 매개 변수 불일치 및 런타임 이상 현상으로 인한 빈번한 과제 실패를 해결하기 위해, 우리는 Plan-and-React라는 새로운 에이전트 아키텍처를 개발하여, 전역 조정과 단계별 반응 실행을 분리합니다.
알파코트(AlphaCNOT)는 모델 기반 계획을 활용하여 CNOT 최소화를 위한 강화 학습 프레임워크입니다. 이 프레임워크는 Monte Carlo Tree Search(MCTS)를 사용하여 CNOT 최소화 문제를 계획 문제로 모델링합니다. 알파코트는 현재의 노이즈 인터미디에이트 스케일 양자 장치의 오류 확산을 줄이기 위해 양자 회로 최적화가 중요합니다.
대규모 언어 모델(LLM) 에이전트가 멀티 스텝 태스크에서 사고 저하, 루프, 드리프트, 고정 상태를 경험할 수 있으며, 이러한 현상은 어려운 태스크에서 30%까지 발생할 수 있다. 현재 해결책으로는 강제 단계 제한 또는 LLM-as-judge 모니터링이 있다. 이 연구에서는 인지 파트너(Cognitive Companion)라는 병렬 모니터링 아키텍처를 제안한다. 이 아키텍처에는 LLM 기반 파트너와 새로운 zero-overhead Probe 기반 파트너가 포함된다. 실험 결과, LLM 기반 파트너는 루프에 취약한 태스크에서 반복을 52-62% 줄일 수 있었으며, Probe 기반 파트너는 0%의 인지 오버헤드에서 평균 효과 크기가 +0.471이었다.
현재의 AI 시스템은 계획, 사유, 실행을 단일 프로세스로 처리하여 불필요한 지연, 에너지 소비, 그리고 행동 연속성을 깨뜨리는 문제를 가지고 있습니다. 새로운 아키텍처인 Tri-Spirit Architecture를 제안하여 계획, 사유, 실행을 각기 다른 컴퓨팅 서브스트레이트에 매핑하고 비동기 메시지 버스를 통해 조정하여 시스템의 효율성을 향상합니다.
원인 수준의 기계적 지역화는 모델의 내부 구성 요소가 그 모델의 행동을 결정하는 원인으로 지역화하는 것을 목표로 합니다. 이 연구에서는 Weight Patching이라는 새로운 방법을 제안하여 LLM의 지식 추출을 향상시키고자 합니다. Weight Patching은 두 개의 같은 아키텍처의 모델이 주어진 입력에 대해 동일한 지식을 표현하는지 여부를 판단하는 방법입니다.
GUI 에이전트의 실용적인 인터랙티브 벤치마크는 에코머천트 위험 관리에서 GUI 에이전트의 강력한 자동화 능력을 보여주지만, 기존의 인터랙티브 벤치마크는 주로 benign한 예측 가능한 소비자 환경을 타겟으로하고 있다. 고위험, 수사적 도메인인 실제 에코머천트 위험 관리의 효과성은 미흡하다. 이 틈새를 메우기 위해 RiskWebWorld라는 첫 번째로 현실적인 인터랙티브 벤치마크를 제시한다. RiskWebWorld는 8개의 핵심 도메인에서 생산 위험 제어 파이프라인을 통해 1,513개의 태스크를
대규모 언어 모델(LLM)을 기반으로 하는 자율적인 그래픽 사용자 인터페이스(GUI) 에이전트는 기기 사용자에게 디지털 자동화를 제공합니다. 그러나 리소스 제약이 있는 기기에서 배포하는 비용이 prohibitive 하기 때문에, 리소스 제약이 있는 기기에서 GUI 자동화를 위한 가볍고 확장 가능한 에이전트를 개발하는 것이 어려울 수 있습니다.