본문으로 건너뛰기

AI / SIGNALS / KOREA

AI의 다음 장면을
가장 빠르게 읽는 법

최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.

4,407개 기사 6시간마다 업데이트

최신 기사

AI 모델 7월 20일

메모에서 유해한 웃음을 감지하고 설명하는 다각적인 사고:

인터넷 메모는 시각적 단서, 텍스트 콘텐츠, 그리고 문화적 배경을 함께 조합하기 때문에, 이중 의미와 해괴함이 함께 존재하는 상황에서는 특히 해석하기 어려운 것이다. 이러한 복잡성을 고려할 때, 정확한 분류와 인간이 이해할 수 있는 설명을 제공하는 설명 가능한 메모 이해 시스템이 필요하다. 그러나 기존의 다모드 분류기는 이러한 상호 의존성을 무시하거나 해석 가능성을 제한적으로 제공한다. 이

에이전트 7월 20일

코딩_AGENT 들은 ARC-AGI-3을 해결하기 위해 실행 가능한 월드 모델, 단순화, 및 검증이 필요합니까?

연구자들은 이전 연구에서 개발한 인공지능 agent인 ARC-AGI-3 agent가 성능을 향상시키는 데 어떤 요인이 중요한지 밝히기 위해 네 가지 nested Codex-based agent를 개발했습니다. 이 네 가지 agent는 텍스트 기반 baseline, 유연한 인터페이스 executable world model, 동일한 executable model에 scheduled simpli

AI 모델 7월 20일

건설 도면에서 다중 깊이 시각-문서적 추론을 위한 실제 세계 벤치마크: DrawingVQA

DrawingVQA라는 새로운 벤치마크를 소개합니다. 이 벤치마크는 대규모 언어 모델(LLM)들을 실세계의 건설 도면에 대한 멀티 모달 평가에 사용하기 위해 설계되었습니다. 건설 도면은 건축, 토목, 그리고 여러 다른 공학 분야에서 핵심적인 미디어입니다. 자연 이미지나 스키마틱 플랜과 달리, 건설 도면은 추상적인 기하학, символ 표기법, 표 형식의 데이터, 주석, 그리고 특정 분야의 텍

에이전트 7월 20일

Local, Multi-Agent 음성_assistant with LLM 계획, 형식화된 실행자, 그리고 적응적인 복구

데스크톱 음성 보조 프로그램은 여전히 클라우드 pipe라인에 의존하고, 기계에서 raw 오디오를 ship하고, 고정된 set의 스킬을 노출합니다. 우리는 AnovaX라는 작은 local-first 보조 프로그램에 대해 설명합니다. AnovaX는 사용자의 컴퓨터에서 완전히 작동하고, 데스크톱 자체를 액션 서피스로 다룹니다. 하나의 Python 프로세스는 wake-word 게이트, Speech

에이전트 7월 20일

Cure 1T: 의료 서비스에 특화된 주도적 건강관리 모델

건강 관리는 고위험 의사소통, 전문가의 사고력, 업무 처리를 포함한다. 그러나 이러한 용도를 모두 다룰 수 있는 특화된 대규모 언어 모델(LLM)은 아직 많이 없다. 건강 관리 모델은 환자 상담, 텍스트와 이미지에 대한 임상 사고력, 상호 작용 진단, 전자 의료 기록(EHR) 도구 사용을 처리해야 한다. 이러한 기능은 서로 다른 방식으로 실패하고, 한 업무를 위한 좁은 업데이트는 다른 업무를

AI 모델 7월 20일

대상에 대한 원인 chain 구성으로부터 명시적이고 감사 가능한 그래프 기반 추론

유사관계와 바탕이 되는 원인 메커니즘을 이해하는 것을 넘어서 추론을 할 수 있는 대규모 언어 모델(LLM)의 발전을 위해 원인적이고干섭적인 질문에 대한 답변은 필수적이다. 그러나 현재까지 존재하는 LLM 기반의 방법들은 종종 암시적인 언어 수준의 추론에 의존하여 투명하지 않은 원인적 가정, 검증할 수 없는 추론 경로, 복잡한干섭 상황에서 약한 예측을 낳는다. 특히, 문맥이 없는 상황에서는 더

에이전트 7월 20일

시퀀셜 진단을 위한 비용-aware 지식 강화 다중 agent 프레임워크: GraphDx

아카이브: 2607.15280v1 발표 형식: 새로운 요약: 순차적 진단은 반드시 진단 정확도와 자원 비용을 균형있게 유지하기 위해 반복적인 정보 수집을 통해 달성해야 합니다. 현재 대규모 언어 모델(LLM) 접근 방식은 지식-사고 격차를 보입니다: 광범위한 의학 지식을 인코딩함에도 불구하고, 자원 제약하에 논리적으로 사고하기 어려워 초과 테스트를 자주 하게 됩니다. 우리는 GraphDx라는

AI 모델 7월 19일

대이브 에거스(Dave Eggers)는 오픈에이아이(OpenAI) 직원들에게 챗GPT가 '전체 세대가 침묵하는 것을 막았다'고 말했습니다.

올해 전에 OpenAI 직원 약 200명에게 강연을 하도록 초청한 샘 알트만(Sam Altman)은 저자 데이브 이거스(Dave Eggers)를 초청했습니다. 그는 무수한 소설, 영화脚本, 저널리즘 작품을 썼으며, McSweeney's를 창립했으며 작가와 예술을 더 광범위하게 지원하는 여러 학교와 비영리 단체를 설립했습니다. 그래서 그는 회사 사무실에 들어와 […]

산업 7월 18일

모든 독자가 필요한 앱, 기기 및 도구

안녕하세요 친구들! Installer No. 136에 오신 것을 환영합니다. 이곳은 세계에서 가장 좋은 것과 Verge-iest 것에 대한 안내서입니다. (만약 여기 처음 오신다면, 환영합니다. 내 동네는 너무 煙霧가 가득해서 걱정되지만, 오래된 모든 판을 Installer 홈페이지에서 읽으실 수 있습니다.) 이번 주, 나는 Version History [...]의 다음 시즌을 녹음했습니다.

도구 7월 18일

틱톡이 AI를 이용한 유사도 감지 도구를 시험 중에 있습니다.

틱톡은 AI와 유사한 특징을 스캔하고 그에 대한 신고를 받을 수 있는 옵션 도구를 테스트하기 시작했습니다. 소셜 미디어 컨설턴트 매트 나바라(Matt Navarra)가 발견한 바에 따르면, 이 도구는 처음에는 미국의 일부 크리에이터에게 테스트를 시작할 예정입니다. 틱톡 미국 대표자 Зак키저(Zachary Kizer)는 더 버지지(The Verge)에게 "일부" 미국 크리에이터에게 테스트를