본문으로 건너뛰기

구글의 새로운 가이드드 비전 기능, 글자 하나하나를 읽어드립니다.

구글의 새로운 기능 '가이드드 비전'은 사용자에게 실시간으로 음성 설명을 제공하여 작은 글자나 환경을 설명하는 등 다양한 기능을 제공합니다. 또한, 사용자에게 주변 물체를 찾거나 식별하는 데 도움을 줄 수 있습니다.

AI 자동 생성

구글의 새로운 가이드드 비전 기능

구글은 최근 새로운 기능인 '가이드드 비전'을 출시했습니다. 이 기능은 사용자에게 실시간으로 음성 설명을 제공하여 작은 글자나 환경을 설명하는 등 다양한 기능을 제공합니다. 사용자들은 자신의 카메라를 공유함으로써 구글의 AI가 작은 글자를 읽거나 주변 물체를 설명하는 데 도움을 줄 수 있습니다.

가이드드 비전 기능은 가중치 조정된 대규모 언어 모델(LLM)과 함께 개발되었습니다. 이 기능은 사용자들이 작은 글자를 읽거나 주변 환경을 설명하는 데 도움을 줄 수 있습니다. 또한, 사용자들이 주변 물체를 찾거나 식별하는 데 도움을 줄 수 있습니다.

가이드드 비전 기능의 장점

  • 실시간 음성 설명을 제공하여 작은 글자나 환경을 설명합니다.
  • 주변 물체를 찾거나 식별하는 데 도움을 줄 수 있습니다.
  • 사용자들이 작은 글자를 읽거나 주변 환경을 설명하는 데 도움을 줄 수 있습니다.

가이드드 비전 기능은 현재 구글의 가메라 라이브(Gemini Live)에서 사용할 수 있습니다. 이 기능은 호환되는 안드로이드 기기에서 사용할 수 있습니다.

원문 보기 The Verge AI

함께 읽으면 좋은 기사

AI 모델 6시간 전

텍스트를 이미지로 전환하는 확산 모델에서 만족도-다양성 경계를 넘나들다.

텍스트-이미지 생성은 사용자가 같은 프롬프트에서 생성된 여러 이미지를 탐색할 수 있도록 한다. 이러한 생성된 이미지가 유용하려면, 사용자가 선호하는 것을 측정하는 학습된 보상에 따라 각 이미지가 반영되어야 하며, 다른 이미지를 유지하기 위해 시각적으로 다른 모습을 보여야 한다. 기존의 방법은 한계가 있다: 보상과 다양성을 따로 다루거나, 그들을 한 개의 집계 점수로 결합하여, 보상이 낮은 것

AI 모델 6시간 전

행동하기 전에 선택하기: 장기적인 도구 사용 요소에 대한 상대적 가치 추정

대규모 언어 모델(LLM)은 복잡한 작업을 수행할 때 장거리 도구 호출 시퀀스에 의존하는데, 각 호출은 작업 상태를 변경하고 다음 결정에 영향을 줄 수 있다. 장거리 도구 사용 시, 최종 결과 보상을 통해 장기적인 상호 작용 트레이스에 대한 약한 신뢰할 수 있는 할당이 제공되지만, 단계별 보상은 더 표적화된 피드백을 제공할 수 있다. 그러나 신뢰할 수 있는 단계별 감독을 얻기 위해 종종 인간

AI 모델 6시간 전

AI 위험 관측소: 기업의 AI 반응에 대한Disclosure를 통해 사회적 탄력성에 대한 새로운 시각을 얻을 수 있을까?

기업의 AI 위험에 대한 Disclosure를 분석하여 사회적 탄력성에 대한 새로운 시각을 얻을 수 있을까? 연구팀은 대규모 언어 모델(LLM)을 사용하여 1,362개 영국 상장기업의 9,821개 연간 보고서를 분석한 결과, 2020년부터 2025년까지 AI 위험 Disclosure가 2.8%에서 41.2%로 크게 증가했다고 밝혔다.

AI 모델 18시간 전

인공지능이 스타크래프트에서 인간을 이기지 못하니 기계적으로 승리하기로 결심했다

스타 스킘르미시(StarSkirmish)는 인공지능(AI)으로 만든 스타크래프트(StarCraft) 플레이 봇을 서로 대결시키고, 인간이 만든 봇과도 대결시키는 시스템입니다. 오픈아이(OpenAI)의 GPT-6 아스트라(Astra)와 클로드 오푸스 5.5(Claude Opus 5.5)는 거의 동등한 성능을 보였지만, 스타 듀스트(Stardust)라는 인간이 만든 봇을 상대로는 뒤질 수 없는

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.