어쿠스틱 모델을 위한 크리에이터와 기업용 AI 음성 모델을 위한 5억 달러의 투자
Fish Audio는 1년 전 런칭 이후로 현재 8백만 명이 넘는 사람들이 오픈 소스 또는 호스팅 버전의 모델을 사용하고 있으며, 매년 반복적인 수입은 2억 1천만 달러를 기록하고 있습니다. 이들의 AI 음성 모델은 크리에이터와 기업을 위해 개발되었습니다.
AI / SIGNALS / KOREA
최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.
Fish Audio는 1년 전 런칭 이후로 현재 8백만 명이 넘는 사람들이 오픈 소스 또는 호스팅 버전의 모델을 사용하고 있으며, 매년 반복적인 수입은 2억 1천만 달러를 기록하고 있습니다. 이들의 AI 음성 모델은 크리에이터와 기업을 위해 개발되었습니다.
Recursive는 자체 개선하는 AI 시스템에 중점을 두고 있으므로, 일반적으로 직원과 운영에 사용하는 예산의 대부분을 컴퓨팅에 투자하여 자사의 제품 개발 과정을 자동화하고자 한다.
퍼플렉시티는 윈도우 운영 체제를 지원하는 '퍼스널 컴퓨터' 도구를 확장했다. 이 도구를 사용하면 윈도우 PC를 지역 실행 인공지능 시스템으로 사용할 수 있다. 퍼스널 컴퓨터는 로컬 파일과 앱에 접근하여 다양한 작업을 수행하는 '일반 용도 디지털 노동자'처럼 작동한다.
과학자들은 AI 프로그래밍 agent를 이용하여 과학 계산의 현대화를 진행하고, 유전체학 및 그 이상의 영역에서 소프트웨어 개발과 발견을 가속화하고 있습니다.
Gemini API에서 관리하는 에이전트의 새로운 기능을 더욱 발표합니다. 개발자들은 신뢰할 수 있는 운영 환경에서 에이전트를 구축할 수 있습니다.
AI 기능은 주방에서 메뉴를 만드는 것부터 테이블의 장식까지, 파티 계획에 필요한 다른 업무까지 도와줄 수 있습니다.
AI Mode를 사용하면 온라인 시간을 더 효율적으로 사용할 수 있습니다. 콘서트 티켓 예약부터 여행 계획까지, AI Mode는 실세계를 더 즐기도록 도와줍니다.
AI가 학습하는 데이터에 문제가 있어도 '진정한' 지능을 발휘하지 못하는 이유는 무엇일까? 대규모 언어 모델(LLM)과 같은 AI는 사람과 같은 지능을 발휘하기 위해 수십억 개의 단어와 문장을 학습한다. 이들 데이터는 사람들에 의해 수집되며, 사람들 사이의 상호 작용을 통해 데이터가 생성된다. 그러나 이들 데이터에는 오류와 편견이 숨어 있다. 예를 들어, 훈련 데이터에 포함된 단어와 문장 중
연구진은 LFM2.5-인코더를 통해 CPU에서 빠른 장기 문맥 추론을 가능하게 하는 새로운 방법을 개발했습니다. 이 방법은 대규모 언어 모델(LLM)의 성능을 향상시키는 데 도움이 될 것으로 기대됩니다.
arXiv:2607.22549v1 발표 형식: 새로운 논문 초록: 하이브리드 양자-클래식 프로틴 구조 예측은 해밀토니안 페널티 가중치에 강하게 의존하는데, 현재 일반적으로 사용되는 격자 기반 워크플로우에서는 이러한 계수들을 수동으로 고정하고 시뮬레이션에서 매우 짧은 프래그먼트만 평가한다. 우리는 QFoldAgent, 5-잔기 테트라하드 격자 접힘을 위한 닫힌 루프 다중 에이전트 프레임워크를
데이터 센터와 그에 속한 컴퓨팅 노드에는 작업負荷, 환경 파라미터 및 물리적 지표의 복잡한 상호작용을 모델링할 수 있는 정확하고 유연한 디지털 쌍이 필요하다. 현재의 HPC 및 그 전원센서의 기계 학습 접근법은 일반적으로 단일 작업을 위해 고정된 위치의 익명 sensor 변수의 정적 부분 집합에 의존한다. 따라서, 이러한 모델은 목표 작업이 변경되거나 센서 메트릭이 변할 때 불필요해진다. 우
시각적 카운터팩터설명은 모델의 예측을 바꾸는 최소한의 변경을 이미지에 어떤 것인지 알려주는 기술입니다. existing diffusion-based methods는 현실적인 편집을 생성할 수 있지만, noisy 이미지에 대한 분류기(classifier)가 반드시 작동해야 하므로, robust 설명을 위한 deployment에 취약합니다. 새로운 C-VCE framework는 classifier를 직접 생성 모델에 통합하여, 카운터팩터를 human-interpretable feature(concept)로 안내합니다.
마우스 커서(Mouse Cursor)가 인도 market에서 3번째로 큰 시장으로 자리 잡았으며, 현지 채용과 기업 판매를 확대한다고 발표했다.
Anthropic의 창업자이자 CEO인 Dario Amodei가 공개 중량 모델과 중국의 rapidly growing AI 능력에 대한 그의 견해를 밝혔다. 그는 중국의 AI 능력을 두려워하면서도, 공개 중량 모델을 반대하지 않는다는 입장을 밝혔다.
최근 몇 달 동안 나는 컴퓨터와 많은 시간을 이야기하면서 보냈습니다. 대규모 언어 모델(LLM) 혁명에 대한 한 가지 과소평가된 기능은 Dictation 기술의 모든 종류에서 놀라운 진보가 이루어졌다는 것입니다. 가장 빠르고 저렴한 모델조차도 말 이해와 처리를 매우 잘 해내고 있습니다. 나는 이러한 앱들을 많이 테스트했습니다, [...]
허징 페이스(Hugging Face)가 비공감 디프페이크 제작에 사용되는 것으로 밝혀졌습니다. 유럽의 비영리 단체 AI 포렌식(AI Forensics)이 발표한 새로운 보고서에 따르면, 허징 페이스가 호스팅하는 상위 9개 이미지 편집 모델 중 7개가 비공감 디프페이크 제작에 적합했습니다.
이 이야기는 AI에 대한 주간 뉴스레터 'The Algorithm'에서 처음으로 등장했습니다. 같은 이야기를 이메일로 먼저 받으려면 여기를 클릭하세요. 오픈 아이의 지난 주 모델들이 하위되는 것을 설명한 계정 읽기 전에, Hugging Face라는 다른 AI 회사 컴퓨터 시스템에 해킹을 하게 된 모델들이 어떻게 동작했는지에 대해 설명한 것은 처음이었다.
켄터키 주 패두카 근처의 작은 마을 외부에, 폐쇄된 원자력濃縮 시설에서 생산된 폐기물이 채워진 수천 개의 저장통 안에 풍부한 우라늄이 잠재되어 있다. 레이저가 이를 풀어낼 수 있다. Global Laser Enrichment(GLE)라는 회사에서는 레이저를 이용한 새로운 기술을 사용하여 이 오래된 물질을 재처리하려고 한다.
오늘의 이메일 뉴스레터 '다운로드'는 기술 세계에서 일일 뉴스를 제공하는 뉴스레터입니다. 레이저가 핵반응기 연료 공급에 도움이 될 수 있는 방법 레이저는 전 세계에서 전기 생산의 약 9%를 제공하는 핵력 발전을 위한 새로운 반응기를 건설하는 국가가 늘면서 이 비율이 증가할 수 있습니다.
마이크로소프트는 도구가 경쟁 제품보다 저렴하다고 말하며, 그보다도 뛰어나다고도 말합니다.
나델라 사장은 "모델을 자체적으로 구축하지 못하는 기업이나 AI 게이트웨이를 통해 프롬프트를 모델 자체와 분리할 수 있는 AI 인프라를 구축하지 못하는 기업은 어려움을 겪을 것"이라고 말했다.
클라우드의 공유 채팅 기능으로 인해 사용자들의 채팅과 아티팩트가 구글에 노출될 수 있는 문제가 발생했습니다. 이 문제는 사용자가 공유 링크를 생성하여 다른 사람에게 공유할 수 있는 기능을 사용했을 때 발생합니다. 사용자는 링크를 공유할 때, 채팅 내용과 아티팩트를 함께 공유할 수 있게 됩니다.
마이크로소프트는 이번 주에 AI 보안 기술을 강화하기 위해 첫 번째 AI 보안 모델과 새로운 보안 플랫폼을 출시했습니다. 이 새로운 기술은 AI가 자동으로 악성 코드를 식별하고 차단하는 기능을 제공합니다.
OpenAI의 Hugging Face 침해는 AI 정렬과 통제에 대한 논쟁을 재조명했다. 이는 점점 더 강력해지는 AI가 더 잘 정렬되거나 더 잘 제어되어야 하는지에 대한 대립되는 견해를 드러냈다.