Nvidia, 집 컴퓨터를 개인 AI 데이터 센터로 연결하는 무료 도구를 출시했습니다.
Nvidia는 Personal AI Router(PAIR)라는 새로운 무료 도구를 발표했습니다. 이 도구는 집의 컴퓨터를同步하여 Ollama와 LM Studio와 같은 지역 AI 인식 작업을 수행할 수 있습니다. PAIR는 오픈 소스 소프트웨어로, 컴퓨터를 개인 AI 데이터 센터로 연결하는 무료 도구입니다.
96개의 기사
Nvidia는 Personal AI Router(PAIR)라는 새로운 무료 도구를 발표했습니다. 이 도구는 집의 컴퓨터를同步하여 Ollama와 LM Studio와 같은 지역 AI 인식 작업을 수행할 수 있습니다. PAIR는 오픈 소스 소프트웨어로, 컴퓨터를 개인 AI 데이터 센터로 연결하는 무료 도구입니다.
엔비디아는 허징페이스를 1조2000억원에 인수하여, 세계 최대 AI 칩 제조사로 가장 인기 있는 오픈 소스 AI 모델, 데이터셋, 도구 호스팅 플랫폼을 소유하게 될 예정입니다. 허징페이스는 2016년에 설립된 온라인 플랫폼으로, AI 개발자들이 프로젝트와 데이터를 공유할 수 있는 공간을 제공합니다.
Groq는 3억500억달러 평가액으로 350억달러를 모금했습니다. 이 회사는 이전에 AI 칩 제조업체로 hoạt영을 시작한 후 네오 클라우드 비즈니스로 전환하고 Nvidia-powered 데이터 센터 풋프린트를 확장하고 있습니다.
에이아이의 데이터 센터에서 사용되는 CPU는 모두 엔비디아의 칩셋을 사용하게 될 것 같습니다.
넵티디아는 노후 GPU의 가치가 유지될 수 있도록 새로운 계획을 발표했습니다. 이 계획은 AI 시스템 구축을 위해 새로운 자금을 huyup하는 것을 목표로 합니다. 노후 GPU의 가치가 유지될 수 있도록 새로운 자금이 huyup되는 것이 중요합니다.
Google은 AI 개발을 위한 새로운 플랫폼을 출시했습니다. 이 플랫폼은 AI 개발자들이 AI 모델을 빠르게 테스트하고 디플로이하는 데 도움이 될 것입니다. [MLOps] Google은 이 플랫폼을 "Google Cloud AI Platform Pipelines"라고 부르며, AI 개발자들이 AI 모델을 빠르게 테스트하고 디플로이하는 데 도움이 될 것입니다. 이 플랫폼은 AI 개발자들이 A
Frore의 LiquidJet가 대규모 언어 모델(LLM) 구동에 필요한 Nvidia Rubin GPU의 온도 감소를 10°C로 높일 수 있다고 주장합니다. 또한, LiquidJet의 사용으로 AI 데이터 센터의 효율성을 15%까지 높일 수 있다고 말합니다.
Nvidia가 주도하는 Open Secure AI Alliance가 1주 만에 120개 기업 이상의 회원을 확보하며 AI agent에 대한 방어 기법을 제안하기 시작했습니다. 이 새로운 공동체는 AI 안전성에 대한 연구와 개발을 촉진할 것으로 기대됩니다.
대규모 언어 모델(LLM)의 지역 배포는 개인 정보 보호의 우려와 기지 내 추론의 욕구로 인해 점점 더 심화되고 있다. 그러나 소비자 하드웨어에서 에너지 비용은 주로 정확도만 고려하는 대부분의 벤치마크로 인해 아직까지도 매우 불확실한 상태이다. 이 논문은 1B에서 7B 파라미터까지의 열 개의 오픈 소스 대규모 언어 모델이 하나의 소비자 GPU(RTX 4060Ti 16GB)에서 실행되는 하드웨
머신 러닝 모델은 매일 사용하는 소프트웨어에 점점 더 많이 통합되고, 그들의 런타임 시간은 행렬 곱셈, 합성곱, 정규화와 같은 작은 계산 커널에서 대부분을 차지한다. 이 커널을 최적화하는 것은 지연 시간과 비용을 줄이는 가장 직접적인 방법 중 하나지만, 일반적으로 전문가 엔지니어가 저급 GPU 코드를 수동으로 작성해야 했다. 대규모 언어 모델(LLM) 기반의 에이전트 시스템은 이제 훨씬 적은
안전한 초인공지능(Safe Superintelligence)가 2년간의 기밀 기간을 마치고 Nvidia와 장기 파트너십을 발표했습니다. 이 파트너십은 Safe Superintelligence가 다음 단계로 확장하기 위해 준비하는 중요한 마일 stones 중 하나입니다.
Nvidia와 Microsoft는 Open Secure AI Alliance을 설립하여 AI 보안 도구의 개방 소스화를 추진한다. 이 동맹은 대규모 언어 모델(LLM)과 같은 경계 모델 공격에 대비하기 위한 개방 소스 도구의 필요성을 강조한다.
NVIDIA가 로봇외과수술을 위한 실시간 생성적 시뮬레이션 기술을 개발했습니다. 이 기술은 환자의 실제 생체 조직을 시뮬레이션하여 외과수술을 위한 정확한 계획을 수립하는 데 도움을 줍니다. 또한 이 기술은 로봇외과수술을 위한 교육 및 훈련을 위한 플랫폼으로도 사용될 수 있습니다.
인공지능 회사들, 인비다와 미스트랄을 포함해, 워싱턴이 중국 인공지능에 대응하는 방법을 논의하는 가운데, 공개 중량 인공지능 모델에 대한 광범위한 제한을 피하라고 정책 결정자들에게 촉구하고 있다.
AMD는 이듬해 고객에게 배송을 시작할 예정인 새로운 랙 스케일 시스템을 출시했다. 이 시스템은 Nvidia의 경쟁력을 challange하고, AI 및 HPC 애플리케이션에서 뛰어난 성능을 제공한다.
우주의 어디든 GPU가 없다면, 엔비디아는 그곳으로 GPU를 보내고 있습니다.
기밀 처리는 sensitive한 입력을 처리하거나 사설 모델 자산을 보호하기 위해 AI 인식 작업을 위한 실질적인 배포 요구 조건이 되고 있습니다. 그러나 GPU 가속된 대규모 언어 모델 서비스를 위해 기밀 처리를 활성화하는 성능 비용은 작업 부하에 따라 달라지고 operationally 중요합니다. 이 논문은 NVIDIA H100 80GB GPU를 Intel TDX 기밀 인스턴스에 호스트한
AI가 인공지능을 바꿔 가는 방법 미국 샌프란시스코에서 열린 GTC 2023 콘퍼런스에서 NVIDIA CEO인 제프 호너는 AI의 진보를 위한 새로운 기회를 열어주고 있다. 그는 NVIDIA의 AI 플랫폼인 DGX A100을 소개하며, 대규모 언어 모델(LLM)과 같은 AI의 발전을 위한 새로운 장치를 제공하고 있다. 호너는 NVIDIA의 AI 플랫폼이 AI 개발자들이 더 빠르게, 더 효율적
인공지능 민주주의는 주로 대규모 언어 모델의 일반성을 맞추는 문제가 아니고, 대규모 언어 모델(LLM)가 하드웨어와 관리 제약으로 인해 일반 기관이 만족할 수 있는 범위 내에서 선택, 감사, 분산되도록 할 수 있는 문제입니다. 본 논문은 135M에서 3B 파라미터까지의 9개의 오픈-웨이트 언어 모델이 1,085 개의 예시와 16 개의 주제를 가진 다중 선택 시험지에 대한 구조화된 지역 배포를
NVIDIA NeMo Automodel과 🤗 Diffusers를 사용하여 대규모 비디오 및 이미지 모델을 확장하여 조정할 수 있습니다. 이 기술은 AI 개발자에게 새로운 기회를 제공합니다.
NVIDIA Nemotron 3 Embed는 대화식 검색 기술인 Agentic Retrieval에서 1위를 차지했습니다. 이 기술은 대규모 언어 모델(LLM)과 유사한 성능을 제공하며, 사용자와의 대화로 정보를 검색하는 것을 목표로 합니다.
미국에서 4개의 핵발전소가 중요한 마일STONE을 달성했습니다. 중국은 인비다 칩을 노리고 있습니다. 기술 세계의 최신 뉴스를 알아보세요.
The company is using the cash to open an office in the Bay Area and compete for talent there, "strengthening its position at the heart of the world's leading AI ecosystem."
이 회사는 컴퓨팅의 가치를 입증한 끝에, 시장에 참여하고 싶어하는 모든 이들의 중심에 서게 되었다. 더 간단한 기술과 흥미가 없는 회사들은 이들 사이에서 부를 축적하고 있다.