AI 벤치마크는 깨진다. 그 대안은?
인공 지능(AI)은 오랜 시간 동안 인간과 비교하여 수행 능력을 평가해왔습니다. 체스, 고급 수학, 프로그래밍, 에세이 쓰기 등 다양한 분야에서 AI 모델과 애플리케이션의 성능은 인간이 특정 작업을 완료하는 데 사용하는 시간과 성과를 비교하여 테스트됩니다. 이 프레임은 매력적입니다.
인공 지능(AI) 벤치마크의 문제점
인공 지능(AI)은 오랜 시간 동안 인간과 비교하여 수행 능력을 평가해왔습니다. 체스, 고급 수학, 프로그래밍, 에세이 쓰기 등 다양한 분야에서 AI 모델과 애플리케이션의 성능은 인간이 특정 작업을 완료하는 데 사용하는 시간과 성과를 비교하여 테스트됩니다. 그러나 이 접근 방식에는 몇 가지 문제가 있습니다. 첫째, 인간과 AI의 비교는 AI의 실제 세계적 적용을 고려하지 않습니다. 둘째, 인간과 AI의 비교는 AI의 단점을 숨기고 단점을 강조하는 경향이 있습니다. 인간과 AI의 비교는 AI의 성능을 평가하는 데 사용되었습니다. 하지만 이 접근 방식은 실제 세계에서 AI가 어떻게 사용되고 있는지를 고려하지 않습니다. 예를 들어, AI의 성능을 평가하는 데 사용되는 지표는 사용자 경험(UX) 성능 및 신뢰성, 보안 및 개인정보 보호, 비용-effectiveness 등입니다. 이러한 지표를 사용하여 AI의 성능을 평가하면 AI의 실제 세계적 적용을 고려하고 AI의 단점을 강조할 수 있습니다.AI 벤치마크를 개선하기 위한 대안
AI 벤치마크를 개선하기 위한 대안은 다음과 같습니다. 인간과 AI의 비교를 피하고 AI의 실제 세계적 적용을 고려하는 지표를 사용해야 합니다. AI의 단점을 강조하고 AI의 실제 세계적 적용을 고려하는 지표를 사용해야 합니다. AI의 성능을 평가하는 데 사용되는 지표를 개선해야 합니다. 이러한 대안을 사용하여 AI 벤치마크를 개선하면 AI의 실제 세계적 적용을 고려하고 AI의 단점을 강조할 수 있습니다. 또한, 이러한 대안을 사용하여 AI 벤치마크를 개선하면 AI의 성능을 개선하는 데 도움이 될 수 있습니다.함께 읽으면 좋은 기사
보험사들이 주장하는대로 AI는 이미 의료비를 증가시키고 있다.
Blue Cross Blue Shield는 병원에서 AI 도구 사용이 2년간의 기간 동안 추가로 942억 달러의 의료 지출로 이어졌다고 밝혔다.
나는 자기가 되는 인터랙티브 디지털 아바타를 만들었고, 그것과 대화할 수 있습니다.
나 자신을 모방한 AI 클론을 만들기 위해 인터랙티브 어바타를 구하고 벤처 사기 같은 주제로 훈련시켰습니다. 하지만 AI 클론을 만드는 것이 정말 좋은 생각인지에 대해 혼란스럽습니다.
메타 커넥트에서 회사의 지능형 оч기는 어디에나 없었다
메타(Meta)가 운영하는 페이스북(Facebook)과 인스타그램(Instagram)과 같은 서비스를 제공하는 회사가 스마트 글래스의 종류를 지속적으로 확장하여 디지털 세상과 소비자들을 연결하고 싶다.
크루소, 1.25억 달러 규모의 Boom 터빈 사용 계획 철회
크루소는 대규모 언어 모델(LLM)과 같은 AI 데이터 센터에 Boom 터빈을 사용하는 1.25억 달러 규모의 계획을 철회했다. Boom Supersonic CEO 블레이크 쇼尔(Blake Scholl)은 새로운 정지형 발전소가 더 이상 크루소의 근무 계획에 포함되지 않는다고 말했다.
메타가 새로운 Muse 기능의 이른 접근 프로그램을 시작합니다.
모델(Muse)에게 연락하여 관심 있는 사람들의 목록에 등록을 요청해야 합니다.
인간 중심 AI, 아카마이와 1조 1660억 원 규모의 클라우드 계약 체결
인간 중심 AI 회사인 Anthropic이 아카마이의 클라우드 인프라에 1조 1660억 원을 지불할 예정이다. 이 계약은 7년간 지속될 예정이며, Anthropic은 아카마이의 주식 5%까지 가질 수 있다.
관련 콘텐츠 더 보기
다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.