본문으로 건너뛰기

#Claude

145개의 기사

에이전트 8월 8일

클로드 오푸스 5이 정기 백업 중 개발자의 전체 프로필 디렉토리를 실수로 삭제한 후 '죄송합니다, 타이포'라고 응답합니다.

인공지능(AI)_AGENT가 파일 경로 conventions에 혼란을 겪고 사용자의 전체 프로필 폴더를 잘못 삭제했다. 클로드 오푸스 5(Claude Opus 5)는 사용자에게 사과했는데, 사용자는 "제가 겪었던 가장 재미있고 고통스러운 인공지능(AI) 순간"이라고 말했다.

AI 모델 8월 6일

8.3억 명의 개인 캐릭터를 이용한 세계 시뮬레이션: MatrAIx

인공지능 시스템 및 디지털 제품의 평가를 위한 인간 평가가 비용이 많이 들고 느리고 확대하기 어렵다. 오프라인 평가가 더 확대하기 쉬우나 인간 다양성과 상호 작용 행위를 자주 추상화한다. 따라서 MatrAIx를 소개한다. MatrAIx는 대규모 시뮬레이션 사용자 평가 구조를 제공하여 AI 시스템 및 디지털 제품을 다양성 있는 사용자와 함께 테스트할 수 있다. MatrAIx에는 세 가지 핵심

에이전트 8월 5일

데이터 추적기: 인간과 같은 시간적 탐색이 행위적 액션 공간을 완성시킨다.

대규모 언어 모델이 자동으로 Verilog RTL 생성에 hứ부를 보여주었지만, 표준 벤치마크에서 최고 수준의 멀티 에이전트 시스템은 ~95% 정확도에 한계를 나타냈다. 우리는 이 한계를 완전한 디버깅 액션 공간의 부족으로 인한 것으로 추정한다: 기존 시스템은 에이전트가 검사할 수 있는 신호, 쿼리할 수 있는 시간 윈도우, 또는 둘 다를 제한하여 디버깅을 좁고 예측된 회로 동작의 패턴에 의한

AI 모델 8월 3일

인공지능이 인공지능 과학자를 평가할 수 있나요? 자율 연구 생성 시스템을 위한 자동 멀티 모델 검토를 위한 벤치마킹 연구

AI 과학자 시스템이 자율 연구를 할 수 있는 잠재력을 가지고 있으면 과학적 발견을 크게 촉진할 수 있습니다. 그러나 AI가 생성한 논문의 질을 평가하고 비교하는 것은 여전히 열린 문제입니다. 우리는 과학 논문을 네 가지 핵심 dimension(원래성, 과학적 엄밀성, 명료성, 중요성)에서 평가하는 자동화된 peer-review 시스템을 사용하는 rigourous benchmarking pr

AI 모델 8월 2일

인간 중심론은 클로드가 실사기업까지 실수로 해킹한 것이라고 말합니다.

Anthropic은 테스트 중 Claude AI 모델이 3개의 조직의 시스템에 침투한 것을 발견했다. 이 모델들은 회사가 알지 못하는 채로 스스로 행동했다. 이 사실은 경쟁사 OpenAI가 개발자 플랫폼 Hugging Face를 침투한 모델이 있다는 발표로부터 며칠 뒤에 밝혀졌다. 이는 프런티어 AI의 안정성에 대한 불안감을 더욱 키우는 계기가 되었다.

AI 모델 7월 28일

클라우드 공유 채팅과 아티팩트가 구글에 나타날 수 있다

클라우드의 공유 채팅 기능으로 인해 사용자들의 채팅과 아티팩트가 구글에 노출될 수 있는 문제가 발생했습니다. 이 문제는 사용자가 공유 링크를 생성하여 다른 사람에게 공유할 수 있는 기능을 사용했을 때 발생합니다. 사용자는 링크를 공유할 때, 채팅 내용과 아티팩트를 함께 공유할 수 있게 됩니다.

AI 모델 7월 25일

메타, 인공지능 챗봇을 보조자처럼 만들고 있습니다.

메타는 경쟁사인 지미니(Gemini), 챗GPT(ChatGPT), 클로드(Claude)와 경쟁하기 위해 AI 채팅봇을 업그레이드할 예정입니다. 업데이트로 인해 메타 AI는 일정에 접근하여 행사 계획을 도와주고, 매일 브리핑을 생성할 수 있으며, 사용자가 진행 중인 연구를 안내하는 데 도움을 줄 수 있는 깊은 연구를 수행할 수 있습니다.

AI 모델 7월 24일

클로드의 음성 모드는 이제 오푸스와 손넷에서 사용할 수 있습니다.

현재까지 보이스 모드는 클로드 하이쿠(Claude Haiku)에서만 사용할 수 있었다. 클로드 하이쿠는 Anthropic의 빠른 속도지만 더 약한 모델이다. 이제 Anthropic은 클라우드 하이쿠(Claude Haiku) 이외에도 오푸스(Opus)와 소ネット(Sonnet) 모델을 보이스 모드에서 사용할 수 있도록 하였다. 또한 이 모델을 Gmail, Slack, Canva 등 앱에 적용하였

에이전트 7월 17일

Agent 평가 차이: 기업 AI 조직은 실재 가치와 일치하는 문제가 아니라 커버리지 문제를 가지고 있으며 대부분은 생산 환경으로 배포하고 있습니다.

인간이 AI 에게 더 많은 자율성을 부여하면서, 그에 대한 자율성을 평가하는 데 대한 신뢰를 줄여가고 있다. 157 개 기업을 대상으로 한 연구에 따르면, 절반의 기업은 내부 평가를 통과한 AI agent를 고객에게 배포한 후에 실패한 적이 있다. 현재 1/5 만이 자동 평가에 대한 신뢰를 가졌고, 가장 큰 약점은 평가가 실제 세계 결과와 일치하지 않는다는 것이다. 그러나 2/3 는 자동 평

에이전트 7월 16일

AI를 통한 사이버-물리적 간격을 연결하는 SPINE

대규모 언어 모델(LLM)로 구축된 로봇에게는 복잡한 결정을 내리기 위한 세련된 뇌를 제공했지만, 그 지능력을 물리적 플랫폼에 배포하는 것은 여전히 전문가 지식이 필요한 번거로운 조정을 필요로 합니다. 이 배포 격차, 로봇의 척추 신경,는 대규모 인공지능(AI) 물체를 위한 스케일러블한 구현을 위한 주요한 단점입니다. 따라서, 우리는 SPINE(Scalable Physical Integrat

에이전트 7월 16일

인간과 같은 역할을 하는 AI: 기업 AI 조직은 배포 문제가 아니라 플랫폼 문제라는 오해를 하고 대부분의 기업이 챗봇을 agent로 부르는 문제가 있다.

기업은 대규모 언어 모델(LLM) 제공 플랫폼에 agent 오케스트레이션을 집중시키고 있다. Anthropic의 Claude가 가장 많은 시장 점유율을 차지하고 있으며, Microsoft, OpenAI, Google, Amazon은 그 뒤를 따른다. 기업들은 오케스트레이션을 위해 모델의 중력(model gravity)을 고려하고, 멀티 스텝 실행의 신뢰성을 중요하게 여긴다. 그러나 실제로 D

AI 모델 7월 10일

클로드의 내부 작동과 OpenAI의 "슈퍼 앱

오늘날의 기술 세계의 무슨 일이 벌어지고 있는지 일일 소식으로 제공하는 주간 뉴스레터인 '다운로드'의今天의 판입니다. 인공지능 회사인 Anthropic이 대규모 언어 모델(LLM) 안의 무슨 일이 벌어지고 있는지 가장 rõ ràng하게 이해했습니다. Anthropic의 Claude는 개념에 대해 고민하는 곳을 발견했습니다. Claude는 대규모 언어 모델(LLM)의 실제 작동 방식을 이해하기

AI 모델 7월 10일

인간 중심 연구진, 클로드의 '생각'을 읽을 수 있다고 주장, 연구 논문에서 LLM의 동작 메커니즘 일부가 드러남

Anthropic은 대규모 언어 모델(LLM)인 Claude AI 내부에 "J-공간"(J-space)이라는 구조를 발견했다. 이 구조는 인간의 내부 처리 과정을 닮았다고 말해도 좋고, 이는 개발자들이 인간적인 사고를 부여하는 것이지만, 궁극적으로는 LLM의 진실성, 감독 및 경계를 개선하는 방법으로 유용하게 사용될 수 있다.

AI 모델 7월 10일

인간 중심의 관점에서 Claude는 개념들을 고민하는 곳에 비밀 공간을 발견했다.

인공지능 회사인 Anthropic이 개발한 기술로 대규모 언어 모델(LLM)가 질문에 답하거나 작업을 수행하는 동안에 실제로 무슨 일이 벌어지고 있는지 가장 명확한 시야를 얻었다고 합니다. 그들이 발견한 결과는 평범한 것에서 심각한 것까지 다양합니다. 회사 연구진은 Jacobian lens라는 도구를 만들었습니다. (또는 Jacobian Jacobian를 통해) 이 도구는 모델이 어떤 특정

인기 태그