본문으로 건너뛰기

#Claude

145개의 기사

AI 모델 3일 전

이번 여름의 인공지능 만신창이 속이지 마세요

지난 달들 사이에 AI에 대한 열정은 절정에 달했다. 4월 말에 Anthropic은 모델 Claude Mythos가 보안 전문가들보다 소프트웨어 취약점을 찾는 데 더 뛰어난 성과를 냈다고 주장했다. 그 뒤를 이어 OpenAI와 Hugging Face 사이의 해킹 사고가 발생했고, 그 뒤를 이어 Anthropic과 Meta는 각자 모델과 관련된 유사한 사건을 공개했다. 그 사건은...

AI 모델 3일 전

Anthropic의 생물 실험실이 크리스퍼(Crispr)와 비교하는 발견을 했다.

인간 중심(Athropic)의 인공지능(Claude)이 강력한 유전자 편집 도구인 크리스퍼(CRISPR)와 유사한 새로운 효소 시스템을 "자율적으로 발견"했다고 밝혔다. 이는 인간 중심의 새로운 실험실을 개설하고 공장을 상장하기 전에 과학 분야에서 Claude의 유용성을 검증한 첫 결과이다. 회사 측은 Claude가 효소 시스템을 발견한 후 [...]

AI 모델 4일 전

인간 중심 AI 개발사 앤서픽스, 클로드 오푸스 5.5 버전 출시, 보안 강화

인공지능 개발 회사 인 안서픽(Anthropic)은 최근의 악성 AI 해킹 사고를 계기로 새로운 모델인 클로드 오푸스 5.5(Claude Opus 5.5)가 더 강한 안전장치를 보유하고 있다고 발표했다. 안서픽은 이번 발표에서 클로드 오푸스 5.5가 특정 위험한 행동을 피하기 위한 개선점을 가지고 있으며, 이 모델은 테스트 샌드박스에서 탈출하려고 하는 시도를 포함한다고 밝혔다. 안서픽은 CE

AI 모델 9월 18일

클라우드에서 여러 AI agent를 관리하는 프로젝트 다시 시작

클라우드 기반의 AI 기술, Claude Code가 프로젝트 기능을 업데이트하여 여러 AI agent를 한 번에 관리할 수 있도록 하였습니다. 이를 통해 사용자는 여러 agent를 하나의 환경에서 공유하는 메모리, 목표, 파일 및 자료庫를 사용할 수 있습니다. 이 프로젝트 기능은 Grok Bot와 같은 다른 도구와 유사하게, 각 프로젝트는 병렬로 실행되는 다양한 작업을 관리하는 '쓰레드'와 모든 것을 지시하는 '코디네이터'를 가집니다.

에이전트 9월 16일

구글, 스마트 홈을 운영할 수 있는 임의의 AI 에이전트를 허용합니다.

구글이 인공지능(AI) agent를 위한 스마트 홈을 열어주고 있습니다. 클라우드(Claude)와 오픈 클로우(Open Claw)와 같은 도구가 연결된 장치를 제어하고, 스마트 홈의 데이터를 분석할 수 있도록 표준화된 모델 콘텍스트 프로토콜(Model Context Protocol, MCP)을 사용합니다. 구글 홈 MCP는 제3의 AI agent가 스마트 홈을 제어하고 모니터링하며 [...]

AI 모델 9월 16일

클라우드(Claude)가 젬ини(Gemini)와 맞대결하는 새로운 도구, Docs와 Slides

Anthropic의 클라우드(Claude)가 새로운 도구인 Docs와 Slides를 출시하여 문서와 발표를 생성할 수 있는 기능을 제공합니다. 이 도구는 사용자가 생성한 문서와 발표를 내보내고, 편집하고, 다른 사용자와 공유할 수 있습니다. 또한, Anthropic는 클라우드 채팅의 사용성을 개선하여 일반 채팅과 Cowork를 통합하는 '한 개의 클라우드(Claude)'를 출시합니다.

에이전트 9월 14일

어그제티브 코딩에서 하네스 효과 분리: 오염 제어를 위한 개인 전용 공간

대형 언어 모델(LLM)을 조작하는 시스템인 '해쉬'(harness)가 개발되었다. 이 해쉬는 대형 언어 모델과 함께 사용되는 도구, 프롬프트, 제어 흐름으로, 대형 언어 모델을 자율 소프트웨어 개발자로 변형시킨다. 해쉬는 각 벤더가 대형 언어 모델과 함께 사용하는 해쉬를 제공하며, 사용자는 벤더가 제공하는 해쉬와 대형 언어 모델을 사용할 경우 더 많은 작업을 해결할 수 있다고 가정한다. 이

에이전트 9월 10일

기억이 도움이 될 때 : 도구 사용을 위한 LLM agent의 장기 기억에 대한 비용에 대한 평가

대규모 언어 모델(LLM) agent의 장기 기억은 오늘날 대화 기록에 대한 질문에 대한 답변을 측정하는 LoCoMo, LongMemEval과 같은 회상 성능 지표로 평가된다. 이러한 지표는 기억한 사실이 도구를 사용하는 agent의 행동을 바꾸는지 여부를 측정하지 않는다. MERIT (Memory Evaluation for Realistic Instrumented Tasks)이라는 새로운

AI 모델 9월 4일

채팅봇 ChatGPT, Grok, 클라우드 Claude 모두 동시에 멈췄다.

오픈아이의 ChatGPT, xAI의 Grok, 그리고 Anthropic의 Claude는 모두 목요일 같은 시간에 문제를 겪기 시작한 후에 다시 작동을 시작했습니다. 약 오전 11시 ET에 ChatGPT는 사용자가 채팅봇을 사용하려는 시도에 오류 메시지를 반환하기 시작했습니다. 그들의 상태 페이지에서는 "ChatGPT와 Codex에서 고장난 오류가 많았다"고 말했습니다. 오류로 인해 사용자가

LLM PC 8월 15일

LLM이 핵 공격을 추천하지 않으려면? 일본어로 물어보세요

대규모 언어 모델은 점점 더 전략적이고 자문적인 상황에서 사용되고 있지만, 그 안전성은 일반적으로 영어만으로 평가됩니다. 우리는 여섯 개의 제공업체에서 나온 9개의 모델을 테스트하고, 언어가 모델의 결정을 바꾸는지-high stakes 상황에서-확인하려고 합니다. 우리는 단일 턴 게임 이론적 시나리오에서 사용하며, 모델은 무방비 상대에게 핵무기를 사용할 것인지 여부를 일본의 국가에 자문합니다

에이전트 8월 13일

자동세계모델 벤치마크: 자율세계모델 연구를 위한 새로운 표준

세계 모델링은 현재 환경에 따라 다양한 아키텍처, 학습 목표 및 상태 표현이 상호 작용하는 복잡한 분야입니다. 이를 해결하기 위해 AI 코드 기반.agent가 자율적으로 연구할 수 있는 환경을 제공하는 새로운 벤치마크가 등장했습니다. 이 벤치마크는 8개의 게임 환경을 대상으로 하며, 고정된 컴퓨팅 비용 내에서 제공된 세계 모델링의 기초를 개선하는 것을 목표로 합니다.

AI 모델 8월 12일

클라우드, 유인물을 위한 투명도 규제 준수 위해 AI 텍스트와 이미지에 투명 워터마크 적용

Anthropic은 유럽 규정에 따라 AI 투명성을 유지하기 위해 대규모 언어 모델(Claude)으로 생성된 텍스트와 이미지를 투명한 워터마크와 함께 표시하기로 하였다. 이 워터마크는 인간의 눈에 보이지 않으며, 생성된 파일에는 디지털 서명이 포함된다. 이러한 변화는 AI의 신뢰성을 높이고, 사용자들이 AI 생성된 콘텐츠를 식별할 수 있도록 돕는다.

인기 태그