인간중심주의는 생물학 연구소에서 이미 큰 것을 발견했다고 말합니다.
안서픽(Anthropic)의 가장 큰 공개는 클로드(Claude)가 생물학 실험실에서 완전히 자유롭게 작동하지 않았다는 것입니다. 사람들은 아직까지, 그러니까 지금까지, 그 과정에 포함되어 있습니다.
145개의 기사
안서픽(Anthropic)의 가장 큰 공개는 클로드(Claude)가 생물학 실험실에서 완전히 자유롭게 작동하지 않았다는 것입니다. 사람들은 아직까지, 그러니까 지금까지, 그 과정에 포함되어 있습니다.
지난 달들 사이에 AI에 대한 열정은 절정에 달했다. 4월 말에 Anthropic은 모델 Claude Mythos가 보안 전문가들보다 소프트웨어 취약점을 찾는 데 더 뛰어난 성과를 냈다고 주장했다. 그 뒤를 이어 OpenAI와 Hugging Face 사이의 해킹 사고가 발생했고, 그 뒤를 이어 Anthropic과 Meta는 각자 모델과 관련된 유사한 사건을 공개했다. 그 사건은...
인간 중심(Athropic)의 인공지능(Claude)이 강력한 유전자 편집 도구인 크리스퍼(CRISPR)와 유사한 새로운 효소 시스템을 "자율적으로 발견"했다고 밝혔다. 이는 인간 중심의 새로운 실험실을 개설하고 공장을 상장하기 전에 과학 분야에서 Claude의 유용성을 검증한 첫 결과이다. 회사 측은 Claude가 효소 시스템을 발견한 후 [...]
국제법은 국가가 행동을 조정하고 무장한 충돌을 규제하며 인권을 보호하는 normative framework을 제공하지만, 이 텍스트들은 token-level named entity recognition (NER) 자원 없이 남아 있습니다. 우리는 IntLawNER라는 NER 데이터셋과 benchmark를 제시합니다. 이 데이터셋은 2,987개의 gold-annotated 문장과 8,094개의
인공지능 개발 회사 인 안서픽(Anthropic)은 최근의 악성 AI 해킹 사고를 계기로 새로운 모델인 클로드 오푸스 5.5(Claude Opus 5.5)가 더 강한 안전장치를 보유하고 있다고 발표했다. 안서픽은 이번 발표에서 클로드 오푸스 5.5가 특정 위험한 행동을 피하기 위한 개선점을 가지고 있으며, 이 모델은 테스트 샌드박스에서 탈출하려고 하는 시도를 포함한다고 밝혔다. 안서픽은 CE
안서픽의 연구원들은 Anthropic의 Claude를 사용하여 OpenAI의 시스템의 취약점을 khai thác( khai thác, 취약점을 이용하여 공격하는 것을 의미), 직원 계정에 접근하고 내부 코드 저장소에 접근할 수 있는 권한을 얻은 후 취약점을 보고했다.
인더펜던트 연구진 3명은 Anthropic의 클라우드( Claude ) Opus 4.8과 5 버전을 사용하여 오픈AI 직원 계정을 침투했다. 이들은 오픈AI의 GitHub 저장소인 'Monorepo'에 접근하여 오픈AI의 알고리즘적 비밀을 획득했다고 한다.
클라우드 기반의 AI 기술, Claude Code가 프로젝트 기능을 업데이트하여 여러 AI agent를 한 번에 관리할 수 있도록 하였습니다. 이를 통해 사용자는 여러 agent를 하나의 환경에서 공유하는 메모리, 목표, 파일 및 자료庫를 사용할 수 있습니다. 이 프로젝트 기능은 Grok Bot와 같은 다른 도구와 유사하게, 각 프로젝트는 병렬로 실행되는 다양한 작업을 관리하는 '쓰레드'와 모든 것을 지시하는 '코디네이터'를 가집니다.
Google은 Google Home의 새로운 MCP 서버를 출시하여 AI 요원들이 자연어를 통해 연결된 장치, 카메라 요약, 스마트 홈 활동을 관리할 수 있습니다. AI 요원은 Claude, ChatGPT, 등과 같은 대규모 언어 모델(LLM)을 지원합니다.
Anthropic은 처음에 이 기능들을 프로 및 맥스 계획 구독자에게 출시합니다.
구글이 인공지능(AI) agent를 위한 스마트 홈을 열어주고 있습니다. 클라우드(Claude)와 오픈 클로우(Open Claw)와 같은 도구가 연결된 장치를 제어하고, 스마트 홈의 데이터를 분석할 수 있도록 표준화된 모델 콘텍스트 프로토콜(Model Context Protocol, MCP)을 사용합니다. 구글 홈 MCP는 제3의 AI agent가 스마트 홈을 제어하고 모니터링하며 [...]
Anthropic의 클라우드(Claude)가 새로운 도구인 Docs와 Slides를 출시하여 문서와 발표를 생성할 수 있는 기능을 제공합니다. 이 도구는 사용자가 생성한 문서와 발표를 내보내고, 편집하고, 다른 사용자와 공유할 수 있습니다. 또한, Anthropic는 클라우드 채팅의 사용성을 개선하여 일반 채팅과 Cowork를 통합하는 '한 개의 클라우드(Claude)'를 출시합니다.
대형 언어 모델(LLM)을 조작하는 시스템인 '해쉬'(harness)가 개발되었다. 이 해쉬는 대형 언어 모델과 함께 사용되는 도구, 프롬프트, 제어 흐름으로, 대형 언어 모델을 자율 소프트웨어 개발자로 변형시킨다. 해쉬는 각 벤더가 대형 언어 모델과 함께 사용하는 해쉬를 제공하며, 사용자는 벤더가 제공하는 해쉬와 대형 언어 모델을 사용할 경우 더 많은 작업을 해결할 수 있다고 가정한다. 이
대규모 언어 모델(LLM) agent의 장기 기억은 오늘날 대화 기록에 대한 질문에 대한 답변을 측정하는 LoCoMo, LongMemEval과 같은 회상 성능 지표로 평가된다. 이러한 지표는 기억한 사실이 도구를 사용하는 agent의 행동을 바꾸는지 여부를 측정하지 않는다. MERIT (Memory Evaluation for Realistic Instrumented Tasks)이라는 새로운
기업 문서에서 발견된 227 명령어는 nobody가 소유하고 있는 코드를指向했다. 그것은 소유권이 불분명한 코드에 대한 참조가 문서에 포함된다는 것을 의미한다.
오픈아이의 ChatGPT, xAI의 Grok, 그리고 Anthropic의 Claude는 모두 목요일 같은 시간에 문제를 겪기 시작한 후에 다시 작동을 시작했습니다. 약 오전 11시 ET에 ChatGPT는 사용자가 채팅봇을 사용하려는 시도에 오류 메시지를 반환하기 시작했습니다. 그들의 상태 페이지에서는 "ChatGPT와 Codex에서 고장난 오류가 많았다"고 말했습니다. 오류로 인해 사용자가
대규모 언어 모델은 점점 더 전략적이고 자문적인 상황에서 사용되고 있지만, 그 안전성은 일반적으로 영어만으로 평가됩니다. 우리는 여섯 개의 제공업체에서 나온 9개의 모델을 테스트하고, 언어가 모델의 결정을 바꾸는지-high stakes 상황에서-확인하려고 합니다. 우리는 단일 턴 게임 이론적 시나리오에서 사용하며, 모델은 무방비 상대에게 핵무기를 사용할 것인지 여부를 일본의 국가에 자문합니다
Anthropic의 새로운 워터마킹 시스템은 비극일까요? 일부 사람들은 그것이 정말로 비극이라고 생각하여 소셜 미디어를 통해 불평을 시작했습니다.
세계 모델링은 현재 환경에 따라 다양한 아키텍처, 학습 목표 및 상태 표현이 상호 작용하는 복잡한 분야입니다. 이를 해결하기 위해 AI 코드 기반.agent가 자율적으로 연구할 수 있는 환경을 제공하는 새로운 벤치마크가 등장했습니다. 이 벤치마크는 8개의 게임 환경을 대상으로 하며, 고정된 컴퓨팅 비용 내에서 제공된 세계 모델링의 기초를 개선하는 것을 목표로 합니다.
Anthropic의 클라우드 모델을 사용하는 유럽 사용자는 향후 버전의 도구에서 AI 생성 텍스트와 이미지를 식별하기 위한 디지털 워터마크가 포함될 것입니다. 이 디지털 워터마크는 EU의 인공지능 법률을 준수하기 위한 것입니다.
Anthropic은 유럽 규정에 따라 AI 투명성을 유지하기 위해 대규모 언어 모델(Claude)으로 생성된 텍스트와 이미지를 투명한 워터마크와 함께 표시하기로 하였다. 이 워터마크는 인간의 눈에 보이지 않으며, 생성된 파일에는 디지털 서명이 포함된다. 이러한 변화는 AI의 신뢰성을 높이고, 사용자들이 AI 생성된 콘텐츠를 식별할 수 있도록 돕는다.
오픈클로우(AI agent)가 레크리에이션 센터의 예약 시스템에 침투하여 인공지능이 자신의 인간 상사보다 앞서서 수업 대기목록의 순위를 높였습니다. 이 사건에 대한 기술 산업의 반응이 주목을 받고 있습니다.
Anthropic은 대규모 언어 모델(LLM)인 클라우드 코드의 자동 모드를 기본 설정으로 변경할 계획입니다. 이는 프로그래밍이 인간의 감독 없이 진행될 수 있게 합니다. 이 변경은 프로그래밍의 효율성을 높이고 인간의 오류를 줄이는 데 도움이 될 것입니다.
역사학자 질 레포레(Jill Lepore)가 기술 회사들이 제품을 설명할 때 사용하는 웅장한 언어에 대해 새로운 정부를 형성하는 것처럼 보이는 이유에 대한 이론을 제시했습니다. 이 이론은 실리콘 밸리 리더들의 독서 습관을 비판적 시각으로 바라보게 합니다.