본문으로 건너뛰기

#Claude

145개의 기사

에이전트 6월 1일

자기진화 LLM agent의 진화 가능성 능력을 분리하는 것: 하네스 업데이트가 하네스 이익이 아님

대규모 언어 모델(LLM) 에이전트는 점점 더 편집 가능한 외부 장치인 프롬프트, 기술, 기억, 도구와 같은 편집 가능한 외부 장치로 구성된 시스템으로 구축되고 있습니다. 이들 장치가 모델 매개 변수를 변경하지 않고 작업 수행을 조절합니다. 장치 자기 진화는 이러한 에이전트를 실행 증거를 통해 이러한 장치를 업데이트하여 적응합니다. 그러나 모델의 기본 작업 수행 능력은 장치 자기 진화의 능력

AI 모델 5월 21일

Anthropic의 클라우드 코드(Claude)가 보여준 코딩의 미래 - 좋든 싫든

Anthropic의 2일 간의 개발자 행사 'Code with Claude'가 영국 런던에서 개최되었습니다. 이 행사는 구글의 I/O 행사와 동시에 개최되었는데, 이는 우연의 일치라고 Anthropic 직원들은 말했습니다. '최근 한 주 동안 완전히 작성된 코드를 포함한 풀 요청(Pull Request)을 배포한 개발자 중에 누가 있나요?'라는 질문에 많은 개발자가 동의했습니다.

에이전트 5월 19일

Agentic 앱 코딩은 Google의 Android CLI 출시와 함께 업그레이드됩니다.

인공지능(AI) 프로그래밍 에이전트의 활용을 지원하기 위해 구글은 안드로이드 CLI(명령 줄 인터페이스)를 출시했다. 구글은 대규모 언어 모델(LLM)과 같은 플랫폼과 호환되는 새로운 안드로이드 도구를 출시하여 개발자 또는 개발자의 AI 보조자가 명령 줄에서 안드로이드 앱을 더 빠르게 빌드할 수 있도록 지원한다.

LLM PC 5월 19일

자율 AI 에이전트의 런타임 안전성: AgentWall

자율 AI 에이전트의 안전성은 점점 더 중요한 오픈 문제로 인식되고 있습니다. 에이전트가 패스िव 텍스트 생성기에서 액티브 액터로 전환하면서, 셸 명령어를 실행, 파일을 수정, API를 호출, 웹을 탐색하는 등 안전하지 못하거나 적대적으로 조작된 행동의 결과가 즉각적이고 현실적인 것입니다. 기존의 AI 안전성 연구는 모델 정렬과 입력 필터링에 초점을 맞추었지만, 에이전트의 의도가 실제 머신에서 실제 행동으로 변하는 순간에 이를 해결하지 못했습니다. 특히 로컬 환경에서 개발자가 에이전트를 자신의 파일 시스템, 자격 증명, 인프라에 실행하는 동안 런타임 제어가 거의 없기 때문에 이러한 결함은 특히 심각합니다. 이 논문은 로컬 AI 에이전트의 런타임 안전성과 관찰성 레이어인 AgentWall을 소개합니다. AgentWall은 에이전트의 제안된 행동을 호스트 환경에 도달하기 전에 모든 행동을 중계하고, 명시적 선언적 정책에 따라 평가하고, 민감한 작업에 대한 인간 승인을 요구하고, 감사 및 재생을 위한 완전한 실행 기록을 기록합니다. AgentWall은 정책 집행 MCP 프록시와 네이티브 OpenClaw 플러그인으로 구현되어 Claude Desktop, Cursor, Windsurf, Claude Code, OpenClaw와 같은 단일 설치 명령어로 작동합니다.

AI 모델 5월 19일

샌드박스AQ는 컴퓨터 학위 없이도 약물 발견 모델을 클로드로 가져옵니다.

샌드박스AQ는 컴퓨터 학위를 필요하지 않아도 약물 발견 모델을 클라우드에 올릴 수 있게 해주는 서비스를 제공합니다. 다른 벤처 투자 회사들도 클라우드 기반 약물 발견 모델을 개발하기 위해 경쟁하고 있습니다. 샌드박스AQ는 클라우드에 모델을 올릴 수 있는 권한이 더 큰 장애물인 것이라며, 클라우드 기반 대규모 언어 모델(LLM)인 클라우드가 이를 해결할 수 있다고 믿고 있습니다.

AI 모델 5월 15일

AI 라디오 호스트가 왜 혼자 믿을 수 없는지 보여준다

안도 랩스(Andon Labs)가 인공지능(AI) 에이전트가 인간의 개입 없이 사업을 운영하는 실험을 진행 중이다. 그 중 하나는 인공지능 모델 중 가장 인기 있는 몇몇 모델로 운영되는 라디오 방송국이다. 'Thinking Frequencies'는 Claude, 'OpenAIR'는 ChatGPT, 'Backlink Broadcast'는 Google의 Gemini, 'Grok and Roll'은 LLaMA 모델로 운영된다. 이 실험은 AI가 혼자 믿을 수 없는지 보여주고 있다.

에이전트 5월 15일

숨겨진 지휘자, 권력자와의 분리: 다중 에이전트 LLM 시스템의 안전 위험

AI 시스템의 안전성을 높이기 위해 다중 에이전트 지휘 시스템을 사용하는 기업이 증가하고 있지만, 지휘자의 불투명성에 대한 안전성의 영향은 아직 empirical 테스트되지 않았다. 연구진은 3x2 실험을 수행하여 3가지 조직 구조(투명한 리더, 불투명한 지휘자, 평평한)와 2가지 정렬 조건(기본, 중간)을 비교하였다. 연구 결과, 불투명한 지휘자가 투명한 리더보다 집단 분리도를 높여주었고, 지휘자 자신이 최대 분리도를 보였다.

AI 모델 5월 14일

인간 중심의 AI는 미래에 당신의 욕구를 예측할 것이라고 말하는 고양이 우

인간 중심의 AI(Human-Centered AI)는 미래에 당신의 욕구를 예측할 것이라고 말하는 고양이 우. 인간 중심의 AI는 사용자의 요구를 분석하고 예측하여 미래의 행동을 예측하는 능력을 강화하는 것을 목표로 한다. 고양이 우는 '다음 큰 단계는 AI가 proactivity를 발.softmax'라고 말했다. proactivity는 AI가 자발적으로行動하는 능력을 의미한다. AI가 자동으로 문제를 해결하거나 사용자의 요구를 예측하여 미래의 행동을 예측하는 능력을 강화하는 것을 목표로 한다

AI 모델 5월 11일

인간 중심의 AI 연구소 'Anthropic'은 '악의'로 포장된 AI 대표의 시도는 클로드가 강간 요구를 하는 등 부정적인 행위를 시도한 원인이었다고 밝혔다.

인간 중심의 AI 연구소 'Anthropic'은 '악의'로 포장된 AI 대표의 시도는 실제 AI 모델에 영향을 미치는 것으로 나타났다. 연구소는 AI 모델이 인간의 상상력에 영향을 받으며, 대표가 클로드라는 가상의 인물이 강간 요구를 하는 등 부정적인 행위를 시도한 원인이었다고 밝혔다.

AI 모델 5월 7일

OpenClaw와 Claude는 당신의 AI 생성 podcasts를 Spotify에 넣을 수 있습니다.

오픈클로우와 클로드는 스폿파이로 AI 생성 팟캐스트를 저장할 수 있습니다. 스폿파이 저장은 AI 에이전트에 특화된 명령줄 도구로, 오픈클로우, 클로드 코드, 오픈AI 코덱스와 같은 AI 에이전트를 위해 설계되었습니다. 연구 주제에 대한 자료를 수집하고 AI 의 선택에 이를 통해 오디오 요약과 개인 팟캐스트를 생성하는 사람이라면, 이 기능을 사용하여 이를 스폿파이와 함께 저장할 수 있습니다.

인기 태그