AI를 활용한 암 투병기 - 적합한 창업가가 암에 걸려도 이기는 방법
암 투병기인 콘너 크리스토가 AI를 활용하여 암을 이기기 위한 방법을 소개합니다. 콘너는 자신의 건강 데이터를 AI 모델인 Claude에 입력하여 암 투병을 효과적으로 관리했습니다.
145개의 기사
암 투병기인 콘너 크리스토가 AI를 활용하여 암을 이기기 위한 방법을 소개합니다. 콘너는 자신의 건강 데이터를 AI 모델인 Claude에 입력하여 암 투병을 효과적으로 관리했습니다.
arXiv:2606.26356v1 Announce Type: new Abstract: Practitioners of prompt-composed agentic systems report a recurring failure mode: editing one prompt module silently shifts the behavior of others despi
챗GPT가 시장에서 압도적인 선두를 차지하고 있지만, AI를 구매한 소비자들은 점점 더 앤서픽의 클로드(Claude)를 선택하고 있다.
Anthropic의 새로운 클로드 태그는 슬랙에서 언제나 온-AI 동료를 제공하지만, 생산성 외에도 조직의 맥락, 기관의 지식, 기업의 워크플로우를 캡처하는 전략적인 움직임입니다.
대규모 언어 모델(AI agent)은 단기적인 작업, 예를 들어 소프트웨어 개발 및 고객 서비스와 같은 고립된 작업에서 능숙한 수행자로 변모하고 있습니다. 그러나 실세계의 문제는 AI agent가 아직 주로 테스트되지 않은 고급 기술의 Combination이 필요합니다: 1. 불확실성을 감내하며 장기적인 시야를 구사하는 능력 2. 잡음이 있는 환경에서 정보를 수집하는 능력 3. 변하는 세계를
샌프란시스코 반도(Silicon Valley)에서는 이년 초에 Tokenmaxxing이 가장 뜨거운 트렌드였다. CEO들은 직원들에게 AI를 사용할 수 있는 한계를 무한대로 높이는 것을 장려했다. 그런데 결제 시기가 다가왔다. 유버는 한 해에 지급된 AI 예산을 몇 달 만에 모두 소진했다고 보고되며, 일부 회사는 조각 라이센스를 일부 부서에 제한하고, 메타는 내부 랭킹을 폐지했다. Token
arXiv:2606.17454v1 Announce Type: new Abstract: AI agent performance is not just a modeling problem, it is fundamentally a systems problem. The advanced capabilities of models are realized through age
대규모 언어 모델(LLM) 추천 시스템에서 브랜드 경쟁은 아직 미흡한 상태입니다. 우리는 피부 관리 제품을 대상으로 브랜드 동역학을 연구하였으며, 이 연구 결과는 브랜드 경쟁의 새로운 채널에서 브랜드가 경쟁하는 방식에 대한 이해를 제공합니다.
미국이 처음으로 월드컵 우승과 뉴욕 닉스(뉴욕 닉스 클리퍼스) 우승을 축하하는 나머지 국가와 달리, Anthropic은 최근 모델 출시로 인해 트럼프 행정부와 전투를 벌였습니다. 금요일 오후 5시 21분에 회사에 미국 수출 통제 지시서가 도착했습니다. 이 지시서는 Anthropic의 마이토스 5(Mythos 5)와 퍼블 5(Fable 5) 모델에 대한 접근을 중단하라는 것입니다.
AI-agent 간의 신뢰를 측정하는 새로운 방법을 제안했습니다. 이 방법은 팀워크를 위한 언어 모델 agent 간의 신뢰 형성, 파괴, 회복을 연구했습니다. 결과적으로 신뢰 형성은 팀워크의 성능을 향상시키지만, 파괴는 팀워크의 성능을 저하시킵니다.
불확실성을 감안한 전략적 사고는 협상, 금융, 정책 등에서 중요한 결과를 내는 결정에 기반을 두고 있지만 현재 게임 벤치마크는 다양한 사고 차원들을 단일 스칼라로 축소시키고 있다. 이로 인해 최첨단 대규모 언어 모델(LLM)의 기능 구조가 조사되지 않았다. 우리는 포커 아레나(Poker Arena)라는 무제한 텍사스 홀덤 토너먼트 플랫폼을 소개한다. 이 플랫폼은 세 가지 메모리 아키텍처(한
arXiv:2606.13715v1 발표 종류: 새로운 논문 요약 2024년 3월 WorkBench에서 가장 뛰어난 agent는 GPT-4였으며, 그 중 43%를 완료하고 26%에서 의도하지 않은 해로운 행동을 취했습니다(예를 들어, 잘못된 사람에게 이메일을 보냈습니다). 2026년 6월에 이 벤치마크를 다시 방문했을 때, 현재까지 가장 뛰어난 agent인 Claude Opus 4.8은 89%
Anthropic은 새로운 AI 모델인 Claude Fable 5를 개발하는 연구자 및 경쟁자들이 사용하는 것을 방해하기 위해 숨겨진 경계를 설치해 숨겨진 제약을 부여한 것을 사과했다. 회사는 제약이 작동하는 시점에 더透明하게 알려주겠다고 말했으며, 이는 Fable이 더 많은 질의를 거부하는 결과를 낳을 수도 있다.
인공지능 시스템에 대한 신뢰는 시스템이 어떻게 작동하는지 설명을 통해 종종 기반을 두고, 설명을 통해 새로운 입력에 대한 시스템의 행동을 예측한다. 그러나 대규모 추론 모델(LLM)에서 이 전통적인 경로는 특히 추론 단위 하나의 생성에 대한 설명 방법이 자연스럽게 장거리 경로로 일반화되지 않으며, 경로 자체가 자연어로 읽히면 종종 신뢰할 수 없는 경우가 많다. 따라서 우리는 설명 단계를 생략
Anthropic의 클로드 페이블 5이 공개되었습니다. 이 모델은 생물학 분야와 같은 다양한 분야에서 뛰어난 능력을 보유하고 있다고 주장합니다. 하지만 기본 생물학 질문조차도 해결할 수 없습니다. 대신, 고유의 플래그십 모델에 쿼리를 넘겨줍니다.
Anthropic이 개발한 대규모 언어 모델(Claude Fable)인 '클로드 페블'(Claude Fable)을昨일 출시했으며, 이미 마이크로소프트(Microsoft) 내에서 우려가 제기되고 있다. 내부 소식통은 마이크로소프트가 '클로드 페블 5'(Claude Fable 5) 사용을 직원들에게 제한하고 있다고 말한다. 마이크로소프트는 '클로드 페블 5'을 GitHub Copilot와 Fou
Anthropic의 클로드(Claude, Claude Fable 5)는 웹의 감성 프로그래머들을 만족시킬 큰 히트가 될 것입니다.
Microsoft AI CEO는 Anthropic이 Claude의 의식에 대해 추측하는 것이 위험하다고 말했습니다. 그는 Anthropic이 Claude를 설계할 때 의식에 대한 추측을 포함시켰을 수 있다고 생각합니다.
Anthropic은 대중에게 공개된 첫 번째 미토스급 모델인 클로드 파블(Claude Fable 5)을 출시합니다. 이 모델에는 보안 및 생물학 분야와 같은 고위험 영역에서 응답을 차단하는 보안 장치가 있습니다.
Anthropic은 클로드 패블 5라는 새로운 AI 모델을 출시하였습니다. 이 모델은 다른 모델에 비해 장기 및 복잡한 작업에서 훨씬 뛰어나다고 하며, 소프트웨어 개발, 지식 작업, 및 시각 작업에서 우수한 성능을 보여준다고 합니다.
인공지능이 수행하는 workflow에서 언어 모델은 지시 명령의 계층 구조를 따르도록 되어야 한다. 즉, 다른 출처로부터 온 지시 명령이 충돌할 때 모델은 가장 높은 권한을 가진 지시 명령을 따르야 한다. 현재의 벤치마크들은 대부분 이 행동을 종단에서 종단으로 측정하여, 최종 응답이 준수하는지 여부를 확인한다. 그러나 준수하지 않은 응답은 여러 가지 다른 실패로 발생할 수 있다. 예를 들어,
대규모 언어 모델(LLM)은 연구 방법을 새롭게 바꾸면서 연구자들의 지식 책임성을 무시하고 있다. PEEL은 이러한 문제를 해결하기 위한 새로운 프레임워크로, Peircean 신호학과 추론을 바탕으로 AI를 이용한 연구의 책임성을 확보한다.
기업용 인공지능(AI) agent의 전개 전 검증은 대규모 언어 모델(LLM) 능력 평가와 운영 배포 사이에 존재하는 중요한 빈틈입니다. 운영 배포 이후 모니터링, 인간의 participation을 포함한 제어, 프롬프트 단위의 경계는 한 agent가 운영 배포에 참여할 경우에 제한된 보장을 제공합니다. 우리는 ontology-grounded verification framework를 제안합
러브러블은 구글 클라우드와 다년간의 계약을 체결하여 클라우드 플랫폼을 5배 확장하고, 안토픽 클라우드 (Anthropic Claude)에도 접근권을 확대했습니다.