Anthropic의 클로드(Claude)는 지불하는 고객을 사로잡고 있으며, ChatGPT가 소유하고 있는 시장에서 승리하고 있습니다.
챗GPT가 시장에서 압도적인 선두를 차지하고 있지만, AI를 구매한 소비자들은 점점 더 앤서픽의 클로드(Claude)를 선택하고 있다.
218개의 기사
챗GPT가 시장에서 압도적인 선두를 차지하고 있지만, AI를 구매한 소비자들은 점점 더 앤서픽의 클로드(Claude)를 선택하고 있다.
바이럴 게시물은 이제는 장문의 다언어 문장, 여러 이미지, 혼합된 출처, 그리고 텍스트와 이미지의 서술 오류를 포함하는 것이 더 많아지면서, 다중 모드 정보 오류 탐지의 중요성이 점점 더 커지고 있습니다. 현재의 기준점과 방법들은 여전히 이 환경에 잘 맞지 않고 있습니다: 일반적으로 짧은 캡션, 단일 이미지, 이진 레이블, 또는 하나의 조작 소스를 분리하는 경향이 있습니다. 또한, 현실적인
GPT-5 Pro는 T 세포 행동에 대한 통찰력을 제공하며 3년 동안 해결되지 못한 면역학의謎를 풀어냈다. 이러한 발전은 암과 자가면역 질환 연구를 지원할 수 있다.
대규모 언어 모델(LLM)을 목표 가치 함수와 일치시키는 데 있어 중요한 진전이 이루어졌습니다. 우리는 LLM이 (포스트-)학습 시 잘 일치되더라도, 여전히 합리적인 가치 maximization에서 실패할 수 있음을 주장합니다. 이 간격을 합리적 가치 위험(rational value risk)으로 정의하여 수학적으로 정의합니다. 이는 모델의 배포된 추론 전략과 합리적인 동등체가 되는 응답의
삼성전자(Samsung Electronics)는 전 세계 직원에게 OpenAI의 대규모 언어 모델(LLM)인 ChatGPT Enterprise와 Codex를 배포했다. 이 배포는 OpenAI가 기업으로서의 AI 배포 중 가장 큰 규모의 것으로 간주된다.
오픈 아이(OpenAI)가 기업용 챗GPT(ChatGPT Enterprise)에서 새로운 비용 관리 기능과 사용 분석 도구를 출시했습니다. 이 기능은 조직이 비용을 관리하고 AI를 신뢰감 있게 확장할 수 있도록 도와줍니다.
Learn how GPT-5.5 Instant improves ChatGPT’s health and wellness responses with stronger reasoning, better context, clearer communication, and physician-informed evaluations.
최근의 논문에서는 대규모 언어 모델(LLM) agent에 대해 고전적인 확률론적/지식론적 불확실성 프레임워크가 부족하다고 주장하고, 새로운 agent 기능인 예방적 설명요청과 공유된 정신 모델 생성을 가능케 하는 불확실성 표현을 위한 하이퍼스펙티파이 의식, 분해, 그리고 의사소통 가능한 불확실성 표현을 필요로 합니다. 실용적인 배포 제약조건 - 블랙박스 API, 상호 작용 지연 시간 지출,
인공지능 모델에 고급 해킹 기능이 곧 일반화될 것입니다. AI model의 한 유형인 Generative Pre-trained Transformer 3(GPT-3)은 이미 사용자가 원하는 대로 작동하도록 프로그램할 수 있는 능력을 보유하고 있습니다.
대규모 언어 모델(AI agent)은 단기적인 작업, 예를 들어 소프트웨어 개발 및 고객 서비스와 같은 고립된 작업에서 능숙한 수행자로 변모하고 있습니다. 그러나 실세계의 문제는 AI agent가 아직 주로 테스트되지 않은 고급 기술의 Combination이 필요합니다: 1. 불확실성을 감내하며 장기적인 시야를 구사하는 능력 2. 잡음이 있는 환경에서 정보를 수집하는 능력 3. 변하는 세계를
미국인 63%가 인공지능 기술이 너무 빨리 발전하고 있다고 생각한다고 조사 결과가 나타났다. 또한, 대화봇 사용자 중 49%가 매일 또는 주말에 사용한다.
AI-agent 간의 신뢰를 측정하는 새로운 방법을 제안했습니다. 이 방법은 팀워크를 위한 언어 모델 agent 간의 신뢰 형성, 파괴, 회복을 연구했습니다. 결과적으로 신뢰 형성은 팀워크의 성능을 향상시키지만, 파괴는 팀워크의 성능을 저하시킵니다.
대규모 언어 모델(LLMs)은 자동 증명 논리를 크게 진전시키면서도 현재까지 존재하는 공식 평가 지표는 수학적 범위와 난이도에서 모두 제한적이다. 대부분은 대수학과 초등 수학적 수학 이론과 같은 더 쉽게 공식화되는 분야에 집중되어 있으며, 더 깊은 사고를 요구하는 하위 분야인 수학적 분석에 대한 범위는 제한적이다. 이러한 공백을 해결하기 위해 우리는 Mathematical Analysis를
arXiv:2606.13715v1 발표 종류: 새로운 논문 요약 2024년 3월 WorkBench에서 가장 뛰어난 agent는 GPT-4였으며, 그 중 43%를 완료하고 26%에서 의도하지 않은 해로운 행동을 취했습니다(예를 들어, 잘못된 사람에게 이메일을 보냈습니다). 2026년 6월에 이 벤치마크를 다시 방문했을 때, 현재까지 가장 뛰어난 agent인 Claude Opus 4.8은 89%
인공지능 시스템에 대한 신뢰는 시스템이 어떻게 작동하는지 설명을 통해 종종 기반을 두고, 설명을 통해 새로운 입력에 대한 시스템의 행동을 예측한다. 그러나 대규모 추론 모델(LLM)에서 이 전통적인 경로는 특히 추론 단위 하나의 생성에 대한 설명 방법이 자연스럽게 장거리 경로로 일반화되지 않으며, 경로 자체가 자연어로 읽히면 종종 신뢰할 수 없는 경우가 많다. 따라서 우리는 설명 단계를 생략
Nextdoor 엔지니어들이 Codex와 GPT-5.5를 이용해 복잡한 재현이 어려운 문제를 조사하고, 다양한 플랫폼을 건너편하며, 제품 결과에 집중하는 방법을 사용합니다.
격리 모드(Lockdown Mode)를 적용해도 ChatGPT는 프롬프트 인젝션(prompt injection) 공격에 취약할 수 있지만, 민감한 데이터가 공유되는 가능성을 줄이는 것이 목적입니다.
엔다바가 AI agent, ChatGPT Enterprise, Codex를 사용하여 소프트웨어 배포를 가속화하고 워크플로우를 자동화하며 대기업 내 AI-네이티브 문화를 구축하는 방식에 대해 배워보세요.
인공지능 에이전트가 관련된 작업을 수행하는 동안 여러 단계의 웹 자동화 작업을 향상시키기 위해 재사용 가능한 스킬에 점점 더 의존하고 있다. 온라인 스킬 학습에 대한 연구가 점점 더 많아지고 있는데, 에이전트가 이전 작업 경로에서 스킬을 유도하고 미래 작업에서 즉시 재사용하는 방식이다. 그러나 현재의 방법은 대부분 작업 수준에서 스킬을 재사용한다. 초기 작업 지시를 기반으로 고정된 스킬 세트
AI 에이전트의 중단 시점 결정은 안전성과 신뢰성을 높이기 위해 중요합니다. 연구 결과, 감정 기반 트리거와 LLM 판정자는 에이전트의 중단 시점을 결정하는데 실패합니다.
어떤 행동의 품질은 미래의 사건에 의존하거나 게임 규칙을 위반하는 움직임에 의존하거나 다른 플레이어의 결정에 의존할 수 있으므로, 다중 agent 전략적 상호 작용을 위한 언어 모델 agent를 교육하는 것은 핵심적인 어려움을 제시한다. 표준 강화 학습은 각 단계마다 보상을 할당할 수 있다고 가정하지만, 이 가정은 시간과 agent 간의 결과가 얽혀 있는 설정에서 실패한다. 우리는 지연된 단
The lawsuit partially revolves around a shooting at Florida State University last year, and ChatGPT's alleged role in the incident.
물리학 문제를 텍스트에서 다이어그램으로 생성하는 것은 물리 법칙을 엄격히 지키는 것을 요구한다. 현재 생성 모델은 시각적으로 가능성이 높은 출력을 생성하지만, 힘 벡터를 무작위로 생성하고, 보존 법칙을 무시하고, 기하학적 제약을 위반한다. 우리는 물리 법칙을 지키는 신경符号 pipeline인 PhyDrawGen을 제안한다. 먼저 대규모 언어 모델이 문제 텍스트에서 유형화된 장면 그래프를 추출
MUFG uses ChatGPT Enterprise to build an AI-native organization, improve workflows, and deliver new AI-powered financial services at scale.