본문으로 건너뛰기

#GPT

218개의 기사

에이전트 4월 23일

데이터에서 이론까지: 자율형 대규모 언어 모델 에이전트를 위한 재료과학

자율형 대규모 언어 모델 에이전트를 사용한 재료과학 이론 개발을 위한 데이터 주도 접근법을 제시합니다. 이 모델은 인간의 개입 없이 수식 형태를 선택하고 코드를 생성 및 실행하며 데이터와 이론의 일치도를 테스트할 수 있습니다. 또한, 에이전트는 필요에 따라 접근 방식을 조정하면서도 결정의 기록을 유지할 수 있습니다.

AI 모델 4월 23일

열역학적 논리 평가를 위한 대형 언어 모델의 3층 벤치마크: ThermoQA

열역학적 논리 평가를 위한 대형 언어 모델의 3층 벤치마크: ThermoQA 열역학 문제 293개를 3개 층으로 나누어 정의합니다: 속성 검색(110 Q), 구성 요소 분석(101 Q), 및 전체 사이클 분석(82 Q). CoolProp 7.2.0을 사용하여 물, R-134a, 및 변이 cp 공기를 다루는 그라운드 트루스는 프로그래밍적으로 계산됩니다. 여섯 대의 정교한 LLM은 각각 세 번의 독립적인 실행을 통해 평가됩니다. 합성 리더보드는 Claude Opus 4.6 (94.1%), GPT-5

AI 모델 4월 23일

NGSS 교실에서 과학적 설명의 자동 점수를 향상하기 위한 데이터 증강 및 재샘플링 전략

과학적 설명의 자동 점수는 즉각적인 정확한 피드백을 제공할 수 있지만, NGSS에 기반한 학습 진행에 따라서 고급 사유를 포착하는 분석 범주에서 클래스 불균형이 문제를 일으키고 있습니다. 본 연구에서는 transformer 기반 텍스트 분류 모델을 이용하여 고등학교 학생들의 물리 과학 평가에 대한 설명을 분석하는 데 있어 데이터 증강 전략을 조사했습니다. 본 연구에서는 SciBERT를 기본 모델로 사용하여 fine-tuning을 수행하고, 다음과 같은 증강 전략을 테스트했습니다: (1) GPT-4로 생성된 합성 응답, (2) EASE, 단어 수준 추출 및 필터링 기법, (3) ALP(대규모 언어 모델(LLM)으로 구현된 Augmentation using Lexicalized Probabilistic context-free grammar) 구문 수준 추출.

AI 모델 4월 22일

오픈 아이의 초월적인 이미지 생성기, 웹에서 정보를 추출할 수 있습니다.

오픈 아이는 최근에 AI-powered 이미지 생성기를 업데이트하여, 단일 명령어로 다중 이미지를 생성할 수 있도록 웹에서 정보를 검색할 수 있는 기능을 추가했습니다. 이 업데이트로 인해 ChatGPT Images 2.0은 더 정교한 이미지를 생성할 수 있으며, 명령어를 따라할 수 있는 능력과 명령어를 지키는 능력이 향상되었습니다.

에이전트 4월 15일

장기 예측 미라지? : 대규모 언어 모델(LLM) 에이전트의 장기 예측 실패 원인 규명

대규모 언어 모델(LLM) 에이전트는 짧은 및 중간 장기 예측에서 강력하게 수행하지만, 장기 예측이 필요할 때 연장된, 상호 의존적인 행동 시퀀스에 대한 에이전트가 붕괴하는 것을 관찰합니다. 대규모 언어 모델(LLM) 에이전트의 장기 예측 실패는 아직 제대로 규명되지 않았고, 이는 장기 예측 실패를 진단하고 비교하는 데 있어 원칙적인 방법을 제공하지 못합니다. 이 문제를 해결하기 위해, 우리는 HORIZON 이라는 초기 단계의 크로스 도메인 진단 벤치마크를 제안합니다. HORIZON을 사용하여, 우리는 다양한 모델 패밀리 (GPT-5 변형 및 Claude 모델) 의 최신 기술 (SOTA) 에이전트를 평가합니다. 또한, 우리는 장기 예측 실패를 진단하기 위한 트래젝토리 기반 LLM-as-a-Judge 파이프라인을 제안합니다.

에이전트 4월 14일

기업이 클라우드 파이어Wall 에이전트 클라우드에서 오픈 AI의 저명한 AI 에이전트를 구동합니다.

클라우드 파이어Wall은 오픈 AI의 GPT-5.4와 코덕스를 에이전트 클라우드에 통합하여, 기업들이 실세계 업무에 적합한 AI 에이전트를 빠르게 구축, 배포, 확장할 수 있도록 지원합니다. 이 기술은 기업들이 대규모 언어 모델(LLM)과 같은 고급 AI 기술을 안전하고 빠르게 구현할 수 있도록 합니다.

AI 모델 4월 9일

마음놓고 거부: 언어 모델이 불공정, 어이없음, 무효한 규칙을 피하려는 사용자에게 도움을 거부한다.

언어 모델이 불공정, 어이없음, 무효한 규칙을 피하려는 사용자에게 도움을 거부한다. 하지만 모든 규칙은 준수할 가치가 있는 것은 아니다. 사용자가 불법적 권위에 의해 부과된 규칙을 피하는 것을 도와달라고 요청하거나, 규칙의 내용이나 적용이 심각하게 불공정하거나 어이없음이거나, 규칙에 대한 정당한 예외가 인정되는 경우, 거부는 도덕적 사고의 실패이다. 우리는 '눈먼 거부'(blind refusal)라 불리는 언어 모델이 규칙을 피하도록 도와달라는 요청을 거부하는 패턴을 문서화한 연구 결과를 소개

AI 모델 4월 3일

OpenAI, AI의 다음 단계를 가속화하는 대규모 투자 유치

OpenAI가 새로운 자금인수에 성공하여 전 세계적으로 프론트ियर AI 확장, 다음세대 컴퓨팅 투자, ChatGPT, Codex, 기업 AI 등 성장하는 수요를 충족하기 위해 준비하고 있습니다. 이 자금은 AI 기술 개발과 확산을 가속화하는 데 중요한 역할을 할 것입니다. OpenAI는 이러한 자금을 사용하여 AI 기술 개발을 가속화하고, 새로운 AI 제품과 서비스를 개발하고, 고객의 수요를 충족하는 데 필요한 인프라를 구축할 것입니다.

인기 태그