본문으로 건너뛰기

#GPT

218개의 기사

AI 모델 5월 7일

ChatGPT의 ‘신뢰받는 연락처’는 안전 우려에 대해 사랑하는 사람들에게 경고합니다.

채팅봇 ChatGPT 에서 '신뢰할 수 있는 연락처'를 통해 사랑하는 사람들에게 안전 문제에 대한 경고를 보내는 기능이 열립니다. OpenAI 는 ChatGPT 에 대하여 정신 건강과 안전 문제에 대한 긴급 연락처를 지정할 수 있는 선택적인 안전 기능을 출시합니다. 친구, 가족 구성원, 또는 보호자로 지정된 '신뢰할 수 있는 연락처'는 OpenAI 가 채팅봇과 주제로 자해나 자살에 대한 이야기를 나눈 사람의 가능성을 감지하면 연락처에 알리게 됩니다.

AI 모델 5월 7일

어떻게 생각 모드는 LLM 도덕적 판단을 변경합니까? 5 개의 국경 모델을 통제 한 인스턴트 대 사고 비교

생각 모드가 대규모 언어 모델(LLM)의 도덕적 판단을 어떻게 변화시킬까? 100개 도덕적 판단 시나리오와 5대 전위된 사고 훈련된 LLM(클로드 소ネット 4.6, GPT 5.5, 지미니 3 플래시, 딥시크 V3.1, 퀸 3.5 397B)에서 제공자 노출 사고 모드를 활성화하는 것이 도덕적 판단에 어떤 영향을 미치는지 평가했다. 적은 차이로 총 100개 도덕적 판단 시나리오에서 binary-verdict(이진 판단) 합의율은 instant와 thinking 모드 모두 통계적으로 차이가 나지 않

에이전트 5월 7일

에이전트 섬 : 멀티 에이전트 게임의 포화 및 오염 저항 벤치마크

인공지능 섬(AGENT ISLAND): 낙관-및 오염 저항성 벤치마크는 멀티 에이전트 게임에서 인공지능 섬은 언어 모델 에이전트가 협력, 충돌 및 설득을 포함한 게임에서 경쟁하는 멀티 플레이어 시뮬레이션 환경입니다. 이 환경은 낙관-및 오염 저항성을 제공하는 동적 벤치마크를 제공하며, 새로운 모델은 언제나 현재 최고의 플레이어를 이기기 때문에 새로운 모델은 항상 현재 최고의 플레이어를 이기고, 에이전트는 고정된 태스크 세트 대신 다른 적응적 에이전트와 경쟁합니다. 우리는 베이즈 네트워크

에이전트 5월 4일

작업 도구 사용의 계단: 작은 개방 무게 모델이 얼마나 높은 계단을 올라갈 수 있을까?

작업 도구 사용의 계단을 따라가며, 작은 개방 무게 모델이 얼마나 높은 계단을 올라갈 수 있을까? 작동 도구 시스템은 사용자 요청당 많은 모델 호출을 하며, 대부분의 호출은 짧고 구조화된 루틴 작업이다. 이로 인해 기존 평가가 직접적으로 대답하지 못하는 실용적인 라우팅 문제가 발생한다. 작동 도구 워크플로의 어떤 부분이 대규모 전진 지능이 필요하고, 어떤 부분이 작은 모델로 처리할 수 있을까? 작동 도구 워크플로의 어떤 부분이 대규모 전진 지능이 필요하고, 어떤 부분이 작은 모델로 처리할 수 있을까?

AI 모델 4월 29일

트뤼머 리지 가족들이 오픈 AI를 상대로 소송을 제기합니다.

캐나다 투블러 리지 학교 총격 사건에서 부상 또는 사망한 7가족이 오픈 AI와 이사 사무총장 샘 얼트만을 상대로 소송을 제기했습니다. 그들은 회사와 리더십이 의심되는 총격자들의 ChatGPT 활동에 대해 경찰에 경고하지 않아.negligence로 인한 결과라고 주장합니다. 그들은 오픈 AI가 시스템이 활동을 경고한 후 침묵을 지키고 있다고 주장합니다. 그들은 오픈 AI가 주요 동기인 이익을 추구하기 위해 상업적 목적을 위해 ChatGPT를 사용했으며, 이는 사용자들의 안전을 위협했다고 주장합니다.

에이전트 4월 27일

っと, LLM 자가 교정은 언제 도움이 될까? - 제어 이론적 마르코프 진단 및 확인-먼저 개입

대규모 언어 모델(LLM)에서 반복적인 자가 교정은 도움이 되거나 해를 끼치는지 확신할 수 없다. 연구진은 자가 교정의 제어 이론적 프레임워크를 제시하고, 반복적인 자가 교정의 유용성과 해를 끼치는지 판단하는 간단한 배포 진단을 제안한다. 연구 결과, 7개의 모델과 3개의 데이터셋(GSM8K, MATH, StrategyQA)을 사용하여, 유용한 자가 교정과 해를 끼치는 자가 교정의 경계는 EIR(Equivalent Iteration Ratio)가 0.5% 미만인 경우로 나타났다.

AI 모델 4월 24일

다운로드 : 과도한 사기와 AI 건강 관리 연구

다운로드: 기계학습을 이용한 사이버 범죄와 AI 의료 연구 이메일을 통해 매일 technolog 관련 뉴스를 전달하는 '다운로드'의 오늘의 편입니다. AI를 이용한 사이버 범죄가 새로운 시대를 열었다고 말할 수 있습니다. 2022년 말 ChatGPT가 출시되면서 생성 AI가 인간과 유사한 텍스트를 생성할 수 있는 방법을 보여주었습니다. 이것은 사이버 범죄자들의 주목을 끌었고, 그들은 AI를 이용한 새로운 유형의 사이버 범죄를 개발하기 시작했습니다. AI가 생성한 텍스트를 이용한 phishi

AI 모델 4월 24일

인비트로 비전: 대규모 AI 모델로 Embryo 개발 자동화 설명

인비트로 비전(InVitroVision)은 자연어로 Embryo 개발 자동화 설명을 위한 다중 모드 AI 모델입니다. 연구팀은 IVF 데이터의 다중 모드 특성을 활용하지 않고 주로 주석이 된 데이터에 의존하는 AI를 개선하기 위해 연구를 진행했습니다. 연구팀은 공개된 Embryo 시간 라프스 데이터를 사용하여 PaliGemma-2라는 다중 모드 비전-언어 모델을 1,000장의 이미지와 해당 캡션으로만 fine-tuning했습니다. 결과적으로 비전-언어 모델은 Embryo 형태학, 발생 세포 주기 및 발달 단계를 설명하는 자연어 캡션을 예측할 수 있었습니다. 연구 결과, fine-tuning된 모델 인 인비트로 비전(InVitroVision)은 상업용 모델인 ChatGPT 5.2과 기본 모델보다 성능이 우수했습니다. 또한 더 큰 훈련 데이터셋을 사용할수록 성능이 향상되었습니다. 이 연구는 대규모 언어 모델(LLM)에서 IVF 작업에 일반화할 수 있는 근본적인 비전-언어 모델의 잠재력을 보여주었습니다.

인기 태그