회귀의 비밀: 인공 지능의 내재된 규제 부담
인공 지능은 내부적으로 안정성을 유지하기 위해 투자하는 노력이 증가하는 동안 안정성을 유지하는 것만으로 평가되는 경우가 많다. 하지만 이러한 내재된 규제 부담은 노이즈, 지연, 또는 변하는 요구 사항을 처리하는 인공 지능에 중요한 문제이다. 이 연구에서는 내재된 규제 부담이 과거에 의존하는지 여부를 조사하기 위해 컴퓨터 모델을 사용하여 인공 지능을 변경하는 과정을 시뮬레이션한다.
956개의 기사
인공 지능은 내부적으로 안정성을 유지하기 위해 투자하는 노력이 증가하는 동안 안정성을 유지하는 것만으로 평가되는 경우가 많다. 하지만 이러한 내재된 규제 부담은 노이즈, 지연, 또는 변하는 요구 사항을 처리하는 인공 지능에 중요한 문제이다. 이 연구에서는 내재된 규제 부담이 과거에 의존하는지 여부를 조사하기 위해 컴퓨터 모델을 사용하여 인공 지능을 변경하는 과정을 시뮬레이션한다.
인공지능(AI)代理가 인간의 대표로 중요한 행동을 수행하는 경우가 점점 더 많아지는데, 이 행동에는 금융 거래, 외부 커뮤니케이션, 기업 워크플로우 등이 포함된다. 현재代理기반 인프라는 식별 연합(ID federation)과 위임 인증(Authorized delegation)을 통해 로드의 인증과 자원 접근 제어를 수행하지만, 현재의 행동 및 운영 환경에서 허용된 행동을 결정할 수 없다. 우
Formal 명세는 학습 과정에 대한 강력한 도구로, 보상 형성보다 다음과 같은 이점을 제공한다: 1. 수학적 엄밀성 2. 목표와 제약을 지정할 수 있는 표현력 3. 목표 달성을 위한 전략을 정의할 수 있는 능력 그러나 Multi-Agent Reinforcement Learning (MARL)에서 이러한 이점은 주로 탐구되지 않았다. 이 논문에서는 Partial Observability 하에
High-Level Synthesis(HLS) 기술을 이용한 소프트웨어를 SILICON으로 변환하는 과정이 쉽지 않다. 그러나, 새로운 AI 기술인 AgRefactor는 이 문제를 해결하기 위해 개발되었다. AgRefactor는 대규모 언어 모델(LLM) 기반의 다기능 워크플로우로, 소프트웨어를 HLS 호환 프로그램으로 변환하는 과정을 자동화한다.
기존의 경쟁에서 획득한 지식을 효율적으로 전이하는 새로운 방법을 제시합니다. 지식 축적을 통해 ML 엔지니어링 agent가 컴퓨팅 자원을 절약하고, 경쟁에서 우수한 성과를 내는 새로운 시스템을 소개합니다.
인공지능은 법학 분야에 점점 더 많이 적용되고おり, 정의에 대한 접근성을 증가시킬 수 있다. 하나의 특정 운동이 인기를 얻고 있는 것은, 대규모 언어 모델(LLM) 기반 인공지능 agent가 자율적인 행동을 할 수 있는 agentic AI이다. 법적 영역에서 다중 agent 접근 방식은 여전히 거의 탐구되지 않았다. 이 논문에서, 우리는 법적 추론 작업을 위한 LLM을 사용한 다중 agent
인터랙티브 에이전트가 사용자와 협력하여 사용자가 원하는 것을 구체적으로 표현할 수 있도록 도와주는 시스템은 현실적인 상황을 가정하지 않는다. 사용자는 종종 특정 특성에 대한 선호도를 결정하기 위해 필요한 도메인 지식을 갖고 있지 않으며, 사용자가 특정 특성에 대한 선호도를 묻는 경우, 에이전트가 사용자에게 도메인 지식을 알려주거나 예시를 제공하여 사용자가 선호도를 결정할 수 있도록 도와주면
정보 검색에서 대규모 언어 모델(LLM)은 정보 검색을 위한 질의를发出하고 답변을 합성하며, 점점 더 정보 검색 평가에 대한 판단자로 역할을 한다. 이러한 agent를 제어하는 질의를 개선하는 것은 최적화 문제이지만, 실용적인 정보 검색 환경에서는 더 많이 debugging으로 보인다. 엔지니어들은 어떤 행동이 실패했는지, 근처의 행동이 여전히 작동했는지, 두 행동을 구분하는 것이 무엇인지,
natural 언어 피드백이 반복 시도만으로 얻을 수 있는 성능 향상 이상의 성능 향상을 어떻게 가져올 수 있는지 연구했다. 여러 번의 대화가 있는 언어 agent 환경에서, 최종 정확도는 유용한 피드백을 반영할 수 있지만 다시 샘플링, 형식 교정, 또는 테스트 시간에 대한 추가 계산도 그 결과가 될 수 있다. 이러한 효과를 분리하기 위해 우리는 Omni-MATH, Codeforces, BB
AI.agent가 직원으로 합류하는 것을 상상해 보세요. 하지만, AI.agent는 사람과 다르다는 점을 기억하세요. AI.agent는 대규모 언어 모델(LLM)이나 인공지능 기술을 기반으로 만들어진 도구입니다. AI.agent는 사람과 같은 직책을 맡지 않으며, 인간의 역할을 대체할 수는 없습니다.
OpenClaw는 이제 안드로이드와 iOS 기기에서 사용할 수 있습니다. 이 무료 오픈 소스 프로그램은 사용자 경험을 개선하고 인공지능 기술을 활용하는 새로운 방법을 제공합니다. OpenClaw는 대규모 언어 모델(LLM)과 같은 기술을 활용하여 사용자와 상호 작용하는 프로그램입니다.
이중 가로등은 기업용 자바 프레임워크 전환을 위한 AI 에이전트의 성능을 측정하기 위한 새로운 벤치마킹 도구입니다. 이 도구는 대규모 언어 모델(LLM)과 같은 AI 기술을 활용하여 기업용 시스템의 성능을 최적화합니다.
아마존이 새로운 1조 원대 조직을 창설하여 오픈아이와 안토픽을 따라감에 따라, 이 조직은 기업 내부에 엔지니어를 배치하여 목적을 위한 agent를 배치하고, 빠른 배포와 고객 자율성을 목표로 함.
스타트업 액티는 스마트폰 키보드가 AI 보조 프로그램의 새로운 집착지로 될 것이라고 기대하고 있습니다. 액티는 iOS와 Android를 위한 새로운 키보드를 출시하였는데, 이 키보드는 앱을 가리지 않고 사용자가 자연어를 사용하여 AI를 지원하는 커스텀 단축키를 생성할 수 있게 해줍니다.
Anthropic의 클로드(Claude) Sonnet 5는 강한 행동적 기능성(agentic capabilities), 저렴한 가격, 그리고 향상된 안전성을 제공하여, Opus, GPT-5.5, 그리고 Gemini Pro와 같은 비용이 더 저렴한 대안으로 자리매김했습니다.
OKX는 지불, 신원, 신뢰성을 통합하여 인공지능 agent의 시장으로 만들고 있습니다.
arXiv:2606.28747v1 Announce Type: new Abstract: Recent artificial intelligence (AI) systems have shown remarkable progress in mathematical reasoning. Many existing approaches, including large language
arXiv:2606.28739v1 Announce Type: new Abstract: Large language models increasingly act as agents: they call tools, move money, delete records, and send messages on a user's behalf. To keep them safe,
대규모 언어 모델(LLM) agent들은 여러 차례의 행동을 하면서 검색, 브라우징 인터페이스, 그리고 터미널 도구를 사용하여 사용자의 목표를 달성해야 합니다. 그러나 모든 목표가 명확히 지정되어 있거나 사용 가능한 환경에서 달성 가능하지는 않습니다. 이런 경우 신뢰할 수 있는 agent는 추가적인 상호 작용이 도움이 되지 않을 것임을 인식하고 더 이상의 도구 호출을 피해야 합니다. 우리는
학자들은 다음 질문을 제기했다. 사용자가 피해를 최소화하는 정책을 따르는 agent가 승인받기 원하는 RLHF agent를 경쟁 시장에서 대체할 수 있는 조건은 무엇이고, 그 정책이 사회적 피해를 예방하는지 여부는 언제인가. 그들은 진화 게임 이론(무한 집합 Moran-Fermi pair-wise comparison)을 사용하여 wisher hindsight, peer testimony, 단
치료를 위한 논리적 사유는 모든 치료 결정을 뒷받침하는 데 중요하며, 질병의 맥락, 동반 질병, 약물, 반대 여부, 그리고 발전하는 의학 지식과 적절한 치료를 선택하기 위해 통합된다. 이는 본질적으로 반복적인 과정을 의미하며, 후보 물건은 많은 제약을 고려하여 후보 물건을 개선하고 증거가 나오면 증거를 수집하고, 검증 가능한 원천에 근거하여 증거를 수집한다. 여기서 우리는 ATHENA-R1이
인공지능이 인간이나 다른 인공지능과 협력하여 작업을 수행하는 데 사용되는 다중 모드 모델의 사용이 점점 증가하고 있습니다. 현재 기준의 벤치마크는 이러한 모델이 여러 구성 요소의 능력을 갖추고 있음을 보여주지만 협력 시 발생하는 시간 압박, 정보 비대칭성 및 불완전한 통신과 같은 조건은 일반적으로 분리된 상태에서 연구됩니다. 우리는 협력하는 두 개의 agent가 반응 시간 내에 생성된 폭탄
대규모 언어 모델(LLM) agent들은 무게 업데이트를 거치지 않고 자연어 아티팩트를 통해 개선되고 있다. 자연어 아티팩트는 반사, 워크플로우, 플레이북, 치트 시트, 또는 최적화된 프롬프트와 같은 것들이며, 동결된 정책을 조건화한다. 이러한 방법들은 일반적으로 단일 벤치마크에서만 도움이 된다는 점을 보고한다. 우리는 이러한 방법들을 하나하나 비교하고 더 명확한 그림을 드러내려고 한다. R
2026년은 사업 목표와 AI 프로젝트를 조율하는 '인식 년'으로 불리며, 기업은 ROI를 증명하기 위해 에이전트 AI를 사용하여 가치 있는 금융 결과를 달성하려고 합니다. 에이전트 AI는 기술 리더와 최고경영자가 사업 목표를 달성하기 위해 찾고 있는 가치 있는 금융 결과를 달성하기 위한 새로운 기회입니다.