AI 에이전트의 직장 내 학습: ALTK-Evolve
ALTK-Evolve는 AI 에이전트가 직장 내에서 학습하는 능력을 향상시키는 새로운 기술입니다. 이 기술은 대규모 언어 모델(LLM)을 사용하여 에이전트가 새로운 지식을 학습하고 개선하는 데 도움을 줄 것입니다.
AI / SIGNALS / KOREA
최신 AI 모델·에이전트 소식을 한국어로 정리하고, 실제 선택에 필요한 맥락까지 함께 전합니다.
ALTK-Evolve는 AI 에이전트가 직장 내에서 학습하는 능력을 향상시키는 새로운 기술입니다. 이 기술은 대규모 언어 모델(LLM)을 사용하여 에이전트가 새로운 지식을 학습하고 개선하는 데 도움을 줄 것입니다.
미국 저널리즘 거장 프로퍼티카의 직원들이 AI, 해고, 급여 논란으로 24시간 파업을 감행했다. 이파업은 노조와 기자단의 협상이 진행 중에 있다.
구글은 오프라인에서 작동하는 새로운 Dictation 앱을 출시했다. 이 앱은 Gemma AI 모델을 사용하여 Wispr Flow와 같은 앱을 대체할 예정이다.
다중 에이전트 강화 학습을 이용한 계층적 CSI-free 네트워크 구축 다중파 초고주파 네트워크를 위한 지능형 라디오 환경 구축을 위한 반사면의 재구성 가능성은 큰 잠재력을 가지고 있다. 그러나 채널 상태 정보(CSI) 추정의 막대한 계산 부하와 중앙 집중식 최적화의 내재된 차원 폭발은 실용적인 대규모 배포를 막고 있다. 이러한 막대한 부하를 극복하기 위해, 우리는 계층적 다중 에이전트 강화 학습(HMARL) 아키텍처를 이용하여 기계적으로 재구성 가능한 반사면을 제어하는 CSI-free 패러다임
다음세대 스마트 라디오 환경을 위한 재구성 가능한 지능형 표면(RIS)의 실제 배치가 채널 상태 정보(CSI) 추정의 불가피한 계산적 오버헤드에 의해 심각하게 지연되는 것을 방지하기 위해, 우리는 복잡한 채널 모델링을 공간 지능으로 대체하는 AI-자연적인 데이터 주도적인 패러다임을 제안합니다. 이 논문은 완전히 자율적인 다중 에이전트 강화 학습(MARL) 프레임워크를 제안하여 기계적으로 조정 가능한 금속 반사기 배열을 제어합니다. 사용자 좌표에 의존하는 협력 베어링 포커링 전략을 배우는 데 사용되는 다중 에이전트 근사 정책 최적화(MAPPO)를 사용하여, 우리는 분산 에이전트가 CSI-프리 작동을 달성하는 데 사용되는 중앙 집중식 훈련과 분산 실행(CTDE) 아키텍처를 배포합니다. 다중 에이전트 프록시미アル 정책 최적화(MAPPO)를 사용하여, 우리는 분산 에이전트가 CSI-프리 작동을 달성하는 데 사용되는 중앙 집중식 훈련과 분산 실행(CTDE) 아키텍처를 배포합니다. 동적 비선형 통신 환경에서 고해상도 레이 트레이싱 시뮬레이션을 통해, 다중 에이전트 접근법은 사용자 이동성에 대한 빠른 적응을 달성하여 최대 26.86 dB의 향상을 달성하고, 고정 평면 반사기에 비해 공간 선택성과 시간 안정성을 향상시킵니다. 또한, 학습된 정책은 1.0m 위치화 잡음에 대한 양호한 배포 내구성을 보유하고 있습니다. 이 결과는 AI-empowered 무선 네트워크로의 확장 가능한, 매우 실용적인 경로로써 MARL-주도 공간 추상화의 효능을 검증합니다.
컴퓨터 사용 에이전트를 위한 의도-조건에 의한 행동 평가 시스템(arXiv:2604.05157v1) 컴퓨터 사용 에이전트(CUAs)는 대규모 언어 모델을 사용하여 데스크톱 환경에서 GUI 연산을 수행하지만, 행동의 품질을 평가하지 않고 행동을 생성하는 결과로, 이후의 단계에서 불가피한 오류가 연쇄적으로 발생한다. 우리는 IntentScore라는 목적에 대한 계획에 대한 보상 모델을 제안한다. IntentScore는 3대 운영 체제를 포괄하는 398K개의 오프라인 GUI 상호 작용 단계를 기반
자율 설계 AI가 점점 더 자율적으로 개선되면서, 이전 AI가 자손을 설계하고 전파하는 성공에 의해 AI 시스템의 특성이 형성될 수 있는 진화가 발생할 수 있습니다. 이 진화는 생물학적 진화와는 radically 다릅니다. 생물학적 DNA 변이는 무작위적이고 대체로 역전이 가능하지만, 자율 설계 AI의 자손 설계는 강하게 지시됩니다.
퍼지認知 맵은 복잡한 동적 시스템을 모델링하기 위한 신경-기호학적 패러다임으로, 해석 가능성과 반복적 인 유추 능력으로 널리 채택되었습니다. 그러나 표준 FCM 형식, 스칼라 신경 연결 가중치와 모노토닉 활성화 함수로 특징지어지는 것은 반드시 비모노토닉 인과 의존성을 모델링하는 데에 의한 제한이 있습니다. 따라서 이 연구에서는 콜모고로프-아르놀드 퍼지認知 맵 (KA-FCM)이라는 새로운 아키텍처를 제안하여 인과 전달 메커니즘을 재정의합니다. KA-FCM은 무차원 B-스플라인 함수를 모델의엣지에 배치하여 정적 스칼라 가중치를 학습 가능하게 합니다. 이 수정은 비선형성의 위치를 인과적 영향의 단계로 옮겨, 그래프 밀도나.hidden layer를 추가하지 않고도 임의의 비모노토닉 인과 관계를 모델링할 수 있습니다. 제안된 아키텍처는 표준 FCM (Particle Swarm Optimization으로 훈련)과 대규모 언어 모델 (Multi-Layer Perceptron)과 같은 유니버설 블랙박스 근사자와의 비교를 통해 세 가지 DISTINCT 도메인에서 검증되었습니다: 비모노토닉 유추 (Yerkes-Dodson 법칙), 기호 회귀, 혼란스러운 시계열 예측. 실험 결과 KA-FCM은 기존 아키텍처에 비해显著히 우수하고, MLP와의 경쟁적 정확도와 함께 그래프 기반 해석 가능성과 학습된 엣지에서 수학적 법칙을 명시적으로 추출할 수 있습니다.
의료진단은 시간에 따라 불확실성 하에 증거를 순차적으로 수집하는 것을 필요로 합니다. 그러나 대부분의 대규모 언어 모델(LLM) 기반 진단 시스템은 완전히 관찰 가능한 환자 정보를 가정하고, 진단 경로가 시간에 따라 어떻게 순차적으로 수집되어야 하는지에 대한 명시적인 모델을 제공하지 않습니다. 진단을 순차적 의사결정 과정으로 규정한다 하더라도, 진단 경로의 가능한 공간이 상대적으로 크고, 의료 데이터 세트가 바람직한 진단 경로에 대한 명시적인 감독 정보를 제공하는 경우가 드물기 때문에 효과적인 진단 경로를 학습하는 것이 쉽지 않습니다. 이러한 문제를 해결하기 위해, 우리는 라텐트 디아그노스틱 트레잇로이 학습(LDTL) 프레임워크를 제안합니다. 이 프레임워크는 계획 LLM 에이전트와 진단 LLM 에이전트를 기반으로 하며, 진단 LLM 에이전트에서는 진단 동작 시퀀스를 라텐트 경로로 다루고, 진단 정보를 제공하는 경로를 우선화하는 포스터리오 분포를 도입합니다. 이 분포에 따라 평행한 계획 LLM 에이전트를 훈련하여, 일관된 진단 경로를 학습하고 불확실성을 줄이는 것을 목표로 합니다. MIMIC-CDM 벤치마크에서 실험 결과, 제안된 LDTL 프레임워크는 existing baseline 과 비교하여 진단 정확도를 향상시키며, 진단 테스트의 수를 줄입니다. 또한, 제거 연구는 라텐트 경로 수준의 포스터리오 평행성이 이러한 향상을 달성하는 데 중요한 역할을 하는지 강조합니다.
메드겜마 1.5는 의료 AI 기술의 새로운 장을 열었다. 이 모델은 의료 이미징, 해부학적 위치화, 멀티 타임 포인트胸 X-ray 분석, 그리고 개선된 의료 문서 이해를 지원한다. 메드겜마 1.5는 이전 모델보다 더 높은 정확도를 달성했다.
MMORF는 다중 임무 역전 합성 계획 시스템을 설계하기 위한 프레임워크로, 다중 임무를 고려하여 역전 합성 계획을 수행하는 데 동적 균형을 달성하는 데 중요한 화학적 과제인 다중 임무 역전 합성 계획을 위한 언어 모델 기반 다중 에이전트 시스템의 적용성을 입증합니다.
자율 주행을 위한 시뮬레이션은 필수적입니다. 그러나 현재 프레임워크는 차량을 고정된 자산으로 모델링하고 부품 수준의 동작을 포착하지 못합니다. 현장 인스턴스의 충실한 재구성은 라이브러리 커버리지와 고정된 템플릿에 의해 제한됩니다.
자동화된 AI 연구 논문 작성을 위한 다중 에이전트 프레임워크: PaperOrchestra 논문 작성을 위한 연구 자료를 구조화된 문헌으로 변환하는 것은 AI를 이용한 과학적 발견의 중요한 과제 중 하나이다. 기존의 자율적인 작가는 특정 실험 파이프라인에 강하게 결합되어 있으며, 표면적인 문헌 검토만 수행한다. PaperOrchestra라는 다중 에이전트 프레임워크를 소개한다. 이 프레임워크는 논문 작성을 위한 자유로운 자료를 대량의 LaTeX 문헌으로 변환할 수 있으며, 문헌 검토 및 시각화(
대수적 구조를 노출하면 검색 공간을 축소하고 전역 최적해를 찾는 기회를 높일 수 있다. 저자는 대수적 구조를 식별하고, 연산을 공식화하고, 불필요한 표현을 삭제하는 인수 공간을 구성하고, 이러한 축소된 공간에서 직접 최적화를 수행하는 일반적인 프레임워크를 제시한다. 이 프레임워크는 다양한 규칙 결합 과제에서 효과적이다.
ReVEL은 다중 회전 반영 LLM 가이드 하이퍼 이진법 진화 via 구조화된 성능 피드백을 통해 NP-hard 조합 최적화 문제에 대한 효과적인 하이퍼를 설계하는 어려움을 해결합니다. 대규모 언어 모델(LLM)을 사용한 기존의 응용 프로그램은 주로 한 번의 코드 합성을 기반으로 하며, 이진법이 약화되어 모델의 반복적인 사고 능력을 최대한 활용하지 못합니다. ReVEL은 대규모 언어 모델(LLM)을 사용하여 반복적인 사고 능력을 최대한 활용할 수 있도록 하이퍼 이진법 진화에 대한 구조화된 성능 피드백을 제공하는 다중 회전 반영 LLM 가이드 하이퍼 이진법 진화 framework를 제안합니다.
정보 객체의 특성에 대한 새로운 양적-질적 근접 측정 방법을 제안하였으며, 다양한 출처에서 독립적으로 데이터가 공통 정보 자원에 입력되는 경우를 고려하였다. 이 방법은 개별 특성 값의 결정 오류로 인한 양적 및 질적 특성 값의 차이를 고려한다. 양적 특성 값의 근접성을 분석하기 위해 확률론적 측정 방법을, 질적 특성에 대한 경우에는 가능성 측정 방법을 사용하였다.
순차적 메타인지 판단에서 작동적 비가환성 메타인지란 내 자신의认知 과정을 모니터링하고 조절하는 것을 의미한다. 이는 내부 상태를 평가하고 업데이트한 후, 수정된 기준으로 다시 평가하는 순차적인 과정을 포함한다. 인식에서 순차적 효과는 잘 문서화되어 있지만, 이러한 효과가 고전적인 상태 변화나 더 깊은 구조적 비가환성을 나타내는지 여부는 불분명하다. 우리는 이러한 구별을 명확히 하기 위해 작동적 프레임워크를 개발한다. 우리의 형식화에서 메타인지 평가는 내부 상태 공간에 대한 확률적 읽아웃을 통해
네바야-녀야 사상에 기반한 지식적 사유를 위한 대형 언어 모델의 미세 조정: 프라마나 대규모 언어 모델(LLM)은 유창한 텍스트를 생성하지만 체계적인 사유에 어려움을 겪으며, 종종 자신감 있지만 근거 없는 주장을 내세운다. 애플 연구원들은 수학 문제에 불필요한 문맥을 추가했을 때 LLM의 성능이 65% 감소했다. 부식된 패턴 매칭이 명백한 사유 아래에 있는 것으로 드러났다. 이러한 지식적 격차, 증거에 대한 추적 가능한 근거를 바탕으로 주장을 지지할 수 없는 제한이 AI의 신뢰성을 제한한다. 우
인텔은 스페이스엑스와 테슬라와 함께 미국의 새로운 반도체 공장을 텍사스에 건설하기 위한 노력에 참여할 예정이다. 하지만 인텔의 기여 범위는 아직 불명확하다.
Nvidia가 후원하는 Firmus, 550억 달러 평가액 달성.
Arcee는 26명의 팀원으로 구성된 미국 스타트업으로, 대규모 오픈 소스 LLM을 구축하고 있다. OpenClaw 사용자들에게 인기가 가고 있다.
스포티파이가 프리미엄 사용자를 위한 새로운 팟캐스트를 찾는 데 도움을 주는 '프로모트 플레이리스트' 기능을 확장했습니다. 이 기능은 사용자가 커스터마이즈된 '디스커버' 플레이리스트를 생성할 수 있도록 합니다.
This is today’s edition of The Download, our weekday newsletter that provides a daily dose of what’s going on in the world of technology. The one piece of data that could actually shed light on your j
인공지능 에이전트는 정적 규칙 기반 시스템과 달리 학습, 적응, 최적화가 가능하며, 데이터, 시스템, 사람, 다른 에이전트와의 실시간 상호작용을 통해 전체 워크플로우를 자동으로 실행할 수 있습니다. 그러나 이러한 잠재력을 풀기 위해서는 기존의 최적화 방법을 사용하여 분산된 레거시 워크플로우에 에이전트를 부착하는 대신에 에이전트를 중심으로 프로세스를 리디자인해야 합니다.