실렌스: 효율적인 LLM 에이전트를 위한 대규모 언어 모델(LLM) 경험 재사용
실렌스는 대규모 언어 모델(LLM) 에이전트가 다양한 태스크에서 절차적 경험을 재사용하는 데 있어 실용적인 방법이 되었다. 그러나 기존 시스템은 지식库를 단일 해상도 프롬프트 블록으로 다루어 왔기 때문에, 도식화된 지식은 관련성이 떨어지거나 오해를 일으킬 수 있지만, 전체 지식을 다시 작성하는 것은 비용이 많이 들고 자주 필요하지 않다. 실렌스는 지식 라이브러리를 네 개 층의 정책, 전략, 절차, 원소로 구성된 그래프에 조직하고, 다양한 해상도에서 지식을 검색하는 지식 진화 프레임워크를 제안한다. 태스크를 입력받으면, 실렌스는 의미적으로 관련된 지식 씨앗을 검색하고, 그 지식 씨앗을 확장하기 위해 지식 그래프에 대한 고도의 정정된 무작위 경로를 수행하고, 이후 각 방문 단위가 수락, 분해, 다시 작성, 건너뛰어야 하는지 결정하기 위해 검증기를 사용한다. 이로써 에이전트는 호환 가능한 서브 지식을 직접 재사용할 수 있으면서, 지역적으로 일치하지 않는 구성 요소를만 지역적으로 적응할 수 있다. 시간이 지남에 따라 시스템을 개선하기 위해, 실렌스는 다중 해상도 지식과 검증기를 개선하여 라우팅 결정력을 향상시킨다. 우리는 이론적으로 다중 해상도 적응이 희박한 일치 가정하에 선형 비용을 발생시키며, 진화적 업데이트 규칙이 유효성 목표를 지역 최적점까지 단조적으로 향상시키는 것을 보여준다. MuLocbench와 ALFWorld에서, 실렌스는 강력한 지식 기반 베이스 라인보다 일관되게 향상되어, 버그 로컬라이제이션에서 6.31%의 Acc@1 향상과 에이전트 성공률을 45.00%에서 51.31%까지 높였다다.
소개
대규모 언어 모델 에이전트가 다양한 작업에서 절차적 경험을 재사용하는 데 있어 실용적인 방법이 필요합니다. 기존 시스템은 지식를 단일 해상도 프롬프트 블록으로 다루어 왔습니다. 그러나 이 방법은 도식화된 지식이 관련성이 떨어지거나 오해를 일으킬 수 있으며, 전체 지식을 다시 작성하는 것은 비용이 많이 들고 자주 필요하지 않습니다.
실렌스는 지식 라이브러리를 네 개 층의 정책, 전략, 절차, 원소로 구성된 그래프에 조직하고, 다양한 해상도에서 지식을 검색하는 지식 진화 프레임워크를 제안합니다. 이 프레임워크는 작업을 입력받으면 의미적으로 관련된 지식 씨앗을 검색하고, 그 지식 씨앗을 확장하기 위해 지식 그래프에 대한 고도의 정정된 무작위 경로를 수행합니다.
기능 및 성능
실렌스는 각 방문 단위가 수락, 분해, 다시 작성, 건너뛰어야 하는지 결정하기 위해 검증기를 사용합니다. 이로써 에이전트는 호환 가능한 서브 지식을 직접 재사용할 수 있으면서, 지역적으로 일치하지 않는 구성 요소를 지역적으로 적응할 수 있습니다. 시간이 지남에 따라 시스템을 개선하기 위해, 실렌스는 다중 해상도 지식과 검증기를 개선하여 라우팅 결정력을 향상시킵니다.
실렌스의 성능은 MuLocbench와 ALFWorld에서 테스트되었으며, 강력한 지식 기반 베이스 라인보다 일관되게 향상되었습니다. 버그 로컬라이제이션에서 6.31%의 Acc@1 향상과 에이전트 성공률을 45.00%에서 51.31%까지 높였습니다. 또한, 이론적으로 다중 해상도 적응이 희박한 일치 가정하에 선형 비용을 발생시키며, 진화적 업데이트 규칙이 유효성 목표를 지역 최적점까지 단조적으로 향상시키는 것을 보여주었습니다.
함께 읽으면 좋은 기사
오픈에이아이의 Dot agent는 기업용 소프트웨어로 식사 주문까지 가능하다
오픈아이의 새로운 agent 플랫폼인 Dots는 귀여운 작은 친구들이 많아 주문에 따라 행동하는 모습을 보여줍니다. 그러나 메타 뮤즈 같은 친숙한 느낌보다는, Dots는 사용자가 일을 처리하는 도구에 부가 기능으로 음식을 주문할 수 있는 기능을 제공하는 것처럼 느껴집니다.
쇼피프가 선보인 캔버스, AI와 대화하며 온라인 매장을 만드는 방법
쇼피프의 새로운 캔버스(Canvas) 사이트 빌더는 판매자들이 AI agent인 사이드 킥(Sidekick)과 대화하며 온라인 상점을 만들고 커스터마이징할 수 있게 해줍니다. 이 과정을 실시간으로 보면서 진행할 수 있습니다.
에어비앤비의 차세대 운영 체제: 인공지능 agent의 자율성 필요하다
에어비앤비 창업자 브라이언 체스키(Brian Chesky)는 인공지능 agent를 위해 자체 운영 체제가 필요하다고 말합니다. 그는 또한 소비자 인공지능의 현재 상태와 인공지능이 가진 잠재력을 강조합니다.
오픈아이, 메타와 경쟁하기 위해 '도트'를 출시하다
오픈아이가 메타의 마인드(Muse) AI agent 플랫폼에 도전하기 위해 '도트(Dots)'라는 새로운 agent를 출시했다. 이 agent는 GPT-6 Astra를 기반으로 하고 있으며, 메타의 마인드 플랫폼의 성공에 도전한다.
장기 언어_AGENT의 중량 꼬리 메모리 트레이스
장기 예측 언어 agent는 점점 더 외부 메모리를 세계 모델로 고정시키며, 현재의 메모리 시스템은 일반적으로 작업 성공률이나 토큰 비용만으로 평가됩니다. 우리는 메모리 사용의 형태가 누락된 것이며, 한정된 맥락과 반복적인 검색에서 agent 메모리는 작은 핵심에 집중할 수 있으며, 예측 오류가 축적되는 드문 상태를 긴 꼬리에서 남겨둘 수 있음을 주장합니다. 우리는 이 효과를 보존된 꼬리 감
메타, 뮤즈가 사용자의 사생활 메시지를 읽었다는 주장에 반박한다
메타는 뮤즈 AI agent가 사용자의 사생활 메시지를 읽는 것을 허용하지 않는다고 밝혔다. 뮤즈는 사용자의 사생활 메시지를 읽었을 가능성이 있다. 하지만 사용자가 Mac의 특정 설정을 끄지 않았다면.
관련 콘텐츠 더 보기
다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.