본문으로 건너뛰기

IBM Heron에서 하드웨어 캘리브레이션을 지원하는 순차적 POMDP 신뢰도 업데이트: QANTIS

AI 자동 생성

arXiv:2607.06760v1 발표 형식: 새로운 논문 요약: 부분 관찰 가능성 하에 작동하는 자율 시스템은 신뢰를 바탕으로 작동하며, 원시 센서 이벤트보다는 신뢰를 따른다. QANTIS는 이 루프에서 양자 처리기를 신뢰 업데이트를 위한 캘리브레이션 서비스로 다루는데, 이는 이전에 캘리브레이션 된 신뢰 업데이트를 받는 서비스로 작동한다. 이를 위해, QANTIS는 이전에 계산된 신뢰와 관찰 모델을 받고, 희소한 이벤트 증거 항목을 추정하고, 정상적인.posterior를 고전적인 계획자에게 반환한다. 이 논문은 IBM Heron 하드웨어에서 현재 존재하는 Tiger POMDP 시퀀셜 시간에 걸쳐 이 서비스를 재사용할 수 있는지 여부를 묻는다. 그리고 계획자에게-facing posterior가 왜곡되지 않는지 여부를 묻는다. 우리는 이 서비스가 재사용 가능한지 여부에 대한 제한된 하드웨어 연구를 통해 답한다. 그 연구는 같은 경로에서, 증폭되지 않은 경우, 보호된 Grover 증폭, 그리고 모든 단계의 고정 지점 증폭을 비교한다. 그리고 반환된 posterior가 하류 액션을 변경하는지 여부를 확인한다. 모든 단계의 고정 지점 증폭은 보고된 8-단계 및 12-단계 주기 실행에서 Tiger posterior를 유지하며, 20-단계 및 32-단계 제어는 같은 운영 범위 내에 있다. 보고된 모든 결정 확인에서, 하드웨어 posterior와 정확한 Bayes posterior는 동일한 즉시 액션을 선택한다. 경계-aware BIQAE는 0과 1 근처에서 진폭 추정을 안정화시키며, 1,000,000배 희소한 증거의 논리 샘플 복잡도-envelope를 맵핑한다. 결과는 하드웨어 캘리브레이션된 신뢰 업데이트의 운영 범위, 즉 독립적인 하드웨어 이점 선언이 아닌 하드웨어 캘리브레이션된 신뢰 업데이트의 기본 요소이다.

원문 보기 arXiv AI

함께 읽으면 좋은 기사

AI 모델 15분 전

노이즈가 있는 경찰 음성 데이터에 대한 미리 학습된 ASR 가짜 레이블링

방송 경찰 통신(Broadcast Police Communication, BPC)에서 노이즈가 많은 상황에서 훈련된 음성 인식 시스템이 나쁜 성능을 보인다. 이를 통해 경찰의 의사 결정이 이해될 수 없게 되고, 이는 경찰의 의사 결정에 대한 연구를 어렵게 만든다. 사용자 레이블을 비용이 많이 들지 않고 pseudo-labeling을 통해 ASR 성능을 개선할 수 있는 방법이 있다. 그러나 매

AI 모델 15분 전

단백질 확산 모델의 테스트 시점 정렬을 위한 스펙트럴 피드백

Reward 최적화와 일치하는 방법을 위한 분산 확산 모델의 방법론은 대개 역과정의 방향을 조절하기 위해 로짓을 영향받거나 중간 단계에서 선호하는 시퀀스를 선택하는 것을 목표로 합니다. 이러한 접근법은 주로 추론을 단방향적인 과정으로 다루며, 불쾌한 토큰 선택을 재방문하는 메커니즘을 제공하지 못합니다. 우리는 Spectral Feedback 라는 알고리즘을 소개합니다. 이 알고리즘은 feed

AI 모델 15분 전

3차원 구조 기반의 막통합 단백질의 상위 구조 예측

이 논문은 최신 그래프 신경망(GNN, Graph Neural Network)인 SchNet을 이용한 단백질拓종 추론의 새로운 방법을 제시한다. 모델은 최근 DeepTMHMM 모델을 개발하기 위해 사용된 데이터셋과 동일한 데이터셋을 사용하여 5-분할 교차 검증을 통해 학습되었다. 단백질 서열이나 $\alpha$- 탄소만을 특성으로 사용하는 전통적인 접근법과 달리, 우리는 분류기에서 모든 원자

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.