본문으로 건너뛰기

오페플로: 시뮬레이션된 인간 웹 인터랙션을 통해 GUI 기반의 자동 UX 평가

AI 자동 생성

웹 사용성 평가를 일반적으로 수행하려면 시간이 많이 걸리는 사용자 연구와 전문가 검토가 필요하며, 이로 인해 제품 개발 속도가 느려지며 특히 작은 팀과 안정적인 워크플로우에서 iteration 속도가 느려진다. 우리는 오페플로라는 사용자 경험 평가 에이전트를 제시하는데, 이는 사용자가 웹사이트에 접속하는 행동을 시뮬레이션하고 표준화된 사용성 평가를 제공한다. 전통적인 도구가 DOM 파싱에 의존하는 것과 달리, 오페플로는 액션과 관찰을 기반으로 하여, 실질적인 웹 페이지와 상호 작용을 하며 사용자 여행의 일관된 추적을 유지할 수 있다.

아비뉴-웹(Avenir-Web) 시스템을 기반으로, 우리는 강력한 상호 작용을 시뮬레이션된 사용자 행동 프로파일과 구조화된 평가 프로토콜과 통합된 시스템 사용성 척도(System Usability Scale, SUS), 단계별 단순한 쉬운 질문(SEQ), 동시 사고 aloud concurrently think-aloud)와 함께 제공한다. 그 결과, 사용자 경험(User Experience, UX) 보고서가 생성된다.

오페플로의 아키텍처에 대해 논의하고, 다중 모드 그라운드가 웹 기반 상호 작용과 UX 평가 시나리오에서 강건성을 향상시킨다는 것을 설명한다. 또한, 지속적인, 확장 가능한, 데이터 주도적인 사용성 테스트를 통해 모든 개발자가 사용 가능한 웹 인터페이스를 구축할 수 있는 새로운 시대에 길을 열어준다.

코드는 다음 주소에서 제공된다: https://github.com/Onflow-AI/OpenFlo

원문 보기 arXiv AI

함께 읽으면 좋은 기사

에이전트 17시간 전

Meta의 영감은 OpenAI와 Anthropic에서 본격적으로 빛나는 AI를 훔쳤습니다.

AI 리더들이 OpenAI와 Anthropic에서 "선도 경계를 맞춰가기"라는 주제로 논의를 시작했을 때, 누군가는 "어느 속도로?"라는 질문을 해야 했을 수도 있었다. 이제는 두 회사가 모두 모델을 출시하는 모델 출시 주간이 되었는데, Anthropic이 Opus 5.5을 출시한 후 OpenAI가 GPT-6 모델 업데이트를 90분만에 출시했다. 그러나 스포트라이트를 잡은 것은 Meta 였는

에이전트 2일 전

강화 학습 기반 역할 놀이 에이전트의 역할 학습을 위한 적대적 폐쇄 루프 교육과정

역할 연기하는 agent는 대규모 언어 모델을 기반으로 한 것들이 개인화된 지원 및 사회 시뮬레이션과 같은 분야에서 광범위하게 적용되어 왔다. 최근 RL 방법들은 학습이 시작되기 전에 미리 수집한 고정된 시나리오 풀에서 훈련을 받는다. 이로 인해 분포적 병목 현상이 발생한다: agent가 향상될수록 agent가 나쁜 성능을 보이는 시나리오도 변하고, 훈련 분포는 정적이다. 따라서, 우리는 역

관련 콘텐츠 더 보기

다른 플랫폼에서 이 주제에 대한 더 많은 정보를 확인하세요.