Lean4Agent: 에이전트 워크플로우 및 트레젝토리 formal modeling과 verification
인공지능의 중심 과제가 된 것은 대규모 언어 모델(LLMs)을 신뢰할 수 있는 다단계 워크플로우를 수행할 수 있도록 하는 것입니다. 최근 LLM의 의사결정 능력에 대한 발전에도 불구하고, 대부분의 agent 시스템은 워크플로우와 실행 경로를 명시하고, 검증하고, 디버그하기 위한 공식적인 방법을 아직도 가지고 있지 않습니다. 이 문제는 수학의 오랜 문제와 비슷합니다. 자연 언어(NL)의 모호성