다중 에이전트 강화학습(MARL)의 정책 재조합 안전성 한계와 계층형 MA-USFA 아키텍처 분석
📌 핵심 요약 (Key Takeaways) 안전성 한계 입증: MARL 환경에서 개별 에이전트 단위 독립적 Successor Feature(SF) 정책 합성이 시스템 전체의 가치 예측을 오염시키고 제로샷 안전성 보장을 파괴함을 수학적으로 증명. 계층형 구조 제안(MA-USFA): 동료 에이전트의 목적 함수에 조건화된 하위 USFA 층과 에이전트 간 상호작용 보정을 담당하는 상위 합성자(Composer)로 구성된 2계층 아키텍처 구축. 실무적 제로샷 확장성: 재배치 … 더 읽기