동적 다중 거점 차량 경로 문제(MDVRP)를 위한 이벤트 기반 트랜스포머 DRL 및 롤링 호라이즌 벤치마킹
📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 이벤트 기반 트랜스포머 및 행동 복제(BC)/PPO 기반 정책은 재학습 없이 최대 80개의 실시간 요청 시나리오로 확장 가능함을 입증함. 독창적 차별점 2: 고정 프리픽스/유연한 서픽스 경로 커미트먼트를 도입하여 완료·진행 중·근미래 결정을 명확히 분리하고 제어 안정성을 확보함. 실무 파급력 3: 밀리초 단위의 빠른 연산 속도에도 불구하고 휴리스틱(Nearest Feasible) 대비 … 더 읽기