CoANeRV: Coordinate-Aware Token-Space Neural Video Representation
📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 단 한 번의 피드포워드 패스로 컴팩트한 비디오 토큰을 생성하고, 공유 좌표 조건부 디코더를 활용해 비디오별 최적화 없이 연속적인 시공간 쿼리를 재구성함. 독창적 차별점 2: 축 적응형 위치 인코딩(axis-adaptive positional encoding)과 온도 변조 크로스 어텐션을 도입하여 시공간 쿼리와 비디오 토큰을 정밀하게 정렬함. 실무 파급력 3: 블록 단위 좌표 … 더 읽기