CRAFT: 합성 타겟 데이터 없는 MMDiT 기반 주체 개인화를 위한 어텐션 파인튜닝 프레임워크

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 150만~200만 건의 고비용 합성 타겟 페어 대신, 1만 건의 참조 이미지만 사용하여 SOTA 주체 개인화 성능 달성 독창적 차별점 2: ‘Where to look’ 원리에 기반한 어텐션 레벨 및 픽셀 레벨의 제약 보상(ReFL) 결합 아키텍처 도입 실무 파급력 3: 복잡한 멀티스테이지 큐레이션 파이프라인을 제거하여 대규모 비전 모델 학습 … 더 읽기

CoANeRV: Coordinate-Aware Token-Space Neural Video Representation

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 단 한 번의 피드포워드 패스로 컴팩트한 비디오 토큰을 생성하고, 공유 좌표 조건부 디코더를 활용해 비디오별 최적화 없이 연속적인 시공간 쿼리를 재구성함. 독창적 차별점 2: 축 적응형 위치 인코딩(axis-adaptive positional encoding)과 온도 변조 크로스 어텐션을 도입하여 시공간 쿼리와 비디오 토큰을 정밀하게 정렬함. 실무 파급력 3: 블록 단위 좌표 … 더 읽기

Owner3D: 대규모 재구성 모델 기반 학습 불필요 국소적 3D 스타일화 프레임워크

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 스타일 누출을 기존 StyleSplat 대비 86.4%, LAENeRF 대비 89.9% 대폭 절감하며 타겟 영역의 스타일 충실도와 비타겟 영역의 외형 보존을 동시에 달성함. 독창적 차별점 2: 소유권 유도 스타일 쓰기(Ownership-guided style writing)와 경계 듀얼 슬롯(Boundary dual slots)을 도입하여 추가 학습 없이 트라이플레인 특징 공유 문제를 해결함. 실무 파급력 3: … 더 읽기

DeaMoE: 실시간 소배치 디코딩을 위한 고효율 Mixture-of-Experts(MoE) 아키텍처 분석

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 단계별 로딩 가중치를 최대 50.9% 절감하고, A40 환경에서 사전 학습된 7B 모델 기준 최대 1.33배의 TPOT(Time Per Output Token) 성능 향상 달성 독창적 차별점 2: 전문가(Expert) 간 공통 파라미터를 부서(Department) 단위로 공유하고 고유 파라미터를 분리하는 구조와 중복 로딩을 방지하는 2단계 라우팅 전략 도입 실무 파급력 3: 응답 … 더 읽기

텍스타일 정전용량 센서의 꼬임 구조가 압력 및 근접 감지에 미치는 영향 분석

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 4층 꼬임 구조 센서에서 최대 0.1331 MPa⁻¹의 감도 및 15,000회 구동 안정성 확보 독창적 차별점 2: 원사 수준의 아키텍처(1, 2, 4층 꼬임) 조율을 통한 압력-근접 감지 트레이드오프 제어 실무 파급력 3: 로봇 암(Arm) 통합 테스트를 통해 403 ms의 엔드투엔드 반응 지연 시간 입증 서론: 텍스타일 기반 촉각 … 더 읽기

THRIVE: 가상 환경 기반 휴머노이드 로봇 치료 및 모션 트래킹 시스템 아키텍처

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: VR 기반 상지 재활 게임, 카메라 실시간 모션 트래킹, 소셜 로봇 치료사를 통합한 가정용 홈 헬스케어 플랫폼 구축 독창적 차별점 2: 재활 게임 로직과 로봇 하드웨어 물리 구현체를 완전히 분리(Robot-agnostic)하여 확장성과 비용 효율성 극대화 실무 파급력 3: 아동 상지 운동 장애 치료를 위한 지속 가능하고 데이터 기반의 … 더 읽기

PRM-as-a-Judge 1.5: 로봇 및 무인이동체 조작 프로세스 정밀 평가 툴킷 분석

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 롤아웃 비디오를 밀집 진척 곡선(Dense Progress Curves)으로 변환하여 이진 성공률을 넘어선 다차원 정량 지표 도출 체계 구축 독창적 차별점 2: 실패 측면 진척도, 드로다운 이후 회복력, 성공 측면 실행 품질 등 3가지 신규 지표와 RoboPulse++ 신뢰성 검증 테스팅 플랫폼 도입 실무 파급력 3: 재현 가능한 조작 프로세스 … 더 읽기

ReflexVLA: 동적 조작을 위한 고속·예측형 비전-언어-액션 모델 분석

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 대규모 사전 학습 없이도 동적 조작(Reaction-critical manipulation) 환경에서 실시간 반응성을 확보한 ReflexVLA 아키텍처 제안 독창적 차별점 2: 시뮬레이터 구동과 제어 루프를 분리하고 잠재 미래 예측(Latent future prediction)과 CUDA Graph 리플레이를 통한 추론 지연 최소화 실무 파급력 3: 비동기 및 동기식 추론 환경 모두에서 설정 가능한 지연 시간을 … 더 읽기

항공기 조종사 인지 프레임워크: 비행 성능을 결정하는 4대 핵심 인지 모듈 메타분석

📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 93건의 선행 연구 및 3수준 혼합효과 메타회귀분석을 통해 비행 성능과 직결되는 4대 핵심 인지 모듈(지각, 작업 기억, 멀티태스킹 유연성, 정신 운동) 규명 (Fisher’s z = 0.356–0.440, p < 0.001) 독창적 차별점 2: 기존 분절적인 인지 연구의 한계를 극복하고, 조종 환경에서 요구되는 최소 인지 모듈 세트(Core Cognition Set)를 ... 더 읽기

자율주행 드론 및 무인이동체 인프라 구축을 위한 지자체 의사결정 모델 분석

자원 의존성 이론을 적용하여 무인이동체 및 드론 인프라 도입 시 지자체의 협상력과 전략적 대응 방식을 분석합니다. 동적 역량(Dynamic Capabilities)과 리더십을 활용한 지자체의 능동적 인프라 융합 모델을 제시합니다. 국가 주도의 규제와 지역 현장 간의 격차를 해소하기 위한 GCS 지상통제 및 실무 거버넌스 방안을 도출합니다. 무인이동체 인프라 도입과 지자체 거버넌스의 상관관계 최근 자율주행 드론 및 무인이동체(UAV/UGV)의 도심 … 더 읽기