3D생성 11
- lingbot-map: 단일 카메라로 1만 프레임의 3D 공간을 실시간으로 그려내는 원리
- 3D 라벨 없이 장면의 앞뒤를 읽을 수 있을까: VEGA-3D의 대가
- LoGeR가 19,000프레임 3D 재구성을 버틸까: TTT, SWA 메모리의 대가
- Holi-Spatial은 3D 라벨링을 없앨까: 1.2만 Scene, 400만 자동 데이터의 검증
- LiDAR, RGB-D, CAD를 한 3D 인코더로 처리할 수 있을까? Utonia의 범위
- 이미지 1,000장 3D 재구성에서 OOM을 피하려면: VGG-T³
- Think3D는 가려진 물체를 실제로 볼 수 있을까: 3D CoT와 재구성 오류의 한계
- NeoVerse는 흔들린 단안 영상으로 4D를 어떻게 만드나: Pose-free의 의미
- InsertAnywhere는 영상 속 객체 위치를 어떻게 고정할까? 4D Mask와 Diffusion
- 카메라가 돌아오면 배경이 바뀌는 AI 영상, Spatia는 3D Memory로 어떻게 막나
- VLM이 카메라 이동과 객체 이동을 헷갈리는 이유: DSR Suite와 GSM