YOLO 19
- RAG 답이 틀릴 때 LLM보다 PDF를 먼저 의심해야 하는 이유: RAGFlow
- Deep-Live-Cam 실시간 Face Swap는 어디서 깨질까: 128px, 측면 얼굴, 지연
- pi-mono의 네 가지 기본 도구로 충분할까: 확장성, 권한, 유지비 판단법
- YOLOE: 모든 객체를 실시간으로 탐지 & 분할하는 혁신 기술
- RailSem19 데이터셋으로 철도 객체 탐지를 바로 학습해도 될까: 라벨 2종과 클래스 불균형
- OmniParser: GUI 자동화를 위한 순수 비전 기반 에이전트
- HunyuanVideo 13B는 어떻게 영상을 만들까: 데이터, 3D VAE, 실행 전제
- DEIM은 DETR 학습을 왜 줄이나: Dense O2O와 MAL
- Darknet YOLO Layer에서 ignore_thresh와 truth_thresh가 다른 이유
- Darknet network.c 학습, 예측 흐름: subdivisions 업데이트와 포인터 수명 함정
- DarkNet Detection Layer 출력 배열 읽는 법: class, objectness, box
- YOLOv4 Bag of Freebies와 Specials, 무엇이 추론 비용을 늘릴까?
- YOLOv3는 왜 3개 Scale과 BCE를 쓸까? 출력 Tensor 계산법
- YOLOv2에 Anchor Box를 넣었는데 mAP가 떨어진 이유: Recall부터 다시 보기
- YOLOv1 출력 7×7×30은 어떻게 읽을까? 98개 Box와 Loss까지
- StyleGAN Blending에서 눈이 네 개 생기는 이유: 얼굴 정렬부터 Pix2PixHD까지
- YOLOv2는 recall을 어떻게 올렸나: Anchor Box, 좌표 제약, Multi-Scale의 역할
- NCS2에서 YOLOv3가 실행되지 않을 때: FP16 IR 변환과 입력 Shape 점검
- YOLOv1은 왜 빠르지만 작은 물체에 약할까: 7×7 Grid와 Loss 해설