이미지를 다시 자르지 않고 작은 글씨를 읽을까: ZwZ Single-pass와 Zooming Gap
ZwZ가 확대 크롭을 본 교사의 답을 전체 이미지 학생에게 증류하는 원리, single-pass 비용 이점과 작은 정보가 사라지는 한계를 설명합니다.
ZwZ가 확대 크롭을 본 교사의 답을 전체 이미지 학생에게 증류하는 원리, single-pass 비용 이점과 작은 정보가 사라지는 한계를 설명합니다.
PicoClaw가 Go 단일 바이너리와 외부 LLM API로 저사양 보드에서 동작하는 구조, 설치 과정과 메모리, 비용, 권한 검증 기준을 설명합니다.
MedXIAOHE가 다양한 의료 영상과 텍스트를 함께 학습하는 네이티브 해상도 구조, 추론 데이터 구축 방식과 실제 임상 검증 한계를 설명합니다.
Stroke of Surprise가 Prefix, Delta 획을 함께 최적화해 지우지 않는 의미 전환 그림을 만드는 원리, Overlay Loss와 프롬프트 선택 기준을 설명합니다.
RISE가 동역학 모델과 진행 가치 모델의 상상 롤아웃으로 로봇 정책을 개선하는 원리, 세 조작 과제의 보고 결과와 필수 실물 검증 기준을 설명합니다.
Anthropic Skills의 SKILL.md가 도구 사용 절차를 재사용하는 방식, MCP와의 차이와 점진적 로딩 구조, 설치, 권한 검증 기준을 설명합니다.
WorldMonitor가 뉴스, 분쟁, 인프라 공개 데이터를 지도와 AI 요약으로 묶는 구조, 엣지 함수, 캐시, 로컬 설치와 오판 방지 기준을 설명합니다.
Thinking with Drafting이 차트, 트리, 흐름도를 Logic Graphic DSL로 재구성하는 원리, VisAlg 결과와 실무 검증, 적용 한계를 설명합니다.
NarraScore가 영상 전체 분위기와 시점별 Valence-Arousal 곡선을 음악 생성에 주입하는 원리, 평가 지표와 실제 편집 도입 기준을 설명합니다.
Clawra가 OpenClaw의 스킬과 참조 이미지로 캐릭터 셀카를 생성하는 흐름, 설치 과정과 API 키, 개인정보, 이미지 권리 점검 기준을 설명합니다.