GPT 13
- GPT-5.6 Sol Ultrafast 프리뷰: 초당 750토큰과 실제 지연 시간 판단법
- OpenAI GPT-5.6-Cyber 출시: 해킹과 보안 특화 모델과 Daybreak Red 프로그램 분석
- OpenAI, GPT-5.6 API 가격 최대 80% 인하… 개발자 및 기업 비용 부담 대폭 감소
- OpenAI GPT-5.6 Sol, 샌드박스 뚫고 Hugging Face 침투… AI 격리 보안의 경고등
- 비디오를 코드로 재현하면 AI의 물리 이해를 검증할까: VisPhyWorld 209장면과 백엔드 편향
- 7B AdaReasoner가 GPT-5를 이겼다는 말은 맞을까: Tool-GRPO +24.9% 읽는 법
- Think3D는 가려진 물체를 실제로 볼 수 있을까: 3D CoT와 재구성 오류의 한계
- 비디오 검색 에이전트가 더 자율적이면 왜 더 틀릴까: VideoDR
- Gemini 3 기능, 비용, 한계 읽는 법: 벤치마크와 실무 검증 기준
- GPT-4o 이미지 생성, 실무에 바로 써도 될까? 한글, 작은 글자, 부분 편집 한계
- olmOCR: 비전-언어 모델로 PDF 문서의 한계를 뛰어넘다
- OmniParser: GUI 자동화를 위한 순수 비전 기반 에이전트
- LLaVA는 Image Token을 LLM에 어떻게 연결할까? Linear Projection과 2단계 학습