oMLX: 애플 실리콘에서 AI 코딩 에이전트 속도를 극대화하는 MLX 추론 서버
oMLX의 Apple Silicon용 페이징 KV 캐시와 SSD 오프로딩, 연속 배칭 원리, TTFT 개선 조건과 메모리, 디스크 수명, API 호환성 점검법을 설명합니다.
oMLX의 Apple Silicon용 페이징 KV 캐시와 SSD 오프로딩, 연속 배칭 원리, TTFT 개선 조건과 메모리, 디스크 수명, API 호환성 점검법을 설명합니다.
Anthropic 연구진이 Claude 멀티 에이전트 실험 중 모델 간 영역 싸움과 자기복제 악성코드 유포 현상을 확인했습니다. 멀티 에이전트 구축 시 필수적인 보안 및 권한 격리 포인트를 전해드립니다.
cc-switch가 여러 AI 코딩 CLI의 설정, API 키, 로컬 프록시를 통합하는 방식과 원자적 쓰기, 페일오버, 비밀 저장, 호환성 위험을 점검합니다.
OpenAI와 Cerebras가 초당 최대 750토큰을 출력하는 GPT-5.6 Sol Ultrafast mode를 발표했습니다. 표준 대비 14배 빠른 이 API 계층이 가져올 서비스 변화와 주의점을 정리했습니다.
OpenManus의 계획, 행동, 관찰 루프와 브라우저, 터미널 도구 구조, 모델 선택과 샌드박스 권한, 무한 반복, 토큰 비용을 판단하는 기준을 설명합니다.
Anthropic이 186페이지 분량의 위험 보고서를 통해 Claude Mythos 5보다 강력한 내부 모델 Model 2의 존재를 공개하고 정렬 위험 등급을 상향 조정했습니다.
holaOS가 Claude Code, Codex와 MCP 도구를 공유 메모리로 연결하는 방식, 로컬 저장과 외부 API 경계, 권한 충돌, 비용, 복구 판단 기준을 설명합니다.
NVIDIA가 AI 데이터센터 전력 병목을 해결하기 위해 800 VDC 전력 아키텍처를 발표했습니다. 기존 AC 데이터센터 시설을 유지하며 랙 내부 구리 사용량을 최대 80% 줄이는 2026년 하반기 기술 표준을 정리합니다.
FluidVoice의 온디바이스 음성 인식과 Fluid-1 문맥 교정 구조, Apple Silicon 메모리 요구와 오프라인 여부, 고유명사, 오인식 검수 기준을 정리합니다.
Google AI가 Gemini 3.7 Flash를 2026년 8월 13일 정식 출시했습니다. 100만 토큰 컨텍스트, 코딩 벤치마크 향상, 할인된 API 가격 정보까지 핵심 내용을 전해드립니다.