AI 코딩 에이전트에 터미널 권한을 줘도 될까? Goose의 안전 경계
Goose가 파일, 터미널, MCP 도구를 반복 실행하는 구조와 샌드박스, 자격 증명, 모델 선택, 중단 조건, 최종 diff의 실제 검증 기준을 설명합니다.
Goose가 파일, 터미널, MCP 도구를 반복 실행하는 구조와 샌드박스, 자격 증명, 모델 선택, 중단 조건, 최종 diff의 실제 검증 기준을 설명합니다.
XSkill이 멀티모달 에이전트의 화면별 경험과 작업 절차 스킬을 분리해 재사용하는 방식과 기억 승격, 만료, 오염, 검색 비용 검증법을 설명합니다.
ShotVerse가 자연어 카메라 지시를 3D 궤적으로 계획한 뒤 멀티샷 영상을 생성하는 구조와 경로 충돌, 장면 연속성, 비용 검증법을 설명합니다.
Hermes Agent의 영구 메모리와 스킬 생성, Gateway, MCP 구조를 살펴보고 기억 오염, 실행 권한, 백그라운드 비용과 안전한 도입 기준을 설명합니다.
agency-agents의 직무별 마크다운 문서를 실제 서브 에이전트에 연결할 때 필요한 역할 경계, 라우팅, 권한, 토큰, 결과 합성 검증법을 설명합니다.
FIRM-8B가 이미지 편집의 실행, 일관성과 생성의 품질, 정렬을 분리해 보상하는 구조와 임계값, 보상 해킹, 실제 추론 비용의 검증법을 설명합니다.
DreamVideo-Omni가 여러 인물의 정체성, 궤적, 카메라 조건을 분리하는 방식과 latent 보상, 교차, 가림 실패, 입력 비용을 검증하는 법을 설명합니다.
CLI-Anything이 GUI 이벤트 뒤의 로직을 CLI, JSON, REPL로 노출하는 구조와 기능 누락, 상태 격리, 권한, 테스트 범위를 검증하는 법을 설명합니다.
Cline의 ReAct 파일 수정, 터미널 루프와 Auto Approve, MCP 권한을 살펴보고 비용 상한, 반복 중단, diff, 테스트 검토 기준을 설명합니다.
ExeVRM이 컴퓨터 에이전트의 실행 영상을 보고 완료 여부를 판정하는 방식과 오탐, 화면 밖 상태, 토큰 가지치기, 도메인 이동 검증법을 설명합니다.