Agent Prototype에서 안전한 운영까지
가능성 있는 AI Agent를 안전하게 운영되는 시스템으로 어떻게 옮길까?
약 20분 · 5개 stop · 진행 상태는 이 브라우저에만 저장됩니다.
Field journal
Agent가 실제로 할 수 있는 일을 정의한다
infrastructure를 고르기 전에 tool, autonomy, state, delegation과 환경의 위험을 분류합니다.
Managed service의 경계를 그린다
runtime, identity, gateway, memory, observability와 application이 책임질 통제를 분리합니다.
배포를 review 가능한 과정으로 만든다
policy, evaluation, approval과 rollback을 가진 결정론적인 platform workflow로 agent를 전달합니다.
모든 hop에서 trust를 강제한다
중요한 action을 중심으로 workload identity, 사용자 delegation, 좁은 권한, audit와 recovery를 설계합니다.
상태 이전과 rollback을 증명한다
실제 Hermes 이전에서 writer shutdown, SQLite 검증, single-consumer cutover와 rollback이 필요한 이유를 확인합니다.
Prototype보다 운영 경계를 먼저 설계하세요
핵심 원칙
- 시스템을 agent라고 부르기 전에 권한과 위험을 기술한다.
- managed service를 자동 production readiness가 아니라 명시적인 경계로 다룬다.
- infrastructure 변경은 결정론적이고 review 가능하며 되돌릴 수 있게 만든다.
- 매 hop에서 workload와 delegated user를 인증하고 승인한다.
- 실제 runtime으로 state recovery와 cutover를 시험한다.
실무 체크리스트
- Agent의 tool, autonomy, state와 최대 피해 범위를 기록한다.
- inbound authentication, workload identity와 tool authorization을 분리한다.
- artifact를 고정하고 evaluation, approval, observability와 rollback 증거를 요구한다.
- 모든 component의 network reach와 permission을 최소화한다.
- migration 전에 backup, restore, writer shutdown과 rollback을 연습한다.