fos-blog/study
01 / 홈02 / 카테고리03 / 시리즈
01 / 홈02 / 카테고리03 / 시리즈

카테고리

  • AI 페이지로 이동
    • RAG 페이지로 이동
    • agent 페이지로 이동
    • claude-code 페이지로 이동
    • harness 페이지로 이동
    • llm 페이지로 이동
    • ops 페이지로 이동
    • practice 페이지로 이동
  • algorithm 페이지로 이동
    • Alias Method: 가중치 랜덤 선택을 전처리 O(n), 추출 O(1)로 바꾸기
    • Welford's Online Algorithm: 값을 저장하지 않고 평균과 분산 계산하기
  • architecture 페이지로 이동
    • distributed-systems 페이지로 이동
    • domain 페이지로 이동
    • evolution 페이지로 이동
    • patterns 페이지로 이동
  • database 페이지로 이동
    • milvus 페이지로 이동
    • mysql 페이지로 이동
    • opensearch 페이지로 이동
    • qdrant 페이지로 이동
    • redis 페이지로 이동
    • vespa 페이지로 이동
    • DB Connection Pool Saturation과 Thread Pool 격리
    • 커넥션 풀 크기는 얼마나 조정해야 할까?
    • MyBatis 기본기 — XML Mapper, resultMap, 동적 SQL, 운영 패턴 정리
    • MyBatis와 JPA/Hibernate 트레이드오프 — 레거시 백엔드를 다루는 시니어 관점
    • 한국어 형태소 분석기 Nori vs Lindera — OpenSearch에서 Milvus로 갈 때 어휘 검색은 유지되나
    • 정규화와 역정규화: 무결성과 조회 비용 사이의 선택
    • 벡터 DB 5종, 아키텍처는 어떻게 다른가
    • 벡터 DB 5종을 실제로 벤치마크했다 — 같은 recall에서 QPS는 얼마나 갈리나
    • 벡터 DB 어떻게 고를까 — OpenSearch · Milvus · Qdrant · Vespa · pgvector 비교
    • 벡터 DB를 실제로 도입한 사례 — 빅테크 프로덕션
  • devops 페이지로 이동
    • docker 페이지로 이동
    • k8s 페이지로 이동
    • Envoy Proxy
    • Graceful Shutdown
    • 종료 신호는 어디서 멈추는가
  • http 페이지로 이동
    • HTTP Connection Pool
    • HTTPS와 TLS: 핸드셰이크, 인증서, 종료 지점
  • java 페이지로 이동
    • concurrency 페이지로 이동
    • jdbc 페이지로 이동
    • spring 페이지로 이동
    • spring-batch 페이지로 이동
    • testing 페이지로 이동
    • Java 동시성 락 정리 — 커머스 메뉴/프로모션 정책 캐시 갱신 관점
    • JVM 튜닝 실전: 메모리 구조부터 Virtual Threads, GC 튜닝, 프로파일링까지
    • 로그에 traceId 남기기 — MDC 부터 OpenTelemetry 까지
    • Java StampedLock — 읽기 폭주에도 쓰기가 밀리지 않는 락
    • Virtual Thread와 Project Loom
  • javascript 페이지로 이동
    • typescript 페이지로 이동
    • AbortController
    • Async Iterator와 제너레이터
    • CommonJS와 ECMAScript Modules
    • 제너레이터(Generator)
    • Http Client
    • Node 백엔드 운영 패턴 — Streams 백프레셔, pipe/pipeline, 멱등성 vs 분산 락
    • Node.js
    • `setImmediate()`
  • kafka 페이지로 이동
    • Kafka 클러스터 아키텍처: Broker, KRaft Controller와 복제
    • Kafka 기본 개념: Topic, Partition, Offset과 Segment
    • Kafka 실전 설계: 파티션 전략, 컨슈머 그룹, 전달 보장, 재시도, 순서 보장 트레이드오프
    • Kafka 파티션·리밸런스·컨슈머 지연 운영
    • Kafka를 로그로 이해하기: 복제, 재처리, 상태와 데이터 통합
    • Spring Kafka 컨슈머 오프셋 커밋과 트랜잭션 정렬: AckMode, manual ack, 멱등 처리
  • linux 페이지로 이동
    • fsync — 리눅스 파일 동기화 시스템 콜
    • SSH forced command 로 배포 키가 실행할 수 있는 명령 제한하기
  • mlops 페이지로 이동
    • llm-serving 페이지로 이동
    • model-router 페이지로 이동
    • Python CUDA 버전 생태계 — nvidia-smi, nvcc, pip, conda가 다 다른 버전을 말하는 이유
    • GPU 컨테이너의 CUDA 버전 호환성 — nvidia-smi부터 이미지 다이어트까지
    • Kubernetes GPU 노드에서 /run tmpfs가 꽉 차서 Pod가 안 뜰 때
    • GPU·CUDA·MPS 기초 — 자바 백엔드 개발자가 처음 만나는 그림
    • Multi-process GPU 워크로드 — 자바 ThreadPool 사용자가 만나는 모델 차이
    • ML 서비스 성능 분석 워크플로 — 자바 백엔드 트러블슈팅과 다른 점
    • 한 GPU 를 여러 프로세스가 나눠 쓰기 — Time-Slicing 과 MPS
  • network 페이지로 이동
    • Connection reset by peer는 누가 보낸 걸까 — 리버스 프록시 홉마다 TCP 연결은 따로 논다
    • L2(스위치)와 L3(라우터)의 역할 차이
    • L4와 VIP(Virtual IP Address)
    • IP Subnet
  • observability 페이지로 이동
    • Observability 입문: 시니어 백엔드가 장애를 탐지하고 대응하는 방식
    • K8s 위 Spring Boot 앱의 메트릭 수집
  • python 페이지로 이동
    • Python async/await — CompletableFuture·Reactor 와 다른 점, 그리고 blocking I/O 함정
    • Python 의존성 관리 — Java Maven/Gradle 사용자가 만나는 첫 충격
    • FastAPI 기초 — Spring Boot 사용자가 빠르게 익히는 법
    • Java 개발자를 위한 Python 심화 — OOP·데코레이터·컨텍스트 매니저
    • PyTorch 기초 — 텐서, 디바이스, 그리고 모델 로딩이 무거운 이유
    • Java 개발자를 위한 Python 문법 핵심
    • ThreadLocal 에서 contextvars 로 — Python 의 요청 컨텍스트 전파
    • OCR 동작 원리 — Layout · Text · Post-process 3단계
    • Python 서버의 RSS가 줄지 않는 이유: CPython, gc.collect(), malloc_trim
  • rabbitmq 페이지로 이동
    • RabbitMQ Basics — 실전 백엔드 관점에서 정리하는 메시지 브로커 기본기
    • RabbitMQ vs Kafka — 백엔드 메시징 선택 기준과 실전 운영 관점
  • resume 페이지로 이동
    • 경험 및 경력기술서
    • 김병태 경력기술서
    • 김병태 포트폴리오
  • task 페이지로 이동
    • ai-service-team 페이지로 이동
    • nsc-slot 페이지로 이동
    • sb-dev-team 페이지로 이동
    • the-future-company 페이지로 이동
  • thinking 페이지로 이동
    • 자기주도 학습: 질문에서 시작해 글로 검증하기
    • 좋은 일을 넘어 중요한 일을 하는 법
FOS-BLOG · FOOTERall systems normal·v0.1 · 2026.04.27·seoul, kr
Ffos-blog/study

개발 학습 기록을 정리하는 블로그입니다. 공부하면서 기록하고, 기록하면서 다시 배웁니다.

visitors
01site
  • Home↗
  • Posts↗
  • Categories↗
  • Glossary↗
  • About↗
02policy
  • 소개/about
  • 개인정보처리방침/privacy
  • 연락처/contact
03categories
  • AI↗
  • Algorithm↗
  • DB↗
  • DevOps↗
  • Java/Spring↗
  • JS/TS↗
  • React↗
  • Next.js↗
  • System↗
04connect
  • GitHub@jon890↗
  • Source repositoryjon890/fos-study↗
  • RSS feed/rss.xml↗
  • Newsletter매주 1 회 · 한 편의 글→
© 2026 FOS Study. All posts MIT-licensed.
built with·Next.js·Tailwind v4·Geist·Pretendard·oklch
fos-blog/AI/사람용 CLI와 AI 에이전트용 CLI는 설…
ai

사람용 CLI와 AI 에이전트용 CLI는 설계가 다르다

예전에는 CLI를 사람만 썼다. 지금은 Claude Code 같은 AI 에이전트가 CLI를 호출해 업무를 자동화한다. 같은 도구라도 "에이전트가 쓰기 좋게" 설계하면 자동화가 훨씬 매끄럽고, 그러지 않으면 자동화가 자주 깨진다. 여러 업무 자동화 CLI를 직접 만들어 에이전트로 호출해 보면서 정리한 설계 원칙을 공유한다. (예시는 공개한 개인 도구 door...

2026.09.08·4 min read·45 views

예전에는 CLI를 사람만 썼다. 지금은 Claude Code 같은 AI 에이전트가 CLI를 호출해 업무를 자동화한다. 같은 도구라도 "에이전트가 쓰기 좋게" 설계하면 자동화가 훨씬 매끄럽고, 그러지 않으면 자동화가 자주 깨진다.

여러 업무 자동화 CLI를 직접 만들어 에이전트로 호출해 보면서 정리한 설계 원칙을 공유한다. (예시는 공개한 개인 도구 dooray-cli·nhncloud-cli에서 가져왔다.)

왜 다른가

사람은 출력을 눈으로 읽고, 모호하면 다시 입력하고, 위험한 작업은 알아서 조심한다. 에이전트는 그렇지 못하다. 출력을 기계적으로 파싱해야 하고, 입력 형식이 어긋나면 멈추며, 위험한 작업도 시키면 그냥 한다. 그래서 에이전트가 쓸 CLI는 출력·확인·안전을 사람용과 다르게 설계해야 한다.

1. 기계가 읽을 수 있는 출력 (--json)

사람용 표 출력은 에이전트가 파싱하기 어렵다.

  • --json 플래그로 구조화된 결과를 내보내면, 에이전트가 결과를 받아 다음 단계로 바로 넘길 수 있다.
  • 사람용 표 출력과 기계용 JSON 출력을 분리해 둔다 — 둘 다 필요하다.

2. 미리보기 (--dry-run)

에이전트는 위험한 작업도 망설임 없이 실행한다.

  • --dry-run으로 "실행하면 무엇이 일어나는지"만 보여주고 실제로는 바꾸지 않는 모드를 둔다.
  • 에이전트(또는 사람)가 미리보기로 확인한 뒤 실제 실행을 결정할 수 있다.
  • 파일을 만들거나 외부에 전송하는 명령일수록 미리보기의 가치가 크다.

3. 비대화형 모드 (--quiet, --no-confirm)

대화형 프롬프트("정말 진행할까요? y/n")는 사람에겐 친절하지만 에이전트·자동화 환경에선 멈춤의 원인이다.

  • --no-confirm으로 확인 단계를 건너뛰고, --quiet으로 진행 로그를 줄여 결과만 깔끔하게 남긴다.
  • CI 파이프라인이나 에이전트 호출에서 사람이 끼어들지 않아도 끝까지 돈다.

4. 안전장치는 기본값으로

비대화형으로 만들수록 안전장치를 도구 안에 내장해야 한다.

  • 같은 파일을 덮어쓰거나 중복 생성하려 하면 경고하거나 막는다.
  • 외부 제출·삭제·게시처럼 되돌리기 어려운 작업은 기본적으로 막고, 명시적 플래그가 있을 때만 수행한다.
  • "에이전트가 시키는 대로 다 한다"는 전제 위에서 위험한 기본 동작을 없앤다.

5. 입력을 너그럽게 해석한다

에이전트는 정확한 입력 형식을 항상 알지는 못한다.

  • 같은 대상을 URL·ID·코드·이름 등 여러 형식으로 받아 자동으로 분기해 처리한다.
  • 예를 들어 사람 지정은 이름(부분 일치)·이메일(정확히)·내부 ID(직접) 중 무엇으로 줘도 동작하게 한다.
  • 입력 형식을 까다롭게 받으면 에이전트가 자주 막히고, 너그럽게 받으면 자동화가 매끄러워진다.
  • 이름으로 찾을 때는 규칙을 하나로 통일한다. 정확히 일치하는 값을 먼저 찾고, 없으면 부분 일치를 찾고, 후보가 여러 개로 남으면 고르지 않고 에러로 끝낸다. 모호한 입력을 추측해서 처리하면 에이전트가 엉뚱한 대상을 바꾸고도 성공으로 받아들인다.

6. stdout 은 데이터, stderr 는 로그와 에러

에이전트는 stdout 만 파싱하는 경우가 많다. 진행 표시, 경고, 에러 메시지가 같은 스트림에 섞이면 --json 출력도 JSON 으로 읽히지 않는다.

  • 결과 데이터는 stdout 으로, 진행 표시와 에러는 stderr 로 보낸다.
  • 스피너 같은 진행 표시도 stderr 로 보낸다. dooray-cli 의 스피너는 stderr 스트림에 그린다.
  • 에러 메시지는 사람이 읽을 수 있게 쓰되 stdout 에는 한 글자도 쓰지 않는다.

7. 종료 코드를 한 곳에서 정한다

에이전트는 메시지 문장이 아니라 종료 코드로 성공과 실패를 판단한다. 명령마다 process.exit 를 흩어 두면 같은 실패가 명령에 따라 다른 코드로 끝난다.

  • 에러 타입을 하나로 두고 메시지와 종료 코드를 함께 담는다. dooray-cli 는 DoorayCliError(message, exitCode) 를 던지고, 진입점의 최상위 핸들러가 한 번만 stderr 에 출력한 뒤 그 코드로 종료한다.
  • 명령 코드는 process.exit 를 직접 부르지 않고 에러를 던지기만 한다. 일부만 실패한 파일 일괄 내려받기처럼 끝까지 진행해야 하는 경우에만 process.exitCode 를 설정한다. 종료 방식이 한 곳에 모이므로 코드 체계를 바꿔도 명령을 고칠 필요가 없다.

8. 참조는 앱으로 이동할 수 있는 링크로 출력한다

업무, 문서처럼 다른 시스템의 대상을 가리킬 때는 ID 만 출력하지 않고 그 시스템이 인식하는 표준 링크로 출력한다. dooray-cli 는 업무를 dooray://<조직 ID>/tasks/<업무 ID> 형태의 deeplink(앱 내 특정 화면으로 바로 이동하는 URI)로 출력한다.

  • 사람은 링크를 눌러 바로 이동한다.
  • 에이전트가 그 링크를 댓글이나 본문에 옮겨 적으면 대상 시스템이 업무로 자동 인식한다.

9. 반복 조회는 캐시하고 변경하면 무효화한다

이름을 ID 로 바꾸는 resolver 는 명령마다 같은 목록 API 를 다시 호출하기 쉽다. 에이전트는 한 세션에서 명령을 수십 번 부르므로 이 낭비가 그대로 쌓인다.

  • 이름에서 ID 로 바꾼 결과를 TTL(만료 시간) 캐시에 저장한다. dooray-cli 는 멤버, 프로젝트, 위키, 태그, 템플릿의 변환 결과를 파일로 저장하고 갱신 시각이 TTL 을 넘으면 다시 조회한다.
  • 캐시된 엔티티를 바꾸는 mutation(생성, 수정, 삭제)이 성공하면 관련 캐시를 곧바로 무효화한다. 그렇지 않으면 방금 만든 태그를 다음 명령이 찾지 못한다.
  • API client 는 순수한 HTTP 래퍼로 두고 캐시 정책을 섞지 않는다. mutation 과 무효화를 같은 service 의 책임으로 묶으면 새 명령을 추가할 때 무효화를 빠뜨리기 어렵다.
  • 캐시가 의심될 때 사람이나 에이전트가 직접 지울 수 있는 명령(cache clear)도 함께 둔다.

정리

에이전트가 호출할 도구는 다음을 갖추면 자동화가 잘 깨지지 않는다.

  • 기계가 읽는 출력(--json)
  • 미리보기(--dry-run)
  • 비대화형 모드(--quiet/--no-confirm)
  • 되돌리기 어려운 작업의 기본 차단
  • 너그러운 입력 해석
  • stdout 과 stderr 의 분리
  • 한 곳에서 정하는 종료 코드
  • 이동할 수 있는 링크 형태의 참조 출력
  • TTL 캐시와 변경 후 무효화

이렇게 만든 CLI를, 반복 작업을 절차로 고정한 skill이 호출하면 업무 자동화가 한 단계 더 매끄러워진다. skill로 절차를 고정하는 쪽은 Claude Code의 Skill 시스템에서 다룬다.

on this page
  • 01왜 다른가
  • 021. 기계가 읽을 수 있는 출력 (`--json`)
  • 032. 미리보기 (`--dry-run`)
  • 043. 비대화형 모드 (`--quiet`, `--no-confirm`)
  • 054. 안전장치는 기본값으로
  • 065. 입력을 너그럽게 해석한다
  • 076. stdout 은 데이터, stderr 는 로그와 에러
  • 087. 종료 코드를 한 곳에서 정한다
  • 098. 참조는 앱으로 이동할 수 있는 링크로 출력한다
  • 109. 반복 조회는 캐시하고 변경하면 무효화한다
  • 11정리
tags
#study#insights

이런 글도

  • ai

    하네스 회고는 새 문서로 쌓지 않고 종류에 맞는 기존 단일 소스에 환원한다

    2026.10.02
  • ai

    에이전트가 배운 회피 패턴은 조건을 통과한 것만 파일로 쌓고 주기적으로 지운다

    2026.10.02
  • ai

    ADR 은 되돌리기 어려운 결정의 이유만 남기고, 대안 기각은 옵션마다 줄을 나눈다

    2026.10.02
  • ai

    스킬 문서는 반복 실행을 스크립트로 내리고 같은 지시를 한 곳에서만 소유하게 쓴다

    2026.10.02

댓글 (0)