fos-blog/study
01 / 홈02 / 카테고리03 / 시리즈
01 / 홈02 / 카테고리03 / 시리즈

카테고리

  • AI 페이지로 이동
    • RAG 페이지로 이동
    • agent 페이지로 이동
    • langgraph 페이지로 이동
    • 사람용 CLI와 AI 에이전트용 CLI는 설계가 다르다
    • agents.md
    • Claude Code 메모리: CLAUDE.md와 .claude/rules를 규칙으로 쓰는 법
    • Claude Code의 Skill 시스템 - 개발자를 위한 AI 자동화의 새로운 차원
    • Claude Code를 5주 더 쓴 결과 — 스킬·CLAUDE.md를 키워가는 방식
    • Claude Code를 11일 동안 쓴 결과 — 데이터로 본 나의 사용 패턴
    • Claude Code 멀티 에이전트 — Teams
    • AI 에이전트와 디자인의 새 컨벤션 — DESIGN.md, Google Stitch, Claude Design
    • Docling — IBM Research 의 문서 파싱 toolkit 상세 정리
    • 하네스 엔지니어링 실전 — 4인 에이전트 팀으로 코딩 파이프라인 구축하기
    • 하네스 엔지니어링 — 오래 실행되는 AI 에이전트를 위한 설계
    • 멀티모달 LLM (Multimodal Large Language Model)
    • AI 에이전트와 함께 MVP 만들기 — dooray-cli 사례
    • 온톨로지에서 코딩 에이전트 컨텍스트까지 — 클래스·관계 설계와 그래프 평가
    • OpenClaw는 context와 memory를 어떻게 관리하나 — 나만의 에이전트를 구성하는 법
    • OpenClaw vs Hermes Agent — 갈아탈까 고민하며 정리한 비교
  • ai 페이지로 이동
    • agent 페이지로 이동
    • [초안] AI 제품 백엔드 안정성 — 지연·비용·권한·관측·도구 실패·폴백/재시도/사람 에스컬레이션
    • [초안] LLM 평가 프레임워크: 골든셋, 회귀 테스트, LLM-as-a-judge, 사람 피드백 루프
  • algorithm 페이지로 이동
    • live-coding 페이지로 이동
    • 분산 계산을 위한 알고리즘
  • architecture 페이지로 이동
    • 시니어 백엔드를 위한 API 설계 실전 스터디 팩
    • API 버저닝과 하위 호환성: 모바일·외부 컨슈머까지 안전하게 진화시키기
    • 캐시 설계 전략 총정리
    • [초안] 커머스 Spring 서비스에 Clean/Hexagonal Architecture를 실용적으로 적용하기
    • [초안] 커머스 도메인 모델링: 주문·재고·노출의 세 축을 분리해서 설계하기
    • 커머스 주문 상태와 데이터 정합성 기본기
    • [초안] 쿠폰/프로모션 동시성과 정합성 기본기 — 선착순·중복 사용 방지·발급/사용/복구
    • [초안] DDD와 도메인 모델링: 시니어 백엔드 관점의 전술/전략 패턴 실전 가이드
    • [초안] Decorator & Chain of Responsibility — 행동을 체인으로 조립하는 두 가지 방식
    • 디자인 패턴
    • [초안] 분산 아키텍처 완전 정복: Java 백엔드 시니어 인터뷰 대비 실전 가이드
    • [초안] 분산 트랜잭션과 Outbox 패턴 — 왜 2PC를 피하고 어떻게 대신할 것인가
    • 분산 트랜잭션
    • [초안] e-Commerce 주문·결제 도메인 모델링: 상태머신, 멱등성, Outbox/Saga 실전 정리
    • [초안] Event Sourcing과 CQRS — 상태가 아니라 변화를 저장한다는 발상
    • [학습중] 금융 거래 취소·정정·대사·일마감 운영
    • [학습중] 금융 거래 상태와 원장 설계
    • [초안] F&B 쿠폰·프로모션·멤버십·포인트 설계
    • [초안] F&B · e-Commerce 디지털 채널 도메인 한 장 정리
    • [초안] F&B 주문/매장/픽업 상태머신 설계
    • [초안] F&B 이커머스 결제·환불·정산 운영 가이드
    • [초안] Hexagonal / Clean Architecture를 Spring 백엔드에 적용하기
    • [초안] 대규모 커머스 트래픽 처리 패턴 — 대규모 회원과 메가 프로모션을 버티는 설계
    • [초안] 레거시 JSP/jQuery 화면과 신규 API가 공존하는 백엔드 운영 전략
    • [학습중] 모듈러 모놀리스에서 MSA로 점진 전환하는 실습
    • [초안] MSA 서비스 간 통신: Redis [Cache-Aside](../database/redis/cache-aside.md) × Kafka 이벤트 하이브리드 설계
    • [초안] Observability 입문: 시니어 백엔드가 장애를 탐지하고 대응하는 방식
    • [초안] Outbox / Inbox Pattern 심화 — 분산 메시징의 정합성 문제를 DB 트랜잭션으로 풀어내기
    • [초안] 결제 도메인 멱등성과 트랜잭션 재시도 기본기
    • [초안] 시니어 백엔드를 위한 Resilience 패턴 실전 가이드 — Timeout, Retry, Circuit Breaker, Bulkhead, Backpressure
    • [초안] Spring Batch vs Event-Driven — 같은 비동기처럼 보이지만 전혀 다른 두 패러다임
    • [초안] Strategy Pattern — 분기문을 없애는 설계, 시니어 백엔드 인터뷰 핵심 패턴
    • [초안] 시니어 백엔드를 위한 시스템 설계 입문 스터디 팩
    • [초안] 템플릿 메서드 패턴 - 백엔드 처리 골격을 강제하는 가장 오래되고 가장 위험한 패턴
    • [초안] 대규모 트래픽 중 무중단 마이그레이션 — Feature Flag + Shadow Mode 실전
  • database 페이지로 이동
    • milvus 페이지로 이동
    • mysql 페이지로 이동
    • opensearch 페이지로 이동
    • qdrant 페이지로 이동
    • redis 페이지로 이동
    • vespa 페이지로 이동
    • 김영한의-실전-데이터베이스-설계 페이지로 이동
    • [초안] DB Connection Pool Saturation과 Thread Pool 격리
    • 커넥션 풀 크기는 얼마나 조정해야 할까?
    • 인덱스 - DB 성능 최적화의 핵심
    • [초안] JPA N+1과 커머스 조회 모델: 주문/메뉴/쿠폰 도메인에서 살아남기
    • [초안] MyBatis 기본기 — XML Mapper, resultMap, 동적 SQL, 운영 패턴 정리
    • [초안] MyBatis와 JPA/Hibernate 트레이드오프 — 레거시 백엔드를 다루는 시니어 관점
    • 한국어 형태소 분석기 Nori vs Lindera — OpenSearch에서 Milvus로 갈 때 어휘 검색은 유지되나
    • 벡터 DB 5종, 아키텍처는 어떻게 다른가
    • 벡터 DB 5종을 실제로 벤치마크했다 — 같은 recall에서 QPS는 얼마나 갈리나
    • 벡터 DB 어떻게 고를까 — OpenSearch · Milvus · Qdrant · Vespa · pgvector 비교
    • 벡터 DB를 실제로 도입한 사례 — 빅테크 프로덕션
    • 역정규화 (Denormalization)
    • 데이터 베이스 정규화
  • devops 페이지로 이동
    • docker 페이지로 이동
    • k8s 페이지로 이동
    • k8s-in-action 페이지로 이동
    • observability 페이지로 이동
    • [초안] 커머스/F&B 채널 장애 첫 5분과 관측성 기본기
    • [초안] 운영 데이터 정합성 장애 대응 — 결제 취소 누락과 중복 적재 런북
    • Envoy Proxy
    • [초안] F&B / e-Commerce 운영 장애 대응과 모니터링 — 백엔드 관점 정리
    • Graceful Shutdown
    • [초안] 시니어 백엔드를 위한 SLO와 Error Budget 기반 장애 대응
  • http 페이지로 이동
    • HTTP Connection Pool
    • HTTPS는 어떻게 안전한가 — TLS, 인증서, 그리고 termination
  • interview 페이지로 이동
    • [초안] AI 서비스 팀 경험 기반 시니어 백엔드 면접 질문 뱅크 — Spring Batch RAG / gRPC graceful shutdown / 캐시 정합성 / 12일 AI 웹툰 MVP
    • Observability — 면접 답변 프레임
    • [초안] 시니어 Java 백엔드 면접 마스터 플레이북 — 김병태
    • [초안] NSC 슬롯팀 경험 기반 질문 은행 — 도메인 모델링·동시성·성능·AI 협업
  • java 페이지로 이동
    • concurrency 페이지로 이동
    • jdbc 페이지로 이동
    • opentelemetry 페이지로 이동
    • spring 페이지로 이동
    • spring-batch 페이지로 이동
    • testing 페이지로 이동
    • 더_자바_코드를_조작하는_다양한_방법 페이지로 이동
    • [초안] Java 동시성 락 정리 — 커머스 메뉴/프로모션 정책 캐시 갱신 관점
    • [초안] JVM 튜닝 실전: 메모리 구조부터 Virtual Threads, GC 튜닝, 프로파일링까지
    • Java의 로깅 환경
    • MDC (Mapped Diagnostic Context)
    • Java StampedLock — 읽기 폭주에도 쓰기가 밀리지 않는 락
    • Virtual Thread와 Project Loom
  • javascript 페이지로 이동
    • typescript 페이지로 이동
    • AbortController
    • Async Iterator와 제너레이터
    • CommonJS와 ECMAScript Modules
    • 제너레이터(Generator)
    • Http Client
    • Node 백엔드 운영 패턴 — Streams 백프레셔, pipe/pipeline, 멱등성 vs 분산 락
    • Node.js
    • npm vs pnpm — 어떤 기준으로 선택했나
    • `setImmediate()`
  • kafka 페이지로 이동
    • [초안] Kafka 기본 개념 — 토픽, 파티션, 오프셋, 복제
    • Kafka를 사용하여 **데이터 정합성**은 어떻게 유지해야 할까?
    • [초안] Kafka 실전 설계: 파티션 전략, 컨슈머 그룹, 전달 보장, 재시도, 순서 보장 트레이드오프
    • [학습중] Kafka 파티션·리밸런스·컨슈머 지연 운영
    • 메시지 전송 신뢰성
    • [초안] Spring Kafka 컨슈머 오프셋 커밋과 트랜잭션 정렬: AckMode, manual ack, 멱등 처리
  • linux 페이지로 이동
    • fsync — 리눅스 파일 동기화 시스템 콜
    • tmux — Terminal Multiplexer
  • mlops 페이지로 이동
    • llm-serving 페이지로 이동
    • serving-frameworks 페이지로 이동
    • Python CUDA 버전 생태계 — nvidia-smi, nvcc, pip, conda가 다 다른 버전을 말하는 이유
    • GPU 컨테이너의 CUDA 버전 호환성 — nvidia-smi부터 이미지 다이어트까지
    • Kubernetes GPU 노드에서 /run tmpfs가 꽉 차서 Pod가 안 뜰 때
    • GPU·CUDA·MPS 기초 — 자바 백엔드 개발자가 처음 만나는 그림
    • Multi-process GPU 워크로드 — 자바 ThreadPool 사용자가 만나는 모델 차이
    • ML 서비스 성능 분석 워크플로 — 자바 백엔드 트러블슈팅과 다른 점
    • 한 GPU 를 여러 프로세스가 나눠 쓰기 — Time-Slicing 과 MPS
  • network 페이지로 이동
    • Connection reset by peer는 누가 보낸 걸까 — 리버스 프록시 홉마다 TCP 연결은 따로 논다
    • L2(스위치)와 L3(라우터)의 역할 차이
    • L4와 VIP(Virtual IP Address)
    • IP Subnet
  • python 페이지로 이동
    • Python async/await — CompletableFuture·Reactor 와 다른 점, 그리고 blocking I/O 함정
    • Python 의존성 관리 — Java Maven/Gradle 사용자가 만나는 첫 충격
    • FastAPI 기초 — Spring Boot 사용자가 빠르게 익히는 법
    • Java 개발자를 위한 Python 심화 — OOP·데코레이터·컨텍스트 매니저
    • PyTorch 기초 — 텐서, 디바이스, 그리고 모델 로딩이 무거운 이유
    • Java 개발자를 위한 Python 문법 핵심
    • ThreadLocal 에서 contextvars 로 — Python 의 요청 컨텍스트 전파
    • OCR 동작 원리 — Layout · Text · Post-process 3단계
    • Python 서버의 RSS 가 안 줄어드는 이유 — gc.collect 의 한계와 malloc_trim
  • rabbitmq 페이지로 이동
    • [초안] RabbitMQ Basics — 실전 백엔드 관점에서 정리하는 메시지 브로커 기본기
    • [초안] RabbitMQ vs Kafka — 백엔드 메시징 선택 기준과 실전 운영 관점
  • resume 페이지로 이동
    • [초안] 김병태 경력기술서
    • [초안] 김병태 포트폴리오
  • security 페이지로 이동
    • [초안] 시니어 백엔드를 위한 보안 / 인증 스터디 팩 — Spring Security, JWT, OAuth2, OWASP Top 10
    • [초안] Spring Security 6.x OAuth2 + JWT 상용 인증 설계 — Grant 선택, Resource Server, Refresh Rotation, 로그아웃
  • task 페이지로 이동
    • ai-service-team 페이지로 이동
    • nsc-slot 페이지로 이동
    • sb-dev-team 페이지로 이동
    • the-future-company 페이지로 이동
  • testing 페이지로 이동
    • [초안] 시니어 Java 백엔드를 위한 테스트 전략 완전 정리 — 피라미드부터 TestContainers, 마이크로벤치, Contract까지
  • thinking 페이지로 이동
    • 좋은 일을 넘어 중요한 일을 하는 법
FOS-BLOG · FOOTERall systems normal·v0.1 · 2026.04.27·seoul, kr
Ffos-blog/study

개발 학습 기록을 정리하는 블로그입니다. 공부하면서 기록하고, 기록하면서 다시 배웁니다.

visitors
01site
  • Home↗
  • Posts↗
  • Categories↗
  • Glossary↗
  • About↗
02policy
  • 소개/about
  • 개인정보처리방침/privacy
  • 연락처/contact
03categories
  • AI↗
  • Algorithm↗
  • DB↗
  • DevOps↗
  • Java/Spring↗
  • JS/TS↗
  • React↗
  • Next.js↗
  • System↗
04connect
  • GitHub@jon890↗
  • Source repositoryjon890/fos-study↗
  • RSS feed/rss.xml↗
  • Newsletter매주 1 회 · 한 편의 글→
© 2026 FOS Study. All posts MIT-licensed.
built with·Next.js·Tailwind v4·Geist·Pretendard·oklch
fos-blog/resume/[초안] 김병태 포트폴리오
resume

[초안] 김병태 포트폴리오

백엔드 시스템의 안정성과 AI 기반 업무 전환을 함께 설계합니다. - 이메일: jon89071@gmail.com - GitHub: https://github.com/jon890 - 경력: 약 7년 - 핵심 스택: Java·Kotlin, Spring Boot, TypeScript, Python, OpenSearch, Redis, Kubernetes | 프로젝...

2026.07.16·10 min read·17 views

백엔드 시스템의 안정성과 AI 기반 업무 전환을 함께 설계합니다.

  • 이메일: jon89071@gmail.com
  • GitHub: https://github.com/jon890
  • 경력: 약 7년
  • 핵심 스택: Java·Kotlin, Spring Boot, TypeScript, Python, OpenSearch, Redis, Kubernetes

포트폴리오 한눈에 보기

프로젝트해결한 문제주요 역할핵심 기술
AI 개발 생산성 전환에이전트의 도메인 이해 부족과 반복 업무컨텍스트 설계, CLI 개발, 검토 워크플로Cursor Rules, TypeScript CLI, LLM review
다중 소스 RAG 색인느린 I/O와 중간 실패, 원천별 확장파이프라인 설계·구현Java 21, Spring Batch, OpenSearch
문서 파싱 품질 플랫폼변환 품질 회귀와 워커 운영 불안정품질 검증·병렬화·운영 개선Python, FastAPI, OCR, golden set
AI 웹툰 제작 도구혼자 짧은 기간에 End-to-End AI 제품 완성제품·아키텍처·AI 파이프라인Next.js, TypeScript, Gemini, PostgreSQL
슬롯 백엔드 현대화중복 구조, 캐시 동시성, 성능 병목점진 리팩터링과 성능 개선Java 17, Spring Boot, Redis, MySQL

프로젝트 1. AI를 개발 생산성과 실행 도구로 전환

문제

복잡한 슬롯 도메인에서 AI 에이전트는 코드 위치와 게임 규칙을 몰라 존재하지 않는 클래스를 사용하거나 잘못된 로직을 만들었습니다. 협업 도구와 클라우드 운영 업무는 사람이 화면과 여러 CLI를 오가며 반복해서 처리해야 했습니다.

목표

AI가 단순한 코드 생성 도구가 아니라 도메인 맥락을 이해하고, 검증 가능한 방식으로 개발과 운영 업무를 수행하도록 만드는 것이 목표였습니다.

역할

  • 도메인 컨텍스트와 검토 기준 설계
  • 에이전트가 호출할 CLI 인터페이스 설계·구현
  • AI 구현 결과의 추적과 검토 흐름 설계
  • LLM 코드리뷰와 자동 테스트 연결

설계와 구현

도메인 컨텍스트

  • 공통 객체의 정확한 패키지, 슬롯 아키텍처와 테스트 규칙을 Cursor Rules로 작성했습니다.
  • 게임별 심볼, 보너스 규칙과 캐시 대응 방법을 별도 규칙으로 분리했습니다.
  • 규칙이 코드와 어긋나면 없는 것보다 위험하다고 보고 유지보수 대상을 명시했습니다.

사람 검토 중심 워크플로

  • 에이전트 구현은 by agent 커밋으로 구분했습니다.
  • RTP 계산과 특수 심볼 같은 도메인 규칙은 사람이 반드시 검토했습니다.
  • 테스트와 검토를 통과한 결과만 실제 코드에 반영했습니다.

에이전트 친화 CLI

  • 협업 시스템의 업무, 위키, 메일과 첨부 기능을 하나의 CLI로 통합했습니다.
  • 모든 명령에 구조화 JSON 출력과 표준 종료 코드를 적용했습니다.
  • 대화형 확인이 필요 없는 실행 경로와 파일 입력을 제공했습니다.
  • 클라우드 리소스 98개 명령을 같은 계약으로 통합했습니다.
  • commands --json을 통해 에이전트가 런타임에 명령 카탈로그를 발견하도록 만들었습니다.

결과

  • 20개 이상의 도메인 규칙을 구축했습니다.
  • AI 에이전트를 통해 신규 슬롯 3종을 구현했습니다.
  • 에이전트용 문서가 팀원의 도메인 온보딩에도 재사용됐습니다.
  • 반복되는 협업과 클라우드 운영 업무를 사람과 에이전트가 공유하는 실행 도구로 전환했습니다.

배운 점

  • AI 생산성은 모델 성능만으로 결정되지 않고 컨텍스트, 실행 계약과 검토 비용까지 포함해 설계해야 합니다.
  • 자동화의 완료 기준은 명령이 실행되는 것이 아니라 사람이 실패 원인을 판단하고 안전하게 복구할 수 있는 것입니다.
  • 다음 단계에서는 도입률, 반복 작업 시간, 자동화 성공률과 수동 개입률을 기준선과 함께 측정해야 합니다.

링크

  • AI 개발 도구 도입
  • dooray-cli
  • nhncloud-cli

프로젝트 2. 다중 소스 RAG 벡터 색인 파이프라인

문제

사내 지식 검색을 위해 여러 문서 원천을 임베딩하고 OpenSearch에 색인해야 했습니다. 동기 처리에서는 임베딩과 문서 파싱 I/O가 병목이 됐습니다. 중간 실패 시 처음부터 재처리하면 비용이 커지고 삭제된 원문이 검색 결과에 남는 문제도 있었습니다.

목표

  • 실패 지점부터 재시작할 수 있어야 합니다.
  • 페이지, 댓글, 첨부와 삭제 동기화의 실패 범위를 분리해야 합니다.
  • 문서 원천이 늘어도 기존 파이프라인의 핵심 구조를 바꾸지 않아야 합니다.
  • 변경되지 않은 문서의 임베딩 비용을 반복해서 지불하지 않아야 합니다.

역할

Spring Batch 구조 설계부터 Reader, Processor, Writer와 OpenSearch 색인까지 전체 파이프라인을 구현했습니다.

설계와 구현

11개 Step 분리

  • 초기화
  • 원천 수집
  • 페이지 색인
  • 댓글 색인
  • 페이지·댓글·첨부 삭제 동기화
  • 색인 갱신
  • 실행 완료 처리

각 Step은 독립된 실행 결과를 남깁니다. 댓글 처리에서 실패해도 이미 완료된 페이지 색인 결과는 유지됩니다.

I/O 병렬화

  • AsyncItemProcessor로 임베딩과 문서 파싱 호출을 병렬 처리했습니다.
  • AsyncItemWriter가 완료 결과를 모아 OpenSearch에 벌크로 색인합니다.
  • 동시 실행 수를 제한해 외부 API와 내부 자원을 과도하게 사용하지 않도록 했습니다.

변경 감지와 확장

  • OpenSearch 문서 version과 원문의 version을 비교했습니다.
  • 변경 없는 문서는 Processor에서 제외해 임베딩 호출을 줄였습니다.
  • 원천별 메타데이터 차이는 Provider 전략으로 분리했습니다.
  • 단일 스페이스에서 여러 스페이스로, 페이지에서 댓글·첨부파일까지 색인 범위를 확장했습니다.

검증

  • Testcontainers로 OpenSearch와 MySQL을 포함한 통합 테스트를 구성했습니다.
  • JaCoCo 커버리지 게이트와 SonarQube를 CI에 연결했습니다.

결과

  • 사내 AI 서비스의 RAG 색인 기반을 처음부터 구축했습니다.
  • 중간 실패 후 전체를 다시 실행하지 않고 필요한 Step부터 이어갈 수 있게 했습니다.
  • 원천 추가와 삭제 동기화를 기존 핵심 흐름을 유지한 채 확장할 수 있게 했습니다.

배운 점

Spring Batch의 Step 분리는 코드 정리 수단이 아니라 운영 장애의 범위를 제한하는 장치였습니다. 재시작 상태와 실행 중 공유 데이터는 수명과 복구 목적이 다르므로 같은 저장소에 무조건 넣으면 안 됩니다.

링크

  • RAG 벡터 색인 배치

프로젝트 3. 문서 파싱 품질 검증과 워커 운영

문제

다양한 문서를 Markdown으로 변환하는 서비스는 설정과 라이브러리를 조금만 바꿔도 결과가 달라집니다. 기존 출력과 달라졌다는 사실만으로는 품질이 좋아졌는지 나빠졌는지 판단하기 어려웠습니다. OCR 워커는 병렬 처리, GPU 상태와 메모리 단편화 때문에 운영 안정성 문제도 있었습니다.

목표

  • 의도하지 않은 출력 회귀를 자동으로 차단합니다.
  • 실제 정답에 가까워진 개선은 통과시킵니다.
  • 표 구조의 손실을 일반 텍스트 점수와 별도로 검증합니다.
  • 운영 서버에 영향을 주지 않고 실제 이미지로 검증합니다.

역할

  • 워커 병렬 구조 개선
  • 파서 모듈 분해
  • 품질 검증 체계 설계
  • 관측 정보 정리
  • 메모리 증가 원인 분석과 개선

설계와 구현

두 층의 품질 검증

  • 1차 회귀 검증은 이전 출력과 새 출력의 NED를 비교했습니다.
  • 2차 절대 평가는 LLM 초안을 사람이 확정한 golden 출력과 비교했습니다.
  • 표는 셀 누락과 위치 변경이 전체 문자 점수에 묻히지 않도록 셀 단위 F1으로 분리했습니다.

격리된 검증 환경

  • 운영 인스턴스를 트래픽에서 빼 검증하던 방식을 폐기했습니다.
  • 직접 만든 클라우드 CLI로 운영과 격리된 전용 GPU 인스턴스를 확보하고, 검증 대상 이미지만 바꿔 띄웠습니다.
  • 평소에는 인스턴스를 정지해 두고 검증할 때만 시작하는 방식으로 재사용해 운영 영향과 비용을 줄였습니다.

워커 메모리 문제

  • 워커 RSS가 시간당 약 1.4GB씩 증가하는 현상을 확인했습니다.
  • gc.collect() 이후에도 RSS가 줄지 않는 원인을 glibc allocator와 메모리 단편화 관점에서 분석했습니다.
  • OS 반환을 유도하는 malloc_trim을 적용하고 환경변수로 즉시 끌 수 있게 했습니다.
  • 인스턴스 한 대에 먼저 배포해 검증한 결과 RSS가 일정 범위에서 유지되고 회귀가 없음을 확인했습니다. 다만 워커 재활용과 malloc_trim 단독 효과를 분리 측정하는 것은 다음 과제로 남겼습니다.

결과

  • 품질 저하를 막으면서 개선 실험을 안전하게 반복할 수 있게 했습니다.
  • 운영 자원을 점유하지 않는 검증 환경을 만들었습니다.
  • 워커 강제 종료와 재예열 의존도를 낮췄습니다.

배운 점

  • 관측 지표가 있다고 해서 올바른 의사결정이 가능한 것은 아닙니다.
  • pending과 call queue처럼 의미가 다른 수치를 구분해야 확장 판단을 잘못하지 않습니다.
  • AI 결과 품질은 하나의 종합 점수보다 실패 형태에 맞는 여러 지표로 평가해야 합니다.

링크

  • 문서 파싱 파이프라인

프로젝트 4. AI 웹툰 제작 도구

문제

한 명이 짧은 기간에 웹소설 분석부터 60컷 이미지 생성까지 이어지는 풀스택 AI 제품을 완성해야 했습니다. 긴 입력의 비용, 모델 rate limit, 부분 실패, 프롬프트 환각과 캐릭터 외형 일관성이 핵심 문제였습니다.

목표

  • 운영자가 단계별 결과를 확인하고 수정할 수 있어야 합니다.
  • 일부 이미지 생성이 실패해도 성공한 결과는 유지해야 합니다.
  • 모델 장애나 제한 상황에서도 작업을 계속할 수 있어야 합니다.
  • 원작 범위를 벗어난 서사 환각과 캐릭터 외형 변화를 줄여야 합니다.

역할

제품 요구사항, 프론트엔드, 백엔드, 데이터베이스, AI 호출 구조와 에이전트 개발 하네스를 단독으로 설계했습니다.

설계와 구현

모델·비용 전략

  • 결과 품질이 낮아 재생성이 반복되면 저가 모델도 총비용이 커진다고 판단했습니다.
  • pro를 우선 사용하고 429가 발생하면 flash와 lite로 넘어가는 fallback을 적용했습니다.
  • 모델별 rate limit 상태를 전역으로 공유해 같은 실패 요청이 반복되지 않게 했습니다.
  • 동일 소설은 Gemini Context Caching으로 여러 단계에서 재사용했습니다.

부분 실패 격리

  • 60컷 이미지를 하나의 긴 SSE 작업으로 처리하지 않았습니다.
  • 독립 작업의 성격에 맞게 브라우저에서 Promise.allSettled로 요청했습니다.
  • 실패한 컷만 다시 실행할 수 있도록 상태와 오류를 컷별로 저장했습니다.

환각과 이미지 일관성

  • continuation 호출마다 원작과 treatment grounding을 다시 전달했습니다.
  • 허용되는 창의는 연출이고 서사는 원작 범위라는 경계를 명시했습니다.
  • 캐릭터 외형은 텍스트 지시가 아니라 기준 이미지를 자동으로 첨부해 유지했습니다.

AI 개발 하네스

  • 구현 전에 계획과 성공 기준을 파일로 고정했습니다.
  • 실행, 비판적 검토와 문서 정합성 확인을 서로 다른 에이전트 역할로 분리했습니다.
  • 본인은 요구사항과 기술 결정을 맡고 반복 구현을 에이전트가 수행하게 했습니다.

결과

  • 12일 동안 199개 계획과 760개 커밋으로 MVP 범위를 완성했습니다.
  • 운영자가 소설 분석부터 이미지 결과까지 단계별로 검토하는 제품 흐름을 구현했습니다.
  • 디자이너와 파일 소유권을 분리해 로직과 시각 변경의 충돌을 줄였습니다.

배운 점

  • AI 제품의 품질 문제는 프롬프트 문구보다 호출 경계와 컨텍스트 전달 구조에서 발생하는 경우가 많습니다.
  • 자동화 생산성을 높이려면 에이전트 수보다 입력 요구사항과 검증 게이트의 정확도가 중요합니다.
  • 비용 최적화는 모델 단가가 아니라 재생성까지 포함한 전체 작업 비용으로 판단해야 합니다.

링크

  • AI 웹툰 제작 도구
  • 실제 제작 결과

프로젝트 5. 슬롯 백엔드의 점진적 현대화

문제

슬롯마다 플레이 흐름과 당첨 규칙이 중복됐고 정적 데이터 갱신 중 조회 요청이 부분 상태를 읽어 NPE가 발생했습니다. 대규모 시뮬레이션은 난수 생성과 메모리 누적으로 성능과 안정성 문제가 있었습니다.

목표

  • 검증되지 않은 추상화를 먼저 만들지 않습니다.
  • 신규 슬롯을 추가할 때 기존 서비스 코드의 변경 범위를 줄입니다.
  • 다중 서버 환경에서 캐시 갱신 중에도 조회 안정성을 유지합니다.
  • 알고리즘과 벤치마크를 근거로 성능 병목을 해결합니다.

역할

  • 신규 슬롯 5종 개발 (Slot 36·38·41·44·47)
  • 슬롯 엔진 구조 개선
  • 캐시 동시성 문제 해결
  • 시뮬레이터 성능과 메모리 개선
  • 테스트 구조와 AI 개발 컨텍스트 표준화

설계와 구현

점진적 추상화

  • 슬롯 5종 이상을 직접 구현하며 실제로 반복되는 경계를 먼저 확인했습니다.
  • 공통 플레이 흐름은 템플릿으로, 모드별 차이는 Handler로 분리했습니다.
  • 당첨 계산의 부가 규칙은 Decorator와 Strategy로 조합했습니다.
  • 신규 타입은 기존 코드를 수정하기보다 구현체 추가로 확장하도록 만들었습니다.

캐시 정합성

  • 정적 데이터 갱신 시 기존 값을 비우고 다시 적재하는 구간에서 NPE가 발생했습니다.
  • 갱신은 StampedLock write lock으로 보호했습니다.
  • 조회는 제한 시간 안에 read lock을 얻지 못하면 실패를 명확하게 처리하도록 했습니다.

성능과 메모리

  • 가중치 랜덤 선택의 병목을 분석하고 Alias Method 적용으로 시간 복잡도를 O(n)에서 O(1)로 낮출 수 있음을 정리했습니다.
  • 1억 건 당첨금을 모두 저장하던 구조를 Welford Online Algorithm으로 변경했습니다.
  • 평균과 분산 계산에 필요한 상태만 유지해 공간 복잡도를 O(N)에서 O(1)로 줄였습니다.

결과

  • 슬롯별 중복 흐름을 공통 구조로 모으고 신규 규칙의 변경 범위를 줄였습니다.
  • 정적 데이터 갱신 중 발생하던 NPE를 해소했습니다.
  • 시뮬레이터의 OOM을 제거하고 성능 결정의 근거를 남겼습니다.
  • 긴 수명의 레거시를 한 번에 교체하지 않고 테스트 가능한 구조로 발전시켰습니다.

배운 점

  • 추상화의 시점은 재사용 가능성을 상상했을 때가 아니라 실제 중복의 경계를 확인했을 때입니다.
  • 동시성 도구는 성능뿐 아니라 실패 시 동작과 운영자가 진단할 수 있는 상태까지 함께 설계해야 합니다.
  • 작은 PR과 테스트 안전망은 장기 리팩터링을 실제로 끝내게 하는 실행 전략입니다.

링크

  • 슬롯 엔진 추상화
  • 슬롯 스핀 성능 개선

일하는 방식

현업 문제를 기술 언어로 바꿉니다

사용자가 말하는 증상을 바로 기능 요구사항으로 받아들이지 않습니다. 반복, 실패, 대기와 검토 비용을 구분하고 기술로 바꿀 수 있는 경계를 찾습니다.

AI 결과도 검증 가능한 소프트웨어로 다룹니다

LLM 출력은 정답으로 간주하지 않습니다. 스키마 검증, golden set, 회귀 테스트와 사람 검토를 조합합니다.

도구와 지식을 팀의 자산으로 남깁니다

일회성 스크립트보다 반복 실행 가능한 CLI와 skill을 선호합니다. 의사결정과 도메인 규칙을 문서로 남겨 사람과 에이전트가 함께 사용하도록 만듭니다.

다음 성장 목표

현업 조직과 직접 맞닿아 업무 병목을 발견하고 필요한 커넥터, 도구와 지식 기반을 빠르게 배포하는 AI 챔피언을 지향합니다. 도입 이후에는 다음 지표를 이용해 효과를 검증하고 지속적으로 개선하고자 합니다.

  • 사용자 도입률과 활성 사용률
  • 반복 업무의 처리 시간
  • 자동화 성공률과 수동 개입률
  • 지식의 최신성
  • 지식의 참조 빈도와 재사용 범위
on this page
  • 01포트폴리오 한눈에 보기
  • 02프로젝트 1. AI를 개발 생산성과 실행 도구로 전환
  • 문제
  • 목표
  • 역할
  • 설계와 구현
  • 결과
  • 배운 점
  • 링크
  • 03프로젝트 2. 다중 소스 RAG 벡터 색인 파이프라인
  • 문제
  • 목표
  • 역할
  • 설계와 구현
  • 결과
  • 배운 점
  • 링크
  • 04프로젝트 3. 문서 파싱 품질 검증과 워커 운영
  • 문제
  • 목표
  • 역할
  • 설계와 구현
  • 결과
  • 배운 점
  • 링크
  • 05프로젝트 4. AI 웹툰 제작 도구
  • 문제
  • 목표
  • 역할
  • 설계와 구현
  • 결과
  • 배운 점
  • 링크
  • 06프로젝트 5. 슬롯 백엔드의 점진적 현대화
  • 문제
  • 목표
  • 역할
  • 설계와 구현
  • 결과
  • 배운 점
  • 링크
  • 07일하는 방식
  • 현업 문제를 기술 언어로 바꿉니다
  • AI 결과도 검증 가능한 소프트웨어로 다룹니다
  • 도구와 지식을 팀의 자산으로 남깁니다
  • 다음 성장 목표

이런 글도

  • [초안] 김병태 경력기술서
    백엔드 코어 위에 AI를 제품과 개발 생산성으로 접목해 온 7년차 개발자입니다. - 이메일: jon89071@gmail.com - GitHub: https://github.com/jon890 - 주요 분야: Java·Kotlin 백엔드, AI 서비스, RAG, 개발 생산성 자동화 - Java 17·21과 Spring Boot 2.6·3.x 기반 운영 서비스...
    📄 resume
    resume
    2026.07.16

댓글 (0)