SELECTED ENGINEERING / 2026

도구 선택부터,
업무 결과까지.

AI Agent Engineering

에이전트의 도구 실행, 사내 업무 자동화, 근거 기반 평가와 배포 전 검증. 네 프로젝트의 문제와 설계 선택, 확인할 수 있는 구현을 연결했습니다.

선택한 사례 보기 ↓
OrchestrationMCPAI APIMLOps

01 / SELECTED CASES

무엇을 만들었고, 왜 그렇게 바꿨는가.

01 / AGENT + MCP

Terracotta

제품 기획 · UI · 에이전트/API · 배포 구성

공개 코드 · 개인용 프로토타입
Terracotta 프로젝트 화면
  1. Model routing
  2. Tool loop
  3. MCP / approval
  4. Result + trace

문제

여러 모델과 업무 도구를 오가면 작업 맥락, 실행 권한, 비용을 따로 관리해야 합니다.

설계와 개선

모델별 도구 호출 루프와 MCP 연결을 구성했습니다. 에이전트 경로에서 쓰기 도구는 승인을 기다리고, 라운드·호출 수를 제한하며 실행 trace와 사용량을 저장합니다.

확인할 근거

MCP initialize → tools/list → tools/call 코드, OAuth PKCE와 토큰 암호화, D1 상태 저장, Docker·GHCR 발행 기록을 공개합니다.

검증 범위

MCP 2025-11-25 기반 HTTP 구현입니다. 전체 외부 서비스와의 호환성·모든 API 진입점의 승인 강제·A2A 연동은 검증하지 않았습니다. 비용 벤치마크는 오프라인 정책 시뮬레이션입니다.

02 / WORKFLOW + OPERATIONS

Meeting Assistant

단독 담당 · 기획 / 개발 / 배포 / 운영 / 유지보수

RTX 4090 사내 운영 · 공개판은 UI 데모
Meeting Assistant 프로젝트 화면
  1. Audio + job ID
  2. STT / diarization
  3. Structured minutes
  4. Notion / email

문제

녹음 이후 전사, 화자 구분, 회의록 정리와 전달을 반복해야 합니다. 긴 음성 처리는 웹 요청 제한이나 외부 API 실패의 영향을 받습니다.

설계와 개선

FastAPI 작업 ID로 긴 처리를 관리하고 전사 → 화자 분리 → 구조화 회의록 → Notion·메일 전달을 연결했습니다. 업로드 응답 유실 시 기존 작업을 찾아 재연결하고, 단계별 실패에서도 전사본과 회의록을 보존합니다.

확인할 근거

2026년 8·9월 제공 통계에 회의 32건, 녹음 길이 합계 833분이 기록돼 있습니다. 운영 요청에서 재연결·재처리·결과 보존으로 이어진 변경을 사례에 정리했습니다.

검증 범위

고정 단계의 AI 업무 자동화입니다. 자율 다중 에이전트나 MCP 시스템으로 분류하지 않습니다. 833분은 절감 시간이 아니며, 재연결은 조건 기반으로 완전한 중복 방지 보장이 아닙니다.

03 / ORCHESTRATION + EVALUATION

MED-RAG

RAG 구현 · 설치·원격 유지보수 · 공개 평가·튜닝

개인 PC 사용 · 별도 ADK 공개 실험
MED-RAG 프로젝트 화면
  1. Question
  2. Search tools
  3. Draft → review
  4. Evidence-aware eval

문제

문서를 찾는 것과 근거에 맞게 답하는 것은 서로 다른 문제입니다. 그럴듯한 답변만 평가하면 검색 실패와 위조 인용을 놓칠 수 있습니다.

설계와 개선

공개 Vertex 포트에서 ADK SequentialAgent로 검색·초안과 검토를 연결했습니다. 검색 문서를 평가자에게 전달하고, 튜닝의 위조 인용 감소와 과잉 거부 증가를 함께 비교했습니다.

확인할 근거

공개 보고서: 합성 질문 24건 중 정답 문서 검색 23건, 근거 기반 답변 평가 통과 20건. 튜닝 원본 평가에서는 개선과 부작용을 비교해 기본 모델을 유지하는 판단을 기록했습니다.

검증 범위

실사용판과 합성 데이터 공개 실험은 별도입니다. 두 단계 순차 실행이며 검토 LLM은 강제 승인 gate가 아닙니다. 공개 RAG 보고서의 원본 API 로그는 포함되지 않아 이번 점검에서 수치를 재실행하지 않았습니다.

04 / API + RELEASE VALIDATION

MED-RAG Serving Lab

서빙 계약 · 품질 gate · 릴리스 산출물 검증

실제 HTTP · 합성 CPU upstream 실험
  1. Version manifest
  2. HTTP / SSE gateway
  3. Quality + load checks
  4. Release artifact

문제

답변 품질만 확인해도 요청 폭주, 스트림 중단, 버전 불일치 때문에 서비스가 실패할 수 있습니다.

설계와 개선

모델·프롬프트·데이터·런타임 버전을 고정하고, SSE gateway의 동시 요청 제한·시간 초과·준비 상태를 검증합니다. 품질과 성능 기록을 다시 계산해 릴리스 준비 조건을 검사합니다.

확인할 근거

공개 HTTP rehearsal 계약 14개와 Python 테스트 31개. 검증 기록의 소스 hash 6개가 코드와 일치하는지 확인했습니다.

검증 범위

실제 모델 추론과 GPU 성능, 운영 서비스 교체·롤백은 미실행입니다. 실제 모델 API·worker 복구 근거는 별도 VisionEye CPU 실험으로 연결합니다.

02 / EVIDENCE MAP

기술 이름을 구현 근거에 연결합니다.

역량현재 근거더 확인할 항목
Agent 설계·오케스트레이션Terracotta 도구 루프 · MED-RAG ADK 순차 에이전트실제 모델의 업무 완주율 · 재시작 후 실행 재개
MCP 기반 시스템 연계Terracotta HTTP 도구 탐색·호출 · OAuth독립 서버와 호환성 · 버전 협상 · 모든 진입점의 승인 정책
AI API·성능·복구Meeting 비동기 작업 · Serving Lab gateway · VisionEye CPU API부하 조건별 p95 · 동시성 · 실제 GPU 서빙
업무 자동화회의 녹음 → 회의록 → Notion·이메일단계별 완료율 · 수작업 대비 시간 측정
MLOps·서비스 연계버전 고정 · 품질 gate · CI · 릴리스 산출물실제 배포 전환·롤백 · 장시간 모니터링
A2A·지식그래프현재 선정 사례에 검증된 프로토콜/온톨로지 구현 근거 없음독립 에이전트 위임이 필요할 때 후속 구현

함께 볼 수 있는 실험

Agent Orchestra는 LangGraph 병렬 fan-out과 재작성 루프의 구조 검증, VisionEye는 실제 모델 API와 worker 복구, RoboSkill은 물리 시뮬레이션의 실패 분석을 보완합니다. 각 실험의 mock·실측·미실행 범위를 구분합니다.

03 / PROPOSED EXTENSION · 설계안 / 미구현

RoboSkill ExperimentOps Agent

“외란 조건에서 실패한 실험을 찾아, 같은 seed로 두 전략을 다시 비교하고 보고서를 만들어줘.”

기존 MuJoCo 실행기와 결과 뷰어를 재사용해 실험 검색·재실행·분석의 반복 작업을 자동화하는 확장안입니다. 현재 RoboSkill의 규칙 기반 제어와 구분하며, 이 에이전트는 아직 구현·평가하지 않았습니다.

  1. LLM planner
  2. Persistent graph
  3. MCP experiment tools
  4. MuJoCo + evidence

첫 구현 범위

  • 오케스트레이터 1개 · MCP 도구 서비스 1개 · 영속 작업 DB
  • list_runs · start_experiment · get_run · compare_runs
  • 중복 요청 키와 실행 ID를 연결하고, 중단 후 기존 작업을 조회해 재개
  • A2A는 독립 평가 에이전트로 위임할 필요가 생길 때 확장

완료를 판정할 실험

  • 개발과 분리한 정상 40 · 모호 10 · 미지원 10개 요청
  • 정상 요청의 올바른 산출물 ≥90% 목표 · 아직 측정하지 않음
  • worker 종료·응답 유실·재시작에서 중복 실험 0건 목표
  • p95 지연·비용·도구 오류·보고서 숫자를 원본 실행과 대조

설계 참고: MCP는 도구·데이터 연결, LangGraph 영속 상태는 중단 후 재개, A2A는 독립 에이전트 간 작업 위임에 사용합니다. 체크포인트와 도구의 중복 실행 방지는 별도로 검증합니다.

2026.09.22 코드·공개 기록 검토 기준. 이 페이지는 기존 프로젝트의 직무별 탐색 경로이며, 하나의 통합 운영 시스템이나 새 프로젝트의 완료 보고서가 아닙니다.

Contact

hyunaeee@gmail.com ↗

대한민국 · 한국어 / 영어

포트폴리오 PDF

역할, 설계 판단, 검증 결과와 자료 링크를 함께 담습니다.

인쇄 창에서 ‘PDF로 저장’을 선택하세요.