커넥트웨이브 · Consumer Commerce CTO · 채용 중 28건
[CC CTO] DevOps Engineer
[CC CTO] DevOps Engineer
데브옵스 엔지니어정규직미드 · 경력 무관
커넥트웨이브에서 DevOps Engineer를 채용합니다. Kubernetes 운영 및 Observability 시스템 구축을 주도하며, SLI/SLO 기반의 서비스 신뢰성 관리와 장애 대응 프로세스를 운영합니다. 5년 이상의 관련 경력이 필수이며, 프라이빗 클라우드 환경에서의 인프라 운영 경험이 중요합니다. 대규모 트래픽 환경에서의 장애 대응 및 자동화 경험이 있는 분을 찾습니다.
차세대 플랫폼으로 편리함 을 넘어 무한한 가능성을 찾아 진화하고 있는, "커넥트웨이브" 입니다.
커넥트웨이브는 고객과 셀러의 연결성 강화를 위해 다양한 플랫폼을 인수합병(M&A) 하여 성장해 왔습니다. 빅데이터를 기반으로 한 컨슈머 커머스(다나와, 에누리), 쇼핑몰 구축부터 연동, 운영 등 원스톱 서비스가 가능한 셀러 커머스(메이크샵, 플레이오토, 링크프라이스, 스윗트래커), 글로벌 풀필먼트 서비스가 강점인 크로스보더 커머스(몰테일)를 선보이며 일상 속 편리한 토탈 플랫폼으로 거듭나고 있습니다. 플랫폼을 현대적 아키텍처로 업그레이드해 나갈 것 입니다.
Observability 시스템 구축 및 운영
Metrics, Logs, Traces 기반의 관측 파이프라인 설계·구축·운영 (Mimir, Grafana, Loki, Tempo 등)
서비스 토폴로지 및 의존성 기반의 대시보드 설계, 이상 탐지 알림 체계 고도화
관측 데이터의 수집·저장·조회 성능 최적화 및 자원 관리
SLI/SLO 및 신뢰성 관리
서비스별 SLI 정의 (Latency, Availability, Error Rate 등) 및 SLO 목표 수립
Error Budget 기반의 릴리스/변경 의사결정 프레임워크 운영
SLO 달성률 리포팅 및 신뢰성 개선 과제 도출
장애 대응 및 Post-mortem
온콜 체계 설계 및 Incident Response 프로세스 구축·운영
장애 발생 시 신속한 원인 분석(RCA) 및 복구 리드
Post-mortem 작성 및 재발 방지 액션 아이템 추적·관리
Runbook 작성 및 장애 대응 자동화 (자동 복구, 에스컬레이션 등)
개발·운영 프로세스 개선
배포 파이프라인, 롤백 절차 등 운영 페인포인트 발굴 및 자동화
Toil 식별·측정 및 체계적 제거
개발팀과 협업하여 서비스의 운영성(Operability) 개선 제안 및 반영
Kubernetes 환경 운영
프라이빗 클라우드 기반 Kubernetes 클러스터 운영 및 안정성 관리
워크로드 리소스 최적화, HPA/VPA 튜닝, 노드 스케일링 전략 수립
네트워크 정책, 서비스 메시 등 클러스터 인프라 운영
경력: 5년 이상 (DevOps 또는 Site Reliability Engineer 경력)
Kubernetes 운영 경험 5년 이상 및 이에 준하는 능력 (Pod 라이프사이클, 스케줄링, 네트워킹, 스토리지에 대한 실무 수준의 이해)
Prometheus, Grafana, Loki, Tempo 등 Observability 스택 구축·운영 경험
SLI/SLO 정의부터 Error Budget 기반 의사결정까지 end-to-end 경험
Incident Response 프로세스 운영 및 Post-mortem 주도 경험
운영 현장의 반복 작업·비효율을 주도적으로 발굴하고 자동화로 해결한 경험
프라이빗 클라우드 환경에서의 인프라 운영 경험
* 면접은 1회 진행되며, 추가 면접이 진행될 경우, 사전에 안내드리고 있어요.
👉 진행 중인 채용공고 모두보기 👈
👉 커넥트웨이브 복리후생 살펴보기 👈
👉 커넥트웨이브 홈페이지 바로가기 👈