직무 설명
직무 제목: 시니어 클라우드 인프라 및 SRE 엔지니어
주요 책임:
- 핵심 트레이딩 시스템(트레이딩 워크플로우, 마켓 데이터 서비스 및 관련 인프라 포함)의 24/7 운영 안정성 보장. 주요 장애 대응에 참여하여 문제 해결, 위험 완화, 서비스 복구 및 사후 분석을 수행하여 트레이딩 연속성과 사용자 자산 보안을 보장합니다.
- AWS/EKS/Kubernetes 프로덕션 인프라 설계 및 최적화(클라우드 아키텍처, 네트워킹, 고가용성, 용량 계획, 재해 복구, 클러스터 업그레이드, 노드 생명주기 관리, 스케줄링/자원 할당, Ingress/LB, DNS, 스토리지, 오토스케일링 포함). 안정성, 보안, 운영성 관점에서 아키텍처 설계에 기여하면서 클라우드 비용 효율성을 지속적으로 개선합니다.
- 관측 가능성 및 안정성 프레임워크(Metrics/Logs/Tracing/Alerting/SLI-SLO/Incident Response/Postmortem) 구축 및 강화하여 문제 탐지, 진단 및 해결 속도 향상. R&D 팀과 협력하여 시스템적 병목 현상, SPOF 및 아키텍처 안정성 문제 해결.
- IaC/CI-CD/자동화(Terraform/Terragrunt/GitHub Actions/Ansible) 추진으로 인프라/앱 배포 프로세스 표준화. 엄격한 검토, 배포, 검증 및 롤백 메커니즘을 통한 변경 관리 개선.
- 핵심 데이터 서비스(MySQL/Redis/Kafka) 운영 관리(고가용성, 모니터링, 용량 계획, 백업/복구, 성능 튜닝, 장애 처리 포함).
- AWS/K8s 보안 거버넌스 구현(최소 권한 액세스(IAM/RBAC), 네트워크 분할, 컨테이너/이미지 보안, 시크릿 관리(KMS), 취약점 수정, 보안 감사 포함). 팀 간 보안 사고 대응 조정.
자격 요건
- 컴퓨터 공학 또는 관련 분야 학사 학위 및 DevOps/SRE/클라우드 인프라 분야 5년 이상 경력. 대규모 프로덕션 운영, 변경 관리 및 복잡한 문제 해결 경험 보유. 강력한 아키텍처 설계 및 구현 능력과 위험 인식, 팀 간 협업 능력.
- Linux, 네트워킹 및 컨테이너 기술에 대한 탄탄한 기초. Kubernetes/EKS 실무 전문성(클러스터 배포/업그레이드/튜닝 및 다계층 문제 해결(Pod/Node/Network) 포함). Java/Go 애플리케이션 환경에 익숙함.
- AWS 핵심 서비스(IAM/VPC/EC2/EKS/ALB/Route53/S3/CloudWatch) 프로덕션 경험. 다중 AZ, 고가용성, 네트워크 격리, 최소 권한, 오토스케일링, 용량 계획 및 비용 최적화 원리 이해.
- Terraform/GitHub Actions/Ansible을 활용한 강력한 IaC/CI-CD/자동화 기술. 인프라/앱 배포 신뢰성 향상을 위한 스크립팅(Bash/Python) 능숙.
- Prometheus/Grafana/ELK/OpenTelemetry를 통한 관측 가능성/안정성 전문성. Metrics/Logs/Tracing/SLI-SLO/알러팅/용량 계획/재해 복구 메커니즘 지식.
- MySQL/Redis/Kafka 운영 경험 및 보안 실무(IAM/RBAC/네트워크/컨테이너/호스트 보안/KMS/취약점 관리/감사).
- Web3/크립토 프로덕션 경험 우대, 블록체인 기초 및 디지털 자산 트레이딩 위험 이해.
우대 자격:
- 디지털 자산 거래소, 증권, 금융 트레이딩 또는 고가용성 결제 시스템 경험.
- 대규모/고트래픽 Kubernetes/EKS 환경, AWS 다중 계정 거버넌스 또는 크로스 리전 재해 복구 전문성.
- 고급 클라우드 네이티브/보안/비용 최적화 기술(Karpenter/ArgoCD/OpenTelemetry/eBPF/FinOps).
혜택
- 매우 경쟁력 있는 보상 패키지
- 싱가포르 취업 비자 스폰서십
- 다양하고 포용적인 문화의 수평적 조직 구조
- 훌륭한 워라밸을 위한 충분한 유급 휴가/병가
직접 지원: https://davionlabs.bamboohr.com/careers/75?source=aWQ9MzM%3D