職務内容
職位名: シニアクラウドインフラストラクチャ&SREエンジニア
主な責任:
- コアトレーディングシステム(取引リンク、マーケットデータサービス及び関連インフラ)の24/7稼働安定性を確保。重大インシデント対応(トラブルシューティング、リスク軽減、サービス復旧、事後分析)に参加し、取引継続性とユーザー資産保護を保証
- AWS/EKS/Kubernetes本番環境インフラ(クラウドアーキテクチャ、ネットワーク、高可用性、容量計画、災害復旧、クラスターアップグレード、ノードライフサイクル管理、スケジューリング/リソース割当、Ingress/LB、DNS、ストレージ、自動スケーリング)の設計・最適化。安定性・セキュリティ・運用性の観点からアーキテクチャ設計に貢献しつつ、クラウドリソース効率とコスト効果を継続的に改善
- 可観測性・安定性システム(メトリクス、ログ、トレーシング、アラート、SLI/SLO、インシデント対応、事後分析)の構築・強化による問題検知・診断・解決の加速。R&Dチームと連携し、システム的ボトルネック、単一障害点、長期的なアーキテクチャ安定性課題に対処
- IaC・CI/CD・自動化(Terraform/Terragrunt、GitHub Actions、Ansible)の推進によるインフラ・アプリケーション提供の標準化。変更管理プロセス(レビュー・デプロイ・検証・ロールバック)の改善で本番リスクを最小化
- コアデータ/ミドルウェアサービス(MySQL、Redis、Kafka)の本番運用管理(高可用性、監視、容量計画、バックアップ/復旧、パフォーマンスチューニング、インシデント対応)
- AWS/Kubernetesセキュリティガバナンス(最小権限アクセス(IAM/RBAC)、ネットワーク分離、コンテナ/イメージセキュリティ、シークレット管理(Secrets/KMS)、脆弱性管理、セキュリティ監査)の実施。関連チームと連携したセキュリティインシデント対応
求めるスキル
- コンピュータサイエンスまたは関連分野の学士号+DevOps/SRE/クラウドインフラ職5年以上の実務経験。大規模本番運用・変更管理・複雑なトラブルシューティングの実績。リスク意識とチーム横断連携能力を備えた強固なインフラ設計/実装スキル
- Linux・ネットワーク・コンテナ技術の確かな基礎。Kubernetes/EKSの実務経験(クラスター展開・アップグレード・チューニング・pod/node/ネットワークレベルのトラブルシューティング)。Java/Goアプリケーション環境の理解と基本的なデバッグ能力
- AWS本番環境経験(IAM、VPC、EC2、EKS、ALB/NLB、Route53、S3、CloudWatch)。マルチAZ・高可用性・ネットワーク分離・最小権限・自動スケーリング・容量計画・コスト最適化の原則理解
- Terraform/Terragrunt、GitHub Actions、Ansibleを用いたIaC/CI/CD/自動化スキル。Bash/Pythonスクリプティングによるインフラ/アプリ提供信頼性向上の実績
- Prometheus、Grafana、ELK/Loki、OpenTelemetryを用いた可観測性/安定性の専門知識。メトリクス/ログ/トレーシング、SLI/SLO、アラート管理、容量計画、災害復旧メカニズムの深い理解
- MySQL/Redis/Kafkaの本番運用経験。IAM/RBAC、ネットワーク/ホスト/コンテナセキュリティ、シークレット管理、脆弱性対応、セキュリティ監査を含むセキュリティ運用/DevSecOps知識
- Web3/暗号資産業界経験があれば尚可(ブロックチェーン基礎理解とデジタル資産取引システムの安定性/セキュリティリスク対応能力)
歓迎要件:
- デジタル資産取引所・証券・金融取引・決済システムにおける高可用性要件のある環境での経験
- 大規模/高トラフィックKubernetes/EKS環境、AWSマルチアカウントガバナンス、クロスリージョン災害復旧、またはDR訓練の経験
- 高度なクラウドネイティブ/セキュリティ/コスト最適化専門知識(Karpenter、ArgoCD/Flux、OpenTelemetry、eBPF、FinOps)
福利厚生
- 業界トップクラスの報酬パッケージ
- シンガポール就労ビザスポンサーシップ
- フラットな組織構造と多様性・包括性を重視したカルチャー
- 充実した年次/医療休暇、週休2日制、優れた労働環境
直接応募: https://davionlabs.bamboohr.com/careers/75?source=aWQ9MzM%3D