仕事内容
DMM.comのSREとして、国内最大級のエンタメトラフィックを支えるDMM TV・動画のクラウド基盤を牽引します。累計有料会員400万規模のユーザーからの膨大なAPI/Webリクエストを処理する基盤の設計・構築・運用、および既存環境の標準化・リファクタリングを推進。Google Cloud/AWS、Kubernetes、Terraform、Datadog、GitHub Actionsなどを活用し、大規模なユーザートラフィックを支え、サービスの信頼性向上と自動化に取り組みます。
業務内容
- 累計有料会員400万規模のユーザーからの膨大なAPI/Webリクエストを処理する基盤を担当します
- インフラの設計から構築、監視ツール導入、パフォーマンスチューニングまで幅広い取り組みを行います
- 個別管理されていたクラウド環境の標準化や自動化を強力に推進します
- インフラ設計・構築・運用、および既存環境の標準化・リファクタリング(Google Cloud / AWS)を行います
- Kubernetes(GKE)を活用したコンテナオーケストレーション基盤の構築・運用・継続的改善を行います
- モニタリングツール(Datadog等)の導入・監視設定の追加、SLI/SLO運用を行います
- 負荷試験とデータを元にしたパフォーマンスと安定性の改善を行います
- トイル削減のための自動化、そのためのツール開発を行います
- 各種DevOps、CI/CDパイプライン(GitHub Actions / Argo CD)の開発・運用を行います
事業について
- DMM.comの動画配信サービスは、売上高4000億円を超えるDMMグループの中心的なサービスの一つです
- 創業当初から25年以上にわたって収益を支える柱の一つであり、常に進化を続け業界トップの地位を確立しています
- ガラケーからスマホへのシフト、スマートテレビやゲーム機への対応、VR動画の導入など、技術進歩に追従しトレンドを牽引してきました
- SVODを中心とした動画配信サービス「DMM TV」をリリースし、多様化する視聴体験に対応しています
- クライアントアプリケーション、配信システム、Webシステムのほぼ全ては内製で開発されています
- WebAPIは日次で5億リクエスト超、動画の配信基盤はピーク1Tbpsを超える世界有数の大規模サービスです
- エンジニアチームはさまざまな技術スタックを用いて、日々トップレベルの技術力でサービスを支え、事業発展に取り組んでいます
ポジションの魅力
- GKEやCloud Spanner、Cloud Pub/SubなどGoogle Cloudのマネージドサービスをフル活用したインフラ構成です
- さらなるトラフィック増加が見込まれる中で、安定したサービス提供を実現・改善できる環境です
- 2022年12月のリリースから急成長し、約3年で累計有料会員400万人を突破した大規模トラフィックを捌く基盤構築に携われます
- 既存環境の見直しと運用巻き取りが急務であり、インフラを最適な形に作り変え、標準化していくフェーズを経験できます
- 担当領域の決定権はSREチームが強く持ち、技術選定からベンダー折衝、契約まで一貫して裁量を持てます
- システム構成としてモジュラーモノリスを採用しており、SREとバックエンドの垣根を超えてサービス全体を俯瞰した最適化に取り組めます
- クラウド(API/Web側)をメインとしつつ、大規模なオンプレミス環境に触れ、知見を広げるチャンスもあります
- 人海戦術に頼らず、自動化や仕組み化を徹底する少数精鋭での高度な運用実績があります
- リリース以降SREチーム起因での大規模障害は一度も発生させておらず、心理的安全性の高い環境で本質的なエンジニアリングに集中できます
募集の背景
- SREチームは「DMM TV」のクラウド基盤を設計・運用し、インフラの新規設計からリリース、運用安定化などに取り組んできました
- 動画サービス全体では、事業スピード優先のため開発チームがクラウド環境の構築・運用を個別に行っていました
- アプリケーションの増加や規模拡大に伴い、スケーラビリティや信頼性を考慮したメンテナンス継続が困難になりつつあります
- 現在、動画関連の複数クラウド環境の運用・保守をSREチームが専任組織として全面的に巻き取り、標準化や再設計を進めています
- 今後のさらなる開発スピードとシステムの信頼性を両立させるため、次世代の運用基盤を共に構築するメンバーを募集しています
求めるスキル・経験
必須
パブリッククラウド(Google Cloud, AWS, Azure等)上でのインフラ設計・構築・運用経験 AWSMicrosoft AzureGCP
Kubernetesの構築・運用経験 Kubernetes
Terraform等の構成管理ツールを利用したシステム構築・運用経験 Terraform
GitHub Actions, CircleCI等を用いたCI/CDパイプラインの構築経験 CircleCIGitHub Actions
歓迎
大規模環境のインフラリプレイス、または標準化の推進経験 アーキテクチャ刷新経験標準化活動
Argo CDの構築・運用経験 Argo CD
Go言語での開発経験 Go
大規模トラフィックを扱うWebサービスでのSRE運用経験 SRE/信頼性エンジニアリング経験
募集要項
- 職種
- SRE
- 雇用形態
- 正社員
- 想定年収
- 700万〜1500万円
- 勤務地
- 東京都 港区
- 出社・リモート
- 出社
- レベル
- メンバー
- 勤務時間
- フレックスタイム制
- 休日休暇
- 完全週休2日制 / 祝日休み
- 給与の詳細
- みなし残業 月45時間
- 試用期間
- 3ヶ月