仕事内容
セーフィーはクラウド映像プラットフォームを基盤に、30万台以上のカメラが接続する国内最大級の映像配信プラットフォームを展開しています。本ポジションは、巨大なクラウド基盤の運用保守・改善を担い、技術面から事業成長を支えるインフラ・SREエンジニアです。2,000台以上のサーバーと数十ペタバイトのデータを扱う大規模環境で、高可用性インフラの構築・運用、コスト最適化、次世代技術導入に挑戦できます。リーダー候補として、チームメンバーの育成や開発プロジェクトの推進も担当し、技術力とマネジメントの両面で事業貢献が期待されます。
業務について
- 100万台規模のクライアントが接続するクラウド録画サービスを安定して提供できるアーキテクチャの構築・運用
- サーバーコストを抑えるための各種最適化
- サービス・システムの監視やチューニング等の運用
- 2,000台以上のサーバーを無停止で常時稼働させるための、高可用性が要求されるクラウドインフラの構築・安定運営
- 技術負債の解消とプラットフォーム全体の最適化
- サーバー台数増加に伴うトイルの増加やメンテナンス工数増加への対応と削減
- 次世代技術の導入と新領域への挑戦
- トランザクションの増加に伴うDBレイヤーの複雑性解消を目的とした、データベース技術の検証・導入
- 動画データ録画配信サービスとしての更なる強化
- 競争力のある画質・レイテンシー・プライシングの実現
- AIOps等技術を有効活用した次世代型クラウドインフラ運営へのチャレンジ
- 他組織への先進的インフラ技術の提供およびイネーブリング
インフラグループについて
- セーフィーのプラットフォームや各種プロダクトのシステムは、主にAWS上で構築されている
- サーバー台数は2,000台以上とかなりの規模に及び、日本国内のインターネット上り帯域の約3%を占めるトラフィックが走る
- インフラグループの最も重要なミッションは、巨大なクラウドプラットフォームのインフラ環境の構築、管理・運用
- 日々、大規模なサーバー群はもちろんのこと、AWS環境全般の安定稼働を支えている
- サーバーサイドグループが多く、社外では業務に用いる技術ツール関連の担当者と関わる
- 役職や経験に関わらず、技術的な議論やプロダクト改善の提案を歓迎するフラットな雰囲気
- 設計や実装方針の相談はデイリーミーティング等を活用して行われている
- 新しいアイデアや技術的探求・チャレンジを歓迎しており、戦略的にリソースを投資
- 日々の振り返りの中で、KPTだけでなく、思いついたアイデアなどを共有するオープンな文化が根付いている
開発環境
- 開発言語:Python、ShellScript
- インフラ:AWS
- データベース:MySQL、Redis、PostgreSQL、TiDB (検証中)
- 構成管理ツール:Terraform、Ansible、Packer
- 監視:Prometheus、Grafana、PagerDuty、StatusCake、Sentry、Datadog
- CI/CD:GitHub Actions
- その他:GitHub、Docker、Fluent Bit、Redash
- 生成AIツール:Amazon Bedrock/Gemini/GitHub Copilot/Notion AI/Claude Code
- 現在30万台を超えるデバイスが接続しており、2025年末以降、保存している映像データは数十ペタバイトを超える大規模システム
- 扱う情報の機密性も高く、運用も無停止で行う必要があり、開発する上で考慮するポイントが多い
- カメラ (IoT) や映像解析 (AI) を扱っているため、サーバーとアプリ以外にも組み込みエンジニアや機械学習のエンジニアがいる
- サーバーチームはそれらをつなぐ仕組みを開発しているので、様々な情報に触れることができ、自身の知見を広めることができる
- 「土台創り」という、自ら環境をつくっていく貴重な経験ができるプラットフォーム開発に携われる
業務について
- 数秒のダウンも許されないシビアな環境下で、可用性向上に向けたトライ&エラーを繰り返し、負荷分散やパフォーマンス改善といった高度なメンテナンス技術を追求できる
- 基盤の安定稼働から新サービスの実装まで領域は幅広く、映像プラットフォームを構成する広範な技術スタックを習熟できる
- 「映像」という汎用的なデータを扱っており、単純な防犯用途を超えた、様々な技術やアプリケーションとの連携による幅広いサービス展開が可能
- 大手企業や地方自治体との協業により、実世界との紐付きが強く社会貢献性の高い、かつダイナミックな案件に携わることができる
- 膨大なデータを扱う特性上、インフラの改善・最適化がクラウドコストの削減、ひいては事業・プロダクトの利益/成長にダイレクトに直結するため、エンジニアとしての技術的な改善活動が経営レベルで高く評価される
- 事業・プロダクトの拡大に応じて、事業成長を技術面から支えるアプリケーションSREのような役割や、組織横断的にガバナンスを担うコアSREなど、専門性を活かせる柔軟なステップアップを設けることで、キャリアを形成しやすい
- エンジニア職専用の、シニアエンジニアとリーダー、それぞれのキャリアに合わせた並列の基準を持っており、その職能自体でのパフォーマンス・活躍によって正当に評価される
リーダー候補について
- リーダーは業務内容にマネジメント要素を含んでおり、メンバーの育成や開発プロジェクトのマネジメントなども担う
- 5名〜6名程のチームメンバーの育成‧教育
- 100万台規模のクライアントが接続するクラウド録画サービスを安定して提供できるアーキテクチャの設計‧開発の推進
- クラウドコストを抑えるための各種最適化の推進
- サービス‧システムの監視やチューニング等の運⽤の推進
- 組織目標に向かって継続的に活動することでメンバーを鼓舞し組織力を高めていく役割の実践
- 組織的なプラクティスやプロセスの改善提案と実践、他グループとの共有
- リーダーとなっても一定の開発・プレイング業務は含まれる
求めるスキル・経験
必須
歓迎
自社プロダクト‧サービスを有する事業会社メーカーでの就業経験
運用保守‧障害対応の経験 サーバ運用・保守経験
Production側コード本体にも手を加えるSRE活動の経験 SRE/信頼性エンジニアリング経験
関連スキル
必須
募集要項
- 職種
- SRE
- 雇用形態
- 正社員
- 想定年収
- 応相談
- 勤務地
- 東京都 品川区
- 出社・リモート
- ハイブリッド / リモート可
- 必要経験
- 5年以上
- レベル
- リーダー
- 勤務時間
- 裁量労働制 / 実働8時間
- 休日休暇
- 完全週休2日制 / 祝日休み
福利厚生・制度
選考プロセス
- 書類選考
- カジュアル面談 (場合により) (職種やご希望により実施/オンライン)
- 一次面接 (オンライン)
- 二次面接 (オンライン)
- 三次面接(最終/対面)
- Web適性診断
- コーディングテスト (場合により) (エンジニア職の場合)
- 内定(オファー面談実施有)
一部職種により選考フロー変更や回数増減の可能性あり