SRE条件を変える閉じる
要約求人票をもとにAIがまとめたものです
SREチームの一員として、Mercari、Merpay、Mercoinを含むMercari Groupの本番サービスの信頼性、スケーラビリティ、運用品質の向上を担います。Google CloudやKubernetes上の本番マイクロサービスを運用し、SLO/SLIの定義、インシデント対応、トイル削減、AI Agentを活用した運用高度化などを推進します。
応募資格
必須
- サービスの信頼性に責任を持ち、可用性目標の達成、トイル削減、本番稼働に向けた準備を推進した経験。SLI/SLOを活用し、開発チームと連携しながら信頼性向上の優先順位を判断した経験を含む。
- SLOに基づき、大規模なサービス(10K QPS以上、または複数の本番マイクロサービス)を運用した経験。
- Google CloudなどのクラウドサービスおよびKubernetes上で稼働するワークロードの本番運用経験。
- Infrastructure as Codeの実践やSRE業務向けツールの開発を通じて、運用の効率化・自動化を推進した経験。
- Datadogまたは同等のツールを用いた監視・オブザーバビリティ強化の実務経験。アラート設計や疲労の軽減に取り組んだ経験を含む。
- インシデント対応、ポストモーテム、オンコールまたは運用サポートの当番制を担った経験。
- 信頼性向上に向けた取り組みを、設計から実行、改善まで自律的にリードできる。
- SREの専門領域に閉じず、AIを運用業務に学習・適用していく意欲。
次のいずれか
- 日本語:Independent (CEFR – C1)
- OR 英語:Independent (CEFR – C1)
歓迎
- 複数のサービスまたは事業領域をまたぐ、全社的・横断的なSLOプログラムの設計または運用経験。
- ログ分析、アラート要約、根本原因分析、復旧対応などの運用業務にAIを活用した経験、およびその精度や安全性を評価した経験。
- 大規模なKubernetes基盤の運用経験、または分散システムの内部動作に関する知識・経験。
- 複数チームにまたがる信頼性向上またはプラットフォーム改善の取り組みをリードした経験。
- リスク評価、監査証跡の自動収集、インフラ設定や運用ルールのコード化・自動検証を通じて、本番環境の安全性と信頼性を高めた経験。
使用ツール
募集要項最終確認 9/26
- 職種
- SRE
- 雇用形態
- 雇用形態: 正社員
- 給与
- 記載なし
- 勤務地
- 六本木
- 働き方
- 記載なし
- 勤務時間
- フレックスタイム制(コアタイムなし・フレキシブルタイムなし)
- 選考の流れ
- メルカリグループではメルカリグループおよび各カンパニーのミッションとバリューへの共感・体現を大切にしています。メンバーが発揮する価値の総量が最大化されるような組織づくりを推進するために、候補者のみなさんの経験やスキルをより正しく理解したいと考えています。選考の流れ技術課題:エンジニアポジションではHackerRankまたはGithubでの技術課題を、エンジニア以外のポジションでは採用ポジションによります(面接タイミングと前後することがあります)面接:ポジションにより、複数回の面接をお願いしますリファレンス:オンライン回答形式のもので、最終選考の前後でお願いしますオファー:最終選考とリファレンスの内容より決定されます
- 掲載日
- 2026/07/02 14:34(89日前)
- 最終確認
- 2026/09/26 01:59(3日前)
仕事内容
組織・チームのミッション
Mercari Engineering Principles は、メルカリのエンジニアリング組織における信念や行動の基盤となる共通認識を明文化したもので、メルカリのメンバー全員が共有するMission、Value、Cultureをエンジニアリングの視点から補完するものとなります。これらのPrinciplesは、私たちが長期的に実現しようとする理想的な姿を定義することで、最終的にメルカリのミッションを達成するために活用していきます。
Passion For The Product
Grow Together
Solve Through Mechanisms
Collaborate Openly
SREチームは、Mercari、Merpay、Mercoinを含むMercari Groupの本番サービスにおいて、信頼性、スケーラビリティ、運用品質の向上をリードするチームです。システムやサービス単位だけでなく、お客さまの体験を起点とした信頼性を重視し、CUJ SLOを活用して重要な体験を観測可能にしながら、継続的なサービス改善につなげています。Google CloudやKubernetesをはじめとするクラウドネイティブな基盤上で運用される大規模なシステムに向き合い、インシデント対応の高度化、トイル削減、レジリエントなシステム設計・運用を推進しています。さらに、AIによって開発スピードが加速する中で、ガードレールの整備、AI Agentを活用した調査・対応プロセスの高度化、チーム横断のコラボレーションを通じて、インシデントの未然防止と迅速な復旧を支えています。
業務内容
SLOに基づき、Google Cloud上で稼働する数百規模の本番マイクロサービスを運用し、緊急時のオンコール対応や運用サポートも担う。
信頼性向上に向けた取り組みを、設計、監視、リリース、リリース後の改善まで一貫してリードする。
重要なユーザージャーニーに対するSLI/SLOを定義・運用し、エラーバジェットを活用してプロダクトチームとの優先順位付けを行う。
インシデント対応をリードし、ポストモーテム文化を発展させ、再発防止につながるフォローアップを推進する。
ログ分析、アラート要約、根本原因分析、復旧対応をなどを対象に、明確な安全性を担保したAI Agentを構築する。
TerraformによるInfrastructure as Codeを実践し、大規模なマイクロサービス環境における運用のスケーラビリティ向上やトイル削減のための自動化を実施する。
お客さまの影響に紐づいた監視、アラート、オブザーバビリティを構築・維持し、検知から緩和までの時間を短縮する。
本番環境で稼働するサービスに対して、利用増加や障害発生を見据えたリソース設計、オートスケール、依存先サービスへのレジリエンス強化などを通じて、信頼性と性能を継続的に改善する。
プロダクトチームおよびプラットフォームチームと連携し、新機能や新規サービスを安全に本番投入するための準備、運用設計、新しいプラットフォーム整備を推進する。
リスク評価、監査対応、運用ルールのコード化・自動検証を通じて、安全で信頼性の高い本番環境を継続的に維持・改善する。
ユニークなチャレンジ
MarketplaceとFintechを含むMercari Groupの幅広い事業領域において、CUJ SLOを通じてお客さまへの影響を可視化し、プロダクト判断や運用方針に反映しながら、信頼性向上に取り組みます。
AIによって開発スピードが加速する中で、エンジニアとAI Agentが協働する新しい運用のあり方をつくり、これからのSRE文化を形づくります。
信頼性とレジリエンスの重要性が組織全体で理解されている環境で、プロダクトチームやプラットフォームチームと連携し、データに基づく改善を継続的に進められます。
運用サポート、問い合わせ対応、インシデント対応などの日々の運用業務と、信頼性向上に向けた中長期のプロジェクト推進の両方に取り組みます。
チーム内外で日本語と英語を日常的に使う環境で働きます。
この求人は株式会社メルカリの採用ページの掲載内容をもとに構成しています。応募条件の最新情報は募集元をご確認ください。
募集元の採用ページから応募できます
応募は株式会社メルカリの採用ページで受け付けています。このページは採用ページの掲載内容をもとに構成しているため、最新の応募条件は募集元でご確認ください。
この求人と近い条件で探す数字はリンク先ページの掲載件数
この職種で探す
- SRE233
- テック17,448
- インフラエンジニア1,249
- セキュリティエンジニア958
- クラウドエンジニア617
働き方・年収で探す
この職種を募集する企業
- 株式会社メルカリ136
- 株式会社Lagomliv1,642
- フロンティア株式会社982
- 株式会社アインホールディングス944
- 株式会社スターシステム868