その他職種条件を変える閉じる
HPCクラスタエンジニア(さくらONE)
給与
700〜1600万円/年※ 募集要項に記載のレンジ。実額は選考で決まります
- 勤務地
- フルリモート(国内)
- 雇用形態
- 正社員
- 働き方
- 国内フルリモート可
- 年間休日
- 非公開
リモート可
仕事内容その他職種
GPUベースのマネージドスパコン「さくらONE」の構築・運用を担い、HPCクラスタの安定稼働や性能最適化、ユーザー支援を行うポジションです。クラスタ運用からソフトウェアスタック、通信最適化、テレメトリ分析まで幅広く携わります。研究者・エンジニアの計算課題に寄り添い、HPC/AI基盤の高度化をリードします。
業務内容
- さくらインターネットの研究所プロダクトである、GPUベースのマネージドスパコン「さくらONE」の構築・運用をリードし、その安定稼働とユーザの研究・開発活動を支えるポジションです。
- 高火力PHY(ベアメタルサーバー)上に構築されたHPC環境において、クラスタ運用、ミドルウェア整備、パフォーマンス最適化、ユーザー支援まで幅広く担当いただきます。
- ユーザの計算課題に対して技術的に寄り添い、計算効率の最大化や課題解決を実現する「フロントラインエンジニア」としての役割を期待しています。
- テレメトリデータの分析などを通じて、次世代基盤の高度化や自動化にも関与いただきます。
具体的には
- エンジニアとしてさくらONEプロダクトにオーナーシップを持ち、計算資源から生み出される価値を様々な観点から最大化し、事業に貢献いただきます。
- HPCクラスタの運用管理(Slurm等によるジョブ制御、リソース最適化)
- GPUノード/ストレージ(Lustre等)/高速ネットワークの監視・障害対応
- コンパイラ、MPI、CUDA等のソフトウェアスタックの構築・運用
- さくらONEと高火力PHY間の環境連携・コンバート対応
- ユーザの計算課題に対する技術支援・パフォーマンスチューニング
- NCCL/UCX等の通信最適化やジョブ実行時のパラメータ設計
- テレメトリデータ分析による性能改善・運用自動化・障害予兆検知の検討
期待する将来像
- HPC/AI基盤の中核エンジニアとして、運用・改善・高度化をリードする存在
魅力です!
- 国内でも希少なGPUスパコン運用に携われる環境
- インフラ・ミドルウェア・アプリケーションを横断した高度な技術領域に関われる
- 研究者・エンジニアとの直接的な技術対話を通じた価値創出
- 実運用を通じてHPC/AI分野の深い専門性を身につけられる
募集要項最終確認 9/13
- 雇用形態
- 正社員
- 想定年収
- 700〜1600万円/年
- 勤務地
- フルリモート(国内)
- 働き方
- 国内フルリモート可
- 年間休日
- 非公開
- 職種
- その他職種
- 経験年数
- 不問
- 掲載日
- 9/9
- 最終確認
- 9/13
応募資格(必須)
- Linuxベースのクラスタの構築運用経験
- C/C++、Go、Python、Rust、Bash/Shell 等を用いたシステムプログラミング能力、OSS利用経験、およびGit/GitHubを使用した開発経験
歓迎する経験
- 大規模機械学習または推論クラスタにおける実務経験
- MPI / OpenMP等を用いた並列計算の知識または実務経験
- NVIDIA GPU / CUDA環境の利用・運用経験
- Slurm / PBS / Lustre等のHPCミドルウェアの運用経験
- Docker / Apptainer(Singularity)等のコンテナ技術の利用経験
- HPC環境におけるパフォーマンスチューニング経験(Nsight, gprof等)
求めるスキル・経験
この求人はさくらインターネット株式会社の採用ページの掲載内容をもとに構成しています。応募条件の最新情報は募集元をご確認ください。
募集元の採用ページから応募できます
応募はさくらインターネット株式会社の採用ページで受け付けています。このページは採用ページの掲載内容をもとに構成しているため、最新の応募条件は募集元でご確認ください。