仕事内容
国産LLM『Sarashina』のLLM Inference Engineerとして、高スループット/低レイテンシなAIモデルサービング環境の構築とチームの開発プロセス設計管理を担当します。モデルのポテンシャルを最大化し、極限まで磨き抜かれたパフォーマンスとスケーラビリティの実現を使命とします。海外ベンダーにも引けを取らない計算基盤を活用し、プロダクトに必要な技術領域を問わず挑戦できる環境です。
職務内容
- 高スループット/低レイテンシなAIモデルサービング環境の構築
- チームの開発プロセスの設計管理や生産性向上のための各種活動
この仕事の魅力
- 海外ベンダにも引けを取らない計算基盤を使って正面から戦えること
- ユーザに対して価値のあるプロダクトを自ら考え提案し開発までを一貫して行うことができること
- プロダクトに必要なことであれば技術領域を問わず何でもできる環境があること
ミッション
- 国産LLM『Sarashina』を通じて圧倒的なユーザー体験を創出し、AIジャイアントと戦い、勝ち抜く
- モデルとユーザー体験の間に横たわるあらゆる課題を技術的創意で乗り越える
- 極限まで磨き抜かれたパフォーマンスとスケーラビリティの実現を使命とする
- モデルのポテンシャルを最大化するためのプロダクトの理想を掲げ、技術的挑戦を厭わず、成果に誇りを持つプロフェッショナル集団を目指す
求める人物像
- 当社事業内容、ミッションに共感し、新たな事業への挑戦姿勢・意欲を持った方
求めるスキル・経験
歓迎
オンプレまたはクラウドの GPU クラスタ上で稼働するシステムの設計・開発経験 GPU/HPC基盤
複数データセンタ (マルチリージョン) に跨る高可用システムの設計・開発・運用経験 分散システム
オンプレでの分散データベースや検索エンジンの開発・運用経験 分散システム
機械学習モデルオンラインサービング基盤の設計・開発経験 ML Ops経験
機械学習モデル推論ワークロードの高速化に関する研究開発経験 機械学習モデル開発経験
LLM 推論フレームワーク (vLLM, SGLang, TensroRT-LLM 等) を用いたシステムの運用経験 ML Ops経験
分散処理基盤のモニタリングやオブザーバビリティに関するシステムの設計開発経験 可観測性
エンタープライズ向け API サービスにおけるセキュリティ・ガバナンス設計経験 エンタープライズアーキテクチャ
実装フェーズに手を動かすことを厭わず、詳細設計からレビューまで自らドライブできる能力
OSSへの貢献、論文執筆、技術コミュニティでの活動経験 OSSコントリビューション
募集要項
- 職種
- AIエンジニア
- 雇用形態
- 正社員
- 想定年収
- 650万〜1800万円
- 勤務地
- 東京都 港区
- 出社・リモート
- ハイブリッド / リモート可
- 必要経験
- 5年以上
- レベル
- メンバー
- 勤務時間
- フレックスタイム制 / 休憩60分
- 休日休暇
- 完全週休2日制 / 祝日休み / 年末年始休暇6日
- 給与の詳細
- みなし残業 月35時間
福利厚生・制度
選考プロセス
- 面接・面談
具体的なオンラインの形式などの詳細は、個別に対象となる方にご案内いたします。