転職AI
AIに相談
AIに相談
株式会社Preferred Networks
募集中 1日前に確認

Reinforcement Learning Researcher

リサーチサイエンティスト ハイブリッド 正社員 メンバー
想定年収
応相談
勤務地
東京都 千代田区
リモート
リモート可

仕事内容

Preferred Networks(PFN)は「現実世界を計算可能にし、共に未来を創り出す」というミッションのもと、AI技術の垂直統合と社会実装を推進しています。本ポジションでは、強化学習の高い専門性を活かし、防衛・安全保障分野の各種課題に対して、技術選定から実装、評価まで強化学習に関する取り組みをリードしていただきます。

Job Description / 職務内容

  • 強化学習に関する研究開発のリード・マネジメントを担当する。
  • 高い専門性を活かし、技術選定、アルゴリズム設計、実装方針策定を行う。
  • 防衛・安全保障分野における各種課題を整理し、強化学習による解決に適した問題定式化を行う。
  • シミュレーション環境の設計・実装、大規模実験の設計・実行・結果分析を行う。
  • リアリティギャップへの対処、制約条件や安全性を考慮した強化学習アルゴリズムの設計、実装および評価を行う。
  • 学習済み方策の安定性・頑健性・汎化性能に関する検証および改善を行う。
  • 社内計算基盤等を活用した学習・評価パイプラインの整備(再現性、実験管理、評価指標の体系化等)を行う。
  • 防衛・安全保障分野における技術戦略立案に貢献する。
  • 社内外関係者(官公庁・関連企業等)との協働による価値創出を推進する。

事業・プロダクト

  • Preferred Networks(PFN)は、AI半導体・計算基盤・生成AI基盤モデル・ソリューション/プロダクトといったAI技術のバリューチェーンを自社内で垂直統合している。
  • 防衛・安全保障分野においては、官公庁・公共機関やその関連組織、パートナー企業等と連携しながらAI技術の応用に取り組んでいる。

求めるスキル・経験

必須
強化学習に関する深い専門性(関連する分野での博士号、またはそれに相当する研究業績)
Python等を用いた機械学習/深層学習の研究開発経験 機械学習モデル開発経験Python
防衛・安全保障領域におけるAI活用への興味関心 防衛・宇宙業界知識
社内外の多様な関係者と協働し、論点整理・合意形成・実行推進ができるコミュニケーション力 コミュニケーション能力
ビジネスレベルの日本語能力(日本語非母語話者においては JLPT 試験で N1 レベル相当) ビジネス日本語
歓迎
ソフトウェアの開発経験
リードエンジニアとして開発プロジェクトを牽引した経験 チームリード経験
OSSへのコントリビューション経験 OSSコントリビューション
CI/CDの構築経験 CI/CD
プログラミング能力が秀でていることが証明できること
大規模分散強化学習、マルチエージェント強化学習、部分観測下の意思決定などの大規模かつ実践的な強化学習に関する知識・経験 分散システムマルチエージェント設計
プロジェクト推進・リーダーシップ経験 リーダーシップ
複数名のチームのリード・マネジメント経験 チームリード経験
外部顧客等と共同したプロジェクトの推進経験 プロジェクトマネジメント経験
研究成果の対外発信(論文、学会発表、特許、OSS)または産業応用での成果 OSSコントリビューション
防衛・安全保障分野に関する専門的知識・経験または実績 防衛・宇宙業界知識
官公庁・自衛隊・防衛関連産業等での勤務・在籍経験 公共・官公庁業界知識
防衛省、防衛装備庁主催の各種コンテストへの参加経験 防衛・宇宙業界知識
航空工学、制御工学、ロボティクスに関する専門知識・経験または実績 ロボティクス領域

募集要項

雇用形態
正社員
想定年収
応相談
勤務地
東京都 千代田区
出社・リモート
ハイブリッド / リモート可
レベル
メンバー
勤務時間
裁量労働制 / 実働8時間
休日休暇
完全週休2日制 / 祝日休み
給与の詳細
賞与 年2回
試用期間
3ヶ月
掲載日
2026/7/27
情報の最終確認日
2026/7/26

福利厚生・制度

企業情報

株式会社Preferred Networksの求人をすべて見る →