仕事内容
大規模マルチモーダル生成モデルの研究開発を推進し、プロダクトへの応用を通じてビジネスインパクトを創出するポジションです。最新の視覚生成モデルに関する深い理解と実践経験を活かし、新たなプロダクト機能の創出につながる応用研究テーマをリードします。東京拠点の国際色豊かなチームで、日本国内最大の計算リソースを活用し、研究成果を実世界アプリケーションに適用できる魅力があります。
職務内容
- 画像およびマルチモーダルの基盤生成モデルにおいて、性能・スケーラビリティ・効率性の向上を推進する。
- プロダクトチームと連携し研究成果を実用的なプロダクトに繋げる。そのために市場の動向を調査し知見を収集。
- トップカンファレンスでの研究成果の発表。グローバルな研究者コミュニティとのつながりを構築。
仕事の魅力
- 大規模マルチモーダル生成モデルの学習と開発プロジェクトに携わることができる。
- 研究成果を実世界のアプリケーションに適用し、ビジネスに測定可能なインパクトをもたらすことができる。
- 東京拠点の多様かつ国際色豊かなチームで連携して研究開発ができる。
- 日本国内最大の計算リソースを使った研究開発ができる。
ミッション
- 新たなプロダクト機能の創出につながる応用研究テーマをリードする。
- 技術的な仮説を定義し、斬新な手法やモデルへの応用を提案し、実験を設計し、プロトタイプのトレーニングパイプラインと評価基準を構築し、プロトタイプとPOC(概念実証)を通じて実現可能性を実証します。
求めるスキル・経験
必須
コンピュータサイエンス、データサイエンス、または関連分野の修士号/博士号を有し、これら分野の基礎原理に強い理解があること。
視覚生成および/またはマルチモーダル生成における研究経験または産業界での実務経験があること。
PyTorch または同等の深層学習フレームワークを用いたモデル学習・ファインチューニングに習熟していること。 機械学習モデル開発経験PyTorch
拡散モデル(diffusion)、Flow Matching、自回帰(AR)など最新の視覚生成モデルに関する深い理解と、これらのモデルの学習/ファインチューニング経験があること。
トップ会議・ジャーナル(CVPR、NeurIPS、TPAMI など)における視覚・マルチモーダル生成分野の第一著者論文。
実社会での応用に向けた実用的な解決策の開発を目的とした産業研究に積極的に取り組みたいと考えていること。
歓迎
生成モデルの(事後)学習またはファインチューニングに関する実践的経験があること。
オープンソースAIプロジェクトへの貢献、または視覚/マルチモーダル生成に関する著名な GitHub プロジェクト経験。
データ収集、クレンジング、前処理に関する機械学習技術の知識。 機械学習モデル開発経験
音声・言語など視覚以外のモダリティデータを扱った経験。
募集要項
- 職種
- リサーチサイエンティスト
- 雇用形態
- 正社員
- 想定年収
- 650万〜1800万円
- 勤務地
- 東京都 港区
- 出社・リモート
- ハイブリッド / リモート可
- レベル
- メンバー
- 勤務時間
- フレックスタイム制 / 実働7.75時間 / 休憩60分
- 休日休暇
- 完全週休2日制 / 祝日休み / 年末年始休暇6日
- 給与の詳細
- みなし残業 月35時間
福利厚生・制度
選考プロセス
- 面接・面談 (原則オンラインで実施)
英語での面接になる可能性がございます。具体的なオンラインの形式などの詳細は、個別に対象となる方にご案内いたします。