転職AIログインマイページ求人へ
機械学習エンジニア条件を変える閉じる

こだわり
条件をクリア

Software Engineer - LLM Inference Optimization / 大規模言語モデル 推論基盤エンジニア

株式会社Preferred Networks

テック 東京都千代田区 企業サイト 掲載 7/1

給与

記載なし※ 募集要項に金額の記載がありません

勤務地
東京都千代田区
雇用形態
正社員
働き方
ハイブリッド勤務

在宅勤務あり

年間休日
記載なし

要約求人票をもとにAIがまとめたものです

推論最適化チームで、自社開発LLMを実運用環境の品質・速度・コスト要件に合わせて最適化し、PFNのプロダクトやソリューション事業の拡大を技術面から支援します。LLM推論性能の向上、推論エンジンの開発、LLMのカスタマイズ・デプロイ支援、OSSコミュニティ活動を担当します。

応募資格

必須

  • コンピュータサイエンスの知識や関心
  • コンピューターサイエンスのすべての分野への精通を目指し、常に最先端の技術を追いかけ続けていること
  • Pythonを使ったソフトウェア開発経験
  • コンピューターアーキテクチャーを理解し、ソフトウェアの実効効率や、計算量を意識したプログラムの作成が出来ること
  • 商用環境・オンプレミス環境など、品質要件の高いソフトウェアの開発経験
  • LLM推論フレームワークの利用経験
  • LLM推論最適化に関する各種技術に対する理解
  • LLM推論に関連する最先端の技術動向を主体的にキャッチアップし、専門性を深める意欲
  • CUDAアプリケーションの実装・性能改善・デバッグの経験
  • チーム内外のメンバーと協働しながら課題解決ができること
  • 既存フレームワークのコードや英語のドキュメントが抵抗なく読めること

歓迎

  • LLM推論エンジンのコア技術(演算のスケジュール制御やKV cacheの管理機構など)の開発経験
  • 商用環境や実際のユースケースにおけるLLM推論の性能測定・最適化の経験
  • LLM推論に関連するOSSや、データサイエンス関連のOSSへのコントリビューション経験
  • C++またはRustでのソフトウェア開発経験
  • GPUクラスタ(Kubernetes等)の利用経験
  • MLの学習・評価を行うワークフローフレームワーク(Argo, MLFlow等)の利用経験
  • ビジネスレベルの英語・日本語コミュニケーション能力

募集要項最終確認 9/26

職種
機械学習エンジニア
雇用形態
正社員(試用期間3ヶ月、本採用と同条件)
給与
記載なし
給与の詳細
経験、業績、能力、貢献に応じて、当社規定により優遇年2回の人事評価及び会社業績に基づいて決定
手当
通勤手当在宅勤務手当
勤務地
東京都千代田区大手町1−6−1 大手町ビル
働き方
ハイブリッド勤務(オフィス出社と在宅勤務を組み合わせての勤務)
勤務時間
専門労働型裁量労働制(みなし労働時間:8時間)もしくはフレックス制
休日・休暇
土曜日日曜日国民の祝日国民の休日年末年始当社規定による年次有給休暇制度(入社時26日付与)育児休暇慶弔休暇など
福利厚生
確定拠出年金制度ラップトップPC購入補助定期健康診断実施
社会保険
社会保険完備(厚生年金保険、健康保険、雇用保険、労災保険)
掲載日
2026/07/01 09:44(90日前)
最終確認
2026/09/26 01:16(3日前)

仕事内容

Job Description

Preferred Networks (PFN) では、大規模言語モデル (LLM) を中心としたマルチモーダルな基盤モデルの開発を進めています。

推論最適化チームのミッションは、最先端のモデルと現実世界のプロダクトを結ぶ「架け橋」となることです。

自社開発のLLMのポテンシャルを極限まで引き出し、実運用環境で求められる厳しい品質・速度・コスト要件を満たす形で最適化し提供することを通じて、PFNのプロダクトやソリューション事業の拡大を技術の出口から支援します。

LLMモデルの推論性能向上: 量子化・推論エンジンの改善・パフォーマンスチューニングなどを通じて、モデルの出力品質を担保しながら、ターゲット環境におけるスループットの向上やレイテンシ/メモリ使用量の削減を行う。

LLM推論エンジンの開発: SaaS環境やオンプレミス環境でのサービングに必要となる推論エンジンと、その周辺機能の開発およびインテグレーションを行う。

LLMのカスタマイズ・デプロイの支援: 案件ごとのニーズに応じてLLMモデルのカスタマイズを行うためのワークフローや、デプロイのパイプラインを整備する。

OSSコミュニティ活動: vLLMをはじめとするLLM推論エンジンのエコシステムで、新機能の実装・バグフィックスのアップストリーム対応を行う。また、必要に応じて、関連イベントへの登壇や情報発信を行う。

入社後に実際に担当いただく業務内容は、専門・ご経験を考慮のうえ決定します。

この求人は株式会社Preferred Networksの採用ページの掲載内容をもとに構成しています。応募条件の最新情報は募集元をご確認ください。

東京都の機械学習エンジニアの求人156件

東京都の機械学習エンジニアの求人をすべて見る(156件)

募集元の採用ページから応募できます

応募は株式会社Preferred Networksの採用ページで受け付けています。このページは採用ページの掲載内容をもとに構成しているため、最新の応募条件は募集元でご確認ください。

募集元の採用ページを開く

この求人と近い条件で探す数字はリンク先ページの掲載件数

相談募集元で応募する採用ページへ

AI相談