仕事内容
DMM.comの大規模エンタメサービスを支える、最先端の音声合成(TTS)モデルの開発・推論最適化をリードする高度AI人材を募集します。TTSモデルのFine-tuning・推論最適化からサービス統合まで一気通貫で推進し、日本最大級のエンタメプラットフォームで世界に通用する音声AIを創り上げる挑戦的なポジションです。DMM独自のデータ・ドメインに特化した音声生成技術の研究開発・サービス化をリードし、AIアバターや対話型キャラクターといった新たなユーザー体験の創出を目指します。
業務内容
- TTSモデル(Qwen-TTS、Orpheus等)のFine-tuning・話者/感情制御の実装を推進します
- GPU上での推論効率化(バッチング、KV cache、量子化、同時実行数チューニング)を担当します
- 音素タイムライン生成のTTSパイプラインへの統合(アバターのリップシンク等への応用)を行います
- 推論基盤の構築・運用、レイテンシ(TTFS)とサービス品質の管理を担当します
募集の背景
- DMM独自のデータ・ドメインに特化した音声生成(TTS)技術の研究開発・サービス化をリードする高度AI人材を募集しています
- 高品質な音声合成を組み合わせることで、AIアバターや対話型キャラクターといった新たなユーザー体験の創出を目指しています
- TTSモデルのコア技術を熟知し、オープンモデルをDMMのデータでFine-tuningでき、かつ推論を効率化できる音声AIエンジニアを求めています
事業について
- 新規事業の創出と成長を技術面から推進する開発本部です
- サービスの企画・設計から開発、リリースまで一貫して関わることができます
- MVP開発のような小〜中規模プロジェクトから、複数部署が連携する大規模プロジェクトまで、幅広い開発案件を手がけています
求めるスキル・経験
必須
TTSモデル(Qwen-TTS、Orpheus、VITS、Fish-Speech等)のFine-tuning・追加学習の実務経験
話者適応・感情/プロソディ制御・多言語対応などのカスタマイズ経験 自然言語処理
音声データセットの構築・前処理パイプライン(音声/テキストアライメント等)の開発経験 ETL/ELTパイプライン経験
PyTorchでのモデル学習、LoRA等の効率的Fine-tuning手法の実装経験 PyTorch
GPU上での推論最適化(バッチング、KV cache管理、量子化、ストリーミング生成)の実務経験 パフォーマンス最適化経験
推論基盤(vLLM、TensorRT-LLM、SGLang等)の選定・導入・最適化経験
同時実行数(concurrency)のチューニング、レイテンシ(TTFS等)改善の実務経験 パフォーマンス最適化経験
CUDA最適化、メモリ効率化に関する深い理解 パフォーマンス最適化経験
推論サービスのレプリカ構成、オートスケーリング、監視・可観測性基盤の構築経験 分散システムKubernetes可観測性
歓迎
音素タイムライン(phoneme timestamp)生成をTTSに統合した経験 自然言語処理
リアルタイム音声対話・AIアバターのリップシンク等の開発経験
日本語能力検定1級 日本語能力試験 N1
英語ビジネス会話レベル ビジネス英語
BigTech、音声AI特化企業でのTTS/音声生成モデルの開発・運用経験 機械学習モデル開発経験
募集要項
- 職種
- AIエンジニア
- 雇用形態
- 正社員
- 想定年収
- 700万〜1100万円
- 勤務地
- 東京都 港区
- 出社・リモート
- 出社
- レベル
- メンバー
- 勤務時間
- フレックスタイム制
- 休日休暇
- 完全週休2日制 / 祝日休み
- 給与の詳細
- みなし残業 月45時間
- 試用期間
- 3ヶ月
福利厚生・制度
選考プロセス
- エントリー
ご応募から内定まで約3週間前後