転職AI
AIに相談
AIに相談
合同会社DMM.com
募集中 1日前に確認

音声合成(TTS)モデルエンジニア

AIエンジニア 出社 正社員 メンバー
想定年収
700万〜1100万円
勤務地
東京都 港区
リモート
出社

仕事内容

DMM.comの大規模エンタメサービスを支える、最先端の音声合成(TTS)モデルの開発・推論最適化をリードする高度AI人材を募集します。TTSモデルのFine-tuning・推論最適化からサービス統合まで一気通貫で推進し、日本最大級のエンタメプラットフォームで世界に通用する音声AIを創り上げる挑戦的なポジションです。DMM独自のデータ・ドメインに特化した音声生成技術の研究開発・サービス化をリードし、AIアバターや対話型キャラクターといった新たなユーザー体験の創出を目指します。

業務内容

  • TTSモデル(Qwen-TTS、Orpheus等)のFine-tuning・話者/感情制御の実装を推進します
  • GPU上での推論効率化(バッチング、KV cache、量子化、同時実行数チューニング)を担当します
  • 音素タイムライン生成のTTSパイプラインへの統合(アバターのリップシンク等への応用)を行います
  • 推論基盤の構築・運用、レイテンシ(TTFS)とサービス品質の管理を担当します

募集の背景

  • DMM独自のデータ・ドメインに特化した音声生成(TTS)技術の研究開発・サービス化をリードする高度AI人材を募集しています
  • 高品質な音声合成を組み合わせることで、AIアバターや対話型キャラクターといった新たなユーザー体験の創出を目指しています
  • TTSモデルのコア技術を熟知し、オープンモデルをDMMのデータでFine-tuningでき、かつ推論を効率化できる音声AIエンジニアを求めています

事業について

  • 新規事業の創出と成長を技術面から推進する開発本部です
  • サービスの企画・設計から開発、リリースまで一貫して関わることができます
  • MVP開発のような小〜中規模プロジェクトから、複数部署が連携する大規模プロジェクトまで、幅広い開発案件を手がけています

求めるスキル・経験

必須
TTSモデル(Qwen-TTS、Orpheus、VITS、Fish-Speech等)のFine-tuning・追加学習の実務経験
話者適応・感情/プロソディ制御・多言語対応などのカスタマイズ経験 自然言語処理
音声データセットの構築・前処理パイプライン(音声/テキストアライメント等)の開発経験 ETL/ELTパイプライン経験
PyTorchでのモデル学習、LoRA等の効率的Fine-tuning手法の実装経験 PyTorch
GPU上での推論最適化(バッチング、KV cache管理、量子化、ストリーミング生成)の実務経験 パフォーマンス最適化経験
推論基盤(vLLM、TensorRT-LLM、SGLang等)の選定・導入・最適化経験
同時実行数(concurrency)のチューニング、レイテンシ(TTFS等)改善の実務経験 パフォーマンス最適化経験
CUDA最適化、メモリ効率化に関する深い理解 パフォーマンス最適化経験
REST API/WebSocket/gRPC設計、ストリーミング音声配信の実装経験 gRPCREST APIWebSocket
推論サービスのレプリカ構成、オートスケーリング、監視・可観測性基盤の構築経験 分散システムKubernetes可観測性
歓迎
音素タイムライン(phoneme timestamp)生成をTTSに統合した経験 自然言語処理
リアルタイム音声対話・AIアバターのリップシンク等の開発経験
日本語能力検定1級 日本語能力試験 N1
英語ビジネス会話レベル ビジネス英語
BigTech、音声AI特化企業でのTTS/音声生成モデルの開発・運用経験 機械学習モデル開発経験

募集要項

雇用形態
正社員
想定年収
700万〜1100万円
勤務地
東京都 港区
出社・リモート
出社
レベル
メンバー
勤務時間
フレックスタイム制
休日休暇
完全週休2日制 / 祝日休み
給与の詳細
みなし残業 月45時間
試用期間
3ヶ月
掲載日
2026/7/27
情報の最終確認日
2026/7/26

福利厚生・制度

選考プロセス

  1. エントリー

ご応募から内定まで約3週間前後

企業情報

合同会社DMM.comの求人をすべて見る →