転職AIログインマイページ求人へ
職種・勤務地・キーワードで探す
条件を変える

テック
コーポレート
セールス
サービス・販売
ビジネス
製造業
医療職
マーケティング
建設・建築
コンサルティング
デザイン
物流・運輸
不動産
研究
クリエイティブ
金融プロフェッショナル
編集・コンテンツ
士業・専門サービス
農林水産
公共・公務
その他
北海道・東北
関東
中部
近畿
中国・四国
九州・沖縄

こだわり条件

こだわり条件
条件をクリア
東京都の機械学習エンジニアの求人172件

MLエンジニア

2,500円/時〜

※ 募集要項に記載の額

勤務地
東京都渋谷区
休日
記載なし
雇用形態
インターン

どんな仕事かAIによる生成

ABEMAの機械学習エンジニアとして、実際の番組の映像・音声データを用いた検証に取り組みます。映像・音声・文字起こしテキストなどを組み合わせ、膨大な映像から目的のシーンを検索・検出する手法を検証します。機械学習/AIの手法検証(PoC)から、制作現場へのフィードバック・提案までを経験できるポジションです。

応募資格・募集要項・仕事内容を見る

この求人に応募

給与2,500円/時〜

募集元で応募する株式会社サイバーエージェントの採用ページへ
相談する共有準備中

応募は募集元の採用ページで受け付けています。当サイトに応募フォームはありません。

応募資格

必須

  • 大学・大学院で、以下いずれかの分野を専攻 or それに準ずる知識を独学で習得している方
  • Python を使ったデータ分析・機械学習の実装経験
  • 映像・音声、エンタメコンテンツ、番組制作の裏側のいずれかに強い関心がある方
  • 課題にあった論文やライブラリを調査し、手を動かして試せること

歓迎

  • ※いずれかの知識・経験

    • コンピュータービジョン(動画理解・シーン検出・ハイライト抽出など)の研究・開発・コンペ経験
    • 音声処理(音源分離・音声認識・話者分離など)の研究・開発経験
    • マルチモーダルモデル・基盤モデル(VLM・音声認識モデルなど)の活用経験
    • 機械学習・人工知能系の国際カンファレンスや査読誌での採択実績
    • 映像編集の経験(趣味レベルでも歓迎します)

求める人物像

  • とにかく映像や番組が好きで、「これ、どうやって作ってるんだろう?」がつい気になってしまう
  • 「目的のシーンをどう見つけ出すか」のような正解のない問いを、あれこれ試しながら楽しめる
  • きれいに整備されたデータセットより、現場から生まれた生のデータの手強さにワクワクする
  • 作ったものが現場で実際に使われる瞬間に、いちばんのやりがいを感じる

使用ツール

NumPypandasscikit-learnPyTorchJupyter映像・音声・文字起こしテキスト既存の動画理解モデル基盤モデル

募集要項最終確認 10/5

職種
機械学習エンジニア
雇用形態
インターン
採用区分
【学生インターン】インターン
給与
2,500円/時〜
給与の詳細
時給 2,500円〜 ※能力に応じて決定いたします。
勤務地
東京都渋谷区宇田川町40-1 東京本社
働き方
記載なし
受動喫煙対策
有(喫煙室あり)
学歴
大学卒業以上
掲載日
2026/07/31 23:55(67日前)
最終確認
2026/10/05 21:23(1日前)

仕事内容

募集内容

  • 私たちのAI Productチームは、撮影・編集といった制作の現場から映像が視聴者に届くまでの業務のAIによる効率化に加え、AIだからこそ生み出せる新しい価値づくりにも取り組むチームです。現場と直接対話しながら「本質的な課題」を見つけ、つくったものが実際に使われるところまでを自分たちで担っています。若手にも裁量を任せるサイバーエージェントの文化のもと、「何をつくるか」から自分たちで決めて動けるチームです。

ABEMAと映像制作の裏側

  • 皆さんが「ABEMA」で普段目にしているコンテンツは、配信用の完成版映像です。しかしその裏側では、複数のカメラで撮影された映像や、出演者ごとのマイクで収録された音声など、完成版をはるかに超える量の映像・音声データが日々生まれています。
  • コンテンツ制作や宣伝の現場では、この膨大な映像の中から「目的のシーンを探し出す」場面が日常的に発生します。ところが、映像は文書のように一覧したり、キーワードで引いたりすることができません。どこに何が映っていて、誰が何を話しているのか。現在はスタッフが時間をかけて映像を確認しながら探しており、ここに多くの時間が費やされています。
  • 私たちはこの課題に対して、映像・音声・文字起こしテキストといったマルチモーダルな情報を活用した「シーン検索」の仕組みづくりを進めています。人物・発話内容・場面の状況といった切り口で映像を検索できるようになれば、コンテンツ制作に関わるさまざまな業務のあり方が大きく変わります。さらにその先には、数値では捉えにくい人間関係や感情の機微、場の空気といった「言葉にしにくいもの」をどう捉えるか、という解のない問いも待っています。
  • これらは、コンピュータービジョン・音声処理・自然言語処理・マルチモーダルAIといった技術がまさに活きる領域です。「番組づくりの裏側」を機械学習で変えていく挑戦、一緒にやってみませんか?

業務内容

  • 機械学習/AIの手法検証(PoC)から、制作現場へのフィードバック・提案までの流れを経験できるポジションです。ABEMAの機械学習エンジニアとして、実際の番組の映像・音声データを用いた検証に取り組みます。
  • 以下は担当いただく業務の一例です。ご本人の興味・スキルや検証の進み具合に応じて、取り組むテーマは相談しながら決めていきます。

映像からのシーン検索・検出技術の検証

  • 映像・音声・文字起こしテキストといったマルチモーダルな情報を組み合わせ、膨大な映像の中から目的のシーンを検索・検出する手法を検証します。「誰が、どこで、何をしているシーンか」から、数値では捉えにくい感情や場の空気といった、言葉にしにくい情報まで捉えられないか。既存の動画理解モデルや基盤モデルの活用も含め、アプローチの設計から一緒に考えていきます。
  • ※検証の状況により、業務内容は変わる可能性があります。

実際の番組の映像・音声データを扱えます!

  • 普段見ている番組の「裏側」を覗きながら手を動かせるのは、このポジションならではです。研究用に整備されたデータセットにはない、現場ならではの手強さと面白さがあります。

この求人は、株式会社サイバーエージェントの採用ページの内容をAIが読み取って整理したものです。応募の前に採用ページの原文を確かめてください。データの集め方企業サイト

同じ会社の求人387件

株式会社サイバーエージェントの求人をすべて見る(387件)

職種と勤務地が似ている求人東京都の機械学習エンジニア 172件

東京都の機械学習エンジニアの求人をすべて見る(172件)

募集元の採用ページから応募できます

応募は株式会社サイバーエージェントの採用ページで受け付けています。このページは採用ページの掲載内容をもとに構成しているため、最新の応募条件は募集元でご確認ください。

募集元の採用ページを開く

この求人と近い条件で探す数字はリンク先ページの掲載件数

募集元で応募する採用ページへ

AI相談