リサーチエンジニア/サイエンティスト - ヒューマンアライメント、コンシューマーデバイス

研究員正社員— · 経験不問サンフランシスコハイブリッド
Machine LearningRLHFReward ModelingPreference OptimizationPost-trainingReinforcement Learning

OpenAIのコンシューマーデバイスグループでは、パーソナライズされたマルチモーダルAIシステムのRLHFおよび報酬モデリングを研究するエンジニアを募集しています。機械学習研究の経験と、強化学習または選好最適化の能力が必須です。ユーザーの長期的な価値を考慮したモデルの改善と評価フレームワークの構築を主導していただきます。

OpenAIの新着求人をいち早く受け取りましょう

気になる会社を登録すると、新しい求人が公開されたときすぐにお知らせします。

無料で始める
開く