About this role
Lead architecture design and implementation of video generation post-training focused on instruction data, preference alignment, and video quality; expand capabilities for long-video modeling, storyline consistency, and camera control, build evaluation pipelines and reward models and execute alignment training (RLHF, DPO, GRPO, PPO), and research inference acceleration and distillation techniques for diffusion models.
Skills for this role
Generative AIVideo Generation Post-TrainingVideo GenerationHigh-quality Instruction DataPreference AlignmentReinforcement Learning from Human Feedback (RLHF)DPOGRPOPPOAlignment TrainingFine-tuningLoRAQLoRADoRAModel DistillationConsistency ModelsFlow MatchingDiffusion ModelsInference AccelerationLong-Video ModelingStoryline ConsistencyPrecise Camera ControlVideo Quality EvaluationVideo Reward ModelsReward ModelsEvaluation MetricsVRAM CompressionQuantizationEfficiency OptimizationTemporal Consistency