First Order Motion Model
A famous deep learning model for image animation (e.g., making a single portrait image speak or move) by modeling motion as a first order approximation. Often used in one-shot talking head video generation.
Link
Related resources
- VQA² (Visual Question Answering for Video Quality Assessment)ACM MM 2025 paper and code for VQA²-Assistant, a unified video/image quality scoring and interpretation model.
- Deep Reinforced Bitrate Ladders (DeepLadder)NOSSDAV 2021 paper on deep-reinforcement-learning-based bitrate ladder construction for adaptive streaming.
- DQ-Ladder: Deep Q-Network Time/Quality-Aware Bitrate LadderDeep reinforcement learning (DQN) approach to bitrate ladder construction achieving 10.3%+ BD-rate gain and 22% decode-time reduction.
- Encoder-Quantization-Motion (EQM) Video Quality MetricAcademic paper on an encoder-side video quality metric for low-latency use, addressing gaps in VMAF/P.1204.3 via contrast/motion masking an…
- A Gamut-Mapping Framework for Color-Accurate Reproduction of HDR ImagesAcademic paper (Sikudova et al.) proposing a gamut-mapping framework for color-accurate HDR image reproduction.
- Bitrate Ladder Construction via Transfer Learning and Spatio-Temporal FeaturesML-based bitrate ladder optimization achieving 94.1% complexity reduction at only 1.71% BD-rate cost using transfer learning.
- 2BiVQA: Double Bi-LSTM No-Reference Video Quality AssessmentNo-reference VQA model for UGC video using double Bi-LSTM, companion code to arXiv:2208.14774.
- nr-vqa-consumervideoNo-reference video quality metric tuned for consumer video capture artifacts (sensor noise, motion blur, shake) rather than compression art…
- Evaluating Video Quality Metrics for Neural and Traditional Codecs (4K/UHD-1)Academic comparison of VMAF, AVQBits, and FasterVQA no-reference quality metrics on 4K content.
- VMAF-torchPyTorch reimplementation of VMAF metric, GPU/gradient-friendly for use in learned codec optimization loops.