- Published on
CVPR 2026 — Face, Body & Biometrics
Face, Body & Biometrics
109 papers
1. EG-3DVG: Expression and Geometry Aware Grounding Decoder for 3D Visual Grounding
- Link: Open Access
2. Computation and Communication Efficient Federated Unlearning via On-server Gradient Conflict Mitigation and Expression
- Link: Open Access
3. Neural Field-Based 3D Surface Reconstruction of Microstructures from Multi-Detector Signals in Scanning Electron Microscopy
- Link: Open Access
- arXiv: 2508.04728
4. Cross-Modal Emotion Transfer for Emotion Editing in Talking Face Video
- Link: Open Access
- arXiv: 2604.07786
5. Inconsistency-aware Multimodal Schrodinger Bridge for Deepfake Localization
- Link: Open Access
6. WildCap: Facial Albedo Capture in the Wild via Hybrid Inverse Rendering
- Link: Open Access
- arXiv: 2512.11237
7. All in One: Unifying Deepfake Detection, Tampering Localization, and Source Tracing with a Robust Landmark-Identity Watermark
- Link: Open Access
- arXiv: 2602.23523
8. Face2Scene: Using Facial Degradation as an Oracle for Diffusion-Based Scene Restoration
- Link: Open Access
9. FHAvatar: Fast and High-Fidelity Reconstruction of Face-and-Hair Composable 3D Head Avatar from Few Casual Captures
- Link: Open Access
- arXiv: 2603.23345
10. One Model, Many Budgets: Elastic Latent Interfaces for Diffusion Transformers
- Link: Open Access
11. X-AVDT: Audio-Visual Cross-Attention for Robust Deepfake Detection
- Link: Open Access
- arXiv: 2603.08483
12. CLEX: Complementary Label Exchange Learning for Noisy Facial Expression Recognition
- Link: Open Access
13. NOWA: Null-space Optical Watermark for Invisible Capture Fingerprinting and Tamper Localization
- Link: Open Access
- arXiv: 2512.22501
14. FACE: A Face-based Autoregressive Representation for High-Fidelity and Efficient Mesh Generation
- Link: Open Access
- arXiv: 2603.01515
15. FVBench: Benchmarking Deepfake Video Detection Capability of Large Multimodal Models
- Link: Open Access
16. ManifoldNeuS: Manifold-aware View Optimizability for Pose-Free Neural Surface Reconstruction
- Link: Open Access
17. Adapting a Pre-trained Single-Cell Foundation Model to Spatial Gene Expression Generation from Histology Images
- Link: Open Access
- arXiv: 2603.19766
18. EmoThinker: Advancing Visual-Acoustic Emotion Analysis via Structural Token Selection and Chain-of-Thought Reasoning
- Link: Open Access
19. OSMO: Open-vocabulary Self-eMOtion Tracking
- Link: Open Access
20. Cross-Slice Knowledge Transfer via Masked Multi-Modal Heterogeneous Graph Contrastive Learning for Spatial Gene Expression Inference
- Link: Open Access
- arXiv: 2603.22821
21. Neural Gabor Splatting: Enhanced Gaussian Splatting with Neural Gabor for High-frequency Surface Reconstruction
- Link: Open Access
- arXiv: 2604.15941
22. Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
- Link: Open Access
- arXiv: 2509.12546
23. Plug-and-Play Incomplete Multi-View Clustering via Janus-Faced Affinity Learning with Topology Harmonization
- Link: Open Access
24. DiffusionFF: A Diffusion-based Framework for Joint Face Forgery Detection and Fine-Grained Artifact Localization
- Link: Open Access
- arXiv: 2508.01873
25. DeepProtect: Proactive Face-Swapping Defense using Identity Blending and Attribute Distortion
- Link: Open Access
26. Protego: User-Centric Pose-Invariant Privacy Protection Against Face Recognition-Induced Digital Footprint Exposure
- Link: Open Access
- arXiv: 2508.02034
27. MeshWeaver: Sparse-Voxel-Guided Surface Weaving for Autoregressive Mesh Generation
- Link: Open Access
28. EmoTaG: Emotion-Aware Talking Head Synthesis on Gaussian Splatting with Few-Shot Personalization
- Link: Open Access
- arXiv: 2603.21332
29. SeeGroup: Multi-Layer Depth Estimation of Transparent Surfaces via Self-Determined Grouping
- Link: Open Access
30. MMGait: Towards Multi-Modal Gait Recognition
- Link: Open Access
- arXiv: 2604.15979
31. DFD-HR: Generalizable Deepfake Detection via Hierarchical Routing Learning
- Link: Open Access
32. MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
- Link: Open Access
- arXiv: 2603.29029
33. EMO-R3: Reflective Reinforcement Learning for Emotional Reasoning in Multimodal Large Language Models
- Link: Open Access
- arXiv: 2602.23802
34. RecoverMark: Robust Watermarking for Localization and Recovery of Manipulated Faces
- Link: Open Access
- arXiv: 2602.20618
35. Distilling Unsigned Distance Function for Surface Reconstruction from 3D Gaussian Splatting
- Link: Open Access
36. Diffusion-Based Makeup Transfer with Facial Region-Aware Makeup Features
- Link: Open Access
- arXiv: 2603.20012
37. MetaSpectra+: A Compact Broadband Metasurface Camera for Snapshot Hyperspectral+ Imaging
- Link: Open Access
- arXiv: 2603.09116
38. Representing 3D Faces with Learnable B-Spline Volumes
- Link: Open Access
- arXiv: 2604.12894
39. EmoStyle: Emotion-Driven Image Stylization
- Link: Open Access
- arXiv: 2512.05478
40. Frequency-domain Manipulation for Face Obfuscation
- Link: Open Access
41. E3AD: An Emotion-Aware Vision-Language-Action Model for Human-Centric End-to-End Autonomous Driving
- Link: Open Access
- arXiv: 2512.04733
42. From Spots to Pixels: Dense Spatial Gene Expression Prediction from Histology Images
- Link: Open Access
- arXiv: 2503.01347
43. Attribute-Preserving Pseudo-Labeling for Diffusion-Based Face Swapping
- Link: Open Access
- arXiv: 2601.15288
44. Iris: Bringing Real-World Priors into Diffusion Model for Monocular Depth Estimation
- Link: Open Access
- arXiv: 2603.16340
45. MS^2Gait: A Multi-Scale Spatio-Temporal Fusion Network for LiDAR-based Gait Recognition
- Link: Open Access
46. Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces Selection
- Link: Open Access
- arXiv: 2603.04337
47. Faithful Contouring: Near-Lossless 3D Voxel Representation Free from Iso-surface
- Link: Open Access
- arXiv: 2511.04029
48. Nano-EmoX: Unifying Multimodal Emotional Intelligence from Perception to Empathy
- Link: Open Access
- arXiv: 2603.02123
49. Real2Edit2Real: Generating Robotic Demonstrations via a 3D Control Interface
- Link: Open Access
- arXiv: 2512.19402
50. No Way To Steal My Face: Proactive Defense Against Identity-Preserving Personalized Generation
- Link: Open Access
51. MVGGT: Multimodal Visual Geometry Grounded Transformer for Multiview 3D Referring Expression Segmentation
- Link: Open Access
- arXiv: 2601.06874
52. Pixels Don't Lie (But Your Detector Might): Bootstrapping MLLM-as-a-Judge for Trustworthy Deepfake Detection and Reasoning Supervision
- Link: Open Access
53. Bridging Facial Understanding and Animation via Language Models
- Link: Open Access
- arXiv: 2603.16936
54. OMGTex: One-stage Multi-style Facial Texture Reconstruction without Geometry Guidance
- Link: Open Access
55. HyperGait: Unleashing the Power of Parsing for Gait Recognition in the Wild via Hypergraph
- Link: Open Access
56. TriDF: Evaluating Perception, Detection, and Hallucination for Interpretable DeepFake Detection
- Link: Open Access
57. Cell-Type Prototype-Informed Neural Network for Gene Expression Estimation from Pathology Images
- Link: Open Access
- arXiv: 2603.18461
58. Text-guided Feature Disentanglement for Cross-modal Gait Recognition
- Link: Open Access
59. Hearing the Room Through the Shape of the Drum: Modal-Guided Sound Recovery from Multi-Point Surface Vibrations
- Link: Open Access
- arXiv: 2604.26678
60. Face-Guided Sentiment Boundary Enhancement for Weakly-Supervised Temporal Sentiment Localization
- Link: Open Access
- arXiv: 2603.14750
61. From Pixel to Precision: Enhancing Handwritten Mathematical Expression Recognition with Image-Level Reward
- Link: Open Access
62. BarbieGait: An Identity-Consistent Synthetic Human Dataset with Versatile Cloth-Changing for Gait Recognition
- Link: Open Access
- arXiv: 2604.12221
63. PC-Talk: Precise Facial Animation Control for Audio-Driven Talking Face Generation
- Link: Open Access
- arXiv: 2503.14295
64. HyperGaussians: High-Dimensional Gaussian Splatting for High-Fidelity Animatable Face Avatars
- Link: Open Access
- arXiv: 2507.02803
65. High-Fidelity Diffusion Face Swapping with ID-Constrained Facial Conditioning
- Link: Open Access
- arXiv: 2503.22179
66. CSF: Black-box Fingerprinting via Compositional Semantics for Text-to-Image Models
- Link: Open Access
- arXiv: 2604.16363
67. SIF: Semantically In-Distribution Fingerprints for Large Vision-Language Models
- Link: Open Access
- arXiv: 2604.17041
68. EventGait: Towards Robust Gait Recognition with Event Streams
- Link: Open Access
- arXiv: 2605.22139
69. Hermite Radial Basis Function for Surface Reconstruction via Differentiable Rendering
- Link: Open Access
70. EmoDiffTalk: Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
- Link: Open Access
71. A Sanity Check for Multi-In-Domain Face Forgery Detection in the Real World
- Link: Open Access
- arXiv: 2512.04837
72. 4DSurf: High-Fidelity Dynamic Scene Surface Reconstruction
- Link: Open Access
- arXiv: 2603.28064
73. BeautyGRPO: Aesthetic Alignment for Face Retouching via Dynamic Path Guidance and Fine-Grained Preference Modeling
- Link: Open Access
- arXiv: 2603.01163
74. Unlocking Motion from Large Vision Models with a Semantic and Kinematic Duality for Gait Recognition
- Link: Open Access
75. Registration-Free Learnable Multi-View Capture of Faces in Dense Semantic Correspondence
- Link: Open Access
- arXiv: 2605.01450
76. Beyond Missing Modalities: Hypergraph Conditioned Diffusion for Uncertainty-Aware Multimodal Emotion Recognition
- Link: Open Access
77. 3D Gaussian Splatting with Self-Constrained Priors for High Fidelity Surface Reconstruction
- Link: Open Access
- arXiv: 2603.19682
78. PerformRecast: Expression and Head Pose Disentanglement for Portrait Video Editing
- Link: Open Access
- arXiv: 2603.19731
79. D^3FER: Dual Channel and Dual Branch Network for Robust Facial Expression Recognition under Dual Challenges
- Link: Open Access
80. Harnessing Chain-of-Thought Reasoning in Multimodal Large Language Models for Face Anti-Spoofing
- Link: Open Access
- arXiv: 2506.01783
81. Goldilocks Test Sets for Face Verification
- Link: Open Access
- arXiv: 2405.15965
82. Investigating Self-Supervised Representations for Audio-Visual Deepfake Detection
- Link: Open Access
- arXiv: 2511.17181
83. Dynamic Label Noise Suppression with Optimal Teacher Pool for Facial Expression Recognition
- Link: Open Access
84. Spatial Matters: Position-Guided 3D Referring Expression Segmentation
- Link: Open Access
85. From Intuition to Investigation: A Tool-Augmented Reasoning MLLM Framework for Generalizable Face Anti-Spoofing
- Link: Open Access
- arXiv: 2603.01038
86. POLAR: A Portrait OLAT Dataset and Generative Framework for Illumination-Aware Face Modeling
- Link: Open Access
- arXiv: 2512.13192
87. Decoupling Bias, Aligning Distributions: Synergistic Fairness Optimization for Deepfake Detection
- Link: Open Access
- arXiv: 2511.10150
88. Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
- Link: Open Access
- arXiv: 2605.01638
89. IrisFP: Adversarial-Example-based Model Fingerprinting with Enhanced Uniqueness and Robustness
- Link: Open Access
- arXiv: 2603.24996
90. Beyond [CLS] Token: Query-Driven Token-Level Forgery Purification for Generalizable Deepfake Detection
- Link: Open Access
91. FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
- Link: Open Access
- arXiv: 2603.05506
92. IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation
- Link: Open Access
93. IDperturb: Enhancing Variation in Synthetic Face Generation via Angular Perturbations
- Link: Open Access
- arXiv: 2602.18831
94. UniMERNet: A Universal Network for Real-World Mathematical Expression Recognition
- Link: Open Access
- arXiv: 2404.15254
95. Tutor-Student Reinforcement Learning: A Dynamic Curriculum for Robust Deepfake Detection
- Link: Open Access
- arXiv: 2603.24139
96. ImmerIris: A Large-Scale Dataset and Benchmark for Off-Axis and Unconstrained Iris Recognition in Immersive Applications
- Link: Open Access
- arXiv: 2510.10113
97. Region-Aware Instance Consistency Learning for Micro-Expression Recognition
- Link: Open Access
98. TESSERA: Temporal Embeddings of Surface Spectra for Earth Representation and Analysis
- Link: Open Access
- arXiv: 2506.20380
99. RDFace: A Benchmark Dataset for Rare Disease Facial Image Analysis under Extreme Data Scarcity and Phenotype-Aware Synthetic Generation
- Link: Open Access
- arXiv: 2604.03454
100. Neu-PiG: Neural Preconditioned Grids for Fast Dynamic Surface Reconstruction on Long Sequences
- Link: Open Access
101. Iris: Integrating Language into Diffusion-based Monocular Depth Estimation
- Link: Open Access
- arXiv: 2411.16750
102. VIRO: Robust and Efficient Neuro-Symbolic Reasoning with Verification for Referring Expression Comprehension
- Link: Open Access
- arXiv: 2601.12781
103. SketchFaceGS: Real-Time Sketch-Driven Face Editing and Generation with Gaussian Splatting
- Link: Open Access
- arXiv: 2604.19202
104. DeepfakeImpact: A Two-Stage Benchmark with Real-World Impact in Deepfake Detection
- Link: Open Access
105. PortraitDirector: A Hierarchical Disentanglement Framework for Controllable and Real-time Facial Reenactment
- Link: Open Access
- arXiv: 2604.19129
106. SAQN: Semantic-based Adaptive Query Network for 3D Referring Expression Segmentation
- Link: Open Access
107. Unleashing Vision-Language Semantics for Deepfake Video Detection
- Link: Open Access
- arXiv: 2603.24454
108. Editprint: General Digital Image Forensics via Editing Fingerprint with Self-Augmentation Training
- Link: Open Access
109. Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality
- Link: Open Access
- arXiv: 2512.07951