GazeDiT: Gaze-Accurate Diffusion Image Generation for Eye Tracking via Spatial Conditioning
GazeDiT, a diffusion model that generates eye-tracking images for a requested 4D binocular gaze via an internally constructed spatial condition, achieves substantially lower tail gaze-label error than…