Under Review
Motion-Surface-Appearance Dynamic Gaussian Splatting for Accurate Geometry and High-Fidelity Rendering
Rethinking Facial Deformation Representation for Speech-Driven 3D Facial Animation
Language-Guided Scene Text Segmentation via Hierarchical Text Context Reasoning and Implicit Glyph Refinement
2026
Revealing Hidden Response Ambiguity in Binary Evaluation of Cultural Gesture Understanding
Vision-Language
Multimodal Learning
Human-Centered AI
ArtBoost: Synthetic Articulatory Data Augmentation for Acoustic-to-Articulatory Inversion
Top-tier AI Conference
Speech Processing
Motion Generation
Deformable 3D Point Cloud Perturbations using Cage-based Deformation for Semantic Consistency
JCR Top 7.8%
[Impact Factor: 8.0]
3D Vision
Adversarial Learning
Unsharp-Inspired Adversarial Point Cloud Perturbation via Low-Rank Approximation
3D Vision
Adversarial Learning
2025
MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization
Top-tier AI Conference
[Acceptance rate: 24%]
Speech Processing
Motion Generation
Digital Human
Enhancing 3D Scene Representation with Structural Dissimilarity-Aware Learning
3D Vision
Gaussian Splatting
Digital Human
Learning Phonetic Context-Dependent Viseme for Enhancing Speech-Driven 3D Facial Animation
Top-tier AI Conference
[Acceptance rate: 49.87%]
Speech Processing
Motion Generation
Digital Human
Leveraging Text Signed Distance Function Map for Boundary- Aware Guidance in Scene Text Segmentation
Scene Understanding
Segmentation
MSCoTDet: Language-driven Multi-modal Fusion for Improved Multispectral Pedestrian Detection
JCR Top 5.5%
[Impact Factor: 8.3]
Vision-Language
Object Detection
2024
Unveiling the Potential of Multimodal Large Language Models for Scene Text Segmentation via Semantic-Enhanced Features
Vision-Language
Segmentation
Scene Understanding
Analyzing Visible Articulatory Movements in Speech Production for Speech-Driven 3D Facial Animation
Speech Processing
Face Analysis
Motion Generation
Causal Mode Multiplexer: A Novel Framework for Unbiased Multispectral Pedestrian Detection
Top-tier AI Conference
[Acceptance rate: 23.6%]
Object Detection
Robust Learning
Super-Resolution Neural Radiance Field via Learning High Frequency Details for High-Fidelity Novel View Synthesis
3D Vision
Neural Rendering
Photometric Stereo Super Resolution via Complex Surface Structure Estimation
3D Vision
Generative Modeling
2022
Assessing Individual VR Sickness through Deep Feature Fusion of VR Video and Physiological Response
JCR Top 15.7%
[Impact Factor: 4.685]
VR/XR
Visual Quality Assessment
Natural-Looking Adversarial Examples from Freehand Sketches
Adversarial Learning
Generative Modeling
2021
Robust Video Frame Interpolation with Exceptional Motion Map
Generative Modeling
Robust Learning
Video Prediction Recalling Long-term Motion Context via Memory Alignment Learning
Top-tier AI Conference
[Acceptance rate: 23.7%]
Generative Modeling
Visual Comfort Aware-Reinforcement Learning for Depth Adjustment of Stereoscopic 3D Images
Top-tier AI Conference
[Acceptance rate: 21%]
VR/XR
Visual Quality Assessment
Reinforcement Learning
Towards a Better Understanding of VR Sickness: Physical Symptom Prediction for VR Contents
Top-tier AI Conference
[Acceptance rate: 21%]
VR/XR
Visual Quality Assessment
2020
SACA Net: Cybersickness Assessment of Individual Viewers for VR Content via Graph-based Symptom Relation Embedding
Top-tier AI Conference
[Acceptance rate: 26%]
VR/XR
Visual Quality Assessment
Structure Boundary Preserving Segmentation for Medical Image with Ambiguous Boundary
Top-tier AI Conference
[Acceptance rate: 22%]
Segmentation
Deep Virtual Reality Image Quality Assessment with Human Perception Guider for Omnidirectional Image
JCR Top 15.7%
[Impact Factor: 4.685]
VR/XR
Visual Quality Assessment
BBC Net: Bounding-Box Critic Network for Occlusion-Robust Object Detection
JCR Top 15.7%
[Impact Factor: 4.685]
Object Detection
Robust Learning
MCSIP Net: Multichannel Satellite Image Prediction via Deep Neural Network
JCR Top 12.8%
[Impact Factor: 5.6]
Generative Modeling
BMAN: Bidirectional Multi-scale Aggregation Networks for Abnormal Event Detection
JCR Top 3.2%
[Impact Factor: 10.856]
Scene Understanding
2019
Endometrium Segmentation on Transvaginal Ultrasound Image Using Key‐point Discriminator
JCR Top 24.1%
[Impact Factor: 3.317]
Segmentation
VRSA Net: VR Sickness Assessment Considering Exceptional Motion for 360° VR Video
JCR Top 4.1%
[Impact Factor: 9.340]
VR/XR
Visual Quality Assessment
Binocular Fusion Net: Deep Learning Visual Comfort Assessment for Stereoscopic 3D
JCR Top 18.7%
[Impact Factor: 4.133]
Visual Quality Assessment
Generative Guiding Block: Synthesizing Realistic Looking Variants Capable of Even Large Change Demands
Generative Modeling
Deep Objective Assessment Model based on Spatio-temporal Perception of 360-degree Video for VR Sickness Prediction
Best Paper Finalists
[Acceptance Rate: 2.1%]
VR/XR
Visual Quality Assessment
Physiological Fusion Net: Quantifying Individual VR Sickness with Content Stimulus and Physiological Response
VR/XR
Visual Quality Assessment
Region-guided Adversarial Learning for Anatomical Landmark Detection in Uterus Ultrasound Image
Object Detection
Photo-Realistic Facial Emotion Synthesis Using Multi-level Critic Networks with Multi-level Generative Model
Face Analysis
Generative Modeling
2018
Adversarial Spatial Frequency Domain Critic Learning for Age and Gender Classification
Face Analysis
Object Bounding Box-Critic Networks for Occlusion-Robust Object Detection in Road Scene
Object Detection
Robust Learning
FSF-C Net: Face Spatial Frequency-Critic Network for Face Super Resolution
Best Student Paper Award (Silver Prize)
Face Analysis
Generative Modeling
VR IQA NET: Deep Virtual Reality Image Quality Assessment Using Adversarial Learning
VR/XR
Visual Quality Assessment
STAN: Spatio-Temporal Adversarial Networks for Abnormal Event Detection
Scene Understanding
Object Detection
ICADx: Interpretable Computer Aided Diagnosis of Breast Masses
Robert F. Wagner All Conference Best Student Paper Final Lists Award
Scene Understanding
Teacher and Student Joint Learning for Compact Facial Landmark Detection Network
Face Analysis
2017
Ultrafast Layer based Computer-Generated Hologram Calculation with Sparse Template Holographic Fringe Pattern for 3-D Object
JCR Top 20.2%
[Impact Factor: 3.356]
3D Vision
Generative Modeling
Multiview Stereoscopic Video Hole Filling Considering Spatiotemporal Consistency and Binocular Symmetry for Synthesized 3D Video
JCR Top 18.1%
[Impact Factor: 3.558]
3D Vision
Generative Modeling
Measurement of Exceptional Motion in VR Video Contents for VR Sickness Assessment Using Deep Convolutional Autoencoder
Top-tier AI Conference
[Acceptance Rate: 21%]
VR/XR
Visual Quality Assessment
Modality-bridge Transfer Learning for Medical Image Classification
Scene Understanding
Robust and Real-Time Visual Tracking with Triplet Convolutional Neural Network
Robust Learning
Visual Comfort Assessment of Stereoscopic Images Using Deep Visual and Disparity Features based on Human Attention
Visual Quality Assessment
Iterative Deep Convolutional Encoder-Decoder Network for Medical Image Segmentation
Segmentation
Sparsity-based Fast CGH Generation Using Layer-based Approach for 3D Point Cloud Model
3D Vision
Generative Modeling
Investigating Numerical Reconstruction Quality and Sparsity Constraints on the Holographic Fringe Pattern in Digital Holography
3D Vision
2016
Acceleration of the Calculation Speed of Computer-Generated Holograms Using the Sparsity of the Holographic Fringe Pattern for a 3D Object
JCR Top 18.5%
[Impact Factor: 3.307]
3D Vision
Generative Modeling
Experimental Investigation of the Effect of Binocular Disparity on the Visibility Threshold of Asymmetric Noise in Stereoscopic Viewing
JCR Top 18.5%
[Impact Factor: 3.307]
VR/XR
Visual Quality Assessment
Critical Binocular Asymmetry Measure for the Perceptual Quality Assessment of Synthesized Stereo 3D Images in View Synthesis
JCR Top 17.2%
[Impact Factor: 3.599]
VR/XR
Visual Quality Assessment
Measurement of Critical Temporal Inconsistency for Quality Assessment of Synthesized Video
VR/XR
Visual Quality Assessment
A New Hole Filling Method based on 3D Geometric Transformation for Synthesized Image
3D Vision
Generative Modeling
Learning based Hole Filling Method Using Deep Convolutional Neural Network for View Synthesis
3D Vision
Generative Modeling
2015
Multi-frame De-raining Algorithm Using a Motion-compensated Non-local Mean Filter for Rainy Video Sequences
Generative Modeling
A Sparse Representation-Based Label Pruning for Image Inpainting Using Global Optimization
Best Student Paper Award
Generative Modeling
Temporally Consistent Hole Filling Method based on Global Optimization with Label Propagation for 3D Video
3D Vision
Generative Modeling
Multi-view Stereo Image Synthesis Using Binocular Symmetry-based Global Optimization
3D Vision
Generative Modeling
2014
Investigating Experienced Quality Factors in Synthesized Multi-view Stereo Images
3D Vision
Visual Quality Assessment