论文清单

论文与学术产出

下列清单覆盖视频理解、具身感知、世界模型、数字人与视频编码等方向。

  • 一、视频理解与多模态内容分析
  • 二、具身感知、三维场景理解与自主系统
  • 三、时空运动建模与世界模型支撑技术
  • 四、数字人、动作生成与视频内容生成
  • 五、视频编码、压缩与国际标准
  • 感知层(方向一、方向二)给世界模型提供观测编码和三维环境表征
  • 预测层(方向三)给世界模型提供状态演化预测能力
  • 生成层(方向四)给具身智能提供交互模拟与训练数据
  • 编码层(方向五)给整个系统提供底层效率保障

汇总:截至 2026 年 6 月创始团队及合作网络在视觉智能、多模态与具身相关方向发表的论文,约 200+

论文标题作者会议/期刊年份
Adversarial image detection based on spatial and frequency informationYucheng Li, Shuai Wang, Guozhi Li, Jiangyao Shi, Wenyi Wang, Xiangdong Han, Lu PanDisplays2026
Audio-Visual Synergy for High-Fidelity Portrait Animation: A Two-Stage Framework with Identity-Motion DisentanglementYuzhi Lu, Yuanzong Mei, Wenyi Wang, Xi Chen, Xiaowen Chen, Zhi Wang, Feng Xu, Jianwen ChenISCAS2026
Cross-Modal Probabilistic Representation Learning for Conversational Emotion RecognitionZhou Z, Xu F, Wang W, Chen JIEEE Transactions on Multimedia2026
EdgeFER: A Structure-Guided and Hardware-Friendly Framework for Dynamic Facial Expression RecognitionZhou Z, Chen A, Teka N A, Chen JISCAS2026
RIA-NET: Realistic Image Animation through Semantic-aware Feature Learning NetworksTeka N A, Kumie G A, Chen A, Chen JJournal of King Saud University Computer and Information Sciences2026
Towards Generalizable Deepfake Detection: Mitigating Training Bias via Generalization Bound TighteningYuzhi Lu, Wenyi Wang, Xi Chen, Xiaowen Chen, Jianwen Chen, Ce ZhuACM MM2026
AMT-Net: Adversarial Motion Transfer Network with Disentangled Shape and Pose for Realistic Image AnimationTeka N A, Alemu K G, Assefa M, et alIEEE Access2025
Multi-Scale Spatial-Frequency Features Representation and Learnable Cross Modal Feature Fusion in DeepFake DetectionYuzhi Lu, Wenyi Wang, Xiaowen Chen, Fengyu Wang, Shuai Wang, Jianwen ChenICIP2025
TransMask-Anim: Transformer-Driven Mask Perturbation and Keypoint Correspondence for Latent Space Image AnimationTeka N A, Zhou Z, Chen JICCWAMTIP2025
Deepfake face discrimination based on self-attention mechanismShuai Wang, Donghui Zhu, Jian Chen, Jiangbo Bi, Wenyi WangPattern Recognition Letters2024
Face Animation Based on Multiple Sources and Perspective AlignmentMei Y, Wang W, Liu X, et alVirtual Reality & Intelligent Hardware2024
Locational Detection of False Data Injection Attacks in Smart Grids: A Graph Convolutional Attention Network ApproachWei Xia, Demin He, Lisha YuIEEE Internet of Things Journal2024
Multi-visual Modality Micro Drone-Based Structural Damage DetectionAgyemang I O, Zeng L, Chen J, Adjei-Mensah I, Acheampong DEngineering Applications of Artificial Intelligence2024
Perception-oriented video frame interpolation via asymmetric blendingGuangyang Wu, Xin Tao, Changlin Li, Wenyi Wang, Xiaohong Liu, Qingqing ZhengCVPR2024
Accflow: Backward accumulation for long-range optical flowGuangyang Wu, Xiaohong Liu, Kunming Luo, et alICCV2023
Cascaded Temporal and Spatial Attention Network for Solar Adaptive Optics Image RestorationChi Zhang, Shuai Wang, Libo Zhong, Qingqing Chen, Changhui RaoAstronomy & Astrophysics2023
Cheap-fake detection with llm using prompt engineeringGuangyang Wu, Weijie Wu, Xiaohong Liu, Kele Xu, Tianjiao Wan, Wenyi WangICMEW2023
Distributed Collaborative Tensor Beamforming via Gaussian Entropy over Array NetworksWei Xia, Lisha Yu, Guoqing XiaIEEE Transactions on Vehicular Technology2023
Dynamic UAV Swarm Confrontation: An Imitation Based on Mobile Adaptive NetworksWei Xia, Zhuoyang Zhou, Wanyue Jiang, Yuhan ZhangIEEE Transactions on Aerospace and Electronic Systems2023
Fastllve: Real-time low-light video enhancement with intensity-aware look-up tableWenhao Li, Guangyang Wu, Wenyi Wang, Peiran Ren, Xiaohong LiuACM MM2023
Improved First-Order Motion Model of Image Animation with Enhanced Dense Motion and Repair AbilityXu Y, Xu F, Liu Q, Chen JApplied Science2023
LiDAR Point Cloud Compression, Processing and Learning for Autonomous DrivingAbbasi R, Bashir A K, Alyamani H J, et alIEEE Transactions on Intelligent Transportation Systems2023
On the PMU Placement Optimization for the Detection of False Data Injection AttacksWei Xia, Demin He, Junbin ChenIEEE Systems Journal2023
Resilient Distributed Estimation Against FDI Attacks: A Correntropy-based ApproachWei Xia, Yuhan ZhangInformation Sciences2023
Spatial-Temporal Consistency Refinement Network for Dynamic Point Cloud Frame InterpolationRen L, Zhao L, Sun Z, Zhang Z, Chen JIEEE ICMEW2023
Widely Linear Null Broadening GNSS Anti-interference for Polarization Sensitive ArraysWei Xia, Yuhan Zhang, Hao YuIEEE Transactions on Aerospace and Electronic Systems2023
二阶广义总变分约束的太阳图像多帧盲解卷积王帅、何春元、荣会钦等光电工程2023
低秩先验的相位差法太阳图像重建王帅、鲍华、何春元等光电工程2023
深度学习点云质量增强方法综述陈建文、赵丽丽、任蓝草、孙卓群、张新峰、马思伟中国图象图形学报2023
针对人脸识别卷积神经网络的局部背景区域对抗攻击张晨晨、王帅、王文一等光电工程2023
Adversarial Examples Detection Based on Error Level Analysis and Space MappingSizhao Huang, Shuai Wang, Jian Chen, Guozhi Li, Wenyi WangICASSP2022
Enhanced Surveillance Video Compression with Dual Reference Frames GenerationLei Zhao, Shiqi Wang, Shanshe Wang, Yan Ye, Siwei Ma, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2022
Evolution of AVS Video Coding Standards: Twenty Years of Innovation and DevelopmentSiwei Ma, Li Zhang, Shiqi Wang, Chuanmin Jia, Shanshe Wang, Tiejun Huang, Feng Wu, Wen GaoScience China Information Sciences2022
FPX-NIC: An FPGA-Accelerated 4K Ultra-High-Definition Neural Video Coding SystemChuanmin Jia, Xinyu Hang, Shanshe Wang, Yaqiang Wu, Siwei Ma, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2022
Joint Local and Nonlocal Progressive Prediction for Versatile Video CodingMeng Lei, Falei Luo, Xinfeng Zhang, Shanshe Wang, Siwei MaIEEE Transactions on Image Processing2022
Multiframe Correction Blind Deconvolution for Solar Image RestorationShuai Wang, Huiqin Rong, Chunyuan He, Libo Zhong, Changhui RaoPASP2022
MVFI-Net: Motion-aware Video Frame Interpolation NetworkLin X, Zhao L, Liu X, Chen JACCV2022
P-STMO: Pre-trained Spatial Temporal Many-to-One Model for 3D Human Pose EstimationWenkang Shan, Zhenhua Liu, Xinfeng Zhang, Shanshe Wang, Siwei Ma, Wen GaoECCV2022
RangeINet: Fast LiDAR Point Cloud Temporal InterpolationZhao L, Lin X, Wang W, Ma K K, Chen JICASSP2022
Real-time LiDAR Point Cloud Compression Using Bi-directional Prediction and Range-adaptive Floating-point CodingZhao L, Ma K K, Lin X, Wang W, Chen JIEEE Transactions on Broadcasting2022
Real-Time Scene-Aware LiDAR Point Cloud Compression Using Semantic Prior RepresentationZhao L, Ma K K, Liu Z, Yin Q, Chen JIEEE TCSVT2022
Scalable Intra Coding Optimization for Video CodingJiaqi Zhang, Meng Wang, Chuanmin Jia, Shanshe Wang, Siwei Ma, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2022
An Unsupervised Optical Flow Estimation for LiDAR Image SequencesGuo X, Lin X, Zhao L, Zhu Z, Chen JICIP2021
Deep Inter Prediction via Reference Frame Interpolation for Blurry Video CodingZhu Z, Zhao L, Lin X, Guo X, Chen JVCIP2021
Lossless Point Cloud Attribute Compression with Normal-based Intra PredictionYin Q, Ren Q, Zhao L, Chen J, Wang WBMSB2021
RAI-Net: Range-Adaptive LiDAR Point Cloud Frame Interpolation NetworkZhao L, Zhu Z, Lin X, et alBMSB2021
Regularized Intermediate Layers Attack: Adversarial Examples with High TransferabilityXiaorui Li, Weiyu Cui, Jiawei Huang, Wenyi Wang, Jianwen ChenICIP2021
AIM 2020 Challenge on Efficient Super-Resolution: Methods and ResultsK. Zhang, et alECCV Workshops2020
Author Classification Using Transfer Learning and Predicting Stars in Co-Author NetworksRashid Abbasi, Ali Kashif Bashir, Jianwen Chen, et alSoftware—Practice & Experience2020
RDH Based Dynamic Weighted Histogram Equalization for Secure Transmission and Cancer PredictionRashid Abbasi, Jianwen Chen, Yasser Al-Otaibi, et alMultimedia Systems2020
Reconstruction of Natural Visual Scenes from Neural Spikes with Deep Neural NetworksYichen Zhang, Shanshan Jia, Yajing Zheng, Zhaofei Yu, Yonghong Tian, Siwei Ma, Tiejun Huang, Jian K. LiuNeural Networks2020
Robust Prior-Based Single Image Super Resolution under Multiple Gaussian DegradationsW. Wang, G. Wu, W. Cai, L. Zeng, J. ChenIEEE Access2020
Substitute Model Generation for Black-box Adversarial Attack Based on Knowledge DistillationW. Cui, X. Li, J. Huang, W. Wang, S. WangICIP2020
3D Facial Expression Recognition Using Deep Feature Fusion CNNK. Tian, L. Zeng, S. McGrath, Q. Yin, W. WangISSC2019
A Compatible Framework for RGB-D SLAM in Dynamic ScenesZhao L, Liu Z, Chen J, Cai W, Wang W, Zeng LIEEE Access2019
Efficient Screen Content Coding Based on Convolutional Neural Network Guided by a Large-Scale Database, ICIP, 2019Zhao L, Wei Z, Cai W, Wang W, Zeng L, Chen J2019
Feature Level MRI Fusion Based on 3D Dual Tree Compactly Supported Shearlet TransformChang Duan, Shuai Wang, Qihong Huang, et alJournal of Visual Communication and Image Representation2019
Khan, et alAbubakar Hassan Sani, Jianwen Chen, Muhammad TDesign and Simulation of 3.9 GHz Microstrip Parallel Coupled Line Band Pass Filter. ICCWAMTIP2019
Neural Network Based Image and Video Coding TechnologiesChuanmin Jia, Zhenghui Zhao, Shanshe Wang, Siwei Ma, Wen GaoTelecommunications Science2019
PRED: A Parallel Network for Handling Multiple Degradations via Single Model in Single Image Super-ResolutionG. Wu, L. Zhao, W. Wang, L. Zeng, J. ChenICIP2019
Residual MultiSmoothletsShuai Wang, Dianmin Hu, Shuai Li, Ce Zhu, Changhui RaoBMSB2019
A Multi-scale Deconvolution Semantic Segmentation Network for Joint Detection and SegmentationFeng N, Dong L, Zhang Q, et alJCRAI2018
Adaptive Illumination Normalization via Adaptive Illumination Preprocessing and Modified Weber-FaceJianwen Chen, Zhen Zeng, Rumin Zhang, et alApplied Intelligence2018
Adaptive Shadow Removal Algorithm for Face ImagesZ. Zeng, R. Zhang, J. Chen, L. Zeng, W. Wang, S. McMrathICST2018
An Algorithm for Obstacle Detection Based on YOLO and Light Field CameraChen J, Zhang R, Yang Y, Wang W, Zeng LICST2018
Extended Smoothlets: An Efficient Multi-Resolution Adaptive TransformShuai Wang, Chunmei Wang, Qian Zhang, et alJournal of Visual Communication and Image Representation2018
High Efficient VR Video Coding Based on Auto Projection Selection Using Transferable Features, VCIP, 2018Chen J, Zhao L, Zhang M, et al2018
Multiple Low-Ranks Plus Sparsity Based Tensor Reconstruction for Dynamic MRIShan Wu, Yipeng Liu, Tengteng Liu, et alDSP2018
Robust Multi-Frame Super-Resolution Based on Spatially Weighted Half-Quadratic Estimation and Adaptive BTV RegularizationX. Liu, L. Chen, W. Wang, J. ZhaoIEEE TIP2018
Using Hybrid Sensing Method for Motion Capture in the Standardized Volleyball Techniques TrainingLin J, Zhang R, Chen J, et alICST2018
A Bayesian Approach for Camouflaged Moving Object DetectionXiang Zhang, Ce Zhu, Shuai Wang, Yipeng Liu, Mao YeIEEE TCSVT2017
A Real-Time Obstacle Detection Algorithm for the Visually Impaired Using Binocular CameraRumin Zhang, Wenyi Wang, Liaoyuan Zeng, Jianwen Chen, et alCSPS2017
A Robust and Real-Time Full 3D Reconstruction Method Based on Multiple KinectPeng X, Zeng L, Wang W, et alCSPS2017
Adaptive Progressive Motion Vector Resolution Selection Based on Rate-Distortion OptimizationZhao Wang, Shiqi Wang, Jian Zhang, Siwei MaIEEE Transactions on Image Processing2017
Complex Wavelet-Domain Image Watermarking Algorithm Using L1-Norm Function-Based QuantizationJinhua Liu, Yuanyuan Xu, Shuai Wang, Ce ZhuCircuits Systems & Signal Processing2017
Enhancing Wedgelet-based Depth Modeling in 3D-HEVCChang Duan, Yuhuan Shen, Yingying Zhang, Shuai Wang, Ce Zhu, Meng YangAPSIPA2017
Entropy of Primitive: From Sparse Representation to Visual Information EvaluationSiwei Ma, Xinfeng Zhang, Jian Zhang, Chuanmin Jia, Shiqi Wang, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2017
Hybrid Laplace Distribution-Based Low Complexity Rate-Distortion Optimized QuantizationJing Cui, Shanshe Wang, Shiqi Wang, Xinfeng Zhang, Siwei Ma, Wen GaoIEEE Transactions on Image Processing2017
Inter-View Dependency-Based Rate Control for 3D-HEVCSongchao Tan, Siwei Ma, Shanshe Wang, Shiqi Wang, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2017
Video Compressive Sensing Reconstruction via Reweighted Residual SparsityChen Zhao, Siwei Ma, Jian Zhang, Ruiqin Xiong, Wen GaoIEEE Transactions on Circuits and Systems for Video Technology2017
A Novel Perception Oriented Image Color RepresentationW. Wang, Y. Luo, J. Hu, J. ZhaoI2MTC2016
Hiding Depth Information in Compressed 2D Image/Video Using Reversible WatermarkingW. Wang, J. ZhaoMultimedia Tools and Applications2016
Low-Rank Decomposition-Based Restoration of Compressed Images via Adaptive Noise EstimationXiang Zhang, Weisi Lin, Ruiqin Xiong, Xianming Liu, Siwei Ma, Wen GaoIEEE Transactions on Image Processing2016
Nonlocal In-Loop Filter: The Way Toward Next-Generation Video Coding?Siwei Ma, Xinfeng Zhang, Jian Zhang, Chuanmin Jia, Shiqi Wang, Wen GaoIEEE MultiMedia2016
Real-time Video Chroma Keying: A Parallel Approach Based on Local Texture and Global Color DistributionL. Yin, W. Wang, J. ZhaoIET Image Processing2016
Structure Prior Effects in Bayesian Approaches of Quantitative Susceptibility MappingShuai Wang, Weiwei Chen, Chunmei Wang, et alBioMed Research International2016
Video Chroma Keying via Global Sampling and Trimap PropagationC. Hao, W. Wang, J. ZhaoMultimedia Systems2016
AVS2: Making Video Coding SmarterSiwei Ma, Tiejun Huang, Cliff Reader, Wen GaoIEEE Signal Processing Magazine2015
Research Progress of Quantitative Susceptibility Mapping in MRIWang Shuai, Duan Chang, Zhang Ping, et alJournal of Biomedical Engineering2015
Robust Image Chroma-Keying: A Quadmap Approach Based on Global Sampling and Local AffinityW. Wang, J. ZhaoIEEE Transactions on Broadcasting2015
Stereoscopic Chroma Key Matting Using Statistical Analysis in CIECAM02 Color SpaceL. Yin, W. Wang, J. ZhaoHAVE2015
Gauthier, Ajay Gupta, et alWeiwei Chen, Susan AQuantitative Susceptibility Mapping of Multiple Sclerosis Lesions at Various Ages. Radiology2014
Intracranial Calcifications and Hemorrhages: Characterization with Quantitative Susceptibility MappingWeiwei Chen, Wenzhen Zhu, Iihami Kovanlikaya, et alRadiology2014
Inverse Problem in Quantitative Susceptibility MappingJae Kyu Choi, Hyoung Suk Park, Shuai Wang, Yi Wang, Jin Keun SeoSIAM Journal on Imaging Sciences2014
Low Complexity Adaptive View Synthesis Optimization in HEVC Based 3D Video CodingSiwei Ma, Shiqi Wang, Wen GaoIEEE Transactions on Multimedia2014
Remote Image Fusion Based on PCA and Dual Tree Compactly Supported Shearlet TransformChang Duan, Qi Hong Huang, Xue Gang Wang, Shuai WangJournal of Information Hiding and Multimedia Signal Processing2014
Categorization of Various Methods for Quantitative Susceptibility Mapping (QSM) and Their Noise PropertiesShuai Wang, Tian Liu, Weiwei Chen, et alISMRM2013
Color Range Determination and Alpha Matting for Color ImagesZ. Luo, W. Wang, J. Zhao, L. YuIST2013
High-resolution Remote Sensing Image Segmentation Based on Improved RIU-LBP and SRMJian Cheng, Lan Li, Shuai Wang, Haijun LiuEURASIP Journal on Wireless Communications and Networking2013
Magnetic Susceptibility AnisotropyCynthia Wisnieff, Tian Liu, Pascal Spincemaille, Shuai Wang, et alNeuroImage2013
Mode Dependent Coding Tools for Video CodingSiwei Ma, Shiqi Wang, Qin Yu, Junjun Si, Wen GaoIEEE Journal of Selected Topics in Signal Processing2013
Parallel Fast Inter Mode Decision for H.264/AVC EncodingChen J, Villasenor J, Luo G, He YJournal of Visual Communication and Image Representation2013
A Pixel-Wise Directional Intra Prediction MethodWang Y, Chen J, He YJournal of Visual Communication and Image Representation2012
Adaptive Frequency Weighting for High Performance Video CodingChen J, Zheng J, Xu F, Villasenor JIEEE TCSVT2012
Efficient Video Coding Using Legacy Algorithmic ApproachesChen J, Xu F, He Y, et alIEEE Transactions on Multimedia2012
UMHexagonS Algorithm for MPEG Type-1 Video EncoderLi S, Chen J, He YJournal of Harbin Engineering University2011

专利清单 →