Articles in press have been peer-reviewed and accepted, which are not yet assigned to volumes /issues, but are citable by Digital Object Identifier (DOI).
Editorial for Special Issue on Multimodal Learning, Temporal Modeling, and Foundation Models for Video Understanding
Yun Liu, Guolei Sun, Radu Timofte, Ender Konukoglu, Luc Van Gool
2026, 23(5): 931-933. DOI: 10.1007/s11633-026-1696-z
Abstract PDF SpringerLink Bib
Video Understanding: From Geometry and Semantics to Unified Models
Zhaochong An, Zirui Li, Mingqiao Ye, Feng Qiao, Jiaang Li, Zongwei Wu, Vishal Thengane, Chengzu Li, Lei Li, Luc Van Gool, Guolei Sun, Serge Belongie
2026, 23(5): 934-968. DOI: 10.1007/s11633-026-1656-7
Abstract PDF SpringerLink Bib
Self-supervised Video Depth Adaptation for Efficient Sparse-view NeRF
Jiatong Xia, Libo Sun, Ian Reid, Jia-Wang Bian
2026, 23(5): 969-979. DOI: 10.1007/s11633-025-1592-y
Abstract PDF SpringerLink Bib
GAPNet: A Lightweight Framework for Image and Video Salient Object Detection via Granularity-aware Paradigm
Yu-Huan Wu, Wei Liu, Zi-Xuan Zhu, Zizhou Wang, Yong Liu, Liangli Zhen
2026, 23(5): 980-997. DOI: 10.1007/s11633-025-1593-x
Abstract PDF SpringerLink Bib
Evaluating SAM2 for Video Semantic Segmentation
Syed Ariff Syed Hesham, Yun Liu, Guolei Sun, Jing Yang, Henghui Ding, Xue Geng, Xudong Jiang
2026, 23(5): 998-1011. DOI: 10.1007/s11633-026-1638-9
Abstract PDF SpringerLink Bib
Training-free Dense Video Captioning with Large-scale Pretrained Models
Yue Feng, Ziyi Yan, Yizhen Jia, Ethan Q. Chen, Jie Qin
2026, 23(5): 1012-1027. DOI: 10.1007/s11633-025-1585-x
Abstract PDF SpringerLink Bib
Multimodal Skeleton-based Action Representation Learning via Decomposition and Composition
Hongsong Wang, Heng Fei, Bingxuan Dai, Jie Gui
2026, 23(5): 1028-1040. DOI: 10.1007/s11633-025-1583-z
Abstract PDF SpringerLink Bib
Object-centric Video Prediction with Mask-guided Spatiotemporal Diffusion
Chenchen Han, Jiayi Fan, Na Wu, Jinpeng Dai, Hanbin Bao, Xiankai Lu
2026, 23(5): 1041-1051. DOI: 10.1007/s11633-025-1584-y
Abstract PDF SpringerLink Bib
SAMDistill: SAM-based Spatial-temporal Distillation for Robust 3D Object Detection
Zhaozhong Wang, Dian Shao, Lei Zhang, Zuowei Zhang, Binglu Wang
2026, 23(5): 1052-1067. DOI: 10.1007/s11633-025-1586-9
Abstract PDF SpringerLink Bib
DynaMix-VLT: Dynamic Multi-head Attention and Semantic-guided Modal Mixing for Robust Vision-language Tracking
Huanlong Zhang, Linjie Zhou, Liao Zhu, Fengli Shen, Jingjing Wu, Jianwei Zhang
2026, 23(5): 1068-1083. DOI: 10.1007/s11633-025-1605-x
Abstract PDF SpringerLink Bib
Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning
Qi Peng, Jiatong Li, Sirui Huang, Yiyang Jiang, Kaisong Gong, Ronger Ding, Shijie Ye, Changmeng Zheng, Yi Cai, Xiaobo Yang, Jin Huang, Xiao-Yong Wei, Qing Li
2026, 23(5): 1084-1121. DOI: 10.1007/s11633-026-1659-4
Abstract PDF SpringerLink Bib
M2SNet: Multi-scale in Multi-scale Subtraction Network for Medical Image Segmentation
Xiaoqi Zhao, Hongpeng Jia, Youwei Pang, Long Lv, Feng Tian, Lihe Zhang, Weibing Sun, Huchuan Lu
2026, 23(5): 1122-1144. DOI: 10.1007/s11633-026-1662-9
Abstract PDF SpringerLink Bib
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
Haokun Lin, Haobo Xu, Yichen Wu, Ziyu Guo, Renrui Zhang, Zhichao Lu, Ying Wei, Qingfu Zhang, Zhenan Sun
2026, 23(5): 1145-1161. DOI: 10.1007/s11633-025-1624-x
Abstract PDF SpringerLink Bib
Surviving Resource-constraint Compression: Capability Retention under Tensor-train Decomposition for Sub-billion Parameter Language Models
Mingxue Xu, Yao Lei Xu, Danilo P. Mandic
2026, 23(5): 1162-1177. DOI: 10.1007/s11633-026-1653-x
Abstract PDF SpringerLink Bib
OBSeg: Accurate and Fast Instance Segmentation Framework Using Segmentation Foundation Models with Oriented Bounding Box Prompts
Zhen Zhou, Junfeng Fan, Yunkai Ma, Sihan Zhao, Fengshui Jing, Shuo Wang, Min Tan
2026, 23(5): 1178-1193. DOI: 10.1007/s11633-025-1590-0
Abstract PDF SpringerLink Bib
A Reinforcement Learning-driven Transformer GAN for Molecular Generation
Chen Li, Huidong Tang, Ye Zhu, Yoshihiro Yamanishi
2026, 23(5): 1194-1215. DOI: 10.1007/s11633-025-1589-6
Abstract PDF SpringerLink Bib
StyleVideo: One-shot Image-guided Video Style Transfer
Xinyang Song, Xi Yong, Qi Li, Jianxin Sun, Yunfan Liu, Zhenan Sun
2026, 23(5): 1216-1228. DOI: 10.1007/s11633-025-1609-6
Abstract PDF SpringerLink Bib
    Global Visitors