KDD·2026A Multi-Stage Structural Captioning Framework for Enhancing Chinese Image-to-Video Generation in BaiduLei Shen, Zhipeng Jin, Xiawei Li, Wen Tao, Shiyuan Li, Yi Yang, Cong Han, Shuanglong Li, Zhongmin Cai, Lin LiuDOI出版方