Multi-Modal Latent Variables for Cross-Individual Primary Visual Cortex Modeling and Analysis
Yu Zhu, Bo Lei, Chunfeng Song, Wanli Ouyang, Shan Yu, Tiejun Huang
摘要
Elucidating the functional mechanisms of the primary visual cortex (V1) remains a fundamental challenge in systems neuroscience. Current computational models face two critical limitations, namely the challenge of cross-modal integration between partial neural recordings and complex visual stimuli, and the inherent variability in neural characteristics across individuals, including differences in neuron populations and firing patterns. To address these challenges, we present a multi-modal identifiable variational autoencoder (miVAE) that employs a two-level disentanglement strategy to map neural activity and visual stimuli into a unified latent space. This framework enables robust identification of cross-modal correlations through refined latent space modeling. We complement this with a novel score-based attribution analysis that traces latent variables back to their origins in the source data space. Evaluation on a large-scale mouse V1 dataset demonstrates that our method achieves state-of-the-art performance in cross-individual latent representation and alignment, without requiring subject-specific fine-tuning, and exhibits improved performance with increasing data size. Significantly, our attribution algorithm successfully identifies distinct neuronal subpopulations characterized by unique temporal patterns and stimulus discrimination properties, while simultaneously revealing stimulus regions that show specific sensitivity to edge features and luminance variations. This scalable framework offers promising applications not only for advancing V1 research but also for broader investigations in neuroscience.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper3
- OmniMouse: Scaling properties of multi-modal, multi-task Brain Models on 150B Neural TokensKonstantin Friedrich Willeke, Polina Turishcheva, Alex Gilbert, Goirik Chakrabarty 等ICLR 2026 · 被引用 10 次
- Meta-Learning an In-Context Transformer Model of Human Higher Visual CortexMuquan Yu, Mu Nan, Hossein Adeli, Jacob S. Prince 等NeurIPS 2025 · 被引用 5 次
- Meta-Learning In-Context Enables Training-Free Cross Subject Brain DecodingMu Nan, Muquan Yu, Weijian Mai, Jacob S. Prince 等CVPR 2026 · 被引用 2 次
它引用的顶会 Paper12
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 被引用 35,902 次
- Learning identifiable and interpretable latent models of high-dimensional neural activity using pi-VAEDing Zhou, Xue-Xin WeiNeurIPS 2020 · 被引用 110 次
- Neural Data Transformer 2: Multi-context Pretraining for Neural Spiking ActivityJoel Ye, Jennifer L. Collinger, Leila Wehbe, Robert A. GauntNeurIPS 2023 · 被引用 100 次
- Generalization in data-driven models of primary visual cortexKonstantin-Klemens Lurz, Mohammad Bashiri, Konstantin Willeke, Akshay Kumar Jagadish 等ICLR 2021 · 被引用 71 次
- STNDT: Modeling Neural Population Activity with Spatiotemporal TransformersTrung Le, Eli ShlizermanNeurIPS 2022 · 被引用 40 次
相关 Paper
- Uncovering Semantic Selectivity of Latent Groups in Higher Visual Cortex with Mutual Information-Guided DiffusionYule Wang, Joseph Yu, Chengrui Li, Weihan Li 等ICLR 2026 · 被引用 1 次
- iMIND: Insightful Multi-subject Invariant Neural DecodingZixiang Yin, Jiarui Li, Zhengming DingNeurIPS 2025 · 被引用 3 次
- AVM: Towards Structure-Preserving Neural Response Modeling in the Visual Cortex Across Stimuli and IndividualsQi Xu, Shuai Gong, Xuming Ran, Haihua Luo 等AAAI 2026
- Accurate Identification of Communication Between Multiple Interacting Neural PopulationsBelle Liu, Jacob Sacks, Matthew D. GolubICML 2025
- A flow-based latent state generative model of neural population responses to natural imagesMohammad Bashiri, Edgar Y. Walker, Konstantin-Klemens Lurz, Akshay Kumar Jagadish 等NeurIPS 2021 · 被引用 31 次
