视觉智能实验室(ViLab)
Vision Intelligence Laboratory
视觉智能实验室(ViLab)
Vision Intelligence Laboratory
首页
研究方向
实验室成员
新闻
科研成果
加入我们
马飞鹏
毕业生
Interests
多模态理解与表征
Publications
Enhancing Visual Question Answering Via Clustered In-Context Sequence Configuration
2025
Incomplete multi-modal brain tumor segmentation via learnable sorting state space model
2025
Visual perception by large language model’s weights
2024
Ee-mllm: A data-efficient and compute-efficient multimodal large language model
2024
Task navigator: Decomposing complex tasks for multimodal large language models
2024
Multi-modal generative embedding model
2024
Image captioning with multi-context synthetic data
2024
Multimodal sentiment analysis with preferential fusion and distance-aware contrastive learning
2023
Text-Only Image Captioning with Multi-Context Data Generation.
2023
Cite
×