← Publications

ICASSP 2026

BTCChat: Advancing Remote Sensing Bi-Temporal Change Captioning with Multimodal Large Language Model

A multi-temporal MLLM for bi-temporal change captioning that replaces naive image-pair concatenation with a dedicated change extraction module, while retaining single-image interpretation ability.

Yujie Li, Wenjia Xu, Yuanben Zhang, Zhiwei Wei, Mugen Peng

May 4, 2026ICASSP 2026Multimodal Large Language ModelsChange CaptioningRemote SensingDOIarXiv