Learning Regional Monsoon Patterns with a Multimodal Attention U-Net

2509.23267v1 cs.CV, cs.AI, cs.LG 2025-10-01
Авторы:

Swaib Ilias Mazumder, Manish Kumar, Aparajita Khan

Резюме на русском

#### Контекст Область исследования — прогнозирование моносона на региональном уровне, в частности в Индии, где это задание имеет высокий практический значимость для сельского хозяйства, управления водными ресурсами и планирования климатной стратегии. Существующие проблемы включают недостаточность точности и частотности прогнозов, вызванных проблемами с данными почти наземных наблюдений и характером моносона. Мотивация заключается в создании модели, которая могла бы обрабатывать данные с высокой разрешностью и учитывать многообразие влияющих факторов, включая климатические, географические и социальные. #### Метод Методология основывается на multimodal attention U-Net, сочетающей методы сверточных нейронных сетей и мультимодального обучения. Модель обрабатывает семь ключевых геоспациальных модальностей: земное покрытие, NDVI (индекс видимого зеленого покрытия), температуру земной поверхности, влажность воздуха, объем ветра, высоту над уровнем моря и временные данные. Данные собраны за период с июня по сентябрь 2024 года. Архитектура включает элементы скрытых моделей внимания, которые позволяют модели учитывать интересные сегменты в данных. Функции потерь, такие как focal и dice loss, используются для корректной адаптации модели к неравномерности распределения классов распространения дождей, определяемых Индийской метеорологической департаментом (IMD). #### Результаты Експерименты проводились на новой 1-классовой датасете, разделенной на 5-классовые классы, включая 0 дороговесов, 1-10, 11-50, 51-100 и более 100 мм в месяц. Модель была протестирована на 5-классах регионов Индии. Результаты показали, что multimodal attention U-Net показывает высокую точность и способность распознавать резкие изменения в классах дождей. Она показывает лучшие результаты по сравнению с нейронными сетями U-Net и другими текущими моделями по обработке региональных моносонов, особенно в классах высокой интенсивности дождя. #### Значимость Приложениями модели являются сельское хозяйство, управление ресурсами воды и планирование экстремальных ситуаций, которые влияют на климатную устойчивость и безопасность жителей. Основные преимущества заключаются в точности, мультимодальности и возможности работы с высокочастотными данными. Будущие направления исследований могут включать расширение модели на другие регионы, а также интеграцию дополнительных модальностей, таких как данные от социальных сетей и ИИ. #### Выводы Предложенная модель показала состоятельность в анализе и прогнозировании региональных моносонов, особенно в класс

Abstract

Accurate monsoon rainfall prediction is vital for India's agriculture, water management, and climate risk planning, yet remains challenging due to sparse ground observations and complex regional variability. We present a multimodal deep learning framework for high-resolution precipitation classification that leverages satellite and Earth observation data. Unlike previous rainfall prediction models based on coarse 5-50 km grids, we curate a new 1 km resolution dataset for five Indian states, integrating seven key geospatial modalities: land surface temperature, vegetation (NDVI), soil moisture, relative humidity, wind speed, elevation, and land use, covering the June-September 2024 monsoon season. Our approach uses an attention-guided U-Net architecture to capture spatial patterns and temporal dependencies across modalities, combined with focal and dice loss functions to handle rainfall class imbalance defined by the India Meteorological Department (IMD). Experiments demonstrate that our multimodal framework consistently outperforms unimodal baselines and existing deep learning methods, especially in extreme rainfall categories. This work contributes a scalable framework, benchmark dataset, and state-of-the-art results for regional monsoon forecasting, climate resilience, and geospatial AI applications in India.

Ссылки и действия