Learning Regional Monsoon Patterns with a Multimodal Attention U-Net
2509.23267v1
cs.CV, cs.AI, cs.LG
2025-10-01
Авторы:
Swaib Ilias Mazumder, Manish Kumar, Aparajita Khan
Резюме на русском
#### Контекст
Область исследования — прогнозирование моносона на региональном уровне, в частности в Индии, где это задание имеет высокий практический значимость для сельского хозяйства, управления водными ресурсами и планирования климатной стратегии. Существующие проблемы включают недостаточность точности и частотности прогнозов, вызванных проблемами с данными почти наземных наблюдений и характером моносона. Мотивация заключается в создании модели, которая могла бы обрабатывать данные с высокой разрешностью и учитывать многообразие влияющих факторов, включая климатические, географические и социальные.
#### Метод
Методология основывается на multimodal attention U-Net, сочетающей методы сверточных нейронных сетей и мультимодального обучения. Модель обрабатывает семь ключевых геоспациальных модальностей: земное покрытие, NDVI (индекс видимого зеленого покрытия), температуру земной поверхности, влажность воздуха, объем ветра, высоту над уровнем моря и временные данные. Данные собраны за период с июня по сентябрь 2024 года. Архитектура включает элементы скрытых моделей внимания, которые позволяют модели учитывать интересные сегменты в данных. Функции потерь, такие как focal и dice loss, используются для корректной адаптации модели к неравномерности распределения классов распространения дождей, определяемых Индийской метеорологической департаментом (IMD).
#### Результаты
Експерименты проводились на новой 1-классовой датасете, разделенной на 5-классовые классы, включая 0 дороговесов, 1-10, 11-50, 51-100 и более 100 мм в месяц. Модель была протестирована на 5-классах регионов Индии. Результаты показали, что multimodal attention U-Net показывает высокую точность и способность распознавать резкие изменения в классах дождей. Она показывает лучшие результаты по сравнению с нейронными сетями U-Net и другими текущими моделями по обработке региональных моносонов, особенно в классах высокой интенсивности дождя.
#### Значимость
Приложениями модели являются сельское хозяйство, управление ресурсами воды и планирование экстремальных ситуаций, которые влияют на климатную устойчивость и безопасность жителей. Основные преимущества заключаются в точности, мультимодальности и возможности работы с высокочастотными данными. Будущие направления исследований могут включать расширение модели на другие регионы, а также интеграцию дополнительных модальностей, таких как данные от социальных сетей и ИИ.
#### Выводы
Предложенная модель показала состоятельность в анализе и прогнозировании региональных моносонов, особенно в класс
Abstract
Accurate monsoon rainfall prediction is vital for India's agriculture, water
management, and climate risk planning, yet remains challenging due to sparse
ground observations and complex regional variability. We present a multimodal
deep learning framework for high-resolution precipitation classification that
leverages satellite and Earth observation data. Unlike previous rainfall
prediction models based on coarse 5-50 km grids, we curate a new 1 km
resolution dataset for five Indian states, integrating seven key geospatial
modalities: land surface temperature, vegetation (NDVI), soil moisture,
relative humidity, wind speed, elevation, and land use, covering the
June-September 2024 monsoon season. Our approach uses an attention-guided U-Net
architecture to capture spatial patterns and temporal dependencies across
modalities, combined with focal and dice loss functions to handle rainfall
class imbalance defined by the India Meteorological Department (IMD).
Experiments demonstrate that our multimodal framework consistently outperforms
unimodal baselines and existing deep learning methods, especially in extreme
rainfall categories. This work contributes a scalable framework, benchmark
dataset, and state-of-the-art results for regional monsoon forecasting, climate
resilience, and geospatial AI applications in India.
Ссылки и действия
Дополнительные ресурсы: