1 bit is all we need: binary normalized neural networks

2509.07025v1 cs.LG, cs.AI, I.2.6 2025-09-12
Авторы:

Eduardo Lobo Lustoda Cabral, Paulo Pirozelli, Larissa Driemeier

Резюме на русском

## Контекст Настоящее исследование сосредоточено на проблемах, связанных с размером и вычислительной сложностью больших нейронных сетей, таких как модели языка и обработки изображений. Из-за их огромного размера, необходимость хранения большого количества данных и высокой расход ресурсов во время их использования препятствуют их эффективной развертываемости в реальных приложениях. Одной из целей этого исследования является разработка новых методов, которые позволят создавать модели с меньшим размером и низким вычислительным влиянием, при этом сохраняя высокую точность и эффективность. ## Метод Разработана новая технология, основанная на использовании 1-битных параметров в нейронных сетях. Новые слои, названные **binary normalized layers**, используют только два значения — 0 и 1 — для представления всех параметров, включая веса сверток и биасы. Эти слои являются оболочкой для существующих типов слоев (полносвязных, сверточных, атитнуциональных), но с небольшими модификациями. Для исследования эффективности этого подхода, разработаны две модели: модель для задачи классификации изображений с помощью сверточных и полносвязных слоев, и модель для задачи предсказания следующего символа в тексте с помощью трансформера с множественным вниманием. ## Результаты Экспериментальные испытания показали, что модели с бинарными нормализованными слоями показали результаты, которые в основном совпадают с результатами моделей, использующих обычные 32-битные параметры. Например, модель для классификации изображений демонстрирует почти такую же точность, как модель с 32-битными параметрами, при этом используя 32 раз меньше памяти. Также, модель для задачи предсказания текста показала эквивалентные результаты, уменьшая требования к памяти. Это демонстрирует эффективность нового подхода в сокращении размера моделей и уменьшении вычислительного влияния. ## Значимость Результаты демонстрируют, что 1-битные модели могут быть применены в различных областях, таких как мобильные приложения, IoT-устройства и даже нетрендовые компьютеры. Одним из основных преимуществ является значительное сокращение объема необходимой памяти (32 раз в сравнении с 32-битными моделями), что позволяет развертывать модели на устройствах с ограниченными ресурсами. Безусловным преимуществом является то, что 1-битные модели могут быть реализованы на существующем железе без необходимости разработки специальных аппаратных решений. ## Выводы Основным достижением является разработка нового типа нейронных сетей с 1-битными параметрами,

Abstract

The increasing size of large neural network models, specifically language models and foundational image models, poses deployment challenges, prompting efforts to reduce memory requirements and enhance computational efficiency. These efforts are critical to ensure practical deployment and effective utilization of these models across various applications. In this work, a novel type of neural network layers and models is developed that uses only single-bit parameters. In this novel type of models all parameters of all layers, including kernel weights and biases, only have values equal to zero or one. This novel type of models uses layers named as binary normalized layer. These binary normalized layers can be of any type, such as fully connected, convolutional, attention, etc., and they consist of slight variations of the corresponding conventional layers. To show the effectiveness of the binary normalized layers, two different models are configured to solve a multiclass image classification problem and a language decoder to predict the next token of a sequence. The model to solve the image classification has convolutional and fully connected layers, and the language model is composed of transformer blocks with multi-head attention. The results show that models with binary normalized layers present almost the same results obtained by equivalent models with real 32-bit parameters. The binary normalized layers allow to develop models that use 32 times less memory than current models and have equivalent performance. Besides, the binary normalized layers can be easily implemented on current computers using 1-bit arrays, and do not require the development of dedicated electronic hardware. This novel type of layers opens a new era for large neural network models with reduced memory requirements that can be deployed using simple and cheap hardware, such as mobile devices or only cpus.

Ссылки и действия

Связанные статьи

Deep Residual Echo State Networks: exploring residual orthogonal connections in ...

## Контекст Echo State Networks (ESNs) — это вид необученных Recurrent Neural Networks (RNNs) в контексте Reservoir Comp...

2025-09-02

Residual Reservoir Memory Networks

## Контекст Residual Reservoir Memory Networks (ResRMNs) — это новая класса необученных рекуррентных нейронных сетей (Re...

2025-08-15