Ssylka

Создание графа вычислений для глубокого обучения с нуля

В статье рассматривается реализация вычислительного графа на NumPy, аналогичного графу в PyTorch. Цель – глубже понять принципы работы нейронных сетей, отказавшись от использования готовых библиотек. Автор переходит от ручного вычисления градиентов к автоматическому, представляя вычисления в виде графа, где каждый узел хранит значение и локальные производные. Вводится класс Tensor, переопределяются основные математические операции (сложение, умножение, вычитание, деление, возведение в степень) для работы с графом.
Создание графа вычислений для глубокого обучения с нуля
Изображение носит иллюстративный характер

Ключевая идея – в каждом узле вычислять не только значение, но и производные. Для этого локальные градиенты хранятся в виде функций, которые могут применять chain rule для расчёта градиентов. Это позволяет автоматизировать вычисление градиентов для произвольных функций, построенных из базовых операций. Дополнительно реализуются матричное умножение, reshape, transpose, sum, softmax, и другие функции. Класс Tensor также позволяет отслеживать форму значений и предоставляет удобное представление значений.

После создания основных инструментов, реализуются слои Flatten, ReLU, Linear, и Conv2d, что позволяет строить несложные модели. Подробно рассматривается реализация свёрточного слоя на основе матричных операций и скользящих окон. В конечном итоге создаётся простая свёрточная сеть для обучения на MNIST, но возникают проблемы с обучением этой сети. В заключении показывается, что разработанный подход позволяет разобраться с каждой строчкой кода типичного примера обучения нейросети, и даже заметить, что import torch и torch.nn можно заменить на свою собственную библиотеку.


Новое на сайте

18666Почему мы отрицаем реальность, когда искусственный интеллект уже лишил нас когнитивного... 18665Химический след Тейи раскрыл тайну происхождения луны в ранней солнечной системе 18664Раскрывает ли извергающаяся межзвездная комета 3I/ATLAS химические тайны древней... 18663Масштабная кампания ShadyPanda заразила миллионы браузеров через официальные обновления 18662Как помидорные бои и персонажи Pixar помогают лидерам превратить корпоративную культуру 18661Как астероид 2024 YR4 стал первой исторической проверкой системы планетарной защиты и... 18660Агентные ИИ-браузеры как троянский конь новой эры кибербезопасности 18659Многовековая история изучения приливов от античных гипотез до синтеза Исаака Ньютона 18658Как выглядела защита от солнца римских легионеров в Египте 1600 лет назад? 18657Хакеры ToddyCat обновили арсенал для тотального взлома Outlook и Microsoft 365 18656Асимметрия безопасности: почему многомиллионные вложения в инструменты детекции не... 18655Как безопасно использовать репозитории Chocolatey и Winget, не подвергая инфраструктуру... 18654Масштабная утечка конфиденциальных данных через популярные онлайн-форматеры кода 18653Как расширение списка жертв взлома Gainsight связано с запуском вымогателя ShinySp1d3r 18652Как расширение Crypto Copilot незаметно похищает средства пользователей Solana на...