Разработчик реализовал крошечную языковую модель с нуля на Node.js, включая нейроны, автоград, самовнимание и обратное распространение ошибки, без использования TensorFlow или PyTorch.

В переводе статьи описывается создание крошечной языковой модели с нуля на чистом Node.js. Автор реализовал нейроны, автоград, эмбеддинги, механизм самовнимания, полносвязную сеть, обратное распространение ошибки и SFT, а в процессе обучения показал, как меняются отдельные веса и матрицы. Это образовательный проект для лучшего понимания работы трансформеров, а не новая версия GPT.

Источники 1
  • Создание крошечной языковой модели на чистом Node.js без фреймворков Habr AI
    [Перевод] Языковая Модель без магии: Крошечная Language Model на чистом Node.js
    
    Мы создаем крошечную языковую модель с нуля на чистом Node.js без использования TensorFlow или PyTorch, реализуя нейроны, автоград, эмбеддинги, механизм самовнимания (self-attention), полносвязную сеть (FFN), обратное распространение ошибки и SFT, одновременно наблюдая за тем, как отдельные веса и целые матрицы изменяются в процессе обучения Это не новая GPT и не прод ML...
    
    #machinelearning #machine_learning #backpropagation #self_attention #autograd #nodejs #javascript #sft #нейронная_сеть #transformer | @habr_ai