Обновить

Своя GPT-like LLM по WH40K с нуля. Часть 3: собираем и обучаем LLM (pre-train)

Уровень сложностиПростой
Время на прочтение15 мин
Охват и читатели8.2K
Всего голосов 6: ↑6 и ↓0+8
Комментарии1

Комментарии 1

Такие проекты отлично показывают, что открытый код модели — лишь половина свободы. Вторая половина — доступные вычисления для обучения и инференса. К этому аргументу стоит добавить разбор про то, как Gonka пытается распределить именно этот слой (https://youtu.be/_uwgrHV_li0?r=1081)

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации