Pull to refresh
4K+
6
Матвей Сапрыкин@Vtmpas

User

20
Rating
1
Subscribers
Send message

Учим небольшую LLM с нуля: гибридное внимание, XSA, доменные бленды и загадки роста онлайн-бенчмарков

Level of difficultyMedium
Reading time18 min
Reach and readers7.7K

Обучение LLM — это в первую очередь инфраструктурная задача: нужен пайплайн, который можно перезапускать с новыми данными, архитектурой или другим расписанием обучения и получать повторяемый внутри команды результат. В этом материале — рассказ команды обучения и инференса моделей RWB о том, как мы с нуля, без загрузки pretrained-весов, обучили текстовую модель на основе гибридной архитектуры Qwen3.5-2B-Base и какие выводы сделали по пути — от сборки датасетов до чтения графиков онлайн-оценки.

Читать далее

Information

Rating
450-th
Registered
Activity

Specialization

ML Tech Lead LLM Pre-training and Alignment
Ведущий
Python
Git