Обновить

Всё, Хабр, меня начал банить товарищ майор, причём шадоубаном.

Чтожж, это было весело. Наша любовь, хоть уже как и 18 существовала, но с начала войны мы пошли разными путями.

Так что - сайонара.

Я давно уже живу в США, и основные вещи пишу в твиттере, медиуме и телеге. Так что если кому-то нужно будет меня найти - ищите тама. Ссылки в профиле. Можно найти по нику.

Оно как бы и понятно, что скорее всего с первого Апреля я скорее всего и до Хабра не доберусь. Ну ок.

Я напоследок написал себе парсер, который аккуратно слил все мои комменты и статьи, которые я когда либо писал на Хабре. Так что, думается, некоторые вещи я переиздам, если будет кому-то надо.

Всем спасибо, я откланялся. Есть дела поважнее.

Теги:
Всего голосов 10: ↑3 и ↓70
Комментарии5

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Мы запустили полный checkpoint Qwen/Qwen3.8-Flash-Next на одной RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, без 4-битной квантизации и дистилляции. Использовался полный checkpoint в bf16, который генерировал обычные токены.

По сравнению с Opus 4.6 Max, согласно собственным данным Qwen:

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Публикации