Обновить

— Как нам аудиторию удерживать? Как повысить вовлеченность клиентов?

Сотни людей в тысячах команд по всему миру как в болоте вязнут и буксуют над этим вопросом.

В попытках найти ответ они, как средневековые алхимики, проводят тысячи экспериментов по превращению воды в вино. Философский камень ищут, не иначе.

Таск-трекеры пухнут от тикетов. Десятки встреч на дню: на одних пытаются понять, какой гипотезе дать зеленый свет; на других обсуждают – что этот зеленый свет нам показал. Сгорают на этих встречах, выраженные в человеко-часах, миллионы денежных знаков. А результат действий до смешного похож на бородатый анекдот про секс в резинке: движение есть – а результата нет.

Ладно-ладно. Результат безусловно какой-то есть. Только вот не тот, как всем хочется. А хочется понятно чего – того, что можно было бы смело назвать “huge success”. То есть статистически значимого роста показателей. Хотя бы на 10-15%. А лучше на все 30%.

Прекрасно вас понимаю. Одни и те же сны смотрим.

Расскажу историю про исчезающий интерес. И как его побороли.
...
Продолжение в свежей статье.

Теги:
Рейтинг0
Комментарии0

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Мы запустили полный checkpoint Qwen/Qwen3.8-Flash-Next на одной RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, без 4-битной квантизации и дистилляции. Использовался полный checkpoint в bf16, который генерировал обычные токены.

По сравнению с Opus 4.6 Max, согласно собственным данным Qwen:

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Публикации