Рисовать картинки по промту можно и на одной видеокарте, по 1-8 часов на картинку :) тема которая тут не раскрыта: параметрически указанный размер контекста `-ctx` для кодящих моделек. У меня от tesselate модель - опрятно работает, но требует в два-три раза больше (чем стоковый qwen3.5 от alibaba) памяти ГПУ на контекст
Рисовать картинки по промту можно и на одной видеокарте, по 1-8 часов на картинку :) тема которая тут не раскрыта: параметрически указанный размер контекста `-ctx` для кодящих моделек. У меня от tesselate модель - опрятно работает, но требует в два-три раза больше (чем стоковый qwen3.5 от alibaba) памяти ГПУ на контекст
Есть ощутимая разница в производительности, не в пользу ollama