Обновить
0

Пользователь

0,2
Рейтинг
Отправить сообщение

Не пробовали изменить глубину размышлений? Доступны 4 настройки (xhigh, medium, low, nonе)

Устаревший, неустаревший, однако большинство моделей с ним не справляются. Для чистоты эксперемента, вот код который сгенерила модель для рендеринга указанной выше картинки (можно вставить в txt файл, поменять разрешение на svg и открыть любым просмоторщиком)

<svg xmlns="http://www.w3.org/2000/svg" xmlns:xlink="http://www.w3.org/1999/xlink"
     width="700" height="580" viewBox="0 0 700 580" role="img" aria-labelledby="title desc">
  <title id="title">Friendly pelican riding a vintage bicycle</title>
  <desc id="desc">Minimalist flat vector illustration of a white pelican with a big orange beak and a red scarf, pedaling a red vintage bicycle with fenders and a headlamp. Transparent background.</desc>

  <defs>
    <g id="wheel">
      <circle r="88" fill="none" stroke="#264653" stroke-width="12"/>
      <circle r="74" fill="none" stroke="#264653" stroke-width="3.5"/>
      <g stroke="#264653" stroke-width="3.5" opacity="0.85">
        <line x1="0" y1="-74" x2="0" y2="74"/>
        <line x1="-74" y1="0" x2="74" y2="0"/>
        <line x1="-52" y1="-52" x2="52" y2="52"/>
        <line x1="-52" y1="52" x2="52" y2="-52"/>
      </g>
      <circle r="9" fill="#264653"/>
    </g>
  </defs>

  <!-- Ground shadow -->
  <ellipse cx="400" cy="532" rx="235" ry="16" fill="#1E293B" opacity="0.10"/>

  <!-- Motion lines -->
  <g stroke="#264653" stroke-width="6" stroke-linecap="round" opacity="0.28">
    <line x1="96" y1="372" x2="146" y2="372"/>
    <line x1="78" y1="410" x2="142" y2="410"/>
    <line x1="96" y1="448" x2="146" y2="448"/>
  </g>

  <!-- Far-side leg and pedal -->
  <g>
    <path d="M360 292 C356 322 357 362 359 388" fill="none" stroke="#E08E2B" stroke-width="8" stroke-linecap="round"/>
    <rect x="347" y="385" width="30" height="10" rx="5" fill="#E08E2B" stroke="#264653" stroke-width="3"/>
    <line x1="390" y1="430" x2="361" y2="400" stroke="#1B2A38" stroke-width="7" stroke-linecap="round"/>
    <rect x="346" y="395" width="28" height="9" rx="4" fill="#1B2A38"/>
  </g>

  <!-- Wheels -->
  <use href="#wheel" xlink:href="#wheel" transform="translate(250 430)"/>
  <use href="#wheel" xlink:href="#wheel" transform="translate(550 430)"/>

  <!-- Chain -->
  <g stroke="#264653" stroke-width="3" opacity="0.75">
    <line x1="390" y1="411" x2="252" y2="421"/>
    <line x1="390" y1="449" x2="252" y2="439"/>
  </g>

  <!-- Frame -->
  <g fill="none" stroke="#E63946" stroke-linecap="round">
    <line x1="390" y1="430" x2="250" y2="430" stroke-width="7"/>
    <line x1="342" y1="304" x2="250" y2="430" stroke-width="7"/>
    <line x1="390" y1="430" x2="342" y2="304" stroke-width="9"/>
    <line x1="390" y1="430" x2="506" y2="308" stroke-width="9"/>
    <line x1="344" y1="302" x2="502" y2="306" stroke-width="9"/>
    <line x1="504" y1="300" x2="515" y2="333" stroke-width="13"/>
    <path d="M515 333 C528 362 542 395 550 430" stroke-width="8"/>
    <line x1="504" y1="300" x2="496" y2="262" stroke-width="8"/>
    <path d="M496 262 C494 246 486 236 470 232" stroke-width="8"/>
    <line x1="342" y1="304" x2="334" y2="282" stroke-width="7"/>
  </g>
  <circle cx="468" cy="231" r="5.5" fill="#264653"/>
  <circle cx="487" cy="239" r="5.5" fill="#FFD166" stroke="#264653" stroke-width="3"/>

  <!-- Fenders -->
  <g fill="none" stroke="#264653" stroke-width="8" stroke-linecap="round">
    <path d="M158 377 A106 106 0 0 1 342 377"/>
    <path d="M475 355 A106 106 0 0 1 625 355"/>
  </g>
  <circle cx="524" cy="357" r="8" fill="#FFD166" stroke="#264653" stroke-width="4"/>

  <!-- Saddle -->
  <path d="M258 272 Q304 254 350 263 Q361 267 353 276 Q304 285 274 281 Q261 278 258 272 Z" fill="#5A3825" stroke="#264653" stroke-width="3"/>

  <!-- Chainring and near pedal -->
  <circle cx="390" cy="430" r="20" fill="#C1272D" stroke="#264653" stroke-width="3.5"/>
  <circle cx="390" cy="430" r="4.5" fill="#264653"/>
  <line x1="390" y1="430" x2="420" y2="458" stroke="#264653" stroke-width="7" stroke-linecap="round"/>
  <rect x="402" y="454" width="36" height="10" rx="5" fill="#40566B"/>

  <!-- Near leg -->
  <path d="M372 270 C382 332 402 402 416 452" fill="none" stroke="#F5A623" stroke-width="9" stroke-linecap="round"/>
  <rect x="400" y="443" width="46" height="13" rx="6.5" fill="#F5A623" stroke="#264653" stroke-width="3"/>
  <line x1="434" y1="448" x2="443" y2="453" stroke="#264653" stroke-width="2.5" stroke-linecap="round"/>

  <!-- Pelican -->
  <path d="M268 196 C240 188 220 194 208 208 C220 206 232 210 240 218 C226 220 216 230 212 242 C224 236 236 238 244 246 C252 230 260 212 268 196 Z" fill="#FDFDFD" stroke="#264653" stroke-width="4" stroke-linejoin="round"/>
  <path d="M352 118 C415 118 448 165 448 215 C448 272 405 292 352 292 C300 292 258 268 258 215 C258 160 290 118 352 118 Z" fill="#FDFDFD" stroke="#264653" stroke-width="4.5" stroke-linejoin="round"/>
  <path d="M330 168 C285 175 262 215 272 248 C280 272 310 280 335 268 C355 258 362 232 355 210 C349 190 344 172 330 168 Z" fill="#E3EBF3" stroke="#264653" stroke-width="4" stroke-linejoin="round"/>
  <path d="M300 240 C310 246 322 248 332 244 M302 224 C312 230 324 232 334 228" fill="none" stroke="#264653" stroke-width="3" stroke-linecap="round" opacity="0.45"/>
  <circle cx="420" cy="95" r="46" fill="#FDFDFD" stroke="#264653" stroke-width="4.5"/>
  <path d="M402 52 C398 38 404 28 414 25 M418 50 C418 34 428 26 438 25 M434 53 C438 40 447 34 456 33" fill="none" stroke="#264653" stroke-width="4" stroke-linecap="round"/>
  <path d="M450 114 L583 108 C589 110 588 116 581 121 C545 169 480 171 452 132 C448 124 448 118 450 114 Z" fill="#F79A3E" stroke="#264653" stroke-width="4" stroke-linejoin="round"/>
  <path d="M450 84 L583 99 C591 101 591 107 583 109 L452 116 C446 102 446 96 450 84 Z" fill="#FFB84C" stroke="#264653" stroke-width="4" stroke-linejoin="round"/>
  <line x1="468" y1="96" x2="478" y2="99" stroke="#264653" stroke-width="3" stroke-linecap="round"/>
  <circle cx="428" cy="74" r="9.5" fill="#264653"/>
  <circle cx="431.5" cy="70.5" r="3.2" fill="#FFFFFF"/>
  <ellipse cx="437" cy="111" rx="8.5" ry="5" fill="#FFB4A2" opacity="0.85"/>

  <!-- Scarf -->
  <path d="M378 128 Q412 148 448 136 L443 156 Q410 168 384 148 Z" fill="#E76F51" stroke="#264653" stroke-width="3.5" stroke-linejoin="round"/>
  <path d="M384 148 C350 156 330 146 306 154 C290 159 279 168 272 180 L288 184 L276 196 C292 194 306 186 318 178 C336 166 358 164 378 168 Z" fill="#E76F51" stroke="#264653" stroke-width="3.5" stroke-linejoin="round"/>
</svg>

Для сравнения unsloth/Qwen3.6-27B-UD-Q8_K_XL.gguf 

У меня с первого раза вышел зачетный пеликан на велике :))) Модель unsloth/Qwen3.8-27B-UD-Q8_K_XL.gguf , промпт: "Generate clean SVG code for a whimsical illustration of a friendly pelican riding a vintage bicycle, transparent background, minimalist vector style "

unsloth/Qwen3.8-27B-UD-Q8_K_XL.gguf , 2х RTX3090. Промпт: "Generate clean SVG code for a whimsical illustration of a friendly pelican riding a vintage bicycle, transparent background, minimalist vector style  "
unsloth/Qwen3.8-27B-UD-Q8_K_XL.gguf , 2х RTX3090. Промпт: "Generate clean SVG code for a whimsical illustration of a friendly pelican riding a vintage bicycle, transparent background, minimalist vector style "

Ну в разрешении 480р 10 секундный ролик генерируется чуть меньше 10 минут. Просто с ростом разрешения длительность генерации увеличивается в геометрической прогрессии:))

"Разрешение при self-host упирается в 768p" - максимальное разрешение при self-host 1920*1080. У меня на rtx3090 генерация 15 секундного видео в таком разрешении заняло почти 3 часа

Как пользователь двух rtx3090 именно для локальных LLM уточню: если не использовать nvlink и разделять модель Qwen3.6-27b q8-k-xl по слоям, то скорость генерации будет около 40-50 токенов в сек, но GPU не будут загружены на 100% (загрузка будет попеременно скакать) и реальное потребление энергии будет около 500 Вт. При этом действительно дорогой компьютер не нужен, LLM работает с такой скоростью даже на материнках с PCIE 3.0 и даже в режиме PCIE 4x.

Но при этом хочу сказать, что с каждым днём убеждаюсь, что Qwen3.6-27b q8-k-xl - это исключительно удачная локальная модель, можно даже сказать шедевр локального моделестроения:)) Многими недооцениваемая. После того как я облепил ее самописными (с ее помощью) MCP-серверами и инструментами, адаптированными под мои задачи, а также сформировал и постоянно пополняю для модели базу знаний о моей инфраструктуре и окружении, она вдруг резко стала на порядок более умной и компетентной:))

При чем тут вообще аппаратная часть? Вы даёте новичкам откровенно устаревшую и не актуальную информацию. Если у человека видеокарта на 16 гигабайт, то это не причина рекомендовать ему устаревшие модели. Современная модель типа Qwen3.6-35b-a3b q4 будет на 16 гигабайтах работать гораздо лучше чем старые модели, как по скорости, благодаря MTP и грамотному переводу части MoE слоев на CPU, так и несравнимо лучше по качеству ответов.

Вот ваше утверждение "для вайбкодинга лучше и дешевле облачные решения" как раз и следствие того, что вы оперирует устаревшей информацией, не имеете достаточного опыта работы с современными моделями и с современными приемами выстраивания пайплайна для работы с такими моделями. Локальный вайбкодинг сейчас - это про грамотную настройку агентов и инструментов, использование правильных MCP. Это конечно намного сложнее чем просто дать команду "напиши код...".

Посмотрел по ссылке. Информация по моделям давно неактуальная и устаревшая. Для кодинга рекомендовать Qwen 2.5 Coder, серьезно?

Ваши цифры без указания настроек запуска ничего не говорят. Какое квантование кэшей? Какие бетчи?

Ну взять например ваше утверждение, что "Gemma4 26B-A4B памяти на контекст требует в разы больше, чем Qwen3.6 35B-A3B". Размер памяти под контекст это математическая величина, которую можно рассчитать по формуле (llama.cpp это делает при старте и заранее выделяет требуемый размер памяти). Контекст у Qwen3.6 действительно занимает меньше места, за счёт своей архитектуры, но эта разница не в разы. За счёт того что сама модель Qwen3.6 на 35 млрд параметров, а Gemma на 26, то она весит больше, то итоговое потребление памяти (модель+контекст) примерно одинаковое

С помощью параметра --n-cpu-moe, конкретное количество слоев определяется опытным путем, в зависимости от модели и железа

Качество ответа зависит от квантования модели, от квантования кэша, от формулировки задачи (промпта), от прочих настроек, включая температуру. Может быть выбрав правильные настройки вы с удивлением обнаружите, что в большинствое предыдущих случаев вы просто делали это не правильно?

Извините, но Ваше сообщение говорит о том, что Вам нужно подтянуть матчасть. Почти все категоричные утверждения некорректны.

Количество активных параметров указано в названии MoE модели. Qwen3.6-35b-A3b означает что из 35 миллиардов параметров активных 3 миллиарда (А3b - active 3 billions)

Ага только какое отношение к модификации PS1 имеет скриншот с эмулятора Duckstation?

А как vision функции и общие знания мешают в агентских задачах? Несмотря на то что Qwen3.6 универсальная модель она агентские задачи все равно решает лучше.

То что "модель NorthMiniCode в отличие от Qwen специально заточена под агентские циклы" не делает ее лучше Qwen в агентских сценариях. Странный выбор модели учитывая что Qwen3.6 гораздо лучше.

Локальный qwen3.6-27b справился получше

Информация

В рейтинге
2 927-й
Зарегистрирован
Активность