спасибо, добавили уверенности и сам собрал модель на Q6 , весит < чем модель от unsloth. Думаю, что теперь всегда буду сам собирать модели.
ещё собрал sh файл для этого, может кому-то пригодится :
#!/bin/bash
# Путь к папке llama.cpp (измените, если проект лежит в другом месте)
LLAMA_DIR="/path/llama.cpp"
# 1. Проверяем, существует ли виртуальное окружение по абсолютному пути. Если нет — создаем.
if [ ! -d "$LLAMA_DIR/.venv" ]; then
echo "Создаем виртуальное окружение в $LLAMA_DIR/.venv..."
python3 -m venv "$LLAMA_DIR/.venv"
echo "Активируем и устанавливаем зависимости..."
source "$LLAMA_DIR/.venv/bin/activate"
pip install --upgrade pip
# Установка зависимостей, необходимых для convert_hf_to_gguf.py
if [ -f "$LLAMA_DIR/requirements.txt" ]; then
pip install -r "$LLAMA_DIR/requirements.txt"
else
# Если requirements.txt не найден, ставим базовый набор для конвертации
pip install torch torchvision torchaudio transformers sentencepiece safetensors gguf
fi
else
# 2. Если уже существует, просто активируем по абсолютному пути
source "$LLAMA_DIR/.venv/bin/activate"
fi
# 3. КОНВЕРТАЦИЯ
python "$LLAMA_DIR/convert_hf_to_gguf.py" \
/path/qwenHF/Qwen3.8-27B \
--outfile /path/qwenHF/out_model/Qwen3.8-27B-F16.gguf \
--outtype f16
# 4. КВАНТОВАНИЕ
"$LLAMA_DIR/build/bin/llama-quantize" \
path/qwenHF/out_model/Qwen3.8-27B-F16.gguf \
path/qwenHF/out_model/Qwen3.8-27B-Q4_K_M.gguf \
Q4_K_M
спасибо, добавили уверенности и сам собрал модель на Q6 , весит < чем модель от unsloth. Думаю, что теперь всегда буду сам собирать модели.
ещё собрал sh файл для этого, может кому-то пригодится :
Желаю только развития ребятам! ✨
Это направление сейчас нужно как воздух. Мечтаю о мощном карманном компьютере в котором я не забанен.