Pull to refresh
0
Aleksander@PUSH_CA

User

Send message

спасибо, добавили уверенности и сам собрал модель на Q6 , весит < чем модель от unsloth. Думаю, что теперь всегда буду сам собирать модели.

ещё собрал sh файл для этого, может кому-то пригодится :

#!/bin/bash

# Путь к папке llama.cpp (измените, если проект лежит в другом месте)
LLAMA_DIR="/path/llama.cpp"

# 1. Проверяем, существует ли виртуальное окружение по абсолютному пути. Если нет — создаем.
if [ ! -d "$LLAMA_DIR/.venv" ]; then
    echo "Создаем виртуальное окружение в $LLAMA_DIR/.venv..."
    python3 -m venv "$LLAMA_DIR/.venv"
    
    echo "Активируем и устанавливаем зависимости..."
    source "$LLAMA_DIR/.venv/bin/activate"
    pip install --upgrade pip
    
    # Установка зависимостей, необходимых для convert_hf_to_gguf.py
    if [ -f "$LLAMA_DIR/requirements.txt" ]; then
        pip install -r "$LLAMA_DIR/requirements.txt"
    else
        # Если requirements.txt не найден, ставим базовый набор для конвертации
        pip install torch torchvision torchaudio transformers sentencepiece safetensors gguf
    fi
else
    # 2. Если уже существует, просто активируем по абсолютному пути
    source "$LLAMA_DIR/.venv/bin/activate"
fi

# 3. КОНВЕРТАЦИЯ
python "$LLAMA_DIR/convert_hf_to_gguf.py" \
  /path/qwenHF/Qwen3.8-27B \
  --outfile /path/qwenHF/out_model/Qwen3.8-27B-F16.gguf \
  --outtype f16

# 4. КВАНТОВАНИЕ
"$LLAMA_DIR/build/bin/llama-quantize" \
  path/qwenHF/out_model/Qwen3.8-27B-F16.gguf \
  path/qwenHF/out_model/Qwen3.8-27B-Q4_K_M.gguf \
  Q4_K_M

Желаю только развития ребятам! ✨

Это направление сейчас нужно как воздух. Мечтаю о мощном карманном компьютере в котором я не забанен.

Information

Rating
5,752-nd
Location
Россия
Date of birth
Registered
Activity