Обновить
2K+
4
@yukakustread⁠-⁠only

Пользователь

2
Рейтинг
Отправить сообщение

Как я за выходные научил ИИ материться по команде, а потом превратил его в кота

Время на прочтение10 мин
Охват и читатели6.2K

Лонгрид про то, как ломается крошечная LLM, почему «первый токен решает всё», и как метрика дважды наврала мне в лицо

Читать далее

Дешёвая модерация анонимной стены: 3-слойный каскад и ROT13-джейлбрейк в проде

Уровень сложностиСредний
Время на прочтение3 мин
Охват и читатели8.4K

Построили модерацию для открытой анонимной мультиязычной стены — дешёвый каскад (regex → классификатор → LLM-судья → fallback), ≈$0 на API. И кто-то попытался обойти его ROT13-джейлбрейком, LLM-судья раскусил закодированную инъекцию, которую keyword-фильтр бы пропустил. Разбор архитектуры, экономики и того, что спросил r/selfhosted.

Читать далее

75 картинок ablation: как Reddit-критика заставила меня переосмыслить FLUX-LoRA пайплайн

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели9.6K

Запустил pinock.io — бесплатную ленту AI-генерации животных в стиле советских спичечных коробков. Под капотом FLUX.2-klein + кастомная LoRA + двухпроходный «sandwich»-пайплайн.

Получил детальный технический комментарий на r/StableDiffusion с тремя претензиями. Сел и прогнал ablation: 5 вариантов пайплайна × 5 категорий × 3 сида = 75 картинок.

Нашёл дыры в собственном пайплайне — в том числе кириллицу прямо в выходе LoRA (training-set leakage) и полный коллапс LoRA при scale=2.0. Текущий sandwich оказался патчем поверх плохо обученной LoRA, а не правильным решением.

В статье — все картинки, цифры, и почему оба «правильных» совета критика на текущей модели не сработали. Плюс план переобучения на 1500-датасете.

Читать далее

Информация

В рейтинге
Не участвует
Откуда
Польша
Дата рождения
Зарегистрирован
Активность