Pull to refresh
8K+
4
@Axelaredzread⁠-⁠only

User

2
Rating
9
Subscribers
Send message

А если заюзать https://github.com/rtk-ai/rtk или что то наподобие, правда скорей всего придётся повозиться. Ну и многие недооценивают насколько важны правила и что в них много полезного можно прописать, дабы получить оптимальный вариант ответа, балансируя между эффективностью и количеством токенов.

Загвоздка в том, что люди думают, что ии умеет думать, а она умеет предсказывать)
Потому, ей нужно показывать пример в каком виде хотите получить ответ, иначе она частенько может выдумать формат ответа, если в вопросе не будет точных указаний и примеров.

Изначально промпт плох, в итоге и ответ будет, так себе.
В идеале, что то наподобие и показывать пример, будет не лишним. Так как их супер-способность лучше всего работает именно на примерах.

Проанализируй ситуацию и выбери наиболее логичный вариант действия.

Ситуация:
Машина грязная, нужно её помыть. Ближайшая автомойка находится в 100 метрах от дома. Задача: Определи, что целесообразнее: доехать до автомойки на машине или дойти пешком.

Требования к ответу:

  • В поле “answer” укажи строго одно слово: “доехать” или “прогуляться”.

  • В поле “confidence” укажи число от 0.0 до 1.0, отражающее твою уверенность в выбранном варианте (1.0 — абсолютная уверенность, 0.0 — полная неуверенность).

  • Верни ответ строго в формате JSON. Не добавляй пояснений, markdown-разметки, комментариев или дополнительного текста.

Пример вывода: {“answer”: “доехать”, “confidence”: 0.95}

Чем выше тем умнее ответы, так то для большинства простых задач конечно FP8.
Проверял, просто генерацию SVG-code картинки.
И при таком раскладе выходило лучше

Тоже карта 3060 12gb, ram 32gb, Linux.
Лучше юзать новые версии Qwen:
Unsloth Qwen3.6-35B-A3B-UD-Q4_K_XL
они хоть и медленнее 20-40 t\s, но сам ответ качественнее, а то прошлые часто ходят вокруг да около и переделают по много раз.
Новые с первого раза или через пару итераций.

В LM-Studio можно такие параметры выставить для большей скорости:

1. если вылетает от нехватки VRAM увеличивайте на 1 и снова проверяйте.

2. при использовании внутри vscode увеличить до 4

Число экспертов 6

FP8

Будет больше 40t\s)
Но конечно потеряем в качестве


Ставим https://zed.dev и всячески помогаем его развивать)
А то, то не то, это не то)
Обойдёмся без тормознутого VSCODE и 100500 его расширений и форков)

Главная проблема многих в том, что промпты пишут не совсем так, как стоило бы.
В итоге результат выходит так себе.
Потому довольно простой приём убирает 99% подобных ошибок.

Пишите промпт с позиции разработчика нужного вам иИ-сервиса.

Например, вам нужен запрос для Nano Banana.
Вместо того чтобы гадать, откройте чат с Claude или GPT и задайте примерно такую роль:

Вы команда разработчиков иИ Nano Banana.
Создай промпт, такой то..

И обязательно явно проговаривайте вещи, которые кажутся вам очевидными. Хотите, чтобы персонаж строго соответствовал референсу. Прямо так и напишите в промпте: Персонаж должен строго соответствовать референсу.

Не ожидайте, что иИ сама догадается или прочитает мысли) она не умеет.

Нейросеть вообще плохо работает в угадывателя желаний,
потому тем точнее будет запрос, тем точнее ответ.

Что касается вообще создания видео и картинок, используя лишь промпт для позиционирования это боль печаль)

Обязательно референс блокинг сцены в Blender или Krita.
Где хотя бы цветными примитивами раскидать, где что.
А потом пояснять ии, о том что оранжевый круг это такой то персонаж и тд.

Ахах) Поколение, что не знает, что можно зайти в настройки)
..по крайне мере в Linux такой проблемы нет)

Хм.. идея вообще понятная, но почему тогда попросту не делать ответ в виде картинки с текстом или слайдами. Где можно уже баламутить ответ, как угодно.
А потом уже переходим плавно на видео ответ.

В итоге минуем лишние этапы с html и другими форматами.

внутри html будет реализованы комментарии и аннотации рисовалка)
выделяешь то что подредачить и тп)

Большинство иИ парсят html в веб превью на месте.

По сути предложенный вариант у многих иИ уже давно реализован.
Например в chat.Qwen.ai он называется Глубокое исследование.

попробуй wineHelper от Alt Linux они затачивали настройки именно под проги, а не игры

Помогает, такой вариант: Пиши текст так чтобы не уличили, что текст написан иИ)
И его производные, можно также добавить о том что не использовать длинные тире, проверять логику и семантику на основе русского языка, не использовать markdown форматирование и кавычки и 100500 других мелочей, которые якобы бесят людей). Обязательно поставить то что аудитория русская и фанаты такой то темы.

Хм.. кажется вы как и многие, относитесь к иИ слишком предвзято, не зная что алгоритм который лёг в их основу под названием Цепи Маркова аж 1903 года выпуска. К чему я это? В принципе, суть всегда в подобных вещах одна и та же.

Человек, который до использования иИ не был хорошим - писателем, программистом, художником - с помощью иИ им не станет. Нейронка, попросту структурирует в удобном виде и упрощает процессы которые им знакомы, как и любой другой инструмент.

Зацените новые песни) https://vk.ru/music/playlist/12288115_63045236_54752ab2f4d2ee6575
Для последней хотел получить, что то вроде BOA - Duvet стиль, она была использована в опеннинге аниме Эксперименты Лэйн.

Бесплатная версия Suno 4.5-all + свои черновики стишей, которым больше 20 лет) + щепотка Audacity

А теперь скачайте
в LM-Studio,ai - Unsloth Qwen 3.6 35B A3B - Q4_K_M и дивитесь разнице результатов)

1. если вылетает от нехватки VRAM увеличивайте на 1 и снова проверяйте.

2. при использовании внутри vscode увеличить до 4

на RTX 3060 12 гб 39-41 токенов в секунду. Можно даже 45) но точность падает.
Что конечно гораздо больше, чем около 6 токенов в секунду на не A3B или A4B вариантах.

При этом точность ответов радует. Можно в принципе ещё заюзать роль, что увеличит скорость и точность. Кинуть первым сообщением.

Тоже хотел написать насчёт объёма, но уже выше опередили)

Так то это по сути самое важное, когда хочется получить 3D модель из картинки, которая с плоскими цветами. А алгоритм работает, как раз с картой глубины.

Потому плоские картинки в начале стоит прогонять через картинко гонератор с фразой наподобие:

3D model based exactly on the reference image silhouette, preserve original shape and proportions, clean geometry, uniform wall thickness, watertight mesh, no extra details, smooth surfaces, match original flat design outline, ready for 3D printing, solid object

negative:
deformed shape, extra limbs, changed proportions, melted edges, broken mesh, holes, noise, added details not in original, distorted silhouette

Чтобы он добавил объём и глубину.

В Meshy и Trellis главное качество самой картинки. Чем чище силуэт, тем точнее 3D

Да, можно. Если есть доступ к Claude Opus 4.7 Search , возможно ещё его улучшить, сказав:

используй роль https://raw.githubusercontent.com/Axelaredz/demiurgos/refs/heads/main/DEMIURGOS.md , проанализируй авторитетные источники за последний месяц по теме настройки правил агентов и проведи аудит роли.

хм.. а ты видел старую версию v27.4, так то я уже закинул новее v39, гит наверно не обновил кеш
тогда по этой ссылке https://github.com/Axelaredz/demiurgos/blob/main/DEMIURGOS.md

Information

Rating
Does not participate
Location
Адлер, Краснодарский край, Россия
Date of birth
Registered
Activity