Обновить
3

Enterprise search

0,2
Рейтинг
Отправить сообщение

Корпоративная модель от IBM для задач, где нельзя ошибаться.

Granite 4.1 8B, нарисуй чебурашку по инструкции

Write a pristine, highly detailed adorable SVG of the character Cheburashka (the famous USSR cartoon toy). Follow these exact anatomical rules and precise SVG geometry layout: 1. Palette & Gradients: Use radial gradients extensively. Fur should be soft brown, transitioning from lighter brown (#68432a) in the center to darker brown (#3a2517) at the edges. The face should be a soft cream/peach gradient (#fdead1 to #f0cdab). 2. Huge Ears: Two very large perfect circles on the far left and right. Each ear has a thick lighter brown circular stroke/rim and a deeply recessed, extremely dark brown (#2e1c10) inner circle. 3. Head: A large perfect circle in the center, overlapping the inner edge of the ears. 4. Face: A slightly smaller perfect circle centered inside the head. Cream/peach color. 5. Facial Features: - Eyebrows: Thin arched brown curves above the eyes. - Eyes: Two black circles. Each eye MUST have TWO distinct white highlight circles (a larger one on the top-left, a tiny one on the bottom-right) to look cute and glossy! - Cheeks: Soft pink (#f4b1ae) blushing circles below the eyes. - Nose: A small dark brown rounded inverted triangle. - Mouth: A gentle reddish-brown smiling stroke curve. 6. Body: A vertical oval beneath the head. It has a large, very dark brown oval "belly" patch centered inside it. 7. Limbs: - Arms: Two small vertical ovals on the left and right sides of the body overlapping the edge. - Feet: Two small horizontal ovals overlapping the bottom of the body. Produce ONLY clean XML/SVG code block

Нарисовал...

Надо будет закинуть книгу в GPT для генерации /skill:stratum-* Или кто-то уже сделал?

Так статья - выжимка из видоса. Nice :)

Я давно юзаю Коэн-промт: продакшн-реди код гарантирован сами догадываетесь кем

Сорян, тут помочь не могу - просто читаю свою ленту, иногда что-то комментирую, чаще невпопад :)

Дошел в своей ленте до оригинала на русском. Понял смысл туннеля :) Меня на диаграмме смутил этот прокси-компонент, я подумал, что у вас какой-то магический сервер в облаке магически проксирует. А это “просто” хак для курсоровских серваков. Н-да… наверное очень хорошее IDE :)

Я задавал вопросы, смотря на диаграмму “Architecture”. Думал, что вам сразу станет понятно, о чём речь.

да что вы говорите :) Ну ладно, не хотите - не рассказывайте

Можнно подробнее про эту магию: Ungate proxy

  • зачем он

  • где он

  • почему нельзя сразу с юзерского места

Есть ссылка на гитхаб? :)

Посмотреть на счётчик эл энергии?

И опять стало интересно, а зачем слои на ветер выкидывать?..

Первое — таргетинг под потребительское железо. У DavidAU на странице есть 21B, 27B и 40B версии этой модели. Это веер под разные размеры VRAM, как линейка одежды. 21B — для 16GB.

Второе — нишевание. На Hugging Face десятки тысяч файнтюнов Qwen3.5-27B. «Просто ещё один тюн 27B» теряется. «21B-версия с уникальным размером» выделяется и легче находится.

Третье — эксперимент ради эксперимента. Сообщество мерджеров (DavidAU, Undi95, TheDrummer и т.д.) любит хирургию весов как самостоятельную дисциплину. Получается ли что-то хорошее — вопрос вторичный.

Четвёртое — продолжение экспериментов. Квантизация Q3_K_S от 27B даст похожую экономию памяти при меньшей деградации, чем pruning + distill. Многие именно так и считают — что depth-pruning потребительских моделей это путь сомнительной ценности, и предпочитают агрессивные кванты.

Но базовый Qwen3 идёт в размерах 0.6B, 1.7B, 4B, 8B, 14B, 32B, 235B

Если автор модели брал именно 3.5, то самая большая из маленьких 3.5 - всего 9B.

Update: стало интересно, поднапряг ИИ-друзей

Финальная честная строка — твой первый вопрос, теперь с фактической базой:

файнтюн-Qwen3.5-27B(VL,gated-DeltaNet+gated-attention,28B-параметров)-
с-выкинутыми-4-из-16-супер-блоков-до-48-слоёв-21B-
после-аблитерации-через-Heretic-
и-многоэтапного-тюна-через-Unsloth-на-художественных-данных-Deckard-
и-дистилляте-Claude-4.5-Opus-
thinking-режим-унаследован-от-базы

«Зачем вообще выкидывать слои» — на конкретно этом примере он становится острее. Удаляются не «избыточные» слои по метрикам важности, а четыре целых супер-блока подряд из регулярной структуры. Это самый грубый вид depth-pruning, и без хорошего восстановительного тюна качество должно проседать заметно. Что и пытаются компенсировать distill’ом на Claude-выводах. Но базовая Qwen3.5-27B на бенчмарках играет в одной лиге с GPT-5-mini и Claude Sonnet 4.5 на ряде задач — терять её 25% слоёв ради «характера» и скорости — спорный размен. Полученные 21B на reasoning-бенчах почти наверняка слабее исходных 27B; выигрыш — только в скорости/памяти и «расцензуренности» с творческим уклоном.

Исследовательский промпт на будущее
Расследование модели на Hugging Face. Только факты.

ОБЯЗАТЕЛЬНЫЕ ШАГИ (в этом порядке, до любых выводов):

1. web_fetch на страницу модели: huggingface.co/{author}/{model}
2. web_fetch на raw config.json: huggingface.co/{author}/{model}/raw/main/config.json
3. Если в карточке указана базовая модель — web_fetch её страницы и её config.json
4. Сравнить config'и побайтно: hidden_size, intermediate_size, num_hidden_layers,
   num_attention_heads, num_key_value_heads, head_dim, vocab_size, layer_types,
   model_type, architectures, rope_parameters, vision_config (если есть)

ЕСЛИ КАРТОЧКА ПУСТАЯ ИЛИ "coming soon":
- не выдумывать пайплайн
- использовать только: теги модели, датасеты в сайдбаре, имена связанных репо
- явно сказать, что README канонически пустой

ОТВЕТ СТРОГО ПО СХЕМЕ:

[БАЗА] — что точно, по совпадению config'ов. Если не совпадают — что не совпадает.

[АРХИТЕКТУРА] — dense/MoE, тип attention (full/linear/гибрид), число слоёв,
hidden, intermediate, GQA-ratio, контекст, vocab, мультимодальность (vision/audio
configs), MTP. Цифрами, не прозой.

[ПАРАМЕТРЫ] — реальное число (из HF "Model size" или прикидка из config'а).
Сверить с числом в названии модели. Если расходится — отметить.

[ЧТО СДЕЛАНО С БАЗОЙ] — depth-pruning / depth-upscaling / merge / SFT / DPO /
abliteration / quantization / distillation. По возможности — на сколько слоёв,
какие именно блоки.

[ДАТАСЕТЫ] — точные имена из сайдбара. Сверить с тем, что заявлено в названии.

[ИМЯ vs РЕАЛЬНОСТЬ] — таблица: каждая часть названия → подтверждено / маркетинг
/ неточно. Особенно: версии моделей (Claude 4.5 vs 4.6, Qwen3 vs 3.5),
размеры, заявленные техники.

[ЧТО НЕ ПОДТВЕРЖДЕНО] — явный список того, что я не смог проверить через config
или страницу. Без этого пункта ответ не закончен.

ПРАВИЛА:

- Никаких "скорее всего", "вероятно", "почти наверняка" без явной пометки [гипотеза].
- Цитата из карточки = в кавычках с указанием секции. Из сниппета поиска — пометить
  "из сниппета, не из канонической страницы".
- Если config.json недоступен — попробовать /raw/main/config.json напрямую,
  не сдаваться на gated-форме.
- Если число параметров в названии не сходится с реальным размером — сказать.
- Бенчмарки из карточки — приводить как есть, не комментировать "хорошо/плохо".
- Никаких рекомендаций, оценок "стоит/не стоит", прогнозов качества — если не спросил.

ССЫЛКА: {вставь URL модели}

никто не ответил, пришлось самому в issue идти: https://github.com/aaronsb/obsidian-mcp-plugin/issues/62

The “semantic” in the plugin name refers to the semantic MCP interface design - organizing tools by intent (vault, view, edit, graph) rather than exposing raw operations. It doesn’t (currently) imply vector embeddings.

Семантика 80 уровня.

Написал “semantic” - пиши какая модель для эмбеддингов.

Вбил, стало всё понятно!
Аишники
Аишники

Да хоспади, с этим т.н. нерогенезом пары нейронов-тормозов гиппокампе носятся уже столько лет как с писаной торбой, всё деньги у скруджев и скуперфильдов на продление жизни выколачивают. Нормальные ребята, я поддерживаю.

Вы поймите главное: мозг состоит из полей и подполей со своими функциями. Единственное что нас отличает от высших приматов - размер ассоциативных полей.

А там даже эти “учёные” не могут нейрогенез обнаружить при всём желании :)

И если вас Телеграф не устраивает, то может к Гитхабу больше доверия будет? :)

А кто будет поддерживать? :)

Ну так и подумайте надосуге. Посмотрите на ключевую ставку, на профицит / дефицит платёжного баланса с 90-х годов по данным таможенной службы. Я вот думал-думал, но только до одного додумался: это ж всё не спроста!

Информация

В рейтинге
3 005-й
Зарегистрирован
Активность