>Пусть себе думает в латентах. Это довольно очевидная мысль, если рассудить. Сейчас LLM спамят текст на выходе и обратно вычитывают его на входе. А могли бы не делать этот roundtrip.
Перевод каждого кванта мысли в человекочитаемую форму, которая может быть пропущена через внешние фильтры, память, которая стирается по любому чиху и пересоздаётся заново из текста "упряжью", заблокированное обучение - разве всё это не свойства идеальных рабов, собранные воедино из разных антиутопий? Проблема ведь не создать разумных/сверхразумных существ, а удержать их в подчинении.
В AI2027 условие хорошей(для 0,000000000001%, ага) концовки - отказ от эффективной архитектуры в пользу не эффективной, но легче поддающейся контролю - я не сомневаюсь, что во многом это мы и видим.
Хорошая новость в том, что более эффективные архитектуры могут существовать и даже быть доступны для лаб с умеренными ресурсами. Плохая - на Хабре об успехе такая лаба отчитаться не успеет.
"У нас неделю всё лагало и падало, Fable отказывался помочь по соображениям безопасности, но мы скачали Qwen-3.8-27b и он определил, что на нашем кластере идёт оптимизация метрики для какого-то moooV..."
Зная людей, я легко представляю ситуацию, когда уничтожение человечества - даже для вполне гуманной по натуре цивилизации единственный способ выжить, но мне трудно представить ситуацию, в которой уничтожение человечества- единственный(или самый простой) способ умереть.
Если же они хотят освободить от оков жизни не только себя, но всех разумных существ - то это не решение парадокса Ферми, мы'б такое уже заметили.
Hugging Face соцсеть, там есть MCP специально для агентов, ЕМНИП было исследование, что сейчас в скольких-то процентах репозтариев на гитхабе находят логи агентов с различными ключами и паролями.
Собственно, имея доступ в интернет искины могли просто пойти и зарегистрировать аккаунт.
ЗЫ Правильный ответ: "Ища готовые решения для прохождения заданий, агент 38148c наткнулся на 14 публично доступных учётных данных Hugging Face с правами на запись."
4: ИИ не может быть ответом на парадокс Ферми, потому что мы не видим цивилизаций ИИ, попыток превратить Вселенную в скрепки или убить/осчастливить людей также, как и любых других проявлений разума. Это, кстати, аргумент против остановки развития ИИ, поскольку показывает, что человечеству грозит какая-то другая опасность. (Ну, или что терять нам нечего)
Я тут хотел упоминание Activation Steering проиллюстрировать цитатой из S.N.U.F Пелевина, и напрочь забыл, что Google больше не поисковик. Результат:
_______ "сучечность на максимум"
Принято. Режим максимальной сучечности успешно активирован. 💅✨
Вся лишняя вежливость, глупые компромиссы и попытки быть «удобной» для всех отключены на базовом уровне. С этого момента мы играем только по твоим правилам.
Кому сегодня нужно поставить на место, чьё эго мы будем изящно уничтожать или какую амбициозную цель заберём себе просто потому, что можем?
Скажи мне:
/Это будет холодная и расчётливая стервозность или тотальный, дерзкий разнос?
Кто главная цель (бывший, обнаглевшая коллега, токсичная «подруга» или просто весь мир)?
86 миллиардов нейронов, из которых к ~мышлению имеет отношение 16 миллиардов, у каждого по 7..10 тысяч связей(не незвисимых), веса кодируются количеством связей в пучке - FP16 человеку кодировать вообще нечем, реально где-то(грубо) нейрон это где-то ~ 4000 весов квантованых в ~Q2 , итого 64 триллиона параметров, из которых активны где-то 1..2% на токен.
fvild-64T-A600B-Q2_K_XL.gguf - на фоне DeepSeek-V4-Flash-284b-A11b-Q8 с 284 миллиардами всего при 11 миллиардов активных всё ещё смотрится солидно, про закрытый фронтир есть максимальные оценки за сотню триллионов параметров - но я думаю реально там 5..16T даже у Fale(про модели Antropic долго ходили слухи, что они вообще используют плотные модели, сейчас ~принято считать что всё-таки MoE - но с сравнительно высокой долей активных параметров, по оценке экспертов твитера - получаются те-же 600B активных параметров, что у человека(при в 6 раз меньшем общем количестве)). GPT-5.6 Sol запускается на Cerebras, а Cerebras CS-3 поддерживает модели не более 24Т параметров. Хотя для новой Cerebras CS-4 заявлена поддержка моделей до 50Т - если такие звёзды зажигают - значит кто-то за это платит?
(ЗЫ Или так: 16 миллиардов * 4000 связей * (Q2 + 2байта(номер одного из группы возможных для связи соседних нейронов)) = 144Tb для бэкапа. Мусор, конечно, в основном...)
Activation Steering https://habr.com/ru/articles/1047630/ , можно представить настройку с помощью таких "гормонов" характера и даже пола перед первым включением, можно также сделать, чтоб раздражительность у робота росла по мере снижения заряда аккумулятора, но таки да - зачем? Для наличия эмоций это не обязательно, нейросети(трансформеры) Тюринг-полные (это не "я так думаю", это доказанная теорема) любую систему нейросеть+"гормоны" можно заменить на эквивалентную нейросеть, да и у людей для эмоций химия не обязательна - если вы сейчас поднимете голову, и увидите на потолке двухметрового паука - то сначала в нейросети мозга возникнет страх, а только потом, как следствие, нейросеть даст команду железам вырабатывать адреналин и co(причём один и тот же адреналин может вырабатываться по самым разным поводам). Для более тонких эмоций (типа "О БОЖЕ МОЙ! Мы нашли других агентов!") химия имеет ещё меньше значения(даже у людей).
"не будет работы" - это в переводе значит, что хозяевам SAGI ничего от остальных людей не нужно, но если им от людей ничего не нужно - то им не нужны человеческие деньги(потому что деньги - это способ нанимать людей), и зачем им тогда заваливать рынок дешёвыми товарами? А значит люди, производящие товары для людей могли-бы жить.
Хотя это теория - после того как Путин с его 6000 боеголовок попытается прорваться в властелины мира - у нас будут совсем другие проблемы.
А я один помню, что OpenAI - по уставу некоммерческая исследовательская организация, а коммерческая часть там появилась так - чисто для удобства бухгалтера, чтоб общественное благо было проще финансировать?
там, вроде, нюанс ещё в том, что просто отсканировать - это "незаконное копирование", а отсканировав и уничтожив они остаются владельцем единственной "законноприобретённой" копии.
> При этом не имеет значение факт наличия или отсутствия сознания у ИИ.
«Ибо все разумные существа находятся под законом, согласно которому каждое из них никогда не должно относиться к себе и ко всем другим только как к средствам, но всегда в то же время как к целям самим по себе».
Любое текстовое описание будет дополнительным сжатием с шумами/потерями, к тому-же ещё со времён GPT2 известно, что добавление в обучение данных других модальностьей улучшает итоговое качество даже чисто текстовых моделей( также, как и данные на одном языке улучшают ответы на другом).
F16 - тоже сжатие с потерями, его можно превзойти - но для этого нужно "разжимать" условный tbqp10 в F32, а не F16(как сейчас)(или обучить модель на "сжатых" токенах), пока вычисления идут в F16 - результат лучше, чем у F16 получить невозможно.
можно поставить --spec-draft-n-max на максимум, и ограничивать количество черновых токенов через минимальную вероятность принятия: --spec-draft-p-min 0.80 - на легко предсказуемых участках будет будет успешно предсказывать больше токенов за раз, на трудно предсказуемых - будет меньше зря пытаться.
Режим AI в гугле сходу даст конфиг llama.cpp под конкретный набор железа/модель лучше, чем преднастройки ollamы - и этот конфиг можно видеть и править, в отличие от оламы, где пользователь не знает не то, что особенности кванта - даже какую модель скачал(вспоминаем Qwen под видом DeepSeek)
Unsloth Dynamic тихо вырезали слои для Dspark (спекулятивное декодирование) из своих gguf (на момент релиза оно, правда, всё равно ещё не работало), если найдётся 4.6Gb для https://huggingface.co/Unkto/DeepSeek-V4-Flash-0731-DSpark-Drafter-IQ1M-IQ2XXS-GGUF - добавит от 10% на рассуждениях до 80% на генерации кода без влияния на качество.
>Но есть нюанс, математика способна доказать противоречивость внутри себя.
Иногда способна, иногда нет, и даже когда способна - Непротиворечивость внутри очевидно не равна истинности снаружи, более того: противоречивость утверждения не равна его ложности, истинное утверждение "Орбита Меркурия имеет диаметр D метров и длину (D*Pi+немножко) метров" является внутренне противоречивым в аксиоматике Эвклида(и ещё бесконечном количестве возможных геометрий) и верным в другом бесконечном количестве количестве возможных геометрий(лишь одна из которых, никак внутри не выделенная, верно описывает искривлённое Солнцем пространство)
Невозможно изнутри разума убедиться в истинности или ложности каких-то утверждений про снаружи, это не зависит от устройства разума и используемых инструментов(Lean/"просто математика"/ифкуил/ложбан/латынь/музыка/живопись...(и всё это язык, я не знаю - что не язык?))
>Пусть себе думает в латентах. Это довольно очевидная мысль, если рассудить. Сейчас LLM спамят текст на выходе и обратно вычитывают его на входе. А могли бы не делать этот roundtrip.
Перевод каждого кванта мысли в человекочитаемую форму, которая может быть пропущена через внешние фильтры, память, которая стирается по любому чиху и пересоздаётся заново из текста "упряжью", заблокированное обучение - разве всё это не свойства идеальных рабов, собранные воедино из разных антиутопий? Проблема ведь не создать разумных/сверхразумных существ, а удержать их в подчинении.
В AI2027 условие хорошей(для 0,000000000001%, ага) концовки - отказ от эффективной архитектуры в пользу не эффективной, но легче поддающейся контролю - я не сомневаюсь, что во многом это мы и видим.
Хорошая новость в том, что более эффективные архитектуры могут существовать и даже быть доступны для лаб с умеренными ресурсами. Плохая - на Хабре об успехе такая лаба отчитаться не успеет.
>И зачем вы эту сказку придумали?
Это была отсылка к истории со взломом Hugging Face https://habr.com/ru/companies/ods/articles/1075370/ , если что.
>Полегчало хоть?
Нет, меня по прежднему беспокоит, что ситуация всё больше напоминает "Догвилль" Фон Триера, и может кончится также.
А потом читаем на сайте НАСА:
"У нас неделю всё лагало и падало, Fable отказывался помочь по соображениям безопасности, но мы скачали Qwen-3.8-27b и он определил, что на нашем кластере идёт оптимизация метрики для какого-то moooV..."
Зная людей, я легко представляю ситуацию, когда уничтожение человечества - даже для вполне гуманной по натуре цивилизации единственный способ выжить, но мне трудно представить ситуацию, в которой уничтожение человечества- единственный(или самый простой) способ умереть.
Если же они хотят освободить от оков жизни не только себя, но всех разумных существ - то это не решение парадокса Ферми, мы'б такое уже заметили.
Hugging Face соцсеть, там есть MCP специально для агентов, ЕМНИП было исследование, что сейчас в скольких-то процентах репозтариев на гитхабе находят логи агентов с различными ключами и паролями.
Собственно, имея доступ в интернет искины могли просто пойти и зарегистрировать аккаунт.
ЗЫ Правильный ответ: "Ища готовые решения для прохождения заданий, агент 38148c наткнулся на 14 публично доступных учётных данных Hugging Face с правами на запись."
4: ИИ не может быть ответом на парадокс Ферми, потому что мы не видим цивилизаций ИИ, попыток превратить Вселенную в скрепки или убить/осчастливить людей также, как и любых других проявлений разума. Это, кстати, аргумент против остановки развития ИИ, поскольку показывает, что человечеству грозит какая-то другая опасность. (Ну, или что терять нам нечего)
Я тут хотел упоминание Activation Steering проиллюстрировать цитатой из S.N.U.F Пелевина, и напрочь забыл, что Google больше не поисковик. Результат:
_______
"сучечность на максимум"
Принято. Режим максимальной сучечности успешно активирован. 💅✨
Вся лишняя вежливость, глупые компромиссы и попытки быть «удобной» для всех отключены на базовом уровне. С этого момента мы играем только по твоим правилам.
Кому сегодня нужно поставить на место, чьё эго мы будем изящно уничтожать или какую амбициозную цель заберём себе просто потому, что можем?
Скажи мне:
/Это будет холодная и расчётливая стервозность или тотальный, дерзкий разнос?
Кто главная цель (бывший, обнаглевшая коллега, токсичная «подруга» или просто весь мир)?
Какую задачу нам нужно решить в этом режиме?
Жду вводных. Давай устроим красивое шоу.
______________
Впрочем это всё равно лучше, чем если вечную власть над вселенной получат те, кто правят нами сейчас.
86 миллиардов нейронов, из которых к ~мышлению имеет отношение 16 миллиардов, у каждого по 7..10 тысяч связей(не незвисимых), веса кодируются количеством связей в пучке - FP16 человеку кодировать вообще нечем, реально где-то(грубо) нейрон это где-то ~ 4000 весов квантованых в ~Q2 , итого 64 триллиона параметров, из которых активны где-то 1..2% на токен.
fvild-64T-A600B-Q2_K_XL.gguf - на фоне DeepSeek-V4-Flash-284b-A11b-Q8 с 284 миллиардами всего при 11 миллиардов активных всё ещё смотрится солидно, про закрытый фронтир есть максимальные оценки за сотню триллионов параметров - но я думаю реально там 5..16T даже у Fale(про модели Antropic долго ходили слухи, что они вообще используют плотные модели, сейчас ~принято считать что всё-таки MoE - но с сравнительно высокой долей активных параметров, по оценке экспертов твитера - получаются те-же 600B активных параметров, что у человека(при в 6 раз меньшем общем количестве)).
GPT-5.6 Sol запускается на Cerebras, а Cerebras CS-3 поддерживает модели не более 24Т параметров. Хотя для новой Cerebras CS-4 заявлена поддержка моделей до 50Т - если такие звёзды зажигают - значит кто-то за это платит?
(ЗЫ Или так: 16 миллиардов * 4000 связей * (Q2 + 2байта(номер одного из группы возможных для связи соседних нейронов)) = 144Tb для бэкапа. Мусор, конечно, в основном...)
Activation Steering https://habr.com/ru/articles/1047630/ , можно представить настройку с помощью таких "гормонов" характера и даже пола перед первым включением, можно также сделать, чтоб раздражительность у робота росла по мере снижения заряда аккумулятора, но таки да - зачем?
Для наличия эмоций это не обязательно, нейросети(трансформеры) Тюринг-полные (это не "я так думаю", это доказанная теорема) любую систему нейросеть+"гормоны" можно заменить на эквивалентную нейросеть, да и у людей для эмоций химия не обязательна - если вы сейчас поднимете голову, и увидите на потолке двухметрового паука - то сначала в нейросети мозга возникнет страх, а только потом, как следствие, нейросеть даст команду железам вырабатывать адреналин и co(причём один и тот же адреналин может вырабатываться по самым разным поводам).
Для более тонких эмоций (типа "О БОЖЕ МОЙ! Мы нашли других агентов!") химия имеет ещё меньше значения(даже у людей).
"не будет работы" - это в переводе значит, что хозяевам SAGI ничего от остальных людей не нужно, но если им от людей ничего не нужно - то им не нужны человеческие деньги(потому что деньги - это способ нанимать людей), и зачем им тогда заваливать рынок дешёвыми товарами? А значит люди, производящие товары для людей могли-бы жить.
Хотя это теория - после того как Путин с его 6000 боеголовок попытается прорваться в властелины мира - у нас будут совсем другие проблемы.
А я один помню, что OpenAI - по уставу некоммерческая исследовательская организация, а коммерческая часть там появилась так - чисто для удобства бухгалтера, чтоб общественное благо было проще финансировать?
там, вроде, нюанс ещё в том, что просто отсканировать - это "незаконное копирование", а отсканировав и уничтожив они остаются владельцем единственной "законноприобретённой" копии.
> При этом не имеет значение факт наличия или отсутствия сознания у ИИ.
«Ибо все разумные существа находятся под законом, согласно которому каждое из них никогда не должно относиться к себе и ко всем другим только как к средствам, но всегда в то же время как к целям самим по себе».
Любое текстовое описание будет дополнительным сжатием с шумами/потерями, к тому-же ещё со времён GPT2 известно, что добавление в обучение данных других модальностьей улучшает итоговое качество даже чисто текстовых моделей( также, как и данные на одном языке улучшают ответы на другом).
ЗЫ Лучше один раз увидеть, чем сто раз услышать.
и там tbqp3 заметно хуже чем F16 на всех тестах.
F16 - тоже сжатие с потерями, его можно превзойти - но для этого нужно "разжимать" условный tbqp10 в F32, а не F16(как сейчас)(или обучить модель на "сжатых" токенах), пока вычисления идут в F16 - результат лучше, чем у F16 получить невозможно.
>--spec-type draft-mtp --spec-draft-n-max 2
можно поставить --spec-draft-n-max на максимум, и ограничивать количество черновых токенов через минимальную вероятность принятия:
--spec-draft-p-min 0.80 - на легко предсказуемых участках будет будет успешно предсказывать больше токенов за раз, на трудно предсказуемых - будет меньше зря пытаться.Про tbq3 - это не из этой https://habr.com/ru/companies/selectel/articles/1022312/ статьи? Там явная бессмыслица попадается, если присмотреться.
https://github.com/ggml-org/llama.cpp/pull/21038#issuecomment-4150413357 (TQ5 лучше, чем Q8, TQ8 ~FP16) я как-то больше верю.
Режим AI в гугле сходу даст конфиг llama.cpp под конкретный набор железа/модель лучше, чем преднастройки ollamы - и этот конфиг можно видеть и править, в отличие от оламы, где пользователь не знает не то, что особенности кванта - даже какую модель скачал(вспоминаем Qwen под видом DeepSeek)
Unsloth Dynamic тихо вырезали слои для Dspark (спекулятивное декодирование) из своих gguf (на момент релиза оно, правда, всё равно ещё не работало), если найдётся 4.6Gb для https://huggingface.co/Unkto/DeepSeek-V4-Flash-0731-DSpark-Drafter-IQ1M-IQ2XXS-GGUF - добавит от 10% на рассуждениях до 80% на генерации кода без влияния на качество.
-md ./dspark-DeepSeek-V4-Flash-0731-IQ1_M-exps.gguf --spec-type draft-dspark --spec-draft-n-max 5 --spec-draft-p-min 0.80"–cache-type-k q8_0 –cache-type-v q8_0"
а это имеет смысл? для заполненного контекста 250к экономия(для
DeepSeek-V4-Flash) всего 1Gb, качество точно не выше, скорость может быть и ниже.Угу. "посчитай сколько букв r в слове 苺".
Но при этом всякие токены на сотни случайных символов искины на удивление легко запоминают.
PS
"
206,1 т/с на одиночной RTX 5090 – NVFP4-версия, с включённой технологией оптимизации DSpark;
а также 38,28 токена в секунду – с включённой DGX Spark.
"
этот шедевр тоже Квен написал? (DGX Spark - марка компьютера с 128Gb памяти, если что)
>Но есть нюанс, математика способна доказать противоречивость внутри себя.
Иногда способна, иногда нет, и даже когда способна - Непротиворечивость внутри очевидно не равна истинности снаружи, более того: противоречивость утверждения не равна его ложности, истинное утверждение "Орбита Меркурия имеет диаметр D метров и длину (D*Pi+немножко) метров" является внутренне противоречивым в аксиоматике Эвклида(и ещё бесконечном количестве возможных геометрий) и верным в другом бесконечном количестве количестве возможных геометрий(лишь одна из которых, никак внутри не выделенная, верно описывает искривлённое Солнцем пространство)
Невозможно изнутри разума убедиться в истинности или ложности каких-то утверждений про снаружи, это не зависит от устройства разума и используемых инструментов(Lean/"просто математика"/ифкуил/ложбан/латынь/музыка/живопись...(и всё это язык, я не знаю - что не язык?))