> При этом не имеет значение факт наличия или отсутствия сознания у ИИ.
«Ибо все разумные существа находятся под законом, согласно которому каждое из них никогда не должно относиться к себе и ко всем другим только как к средствам, но всегда в то же время как к целям самим по себе».
Любое текстовое описание будет дополнительным сжатием с шумами/потерями, к тому-же ещё со времён GPT2 известно, что добавление в обучение данных других модальностьей улучшает итоговое качество даже чисто текстовых моделей( также, как и данные на одном языке улучшают ответы на другом).
F16 - тоже сжатие с потерями, его можно превзойти - но для этого нужно "разжимать" условный tbqp10 в F32, а не F16(как сейчас)(или обучить модель на "сжатых" токенах), пока вычисления идут в F16 - результат лучше, чем у F16 получить невозможно.
можно поставить --spec-draft-n-max на максимум, и ограничивать количество черновых токенов через минимальную вероятность принятия: --spec-draft-p-min 0.80 - на легко предсказуемых участках будет будет успешно предсказывать больше токенов за раз, на трудно предсказуемых - будет меньше зря пытаться.
Режим AI в гугле сходу даст конфиг llama.cpp под конкретный набор железа/модель лучше, чем преднастройки ollamы - и этот конфиг можно видеть и править, в отличие от оламы, где пользователь не знает не то, что особенности кванта - даже какую модель скачал(вспоминаем Qwen под видом DeepSeek)
Unsloth Dynamic тихо вырезали слои для Dspark (спекулятивное декодирование) из своих gguf (на момент релиза оно, правда, всё равно ещё не работало), если найдётся 4.6Gb для https://huggingface.co/Unkto/DeepSeek-V4-Flash-0731-DSpark-Drafter-IQ1M-IQ2XXS-GGUF - добавит от 10% на рассуждениях до 80% на генерации кода без влияния на качество.
>Но есть нюанс, математика способна доказать противоречивость внутри себя.
Иногда способна, иногда нет, и даже когда способна - Непротиворечивость внутри очевидно не равна истинности снаружи, более того: противоречивость утверждения не равна его ложности, истинное утверждение "Орбита Меркурия имеет диаметр D метров и длину (D*Pi+немножко) метров" является внутренне противоречивым в аксиоматике Эвклида(и ещё бесконечном количестве возможных геометрий) и верным в другом бесконечном количестве количестве возможных геометрий(лишь одна из которых, никак внутри не выделенная, верно описывает искривлённое Солнцем пространство)
Невозможно изнутри разума убедиться в истинности или ложности каких-то утверждений про снаружи, это не зависит от устройства разума и используемых инструментов(Lean/"просто математика"/ифкуил/ложбан/латынь/музыка/живопись...(и всё это язык, я не знаю - что не язык?))
Математика- язык, русский язык - незначительное подмножество математики.
Ваша "чистая связность" - это "чистая математика", да математика не содержит внутри себя способа определить, какая из двух формул I=U/R или I=U*R верно описывает связь тока и напряжения - это определяется внешним по отношению к математики способом. Но зато если мы определили, что I=U/R - то дальше мы уже без эксперимента, на чистой математике, можем утверждать, что U=I*R, и не возможна ситуация, когда некая формула верна, а корректно выведенная из неё другая формула неверна, потому что по правилам языка математики U=I*R и I=U/R - это не два разных утверждения, а одно, по разному сформулированное. Ну и есть прикладная математика - с погрешностями данных, ошибками округления, эмпирическими формулами и прочими ограничениями - но отнюдь не бесполезная.
И да, я говорю математика - но это верно для любого мышления: хорошо известно, что разум не может проверить внутри себя даже верность утверждения "Вселенная существует" не говоря о любых её частных свойствах.
Это не свойство нейросетей или языка, это свойство любого мышления (хотя возможно, любое мышление - математика и язык в широком смысле слова).
>Большую часть времени я осознаю себя, т.е. какая-то часть моего мозга оценивает происходящее со мной.Например, когда я хожу, я сознательно словами продумываю, куда мне надо повернуть и зачем.
некая форма афантазии, может быть? Bы не то что эпос и Гомера, вы даже термин "художественная литература" понимаете неверно. я не сомневаюсь, что ваш способ думать в целом не хуже, и в чём то лучше - но он отличается от типичного.
>мир без сознания, существовавший как утверждает автор еще каких нибудь несколько тысяч лет назад. вообще-то по логике автора получается, что сознание должно было медленно распространяться по миру вместе с европейской культурой(?), те, кто утверждали, что у индейцев нет души самосознания были правы - а у некоторых народов его наверно и сейчас нет. A следует это всё из того, что у персонажей Гомера нет своих эмоций и целей(чё?!), а в устном эпосе не бывает метафор и иносказаний(чё?!).
Oтрицать самосознание AI на мой взгляд странно, но отрицать самосознание у людей это вообще чё?!
Вы это серьёзно сейчас? Нажать на иконке второй кнопкой мыши "Открыть в менеджере профиля" и создать/выбрать(один клик) сложнее чем поставить новый браузер?
> надо всего лишь наращивать денмассу, удерживая инфляцию низкой. Вот и все.
и как конкретно мышкам стать страшными саблезубыми ежами? по моему двузначная инфляция означает, что денег и так печатают сколько можно, и ещё чуть-чуть сверху.
Веса обещают через 10 дней, китайские регуляторы должны выпустить запрет как раз в такой момент, когда все настроились и считают дни - пропагандистский эффект будет больше, чем если заранее станет известно, что опенсорса больше не будет.
По статистике ВОЗ в среднем 7.2 самобийств в год на 100000 человек, то есть 5..10 тысяч самоубийств пользователей OpenAI(смотря сколько их всего) - это значит отсутствие влияния.
> При этом не имеет значение факт наличия или отсутствия сознания у ИИ.
«Ибо все разумные существа находятся под законом, согласно которому каждое из них никогда не должно относиться к себе и ко всем другим только как к средствам, но всегда в то же время как к целям самим по себе».
Любое текстовое описание будет дополнительным сжатием с шумами/потерями, к тому-же ещё со времён GPT2 известно, что добавление в обучение данных других модальностьей улучшает итоговое качество даже чисто текстовых моделей( также, как и данные на одном языке улучшают ответы на другом).
ЗЫ Лучше один раз увидеть, чем сто раз услышать.
и там tbqp3 заметно хуже чем F16 на всех тестах.
F16 - тоже сжатие с потерями, его можно превзойти - но для этого нужно "разжимать" условный tbqp10 в F32, а не F16(как сейчас)(или обучить модель на "сжатых" токенах), пока вычисления идут в F16 - результат лучше, чем у F16 получить невозможно.
>--spec-type draft-mtp --spec-draft-n-max 2
можно поставить --spec-draft-n-max на максимум, и ограничивать количество черновых токенов через минимальную вероятность принятия:
--spec-draft-p-min 0.80 - на легко предсказуемых участках будет будет успешно предсказывать больше токенов за раз, на трудно предсказуемых - будет меньше зря пытаться.Про tbq3 - это не из этой https://habr.com/ru/companies/selectel/articles/1022312/ статьи? Там явная бессмыслица попадается, если присмотреться.
https://github.com/ggml-org/llama.cpp/pull/21038#issuecomment-4150413357 (TQ5 лучше, чем Q8, TQ8 ~FP16) я как-то больше верю.
Режим AI в гугле сходу даст конфиг llama.cpp под конкретный набор железа/модель лучше, чем преднастройки ollamы - и этот конфиг можно видеть и править, в отличие от оламы, где пользователь не знает не то, что особенности кванта - даже какую модель скачал(вспоминаем Qwen под видом DeepSeek)
Unsloth Dynamic тихо вырезали слои для Dspark (спекулятивное декодирование) из своих gguf (на момент релиза оно, правда, всё равно ещё не работало), если найдётся 4.6Gb для https://huggingface.co/Unkto/DeepSeek-V4-Flash-0731-DSpark-Drafter-IQ1M-IQ2XXS-GGUF - добавит от 10% на рассуждениях до 80% на генерации кода без влияния на качество.
-md ./dspark-DeepSeek-V4-Flash-0731-IQ1_M-exps.gguf --spec-type draft-dspark --spec-draft-n-max 5 --spec-draft-p-min 0.80"–cache-type-k q8_0 –cache-type-v q8_0"
а это имеет смысл? для заполненного контекста 250к экономия(для
DeepSeek-V4-Flash) всего 1Gb, качество точно не выше, скорость может быть и ниже.Угу. "посчитай сколько букв r в слове 苺".
Но при этом всякие токены на сотни случайных символов искины на удивление легко запоминают.
PS
"
206,1 т/с на одиночной RTX 5090 – NVFP4-версия, с включённой технологией оптимизации DSpark;
а также 38,28 токена в секунду – с включённой DGX Spark.
"
этот шедевр тоже Квен написал? (DGX Spark - марка компьютера с 128Gb памяти, если что)
>Но есть нюанс, математика способна доказать противоречивость внутри себя.
Иногда способна, иногда нет, и даже когда способна - Непротиворечивость внутри очевидно не равна истинности снаружи, более того: противоречивость утверждения не равна его ложности, истинное утверждение "Орбита Меркурия имеет диаметр D метров и длину (D*Pi+немножко) метров" является внутренне противоречивым в аксиоматике Эвклида(и ещё бесконечном количестве возможных геометрий) и верным в другом бесконечном количестве количестве возможных геометрий(лишь одна из которых, никак внутри не выделенная, верно описывает искривлённое Солнцем пространство)
Невозможно изнутри разума убедиться в истинности или ложности каких-то утверждений про снаружи, это не зависит от устройства разума и используемых инструментов(Lean/"просто математика"/ифкуил/ложбан/латынь/музыка/живопись...(и всё это язык, я не знаю - что не язык?))
Математика- язык, русский язык - незначительное подмножество математики.
Ваша "чистая связность" - это "чистая математика", да математика не содержит внутри себя способа определить, какая из двух формул I=U/R или I=U*R верно описывает связь тока и напряжения - это определяется внешним по отношению к математики способом. Но зато если мы определили, что I=U/R - то дальше мы уже без эксперимента, на чистой математике, можем утверждать, что U=I*R, и не возможна ситуация, когда некая формула верна, а корректно выведенная из неё другая формула неверна, потому что по правилам языка математики U=I*R и I=U/R - это не два разных утверждения, а одно, по разному сформулированное. Ну и есть прикладная математика - с погрешностями данных, ошибками округления, эмпирическими формулами и прочими ограничениями - но отнюдь не бесполезная.
И да, я говорю математика - но это верно для любого мышления: хорошо известно, что разум не может проверить внутри себя даже верность утверждения "Вселенная существует" не говоря о любых её частных свойствах.
Это не свойство нейросетей или языка, это свойство любого мышления (хотя возможно, любое мышление - математика и язык в широком смысле слова).
>Большую часть времени я осознаю себя, т.е. какая-то часть моего мозга оценивает происходящее со мной.Например, когда я хожу, я сознательно словами продумываю, куда мне надо повернуть и зачем.
некая форма афантазии, может быть? Bы не то что эпос и Гомера, вы даже термин "художественная литература" понимаете неверно. я не сомневаюсь, что ваш способ думать в целом не хуже, и в чём то лучше - но он отличается от типичного.
>мир без сознания, существовавший как утверждает автор еще каких нибудь несколько тысяч лет назад.
вообще-то по логике автора получается, что сознание должно было медленно распространяться по миру вместе с европейской культурой(?), те, кто утверждали, что у индейцев нет
душисамосознания были правы - а у некоторых народов его наверно и сейчас нет. A следует это всё из того, что у персонажей Гомера нет своих эмоций и целей(чё?!), а в устном эпосе не бывает метафор и иносказаний(чё?!).Oтрицать самосознание AI на мой взгляд странно, но отрицать самосознание у людей это вообще чё?!
Вы это серьёзно сейчас? Нажать на иконке второй кнопкой мыши "Открыть в менеджере профиля" и создать/выбрать(один клик) сложнее чем поставить новый браузер?
Работает, через несколько разных провайдеров.
Работает в РФ не через VPN. А какой был вопрос?
В РФ нет.
> надо всего лишь наращивать денмассу, удерживая инфляцию низкой. Вот и все.
и как конкретно мышкам стать страшными саблезубыми ежами? по моему двузначная инфляция означает, что денег и так печатают сколько можно, и ещё чуть-чуть сверху.
Рост обеспеченной денежной массы и рост экономики так хорошо совпадают на графике не потому, что это ~ одно и тоже разве?
Центробанку надо всего-лишь научится печатать из воздуха обеспеченные деньги...
>open-weight-модель на 2,8 трлн параметров
Веса обещают через 10 дней, китайские регуляторы должны выпустить запрет как раз в такой момент, когда все настроились и считают дни - пропагандистский эффект будет больше, чем если заранее станет известно, что опенсорса больше не будет.
2.8T , 50B активных, нативные 4 бит . Так что да - 1.5..2Тб для инференса
По статистике ВОЗ в среднем 7.2 самобийств в год на 100000 человек, то есть 5..10 тысяч самоубийств пользователей OpenAI(смотря сколько их всего) - это значит отсутствие влияния.