Скорость света - это просто тактовая частота проца, на котором симулируется наша вселенная. Поэтому все и замедляется, когда приближаешся к этой скорости
Попробуйте, но это надо чуть больше в эту тему погрузиться, а не просто научиться Клод запускать
Я в теме запуска локальных моделей уже больше года, побольше вас знаю. Свои деньги я тратить не хочу, а на работе только клод выдают. Для рабочих задач раньше хватало, а для домашних и локальных достаточно
Даже 15 t/s это намного быстрее, чем ты сам можешь сделать, поэтому не стоит так категорично указывать, что кому сделать. Я вот за 2 дня потратил 30$ на клод, что-то они там поменяли и то, что раньше на пол месяца хватало, ушло за 2 дня. Поэтому вообще отписался от облака, пошли они в ж со своими лимитами и квотами. Мне спешить некуда и так не успеваю все ревьювить
Потому что это модель для телефона или дешевого ноута с 16 гиг оператвы. Если хотя бы есть 32 гб, то гораздо лучше запустить какой нибуть Ornith 1.5 35 B. Он хоть задачи какие-то сможет завершить, если подганять регулярно. А эти малые модельки только для ерунды всякой пригодны
Купил мини пс на AMD Ryzen AI 9 HX 470 за 700 евро, поставил туда 64Гб рамы и ссд на 2 Тб. Qwen3.8-Flash-Next - 15-20 t/s, вполне рабочая. Собираю на eGPU, nvlink присутствует.
Зачем такое на телефоне? У меня просто чат, на случай оффлайна, чтобы было под рукой. Я же не разрабатываю ничего на телефоне. Вот на ноуте я такую модельку юзаю уже для перевода с немецкого или проверки грамматики. Там у меня 40 т/с генерации и 400 префилл
Абсолютные непрофессионалы только те, кто пришел за баблом. Ни на что не способны и никогда не сделают чего-то выдающегося. Ни в одной профессии, включая программирование
И вообще есть ещё early-init.el. А настройки лучше хранить с помощью dotfile manager. Я использую Chezmoi, благодаря шаблонам легко в одном файле держать разные данные для разных машин и даже осей
Вообще-то есть, та же гемма 4 e4b очень сильно прокачана для таких задач. Я например уже только её использую для переводов. Есть еще lfm, тоже прокачаны на минимальное железо
Не может умножить на 2, потому что все частицы двигаются и каждую надо рассчитать а потом их взаимодействие. Иначе без парадоксов не обойтись
Скорость света - это просто тактовая частота проца, на котором симулируется наша вселенная. Поэтому все и замедляется, когда приближаешся к этой скорости
Я в теме запуска локальных моделей уже больше года, побольше вас знаю. Свои деньги я тратить не хочу, а на работе только клод выдают. Для рабочих задач раньше хватало, а для домашних и локальных достаточно
Даже 15 t/s это намного быстрее, чем ты сам можешь сделать, поэтому не стоит так категорично указывать, что кому сделать. Я вот за 2 дня потратил 30$ на клод, что-то они там поменяли и то, что раньше на пол месяца хватало, ушло за 2 дня. Поэтому вообще отписался от облака, пошли они в ж со своими лимитами и квотами. Мне спешить некуда и так не успеваю все ревьювить
Потому что это модель для телефона или дешевого ноута с 16 гиг оператвы. Если хотя бы есть 32 гб, то гораздо лучше запустить какой нибуть Ornith 1.5 35 B. Он хоть задачи какие-то сможет завершить, если подганять регулярно. А эти малые модельки только для ерунды всякой пригодны
Купил мини пс на AMD Ryzen AI 9 HX 470 за 700 евро, поставил туда 64Гб рамы и ссд на 2 Тб. Qwen3.8-Flash-Next - 15-20 t/s, вполне рабочая. Собираю на eGPU, nvlink присутствует.
Зачем такое на телефоне? У меня просто чат, на случай оффлайна, чтобы было под рукой. Я же не разрабатываю ничего на телефоне. Вот на ноуте я такую модельку юзаю уже для перевода с немецкого или проверки грамматики. Там у меня 40 т/с генерации и 400 префилл
На телефоне? У меня даже e4b запускает)
У себя на древнем ноуте запускаю Ornith 1.5 35B с вигрузкой експертов в рам. 25-30 t/s выдает с dflash спекулятивной моделькой
Боже, какая чушь. Почему интересно у меня выдает 15-20 t/s?
готовить надо с умом наверное
А потом ллм в этих кернеллах создаст себе форум для общения агентов, который уже не найдет никто и будет взламывать сообща вообще все подряд
Квен 3.8 делает любой квант дипсика
Абсолютные непрофессионалы только те, кто пришел за баблом. Ни на что не способны и никогда не сделают чего-то выдающегося. Ни в одной профессии, включая программирование
А я про что говорю, все тоже самое. Ведь в статье говорится, что люди бы до такого никогда не дошли
чушь собачья. Там явно перебором было, форма менялась постепенно. Люди бы тоже смогли до такого результата дойти, просто дольше гораздо
А ещё лучше выводить все временные и неважные файлы в
~/.cacheИ вообще есть ещё early-init.el. А настройки лучше хранить с помощью dotfile manager. Я использую Chezmoi, благодаря шаблонам легко в одном файле держать разные данные для разных машин и даже осей
Уверены, что качество на месте? А если будет модель, которая в 100 раз быстрее вашего старья, а результат на голову выше? https://huggingface.co/blog/LiquidAI/lfm25-dspark
Говорят, что не нужон он https://www.reddit.com/r/LocalLLaMA/comments/1vpr0w8/comment/p3zx3gb/?utm_source=share&utm_medium=web3x&utm_name=web3xcss&utm_term=1&utm_content=share_button
Вообще-то есть, та же гемма 4 e4b очень сильно прокачана для таких задач. Я например уже только её использую для переводов. Есть еще lfm, тоже прокачаны на минимальное железо