Имеется ввиду Qwen3.8-Flash-Next? q4_m на 5090 на 128к контексте 25-30 т/с стабильно. Но это не особо релевантно, в 64 гиговую dgx она вобще не влезет, память там распаяна, а в 128 гиговую ее придется ногами уталкивать
Считаю. Одну - и получится вдвое (минимум, на небольших моделях разница будет еще больше) больше токенов при инференсе, чем на любой dgx, хоть с 64 гигами, хоть со 128. Даже если вдруг захочется обучением заняться - 5090 будет минимум вдвое быстрее.
Память она значение, конечно, имеет. Но вычислительная мощь на первом месте.
А смысл от памяти, если чип дохлый, хоть терабайт памяти запихни токенов в секунду больше не станет. Вся идея dgx spark это развод гоев на шекели.
Для чего то серьезного как использовали что-то уровня H200 так и используют. А для несерьезного есть 4090/5090 - стоит чуть дешевле, а токенов выдает больше.
Еще как вводят. В жизни почти каждого программиста есть момент упарывания по терминалу (а у многих еще и по vim), большинство со временем приходит в норму, но отдельные личности продолжают пополнять отряды несгибаемых адептов командной строки.
Ну так дайте ссылку на ваше агентство - в гугл посылать сомневающихся не очень хорошо (и да, таки погуглил топ маркетинговых агентств РФ - на втором месте там контора с оборотом 980кк за 2025 - немного не сходится).
Или вы стесняетесь рекламировать ваше маркетинговое агентство, которое делает всякие штуки для российских и не только корпораций?
Так не стесняйтесь - иначе пока все выглядит так, что вы готовы рассказать как открыть бизнес, но свой старательно прячете, готовы научить, как собрать команду - но сами подменяете наемных программистов нейронкой. Вот в развитие личного бренда - верю, в остальное, не очень.
Это да, поэтому и шарп упомянут. Огромные кодовые базы его хлеб.
Причем есть подозрение - если бы эпики пришли к майкам и попросили забабхать им какой-нибудь аналог IL2CPP из юнити - то майки пошли бы им навстречу. Не исключено, что даже забесплатно или за очень дешево.
ECS это круто и прельстиво, а вот Verse как то мимо, что мешало взять что-то известное и зарекомендовавшее себя - Lua например (при минимальной доработке напильником выглядеть будет ничуть не хуже, а знает ее каждый второй), ну или тот же шарп - за одно можно было бы пощипать конкурентов из Unity переманивая разработчиков.
Просто в задачах, где интерфейс должен быть очень быстрым, плотным и предсказуемым, я не хочу постоянно спорить с фреймворком
Что-ж, остается только пожелать вам удачи в написании аналога WPF в котором вам не придется спорить с фреймворком и который будет быстрый, плотный и предсказуемый.
Имеется ввиду Qwen3.8-Flash-Next? q4_m на 5090 на 128к контексте 25-30 т/с стабильно. Но это не особо релевантно, в 64 гиговую dgx она вобще не влезет, память там распаяна, а в 128 гиговую ее придется ногами уталкивать
Влезет в RAM и все равно инференс будет быстрее, на сдачу от dgx вполне можно 192 гига хорошей RAM прикупить))
Считаю. Одну - и получится вдвое (минимум, на небольших моделях разница будет еще больше) больше токенов при инференсе, чем на любой dgx, хоть с 64 гигами, хоть со 128. Даже если вдруг захочется обучением заняться - 5090 будет минимум вдвое быстрее.
Память она значение, конечно, имеет. Но вычислительная мощь на первом месте.
Ну да, ну да. 5090 за 3-4к$ разоришься, а недоразумение с чипом от 5070 за 5к$ не разоришься. Л-логика.
А смысл от памяти, если чип дохлый, хоть терабайт памяти запихни токенов в секунду больше не станет. Вся идея dgx spark это развод гоев на шекели.
Для чего то серьезного как использовали что-то уровня H200 так и используют. А для несерьезного есть 4090/5090 - стоит чуть дешевле, а токенов выдает больше.
Инструкция, как продать 5070 за 5к$
Если кратко, эффективный менеджмент. Если хочется подробностей - ixbt вроде освещали трешачок, что творится в компании.
Еще как вводят. В жизни почти каждого программиста есть момент упарывания по терминалу (а у многих еще и по vim), большинство со временем приходит в норму, но отдельные личности продолжают пополнять отряды несгибаемых адептов командной строки.
Да, все нашел. Каюсь - был не прав, реально очень узкая и специфичная ниша.
Ну так дайте ссылку на ваше агентство - в гугл посылать сомневающихся не очень хорошо (и да, таки погуглил топ маркетинговых агентств РФ - на втором месте там контора с оборотом 980кк за 2025 - немного не сходится).
Или вы стесняетесь рекламировать ваше маркетинговое агентство, которое делает всякие штуки для российских и не только корпораций?
Так не стесняйтесь - иначе пока все выглядит так, что вы готовы рассказать как открыть бизнес, но свой старательно прячете, готовы научить, как собрать команду - но сами подменяете наемных программистов нейронкой. Вот в развитие личного бренда - верю, в остальное, не очень.
Там смотреть нечего, инфоцыган обыкновенный. Статья на хабре суть - реклама продажи успешного успеха за 20-25к в час (70кк в год, реально?).
Но, не исключено, что сайт и бот для телеги сделаны с помощью нейронки - с лендингами и ботами ллмки уже давно успешно справляются.
Это да, поэтому и шарп упомянут. Огромные кодовые базы его хлеб.
Причем есть подозрение - если бы эпики пришли к майкам и попросили забабхать им какой-нибудь аналог IL2CPP из юнити - то майки пошли бы им навстречу. Не исключено, что даже забесплатно или за очень дешево.
ECS это круто и прельстиво, а вот Verse как то мимо, что мешало взять что-то известное и зарекомендовавшее себя - Lua например (при минимальной доработке напильником выглядеть будет ничуть не хуже, а знает ее каждый второй), ну или тот же шарп - за одно можно было бы пощипать конкурентов из Unity переманивая разработчиков.
Не хотелось бы разочаровывать этого наивного добряка...
Что-ж, остается только пожелать вам удачи в написании аналога WPF в котором вам не придется спорить с фреймворком и который будет быстрый, плотный и предсказуемый.
1000$ за шестиядерник на zen4 в открытой экосистеме - ну такое. Видимо valve к своим успехам решила добавить феерический провал.
Есть мнение что ipv8 внедрят раньше, чем все перейдут на v6. Обратная совместимость решает.
Хм. А где плашка про противоречивые чувства? Питоном не пользуюсь, но чувства крайне противоречивые...
А в чем преимущество перед родным дотнетовским TPL Dataflow?
Хорошо, все таки, что в госдуме не читают хабр...