у qwen с 8 сентября для новых аккаунтов бесплатные квоты.(хватает только на потестить). там же есть Kimi K3 и k2.7 code. начиная с qwen3.7 max и особенно qwen3.8 max заметно улучшилась для задач кодинга. модели flash и plus у qwen слабые.
потолок у современных "обычных" материнских плат именно две видеокарты. есть материнские платы у которых есть поддержка именно двух видеокарт по x8 + x8 PCiE, что более чем достаточно для инференса. почти все эти материнские платы из верхней ценовой категории. в прошлом году средне-бюджетную плату с x8/x8 под intel ultra 265k брал, как раз в расчёт на поддержку двух rtx 5090. в средне-бюджетном сегменте таких плат почти нету, в топ сегменте плат тоже не всегда присутствует. то есть это НЕ про материнские платы рабочих станций или серверов.
для объединения видеокарт нужны linux и vllm(или другая оптимизированя для работы с несколькими ускорителями). windows и llama.cpp плохо оптимизированы под объединение нескольких видеокарт под одну модель.
и напомню что речь шла об инференсе. современные x8 PCiE обеспечивают пропускную способность с запасом. обучение моделей или научные(и близкие к ним точные вычисления) задачи имеют отдельную специфику.
древняя tesla v100 не поддерживает множества современных аппаратных ускорений инференса и может быть интересна наверно только для научных или иных расчётов.
в 128GB vRAM не влезет целиком glm/qwen/deepseek уровня flash последних версий. да и в цену нужно прибавить остальное железо для создания такого кластера.
то есть конкуренция с моделями по подпискам за ~10$. для DeepSeek V4 Pro нужен кластер на 900+ GB vRAM. а эта модель кратно уступает возможностям подписок за 100$.
для локального инференса более менее подходят модели под 24/48/64 гб vram. то есть под одиночные или пары 3090/4090/5090 - для нормальной скорости. если скорости не критичны то есть варианты на ram.(NVIDIA DGX Spark, Mac Studio Max/Ultra, AMD Strix Halo / Gorgon Halo) - выйдет дешевле и производительней за те же 128GB.
самоокупаемость возможна только у инференса, но главная статья расходов у компаний это разработки новых моделей. по этому поводу были статьи.
и в этом ключе интересно выглядит заявления об том что прогресс(разработку новых моделей) нужно замедлять. все компании ускорили выпуски новых моделей, что наверняка плохо сказалось на финансовых показателях.
qwen max умнее и дешевле и свежее чем kimi k3. у меня несколько разных подписок и я использую гибридное использование: у агентов и субагентов разные модели.
в таблице использования(в консоле в кабинете) у каждой модели отображается свои уровни использования. но я не достигал ещё ограничений квот, так что могу ошибаться
добавлю что opencode go тарифы/цены моделей почти всегда без скидок. другие сервисы, например опенроутер имеет предложения со скидками на модели.
opencode go обещают суммарно 60$, то есть можно потратить на 4 модели по 15$ из категории тяжёлых/флагманских. или же в несколько окон пользоваться моделями уровня glm flash, deepseek flash, Qwen Flash и за срок подписки не увидеть лимитов использования.
я имел ввиду что wifi можно было бы заменить проводами/кабелями. но я понял что путь проводов не ваш. но всё равно если прокинуть кабели хотя бы к соединим ульям то это бы сократило себестоимость. хотя смотря на ваши расчёты основная статья расходов это платформа для датчиков веса.
Arduino nano(и аналоги) экономичней по потреблению и возможно не пришлось бы так сильно возится с питанием. отдельный независимый комплект под каждый улей - включает в числе прочих отдельную "батарейку" и опционально солнечные панели. а так же совмещение питания.
если делать серьёзные прокладки то и сами кабеля придётся брать более серьезные. себестоимость растёт. а так можно было бы использовать что то вроде кабеля Cat 5e(или попроще). весной проложить/развесить, осенью снять и убрать.
я про то что использовать один ESP32/Arduino на несколько комплектов тензодатчиков. что бы сигнал доходил(между ульями солидное расстояние для слабых сигналов) до ESP32/Arduino от тензодатчиков использовать усилитель(перевод в цифровой сигнал) который получая сигнал усиливает и отправляет на один ESP32/Arduino. то есть сигналы от тензодатчиков усиливаясь уходят на ESP32/Arduino по кабелям. плюс вроде есть модуль что бы подключать/переключать(как раз поочерёдное снятие данных с ульев) больше датчиков. из минусов кабели между ульями, из плюсов меньше плат. по себестоимости может выйти дешевле. расклады я прикидывал под Arduino, для ESP32 как обстоят дела не знаю совсем.
летом пасека посещается несколько раз в неделю, так что замена вручную батареи/акб не проблема. в этом обстоятельстве - возня с солнечной панелью сомнительна. хотя есть альтернативные подходя когда пасеку почти не посещают, тогда может быть. но проще добавить батарей.
когда ульев более 10, нужны же оптимизации? например на 1 мозг/контроллер подключать несколько ульев, опрашивая датчиков от ульев по очереди. там правда потребуются усилители, кабели и возможно что то ещё. а модуль wifi/bt подключать под конец. а почему не 2G модуль мобильной связи? для передачи данных его возможностей хватило бы. ещё можно было бы возможно добавить датчики температуры. и нельзя забывать что пчёлы очень чувствительны к электромагнитным воздействиям. солнечные же панели для сборки по сравнению с "батарейками" не оправдываются же?
в железе не специалист, но примерно прикидывал как сделать умным пасеку.
Erlang VM разрабатывался истерически(телефония, телеком, банки) в специфичных условиях где надёжность была важнее скорости. насколько помню в Erlang VM при высоких нагрузках замедляется что бы постараться обслужить всех. этот паттерн поведения почти ни у кого не встречается реально.
вообще ещё существуют игра слов и и специфические вещи. например ту же игру слов могут обыграть в рамках произведения и даже главы по разному. тупая нейронка скорей всего это сгладит. то есть утеря художественной ценности.
ещё нужно учитывать что большая часть весов нейронок/моделей обучена на переводах с потерями. качественные переводы в общей массе переводов малы и с учётом что модели смещены к среднему выходит что мы получаем по умолчанию переводы с потерями.
сжатие это для меня антипатерн для промежуточных данных. по сути это loss версия данных и дальнейшее использование их может(и часто) приводить к очень неприятным сюрпризам. теряются много детали которые как раз можно было бы подчерпнуть для повышения качества.
кроме слов существуют устойчивые словосочетания, выражения и предложения. нередко можно найти материалы от авторов по своим произведениям, включая форматов вопрос-ответ. в качестве продвинутых систем знаний можут выступать векторно-графовые базы данных. кроме того в качестве полезных данных могут выступать уже переведённые прошлые книги серии. там уже получаются пары книга на исходном языке + книга в переводе.
кто то в своих проектах переводе книг это учитывает?
Вам бы наверное более комфортно было в Осаке или Хоккайдо.
Вообще дискриминация проявляется так или иначе в большинстве странах включая РФ и Европу.
Правильный вопрос был бы не сколько я получу, а какой уровень жизни это мне даст и сколько после этого останется. США и Китай имеют большое население которому нужно много продовольствия и эти страны допускают много компромиссов для покрытия базовых потребностей населения. При сопоставимом уровне жизни/качества всё не так однозначно. например живя в San Francisco и качественно питаясь даже с теми местными доходами будет мало что оставаться в кармане.
немалая часть внутреннего продовольствия выращивается и выращивалось как раз теми кто имеет большой возраст. и как вы уже вроде упомянули эта категория(65+ и не только) в последнее время сильно и быстро убывает. кроме того люди в таком возрасте не склонны к новшествам и поэтому рост производительности труда в фермерском сельском хозяйстве в целом давно остановилось. мигранты фермеры показывают намного лучшее показатели. так же нельзя забывать про высокие стандарты как при внутреннем производстве(производство дороже) так и при импорте(высокие требования сильно отфильтровывают продукцию. как упомянул выше те же американцы были бы рады завозить свою продукцию гмо напичканной химий но...).
концепт: существуют триггеры на которые реакция интеллекта/ai должна быть значительней или по иному особой. концепт - да, реализация - нет. у вас похоже получился микс. как по мне характер персонажа это одно, а его отношения и реакция это другое. в моём прототипе персонаж стойко держит свой характер даже на промт инъекции, при том что на это защиты не было и я ещё не реализовал отношения.
p.s. и кстати пока читал вспомнился Datalog. (может вам полезно будет, а может и нет)
плоская подошва = как вы описали смещение центра тяжести, прогиб спины/позвоночника со смещениями плеч и живота. встать на носочки(или средний/высокий каблук) = выравнивание позвоночника, плеч и подтягивание живота. плюсом мощный сигнал расслабления мышц от ног и не только. моментальная адаптация под обувь с более высоким каблуком. адаптация с более высоко-каблучную обувь на более низко-каблучную обувь очень дискомфортна и занимает 24+ часов.
такой опыт человека вписывается по вашу картину мира?
у qwen с 8 сентября для новых аккаунтов бесплатные квоты.(хватает только на потестить). там же есть Kimi K3 и k2.7 code.
начиная с qwen3.7 max и особенно qwen3.8 max заметно улучшилась для задач кодинга.
модели flash и plus у qwen слабые.
смотри плагины/расширения на github, вроде подобное попадалось
потолок у современных "обычных" материнских плат именно две видеокарты.
есть материнские платы у которых есть поддержка именно двух видеокарт по x8 + x8 PCiE, что более чем достаточно для инференса. почти все эти материнские платы из верхней ценовой категории.
в прошлом году средне-бюджетную плату с x8/x8 под intel ultra 265k брал, как раз в расчёт на поддержку двух rtx 5090.
в средне-бюджетном сегменте таких плат почти нету, в топ сегменте плат тоже не всегда присутствует.
то есть это НЕ про материнские платы рабочих станций или серверов.
rtx 3090 имеют поддержку NVLink 3.0
для объединения видеокарт нужны linux и vllm(или другая оптимизированя для работы с несколькими ускорителями). windows и llama.cpp плохо оптимизированы под объединение нескольких видеокарт под одну модель.
и напомню что речь шла об инференсе. современные x8 PCiE обеспечивают пропускную способность с запасом.
обучение моделей или научные(и близкие к ним точные вычисления) задачи имеют отдельную специфику.
древняя tesla v100 не поддерживает множества современных аппаратных ускорений инференса и может быть интересна наверно только для научных или иных расчётов.
в 128GB vRAM не влезет целиком glm/qwen/deepseek уровня flash последних версий.
да и в цену нужно прибавить остальное железо для создания такого кластера.
то есть конкуренция с моделями по подпискам за ~10$.
для DeepSeek V4 Pro нужен кластер на 900+ GB vRAM. а эта модель кратно уступает возможностям подписок за 100$.
для локального инференса более менее подходят модели под 24/48/64 гб vram.
то есть под одиночные или пары 3090/4090/5090 - для нормальной скорости.
если скорости не критичны то есть варианты на ram.(NVIDIA DGX Spark, Mac Studio Max/Ultra, AMD Strix Halo / Gorgon Halo) - выйдет дешевле и производительней за те же 128GB.
самоокупаемость возможна только у инференса, но главная статья расходов у компаний это разработки новых моделей.
по этому поводу были статьи.
и в этом ключе интересно выглядит заявления об том что прогресс(разработку новых моделей) нужно замедлять.
все компании ускорили выпуски новых моделей, что наверняка плохо сказалось на финансовых показателях.
qwen max умнее и дешевле и свежее чем kimi k3.
у меня несколько разных подписок и я использую гибридное использование: у агентов и субагентов разные модели.
в таблице использования(в консоле в кабинете) у каждой модели отображается свои уровни использования.
но я не достигал ещё ограничений квот, так что могу ошибаться
добавлю что opencode go тарифы/цены моделей почти всегда без скидок.
другие сервисы, например опенроутер имеет предложения со скидками на модели.
opencode go обещают суммарно 60$, то есть можно потратить на 4 модели по 15$ из категории тяжёлых/флагманских.
или же в несколько окон пользоваться моделями уровня glm flash, deepseek flash, Qwen Flash и за срок подписки не увидеть лимитов использования.
и где предлагают эту старую модель по цене free со стабильным api?
я имел ввиду что wifi можно было бы заменить проводами/кабелями.
но я понял что путь проводов не ваш.
но всё равно если прокинуть кабели хотя бы к соединим ульям то это бы сократило себестоимость.
хотя смотря на ваши расчёты основная статья расходов это платформа для датчиков веса.
Arduino nano(и аналоги) экономичней по потреблению и возможно не пришлось бы так сильно возится с питанием.
отдельный независимый комплект под каждый улей - включает в числе прочих отдельную "батарейку" и опционально солнечные панели. а так же совмещение питания.
если делать серьёзные прокладки то и сами кабеля придётся брать более серьезные. себестоимость растёт.
а так можно было бы использовать что то вроде кабеля Cat 5e(или попроще).
весной проложить/развесить, осенью снять и убрать.
Arduino nano
почему ESP32 а не платы Arduino? просто интересно
я про то что использовать один ESP32/Arduino на несколько комплектов тензодатчиков.
что бы сигнал доходил(между ульями солидное расстояние для слабых сигналов) до ESP32/Arduino от тензодатчиков использовать усилитель(перевод в цифровой сигнал) который получая сигнал усиливает и отправляет на один ESP32/Arduino. то есть сигналы от тензодатчиков усиливаясь уходят на ESP32/Arduino по кабелям.
плюс вроде есть модуль что бы подключать/переключать(как раз поочерёдное снятие данных с ульев) больше датчиков.
из минусов кабели между ульями, из плюсов меньше плат. по себестоимости может выйти дешевле.
расклады я прикидывал под Arduino, для ESP32 как обстоят дела не знаю совсем.
летом пасека посещается несколько раз в неделю, так что замена вручную батареи/акб не проблема.
в этом обстоятельстве - возня с солнечной панелью сомнительна.
хотя есть альтернативные подходя когда пасеку почти не посещают, тогда может быть. но проще добавить батарей.
когда ульев более 10, нужны же оптимизации?
например на 1 мозг/контроллер подключать несколько ульев, опрашивая датчиков от ульев по очереди. там правда потребуются усилители, кабели и возможно что то ещё.
а модуль wifi/bt подключать под конец.
а почему не 2G модуль мобильной связи? для передачи данных его возможностей хватило бы.
ещё можно было бы возможно добавить датчики температуры.
и нельзя забывать что пчёлы очень чувствительны к электромагнитным воздействиям.
солнечные же панели для сборки по сравнению с "батарейками" не оправдываются же?
в железе не специалист, но примерно прикидывал как сделать умным пасеку.
Erlang VM разрабатывался истерически(телефония, телеком, банки) в специфичных условиях где надёжность была важнее скорости.
насколько помню в Erlang VM при высоких нагрузках замедляется что бы постараться обслужить всех.
этот паттерн поведения почти ни у кого не встречается реально.
вообще ещё существуют игра слов и и специфические вещи.
например ту же игру слов могут обыграть в рамках произведения и даже главы по разному.
тупая нейронка скорей всего это сгладит. то есть утеря художественной ценности.
ещё нужно учитывать что большая часть весов нейронок/моделей обучена на переводах с потерями. качественные переводы в общей массе переводов малы и с учётом что модели смещены к среднему выходит что мы получаем по умолчанию переводы с потерями.
сжатие это для меня антипатерн для промежуточных данных.
по сути это loss версия данных и дальнейшее использование их может(и часто) приводить к очень неприятным сюрпризам.
теряются много детали которые как раз можно было бы подчерпнуть для повышения качества.
кроме слов существуют устойчивые словосочетания, выражения и предложения.
нередко можно найти материалы от авторов по своим произведениям, включая форматов вопрос-ответ.
в качестве продвинутых систем знаний можут выступать векторно-графовые базы данных.
кроме того в качестве полезных данных могут выступать уже переведённые прошлые книги серии. там уже получаются пары книга на исходном языке + книга в переводе.
кто то в своих проектах переводе книг это учитывает?
Вам бы наверное более комфортно было в Осаке или Хоккайдо.
Вообще дискриминация проявляется так или иначе в большинстве странах включая РФ и Европу.
Правильный вопрос был бы не сколько я получу, а какой уровень жизни это мне даст и сколько после этого останется.
США и Китай имеют большое население которому нужно много продовольствия и эти страны допускают много компромиссов для покрытия базовых потребностей населения. При сопоставимом уровне жизни/качества всё не так однозначно. например живя в San Francisco и качественно питаясь даже с теми местными доходами будет мало что оставаться в кармане.
немалая часть внутреннего продовольствия выращивается и выращивалось как раз теми кто имеет большой возраст.
и как вы уже вроде упомянули эта категория(65+ и не только) в последнее время сильно и быстро убывает.
кроме того люди в таком возрасте не склонны к новшествам и поэтому рост производительности труда в фермерском сельском хозяйстве в целом давно остановилось. мигранты фермеры показывают намного лучшее показатели.
так же нельзя забывать про высокие стандарты как при внутреннем производстве(производство дороже) так и при импорте(высокие требования сильно отфильтровывают продукцию. как упомянул выше те же американцы были бы рады завозить свою продукцию гмо напичканной химий но...).
личное мнения, у каждого может быть своё мнение.
концепт: существуют триггеры на которые реакция интеллекта/ai должна быть значительней или по иному особой.
концепт - да, реализация - нет.
у вас похоже получился микс.
как по мне характер персонажа это одно, а его отношения и реакция это другое.
в моём прототипе персонаж стойко держит свой характер даже на промт инъекции, при том что на это защиты не было и я ещё не реализовал отношения.
p.s. и кстати пока читал вспомнился Datalog. (может вам полезно будет, а может и нет)
плоская подошва = как вы описали смещение центра тяжести, прогиб спины/позвоночника со смещениями плеч и живота.
встать на носочки(или средний/высокий каблук) = выравнивание позвоночника, плеч и подтягивание живота. плюсом мощный сигнал расслабления мышц от ног и не только.
моментальная адаптация под обувь с более высоким каблуком.
адаптация с более высоко-каблучную обувь на более низко-каблучную обувь очень дискомфортна и занимает 24+ часов.
такой опыт человека вписывается по вашу картину мира?