Скоро я буду тестировать MOE модель, на которой как раз хочу проверить ситуацию: "один прогон из 5 условно рабочий, а у другой модели 1 из 5 нерабочий."
Модель по запросу не понимает. Она нацелена на причинение максимальной пользы. А вот пользу каждая из моделей подразумевает по разному. Если вы работаете с топовыми облачными моделями, то можете заметить такое поведение: сначала агент бодро дает новые идеи и рекомендации в какой-то момент просто стихает, хотя идей еще может быть много. Все дело в том, что чем длиннее контекст тем дороже он обходится поставщику облачной. Это связано с особенностями работы LLM. Думаю, в скором времени я напишу статью по этому вопросу. В моем ТГ канале https://t.me/itaiowl есть посты на эту тему.
Благодарю! На самом деле есть такие мысли. Правда технику брал с расчетом именно на объем RAM. На рынке из коробки - это самое большой объем который есть. Если исходить из скорости - то однозначно надо смотреть в сторону графических ускорителей. Как раз это и хотел немного подсветить для представителей сообщества, которые выбирают что купить.
Кстати, у NVidia карт кроме скорости (VRAM намного быстрее) есть еще одно больше преимущество - CUDA, а это генерация изображений и видео, что на Mac практически не реализуемо из-за отсутствия необходимых портов ключевых функций под mlx.
Модно объяснить концепцию памяти человека через аналогию памяти компьютера.
Постоянная память - это память это жесткие диски
Кратковременная - это оперативная память
Рабочая или краткосрочная память - это регистры, которыми оперирует непосредственно процессор.
Данная игра яркий пример увеличения емкости кошелька Миллера. Он у нас в равен 7 плюс/минус 2 значения. Т.е. мы именно столько элементов последовательности мы можем удержать в голове здесь и сейчас без группировки значений.
А на какой менять? Подозреваю, что у других не лучше. Пример - получаю ЛИЧНО карту в Сбере. У меня паспорт иностранного гражданина. Специалист говорит - я не могу подтвердить Вашу личность. На вопрос что делать отвечает, что позвоните по такому то номеру и они подтвердят вашу личность. Пришлось доказывать, что это алогично, т.к. по телефону они меня не смогут идентифицировать, а тут я стою лично перед ним живой и меня можно пощупать. Просто ощущал себя в каком-то фарсе. Хорошо хоть логичные доводы помогли решить ситуацию.
Спасибо за статью! Реально не хватает таких отрезвляющих материалов.
No-code через призму маркетологов превращается в глазах собственника/инвестора в супер инструмент: дешевый и быстрый. И потом приходится разрушать радужные мечты, что со сделанным MVP вы не станете вторым Facebook или Телеграмм.
Данная статья демонстрирует искаженное восприятие микросервисной архитектуры. И что самое страшное, что она будет воздействовать на умы молодых людей, которые только встают на путь проектирования систем. Опытным специалистам с первых же абзацев видны эти искажения.
Одно лишь это предложение много чего стоит: «Вы серьезно перегрузите стек используемых технологий, что может затруднить для клиента взаимодействие с приложением.»
Вы серьезно думаете, что клиент должен знать о стеке используемых технологий? Расскажите, пожалуйста, КАК??? можно спроектировать приложение, чтобы стек используемых технологий затруднил взаимодействие с приложением.
Приведенные примеры отсутствия преимуществ микросервисов перед монолитом - это примеры НЕПРАВИЛЬНОГО проектирования.
Скоро я буду тестировать MOE модель, на которой как раз хочу проверить ситуацию: "один прогон из 5 условно рабочий, а у другой модели 1 из 5 нерабочий."
Модель по запросу не понимает. Она нацелена на причинение максимальной пользы. А вот пользу каждая из моделей подразумевает по разному. Если вы работаете с топовыми облачными моделями, то можете заметить такое поведение: сначала агент бодро дает новые идеи и рекомендации в какой-то момент просто стихает, хотя идей еще может быть много. Все дело в том, что чем длиннее контекст тем дороже он обходится поставщику облачной. Это связано с особенностями работы LLM. Думаю, в скором времени я напишу статью по этому вопросу. В моем ТГ канале https://t.me/itaiowl есть посты на эту тему.
Ловите: https://habr.com/ru/articles/1079274/
Благодарю! На самом деле есть такие мысли. Правда технику брал с расчетом именно на объем RAM. На рынке из коробки - это самое большой объем который есть. Если исходить из скорости - то однозначно надо смотреть в сторону графических ускорителей. Как раз это и хотел немного подсветить для представителей сообщества, которые выбирают что купить.
Кстати, у NVidia карт кроме скорости (VRAM намного быстрее) есть еще одно больше преимущество - CUDA, а это генерация изображений и видео, что на Mac практически не реализуемо из-за отсутствия необходимых портов ключевых функций под mlx.
Модно объяснить концепцию памяти человека через аналогию памяти компьютера.
Постоянная память - это память это жесткие диски
Кратковременная - это оперативная память
Рабочая или краткосрочная память - это регистры, которыми оперирует непосредственно процессор.
Данная игра яркий пример увеличения емкости кошелька Миллера. Он у нас в равен 7 плюс/минус 2 значения. Т.е. мы именно столько элементов последовательности мы можем удержать в голове здесь и сейчас без группировки значений.
А на какой менять? Подозреваю, что у других не лучше. Пример - получаю ЛИЧНО карту в Сбере. У меня паспорт иностранного гражданина. Специалист говорит - я не могу подтвердить Вашу личность. На вопрос что делать отвечает, что позвоните по такому то номеру и они подтвердят вашу личность. Пришлось доказывать, что это алогично, т.к. по телефону они меня не смогут идентифицировать, а тут я стою лично перед ним живой и меня можно пощупать. Просто ощущал себя в каком-то фарсе. Хорошо хоть логичные доводы помогли решить ситуацию.
Спасибо за статью! Реально не хватает таких отрезвляющих материалов.
No-code через призму маркетологов превращается в глазах собственника/инвестора в супер инструмент: дешевый и быстрый. И потом приходится разрушать радужные мечты, что со сделанным MVP вы не станете вторым Facebook или Телеграмм.
Чтобы обратится старшему по званию ИИ должен понять, что он не знает ответа на вопрос. А это уже другая история...
Как бы помягче выразиться…
Данная статья демонстрирует искаженное восприятие микросервисной архитектуры. И что самое страшное, что она будет воздействовать на умы молодых людей, которые только встают на путь проектирования систем. Опытным специалистам с первых же абзацев видны эти искажения.
Одно лишь это предложение много чего стоит: «Вы серьезно перегрузите стек используемых технологий, что может затруднить для клиента взаимодействие с приложением.»
Вы серьезно думаете, что клиент должен знать о стеке используемых технологий? Расскажите, пожалуйста, КАК??? можно спроектировать приложение, чтобы стек используемых технологий затруднил взаимодействие с приложением.
Приведенные примеры отсутствия преимуществ микросервисов перед монолитом - это примеры НЕПРАВИЛЬНОГО проектирования.