Прошлой ночью они уже начали блокировать SSH протокол. Идиоты. Вот они уже зае*ли блокировать нормальные сайты типа https://kubernetes.io/ , у меня даже govulncheck не может базы обновить и виснет при запуске, ИИ агенты отваливаются. Мне не интересны ваши тиктоки, сво, и вся ваша политика, мне работать надо! Дайте уже людям нормально работать и перестаньте кошмарить бизнес, который несет огромные убытки из-за этих блокировок!
Мне вот интересно, кто эти люди которых приглашают на собесы. Отправив сотни резюме, меня ни разу не пригласили на собес! Всегда считал сильной стороной это прохождение технических собесов и решение сложных задач где сыпятся 99% кандидатов, но теперь даже до этого не доходят. А когда раньше сам собеседовал людей, то даже резюме не открывал, и проверял только технические знания и потенциал кандидата. Новомодные технологии меняются раз в пару лет, глубокие технические базовые знания остаются неизменными. Условно для раскатки кластеров раньше использовали pacemaker/corosync, сейчас это kubernetes. Но без хорошей системной базы - как все это работает под капотом, траблшутить ни то ни другое не получится, а все эти новомодные технологии изучаются за неделю. Так же в программировании, можно сменить десятки языков программирования, но что остается не измененным, то это знание алгоритмов. Так же стандартная библиотека любого языка программирования изучается за неделю. Поэтому довольно глупо выглядит, когда рекрутеры получают большое количество откликов, они в список требований добавляют технологии, которые даже не используются у них в компании! Лишь бы снизить поток откликов! Какие на входе будут кандидаты легко догадаться... Все правильно, все будут слабые, которые в итоге вам положат продакшен, но при этом прошли все фильтры ИИ и использовали ИИ при собеседовании. Зато на фоне таких требований хорошие специалисты будут выглядеть слабо т.к. все новые технологии знать в принципе не возможно и есть определенные устоявшиеся и рабочие решения. Если вы думаете, что ИИ не используют при собеседовании, то растрою вас, сейчас есть платные сервисы, которые анализируют ваш экран и общение, и автоматом подготавливают ответы на сложные вопросы. К сожалению сейчас единственный выход, это вернуться к оффлайн собесам где нет всего этого мракобесия. Зато с одной стороны говорят, что не могут найти хороших сотрудников, с другой стороны есть люди, которые может не лучшие специалисты, но они имеют хорошие знания и готовы работать, а их никто не приглашает....
Спасибо товарищ майор, но НЕТ. Никогда не было необходимости открывать рабочий стол для управления на Linux. Для всех задач достаточно ssh доступа. А если кому надо показать рабочий стойл, то всякие зумы умеют это делать из коробки. Потенциальные пользователи это неосиляторы, которых из под палки и суверенной безопасности заставили переходит на российский линукс.
Да, их полно. Вы удивитесь, но очень много крупных опенсорс проектов как чат использую IRC протокол, и им не нужны новомодные матриксы итд Хотя новомодные чаты явно бы облегчили копипаст кода в чат. Тот же GSoC пару лет назад имел чат в IRC.
Очередная ИИ шизофрения правительства США в политических целях, чтобы убить конкурентов. Большие модели типа DeepSeek-V4-Pro в принципе не реально обучать через API других больших моделей, во первых это куча денег уплаченных конкурентам, во вторых низкая скорость обучения завязанная на скорость генерации родительской модели. Можно дообучать модели через конкурирующие сервисы, но не знаю насколько это оправдано финансово. А мелкие дистилированные модели типа Qwen 27B вообще не выгодно обучать через API конкурентов, когда у того же DeepSeek есть свой не плохой DeepSeek-V4-Pro и своя инфраструктура.
Они уже больше полугода после багрепорта не могут починить сохранение сессии на RHEL подобных линукс системах. Приложение тупо не пишет конфиги в $HOME/.config/MAX и при каждом запуске просит авторизирироваться по новой. Нет поддержки Wayland, шрифты все мутные т.к. работает через XWayland.
Абсолютно одинаковая. Даже рекомендуемые параметры у обоих версий одинаковые.
Просто у 3.8 появился reasoning_effort который регулирует глубину рассуждений, температура же отвечает за "качество" рассуждений и постоянство ответов.
Это дает более детерминированный ответ. Некоторые задачи требуют одинакового точного и повторяемого результата. При температуре 1.0 в ответ включается креативность модели, она начинает выдумывать где не надо и ее рассуждения может занести не в ту степь. 1.0 - хорошо для написания уникальных текстов, генерации картинок без повторений. Но цена высокой температуры это галлюцинации, например кривые лица на изображении или люди с 6 пальцами. Для программирования хороший вариант это 0.6-0.7 так как важнее постоянство ответа. Не обязательно придерживаться рекомендаций разработчиков модели, нужно модель настраивать под свои конкретные задачи.
Не совсем так. Еще лет 20 назад провайдеров заставляли покупать СОРМ и ставить у себя. Доступ к СОРМ правоохранительные органы могли получить только по разрешению суда в рамках расследования конкретного уголовного дела. Реализацию белых списков все провайдеры делают по разному т.к. железки не всегда потянут их и стоят дорого, т.е. самый распространенный вариант это правила файервола + скрипт который дергает адреса с ркн, переводит в ип адреса и обновляет список адресов в файерволе. Как можно понять эффективность такого решения не самая высокая, а дорогое оборудование мелкие-средние провайдеры не потянут по деньгам. Так было долгое время, и ютуб у одних в стране работал, а у других нет. По итогу решили еще нагрузить магистралов и придумали более изощренные методы обработки трафика.
Да исторически было еще 20-30 лет назад, когда работал в телекоме, что самой крупной точкой обмена трафика была M9. Считайте прошло 30 лет и мало что изменилось. У нас есть министерства и ведомства, которые отвечают за развитие интернета и технологий в стране. Чем они занимались все эти годы? Наверное надо людей на курсы CISCO CCNA отправлять, чтобы знали недостатки сетевой топологии звезда.
Дело обычно не в специалистах. Спецы обычно адекватные. Дело обычно в "успешных манагерах" и их хотелках прогнуться и сделать денег, отсюда спецам просто приходится идти делать костыли вместо нормального решения, чтобы их не уволили. Думаю дело в том, что кто нужно прогнулся перед кем надо, наобещал с три короба, не правильно оценил бюджет и трудозатраты, денег было ограниченное количество, половину денег потеряли по пути, и оборудования для "суверенного интернета" хватило только на одну точку обмена трафиком.
Видимо оборудование "суверенного интернета" стоит в одном месте и поэтому трафик ходит как "нужно". Так то по хорошему BGP должен был исправить маршрутизацию через альтернативные пути, если ДЦ ляжет. В России кроме ММТС-9 есть не мало точек обмена трафиком.
Почему чисто маркетинговая версия? Модель лучшая среди открытых и меньше 35B. Скорость вам никто не обещал, да токены жрет быстрее, но качество ответов намного лучше всех существующих моделей меньше 35B. Как раз такого качества моделей еще не было, и чтобы такого размера. Как раз недостаток всех крутых моделей это огромный размер потребляемой памяти, а тут можно взять две доступные карточки (или карточку с hbm2 памятью и 32гб) и получить не самую плохую скорость и качество ответов не сильно хуже крупных моделей, для запуска которых локально надо денег раз в 10.
Точно стоит, если вам не важна скорость генерации. Где-то видел тесты, что Qwen 27B набирала больше балов во всех тестах чем 35B A3B. Гугл говорит, что выбор модели зависит от того, что вам важнее скорость генерации или качество ответов.
Сравнение Qwen 35B-A3B (MoE) и 27B (Dense) показывает выбор между высокой скоростью работы экспертной смеси и точностью плотной архитектуры. Модель 27B умнее в сложных логических задачах и кодинге, тогда как 35B-A3B быстрее генерирует токены и требует меньше активных ресурсов на один шаг инференса. [1, 2, 3]
Архитектура и производительность
Qwen 35B-A3B: Использует архитектуру MoE (Mixture of Experts) с 36B общих параметров, но задействует всего около 3B активных параметров на токен. Обеспечивает высокую скорость генерации (до ~150 токенов/сек в облаке) и низкую задержку. [1]
Qwen 27B: Плотная (dense) модель с ~27.8B параметров. Работает медленнее (~77 токенов/сек), но демонстрирует более высокие результаты на бенчмарках интеллекта, логики и агентского кодинга. [1, 2, 3]
Запуск локально (VRAM)
35B-A3B: Из-за природы MoE требует объема памяти под полный набор весов, хотя активная часть мала. Для хорошей квантизации на ПК требуется мощная видеокарта (или связка с RAM), иначе на слабых GPU модель упирается в узкое горлышко пропускной способности памяти. [1]
27B: Плотная модель отлично масштабируется под стандартные потребительские видеокарты с 16–24 ГБ VRAM при грамотном подборе квантования (например, GGUF/NVFP4), обеспечивая стабильное и предсказуемое качество без «промахов» экспертов
Очень крутая модель. Пожалуй это лучшая модель ниже 35B. По сравнению с версией 3.5-3.6 это огромный скачек вперед. Использовал Q5_K_XL квантование. Рассуждения вышли на другой уровень, задачи решает более комплексно и лучше.
Она состоит из рандома 100%. Чтобы этого не было для кодинга надо настраивать temperature, top-p, top-k, min-p, presence-penalty , надо как минимум снижать температуру, иначе на выходе будет рандом и не детерминированный результат. Модели генеративные и создаются для генерации контента, плюс не высокое количество параметров и квантизация накладывают ограничения, отсюда на выходе модель может генерировать например человека с 3мя кривыми пальцами, вместо 5. На больших моделях такое реже встречается при высокой температуре. Про это намекнул автору выше в комментарии.
На q8 редко есть галлюцинации и не на всех задачах, они не всегда заметные, но имеют место быть, примерно на ctx 8192. В основном гоняю контекст 65536, так как даже 32к не всегда хватает для поиска багов и рефакторинга в простом C проекте.
А вы точно уверены, что они на Пронхаб не за знаниями ходили? <sarcasm>
У меня тоже внутри РФ заблокировали ssh. Паранойя на верху крепчает...
Прошлой ночью они уже начали блокировать SSH протокол. Идиоты. Вот они уже зае*ли блокировать нормальные сайты типа https://kubernetes.io/ , у меня даже govulncheck не может базы обновить и виснет при запуске, ИИ агенты отваливаются. Мне не интересны ваши тиктоки, сво, и вся ваша политика, мне работать надо! Дайте уже людям нормально работать и перестаньте кошмарить бизнес, который несет огромные убытки из-за этих блокировок!
Мне вот интересно, кто эти люди которых приглашают на собесы. Отправив сотни резюме, меня ни разу не пригласили на собес! Всегда считал сильной стороной это прохождение технических собесов и решение сложных задач где сыпятся 99% кандидатов, но теперь даже до этого не доходят. А когда раньше сам собеседовал людей, то даже резюме не открывал, и проверял только технические знания и потенциал кандидата. Новомодные технологии меняются раз в пару лет, глубокие технические базовые знания остаются неизменными. Условно для раскатки кластеров раньше использовали
pacemaker/corosync, сейчас этоkubernetes. Но без хорошей системной базы - как все это работает под капотом, траблшутить ни то ни другое не получится, а все эти новомодные технологии изучаются за неделю. Так же в программировании, можно сменить десятки языков программирования, но что остается не измененным, то это знание алгоритмов. Так же стандартная библиотека любого языка программирования изучается за неделю. Поэтому довольно глупо выглядит, когда рекрутеры получают большое количество откликов, они в список требований добавляют технологии, которые даже не используются у них в компании! Лишь бы снизить поток откликов! Какие на входе будут кандидаты легко догадаться... Все правильно, все будут слабые, которые в итоге вам положат продакшен, но при этом прошли все фильтры ИИ и использовали ИИ при собеседовании. Зато на фоне таких требований хорошие специалисты будут выглядеть слабо т.к. все новые технологии знать в принципе не возможно и есть определенные устоявшиеся и рабочие решения. Если вы думаете, что ИИ не используют при собеседовании, то растрою вас, сейчас есть платные сервисы, которые анализируют ваш экран и общение, и автоматом подготавливают ответы на сложные вопросы. К сожалению сейчас единственный выход, это вернуться к оффлайн собесам где нет всего этого мракобесия. Зато с одной стороны говорят, что не могут найти хороших сотрудников, с другой стороны есть люди, которые может не лучшие специалисты, но они имеют хорошие знания и готовы работать, а их никто не приглашает....Спасибо товарищ майор, но НЕТ. Никогда не было необходимости открывать рабочий стол для управления на Linux. Для всех задач достаточно ssh доступа. А если кому надо показать рабочий стойл, то всякие зумы умеют это делать из коробки. Потенциальные пользователи это неосиляторы, которых из под палки и суверенной безопасности заставили переходит на российский линукс.
Да, их полно. Вы удивитесь, но очень много крупных опенсорс проектов как чат использую IRC протокол, и им не нужны новомодные матриксы итд Хотя новомодные чаты явно бы облегчили копипаст кода в чат. Тот же GSoC пару лет назад имел чат в IRC.
Очередная ИИ шизофрения правительства США в политических целях, чтобы убить конкурентов. Большие модели типа DeepSeek-V4-Pro в принципе не реально обучать через API других больших моделей, во первых это куча денег уплаченных конкурентам, во вторых низкая скорость обучения завязанная на скорость генерации родительской модели. Можно дообучать модели через конкурирующие сервисы, но не знаю насколько это оправдано финансово. А мелкие дистилированные модели типа Qwen 27B вообще не выгодно обучать через API конкурентов, когда у того же DeepSeek есть свой не плохой DeepSeek-V4-Pro и своя инфраструктура.
Скорее всего NFC.
Они уже больше полугода после багрепорта не могут починить сохранение сессии на RHEL подобных линукс системах. Приложение тупо не пишет конфиги в
$HOME/.config/MAXи при каждом запуске просит авторизирироваться по новой. Нет поддержки Wayland, шрифты все мутные т.к. работает через XWayland.Абсолютно одинаковая. Даже рекомендуемые параметры у обоих версий одинаковые.
Просто у 3.8 появился
reasoning_effortкоторый регулирует глубину рассуждений, температура же отвечает за "качество" рассуждений и постоянство ответов.Смотрите мой комментарий ниже.
Это дает более детерминированный ответ. Некоторые задачи требуют одинакового точного и повторяемого результата. При температуре 1.0 в ответ включается креативность модели, она начинает выдумывать где не надо и ее рассуждения может занести не в ту степь. 1.0 - хорошо для написания уникальных текстов, генерации картинок без повторений. Но цена высокой температуры это галлюцинации, например кривые лица на изображении или люди с 6 пальцами. Для программирования хороший вариант это 0.6-0.7 так как важнее постоянство ответа. Не обязательно придерживаться рекомендаций разработчиков модели, нужно модель настраивать под свои конкретные задачи.
Не совсем так. Еще лет 20 назад провайдеров заставляли покупать СОРМ и ставить у себя. Доступ к СОРМ правоохранительные органы могли получить только по разрешению суда в рамках расследования конкретного уголовного дела. Реализацию белых списков все провайдеры делают по разному т.к. железки не всегда потянут их и стоят дорого, т.е. самый распространенный вариант это правила файервола + скрипт который дергает адреса с ркн, переводит в ип адреса и обновляет список адресов в файерволе. Как можно понять эффективность такого решения не самая высокая, а дорогое оборудование мелкие-средние провайдеры не потянут по деньгам. Так было долгое время, и ютуб у одних в стране работал, а у других нет. По итогу решили еще нагрузить магистралов и придумали более изощренные методы обработки трафика.
Да исторически было еще 20-30 лет назад, когда работал в телекоме, что самой крупной точкой обмена трафика была M9. Считайте прошло 30 лет и мало что изменилось. У нас есть министерства и ведомства, которые отвечают за развитие интернета и технологий в стране. Чем они занимались все эти годы? Наверное надо людей на курсы CISCO CCNA отправлять, чтобы знали недостатки сетевой топологии звезда.
Дело обычно не в специалистах. Спецы обычно адекватные. Дело обычно в "успешных манагерах" и их хотелках прогнуться и сделать денег, отсюда спецам просто приходится идти делать костыли вместо нормального решения, чтобы их не уволили. Думаю дело в том, что кто нужно прогнулся перед кем надо, наобещал с три короба, не правильно оценил бюджет и трудозатраты, денег было ограниченное количество, половину денег потеряли по пути, и оборудования для "суверенного интернета" хватило только на одну точку обмена трафиком.
Видимо оборудование "суверенного интернета" стоит в одном месте и поэтому трафик ходит как "нужно". Так то по хорошему BGP должен был исправить маршрутизацию через альтернативные пути, если ДЦ ляжет. В России кроме ММТС-9 есть не мало точек обмена трафиком.
Почему чисто маркетинговая версия? Модель лучшая среди открытых и меньше 35B. Скорость вам никто не обещал, да токены жрет быстрее, но качество ответов намного лучше всех существующих моделей меньше 35B. Как раз такого качества моделей еще не было, и чтобы такого размера. Как раз недостаток всех крутых моделей это огромный размер потребляемой памяти, а тут можно взять две доступные карточки (или карточку с hbm2 памятью и 32гб) и получить не самую плохую скорость и качество ответов не сильно хуже крупных моделей, для запуска которых локально надо денег раз в 10.
Точно стоит, если вам не важна скорость генерации. Где-то видел тесты, что Qwen 27B набирала больше балов во всех тестах чем 35B A3B. Гугл говорит, что выбор модели зависит от того, что вам важнее скорость генерации или качество ответов.
Очень крутая модель. Пожалуй это лучшая модель ниже 35B. По сравнению с версией 3.5-3.6 это огромный скачек вперед. Использовал Q5_K_XL квантование. Рассуждения вышли на другой уровень, задачи решает более комплексно и лучше.
Она состоит из рандома 100%. Чтобы этого не было для кодинга надо настраивать
temperature, top-p, top-k, min-p, presence-penalty, надо как минимум снижать температуру, иначе на выходе будет рандом и не детерминированный результат. Модели генеративные и создаются для генерации контента, плюс не высокое количество параметров и квантизация накладывают ограничения, отсюда на выходе модель может генерировать например человека с 3мя кривыми пальцами, вместо 5. На больших моделях такое реже встречается при высокой температуре. Про это намекнул автору выше в комментарии.На q8 редко есть галлюцинации и не на всех задачах, они не всегда заметные, но имеют место быть, примерно на ctx 8192. В основном гоняю контекст 65536, так как даже 32к не всегда хватает для поиска багов и рефакторинга в простом C проекте.