И главное, очень сложно интерпретировать результат, т.е. объяснить его, даже если он правильный. Нейросеть - это черный ящик. Я в своих сервисах с LLM буду делать акцент на первоисточниках. Т.е. для каждого утверждения необходимо давать ссылку на первоисточник. Иначе сервис становится просто опасным.
Проблема не в персональных данных, а в резиновой невнятной трактовке.
Например, маленькому обучающему сайтику ничего не нужно кроме email. Это перс. данные? Вряд ли. Это надо большой фантазией обладать, чтобы отнести email к перс. данным. Но формально email относят к перс. данным. Или... не относят...
А куки сами по себе вообще не относятся к перс. данным. Например, если я мой сайт будет в куке хранить размер шрифта, это перс. данные? Очевидно, нет. Даже если в куке будет храниться уникальный ID посетителя, это тоже еще не перс.данные, т.к. номер этот сам сайтик и генерит (буквально от балды). А вот если сайт соберет реальные перс. данные и свяжет их с id в куках, тогда да - можно трактовать этот id как перс. данные. Но не куки сами по себе.
Если же трактовать всё формально, то под сбор перс. данных можно отнести даже сайт визитку (или вообще страницу-заглушку) без установленных метрических программ.
ЗЫ:
В мультике про козленка, который всех посчитал, по сути показан процесс установки кук, т.е. он (козленок) по формальной широкой трактовке проводил сбор перс. данных, за что и огреб...
Да, самостоятельно можно вытянуть до 11-го класса. И онлайн-курсы есть хорошие. Мы всё это прошли, но не вместо, а параллельно школе. Много раз возникала мысль, что в школе теряется много времени, но... это касается нашего конкретного случая: в школе в одно ухо влетает - в другое вылетает, однако при индивидуальном объяснении сын легко врубается в тему. Но у сына есть и одноклассники, которые и в школе с ходу схватывали материал. Это всё очень индивидуально.
Мои личные выводы и градации таковы:
Хорошие онлайн-школы лучше обычной средненькой школы.
Хорошая школа со спец.уклоном лучше хороших онлайн-школ.
Самообучение и онлайн-школы требуют жесточайшей дисциплины. Ребенок не обладает требуемой силой воли, на самотек отпускать нельзя, нужен строгий контроль.
Социализация так или иначе нужна. Нужны друзья, нужно общение. Занятия в спортивных секциях, например, хороши. И в случае домашнего обучения, наверно обязательны. Да и сам пусть физическими упражнениями занимается, на турнике дома и на улице подтягивается, пусть цель поставит, например - 20 раз подтянуться.
Не надо сосредотачиваться только лишь на определенных предметах. Как верно написали выше, нужна широта знаний. Это лишь с возрастом начинаешь понимать. Помочь в освоении второстепенных предметов могут онлайн-курсы.
Не надо прямо уж всегда и везде создавать комфортные условия обучения. Не надо на каждый чих пытаться вызвать интерес. Для освоения многих предметов (особенно на начальных этапах) нужна сила воли, её надо тоже развивать.
Что касается БВИ, то судя по скандалам прошедших лет (особенно этого года), мне кажется, количество мест для БВИ сильно ограничат, поэтому я бы не стал на это ориентироваться - наверняка всё поменяется.
ЗЫ:
Важный момент: лет с 15-16 во многих случаях у подростков начинается сложный переломный период. Могут быть психозы, непредсказуемые действия и т.д. Сыночка-корзиночка превращается в... Этот период надо перетерпеть, но он может длиться весьма долго - до 20+ лет. И не наделяйте детей недвижимостью (в собственность), это очень опасно!
Наверняка так и происходит. Поэтому я и задаюсь вопросом: а не стремно ли вот так в открытую...? Сейчас глянул: за первое нарушение штраф до 6 миллионов руб., за повторное - до 18 миллионов руб. Не каждая фирмочка выдержит.
Если не ошибаюсь, обезличенные данные также регулируются. Недавно подробный разбор читал на эту тему (вроде здесь на хабре). Насколько помню, с китайскими моделями обезличив и прикрывшись горой бумаг с натяжкой вроде как можно, но с американскими как я понял невозможно. Да и гарантированно всё обезличить невозможно. Даже ФИО вычистить проблематично. Но опять таки, для этого нужна своя локальная LLM или какая-нибудь прога. Если уж начать заниматься качественным обезличиванием и подобными вещами, то проще свою локальную модель создать путем дообучения на базе qwen3.5 - сразу для оценки резюме, с RAG и прочими плюшками.
А какие LLM используют кадровики? Зарубежные или свои локальные? Если зарубежные облачные, то не рискуют ли они? Это же получается трансграничная передача персональных данных? Штрафы драконовские многомиллионные, а легализовать, слышал, почти невозможно. Неужели они не оценивают риски?
А в вузе и не должны "учить", тем более прикладным вещам. Это не школа и не ПТУ. Студент должен учиться самостоятельному обучению (это, кстати, признак сеньора) и получать в вузе прежде всего фундаментальные знания, а не навыки работаты с каким-нибудь новомодным современным фреймворком (для этого есть курсы).
Инженер - по крайней мере подразумевает наличие высшего образования. А джун, мидл, сеньор как я понимаю вообще не подразумевают никакого образования (оно может быть, а может не быть), а подразумевают только опыт и уверенность владения определенным набором инструментов. Т.е. градация идет в другой плоскости.
Тоже пытаюсь проанализировать ситуацию... Имхо, проблема уже заключается в самом (новомодном) делении разработчиков на джунов-миддлов-сеньоров. Кто это? Вот, понятие инженер более-менее понятно. А эти кто? Получается, кто угодно? Как я понимаю, это деление было введено на Западе в связи с очень быстрыми изменениями в АйТи области, а зачастую с надуванием инвестиционных пузырей и хайпом. И деление это, как я понимаю, касается не профессиональных знаний, а степени автономности при выполнении узкого звена задач на конвейере разработки. Широкие знания инженерные стали не нужны, на первый план вышел опыт владения определенным набором инструментов - определенными языками и фреймворками. По большей части фреймворками.
Все более-менее сложные расчеты/алгоритмы упакованы в библиотечные модули, что дало возможность без глубоких знаний и понимания создавать из этих кубиков сложные системы. Разработчики по сути превратились в операторов фреймворков.
Итак, мы имеем: конвейер и цепочку операторов-разработчиков в качестве звеньев этой цепи. У каждого оператора узкий круг задач, а его статус (джун-миддл-сеньор) определяется степенью автономности/самостоятельности при выполнении данного круга задач.
Видите, всё уже готово для замены разработчиков роботами... "Женщину вынули, робота поставили"... Ку... :)
А вот без инженеров здесь не обойтись, не заработает без них конвейер.
Это я к чему? Сдается мне, что обучаться сейчас стоит в глубину, надо осваивать общие принципы, концепции. А в ширину - осваивать всё больше и больше бесконечных фреймворков - это лучше оставить AI, на этом поле он будет вне конкуренции.
И да, о легком старте в АйТи, думаю, можно уже забыть. Надо сразу "становиться ёжиками"...
За что боролись, на то и напоролись? Если во главу угла ставить оформление (по ГОСТам и пр.), то разумеется ИИ полностью и идеально выполнит эту работу, что сделает дипломную работу бессмысленной. Если же на первое место ставить результат, если студент понимает суть и может объяснить, то ИИ ничего не меняет, вообще ничего.
Цитирую: ускорение разработки на 30-70%, минус 45% критических багов в проде, в четыре раза сокращения времени онбординга, менторство, ревью и т.д. И всё это за пять лет работы.
Очевидно же, что указание этих чисел в резюме - почти 100%-й признак того, что резюме не имеет никакого отношения к действительности, написано по чьим-то советам или (что вероятней) сгенерировано по шаблонам, и его можно сразу отправлять в корзину. Кто эти советы раздает?
С инженерной точки зрения не вижу страшных рисков, наоборот - вижу море новых возможностей, которые еще только предстоит осознать. ИИ - это новый, не до конца изученный, мощный инструмент. Но подчеркну - мощным он становится в руках инженера. Говорю именно про инженеров в классическом понимании, т.е. про спецов с широким набором базовых знаний (и не только технических) во многих сферах. В таких руках этот инструмент будет наиболее эффективен. Также инженер с ходу видит отрезвляющую картину: множество неочевидных ограничений и слабых мест (чего обыватель не видит). А это архиважно! Т.е. важно уметь четко определять область/границы применения новой технологии.
С обывательской точки зрения - это чудо-горшочек, которому достаточно сказать "вари", и он сварит... Вау эффект затмевает разум, появляется эйфория, последствия не просчитываются, особенности игнорируются, т.к. их просто не видят (и не хотят видеть), о многих даже не догадываются. Увы, но этот субъективный вау-эффект нельзя игнорировать, его последствия будут вполне реальны.
Что касается увольнений, то ИИ, конечно, сыграет свою роль: на "операторах фреймворков" похоже это скажется в первую очередь. Но всё же больше склоняюсь к тому, что на первом месте стоит экономическая ситуация (и у нас и в мире), и ИИ - это скорее удачный предлог/повод для увольнений, чем настоящая причина.
По моим ощущениям Qwen3.6 хорошо работает в квантах Q4. Я склоняюсь к использованию либо Q4, либо сразу Q6-Q8. В общем Q4 - рабочая лошадка. На сложных и объемных заданиях Q4 выдает результат проще, но всегда лучше декомпозировать задачу на простые шаги. Т.е. я бы организовал работу так, чтобы поручать локальной LLM всегда простые задачи, тогда Q4 вполне справится, причем быстро. Еще попробуйте квант IQ4_NL. Он еще компактней.
Сейчас я скомпилировал сегодняшнюю версию llama.cpp (где MTP нативно внедрили уже) - результат вроде стал лучше, чем было в предварительных версиях. Но отличается от того, что было без MTP. Не могу сказать, что хуже/лучше, но результаты отличаются. Буду еще тестировать.
Qwen3.6-27B все хвалят, да и сам пробовал, могу подтвердить. С квантами Q4-Q6. Для простых и типовых кусков кода достаточно что-то варианта из Q4:...Q4_K_XL. Если нужна точность и код более-менее объемный надо проанализирвать/сгенерить, то лучше варианты Q6. Я вчера пробовал кодировать небольшую игрушку, а также игровое поле. Тестировал Q4_K_XL, Q5_K_XL, Q6_K_XL. Игру беспроблемно написали все, в рабочем виде, но с Q6_K_XL игра получилась более навороченной по спецэффектам. До этого пробовал по работе небольшой код простого микросервиса написать. Q4 выдал простое незамороченное решение. А Q8_0 выдал что-то похожее на энтерпрайз уровень: на каждый чих проверка на ошибки, вынесение констант и настроек в отдельные файлы, всё типизированно и пр. Я, кстати, выбрал первый простой вариант.
Экспериментировал в редакторе zed (там агенты из коробки, легко настраиваются). Интересно наблюдать там за генерацией. zed похоже использует свою проверку синтаксиса для проверки результата работы LLM. Сначала думает, потом генерит код, потом пишет, что чекер редактора выдает ошибки, переделывает код,... опять ошибки... и так до тех пор, пока в редакторе не останется ни одного подсвечивания (ни ошибок, ни предупреждений)... и в итоге сохраняет результат в файлы.
Несколько дней назад пробовал MTP для qwen3.6-27b, вчера много тестировал (для целей кодинга). Прирост скорости есть и заметный, но, увы, точность и стабильность результата заметно хуже. Тестировал на кванте Q6_K_XL. Без MTP результат стабильно оказывался качественнее. Сегодня, смотрю, вышла llama.cpp с официальной поддержкой MTP, попробую с ней потестировать, всё же с mtp 27B работает заметно шустрее.
А перечислить хотя бы пяток аналогов депутат Горелкин сможет? Вопрос риторический, конечно...
Да не в аналогах дело. Если бы речь шла только о своем коде, то можно было бы и без git и без аналогов обойтись, работать по старинке. Но ведь любой код так или иначе на 90-99% базируется или завязан на чужом коде (всевозможные библиотеки, фреймворки и пр.), а это всё находится там. После таких блокировок ничего работать не будет, даже "Hello word"...
И главное, очень сложно интерпретировать результат, т.е. объяснить его, даже если он правильный. Нейросеть - это черный ящик. Я в своих сервисах с LLM буду делать акцент на первоисточниках. Т.е. для каждого утверждения необходимо давать ссылку на первоисточник. Иначе сервис становится просто опасным.
Проблема не в персональных данных, а в резиновой невнятной трактовке.
Например, маленькому обучающему сайтику ничего не нужно кроме email. Это перс. данные? Вряд ли. Это надо большой фантазией обладать, чтобы отнести email к перс. данным. Но формально email относят к перс. данным. Или... не относят...
А куки сами по себе вообще не относятся к перс. данным. Например, если я мой сайт будет в куке хранить размер шрифта, это перс. данные? Очевидно, нет. Даже если в куке будет храниться уникальный ID посетителя, это тоже еще не перс.данные, т.к. номер этот сам сайтик и генерит (буквально от балды). А вот если сайт соберет реальные перс. данные и свяжет их с id в куках, тогда да - можно трактовать этот id как перс. данные. Но не куки сами по себе.
Если же трактовать всё формально, то под сбор перс. данных можно отнести даже сайт визитку (или вообще страницу-заглушку) без установленных метрических программ.
ЗЫ:
В мультике про козленка, который всех посчитал, по сути показан процесс установки кук, т.е. он (козленок) по формальной широкой трактовке проводил сбор перс. данных, за что и огреб...
А какая скорость у вас на 4090 получилась?
У меня такие скорости для Qwen3.8-27B-UD-Q4_K_XL (с MTP):
4090 ~ 70-80 t/s
5090 ~ 120 t/s
2x5060ti ~ 40 t/s.
Без MTP примерно вдвое меньше.
Да, самостоятельно можно вытянуть до 11-го класса. И онлайн-курсы есть хорошие. Мы всё это прошли, но не вместо, а параллельно школе. Много раз возникала мысль, что в школе теряется много времени, но... это касается нашего конкретного случая: в школе в одно ухо влетает - в другое вылетает, однако при индивидуальном объяснении сын легко врубается в тему. Но у сына есть и одноклассники, которые и в школе с ходу схватывали материал. Это всё очень индивидуально.
Мои личные выводы и градации таковы:
Хорошие онлайн-школы лучше обычной средненькой школы.
Хорошая школа со спец.уклоном лучше хороших онлайн-школ.
Самообучение и онлайн-школы требуют жесточайшей дисциплины. Ребенок не обладает требуемой силой воли, на самотек отпускать нельзя, нужен строгий контроль.
Социализация так или иначе нужна. Нужны друзья, нужно общение. Занятия в спортивных секциях, например, хороши. И в случае домашнего обучения, наверно обязательны. Да и сам пусть физическими упражнениями занимается, на турнике дома и на улице подтягивается, пусть цель поставит, например - 20 раз подтянуться.
Не надо сосредотачиваться только лишь на определенных предметах. Как верно написали выше, нужна широта знаний. Это лишь с возрастом начинаешь понимать. Помочь в освоении второстепенных предметов могут онлайн-курсы.
Не надо прямо уж всегда и везде создавать комфортные условия обучения. Не надо на каждый чих пытаться вызвать интерес. Для освоения многих предметов (особенно на начальных этапах) нужна сила воли, её надо тоже развивать.
Что касается БВИ, то судя по скандалам прошедших лет (особенно этого года), мне кажется, количество мест для БВИ сильно ограничат, поэтому я бы не стал на это ориентироваться - наверняка всё поменяется.
ЗЫ:
Важный момент: лет с 15-16 во многих случаях у подростков начинается сложный переломный период. Могут быть психозы, непредсказуемые действия и т.д. Сыночка-корзиночка превращается в... Этот период надо перетерпеть, но он может длиться весьма долго - до 20+ лет. И не наделяйте детей недвижимостью (в собственность), это очень опасно!
Наверняка так и происходит. Поэтому я и задаюсь вопросом: а не стремно ли вот так в открытую...? Сейчас глянул: за первое нарушение штраф до 6 миллионов руб., за повторное - до 18 миллионов руб. Не каждая фирмочка выдержит.
Если не ошибаюсь, обезличенные данные также регулируются. Недавно подробный разбор читал на эту тему (вроде здесь на хабре). Насколько помню, с китайскими моделями обезличив и прикрывшись горой бумаг с натяжкой вроде как можно, но с американскими как я понял невозможно. Да и гарантированно всё обезличить невозможно. Даже ФИО вычистить проблематично. Но опять таки, для этого нужна своя локальная LLM или какая-нибудь прога. Если уж начать заниматься качественным обезличиванием и подобными вещами, то проще свою локальную модель создать путем дообучения на базе qwen3.5 - сразу для оценки резюме, с RAG и прочими плюшками.
А какие LLM используют кадровики? Зарубежные или свои локальные? Если зарубежные облачные, то не рискуют ли они? Это же получается трансграничная передача персональных данных? Штрафы драконовские многомиллионные, а легализовать, слышал, почти невозможно. Неужели они не оценивают риски?
А в вузе и не должны "учить", тем более прикладным вещам. Это не школа и не ПТУ. Студент должен учиться самостоятельному обучению (это, кстати, признак сеньора) и получать в вузе прежде всего фундаментальные знания, а не навыки работаты с каким-нибудь новомодным современным фреймворком (для этого есть курсы).
Инженер - по крайней мере подразумевает наличие высшего образования. А джун, мидл, сеньор как я понимаю вообще не подразумевают никакого образования (оно может быть, а может не быть), а подразумевают только опыт и уверенность владения определенным набором инструментов. Т.е. градация идет в другой плоскости.
Тоже пытаюсь проанализировать ситуацию...
Имхо, проблема уже заключается в самом (новомодном) делении разработчиков на джунов-миддлов-сеньоров. Кто это? Вот, понятие
инженерболее-менее понятно. А эти кто? Получается, кто угодно? Как я понимаю, это деление было введено на Западе в связи с очень быстрыми изменениями в АйТи области, а зачастую с надуванием инвестиционных пузырей и хайпом. И деление это, как я понимаю, касается не профессиональных знаний, а степени автономности при выполнении узкого звена задач на конвейере разработки. Широкие знания инженерные стали не нужны, на первый план вышел опыт владения определенным набором инструментов - определенными языками и фреймворками. По большей части фреймворками.Все более-менее сложные расчеты/алгоритмы упакованы в библиотечные модули, что дало возможность без глубоких знаний и понимания создавать из этих кубиков сложные системы. Разработчики по сути превратились в операторов фреймворков.
Итак, мы имеем: конвейер и цепочку операторов-разработчиков в качестве звеньев этой цепи. У каждого оператора узкий круг задач, а его статус (джун-миддл-сеньор) определяется степенью автономности/самостоятельности при выполнении данного круга задач.
Видите, всё уже готово для замены разработчиков роботами... "Женщину вынули, робота поставили"... Ку... :)
А вот без инженеров здесь не обойтись, не заработает без них конвейер.
Это я к чему? Сдается мне, что обучаться сейчас стоит в глубину, надо осваивать общие принципы, концепции. А в ширину - осваивать всё больше и больше бесконечных фреймворков - это лучше оставить AI, на этом поле он будет вне конкуренции.
И да, о легком старте в АйТи, думаю, можно уже забыть. Надо сразу "становиться ёжиками"...
За что боролись, на то и напоролись? Если во главу угла ставить оформление (по ГОСТам и пр.), то разумеется ИИ полностью и идеально выполнит эту работу, что сделает дипломную работу бессмысленной. Если же на первое место ставить результат, если студент понимает суть и может объяснить, то ИИ ничего не меняет, вообще ничего.
Очевидно же, что указание этих чисел в резюме - почти 100%-й признак того, что резюме не имеет никакого отношения к действительности, написано по чьим-то советам или (что вероятней) сгенерировано по шаблонам, и его можно сразу отправлять в корзину. Кто эти советы раздает?
Мне видится в ситуации два аспекта:
1) В плоскости инженера.
2) В плоскости обывателя.
С инженерной точки зрения не вижу страшных рисков, наоборот - вижу море новых возможностей, которые еще только предстоит осознать. ИИ - это новый, не до конца изученный, мощный инструмент. Но подчеркну - мощным он становится в руках инженера. Говорю именно про инженеров в классическом понимании, т.е. про спецов с широким набором базовых знаний (и не только технических) во многих сферах. В таких руках этот инструмент будет наиболее эффективен. Также инженер с ходу видит отрезвляющую картину: множество неочевидных ограничений и слабых мест (чего обыватель не видит). А это архиважно! Т.е. важно уметь четко определять область/границы применения новой технологии.
С обывательской точки зрения - это чудо-горшочек, которому достаточно сказать "вари", и он сварит... Вау эффект затмевает разум, появляется эйфория, последствия не просчитываются, особенности игнорируются, т.к. их просто не видят (и не хотят видеть), о многих даже не догадываются. Увы, но этот субъективный вау-эффект нельзя игнорировать, его последствия будут вполне реальны.
Что касается увольнений, то ИИ, конечно, сыграет свою роль: на "операторах фреймворков" похоже это скажется в первую очередь. Но всё же больше склоняюсь к тому, что на первом месте стоит экономическая ситуация (и у нас и в мире), и ИИ - это скорее удачный предлог/повод для увольнений, чем настоящая причина.
По моим ощущениям Qwen3.6 хорошо работает в квантах Q4. Я склоняюсь к использованию либо Q4, либо сразу Q6-Q8. В общем Q4 - рабочая лошадка. На сложных и объемных заданиях Q4 выдает результат проще, но всегда лучше декомпозировать задачу на простые шаги. Т.е. я бы организовал работу так, чтобы поручать локальной LLM всегда простые задачи, тогда Q4 вполне справится, причем быстро. Еще попробуйте квант IQ4_NL. Он еще компактней.
да, я это понимаю, но имею ввиду среднее качество результата после нескольких тестов.
Сейчас я скомпилировал сегодняшнюю версию llama.cpp (где MTP нативно внедрили уже) - результат вроде стал лучше, чем было в предварительных версиях. Но отличается от того, что было без MTP. Не могу сказать, что хуже/лучше, но результаты отличаются. Буду еще тестировать.
Qwen3.6-27B все хвалят, да и сам пробовал, могу подтвердить. С квантами Q4-Q6. Для простых и типовых кусков кода достаточно что-то варианта из Q4:...Q4_K_XL. Если нужна точность и код более-менее объемный надо проанализирвать/сгенерить, то лучше варианты Q6. Я вчера пробовал кодировать небольшую игрушку, а также игровое поле. Тестировал Q4_K_XL, Q5_K_XL, Q6_K_XL. Игру беспроблемно написали все, в рабочем виде, но с Q6_K_XL игра получилась более навороченной по спецэффектам. До этого пробовал по работе небольшой код простого микросервиса написать. Q4 выдал простое незамороченное решение. А Q8_0 выдал что-то похожее на энтерпрайз уровень: на каждый чих проверка на ошибки, вынесение констант и настроек в отдельные файлы, всё типизированно и пр. Я, кстати, выбрал первый простой вариант.
Экспериментировал в редакторе zed (там агенты из коробки, легко настраиваются). Интересно наблюдать там за генерацией. zed похоже использует свою проверку синтаксиса для проверки результата работы LLM. Сначала думает, потом генерит код, потом пишет, что чекер редактора выдает ошибки, переделывает код,... опять ошибки... и так до тех пор, пока в редакторе не останется ни одного подсвечивания (ни ошибок, ни предупреждений)... и в итоге сохраняет результат в файлы.
Несколько дней назад пробовал MTP для qwen3.6-27b, вчера много тестировал (для целей кодинга). Прирост скорости есть и заметный, но, увы, точность и стабильность результата заметно хуже. Тестировал на кванте Q6_K_XL. Без MTP результат стабильно оказывался качественнее. Сегодня, смотрю, вышла llama.cpp с официальной поддержкой MTP, попробую с ней потестировать, всё же с mtp 27B работает заметно шустрее.
На зону com цена в десять раз выше за продление. Если всего пара имен, то в принципе можно, а если имен много, то становится очень дорого.
Да не в аналогах дело. Если бы речь шла только о своем коде, то можно было бы и без git и без аналогов обойтись, работать по старинке. Но ведь любой код так или иначе на 90-99% базируется или завязан на чужом коде (всевозможные библиотеки, фреймворки и пр.), а это всё находится там. После таких блокировок ничего работать не будет, даже "Hello word"...