Комментарии 190
Вот тут уже больно. Особенно тем, кто ищет работу только там. Я взял каждую роль и посчитал, какая доля вакансий по ней вообще отсутствует на hh - то есть живёт только на других площадках.
Вроде толковая статья, но зачем же вы так? Добавьте соавторов.
Не понял? Каких соавторов?
В последнее время вижу заражение людей стилем нейросетей. Это прям типичный абзац. Но видимо эту особенность современной речи придется принять.
Процитируем Оруэлла
Читатели переводили взгляд с нейросетей на людей, с людей на нейросети и снова с нейросетей на людей — различить, кто есть кто, стало невозможно
есть еще такой момент, что "заражается" и читатель тоже: вчера смотрел ютуб-видео 2019 года и время от времени в голове срабатывала реакция, что речевой оборот похож на нейронку. Притом, что спикер был хороший, просто мы уже дуем на воду
Да, возможно. К фактам нет вопросов. Интересно, что в процессе обучения нейросетей повлияло на возникновение характерных устойчивых конструкций и оборотов, используемых многими сетями. Хотя карикатурные формулировки более характерны ChatGPT, чем Grok или Deepseek.
Чтобы писать и понимать на "человеческом" сети учились распознавать и отвечать конструкциями нам понятными, неудивительно, что появились заимствования из речи. Поэтому сработало в обе стороны.
Я вот ОЧЕНЬ давно, лет 15, оформляю plain text в мессенджерах, подписях картинок, readme в проектах, description любых объектах при помощи списков с буллитами (•). Они легко ставятся через ALT + 7 на цифровой клавиатуре. И если раньше я ловил фразы типа "о, вот ты заморочился копипастом спецсимвола! А, это так просто через Alt? Круто!!"
А теперь (•) — это маркер ИИ, эх (
Вплоть до того, что мне теперь приходиться отдельно указывать при общении с новыми коллегами, что я, блин, не использовал тут ИИ, а просто люблю списки с буллитами и ставлю их просто на автомате через ALT+7.
это обратное влияние на язык со стороны нейронок, вода тут ни при чём 🤷♂️
вот что сообщает нам… Чад-наш-жэпэти:
— Да. Причём уже довольно убедительно:
Самая прямая работа — Yakura et al., “Empirical evidence of Large Language Model’s influence on human spoken communication”. Они взяли 737 083 часа разговорной речи из 824 634 podcast episodes, причём отфильтровывали scripted speech. После выхода ChatGPT обнаружился резкий рост именно слов, которые непропорционально любит ChatGPT: delve, showcase, boast, intricacies, meticulous и т. п. Synthetic-control анализ связывает перелом именно с релизом ChatGPT.
и он же продолжает:
И вот важная часть: это не просто «люди вставили сгенерированный абзац».
Они отдельно сделали preregistered experiment на 496 людях: после короткого общения с chatbot люди начинали сами выбирать его характерную лексику, причём эффект сохранялся после отвлекающей задачи. То есть авторы прямо интерпретируют это как встраивание LLM-лексики в активный человеческий словарь.
шах и мат, кожмеши!
(шучу-шучу, так он не говорит. Пока ещё)
Тоже ловил себя на мысли… Лозунговые цитаты тяжело читать Их какое то слишком большое количество
А вот тут начинается история…
и что меня особенно тронуло - честную документацию,
И меня наконец‑то выпустили на свободу…
Это меняет всё. Потому что теперь на вопрос “а hh вообще репрезентативен?” из комментов, можно ответить не мнением, а числом
Ответ вынес мозг…
Прочитайте это ещё раз.
И тут я себя приторможу,
. Это разные вещи.
Вот тут уже больно.
Мне кажется это уже из разряда - проще думать на всё, что это ИИ, на любой речевой оборот, на любую мысль. Но ИИ училась на текстах людей, и конкретно своего стиля у неё по сути никогда не было. Так что здесь соу-соу. Не увидел в этом тексте ничего прям нейрослоповского
LLM не из воздуха же материал для обучения скармливали. Конечно, не все люди и не полностью писали как нейронки, но наверняка кто-то хотя бы частично писал и пишет, как нейронки сейчас.
И можете сказать, какой именно паттерн нейронки в указанном вами фрагменте?
Вот тут уже больно. Особенно тем, кто ищет работу только там.
Извините, если несправедливо высказал подозрение. Давайте обсудим в литературном ключе. Какой смысл несёт фраза "вот тут уже больно". То есть это метафора, для усиления. Откуда она появилась в вашей речи?
Второе - разбиение одной мысли на два предложения. Цель - ещё большее усиление.
Мне кажется, что не вызывает вопросов такой оборот - "И вот тут становится больно тем, кто ищет работу только в hh".
Да, выходных токенов побольше, но что нам людям их токены.
Просто комментарий такой, для усиления эффекта. У меня так во всех статьях. Я так люблю делать. Просто потому-что я пишу всегда в разговорном ключе. Не надо на это смотреть как на литературное произведение или научное. Это чисто мои мысли. Я мог написать по разному, но написал так. Разве за полное прочтение статьи не прослеживался мой стиль?
Точно такой же стратегии усиления придерживаются и нейросети, ну плюс ещё противопоставление. Вы бы могли усилить нейросетевой стиль, добавив "И это не просто проблема, это - катастрофа".
Личный стиль или нет, сейчас уже сложно понять, люди дают текст и говорят сети - переформулируй понятнее, добавь цепляющих интерес моментов, усиль впечатление от текста, так что неизвестно чьё произведение получается на выходе.
Но вы мне всё объяснили, я все понял, большое спасибо, интересная дискуссия. За свою ошибку извиняюсь.
Да нейронка писала. Понятно что не все, возможно автор кинул черновики своих расчетов и попросил родить статью, потом немного причесал
Дружище, я лично вычитывал черновой вариант который был в 2 раза больше. Знал бы ты сколько версий эта статья пережила...... Вам бы к окулисту
А почему мне то к окулисту, если вычитывали Вы, а статья все равно дурно пахнет нейронкой?
Замечательно.
Помимо ребят из "Граммар-наци" на поле битвы выходят "новые , незаменимые" ребята из "Нейро-наци".
К "битвам за запятые", добавляются битвы между "у нее унутри нейронка" vs "нет, там человек".
Ученые наблюдают очередной рост энтропии комментариев.
Просто комментарий такой, для усиления эффекта. У меня так во всех статьях. Я так люблю делать.
Мы вам не верим. Это классический маркер нейронки. Статья хорошая, но доработка нейронкой залила в нее мусора, за который цепляется глаз. Очень много маркеров в тексте, даже лень разбирать очередного "я так пишу". Нет, не пишите.
Нейронки так пишут потому что при изначальной разметке люди маркировавшие варианты текста, которые им больше нравятся маркировали именно такие, с водой, клифхенгерами и тд. (писал об этом в отдельной статье, повторяться не буду) потому что такой текст сильно выделялся от обычного человеческого текста и это вначале вызывало интерес своей новизной. Никто и предположить не мог, что потом это станет эпидемией в ИИ. Люди так не пишут, там есть особенности в монотонности паттернов, которые выходят за рамки этого комментария.
Плохо не то что вы ее доработали нейронкой, это как раз нормально для сбора и проверки фактажа и тд, и даже не то что вы отрицаете это, ссылаясь на свой якобы авторский стиль. Плохо то, что вы не видите проблемы в том как нейронка портит ваше авторское изложение мыслей в действительно хорошем материале. Вы сами своими руками обесцениваете созданное вами. Это печально.
Да просто большинство людей в принципе не умеют излагать мысли, поэтому усредненная модель и звучит как курсовая работа троечника с факультета журналистики
У вас стиль нейронок (чат гпт?) прям сквозит, вот это "давай честно" "Несколько честных оговорок, прежде чем начнём "
и "это меняет всё", да нихрена это все не менят, это дополняет в лучшем случае
Зачем Вы это делаете? у вас дофига материала для собственного текста, Вам не надо высасывать сенсации, переливать из пустого в порожнее
А сколько раз "честно" встретилось в статье? почему? Вы учитель в начальной школе и давите на совесть читателя?
(кажется 18 раз)
и рекрУтер, а не рекрутЁр
и в технологиях: PostgreSQL и SQL это правда разные технологии?
Я честно каждый раз удивляюсь, зачем вместо чтения материала выискивать какие то смыслы в материале. Нравиться поставь респект, не нравится поставь дис-респект. Вот скажите честно что за культ ИИ? Абсолютно в каждой статье есть такие комментарии и вот какой смысл что-то писать поднимать какие-либо темы если главная здача найти и посчитать каждое слово ЧЕСТНО в комментариях.
Ради Вас постарался уместить в 3 предложения 3 слова ЧЕСТНО - ой, ещё + 1
не понял противопоставления "вместо чтения выискивать смыслы".. А можно смыслы выискивать без чтения? как это? научите?
А я не знаю откуда культ ИИ, я вижу, что статья написана нейронкой. Все эти "меняется кардинально", "честно", "это меняет всё"
"вот какой смысл " - а смысл штука субъективная, никто за Вас Вам смысл не найдет
Какая разница кем, как и с помощью чего она написана, если статья хорошая? С чего вас корежит?
Вам нет разницы, мне есть
я не считаю статью хорошей. Но я с Вами не спорю, Вам хорошая - ставьте плюсик или что тут ставят

чел, один раз это может забавно, но постить картинки с одним и тем же смыслом - это демонстрация недостатка ума
А писать комментарии с одним и тем же смыслом ("охота на ИИ") это демонстрация чего?
я один раз написал про ИИ по собственной инициативе (У вас стиль нейронок (чат гпт?) )
если где-то еще, то люди спрашивали - я отвечал, приводил аргументы
ну и в целом, что за вобэбаутизм ? типа, если я косячу, это оправдывает кого-то другого?
Каждый сам за себя отвечает,
но в УК за совместные действия дают больше :)
Скажу по-честному - никого здесь ни с чего не корежит. И это меняет всё.
Объясняю простыми словами и без воды.
Тема статьи: интересная
Подход автора к изучению вопроса: классный и последовательный
Графики, интерпретации и выводы: полезные
Подача материала такая, что частенько приходится продираться сквозь вот этот бесполезный шум
Привыкайте,скоро это будет просто ВЕЗДЕ! И уже стоит отпустить этот комплекс.
я вижу, что статья написана нейронкой
А я вижу, что Солнце обращается вокруг Земли.
Нет, не видите. Вам может казаться, вы можете так считать или думать. Но категорично утверждать не можете.
Я честно каждый раз удивляюсь, зачем вместо чтения материала выискивать какие то смыслы в материале.
Никто ничего не выискивает специально потому-что при прочтении генеративность текста сама создает ощущение песка в глазах, отвлекая о сути того что хотел сказать автор. И чем больше человек в теме, так сказать, тем сильнее у него песок в глазах от таких текстов.
Поймите уже, наконец:
Свои мысли в оформлении нейронки - ИИ слоп.
"Мысли" нейронки в оформлении нейронки - ИИ слоп в квадрате.
Свои мысли в собственном оформлении - лютая годнота.
"Мысли" нейронки в собственном оформлении - внезапно, часто тоже годно.
Все что вам пытаются донести, так это то, что стоит перейти из пункта 1 в пункт 3. После этого мы вас обнимем, покружим и поставим на место.
> Свои мысли в собственном оформлении - лютая годнота.
Да ну? Почитайте старые технические статьи на том же хабре и прослезитесь.
Вообще ни разу не так.
Моя уметь говорить и писать, но моя не уметь доносить мысль внятно. Моя отдавать мысль нейронка а нейронка расписывать мысль, красочно и доступно, помогая читателю понимать идеи автора, даже те что он сам не смог сформулировать в моменте.
Прошу прощения, что не в личку (я пять раз подумал, вякать ли, тут уже грамар-нацей попинали), но проблема массовая - любимое моё "тся/ться" (второе любимое - "нижнее ПОДчёркивание"). Мне просто интересна логика, по которой люди мягкий знак расставляют. Рандом? У вас выше в одном предложении сразу два варианта. Это же одно из простейших (мнемонических) правил русского языка. А вот даже интересно, ИИ уже научился разбираться?
и в технологиях: PostgreSQL и SQL это правда разные технологии?
Вы не поняли смысл, я лишь собираю по сути топ слова из стека в вакансии и если там одинаково часто встречается слово PostgreSQL и слово SQL значит они будут присутствовать в аналитике.
а html и css это одна технология? у Вас это одна, через слеш
а как по мне - разные, причем посгрес это частный случай SQL, а вот html и css - это совсем разные штуки (но конечно связанные сильно)
По той же схеме, если оно в тексте описания вакансии встречается вот так часто, то и вылезет оно в таком виде)
странно, но ладно
а что такое "bootstrap-доверительные интервалы "
в моей картине мира, бустрап это или CSS фреймворк, или достаточно специфичный метод из статистики. Но он не для дов. интервалов
Бутстрэп[1] (англ. bootstrap) в статистике — практический компьютерный метод исследования распределения статистик вероятностных распределений, основанный на многократной генерации выборок методом Монте-Карло на базе имеющейся выборки[2]. Позволяет просто и быстро оценивать самые разные статистики (доверительные интервалы, дисперсию, корреляцию и так далее) для сложных моделей.
Спасибо, википедию я тоже умею открывать
я у автора статьи спрашивал, как и для чего он использовал так называемые "бустрап-доверительные интервалы"
Вы знаете что такое бустрап. Лично Вы, а не википедия? Как Вы это используете в работе?
Если, то должны понимать, что при выборке = 4, рожать доверительные интервалы и в целом какую-то статистику выводить - это чушь полная. Даже если юзать бустрап
Подскажите, пожалуйста, с какой целью вы пишете всё это? Разве для вас не важна сама статья и проведённая аналитика? Мне кажется, что объём представленного материала и его масштаб с запасом покрывают 99% возникающих вопросов.
я сам своего рода аналитик, поэтому "аналитика" меня не впечатляет - дайте датасет, я и сам обработаю
а вот "ии-шные" тексты - это плохо

это картинка от прочтения вашей аналитики
чувак, извини конечно, но это очень душно....
а ты думал, почему аналитиков душными называют
так вот поэтому
и это я еще не очень то громил содержательную часть
про бустрап-дов интервалы так ответа и нет
Сам сервис я посмотрел. там косяков минимум 10%, в выдачу по "аналитике данных" попадают и дубли вакансий и вообще "левые вакансии"
если бы дали датасет, там наверно косяков еще больше можно найти
проще говоря, сами исходные данные достаточно кривоваты и их надо чистить
кстати, 100к строк реально прочитать и глазами. Неприятно, долго, но реально
(прочитать в смысле, чтобы убрать косяки (лишне вакансии) там, где их не должно быть), а уж от дублей почистить можно автоматически
Я даже больше скажу - не с целью похвастать чем-то, но ребята на курсах по DA на первых же проектах делают EDA куда лучше и интересней. Но для автора это хобби - не стреляйте в пианиста, он играет как умеет" - поэтому тут претензий нет
С этим же датасетом можно было и более интересные штуки посмотреть
Postgresql и SQL - это разные технологии.
Особенно если в первом случае активно использовать хранимые процедуры и триггеры, или уже из области dba - настраивать бекапы и репликации на линуксовых машинах.
А во втором случае - заниматься MS SQL (что часто и подразумевается под "SQL" без уточнений) под MS Win со всеми сопутствующими нюансами.
Тогда они не просто разные, они буквально не пересекающиеся.
в смысле разные, посгресс это вариация языка скуля
Это я как DA пишу
Хранимые процедуры, тригеры-шмигерры? Вы уверены, что их нет в MS SQL ?
А вообще у меня на работе - ДВХ на MS SQL, а вот CRM-ка маркетинговая - на посгрессе. А вот другая CRm вообще на оракле
в банках часто вообще Оракл-SQL исторически
Тем не менее, чтобы утверждать, что в вакансиях с посгресс есть тригеры и хранимые процедуры, а в вакансиях с SQL их нет - это над более детально анализировать вакансии - а этого не было проведено
Если что, базы данных различаются не только и не сколько диалектами SQL.
я с точки зрения использования, а не с точки зрения проектировщика ДВХ
мне приходится на работе использовать мс-скуль, хотя я с ним никогда не работал до этого. есть посгрес периодически. Оракл (туда не хочется смотреть). А база личного сайта вообще на МариаДБ (это майскуль)
И это я DA, а у разрабов так вообще вариантов немного, дали сикуэль (конкретного типа) и действуй
Так изначально было:
и в технологиях: PostgreSQL и SQL это правда разные технологии?
В списке навыков -- да, разные. Очевидно, что "SQL" значит умение вести общую для любых баз работу, описываемую семантикой языка SQL, а "PostgreSQL" или любое другое название конкретной базы -- умение администрировать именно её.
да ничего подобного и то и другое и одновременно может встречаться в вакансии DA. SQL как в принципе знание SQL, а посгрес как конкретная реализация
это не разные технологии, это одна технология - SQL
пример, в вакансии посгресс, в навыках SQL
https://hh.ru/vacancy/136227623
(DA используют посгрес, админить БД ? ну это редкое явление. это разве уж DE будет)
Умение и навыки создания процедур на plsql и PL/SQL - это разные навыки, примерно как python и php, от синтаксиса до нюансов.
А что там есть в MS SQL и как оно там пишется - это вообще отдельная тема.
начнем с того, что "навыки создания процедур" это вообще не обязательно прилагается, если в требованиях SQL. Вы должности путаете. Если вакансия разраба ДВХ - то да, это может быть критичным, какая именно реализация SQL (оракл это одно, посгрес - другое, мс (он вроде Т) скуль третье, а mySQL - это четвертая
Но если речь идет про использование, то разница некритична совсем:
Выше уже кидал вакансию - в описании посгресс (а точнее так: SQL (CTE, оконные функции; опыт в PostgreSQL, SQL Server, ClickHouse) , в навыках SQl
https://hh.ru/vacancy/136227623
это одна технология, реализации разные
вот кликхаус это ... там по-другому. Вроде и это SQL, но довольно другой. Или какая нить МонгоДБ или еще что-нить экзотическое
а если чел разрабатывает какой-то сайт на пыхе, то ему надо знать SQL в целом, БД будет на mySQL (скорее всего), но админить, разворачивать он ее не будет - для этого есть DBA-шники. И вот..
Даже если чел разрабатывает сайт на пыхе - ему надо хотя бы примерно понимать, что писать 10005000 записей в одну таблицу в mysql и в Oracle - это немного разные 10005000 записей.
Что где-то можно использовать ROW_ID (или как там оно было), а где-то нельзя, и надо уникальный ключ создавать отдельно, да еще и по-разному.
Что где-то можно использовать table1 a, table2 b where a.id=b.sub_id, а где-то приходится извращаться с join, потому что вот так - не работает как надо (конкретный пример не приведу, не помню - давно было).
Не нужно это всё когда вся база - пара таблиц в десяток записей в каждой, или когда за разработчика уже подумали архитектор, DBA, пара сеньоров - и ему остается сделать строго по ТЗ "выбор трех строк из таблицы".
Но тут уже проще у ЧатаГПТ спросить, он быстрее напишет.
Нюансы есть везде ну это можно по месту разобраться же. Пых скорее всего будет связан не с оракл (а с mySQL). А будет с оракл - ну значит будет учитывать нюансы
Например, у микрософт-скуль вместо лимит используется совсем другое (интересно почему)
А у mySQL до какой-о версии не было окошек
создавать ключи? ему на дадут скорее всего на проде, для этого есть ДБА-шники. А то если каждый разраб будет фигачить ключи - это капец же будет. у нас даже на нашем (отдела) сервере, вот так просто "хреначить что угодно" невежливо, мы у коллег спрашиваем "а можно вот так"
пожалуй на любой работе где-то надо погрузится в определенные нюансы и разница реализаций SQL это в целом то как раз понятная разница. А бывает куда более проблематичные препятствия
(джойн вроде везде работает)
я не понимаю этого тренда ветки - притворится тупым, типа, "у меня была вин 10, а теперь 11, это "Другая технология"" , ну да, другая ОС, но разобраться можно
ну вот, для примера, в нашей любимой оракл хотели написать кое-чего, а оно не работает. Даже после "спросить нейронку", ну что? думаете сдались? написали в поддержку, те ответили- у вас и прав то не было, но это можно сделать "вот так". Аналитики данных - люди всеядные -были бы данные, а достать - вопрос техники
Гораздо хуже, когда данных нет, куда-то не передаются, куда надо, или когда в поле пишутся сущности разных типов, хоть и созвучных (спасибо дба-шникам за такую свинью)
А еще бывает так, что в вакансии просто SQL, а на месте оказывается Оракл. Ибо считается, что "не дурак, разберешься".. И это попадос
А знает еще попадос, когда приходишь на работу, а там не вин+эксель, а астра плюс Р7-Офис - вот это реально большая Ж
Небольшая история: являюсь модератором в сообществе, и нейро-посты там что-то между "прямо запрещены" и "крайне не приветствуются". И как-то пришёл чувак, чьи посты написаны иишками от и до - стиль абсолютно иишный, даже устаревшие шабоны вида "Это не окно. Это не дыра в стене. Это - целый смотровой проём наружу" присутствовали. Ну, мы и отбили пост по причине "не пишите с ИИ". А потом оказалось, что это знакомый другой модерши, и она уверяла, что пост без сеток сделан был. И скинула другие его тексты ещё из до-иишных времён, ещё из 10-х годов, и они написаны были абсолютно таким же нейростилем, от которого сейчас у всех глаз дёргается.
Это я не к тому, что конкретно здесь есть ИИ или нет, это к тому, что иногда у людей реально такой собственный стиль.
Огонь, огромное спасибо за столь большой материал, и за доп графики с диска!!!
Интересная пища для размышления..) Спасибо за статистику, учтём) Жду вторую часть)
У меня возникает вопрос. Почему удалёнка так тащит зп, как будто она сейчас на оборот менее востребованной становится
Есть 2 мысли:
- На удалёнку берут в основном более опытных/дорогих специалистов?
- или статистика искажена тем, что дорогие вакансии например, международные чаще бывают удалёнными? А как правило международный равно значительно дороже.
Я думаю обе мысли верные, и они не исключают, а наверное даже дополняют друг друга
По первому пункту - да, на удалёнку чаще зовут опытных. Это факт.
По второму - тоже в точку. Международные вакансии почти всегда удалённые (или гибридные, но с возможностью работать из РФ), и они платят в валюте. В статье как раз я подсветил, что валютные вакансии в 2.4 раза дороже рублёвых. Когда мы смешиваем обычную базовую удалёнку внутри страны и зарубежную (а отделить мы их не можем друг от друга) - получается усреднённый высокий показатель.
Такие дела...
А отделить-то почему не можем? Если есть среди базы данных с вакансиями признак "удалёнка" и признак "за рубежом", или хотя бы признак "зарплата указана в рублях".
Ну так можем, просто это будет е совсем точно. Не все зарубежные вакансии ставят зп в иностранной валюте или указывается статус зарубеж. И не все российские компании ищут так специалиста в России и могут указать зп в валюте.
Даже если нет признака удалёнка не означает что компания не готова брать удалёнщика. Для себя давно выработал стратегию - отвечай на все ваканcии, если что HR при созвоне уточнит этот момент и если совсем никак, то они сразу об этом говорят.
мне кажется в этих 2.4 раза забыт момент, что в России вилка указывается после налогов, а зарубежом - до...
В офис сейчас загоняют в основном галеры и банки, где бюджеты порезаны. А на ремоуте сидят либо сеньоры, которые могут диктовать условия, либо зарубежные заказчики.
Плюс нормальные конторы экономят на аренде и пускают эти деньги в ФОТ
Нет смысла работать удаленно в ООО Ромашка, находящийся за углом. И наоборот московский ООО Василёк желает найти удаленного сотрудника, потому что "в офис" найти нереально. Всё это приводит к тому что на удалёнке условно московские зарплаты.
Провели колоссальную работу- очень интересная статья, дочитал до конца!немного "открылись глаза" на известную площадку!
Забавно что для открытия Америки автору понадобилось спарсить сто тысяч вакансий
Любой мидл, искавший работу последние года три, и так знает, что хх помойка для джунов и эйчаров с синдромом вахтера. На нормальные деньги давно уже через нетворк или телегу хантят
Я ничего не парсил. В начале статьи описана природа появления данных...
Разве не суть исследований опровергать или подтверждать в том числе и "очевидные" факты ?
А ещё есть мидлы, которые не искали работу последние три года и не знают ситуации.
А ещё есть люди, которые не работали последние три года и только начали искать работу. Это не открытие Америки, а очень полезное исследование.
У вас исключительно неприятная манера мерить весь мир по себе, как у на удивление многих людей.
Телегу? А ты точно уверен, что мидл пойдет рыскать по ноунейм каналам, где 0 обратной информации и достоверных организаций без какого либо подверждения?
Уникальная возможность для новичка в IT узнать столько полезного. Раньше я в основном смотрела на hh как на базу и аналог LinkedIn, полагая что в телеге и на агрегаторах уже вторичные и неинтересные вакансии или что-то для своих. Что ж, ошибалась. Спасибо вам за проделанную работу. Очень жду вторую часть статьи!
Самая массовая IT-профессия страны… Барабанная дробь… HR-специалист с 10 913 вакансиями.
Парадоксально, ведь ИИ выполняет их работу
Тут не соглашусь у меня девушка HR. И в их работе ИИ присутствует, но не заменит. Это так просто со стороны обывателя можно сказать. Но нет. Там свои приколы))
я подозреваю, много ищут HR из-за текучки. Вакансий много, платят мало, вредные факторы типа общения с людьми.
А поделитесь, какие самые интересные площадки для поиска работы менеджерами/лидами в России, например? Если сообщества, то какие именно?
Могу вам порекомендовать как раз таки тот ресурс который мне предоставили данные - https://hireseeker.ru (там агрегация всех ресурсов с вакансиями в одном месте).

И ещё честно удивило, куда столько HR-ов то! На падающем то рынке!
Как-будто и правда это уже отдельная раковая опухоль, деятельность которой слабо связана с основной задачей отрасли
так это не "рынок" - это по тому датасету, который разбирал автор, а что и как собиралось в датасете - мы не знаем
А чего не хватает или неизвестно ? HireSeeker берет по 10+ поисковых запросов по каждой профессии, прогоняет их на HH и других площадках, потом агрегирует, убирает дубли, склеивает одинаковые. Даже если взять аналитику только с hh она уже полная и самодостаточная.
я не знаю что делает хайсикер, я вот только из статьи про него и узнал
каким образом этот самый хайксикер определяет. что вот эта вакансия на ХХ такая же, как и в телеге?
а что если в ХХ вакансию назвали "рекрутер", в телеге назвали "HR", где-то еще название "специалист по подбору персонала" - как хайсикер отделяет реальные дубли от реально разных вакансий? - эти 3 названия могут быть и одной, а могут и не быть ведь
это к вопросу. откуда столько HR-вакансий
По описанию вакансии, начиная от векторного поиска и заканчивая через сравнение вторичных признаков.
плохо работает, явные дубли и дата-инженер попадает не в ETL, а в аналитику данных
Пример фильтра
https://hireseeker.ru/?top=analytics&group=analytics&m=data_analytics&en=1&cty=RU&city=10
Есть дата-инженер у Аналитиков данных (а должен быть в банде ETL)
и 2 раза "Руководитель команды аналитиков" - кажется вообще полный дубль
там же в выдаче и HR-аналитик.. Тут только "сомнительно, но окей"..
и внезапно "Стажер в службу риск-менеджмента"
Короче, ну такое себе.. Разработчику сервиса еще там пилить и пилить.
Если вы про вакансию https://hireseeker.ru/vacancy/9794644-rukovoditel-komandy-analitikov и https://hireseeker.ru/vacancy/9972342-rukovoditel-komandy-analitikov , это действительно дубль, но..... есть нюанс, что одна появилась в июне (с автоподнятием), а другая в августе. Вакансии старше месяца стараюсь не склеивать, чтобы случайно не уменьшить выборку. Вы правы, стоило бы склеить такие записи, поработаю над этим. Вы даже не представляете, сколько дублей на самом деле на рынке вакансий.
все просто, тут все HR подряд, а не IT
первый же HR в списке на HireSeeker это
Менеджер по персоналу - сеть кофеен шоколадница
Вы проделали огромную работу. Есть над чем задуматься
Автор, а есть ли возможность проверить присутствует ли на HH практика показа закрытых вакансий для массовки? Увидел однажды очень старую вакансию в позапрошлую контору, спрашиваю "ищите что-ли? полтора года назад же человека брали", а мне в ответ "не, работает, мы не ищем, это на НН фигня". По наименованию подразделения было понятно что к ним, а не куда-то еще. Может конечно там HR мисскликнул и вакансия нарисовалась, но чет как-то сомнительная случайность.
Хотя, конечно, там охват должен быть года на 2-3 глубиной, да и пойди разберись не читая это дубликат или реальный поиск.
Есть вакансии которые по полгода автоподнимаются.
Но нет вакансий, у которых стоит дата несколько месяцев. Я насколько понимаю монетизация такая, что каждый месяц нужно продлевать вакансию за денежку, вот она и считается свежей. Также поиск "За всё время" в фильтрах не находит дальше месяца.
Хотя мне кажется.... что когда я начинал проект, то искалось с дальностью полгода. По данным в БД такие записи не обнаружил.
Не могу конкретно ответить, могу лишь сказать, что не получилось сейчас найти открытые вакансии которые больше месяца с датой публикации и находятся не в архиве
Не могу плюсанутт, но большой респект.
Мне интересно как узнать контакт нанимателя. И почему приходит столько отказов. Буду читать все статьи цикла
Спасибо
Интересно, какая доля 1С-вакансий здесь - это разрабы, а какая - пользователи?
Вот так, спустя почти 15 лет работы узнаешь, что сисадмин (или системный инженер, если брать шире), это никакой не ИТ
Да ладно, уже лет так пять сисадминов айтишниками считают только те, кто к ИТ никакого отношения не имеет. И это обидно :(
Зато в статье указана честная зарплатная вилка админа) Молодому эникею (а существуют ли они и есть ли соискатели?) может эта статья розовые очки разобьёт.
Современный эникей джун в представлении компаний должен быть похож на парня, про которого не так давно тут писали. Он в 18, или около того, лет притаранил с отцом домой мейнфрейм от ibm на поиграться. Разобрал часть дома, чтобы засунуть это в подвал и там запускал это дело. Вот это настоящий, горящий делом джун!
15к рублей в месяц, вставайте в очередь!
Если смотреть на PowerShell в технологиях, то медиана уже 150к.
Вижу логическую нестыковку (подчерк - мой):
1) Несколько честных оговорок, прежде чем начнём (я же обещал не врать)
Это не весь рынок труда России. Это IT и IT‑смежные вакансии из конкретного набора источников.
2) Приготовьтесь. Самая массовая IT‑профессия страны… Барабанная дробь… HR‑специалист
После которой - "сыпятся" и остальные сравнения размеров "сегментов" (забывая указывать "вакансий". Пример, не совсем равный - не про потенциал "требуются":
"Через проходную дверь станции метрополитена, за день - прошел такой-то контингент", и затем, делаем предположения по пропорциям размеров сегментов всей отрасли.
Забыв указать Рабочую гипотезу "Проходимость сегментов - одинакова").
Т.е. HR-специалистов - Требуется больше (у них, по их приему - ситуация еще тяжелее).
(больше требуется) Потому, что ... (и куча вариантов. например: "самая тяжелая работа в ИТ", "самая не благодарная (часто выгорают и уходят)", "потому, что занимаются не только рекрутингом").
Отдельно поставив вопрос "Почему, число вакансий разработчиков на C - меньше, чем на .Net" - мы можем вернуться на обычное понимание "Почему" (и объяснения).
Например, потому, что профессия разработчика C - предполагает работу с ядром ОС/девайса.
Т.е. - не зависит от % вакансий HR.
пошучу: "тут - не работает Принцип Парето".
Спасибо за статью, интересные графики.
По HR не совсем понятно что они тут делают, ну да ладно. По ним можно отдельную аналогичную статью написать- какие навыки наиболее ценны.
Мне очень интересен другой показатель, вероятность ответа на резюме, которое соответствует хотя бы на 90% требованиям вакансии. Такое ощущение, что большинство ваших графиков стали бы совсем другими с фильтром на ответивших.
Прочитайте это ещё раз. Одна и та же профессия вне hh показывает цифру в 2–3 раза больше.
Сравниваем зарплату "программиста" (swe, стартап) в Сан Франциско с зарплатой "программиста" (эникей, поликлиника #1) в Хабаровске и делаем округленные глаза
Аналитики такие аналитики
Раньше я видел только hh считая его эталоном (думаю как и все)
лол
А вакансии техподдержки как отдельный вид ИТ рынка не рассматривались ? Если уж HR попали в ИТ, то ТП как некий "трамплин" в ИТ уж точно должны быть 🤔
Как и в большинстве аналогичных статей не нашел DBA/DBE. Very upset :(
1 по приветствуйте
2 Этот график закрое
3 От сюда
Чего так много вакансий HR-специалистов?
Самое интересное тут для меня даже не «1С обогнал Python» и не «hh врёт/не врёт», а то, насколько сильно результат зависит от того, что именно мы положили в датасет и как потом разметили.
Особенно забавно с HR: если агрегатор называет IT-смежные вакансии IT, а потом мы на основании этого же датасета делаем вывод, что «самая массовая профессия в IT - HR», то мы фактически измеряем не весь IT-рынок, а рынок вакансий по правилам конкретного классификатора. А пример с вакансией шоколадницы в категории HR из комментариев как раз показывает, что тут есть куда допиливать.
С зарплатами та же история. Сравнивать медиану hh и Telegram/Getmatch можно, но это скорее сравнение разных срезов рынка, а не доказательство, что одна и та же работа «вне hh стоит в 2-3 раза дороже». На hh массовый найм, джуны, регионы и вакансии без вилок, а в телеге и нишевых бордах уже изначально другая аудитория. Это примерно как сравнить среднюю скорость всех машин на МКАДе со скоростью машин на трек-дне и потом удивиться, что где-то почему-то быстрее.
При этом сам вывод мне нравится: искать работу только на одной площадке сегодня, действительно так себе стратегия. И вот это уже практическая ценность исследования, даже если некоторые цифры ещё требуют методологического шаманства.
Ну и отдельный респект за попытку показать исходные ограничения, выборки и довер интервалы. Для нас это уже почти production-ready аналитика, осталось только продакшен.
А вообще, если мы теперь любую выборку из 100 тысяч вакансий называем «рынком IT», то следующий шаг - собрать 10 тысяч резюме и доказать, что Россия наконец-то состоит из десяти тысяч уникальных разработчиков, которые почему-то все одновременно ищут работу, не так ли?
Напиши рецепт лимонного пирога
Напрасно вы так: комментарий в нейро-стиле в ответ на такую же статью - очень иронично. К тому же по теме. Мне аналогично резануло то, что якобы НН аналогичные профессии показывает в два раза дешевле - явно же это не в НН дело, и не аналогичные вакансии он так показывает, а сама выборка как-то смещена. В качестве проверки этого утверждения автор мог бы сравнить вилки на полностью аналогичных вакансиях в разных источниках (ведь у него есть эта информация) - и мы бы увидели, есть ли в НН хоть мизерное занижение стоимости вакансии.
Интересная статистика.
Но вижу методологическую ошибку.
Hr, маркетинг , бренд менеджер , smm и прочее - это НЕ it - специальности. Это сопутствующие.
Смешанны две категории: «вакансии в ИТ компаниях» и «вакансии it спецов».
Это принципиально.
Так, что не надо бежать учиться на hr - щика..
Да, но зато статья охватывает большие массы
Приготовьтесь. Самая массовая IT‑профессия страны… Барабанная дробь… HR‑специалист
еще раз - нельзя смешивать категории, требующие технических знаний и умений, специфичных для определенной области и категории, «общего назначения».
Используя такую логику, как у Вас, можно выяснить, что самая массовая профессия в авиационной промышленности - разнорабочий.
Когда смотрю на все эти "рынку нужны бла-бла специалисты", то у меня одна мысль: работодатели не хотят платить именно этим специалистам, поэтому они не могут найти людей на такие нищенские условия. На примере статьи — просто эйчарам не хотят платить, поэтому не могут их найти. Как соискателю, интересно не то, где на рынке можно найти работу на любых (нищенских) условиях, а где можно заработать. Интересно находить ниши, где готовы платить любые деньги, лишь бы найти человека.
Очень честная статья, аж тошнит. Честно.
Не совсем ясно, что вы называете IT-рынком России. В статье и комментариях это подано весьма противоречиво.
Если вакансии айтишников в России, то засчитывать за них вакансии иностранных работодателей некорректно.
А значит и "английский язык" не должен так влиять на зарплату. И опосредованно удаленка тоже.
Всё где ты можешь работать, сидя в РФ, присутствует в данной выборке. По этому некоторые иностранные работодатели с возможностью работать удалённо здесь есть, противоречий нет.
А английский всегда нужен и не важно работаешь ты в России на Российскую компанию или нет. Как минимум многие ЯП откроются с другой стороны
Кажется, вы взяли всех HRов, а не только из IT. Тогда понятно, почему их много.
Еще, слишком сильно бросается в глаза через каждый абзац ваш любимый Python :)
А вот эти вот вакансии в телеграм каналах как искать? Я помню год назад пытался поискать по ключевикам работа/job/вакансии и php. И у меня сложилось впечатление что найм в телеге скорее мертв, особенно если убрать дубли того что есть на hh.
Реально честно читать реально тяжело честно реально обороты речи реально вызывают честное отторжение. Но честно реально сам смысл статьи реально честно интересный :)
на рынке РФ 1С и Excel - это фундамент, а не мем. Хотя как будто эта ситуация и есть мем.
Что ж удивительного то про Excel?
Но беда с ним в том, что любое упоминание в резюме “знаю Эксель” примерно равно “не знаю. Но для галочки надо писать, все равно никто не проверяет”. Т.е. этот показатель заспамлен враньем на все 100%. Я уверен в том, что если завтра во всех фирмах ввести проверку этого “знаю Эксель”, то >95% ничего не сможет показать и отсеется.
А так-то Эксель - топ1 инструмент аналитики для малых и начала средних бизнесов. Для малых вообще безальтернативно.
Согласен с Вами!
по уму требования эксель надо было сравнить с профессиями. Учитывая (хз почему) перевеc вакансий HR-ов.. вот они возможно и повлияли на рост требований к экселю
вообще в этом анализе куча лишнего. Ну как бы маркетолог, работающий в яндексе, не айтишник. Он все равно маркетолог. И HR тоже, не становится строителем, если начал работать на каком-нить ЖБ-комбинате
Выкинув лишние вакансии, анализ бы был бы чище, а всех "посторонних" можно было отдельно смотреть, если нужно
да, мне тоже режет глаз очень жадный алгоритм отнесения к ИТ в этом новом методе. Т.е. раньше он был о работнике “Специальность В СписокСпециальностейИТ”, а теперь будто о фирме “Фирма.НаправлениеДеятельности В СписокНаправленийИТ”.
Так у нас могут появиться и айтиуборщицы, айтиводители, айтикладовщики.
Раньше писали “уверенный пользователь ПК”.
отличная статья, прям шЫкарная, большое спасибо.
Если появятся ещё статьи, то длинные графики вида “Сколько стоит каждая конкретная IT технология в стеке 2026” можно распилить на несколько последовательных картинок. Понимание не уменьшится, а кликать на каждую будет удобней.
Как обычно, desktop разработку ни в каком рейтинге не найдешь :)
Насчёт соавторов:
- “Глава 1. “Что у вас здесь происходит?” - карта всего IT‑рынка” и сама глаза
- “Глава 2. Зарплаты по‑честному” и в частности:
– “Прочитайте это ещё раз.”
– “И тут я себя приторможу, чтобы не наделать шума зря”
Не пишут так на русском. Это - косноязычная смесь американского английского, написанная LLM-кой русскими словами.
Как раз это цитата скорее показывает что писал человек - ИИ орфографических ошибок не делает. И как раз на русском очень многие именно так и пишут, LLM все таки пишет гораздо более литературным языком. Я преподаю в школе с инженерным уклоном, стиль до боли знакомый
Как раз выглядит как авторский стиль речи, особенно последняя цитата, ИИ так не пишут.
Если я правильно понял статью, то Вы ещё пожалели нас, и не рассказали всего что Вы раскопали. Может надо как хирург - не жалеть пациента, а спасать его?
В первой редакции статьи было около 40 страниц docx-документа
И выглядело это вот так:

Ну это я так, если кому-то интересно.
По этому мне читая комментарии уже смешно следить за веткой разговоров про "Статья ИИ".
Кстати говоря до Хабр добралась только редакция с версией текста 4.
Интересная информация, спасибо.
Оффтоп:
Казалось бы, пора на всё обидеться и уйти разводить альпак.
Я недавно узнал, что слово "альпака" не склоняется. Например: "у меня три альпака", "уйти разводить альпака", "дал яблоко альпака".
"В словарях ударение стоит на последний слог. То есть правильно произносить «альпакА». Но согласитесь, это не очень привычно для нашего языка. И привычнее говорить «альпАка», близкое и созвучное к «собАка»"
https://gorodskayaferma.ru/blog-ferma/sklonyaetsya-li-slovo-alpaka-i-gde-stavit-udarenie/
Интересный нюанс, спасибо =)
Спасибо)))) Буду знать))
Подождите, я записываю.
Так где нужно искать работу в 2026 году? ( — нейрослоп :) )
В статье указан hh, getmatch. Линкендин разве вообще рассматривается сейчас без релокации, если там иностранные компании, которые не хотят иметь дела с Россией? Что еще, какие такие телеграмы?
на третьем‑четвёртом месте, начинает проступать то, что обычно и называют "айтишечкой" - классическая разработка.
Ведь не кого же не удивляет, что врачами называют не только приходящих на ум первыми - терапевтов,
но и окулистов, хирургов и прочих нефрологов...
А вот к ИТ почему-то норовят причислять только программистов-кодеров.
Сетевикам, проектировщикам и остальным специалистам по ЦОДам это несколько обидно :)))
Спасибо за обзор. Можно только попросить на графиках которые не влазят в один экран дублировать шкалу измерения сферху
Прочел обе статьи. HireSeeker-у реально респект за предоставление информации, его проект часто мелкал в линке и видно, что парсит человек им занимается.
Жду 2 часть. Предлагаю в нее добавить следующий, интересующий меня, момент, я заметил, что на рынке очень много аутсорс компаний, которые занимаются разработкой в без конкретики и особенно в финтехе. На мой взгляд, финтех в рф абсолютно государственный и не имеет тендеций к бурной разработке и росту, а следовательно непонятно каким компаниями актуален аутсорс в текущем рынке, какие продукты разрабатывает аутсорс, какой процент вакансий аутсорс компаний от общего, какой процент talent pool компаний (прокладок), сколько подозрительных вакансий (пустые компании без отзывов). На словах они все аккредитованные ИТ компании, состоящие из профессионалов и единомышленников, а по факту вообще непонятно что это за люди
Спасибо за проделанную работу! Два дня читал статью)



Более 100 000 вакансий: полный анализ IT‑рынка России в 2026 году. И почему hh.ru нас обманывает?