Обновить
64K+

Статистика в IT

Статистика, исследования, тенденции

38,12
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Дайджест технических новостей, переводов и лонгридов инфослужбы Хабра за август 2026 года

Время на прочтение6 мин
Охват и читатели6.6K

В августе 2026 года информационная служба Хабра выпустила 826 публикаций (785 новостей и постов, 7 лонгридов и 34 перевода). В текущем дайджесте представлены лучшие технические новости, переводы и лонгриды (отдельные большие публикации) инфослужбы Хабра, согласно оценкам пользователей.

Читать далее

Новости

Кто хочет жить вечно — как я сделал открытую базу данных об отношении к продлению жизни

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели7.6K

Что общего у Бенджамина Франклина, японских пенсионеров и американских зумеров? Всех их спрашивали о смерти, бессмертии и о том, сколько они хотят прожить. Только данные разбросаны по сотням статей, сайтов, стат. сборников и архивов.

Если биологи и медики уже давно каталогизируют данные о продлении жизни, то социальные данные — что люди об этом думают — до сих пор лежали мертвым грузом. Никто не сводил их в одну таблицу.

Я решил, это исправить. В этой статье я расскажу, как родился проект «Кто хочет жить вечно», почему вопрос бывает важнее ответа и как я собирал со всего интернета материалы, упаковывая их в инфографику на 40 графиков.

Читать далее

В России в 10 раз выросли суммы штрафов организациям за утечки персональных данных. Новый отчёт ЭАЦ

Время на прочтение3 мин
Охват и читатели9.7K

Привет, Хабр! Наш экспертно-аналитический центр подготовил очередной отчёт, на этот раз — про штрафы за утечки персональных данных по миру и в России (2025–2026).

Небольшой спойлер — тот самый оборотный штраф, о котором столько говорят, пока ещё никому не прилетел. Зато суммы штрафов за утечки персданных, назначаемые организациям, выросли в 10 раз.

Под катом — более подробная статистика с разбивкой по отраслям и странам и полная версия отчёта.

Читать далее

Статистика в отделе маркетинга. Квалификация лидов и биномиальный эксперимент

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели5.8K

Может ли статистика помочь маркетологам и отделам продаж в обработке лидов? Да, причем в целом ряде задач!

Прочитав статью, вы:

1. Получите мощный аргумент для переговоров: «Нет, вероятность, что конверсия вашего отдела продаж просела случайно – статистически ничтожна»;

2. Оцените вероятности целевых событий для вашего медиаплана;

3. Прокачаете «План/Факт», построив эталонное распределение.

Читать далее

Вы внедряете AI неправильно и что такое контекстный долг

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели6K

AI-агента сегодня можно собрать за несколько часов. Но это не значит, что бизнес понимает, где его действительно стоит внедрять.

Компании часто начинают с Build: выбирают модель, подключают Jira, GitHub, MCP, собирают workflow. А уже потом пытаются понять, какую проблему они вообще решили.

В статье разбираю другой подход: сначала найти места, где команда теряет время на восстановление контекста, ручную координацию и переключение между системами. Для этого мы используем Context Audit и понятие контекстного долга.

Поговорим о том, как увидеть такие проблемы в Jira, Confluence и GitHub, почему не каждую из них стоит автоматизировать и что делать после аудита.

Читать далее

DML против PSM: как оценивать нерандомизированные эксперименты быстрее и надёжнее?

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели6.6K

Привет, Хабр! Давайте на примере кейса с рекламой в ПВЗ Wildberries разберемся в двойном машинном обучении (DML) и методе псевдорандомизации (PSM). Вы в деле?

Меня зовут Платон Попов, я дата-аналитик в команде A/B-платформы RWB. В нашей команде я занимаюсь задачами из области причинно-следственного анализа (Causal Inference) и методами понижения дисперсии. 

В этой статье расскажу о самом кейсе и объясню, почему для него не подошёл классический t-тест. Покажу, как мы учитывали спутывающие факторы с помощью Propensity Score Matching (PSM), почему этого оказалось недостаточно и почему в итоге перешли к Double Machine Learning (DML). В конце сравним результаты и обсудим наш план выкатки метода оценки нерандомизированных экспериментов в промышленный масштаб.

Читать далее

Каталог прислал 127 человек за день. На следующий день не вернулся никто

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели5.3K

Две недели назад я выложил свою игру в MAX и чуть позже в каталог мини-приложений VK. Рекламу не покупал, ссылки нигде не размещал, бюджет на продвижение равен нулю.

За две недели игру открыли 525 разных человек: 263 пришли из VK, 165 из MAX, ещё 97 через прямую ссылку. Если судить по этим цифрам, VK у меня самая успешная площадка, и первые дни я так и думал.

Возврат на следующий день у игроков из VK при этом равен нулю. Ноль человек каждый день подряд, начиная с того момента, когда там вообще кто-то появился. У MAX за тот же период возврат держится около 36%.

В статье разбираю, как я две недели радовался графику роста вместо полезной метрики, что показала проверка счётчика на баг, почему средний возврат по всем источникам не описывает ни одну реальную группу игроков и какие три объяснения этому нулю у меня остались непроверенными.

Читать далее

Как фонд в $45 млрд потерял почти всё за несколько недель

Время на прочтение4 мин
Охват и читатели10K

История Леопольда Ашенбреннера ещё недавно выглядела как почти идеальная иллюстрация того, как можно заработать на революции искусственного интеллекта.

После ухода из OpenAI в 2024 году он написал статью под названием «Ситуационная осведомленность», посвящённую будущему искусственного интеллекта, в которой подробно изложил свои взгляды на будущее искусственного интеллекта. Статья была полна сенсационных заявлений и получила широкое распространение в интернете.

Читать далее

5G на «низком старте» в России: сети ещё нет, а смартфоны уже готовы

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели9K

Всем привет! На базе наших аналитических исследований вышла новость про 5G устройства в России. Решили поделиться с читателями Хабра подробностями, которые не попали в публикацию.

Это взгляд на запуск сети пятого поколения не из пресс-релизов операторов, а на базе миллионов мобильных устройств, работающих в России.

Читать далее

24 миллиона оценок внешности: что мы нашли в собственной базе за 12 лет

Уровень сложностиСредний
Время на прочтение4 мин
Охват и читатели7.1K

Двенадцать лет незнакомые люди ставили друг другу баллы от 1 до 10. В базе накопилось 24 миллиона оценок от 110 тысяч человек из 232 стран. Мы залезли в собственный PostgreSQL и нашли четыре вещи, которых не ожидали: провал на девятке, разрыв в 1,14 балла в том, как мужчины оценивают мужчин, разброс по странам в 2,4 балла и падение щедрости по ходу сессии.

Читать далее

Когда комментировать на Хабре: я разобрал 4404 комментария

Время на прочтение8 мин
Охват и читатели7.2K

Некоторое время назад я решил оживить мой аккаунт на Хабре. Покомментировав с умным видом здесь и тут, я решил подвести научную базу: собрал 4404 чужих комментария из 250 тредов и посчитал, когда и где надо оставить комментарий, чтобы он набрал максимум лайков. Спойлер: час на часах не важен, а вот позиция в треде и первые сутки решают всё.

Погрузиться в Биг Дейту

Как мороженое заставляет людей тонуть: главная ошибка корреляционного анализа

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели6.3K

Известно, что чем больше продается мороженого, тем больше регистрируется несчастных случаев с утонувшими. Корреляция есть - значит, мороженое опасно?

Эта статья — о том, почему знание правила «correlation ≠ causation» еще не гарантирует, что вы сами на нем не попадетесь

Читать далее

$40 против миллионов: экономика кибератак, которую защитники не хотят считать

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели5.7K

Привет, Хабр! Меня зовут Александр Михайличенко, я консультирую промышленные компании по безопасности АСУ ТП и КИИ. В прошлом году мы с командой AKTIV.CONSULTING провели исследование зрелости ИБ в 52 российских компаниях, и наткнулись на цифру, которая зацепила: комплаенс у компаний закрыт на 45%, а реальная техническая защита — на 29%. Компании тратят миллионы на бумажную безопасность, а потом читаем в новостях про очередной шифровальщик, остановивший производство.
Родился простой вопрос: а сколько вообще стоит атака?

Начал считать — и увлекся. Аренда шифровальщика — $40 в месяц. Доступ к сети крупной компании — $500. ИИ-фишинг с кликабельностью 54% — $50 в неделю. Ущерб для жертвы — миллионы долларов.

Эта статья — про то, что я насчитал. И про то, почему защита проигрывает не из-за плохих технологий, а потому что экономика сломана: атака дешевеет, защита дорожает, и никто не хочет считать эту разницу вслух.

Читать далее

Ближайшие события

Новый абсолютный рекорд по числу DDoS-атак и другая статистика за Q2 2026

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели8.1K

Настало время рассказать, что интересного произошло в плане DDoS за второй квартал этого жаркого года. Произошло, надо сказать, немало, и некоторые зафиксированные нами тренды специалистам по ИБ будут особенно интересны — впрочем, как и просто тем, кто хочет знать, насколько большая опасность подстерегает их отрасль в середине 2026 года.

Читать далее

Как я перебрал 2377 вакансий за неделю и исследовал рынок труда под мои уникальные хотелки

Уровень сложностиСложный
Время на прочтение27 мин
Охват и читатели8.3K

Есть такая ситуация: сделал инструмент, чтобы решить свою проблему, а потом сидишь и полируешь этот инструмент вместо того, чтобы решать проблему для которой инструмент и создан.

Я написал автооткликалку с ИИ‑анализом вакансий, потому что искал работу. Потом увлекся продуктовой разработкой, оставив сам поиск работы. Думал запустить бизнес.

Но я разрабатываю без команды и пока я играюсь в стартап мне нужны реальные деньги на содержание семьи, поэтому я решил что уже достаточно времени уделил разработке, остался только коммерческий запуск проекта – и его я могу (а точнее - должен) запускать параллельно с работой в найме. Я отпустил мой инструмент погулять с моим резюме по рынку.

Читать далее

Как предсказывать долгосрочный эффект A/B теста раньше: прокси-метрики и ловушка регрессии

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели7.9K

В продуктовых экспериментах нередко возникает следующая ситуация, когад бизнесу важна долгосрочная или малочувствительная метрика, но оценить эффект на такие метрики в рамках короткого A/B-теста сложно.

Как корректно находить прокси-метрики, почему наивная регрессия может обмануть и как отделить настоящую связь экспериментальных эффектов от статистического шума?

Читать далее

DDoS-атаки 2026: эволюция угрозы. Кто находится в зоне риска?

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели8K

Совместное исследование DDoS-Guard и FirstVDS

Раньше считалось, что DDoS-атаки направлены на «крупную рыбу» — корпорации, госкомпании, банки. Но реальность 2026 года говорит о другом: жертвой злоумышленников может стать кто угодно.

За три года число атак выросло с 2,2 до 2,5 млн. Их распределённость увеличилась на 480%. DDoS-атаки стали массовым, доступным и, что самое опасное, автоматизированным инструментом. 

Киберпреступникам больше не нужно тратить недели на подготовку, чтобы атаковать выбранный объект — теперь они используют суперботнеты и сложные алгоритмы, которые автоматически находят уязвимые для удара места за считанные минуты.

Вместе с DDoS-Guard мы решили разобраться, а есть ли кто-то, кто оказывается в красной зоне риска чаще других? Изменился ли характер атак за последние несколько лет? Для этого мы проанализировали данные клиентов, глобальную статистику атак и опросы владельцев бизнеса. В итоге получили портрет идеальной жертвы. 

Дальше рассказываем, как мы это делали и что же удалось выяснить.

Читать далее

Три диплома, два курса и 1700 вакансий: что я понял про обучение на айтишника в 2026-м

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели10K

В этим летом мне исполнилось 32 года, а за плечами — диплом психолога, диплом теолога и свежая, июльская магистратура по педагогике. Я работал официантом, поваром, восемь лет был референтом, работал в магазине, администрировал доставку суши и был региональным менеджером в клининговой компании. А сейчас я учусь на аналитика данных и на системного аналитика, одновременно.

Если вы подумали «вечный студент» — я вас понимаю, сам так про себя так думал. Но именно поэтому мне есть что сказать про обучение — я видел его с обеих сторон. Учился я хорошо и плохо, доходил до конца и бросал, платил за курсы деньгами и, что дороже, временем. А ещё я успел поработать наставником и HR‑ом, то есть смотрел на чужие резюме теми же глазами, какими сейчас смотрят на моё.

Эта статья — не про то, что «образование важно» (спасибо, кэп). Она про то, почему одни и те же курсы для одних становятся трамплином, а для других — строчкой в резюме, которую рекрутёр пролистывает не моргнув. Здесь не будет мотивационных цитат, но будут цифры — в том числе мои собственные.

Читать далее

Торговля по паттернам с точки зрения алгоритмов

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели9.1K

Классические фигуры вроде «головы и плеч» легко увидеть глазами, но тяжело формализовать без десятков спорных условий. В статье я рассказываю, как заменил ручное описание паттернов поиском похожих исторических участков с помощью корреляции Пирсона, какие проблемы возникают при таком подходе и почему высокая корреляция сама по себе ещё не является торговым сигналом.

Читать далее

Дайджест технических новостей, переводов и лонгридов инфослужбы Хабра за июль 2026 года

Время на прочтение6 мин
Охват и читатели9.6K

В июле 2026 года информационная служба Хабра выпустила 1038 публикаций (975 новостей и постов, 7 лонгридов и 56 переводов). В текущем дайджесте представлены лучшие технические новости, переводы и лонгриды (отдельные большие публикации) инфослужбы Хабра, согласно оценкам пользователей.

Читать далее
1
23 ...