Обновить
16K+

Habr

Торт или не торт?

76,04
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Как превратить Хабр из ленты соцсети в библиотеку и базу знаний

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели11K

Хабр показывает материалы как ленту соцсети: читают в основном свежее и обсуждают, а через пару недель статья уходит из поля зрения и может попасться читателю если на нее приведет внешний поисковик или по пользователь перейдет с внешнего ресурса. В ленте выигрывают частота публикации и объем. При этом за 20 лет на ресурсе накопилась редкая база знаний: некоторые старые статьи до сих пор отвечают на актуальные вопросы, их держат в закладках, а темы живут десятилетиями.

Я отлично понимаю что любой проект в этом мире пытается выжить и получать прибыль. К чести этого ресурса, у читателя есть возможность сконцентрироваться на контенте и не отвлекаться на мерцание рекламы и баннеров! Но в этом же плюсе Хабра кроется и минус - реклама становится не явной, а вплетенной в текст.

Начинаешь читать материал и получаешь ссылки на телеграм каналы в статьях независимых авторов призывающих подписаться. А в корпоративных блогах рекомендации виртуальных машин на хостинге, подписки на агрегаторы AI чатботов, дозы нейрослопа для поисковой оптимизации сайтов и продуктов с 2023 года, продвижение HR бренда компании для создания очереди кандидатов и тому подобное. И с этим вряд ли станет лучше. Не спасет читателя модерация и политики платформы.

Нарушается баланс между коммерческими интересами продажи корпоративных подписок и мотивацией независимых и не оплачиваемых авторов-энтузиастов создавать и публиковать полезные материалы. Когда техническую статью на которую ты тратишь дни своей жизни в ленте вытесняют генерируемые быстрее кроликов фибоначчи поверхностные материалы, созданные ради продвижения бренда. Автор не находит своего читателя, а все что было дальше второй-третьей страницы ленты уже вряд ли попадется кому-либо на глаза, кроме небольшого шанса быть прочитаным людьми при попадение в выдачу гугла и яндекса.

Я не агитирую “пчел против мёда”! Но предложу свой подход, который позволяет искать нужную информацию среди десятков и сотен тысяч статей. На Хабре есть контент высочайшего качества: описания решений практических задач, фреймворков, технологий, фич и конструкций языков программирования, как выжить в корпорации или стартапе. И все это можно найти как человеку, так и автоматизированным агентам, нужно лишь обработать и подготовить этот массив информации. И да, здесь для обработки статей и их группировки используются нейросети и алгоритмы кластеризации.

Будем группировать 34 тысячи статьи Хабра по смыслу и каталогизировать их, читать похожие по теме не доверяя ключевым словам и хабам которые указал автор материала. Таким же образом вы можете создавать свою локальную базу знаний из личных материалов и записок на работе и дома, при желании не делясь этой информацией с облачными API сервисами нейросетей. Эту же структурированную информацию будет гораздо проще найти и AI агенту для решения ваших технических задач, где нужны точные решения, алгоритмы и “рецепты”.

Материал в статье, не скрывающийся под спойлером, написан вручную дедовским “ламповым” методом.

Читать далее

Новости

Хабр проиграл войну с нейрослопом

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели111K

3 месяца назад в правилах Хабра добавили запрет на сгенерированные нейросетью статьи.

При этом никакой автоматизированной проверки статей на нейрослоп не появилось.

Я вижу ИИ слоп на Хабре каждый день. В статьях, комментариях и постах.

Читать далее

Тестируем Google TimesFM-3 бесплатными инструментами вайб‑кодинга: DeepSeek, OpenCode и Freebuff

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели10K

На днях, а именно, 31 августа, вышла новая модель работы с временными рядами от Google — TimesFM-3 (Time Series Foundational Model).

Если вкратце, задача моделей семейства TimesFM — прогнозировать дальнейшее поведение системы на основе ретроспективных данных. Интересно, что для этого исследователи Google применяют токенизацию групп временных отсчетов, а сам трансформер TimesFM — decoder‑only. Также в третьей версии TimesFM заявлена поддержка одновременно множественных переменных (multi‑variate).

Так я был в отпуске и мне было скучно, я вспомнил про старую задачу полуторагодовалой давности: классификация сценариев поведения пользователя на основе данных энергопотребления.

Читать далее

Как запускать Python‑функцию с её зависимостями — и не засорять окружение проекта

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели8.6K

Полезная внутренняя функция редко остаётся функцией без зависимостей. Сегодня ей понадобился python-dateutil, завтра — конкретная версия NumPy. Когда тот же код нужен во втором проекте, приходится либо менять его lockfile, либо собирать отдельный контейнер, либо превращать десять строк в сервис.

splime предлагает ещё один вариант: опубликовать доверенную Python‑функцию вместе с точными версиями пакетов и вызывать её по имени. Локальный демон сам собирает окружение и хранит его отдельно от проекта, который будет вызывать функцию. Общая модель была в первой статье, а упаковка функции — в предыдущей части. Этот текст можно читать отдельно.

Сначала запустим функцию, чья зависимость вообще не установлена у вызывающего кода. Затем посмотрим, откуда берётся venv, почему он кэшируется и когда одной ноде стоит назначить native, venv-subprocess или Docker. Материал рассчитан на macOS и Linux с Python 3.13+; в splime 0.4.9 сборка локальных окружений требует POSIX.

Читать далее

Как Python‑функция превращается в ноду: локальный уровень splime изнутри

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели6.9K

В комментариях к прошлой статье сформулировали правило, под которым я подписываюсь обеими руками: «платить» за внепроцессный вызов имеет смысл тогда, когда сама работа дороже транспорта. clean_amount из квикстарта — десять строк, ноль зависимостей, микросекунды работы — этот порог не проходит. Свою задачу тот пример выполнил: показал механику publish/call в шесть строк. Но ноды существуют не для него: 2 + 2 через демон не нужно никому, и splime строился не для этого.

Возьмём случай, где оверхед оправдан, залезем под капот и посмотрим, что происходит между publish и call: где физически живёт нода, как Python‑функция превращается в переносимый объект и как две ноды передают друг другу данные, которым не место в JSON.

Напомню контекст из прошлой статьи. splime упаковывает Python‑функции в переносимые вычислительные элементы — ноды, узлы вычислительного графа, — связывает их в пайплайны и исполняет там, где вы скажете: в текущем процессе, через локальный демон или на другой машине.

Всё, что ниже, проверено на актуальной splime 0.4.9.

Читать далее

Дайджест технических новостей, переводов и лонгридов инфослужбы Хабра за август 2026 года

Время на прочтение6 мин
Охват и читатели7.9K

В августе 2026 года информационная служба Хабра выпустила 826 публикаций (785 новостей и постов, 7 лонгридов и 34 перевода). В текущем дайджесте представлены лучшие технические новости, переводы и лонгриды (отдельные большие публикации) инфослужбы Хабра, согласно оценкам пользователей.

Читать далее

11 минут у Backblaze, и неделя бездействия у reg.ru: как компании обрубают инфраструктуру трояна в России и за рубежом

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели77K

Привет, хабр. Если вы состоите в более‑менее крупных ТГ сообществах, то наверняка замечали, как время от времени в чатах мелькают боты с предложением установить сомнительный APK. Обычно их мгновенно банит антиспам или админ, и на этом всё заканчивается. Правда, пока сообщение ещё висит, взгляд успевает за него зацепиться, и в голове проскакивает «это очевидно скам, но как оно работает?». У меня эта мысль проскочила в дождливый вечер прошлой пятницы, и вот, неделю спустя, я всё ещё смотрю на четыре домена, куда уходят перехваченные банковские коды, и ожидаю хоть каких‑до действий от уполномоченных компаний, которые были уведомлены об атаке почти неделю назад.

В этой статье я хочу пробежаться по инциденту: как вирус распространяется, что у него под капотом, и как различные компании и организации реагируют на сообщения о том, что их инфраструктура используется для взлома.

Читать далее

Тренд на «честность»: обзор употребления слова «честный» на Хабре

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели10K

На прошлой неделе обратил внимание на обильное и, на мой взгляд, не всегда уместное использование слова «честный» на Хабре. Решил детальней изучить ситуацию, собрал данные и в результате оказалось, что мне не показалось и так было не всегда, а пик, возможно, еще не пройден. В этой статье делюсь полученными результатами, методологией и датасетом для тех, кому может быть интересно попробовать найти какие-нибудь закономерности самостоятельно.

Читать далее

Когда комментировать на Хабре: я разобрал 4404 комментария

Время на прочтение8 мин
Охват и читатели7.3K

Некоторое время назад я решил оживить мой аккаунт на Хабре. Покомментировав с умным видом здесь и тут, я решил подвести научную базу: собрал 4404 чужих комментария из 250 тредов и посчитал, когда и где надо оставить комментарий, чтобы он набрал максимум лайков. Спойлер: час на часах не важен, а вот позиция в треде и первые сутки решают всё.

Погрузиться в Биг Дейту

Написал расширение, которое качает статьи Хабра в Markdown — и не долбит сервер

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели12K

В прошлых двух статьях я разбирал DNS-трафик домашней сети и анализировал 1233 публикации Хабра, чтобы понять, за что площадка даёт рейтинг. И там, и там был вопрос, который я обходил: чем, собственно, я выгрузил эту тысячу статей?

Не руками копировал и не скриптом на Python, который на двухсотом запросе получил бы 429 и бан по IP. Я написал расширение для Chrome, которое сохраняет статьи Хабра в Markdown — по одной, пакетом или автоматически по расписанию, — и делает это достаточно вежливо, чтобы сервер не считал его атакой.

Главная мысль статьи оказалась не про парсинг HTML, а про хорошие манеры к серверу. Наивный качатель на голом fetch пишется за пять минут и получает бан на десятой. Инструмент, которым можно пользоваться постоянно, отличается тремя вещами:

— держит принудительный интервал между запросами (1.5 секунды, гарантированно); — слушает 429 и при перегрузке сервера замолкает на три минуты целиком (паттерн circuit breaker), а не долбит сквозь ограничение; — работает с открытыми статьями для личного архива, а не сливает базу.

Внутри: разбор вежливого граббера с кодом, почему парсинг чужой вёрстки ломается на каждом редизайне и как от этого защищаться фолбэками, формат Markdown с YAML-метаданными (тот самый, что сделал возможным анализ тысячи статей) и правовая рамка — где граница между «сохранил для себя» и «спарсил».

Расширение с открытым кодом под MIT, ставится из Chrome Web Store в один клик.

Читать далее

ХАЙтек в хату! Впечатления от нашей рекламной кампании на Хабре

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели11K

Даем гайд, как надо продвигать себя в обсуждениях любых соцсетей. Если что, он в самом конце.

Мы со своими сотрудниками привыкли к деловой дружеской атмосфере в англоговорящих социальных сетях разработчиков, среди которых, кстати, огромное число русскоговорящих юзверей. Даже, если твоя идея или статья отстой, там все пытаются как-то поддержать, дать совет, пожелать развития и процветания, похвалят твою аватарку, на худой конец…

А тут мы попадаем в нашу родную совковую коммуналку, где почти каждый чем-то не доволен. (Оставьте эту фразу, если следующая не пройдет цензуру.) Сначала было ощущение, что мы заехали на зону.

Под каждой статьей бегают какие-то ругательные люди с синдромом Туретта, проверяющие тебя на слабо, провоцирующие на нарушение лагерного режима. Они вообще не спят, потому что постят круглосуточно, сразу же после твоего поста шлют свой унизительный коммент, порой с презирающей картинкой. И сколько бы ты ни отвечал, сколько бы ты ни пытался найти общий язык или хотя бы смысл, ни один твой пост не остается не обгаженным. Ощущаешь себя в тюремной камере…

Добро пожаловать в хату!

Ежедневный Хабр: 9 интересных публикаций каждый день

Время на прочтение5 мин
Охват и читатели16K

На главной теперь закреплена подборка из 9 статей и новостей, которая обновляется раз в сутки.

Это самый быстрый способ читать Хабр: материалы точно интересные, а многие даже набрали комментарии.

Читать далее

Дайджест технических новостей, переводов и лонгридов инфослужбы Хабра за июль 2026 года

Время на прочтение6 мин
Охват и читатели9.9K

В июле 2026 года информационная служба Хабра выпустила 1038 публикаций (975 новостей и постов, 7 лонгридов и 56 переводов). В текущем дайджесте представлены лучшие технические новости, переводы и лонгриды (отдельные большие публикации) инфослужбы Хабра, согласно оценкам пользователей.

Читать далее

Ближайшие события

Смещение с содержания и темы на подачу: как изменился паттерн чтения статей на Хабре

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели8.4K

Недавно мы с коллегой поспорили, какую статью на Хабре считать успешной. Я смотрел на охват и дочтения, а он вспоминал публикации, которые собирали сотни комментариев или неделями пополняли избранное. Стало очевидно, что под «успехом» мы понимаем принципиально разные вещи. Для одного это десятки тысяч просмотров, для другого — актуальность прикладной инструкции, а для третьего — горячая дискуссия, которая продолжается даже когда статья уходит из топа. 

Главный подвох открытой статистики Хабра в том, что ее легко трактовать слишком буквально. Высокий охват принято считать признаком сильной темы, длинную ветку комментариев воспринимают как доказательство резонанса, а добавления в закладки называют гарантией практической пользы. Однако эти реакции не складываются автоматически: статью могут сохранить после быстрого просмотра и не прочитать до конца. Подробный разбор читатель может внимательно изучить и оставить без единого комментария. Спорный тезис, напротив, иногда собирает сотни сообщений при вполне среднем охвате.

Чтобы понять, как эти сценарии соотносятся между собой, я разобрал почти триста публикаций блога МТС, вышедших с января по 11 июня 2026 года. Сопоставил охват, дочтения, доскроллы, сохранения, оценки и комментарии, а затем посмотрел, как реакции менялись в зависимости от темы и конструкции материала.

Выясним, что мне удалось узнать.

Читать далее

Разобрал 1233 статьи Хабра: всё, что советуют авторам, объясняет 6% результата

Уровень сложностиСредний
Время на прочтение16 мин
Охват и читатели10K

Полгода назад я начал писать на Хабр дважды в неделю. Результаты разошлись в восемьдесят раз: от 120 тысяч охвата и 647 закладок до полутора тысяч охвата и нуля закладок при одинаковом подходе к работе.

Чтобы разобраться, я сделал очевидное — собрал 200 статей с высоким рейтингом и посчитал в них всё, что считается. Вышла красивая формула, совпадающая с тем, что обычно советуют авторам: пиши коротко, без картинок, с личного аккаунта, про горячую тему.

Потом я добавил контрольную группу — все 1033 статьи, вышедшие на площадке за месяц, без всякого отбора. И формула развалилась.

Картинки: по хитам корреляция с охватом −0.21, по всей популяции с рейтингом +0.26. Статьи вообще без иллюстраций имеют медианный рейтинг 4, с двадцатью и более — 15.

Длина: по хитам короткое побеждает, по всей популяции статьи на 4000–6000 слов имеют втрое больший шанс взять рейтинг выше 50, чем короткие.

Модель на всех измеримых признаках сразу — длина, картинки, гифки, видео, код, таблицы, ссылки, заголовок, час, день недели, тема, тип блога — даёт R² = 0.06. Вся форма объясняет шесть процентов разброса рейтинга.

Внутри: реальные базовые ставки площадки (медианная статья собирает 8869 охвата, 7 плюсов и 3 комментария), шестикратный разброс по хабам, разбор того, за что дают плюсы и за что закладки, история про тему, выгоревшую за пять месяцев с 697 тысяч охвата до 66 тысяч, и отдельный сюжет о том, как я чуть не повторил ту же ошибку второй раз — уже специально про неё зная.

Плюс результаты живого эксперимента: статья, написанная строго по выведенной формуле и опубликованная в прошлую пятницу.

Читать далее

Можно ли измерить смысл

Уровень сложностиСредний
Время на прочтение24 мин
Охват и читатели9.6K

Дисклеймер: текущие LLM‑возможности позволяют детектировать «жирный» слоп. Но оценка может быть субъективной, и возможны ошибки, никогда не доверяйте оценке слепо: это обоюдоострый меч. Оценить точно не всегда могут сами люди, кроме совсем очевидных примеров, и даже там среднестатистический житель планеты напряжётся. Этот метод — инструмент, призванный экономить время, необходимое для диагностики человеком. Именно эту плоскость и будет раскрывать статья.

Дегустировать

Рекомендации на онбординге Хабра стали обновляться чаще (и автоматически)

Время на прочтение3 мин
Охват и читатели14K

TL;DR: Раньше пресеты подписок на онбординге Хабра настраивались вручную — чтобы попасть туда, нужно было привлечь внимание модератора (в хорошем смысле).

Теперь пресеты подписок обновляются автоматически, раз в сутки. Выпустили сильную статью — на следующий день вас увидят все любопытные новореги.

Читать далее

«Авторский огонёк» Хабра: почему мы зажигаем авторские сердца

Уровень сложностиПростой
Время на прочтение21 мин
Охват и читатели15K

Привет! Ну что, мы продолжаем зажигать ваши сердца и совсем недавно снова собрали корпоративных авторов и редакторов уже на четвертую творческую встречу. Она состоялась 24 июня в нашем офисе в Москве, а уже в эту пятницу, 10 июля, в 13.00 проведем сокращенный формат в режиме онлайн по многочисленным просьбам тех, кто находится не в столице или не смог добраться до офиса. 

Наша последняя офлайн-тусовка побила все рекорды. В одном месте встретились 49 авторов из 38 компаний. Мы нашли классных спикеров и обсудили несколько актуальных тем, успели познакомиться и пообщаться, разобрать основные проблемы авторов, а также вечные вопросы, связанные с их блоками и страхами, а ещё вместе мы погенерили классные идеи, которые могут лечь в основу статей в формате сторителлинга. Одним словом, постарались сделать эту встречу максимально насыщенной и полезной. 

Зачем мы это делаем? Кому всё это нужно? Как можно попасть на такую встречу в качестве гостя или спикера? Вопросов к нам стало прилетать немало, и я решила ответить на них, так сказать, оптом. Если ты  корпоративный автор и тебе не хватает опыта, знаний о Хабре, мотивации, поддержки и вдохновения – велкам под кат! Я поведаю историю этого проекта, а также расскажу про наше авторское сообщество, которое появилось как логичное продолжение одной из таких творческих встреч и частью которого ты тоже можешь стать.

Читать далее

Дайджест технических новостей, переводов и лонгридов инфослужбы Хабра за июнь 2026 года

Время на прочтение6 мин
Охват и читатели7K

В июне 2026 года информационная служба Хабра выпустила 944 публикации (880 новостей и постов, 8 лонгридов и 56 переводов). В текущем дайджесте представлены лучшие технические новости, переводы и лонгриды (отдельные большие публикации) инфослужбы Хабра, согласно оценкам пользователей.

Читать далее

Еще несколько «ласковых слов» о новом редакторе Habr ¯\_(ツ)_/¯

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели13K

Несколько лет назад в процессе подготовки очередной статьи (о ней чуть ниже) я вынужденно столкнулся с новым редактором Habr, которого до этого мне удавалось избегать, и который к тому моменту стал безальтернативным.

Тогда “по мотивам” пользования этим поделием почти сама родилась статья Несколько «добрых» слов о текущей версии редактора Habr, в которой я изложил всё, что я думал о новом редакторе (вернее ту часть мыслей, которую можно было напечатать, поскольку значительная их часть была непечатной)

Я будучи пессимистом тогда наивно полагал, что “хуже быть не может”, однако как оказалось ситуация тогда была оптимистическая, и “может быть еще хуже”

но об этом далее ¯\_(ツ)_/¯
1
23 ...