Обновить

Системный и бизнес-анализ

Сначала показывать
Порог рейтинга
Уровень сложности

LLMO на практике: как попасть в тренировочные данные будущих AI-моделей (и зачем Вам это нужно уже сегодня)

Уровень сложностиСредний
Время на прочтение32 мин
Охват и читатели4.8K

Три месяца назад я начал замечать странную закономерность. Открываю ChatGPT, задаю вопрос по SEO — получаю детальный ответ с цитированием пяти-семи источников. Проверяю Claude с тем же запросом — снова развёрнутый ответ, четыре ссылки на компании и блоги. Perplexity показывает топ-7 ресурсов с описаниями. Gemini выдаёт структурированный список решений.

И вот что интересно. Одни и те же сайты появляются в этих ответах постоянно. HubSpot, Moz, Backlinko, Ahrefs, SEMrush — их цитируют снова и снова. А сотни качественных блогов, которые я читаю годами, в этих ответах отсутствуют. Вообще.

Начал копать глубже. Что у этих постоянно цитируемых ресурсов общего? Почему AI-модели выбирают именно их?

Понимаете, что произошло? Правила игры изменились. И большинство об этом ещё не знает.

Читать далее

СКЗИ для системных аналитиков: простыми словами о защите интеграций

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели5.5K

Обо мне

Меня зовут Кирилл Захаров, я старший аналитик в компании БФТ-Холдинг. Сейчас занят написанием статьи про СКЗИ, а в перерыве занимаюсь проектированием системы долговременного ухода. К сожалению, пока что платят деньги только за последнее.

Эта статья будет полезна:

Читать далее

Векторизация текстов с помощью LLM. Гайд для аналитиков, которые не хотят, чтобы их проекты переделывали с нуля

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели7.5K

Когда речь заходит о языковых моделях (LLM), большинство представляет себе инструмент для генерации текста или изображения по запросу. Эта функция действительно стала визитной карточкой технологий вроде ChatGPT. Однако существует менее известная, но не менее важная функция: преобразование текста в числовые векторы (эмбеддинги).

Меня зовут Вадим Скляров, и я бизнес-аналитик в MWS. Казалось бы, тема векторизации текстов сугубо техническая, зачем мне в нее погружаться? Ответ прост: чтобы понимать возможности и ограничения работы с векторными представлениями и задавать правильные вопросы заказчику, не обещать того, чего сделать не получится. Плюс это помогает точнее оценить сроки и стоимость проекта.

В этом материале я разберу, как использовать эмбеддинги для решения практических бизнес-задач, опишу основные шаги векторизации текстов и акцентирую внимание на ключевых моментах, которые позволят обсуждать задачи с командой разработки на одном языке.

Читать далее

Один простой способ оптимизации API

Уровень сложностиСредний
Время на прочтение4 мин
Охват и читатели5.9K

Привет всем, я Дмитрий Кислов, системный аналитик-технолог в ПСБ. Отвечаю за создание новых и доработку существующих продуктов для клиентов малого и среднего бизнеса.

Решение, которое описано в этой статье, мне кажется простым и очевидным. Но я написал эту статью для тех коллег, которые пока что не сталкивались с вопросом оптимизации API.

Думаю, описанное ниже может оказаться полезным. При том, что предлагаемый кейс действительно элементарный, решение понятно и хорошо работает. 

Читать далее

Наше расследование: pulp fiction

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели16K

Похоже, мы поневоле стали создателями на «Хабре» нового хаба — «Разборка техники». А почему бы и нет? Тема очень увлекательная и вызывает неподдельный интерес — причем не только у читателей, но и у правоохранительных органов.

Мы решили поддержать эту тему новым легким и увлекательным чтивом. Недавно на «Хабре» вышла статья «Главный элемент информационной безопасности», в которой автор @D4N3L0NG рассказывал о клавиатуре от российской компании LightCom на базе отечественного микроконтроллера К1986ВЕ92FI. Попутно было упомянуто, что в другой российской клавиатуре — КЛ104РУ от компании «Бештау» — нашли контроллер, который по необъяснимым причинам отличался от того, что сама «Бештау» представляет как свой.

Этот факт вызвал бурю эмоций в обсуждениях: были обвинения в лжи и воровстве. Даже главный импортозаместитель всея Руси, блогер Горшенин, не остался в стороне и высказался в своем привычном копрофильском стиле.

Поскольку мы занимаемся комплексными поставками техники и должны обезопасить себя от подозрительного оборудования, мы решили перепроверить информацию о клавиатурах «Бештау». И, несмотря на наше предвзятое отношение к компании, в разобранной нами клавиатуре мы нашли «правильный» контроллер.

На этом, казалось бы, можно и закончить. Но тогда и статьи бы не было...

Читать далее

GlowByte представляет новое российское BI-решение для корпоративной аналитики Sigla Vision

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели5.3K

Представьте: ваши дашборды, от которых зависят ежедневные решения, внезапно перестали обновляться. Скрипты интеграций сломались, а поддержка отвечает шаблонными письмами. Знакомая ситуация? После ухода Qlik, Tableau и других игроков многие российские компании оказались в аналитическом вакууме. Мы прошли через это же и в ответ создали Sigla Vision. В этой статье я покажу, как мы решали технические вызовы, с которыми сейчас сталкиваетесь вы.

Читать далее

Исполняем желания заказчика: бизнес-требования на автоматизацию и их связь с корпоративной архитектурой организации

Уровень сложностиСредний
Время на прочтение4 мин
Охват и читатели4.4K

Бизнес-требования на автоматизацию и их связь с корпоративной архитектурой организации

На моей практике в организациях редко связывают (а в некоторых случаях вообще видят связь) между требованиями бизнеса, предъявляемыми к информационным системам, обеспечивающим бизнес-процессы, и корпоративной архитектурой данной организации. Во многих компаниях, при этом, отсутствует или слабо развита сама функция управления корпоративной архитектурой.

Узнать больше

Как аналитику разобраться в legacy-системе без документации

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели4.5K

Приветствую всех! С вами старший системный аналитик, эксперт онлайн-школы по системному анализу Ольги Пономарёвой System Analyst. Статья основана на практическом опыте, в нашей школе мы не просто даем теорию, а любим делиться тем, что действительно работает на проектах.

Разбор legacy-системы без документации кажется сложной задачей. Но это возможно с правильным подходом и современными инструментами. Это руководство даст вам план действий, практические методы и покажет, как использовать ИИ для ускорения работы.

Читать далее

EDA в Python для новичков: что почитать и где попрактиковаться

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.1K

Привет! Это команда курса «Аналитик данных». Мы подготовили подборку материалов для тех, кто делает первые шаги в мире анализа данных и хочет освоить исследовательский анализ данных с нуля.

Разведочный или исследовательский анализ данных (Exploratory Data Analysis, EDA) — это этап работы с данными, на котором аналитик изучает доступную информацию перед построением сложных аналитических моделей. Это основа работы с данными, которая помогает понять, какая информация доступна и возникнут ли трудности с будущим анализом.

Читать далее

Повторное использование шаблонов элементов и коннекторов для стандартизации процессов

Уровень сложностиСложный
Время на прочтение15 мин
Охват и читатели3.3K

Узнайте, как использовать шаблоны элементов и коннекторов в Camunda, чтобы быстро создавать эффективные, стандартизированные и многократно используемые процессы.

Читать далее

Шатдаун правительства США, а также Грокипедия от Илона Маска

Время на прочтение8 мин
Охват и читатели11K

Самые интересные новости финансов и технологий в России и мире за неделю: Electronic Arts продались Эмиратам за $55 млрд, больше налогов для айтишников в России, приватизация Союзмультфильма, нейрослоп-машина Sora 2 от Сэма Альтмана, первая AI-актриса Тилли Норвуд, а также смарт-взрывное кольцо на палец от Самсунга.

Читать далее

Бесконечность в ваших данных – power laws

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели8.3K

Сегодня я хочу рассказать о теме, которая редко затрагивается в курсах по статистике, но порой встречается на практике. Она может сломать основания всех ваших привычных методов и даже ваш мозг. Имя этой теме – power laws или “степенные законы”. В этой статье я расскажу, что это такое, покажу примеры реальных данных и расскажу, что делать, если в ваших данных встретился степенной закон. Я постарался сделать текст читаемым для широкого круга людей и не нагружать его формулами.

Читать далее

Как я пытался сделать нейросеть аналитиком: провалы и уроки

Уровень сложностиСредний
Время на прочтение3 мин
Охват и читатели10K

Наверняка многим знакома ситуация: у тебя есть куча данных, отчетов, KPI, а команда тонет в Excel‑таблицах и Jira‑тикетах. И вот тебе кажется, что решение простое: «Давайте посадим нейросеть на аналитику».

Я решил попробовать. И вот что из этого вышло.

Читать далее

Ближайшие события

Topical Authority на практике: как стать экспертом в глазах Google (и почему одна статья никогда не ранжируется)

Уровень сложностиСложный
Время на прочтение13 мин
Охват и читатели5.7K

Ко мне пришел клиент с блогом о кофе. Он показал статью на 4500 слов про методы заваривания эспрессо. Текст написан бариста с двенадцатилетним стажем. Фотографии профессиональные. Техническая оптимизация безупречна.

Позиция в Google? 47-е место.

Я открыл топ-3 по тому же запросу и увидел картину, которая повторяется в моей практике. Статьи слабее по глубине, без экспертного авторства, с посредственными иллюстрациями. Но эти материалы были частью сайтов, где про кофе написано всё — от истории напитка до химии экстракции кофеина, от обзоров профессиональных кофемашин до детальных гайдов по выбору зёрен из разных регионов произрастания. Google воспринимает эти ресурсы как экспертные источники по всей теме "кофе". А блог моего клиента остаётся точечным игроком. Одна статья. Пусть даже гениальная.

Вот в чём суть проблемы, которую я наблюдаю последние три года работы с клиентами из разных ниш. Алгоритмы больше не ранжируют отдельные страницы в изоляции. Они оценивают сайты как целостные источники знаний по топику. Согласно обновленным Google Search Quality Rater Guidelines от декабря 2024 года, раздел 3.3 явно указывает на важность демонстрации expertise через "объём и глубину контента по теме, созданного квалифицированными авторами".

Цифры это подтверждают жестко. Исследование Ahrefs, проанализировавшее 1.8 миллиарда страниц в 2024 году, показало шокирующую закономерность — сайты с высоким топикальным авторитетом получают на 53% больше органического трафика, чем ресурсы с разрозненным контентом при одинаковом профиле обратных ссылок. Вдумайтесь. Одинаковые ссылки, но в полтора раза больше трафика только за счёт комплексного покрытия темы.

Читать далее

Что такое DWH и зачем оно нужно бизнесу?

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели6.3K

Всем привет! Сегодня рассмотрим, что из себя представляет Data Warehouse и зачем оно нужно вашему бизнесу.

Статья рассчитана на то, чтобы дать общее представление широкой аудитории, так что возможны упрощения и небольшие неточности – буду рада подискутировать о них в комментариях, если вы заметите их.

Подробнее о DWH

Как попасть в ответы ChatGPT, Perplexity и Google AI: практическое руководство по GEO

Уровень сложностиСредний
Время на прочтение20 мин
Охват и читатели10K

Три месяца назад ко мне обратился клиент с проблемой, которую я теперь вижу еженедельно. Позиции в топ-3 Google по всем ключевым запросам. Контент написан экспертами с многолетним опытом. Техническая оптимизация выполнена безупречно — скорость загрузки под секунду, мобильная версия идеальна, Core Web Vitals в зелёной зоне.

Трафик падает. Минус 35% за квартал.

Я открыл Google, ввёл их главный запрос. Первое, что увидел — AI Overview с развёрнутым ответом на три абзаца, занимающий половину экрана. Конкуренты цитируются там с названиями компаний и прямыми ссылками. Мой клиент? Его нет. Даже упоминания.

Проверил ChatGPT Search по тому же запросу. Система выдала структурированный ответ с пятью рекомендованными решениями, описаниями, ценовыми диапазонами. Мой клиент снова отсутствует. Открыл Perplexity — тот показал топ-7 источников с краткими описаниями и ссылками. Результат идентичный — полная невидимость.

Понимаете, что произошло? Правила игры изменились радикально, а стратегия продвижения застряла в 2020 году.

Исследование seoClarity показывает цифры, которые невозможно игнорировать: AI Overviews теперь появляются в 10.4% всех десктопных поисковых запросов в США по состоянию на март 2025 года — это исторический максимум с момента запуска функции. Более того, согласно независимому анализу Ahrefs, позиция номер один в органической выдаче теряет 34.5% кликов при наличии AI Overview над ней.

Вдумайтесь в эту цифру. Вы на первом месте в поиске. Но треть Вашего потенциального трафика испаряется. Просто потому что искусственный интеллект ответил на вопрос пользователя раньше, чем тот успел добраться до Вашей ссылки.

Читать далее

Почему не стоит заменять пустые значения нулями в Power BI

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели3.9K

Вас просили заменить пустые значения нулями в отчетах? Возможно, стоит дважды подумать, прежде чем это делать!

Читать далее

Сущности в SEO: как Google понимает ваш контент (и почему Keywords — это уже не всё)

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели5.4K

Помню, как полгода назад ко мне обратился клиент с интернет-магазином спортивного питания. Контент идеальный — вхождения ключевых слов расставлены по всем правилам классического SEO, LSI-фразы присутствуют, тексты уникальные. Но позиции стояли мертво. Конкуренты с более слабыми текстами занимали топ-3.

В чём дело?

Открываю анализатор сущностей — и вижу картину. Google просто не понимал, о чём этот сайт. Слова «протеин», «креатин», «аминокислоты» были разбросаны как попало, без связи с брендами (Optimum Nutrition, BSN), без упоминания спортивных дисциплин (бодибилдинг, кроссфит), без привязки к научным концепциям (синтез белка, восстановление мышц). Google видел набор слов, но не видел смысла.

Исправили. Добавили структурированную разметку Schema.org для продуктов и брендов. Выстроили внутреннюю перелинковку между статьями о конкретных добавках и тренировочными программами. Указали связи между сущностями явно. Через три месяца — рост органического трафика на 47%, выход в топ-5 по 23 среднечастотным запросам.

Это не магия. Это работа с сущностями — фундаментом современного SEO, о котором многие по-прежнему не знают или игнорируют.

Читать далее

Пользователь не дал согласие на использование cookie и метрических программ, но информация о нём получена: что делать

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели181K

Ситуация: пользователь зашёл на сайт. Фактически его данные уже обрабатываются метрическими программами (файлами cookie), хотя согласия на это он не давал. Пользователь не хочет, чтобы его данные собирались и обрабатывались, поэтому покидает сайт. Но данные уже получены. Что делать в этой ситуации? На каком  основании можно обрабатывать данные пользователя сразу при входе на сайт? 

Узнать, как не нарушать закон

Как с помощью локальной LLM автоматизировать рутину и облегчить жизнь себе и коллегам

Уровень сложностиСредний
Время на прочтение19 мин
Охват и читатели34K

Привет, на связи Алексей Дубинец, Павел Беспалов и Глеб Гладков — BI-аналитики Авито. В тексте делимся идеями и промптами для использования локальной LLM в своих повседневных задачах, а ещё расскажем, как настроить инхаус модель в LM-Studio. Статья будет полезна аналитикам разных грейдов, которые сталкиваются с задачами, где нужно собрать, классифицировать и систематизировать большие объёмы информации.

Читать далее