Обновить

Системный и бизнес-анализ

Сначала показывать
Порог рейтинга
Уровень сложности

Упрощаем Spark через Catalog API

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели4.4K

Говоря о серьезных кластерах в компаниях, нам часто приходится взаимодействовать со сторонними отделами и их данными. И зачастую, когда речь идет об ad-hoc, самый эффективный инструмент - Trino. Он удобен тем, что в платформе данных можно добавить каталог, который позволит по сути избежать настройки коннекшена для конечного пользователя. Просто в запросе указываешь название каталога данных и трино сам понимает, что нужно взять данные со сторонней базы данных. Но все меняется, когда выразительности SQL нам перестает хватать для выполнения поставленных задач и мы переходим в Spark. Точнее, менялось. С релизом Spark 3.0 появилась возможность взаимодействовать с внешними источниками так же просто, как в Trino.

Читать далее

Представляем XBRL-CSV — машиночитаемую отчетность в формате для людей

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели6.6K

Примечание: Статья посвящена формату XBRL-CSV2 (тэг "@context":"www.cbr.ru/xbrl_csv2").

Авторство формата принадлежит Банку России.
Автор статьи — архитектор, принимавший участие в разработке формата в качестве технического специалиста.

Введение.

Банк России использует стандарт XBRL для сбора отчетности от некредитных финансовых организаций. Несмотря на всю продуманность XBRL, при формировании и обработке отчетности возникает проблема, связанная с реестровыми формами.

Эти формы содержат гиперкубы с открытыми осями. При большой вариативности значений таких осей реестровые отчеты становятся чрезвычайно объемными.

Решение этой проблемы — создание производного от XBRL-XML формата: XBRL-CSV.

Основная предпосылка: CSV органически приспособлен для хранения реестровых форм. Открытые оси выносятся в начальные колонки, а комбинации значений ячеек открытых осей в каждой строке образуют составной открытый ключ, однозначно идентифицирующий запись.

Остальные колонки — это данные, которые определяют три аспекта показателя:

Читать далее

Как мы используем RFM-сегментацию, чтобы улучшать CRM-коммуникации в Авито

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели8.8K

Привет! Я Рамиль Сакаев — аналитик в команде Авито Авто. В статье рассказываю, как адаптированная RFM-методология помогла нам выявить недоработанные зоны CRM-коммуникаций и создать бенчмарк для маркетологов.

Читать далее

ИИ-инструменты бизнес и системного аналитика: промт для создания критериев приёмки User Story

Уровень сложностиПростой
Время на прочтение24 мин
Охват и читатели4.9K

Привет, Хабр! На связи Егор Марюшко.

Я не верю в то, что ИИ отберёт у бизнес и системных аналитиков работу.

Как сказал Крейг Винг в одном из своих выступлений: «ИИ — это невероятно дорогостоящий галлюцинирующий попугай, комбинирующий лишь то, что увидел».

ИИ — это современный и перспективный инструмент, и им надо уметь пользоваться. Любой инструмент должен быть простым, полезным и эффективным. Я решил подготовить серию статей с промтами, минимальная модификация которых позволяет решать конкретные задачи, регулярно возникающие перед аналитиком. Не пытаться заменить его творческую и аналитическую деятельность, а упростить и ускорить рутинные операции.

В данной статье разберём промт для создания критериев приемки (Acceptance Criteria) для User Story, проверим его работу на наиболее распространённых и доступных ИИ: ChatGPT, DeepSeek, Qwen, Алиса (Яндекс GPT), GigaChat.

Читать далее

Как создать AI-агента и дать ему инструменты

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели11K

Тема применения сервисов GenAI сейчас на хайпе, на конференциях по этой теме всегда аншлаг, а подавляющее большинство пользователей «играется» с текстовыми запросами в бесплатных сервисах, восторгаясь полученными результатами.

В этой статье хочу пойти дальше и определиться с понятием AI-агентов и показать пример создания AI-агента с помощью системы n8n.io и популярных сервисов GenAI.

Перейти к статье

Разбираемся с Нобелевкой по экономике, а также миллиардное дело о пиратстве OpenAI

Время на прочтение9 мин
Охват и читатели10K

Самые интересные новости финансов и технологий в России и мире за неделю: серебро и золото продолжают ставить рекорды, JPMorgan боится тараканов, принудительное гашение четырех фондов Тинькофф, новый самый молодой миллиардер, США раздумывают над спецоперацией в Венесуэле, ChatGPT снимет ограничения на эротику, а роботов Илона Маск не могут дособирать (потому что у них нет лапок).

Читать далее

Числовой тип данных с плавающей точкой float IEEE 754

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели14K

Как устроен формат кодирования с плавающей точкой, что он из себя представляют и где может использоваться.

Читать далее

Индустрия 4.0 в 2026 году: цифровые двойники, реверс-инжиниринг и «умные» фабрики

Время на прочтение3 мин
Охват и читатели7.5K

2026 год обещает стать переломным для промышленности. Индустрия 4.0 — это уже не красивые слайды, а реальность: заводы оцифровывают оборудование, внедряют цифровых двойников и начинают использовать AI не только для отчётов, но и для реального управления производством.

По данным Всемирного экономического форума, лишь ~30% компаний смогли масштабировать цифровые проекты — остальные застряли в бесконечных пилотах. Но именно те, кто сумел вырваться, сегодня показывают рост производительности и снижение затрат на двузначные проценты.

Читать далее

Как повысить качество клиентских данных

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели5.3K

Привет, Хабр. В этой статье делюсь опытом повышения качества клиентских данных в онлайн-обучении и выводами, к которым я пришел по итогам.

Узнать, как улучшить качество данных

За 4 недели внедрили аналитику программы лояльности для курорта: переток клиентов, возвратность и другие показатели

Время на прочтение10 мин
Охват и читатели4.7K

На связи Андрей Рыжик, руководитель отдела BI-разработки компании «Белый код». Мой опыт показывает, что данные о поведении клиентов — кладезь инсайтов для бизнеса. Особенно это касается программ лояльности: без аналитики трудно понять, как гости пользуются вашими услугами, кто возвращается, а кто уходит навсегда. Сегодня расскажу, как всего за месяц мы разработали аналитическое приложение в Qlik Sense для крупного курорта (аквапарк + СПА, отель, рестораны) и какие возможности это открыло бизнесу.

Читать далее

Что такое Таксономия «Точно в Срок»?

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели4.6K

Сегодня важный день. Возможно, вы только что выпустили на рынок новый продукт или услугу. Возможно, сегодня были опубликованы результаты опроса клиентов. Десятки тысяч комментариев, вопросов, отзывов, заявок в службу поддержки или каких-то еще текстовых документов заполонили вашу систему, и вашей команде необходимо всё это как можно скорее осмыслить и выявить ключевые паттерны и тренды, чтобы успеть эффективно использовать окно возможностей для принятия верных бизнес-решений. Но для этого кто-то должен структурировать полученный массив документов и перевести его в поддающуюся осмыслению форму. Эта задача решается путем выявления иерархической системы категорий, называемой таксономией, которая помогает структурировать основные темы, встреченные в массиве документов.

Используя традиционные методы, команде из нескольких аналитиков может потребоваться 3–4 недели на таксономизацию данных. За это время выявленные проблемы уже перезреют, возможности будут упущены, а критически важное окно для быстрого реагирования закроется. Конечно, вы можете использовать ранее заготовленную таксономию, но она будет охватывать только те категории, которые вы смогли предвидеть заранее.

Основанная на применении искусственного интеллекта (ИИ) технология Таксономия «Точно в Срок» (ТВС-таксономия) решает эту проблему. Вместо того, чтобы тратить недели на ручное создание категорий или пытаться рассортировать новые данные по заранее выбранным категориям, вам будет достаточно нажать кнопку «Старт», и пара ИИ-агентов проанализирует ваши данные и создаст новую пользовательскую таксономию менее чем за час. ТВС-таксономия, созданная на основе семантического анализа ваших данных прямо в день их получения, позволяет оперативно выявить все важные темы (категории), в том числе ранее неизвестные, и провести классификацию документов по этим категориям.

Читать далее

Почему в России так активно убивают 3G? Технический разбор неочевидной причины

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели9.5K

Отключение 3G — общемировой тренд: операторы в США, Европе и Азии тоже высвобождают частоты под более эффективные 4G и 5G.

Однако в России этот процесс имеет свои особенности. Здесь он идёт не только в русле технологического прогресса, но и накладывается на ужесточение правил и процедур вокруг интернета и мобильной связи. Если на Западе основной драйвер — экономика, то в российских реалиях архитектурные изменения сети чаще резонируют с задачами мониторинга и регуляторного контроля.

Итак, к теме

Документирование архитектуры

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели12K

Каждый архитектор сталкивается с вечной дилеммой: как правильно документировать архитектуру, чтобы она была понятна людям и одновременно пригодна для автоматизации? Сегодня разберем три основных подхода и выясним, когда какой использовать.

Современная документация архитектуры должна решать множество задач одновременно. Она должна быть понятна разработчикам, архитекторам и бизнесу, поддерживать версионирование, интегрироваться в CI/CD процессы и оставаться актуальной.

Читать далее

Ближайшие события

Свой оффлайн-ассистент на Phi-3-mini: Разворачиваем локальную модель нейросети для анализа данных с открытым кодом

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели6.8K

Тренд на использование больших языковых моделей (LLM) не ослабевает, но облачные решения вроде ChatGPT или Gemini имеют ряд ограничений: зависимость от интернета, платные подписки и, что самое важное, конфиденциальность данных. Особенно остро последний вопрос стоит при работе с корпоративной или чувствительной информацией, которую нельзя загружать в чужие сервисы.

В этой статье я хочу поделиться опытом создания полностью локального AI-ассистента на основе Microsoft Phi-3-mini — компактной, но мощной модели, способной анализировать данные из CSV, JSON и TXT файлов. Весь проект представляет собой набор Python-скриптов с открытым исходным кодом, которые автоматизируют установку и предоставляют интуитивно понятный чат-интерфейс.

Почему Phi-3-mini?

Microsoft позиционирует семейство моделей Phi-3 как "достаточно маленькие" (Small Language Models), но при этом "достаточно умные". Phi-3-mini, обладая 3.8 миллиардами параметров, демонстрирует производительность, сопоставимую с моделями вроде Mixtral 8x7B и GPT-3.5, но в значительно меньшем размере. Это делает её идеальным кандидатом для локального запуска на потребительском железе.

Компактность: ~7-8 ГБ против десятков и сотен ГБ у более крупных моделей.

Эффективность: Оптимизирована для работы на GPU с ограниченными ресурсами.

Качество: Поддерживает контекст до 4K токенов и отлично справляется с логическими и аналитическими задачами, включая код.

Читать далее

Метод Кано на практике: как мы перестали гадать и стали понимать пользователей лучше

Время на прочтение8 мин
Охват и читатели5.4K

Привет, меня зовут Ксюша Пешкина, я старший системный аналитик в Контуре. Объясняю на кетчупах 🥫🍅, как мы раньше в продукте гадали классифицировали существующие фичи по уровням (надо/не надо), а потом попробовали один крутецкий метод, который перевернул нам всё с ног на голову. 🙃 Рекомендую взять на заметку: это точно позволит вам взглянуть на ваши фичи глазами пользователей и обновить приоритезацию.

Читать далее

Нигерия — Дания 1:21. Как соотносятся региональные цены на Chess.com

Уровень сложностиПростой
Время на прочтение14 мин
Охват и читатели4K

Что такое региональное ценообразование?

Цель каждого бизнеса — максимизация прибылей. Бизнес должен выставлять такую цену на свои продукты, чтобы получать наибольшую прибыль. Сделаешь цену слишком низкой — рискуешь потерять существенную часть прибыли. Слишком высокой — она будет неподъёмной для многих потенциальных покупателей. Для решения этой проблемы компании используют задачу фирмы по выбору оптимальной цены, то есть точки, где прибыль максимальна и есть баланс между ценой и спросом.

Мы знаем, что у многих бизнесов покупатели есть по всему миру. Для максимизации международных прибылей бизнесу необходимо регулировать цены в разных регионах в зависимости от покупательской способности каждой страны и других факторов (налогов, стоимости доставки и пошлин). Это крайне важно, потому что цена, доступная в одной стране, может быть слишком высокой в другой. Без учёта этих различий бизнес может продешевить или завысить цену; и то, и другое приводит к снижению прибылей.

У многих популярных онлайн-сервисов, в том числе Netflix, Spotify, HBO Max, Disney+, YouTube Premium, Steam и Epic Games Store, есть региональное ценообразование. В этой статье я проанализирую стратегию регионального ценообразования, используемую популярной шахматной онлайн-платформой Chess.com.

Читать далее

Выстраиваем процессы в Discovery-команде

Уровень сложностиСложный
Время на прочтение7 мин
Охват и читатели6.8K

Привет! Сегодня расскажу про Discovery-процесс в команде. 

Discovery и Delivery процессы разделены.  В Discovery-команду могут входить продакт-лид, продакт-менеджеры, продакт-аналитики, бизнес-аналитики и UX-дизайнеры/проектировщики. Если же задачи технические, то подключаются тех/тим-лиды, архитекторы и другие технические специалисты.

Что такое Disco? Discovery в первую очередь отвечает на вопросы  и «Что делать?»  и «Надо ли вообще делать?». Delivery -  «Как делать?».

Discovery-команда занимается обоснованием и проработкой инициатив, которые затем попадают в продуктовый бэклог для последующей реализации в Delivery. 

Для запуска с нуля такой команды и их процессов мы используем следующий чек-лист:

Читать далее

Как я парсил схемы Visio

Уровень сложностиСредний
Время на прочтение19 мин
Охват и читатели6.7K

Привет, Хабр! Меня зовут Алексей Грохотов, я разрабатываю продукт Сфера.Архитектура в ИТ‑холдинге Т1. Перед нашей командой стояла задача перенести документы из Orbus iServer в Сфера.Архитектуру. Iserver — это набор инструментов для описания, поддержки и трансформации архитектуры предприятия. Он в значительной степени интегрирован с Microsoft Office, например, все схемы в этом инструментарии создаются в Visio.

Я должен был проанализировать схемы Visio и извлечь необходимую информацию из этих документов. Объекты, соответствующие «прямоугольничкам и стрелочкам» Visio, уже хранились у нас в базе. Мне нужно было соотнести их с фигурами и стрелками схемы, записать для этих объектов геометрическое и текстовое содержание фигур, а также некоторые их специфические свойства. Ещё нужно было определить порты — «стыковочные места» по периметрам фигур, к которым присоединяются стрелки, а также найти надписи у стрелок и фигур. И после этого сохранить в базу данных всю найденную информацию.

Читать далее

Топ-10 способов начать использовать ИИ в работе с процессами уже завтра

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели3.9K

Давайте честно: большинство советов про «ИИ для бизнеса» либо слишком общие, либо слишком технические, чтобы быть полезными. Пока мы готовили курс «AI for Process», я поговорил с десятками участников BPMInstitute.org — аналитиками, архитекторами и руководителями процессов, — которые уже экспериментировали с генеративным ИИ. Кто-то только начинал, кто-то копал глубоко, но все пытались сделать ИИ полезным в повседневной процессной работе.

Эти 10 техник стали лучшими. Если вы только начинаете, используйте этот список как трамплин. Каждая из них — это реальные уроки, реальная польза и понятный путь к тому, чтобы уже завтра работать умнее.

Читать далее

ArchiMate: внедряем в практику бизнес-аналитика на примере соответствия BPMN

Уровень сложностиСредний
Время на прочтение2 мин
Охват и читатели5.9K

Это первая из запланированных статей по внедрению практики использования языка Archimate для различных ИТ-ролей. Конкретно этот материл будет полезен прежде всего бизнес-аналитикам для повышения уровня компетенций и дополнения используемых инструментов моделирования бизнес-процессов (подробней про апгрейд роли было здесь).

Узнать больше