Обновить

Системный и бизнес-анализ

Сначала показывать
Порог рейтинга
Уровень сложности

Новый судебный замес Маска с Альтманом, а также гренландские тарифы Трампа

Время на прочтение9 мин
Охват и читатели15K

Самые интересные новости финансов и технологий в России и мире за неделю: Трампу подарили Нобелевку, отмена виз в США для россиян, Telegram стали замедлять сильнее, в ChatGPT вставляют рекламу, GPT-5.2 впервые решил сложную задачу Эрдёша, в Siri встроят модель Gemini, а также свежее фото новой Ларочки.

Читать далее

Что говорят патенты о натриевых аккумуляторах

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели12K

Сравнение натриевых и литиевых аккумуляторов

Сейчас литиевые аккумуляторы используются почти везде, так как у них наибольшая плотность энергии по сравнению с доступными на практике альтернативами. Однако в настоящее время появились ниши, где масса и объём менее критичны, а ключевыми факторами становятся стоимость, безопасность и низкотемпературная работоспособность.

Натриевые аккумуляторы потенциально обладают этими преимуществами по сравнению с литиевыми.

Также натрий гораздо более распространенный и дешевый элемент, что тоже имеет немалое значение.

Уровень развития технологии

Вот, что мне удалось найти, относительно серийного выпуска натриевых аккумуляторов:

Читать далее

Создание максимально стабильной автоматизированной торговой системы: от бектеста до реального бота

Время на прочтение11 мин
Охват и читатели11K

Привет, хабр!

Сегодня мы разберём полный цикл создания торговой системы на Python: от бэктеста стратегии до её запуска в реальном времени на бирже BingX. Стратегия будет основа на индикаторах и математике, но они будут довольно неклассические и, думаю, многим это будет интересно.

Я опишу логику стратегии, покажу код и объясню каждую часть шаг за шагом. Это не просто копипаст - это полноценный гайд, чтобы вы могли адаптировать систему под себя. Мы используем библиотеки вроде Pandas, NumPy, Matplotlib и API бирж (Binance для данных, BingX для торгов).

Сейчас система находится в тесте около 2 недель. На данный момент профит составляет 5% к капиталу бота, но потеря капитала также возможна. Разберём полностью торговую систему и как провести тестирование.

Все файлы этой торговой системы, а также pine script выложил на github — можете посмотреть на код сами.

Читать далее

Оценка эффекта релиза, когда изменение затронуло не всех: diff-in-diff и синтетический контроль

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели8.4K

Когда релиз раскатан не на всех, классическая схема "до" и "после" начинает рушиться: метрика растет или падает одновременно из-за сезонности, внешнего фона и изменений в каналах, а не только из-за продукта. При этом AB теста может не быть, но данные по группам есть почти всегда: по гео, сегментам, кластерам, витринам.

В этой статье разбираю два практических подхода, которые позволяют оценить эффект релиза в таких условиях. Первый - diff-in-diff: сравниваем, насколько изменилась метрика в затронутой группе относительно контрольной, и тем самым вычитаем общий фон, который влияет на всех. Второй - синтетический контроль: строим базовую линию для затронутой группы как сумму метрик нескольких контрольных групп с весами, подобранными так, чтобы до релиза эта конструкция максимально повторяла историю затронутой группы.

Отдельный акцент на том, что обычно искажает выводы: заметный рост или падение разницы между группами до релиза, изменения состава, локальные акции или технические инциденты в контрольных группах, а также ситуации, когда базовая линия плохо повторяет период до релиза и тогда мы измеряем в основном ошибку модели, а не эффект релиза. В конце показываю, какие проверки стоит сделать, чтобы результат не держался на удачно выбранных границах периода или на одной контрольной группе.

Если в первой части мы работали с одной временной линией метрики, то здесь переходим к более распространенному случаю: несколько групп, частичная раскатка и необходимость отделить влияние релиза от общего шума.

Читать далее

11 шагов к продуктивной коммуникации с заказчиками в IT

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели8.5K

Одна из самых частых и болезненных проблем в IT-командах — коммуникация с внутренними заказчиками. Со стороны разработки заказчики выглядят как генераторы сырых ТЗ, вечных правок и нереалистичных сроков. Со стороны бизнеса IT-специалисты кажутся «черным ящиком», который работает медленно, негибко и допускает ошибки.

До аналитики я три года руководил клиентским сервисом, где сформировал методологию работы с клиентами. Этот опыт помог мне найти ключ к гармонии: работать с заказчиками как с клиентами. Разница в том, что клиента мы стремимся не потерять, а значит, ведем себя более ответственно и проактивно.

В этой статье я собрал 11 принципов, которые помогут выстроить такую коммуникацию.

Читать далее

Прогнозирование выручки через Retention, ARPU и LTV

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели8.1K

Для любых компаний, создающих различного рода продукты, важными составляющими является аналитика и оценка того, как продукт развивается, как влиять на его развитие, управлять и отслеживать положительные и негативные изменения.

Быстрота изменений UX/UI дизайна, функциональности, влияния запусков конкурентов, предоставляющих аналогичный продукт, внешние факторы – все это отражается на метриках удержания и сроке пользования продуктом, а значит и на тех деньгах, которые продукт зарабатывает по P&L.

Посмотреть инструкцию

Рынок лимонов и «размалеванные барышни»: текст вакансии как честное зеркало компании (датасет 146 000 вакансий)

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели11K

Пока соискателей учат быть «размалеванными барышнями», работодатели на «рынке лимонов» никому ничего не должны. Можно ли узнать, что ждет внутри, еще до получения оффера? Что, если я скажу: текст вакансии — это честная проекция «внутренней кухни» компании? Я уверена, так как проверила это на личном кейсе, и, вооружившись этим инструментом, проанализировала 146 000 вакансий. О том, почему и как это возможно — для тех, кто не считает неудачное трудоустройство «ценным опытом» — рассказываю ниже.

Читать далее

Архитектура через призму сложности

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели7.9K

Типовая ситуация: в проект приходят умные люди, менеджеры внедряют эффективные процессы, а проект все равно превращается в болото. Фичи разрабатываются месяцами, релизы откладываются, а на ретроспективах все жалуются на зависимости. При этом на схемах все выглядит красиво: микросервисы, CI/CD, облака. Что с этим миром не так?

Понятно, что «не так» может быть что угодно и как обычно it depends, но здесь и сейчас разберем одну из возможных причин, а именно ситуацию, при которой архитекторы и техлиды работают только с одним видом сложности – технологической. Рисуют квадратики, проводят стрелочки, выбирают базы данных. Реальность разработки при этом гораздо сложнее: в любом проекте одновременно живут три вида сложности, и они постоянно влияют друг на друга.

Читать далее

Как документировать разработку ERP-платформы. Часть 3

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели4.5K

В первой и второй частях мы рассматривали общий подход к бизнес-документации на нашем платформенном проекте в компании «Наука». А сейчас подобрались к главному – техническому проекту (ТП). Это – наш основной и наиболее распространенный документ для типовых задач в ERP-области.

Читать далее

OpenMedata в облаке: а как там у них DataGovernance? Обзор Collate: Часть 1

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели5K

За двадцать с лишним лет работы в области управления данными я видел всё: от Excel-таблиц вместо MDM до попыток построить Data Governance на коленке. Видел, как компании тратят миллионы на внедрение систем, которые никто не использует. И видел, как правильный инструмент меняет всё: от культуры работы с данными до скорости принятия решений.

Сегодня российский рынок Data Management активно развивается, растёт осознание важности управления данными. Но любопытство берёт своё: а что там, на западе? Какие подходы, какие фишки, какие боли они решают?

Читать далее

Как я перешёл из Яндекс Лавки в Авито: опыт аналитика данных

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели11K

Переход из одной большой компании в другую — обычная практика. Такие трансферы далеко не всегда связаны с проблемами на старом месте работы, иногда они просто помогают расширить или углубить экспертизу, разобраться в новых задачах и вырасти в заработке.

Хабр, привет! Меня зовут Раф, я работаю аналитиком ценообразования в Авито (а раньше — в Яндекс Лавке), преподаю машинное обучение в Центральном университете, окончил факультет компьютерных наук в НИУ ВШЭ и прошёл курс «Специалист по Data Science» в Яндекс Практикуме. В этом материале расскажу, как переходил из Лавки в Авито и к чему стоит быть готовым аналитикам, которые захотят повторить мой опыт.

Читать далее

Открываем ПВЗ с умом: интеграция Геоинтеллекта и DataLens

Уровень сложностиСредний
Время на прочтение3 мин
Охват и читатели7.2K

Мы в Геоинтеллекте любим геоданные и геоаналитику. Часто миксуем технологии. Вот, например, мы попробовали генерировать графики BI системы DataLens внутри платформы для Геоаналитики “Геоинтеллект”. Что из этого вышло, посмотрим на реальном кейсе, которая выполняла наша сотрудница. 

Задача

Предположим вы, как аналитик, хотите понять, где выгоднее всего искать помещение для открытия пункта выдачи заказов маркетплейса. Для этого нужно обратить внимание на ряд факторов, которые влияют на выбор:

Читать далее

Как документировать разработку ERP-платформы. Часть 2

Уровень сложностиПростой
Время на прочтение36 мин
Охват и читатели5.9K

В первой части статьи мы рассматривали общий подход к документации платформенного проекта компании NAUKA. А сейчас давайте погрузимся в детали и «начинку» конкретных документов: ADR, Vision и SRS

Читать далее

Ближайшие события

Почему ваш бектест врёт на 50%, и при чём тут выбор между Python и C++

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели9.3K

Sharpe 2.1 в pandas-бектесте, через три месяца реальной торговли упал до 0.3

Pandas-бектесты систематически завышают доходность на 30-70%. Одна строчка с shift(-1) и вы уже используете завтрашние данные для сегодняшних решений. Плюс survivor bias, плюс нереалистичные fills.

В статье разбираю источники look-ahead bias, сравниваю vectorized и event-driven подходы на данных MOEX (SBER, GAZP, LKOH за 2020-2024), мои замеры latency для Tinkoff API, и рассуждения о том, когда Python уже не вывозит и пора думать про C++

Читать далее

Когда данные превращаются в пейзажи

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели7.6K

Есть такое направление в визуализации данных — называется Дата‑арт. То есть, когда данные пытаются визуализировать творчески, не с целью сделать их понятными, а с целью передать эмоции или привлечь внимание к эстетической красоте проекта на основе данных. 

И вот, изучая и классифицируя проекты в этой коллекции (их там несколько сотен), я обнаружила, что в дата‑арт направлении есть набор проектов, которые явно вдохновлены пейзажами — и я выделила их в отдельную группу. 

Читать далее

С помощью Python реабилитировал алкогольную романтику у Довлатова

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.4K

Я проанализировал эпизоды с упоминанием алкоголя в полном корпусе произведений Довлатова и посмотрел, как и для чего он использует алкоголь в рассказах.

Читать далее

Как документировать разработку ERP-платформы. Часть 1

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели7.4K

Как документировать разработку ERP-платформы?

Меня зовут Александр Курашов, и я работаю бизнес-аналитиком и архитектором в компании NAUKA. Один из наших знаковых проектов – разработка Платформы, объединяющей различные продукты компании в единую экосистему решений.

Эта статья посвящена процессу бизнес-документирования платформенной разработки, составу аналитических артефактов и применяемому для этого инструментарию.

Читать далее

Топ инструментов ИИ для системного аналитика

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели13K

Недавно я участвовал в круглом столе на тему «аналитики против искусственного интеллекта». Это обсуждение вдохновило меня на более предметный разговор о том, почему нейронные сети — это не противник, а полезный инструмент, который реально экономит время. Меня зовут Владимир Бурмистров, я главный системный аналитик в IT-холдинге Т1. В отрасли я уже 18 лет — застал и времена адаптации под Internet Explorer 6, и приход нейросетей. И я могу уверенно сказать: благодаря нейросетям я ускоряю свою работу примерно на 30%. Как именно? Давайте разбираться по порядку.

Читать далее

Установка Matomo Tag Manager на своем сервере LAMP + расчет нагрузки

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели5.5K

В прошлой статье я закончил обзор open source решения для аналитики и, что важно для нас, решения для менеджера тегов - Matomo Tag Manager. В этой статье приступаем к разбору по косточкам самого решения. И начинаем с установки его на сервер. А я продолжаю выступать своего рода евангелистом Matomo Tag Manager в рунете, где он незаслуженно, по моему мнению, обойден стороной.

Читать далее

Copilot в Power BI: 6 сценариев использования

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели6.5K

Всем привет! Я — Ольга Матушевич, преподаватель онлайн-магистратуры «Дата-аналитика для бизнеса», а в прошлом наставница на курсе «Аналитик данных» в Яндекс Практикуме. И сегодня я расскажу, чем Copilot может помочь аналитику при создании дашбордов в Power BI: как работающему в компании, только приступившей к использованию BI-системы, так и обладателю обширного legacy.

Читать далее