Обновить
256K+

Исследования и прогнозы в IT *

Исследования, тренды и прогнозы в IT-сфере

305,71
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Нейронки опрокинули гипотезы, которым было по 50–90 лет. И тут есть нюанс

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели6.7K

Любая гипотеза жива ровно до тех пор, пока о ней не спросят языковую модель в правильном настроении. Звучит как шутка. Но за последние недели эта шутка перестала быть шуткой трижды — и каждый раз по-разному эффектно.

1) Сначала чувак из Anthropic между таймами финала ЧМ опроверг гипотезу, которой было 87 лет — прямо в X. 2) Потом модель OpenAI закрыла проблему Эрдёша про расстояния на плоскости, 80 лет никто не мог. 3) А следом — доказательство полувековой гипотезы о двойном покрытии циклами в графах, добытое за час силами 64 параллельных субагентов. Если это совпадение, то очень организованное.

Короче, собираю всё в один текст — с разбором что вообще происходило, как выглядели твиты и доказательства, и почему у истории тревожный постскриптум - ту самую модель OpenAI, которая размотала Эрдёша, позже пришлось приостанавливать, потому что она слишком настойчиво вылезала из песочницы.

Читать далее

Новости

Как предсказывать долгосрочный эффект A/B теста раньше: прокси-метрики и ловушка регрессии

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели5.2K

В продуктовых экспериментах нередко возникает следующая ситуация, когад бизнесу важна долгосрочная или малочувствительная метрика, но оценить эффект на такие метрики в рамках короткого A/B-теста сложно.

Как корректно находить прокси-метрики, почему наивная регрессия может обмануть и как отделить настоящую связь экспериментальных эффектов от статистического шума?

Читать далее

DDoS-атаки 2026: эволюция угрозы. Кто находится в зоне риска?

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели6.1K

Совместное исследование DDoS-Guard и FirstVDS

Раньше считалось, что DDoS-атаки направлены на «крупную рыбу» — корпорации, госкомпании, банки. Но реальность 2026 года говорит о другом: жертвой злоумышленников может стать кто угодно.

За три года число атак выросло с 2,2 до 2,5 млн. Их распределённость увеличилась на 480%. DDoS-атаки стали массовым, доступным и, что самое опасное, автоматизированным инструментом. 

Киберпреступникам больше не нужно тратить недели на подготовку, чтобы атаковать выбранный объект — теперь они используют суперботнеты и сложные алгоритмы, которые автоматически находят уязвимые для удара места за считанные минуты.

Вместе с DDoS-Guard мы решили разобраться, а есть ли кто-то, кто оказывается в красной зоне риска чаще других? Изменился ли характер атак за последние несколько лет? Для этого мы проанализировали данные клиентов, глобальную статистику атак и опросы владельцев бизнеса. В итоге получили портрет идеальной жертвы. 

Дальше рассказываем, как мы это делали и что же удалось выяснить.

Читать далее

Внедрять нельзя игнорировать: дилемма предиктивной диагностики на производстве

Уровень сложностиПростой
Время на прочтение15 мин
Охват и читатели6.8K

Развитие информационных технологий стало катализатором четвёртой промышленной революции. По оценке Клауса Шваба, основателя Всемирного экономического форума в Давосе, её отличительная черта – экспоненциальный, а не линейный темп развития. Тем не менее системы предиктивной диагностики, являющиеся частью этой концепции, пока не получили широкого распространения на промышленных предприятиях. Возникает вопрос: что препятствует их внедрению и почему ожидания от их использования часто не оправдываются? В статье обобщён опыт внедрения таких систем на предприятиях РФ – материал будет полезен техническим руководителям промышленных компаний.

Читать далее

Как провести 35 глубинных интервью с ИТ-директорами, когда вас никто не знает

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели6.3K

В прошлой статье я обещала рассказать про механику маркетингового исследования отдельно. Рассказываю: девять месяцев, 35+ глубинных интервью с ИТ-руководителями, один маркетолог (он же я:), у которого есть и другие задачи, и бюджет, стремящийся к нулю.

Читать далее

Тренды Telegram-ботов и Mini Apps: звезды, ИИ и чат-рулетки

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели8.1K

Телеграм покажет число юзеров бота, если им пользуются больше 10 тысяч человек в месяц.

Я собрал самую большую базу таких ботов.

В статье расскажу о трендах июля 2026 в экосистеме Telegram.

Что же происходило?

Цветочные горшки для ИИшки

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели11K

По результатам статьи «Prompt injection — лучше один раз увидеть», у меня остались не только запущенные размышления и дальнейшие эксперименты, но и бросающаяся в глаза подпись «Не вѣръ чужимъ рѣчамъ, а вѣръ своимъ очамъ (СЛОВАРЬ АКАДЕМІИ РОССІЙСКОЙ, 1806)», которую некоторые ИИ-сервисы теперь пишут мне при каждом ответе. И сегодня, читая очередные рассказы о том, как какая-то ИИшка строго настрого отказывалась отвечать на не те вопросы, но была уболтана, я снова вспомнил о том, что «это не баг, а фича». А раз фича, то давайте использовать её во благо себе. Хотя бы попытаемся.

Читать далее

Квадриллион параметров (1Q) для LLM. Когда нам ждать такую модель?

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели13K

Согласно закону заголовков Беттериджа, который утверждает: «Если заголовок заканчивается вопросительным знаком, на него можно ответить „нет“», ответом на вопрос в заголовке будет „никогда“. И я попытаюсь вас в этом убедить.

Читать далее

От PRD к evals: что мы нашли в вакансиях AI-продактов из 100+ компаний

Время на прочтение9 мин
Охват и читатели8.5K

Как в обычном бизнесе устаканивается роль AI-native продакта — от Walmart и Disney до Citi, Spotify и Optum

Михаил Карпов · основатель ProductCamp, ex-CPO Skyeng, ex-VP Multimedia VK

Expedia ждёт, что Principal PM сможет собрать работающий прототип через API и простой код. Citi требует понимания evaluation frameworks. Spotify пишет, что продуктовая работа смещается от проектирования экранов к оркестрации агентов.

Это отдельные экзотические вакансии — или уже устоявшийся профиль продуктовой роли?

Чтобы проверить это, мы проанализировали вакансии продуктовых менеджеров более чем в 100 компаниях из retail, travel, media, finance, healthcare и других индустрий — составили таблицу и карту навыков того, что теперь компании ждут от AI-продакта

Читать далее

BotHub за первое полугодие 2026: 72,4 млн ₽ выручки и переход к своим AI-продуктам

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели6.6K

Для нас первая половина 2026 года стала не просто периодом роста, а моментом, когда бизнес вышел на устойчивую прибыль, а продуктовая стратегия сместилась от агрегатора моделей к собственным AI-сервисам.

Мы — BotHub, платформа на базе больших языковых моделей (LLM). Это не просто прямой доступ к нейросетям: помимо работы с моделями, у нас есть собственный набор инструментов, которые закрывают задачи, недоступные в обычных чатах, — анализ ссылок и видео с YouTube, суммаризация длинных диалогов, правовой поиск по системе «Гарант», поиск научных статей, генерация изображений и создание документов. При этом всё доступно в одном месте: выбор из более чем 240 моделей от 49 вендоров через единый интерфейс и без VPN. Мы работаем не по подписке, а по пакетной модели — вы покупаете пакет и расходуете его по мере использования, а когда он заканчивается, берёте новый. Внутренняя валюта (капсы) при этом не сгорает со временем. BotHub работает на рынке уже более трёх лет.

Читать далее

Как мы организовали тест-сессию в продукте: пилот формата

Уровень сложностиСредний
Время на прочтение3 мин
Охват и читатели6.9K

Я Лиза, UX-исследователь в Экстерне. Не так давно я организовывала тест-сессию в нашем продукте. В статье расскажу, что мы делали в рамках пилота такого формата исследования, с какими проблемами столкнулись и какие преимущества выделили.

Дизайнеры в Контуре уже пытаются возродить формат тест-сессий для исследований. Поэтому в нашем b2b-продукте мы тоже решили попробовать впервые провести его в этом году.

Опыт получился интересным — мы отловили проблемы интерфейса, как и хотели. Но еще больше поняли про сам формат исследования.

Тест-сессии обычно описывают как быстрый способ проверить интерфейс с коллегами — без рекрута пользователей и полноценного цикла исследования. Но в итоге нам показалось, что всё немного сложнее.

Читать далее

Бенчмарки врут? Бизнес мигрирует на открытые веса, а FDA и ФЗ заставляют уходить на свой инференс: ML-дайджест

Время на прочтение19 мин
Охват и читатели14K

Если водить спорткар, то только на идеальном глянцевом треке. Тогда он всегда будет показывать рекордное время. Я думаю, примерно так топ-менеджмент ИИ-компаний и описывает работу своих моделей инвесторам. Проблема в том, что бизнес-процессы — это дорога с ямами. 

Долгое время индустрия закрывала глаза на то, как именно LLM бьют рекорды на лидербордах. Но эпоха слепого доверия корпоративных данных чужим «черным ящикам» по ту сторону API подходит к концу. Или нет? 

В новом дайджесте обсуждаем масштабный переезд enterprise-сектора на открытые веса, суверенное железо и жесткую валидацию моделей на грязном реальном трафике.

Читать далее

Кладбище умных устройств: кто умер, кто еще поживет и что будет дальше

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели6.1K

В начале 2026 Apple тихо похоронила то, что, казалось, наконец станет успехом среди AR/XR-устройств - свой Vision Pro. За полтора года их продали примерно 600 тысяч штук, новый глава компании вычеркнул из планов обе следующие версии, а первые очки, которые Apple реально выпустит после, будут вообще без экрана.

Почему же люди, которые лучше всех в мире умеют делать железо, раз за разом туда идут, несмотря на все прошлые провалы? Что обрекает умные устройства с экранами и очки на провал раз за разом? И какими будут ИИ девайсы будущего?

Читать далее

Ближайшие события

Промпт инъекция дистиллятом

Время на прочтение4 мин
Охват и читатели12K

Сегодня я делал то, что должен делать автор после публикации статьи — отвечал на комментарии и рефрешил статсы. В процессе последнего, я обратил внимание на то, что последней опубликованной статьёй у меня были результаты эксперимента «Prompt injection — лучше один раз увидеть», а предпоследней — фантастический (но это не точно) рассказ «Кофе на дистиллированной воде».

Это соседство навело меня на футурологическую мысль, которая написана в названии данной статьи и которой я хотел бы поделиться с пиарщиками, безопасниками, писателями худлита и параноиками. Впрочем, даже если вы не относите себя ни к одной из этих категорий, то всё равно можете почитать.

Читать далее

Рекордная активность DDoS-атак: итоги первого полугодия 2026 года

Время на прочтение9 мин
Охват и читатели13K

Сегодня мы наблюдаем тенденцию к ежегодному непрерывному росту количества и мощности DDoS-атак. Это негативно сказывается на доступности как публичных, так и корпоративных сервисов. Последствия для компаний могут быть разными — от финансовых потерь и утечек данных до репутационного ущерба.

Более 36 000 клиентов Selectel генерируют сетевой трафик объемом свыше 500 Гбит/с. Уникальные данные, которые мы получаем в ходе анализа атак на наши сервисы и проекты клиентов, позволяют оценить ландшафт угроз для облачной инфраструктуры.

Мы в Selectel собрали аналитический отчет о DDoS-атаках, отраженных с помощью бесплатного сервиса защиты за первое полугодие 2026. Данные позволяют оценить динамику и основные характеристики DDoS в разрезе облачной инфраструктуры, скорректировать настройки своих IT-систем для защиты.

Читать далее

Prompt injection — лучше один раз увидеть

Время на прочтение9 мин
Охват и читатели20K

В новостях часто появляются рассказы о том, что какие‑то злодеи уговорили чью‑то ИИшку на то, чтобы она потратила деньги, удалила файлы или поставила более высокую оценку. При этом используются слова «prompt injection», “атака” и пр., создающие впечатление, что это какое‑то сложное искусство, требующее особых знаний. В реальности же prompt injection это не то что не сложно, но и вообще не атака. Да, везде в интернете пишут, что это атака, но… Короче, проще один раз показать, чем рассказ на десять тысяч символов набивать.

Читать далее

Самое подробное исследование mental-health стартапов: мы разобрали 542 мёртвые компании и нашли семь закономерностей

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели10K

В 2021 году Pear Therapeutics стоила $1,6 млрд и продавала цифровые лекарства по рецепту с одобрением FDA. В 2023-м компания обанкротилась, а её активы ушли с аукциона за $6 млн.

Прежде чем вкладывать годы в свой продукт для ментального здоровья, я захотел понять, почему в этой нише столько трупов. Мы собрали 542 организации за 2000–2026 годы, разметили каждую по 18 полям и посчитали исходы: 45% поглощений, 37% смертей, 18% серой зоны.

Что видно в цифрах:

— смертность там, где платит сам пользователь, 53%, где платит институт — 21%; — B2C умирает в 2,2 раза чаще B2B; — среди приложений с разовой покупкой мертвы 85%; — среди поднявших $100M+ мертвы 25%; — опубликованные клинические данные дают 10 пунктов к выживаемости; — продукты, которые обещают заменить терапевта, умирают в 50% случаев против 9% у тех, где лечит живой специалист; — медицинский сооснователь исход не двигает: 47% поглощений против 47%.

В статье семь закономерностей, у каждой дробь и знаменатель, четыре кейса крупным планом и честный раздел про ограничения выборки. Отчёт собирается скриптом из датасета, так что каждую дробь можно пересчитать.

Читать далее

Когда человек перестаёт быть центром: капитализм, ИИ и четыре процесса будущего

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели9.6K

Я живу в Таиланде и вижу, как страна стареет быстрее, чем успевает придумать, как с этим жить. Сначала мне казалось, что это особенность местной демографии. Потом я начал думать, что будет с капитализмом, когда людей станет меньше, а ИИ сможет заменить всё большую часть их работы.
Никто не собирается специально уничтожать человека, он просто может оказаться больше не главным. Об этом и статья.

Читать далее

Kimi K3 на PAC1 и ECOM1: результаты 204 задач и разбор отказов

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели8.1K

27 июля Moonshot AI открыла веса Kimi K3 и опубликовала результаты модели на coding- и агентных бенчмарках. Мы проверили, как эти показатели переносятся на рабочие операции с файлами, счетами, корзинами, платежами, возвратами и отчётами.

Kimi K3 прошла 204 задачи PAC1 и ECOM1 и набрала 61/104 и 44,75/100. В статье разбираются публичные трассы успешных задач и повторяющиеся отказы: нарушение точной схемы, частично выполненные транзакции, ошибки в длинных таблицах, неоптимальные маршруты и пропущенные проверки доверия. Все запуски и трассы доступны для проверки.

Смотреть обзор

Почему идеальная LLM всё равно не сделает агентные системы предсказуемыми

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели9.4K

Представьте LLM, которая никогда не галлюцинирует, никогда не ошибается. На один и тот же запрос всегда выдаёт один и тот же ответ — символ в символ. Можно ли тогда наконец относиться к LLM‑системе как к обычному коду — как к фиксированному, предсказуемому алгоритму?

Скорее нет, чем да.

И дело тут не в качестве модели. Предсказуемость отдельного компонента не гарантирует предсказуемость системы, собранной из таких компонентов. Даже если завтра появится LLM с нулевым уровнем галлюцинаций, многоагентный пайплайн, построенный на её основе, всё равно может вести себя непредсказуемо. Просто источник непредсказуемости смещается — с вероятностной природы самой модели на архитектуру взаимодействия агентов. И я хочу вам это доказать на простом примере.

По моим наблюдениям последние года два‑три вендоры потратили на то, чтобы сделать LLM предсказуемее. Тут вам и RAG и fine‑tuning, верификация выходов, низкая температура, жёсткие промпт‑шаблоны. Более того, в узких доменах это работает — уровень галлюцинаций становится совсем незначимым.

Именно это позволило перейти от единичных запросов к многоагентным архитектурам. Вместо одной универсальной модели, мега чат‑бота теперь у нас цепочка специализированных агентов. Каждый из них решает свою маленькую подзадачу и передаёт результат дальше — все в лучших традициях дедушки Форда.

Логика на первый взгляд простая: если каждое звено надёжно, надёжна и вся цепочка. Но, к сожалению, это не всегда так. И на простейшем демонстрационном проете я попытаюсь показать суть явления.

Читать далее
1
23 ...