Обновить

Все потоки

Сначала показывать
Порог рейтинга

AI-аналитик, MCP-сервер и GenAI-трейсы: что появилось в Proto Observability Platform 203

Главной темой релиза Proto Observability Platform 203 стало расширение инструментов для машинного анализа телеметрии и наблюдаемости LLM-приложений: к существующим ИИ-расследованиям добавились AI-аналитик для работы с данными телеметрии на обычном языке, MCP-сервер для подключения ИИ-агентов и представление GenAI-трейсов для анализа работы внешних LLM-приложений.

AI-аналитик работает с метриками, логами, трейсами, инцидентами и объектами ресурсно-сервисной модели. В ответе на запросы оператора он показывает затронутые сервисы, возможные причины проблем и ссылки на найденные объекты платформы, сам проводит анализ ключевых данных производительности приложений и инфраструктуры. Для анализа данных в платформе теперь не требуется знание PromQL, LogsQL или топологии приложений - все это теперь можно запрашивать в режиме чата на обычном языке.

Встроенный MCP-сервер предоставляет ИИ-агентам инструменты для работы с данными платформы по стандарту Model Context Protocol. Через него доступны метрики, логи, события, ресурсы, трейсы, сервисы, алерты и инциденты, ошибки и другие ключевые данные платформы.

Новое представление GenAI-трейсов показывает выполнение LLM-приложения как последовательность действий. На одном экране видны сообщения по ролям, обращения к модели и инструментам, ошибки вызовов и длительность отдельных шагов.

Полное описание этих и других новых возможностей платформы доступно в заметках к релизу.

Теги:
Всего голосов 2: ↑2 и ↓0+4
Комментарии0

12 уроков по системному администрированию: от nftables до RAID

Пока всё работает, инфраструктура редко требует пристального внимания. Настоящая проверка начинается в момент сбоя: L2-петля кладёт сеть, изменение firewall грозит потерей SSH‑доступа, место на диске заканчивается не вовремя, а по логам сложно понять, где именно возникла проблема.

В такой ситуации ближайшая задача — быстро локализовать источник сбоя, безопасно внести изменения и вернуть систему в рабочее состояние. Следующий уровень — выстроить эксплуатацию так, чтобы инфраструктура оставалась предсказуемой при нагрузке, отказах и изменениях.

Собрали бесплатные открытые уроки, на которых можно точечно разобрать эти темы с практикующими специалистами, задать вопросы и заодно посмотреть, как устроено обучение в OTUS.

Linux: безопасность, сервисы и хранение

  • 20 августа, 20:00. «Средства защиты в ядре Linux». Записаться

  • 26 августа, 19:00. «Nftables без потери SSH: безопасно настраиваем firewall на удаленном сервере». Записаться

  • 3 сентября, 19:00. «Первый веб‑сервер на Linux: Nginx, Apache и проверка доступности». Записаться

  • 8 сентября, 20:00. «LVM без простоя: расширение тома, перенос данных и аварийный откат через snapshot». Записаться

  • 17 сентября, 20:00. «Где Linux хранит настройки и логи: разбираем файловую структуру на практике». Записаться

  • 21 сентября, 20:00. «Типовые задачи с RAID‑массивами: создание, эксплуатация, перенос данных и восстановление». Записаться

Сети

  • 24 августа, 20:00. «Защита от петель L2: что выбрать, если STP уже не устраивает». Записаться

Windows‑инфраструктура

  • 7 сентября, 20:00. «Linux для Windows администратора за 60 минут». Записаться

  • 22 сентября, 20:00. «Топ GPO, которые помогут тебе». Записаться

Автоматизация, диагностика и высокая доступность

  • 10 сентября, 20:00. «Настройка GitLab Runners». Записаться

  • 23 сентября, 20:00. «eBPF: рентгеновское зрение для production». Записаться

  • 23 сентября, 20:00. «Узнайте, как использовать Patroni для управления высокодоступными кластерами PostgreSQL». Записаться

ЧТО ПОЧИТАТЬ ПО ТЕМЕ:

  • «Прощай, Fail2Ban: усиливаем защиту Netbird и Caddy с CrowdSec» — практический разбор защиты сервера: работа с логами, блокировка нежелательного трафика и настройка nftables. Читать на Хабре

  • «Пять проблем Bash, которые ломают скрипты в самый неудачный момент» — о типичных ошибках в Bash‑скриптах, которые могут проявиться уже при эксплуатации и автоматизации системных задач. Читать на Хабре

  • «Ищем петли и шторма в L2 сети» — как диагностировать L2-петли, broadcast‑штормы и MAC flapping, найти проблемный порт и восстановить работу сети. Читать на Хабре

Больше открытых уроков по инфраструктуре и смежным направлениям собрали в дайджесте.

Теги:
Всего голосов 4: ↑3 и ↓1+5
Комментарии0

🤖Онлайн-эфир. AI-рынок — 2026: от моделей к продуктам

Сделать хорошую AI-модель — еще не значит создать продукт, который действительно будет работать в бизнесе.

27 августа в 18:00 поговорим о том, что происходит на рынке корпоративного AI и как компании переходят от экспериментов с технологией к работающим решениям.

Спикер — Анна Коковина, менеджер продукта Yandex AI Studio.

В программе: • как меняется российский AI-рынок и в каких отраслях технологии внедряются активнее всего; • какие тренды определяют развитие AI-продуктов в 2026 году; • чем отличаются требования к продукту у заказчиков из малого, среднего и крупного бизнеса; • какие возможности Yandex AI Studio предоставляет для создания и внедрения AI-решений.

📅 27 августа, 18:00

🔗 Регистрация:

Телеграм: https://t.me/mipt_events_bot?start=dl-1787133719f64538446761

ВКонтакте: https://vk.ru/app6379730_-224205661#l=36&auto=1

Теги:
Всего голосов 1: ↑1 и ↓0+3
Комментарии0

Модераторы хабра часто пишут в комментариях, что у них есть алгоритмы определения ИИ слопа. Эти алгоритмы прекрасно работают, ИИ слоп удаляется каждый день пачками.

Посмотрите на эту статью: https://habr.com/ru/articles/1068100/

Приведу короткий открывок из статьи:
Но я потратил годы, разбираясь именно в кодеках — не в протоколах, не в UI, а в том, что происходит с кадром между «экран изменился» и «байты улетели в сеть».

И ведь там вся статья такая.

У кого-нибудь из вас есть сомнения, что это ИИ слоп?

После предыдущего моего поста о ИИ слопе в комментариях на хабре, мне включили возможность жаловаться на контент.

Штош, я отправил жалобу на статью 9 августа. Прошло 10 дней.

Может модераторам просто не пришло уведомление?
Может они решили проигнорировать уведомление?
Может они нечаяно его пропустили?

Или у хабра нет ресурсов и желания для борьбы с ИИ слопом?
Или война с ИИ слопом уже проиграна?

Теги:
Всего голосов 19: ↑17 и ↓2+21
Комментарии3

Миллионы обращений, контент для ИИ и зарплата-загадка: как московские власти ищут шеф-редактора базы знаний

ГКУ «Инфогород» (работает с цифровыми проектами ДИТ Москвы) ищет специалиста в контакт-центр. Здесь не нужно механически наполнять базу знаний, это методологическая функция с обучением, координацией, настройкой процессов и работой с контентом для людей и ИИ. Звучит интересно, но есть подводные камни.

Немного контекста

В России менеджмент знаний (МЗ) как корпоративное направление начал развиваться на рубеже 90-х – нулевых. Первый ГОСТ появился в 2011 году, а стандарт с требованиями к полноценной системе – в 2021-м.

Наш рынок всё ещё заметно отстаёт от Европы и США: и по числу ИТ-решений, и по количеству вакансий – их в 8-12 раз меньше, и по зрелости бизнеса – МЗ как отдельная функция есть у единиц. Но ИИ меняет этот тренд: спрос на проекты растёт, вакансий становится больше, бизнес начинает понимать, что нужно готовить знания для ИИ.

Я больше 15 лет внедряю МЗ в российских компаниях с командой Minerva Result. По вакансиям на hh и других сервисах вижу, что далеко не все осознают, зачем им база знаний и как с ней работать. Чтобы подсветить спорные места и помочь тем, кто хочет развиваться в этой области, решил запустить разборы. Буду рад, если поделитесь обратной связью в комментариях и расскажете, как управляете знаниями в контексте внедрения ИИ.

Ну а теперь к вакансии ГКУ «Инфогород».

Плюсы

Ежемесячно контакт центр обрабатывает больше 5 млн обращений. Любая ошибка стоит дорого и судя по вакансии (а она, в отличие от многих других, достаточно зрелая) работодатель это понимает: здесь есть контроль качества, понятности и актуальности контента, обучение авторов и сотрудников, мониторинг системы, работа с процессами.

Отдельный плюс – акцент на адаптации нормативных документов и подготовке материалов для ИИ. Компания смотрит дальше привычного «написать инструкцию в Word», а для кандидата это уже отличная возможность получить практический опыт и усилить резюме.

Здесь хорошо описано место роли в процессах: специалист становится связующим звеном между редакторами, экспертами и продуктовыми командами. А ещё есть бонусы в виде статуса аккредитованной ИТ-компании, обучения и гибридного формата после ИС.

То, что вызывает вопросы

Границы роли. В названии уже есть координатор центра БЗ и шеф-редактор. После прочтения ещё появляются методолог, тренер, редактор и немного контент-аналитик. Такое размывание не приводит ни к чему хорошему: человек распыляется между задачами, контент устаревает, процессы ломаются, инструмент теряет актуальность, команда возвращается к привычным системам. Лучше чётко определить на старте, чем будет заниматься специалист, какие у него будут метрики и KPI.

Дальше – требования заметно скромнее обязанностей. Ищут человека с высшим образованием, опытом от 2-х лет в координации, административной поддержке, методологии или редакции. Ожидают полного цикла работы с контентом, методологического сопровождения, консультирования и обучения сотрудников. Найти такого всемогутора может быть непросто. Опять же, лучше разбить задачи по ключевым блокам и выбрать приоритетные. Под них искать специалиста.

Ещё одно слабое место – зарплата-загадка. Работодатель обещает «рыночную», но рынок, как известно, у каждого свой. Человек с опытом 3-6 лет может пролистнуть вакансию. Лучше указать вилку или хотя бы написать, вокруг чего конкретно будет строиться зарплата.

Вывод и рекомендации

Вакансия может подойти редактору, методологу или специалисту, который хочет попробовать себя в разных ролях, получить опыт подготовки контента для ИИ, поработать в крупном проекте с реальной потребностью в МЗ.

Что стоит спросить:

  • есть ли цель, метрики и KPI? что будет считаться успешным результатом?

  • какая зона ответственности? можно влиять на методологию?

  • на какой платформе нужно работать?

  • из кого состоит команда? можно привлекать коллег?

  • можно использовать результаты в портфолио?

Больше разборов вакансий – в моём тг-канале. Подпишитесь, чтобы не пропустить новые посты.

Теги:
Всего голосов 4: ↑2 и ↓2+2
Комментарии0

👌 Подключить дополнительные инструменты к VK Data Platform стало проще.

Теперь вы можете добавить к уже настроенному контуру собственные СУБД, вычислительные движки, сервисы обработки данных и ML/LLMOps-инструменты. Пересобирать для этого базовую архитектуру не нужно.

🪄 После подключения новый сервис сразу работает по общим правилам платформы: для него действуют единые настройки доступов, мониторинга, логирования, аудита, отказоустойчивости и масштабирования. Интеграция занимает несколько часов.

😎 Кому это пригодится?

В первую очередь, системным интеграторам и крупным компаниям со сложным или специфичным data-стеком. Обновление позволяет подключать нужные инструменты без создания для каждого из них отдельного контура управления и дополнительной нагрузки на ИТ- и data-команды.

Подробности 👉 по ссылке.

🔗 Мы в МАХ

Теги:
Всего голосов 3: ↑3 и ↓0+5
Комментарии0

Рынок подготовки к ЕГЭ — самая монетизируемая точка входа, но с высочайшим риском копирования. Чтобы выжить при наличие десятка аналогичных моделей продукт должен строиться не на объяснении решений, а на формировании навыков и интеграции в жизнь пользователя.

Проект: Концепция ИИ-репетитора для подготовки к ЕГЭ (продуктовая стратегия)

1. Методология: переход от объяснения к диагностике и тренировке Конкуренты предложат понятный язык объяснений. Этого недостаточно и это легко скопировать. Мой подход:

  • Диагностика невидимых пробелов. Модель анализирует ошибку не только в финальном ответе, но и в промежуточных шагах. Отсутствие навыка сложения алгебраических дробей, например, автоматически блокирует прогресс в целом классе текстовых задач.

  • Генерация внепрограммных тренажеров. ИИ создает задания, которых нет в банке ФИПИ, точечно закрывая выявленный дефицит. Например, генерирует 50 вариаций задач на проценты с усложняющимся контекстом, пока скорость решения не превысит пороговое значение.

  • Неформальная подача учебного материала. Пользователь может сам выбрать одного из предложенных персонажей с индивидуальной манерой преподавания, в качестве наставника.

2. Продукт: экосистема вместо отдельного приложения Главная ошибка — делать ИИ-репетитора отдельным сервисом. Через два года он станет лишь одной из функций личных ассистентов и исчезнет как самостоятельный продукт. Наша стратегия:

  • Фоновый режим (Background Tutoring). Репетитор работает постоянно в качестве ИИ-помощника. Пользователь может обсуждать с ним мемы, выбор кроссовок или новости, но модель всегда держит в контексте цель — подготовку к ЕГЭ. Она органично вплетает темы в беседу («Кстати, этот мем про экспоненту отлично иллюстрирует задачу №16»).

  • Непрерывная подготовка (Non-stop prep). Система напоминает о занятиях, мотивирует и связывает экзаменационные задачи с бытовыми вопросами пользователя.

  • Расширяемость (Extensibility): Архитектура изначально закладывается под концепцию «Личного когнитивного контура» — после ЕГЭ продукт бесшовно трансформируется в ИИ-помощника для вуза (написание курсовых, поиск литературы) и рабочего места.

3. UX и Геймификация: борьба с главной проблемой — прокрастинацией Ученики проваливают экзамен не из-за глупости, а из-за неумения организовать себя.

  • Жесткое планирование. ИИ сам составляет расписание, ставит дедлайны и требует подтверждения выполнения. Пропуск дня без уважительной причины запускает цепочку эскалации: уведомление пользователю → куратору.

  • Кураторский контур. Ежедневные отчеты (автоматизированные дашборды: время фокуса, % выполненных заданий, динамика ошибок) отправляются родителю, школьному учителю или другу-напарнику.

  • Двуличный ИИ (Multi-agent tutoring). Вместо одного скучного помощника — система конфликтующих персонажей, которую я уже реализовывал в прототипах:

    • «Профессор»: строгий, объясняет через фундаментальную науку, готовит к вузовским стандартам, использует сарказм.

    • «Студент»: объясняет «на пальцах», шутит, снижает тревожность. Они спорят друг с другом, вовлекая ученика в роль арбитра. Юмор и контролируемый конфликт повышают вовлеченность 

Теги:
Всего голосов 4: ↑2 и ↓2+2
Комментарии1

QA-эксперт Авито о том, почему вход в IT через тестирование больше не работает

Всем привет! Гостья нового выпуска AviTalk — Соня Каребина, QA-эксперт Центра экспертизы обеспечения качества в Авито. До IT у неё были инженер-нефтяник и администратор фотостудии — то есть путь в тестирование получился совсем не прямым. Ведущий выпуска — Виктор Раев, руководитель разработки юнита Services Base.

Говорим о том, почему в тестировании нет универсального ответа «релизить или не релизить» и как QA оценивает риски для пользователей и бизнеса. Разбираемся, почему умение договариваться для тестировщика важно не меньше технической экспертизы, и каким становится процесс, когда человек и AI работают в связке. А ещё — про волонтёрство, эмоциональное выгорание, вязание, двести комнатных растений, мечту о Марсе и принцип, который в своё время помог Соне сменить профессию.

Смотреть выпуск:

🔵 VK Видео
📺 YouTube
📌 RuTube

AviTalk — шоу толковых людей. Приглашённые гости — сотрудники Авито из разных дирекций и команд, которые делятся экспертизой и рассказывают о своём профессиональном пути.

Теги:
Всего голосов 30: ↑29 и ↓1+30
Комментарии0

Можно ли быстро актуализировать старые PHPUnit-тесты под новые версии пакета?

Краткий ответ: да, но есть нюансы.

На Хабре незаслуженно мало статей про инструмент Rector, и даже в них совсем вскользь упоминается, что у инструмента есть отдельный функционал для актуализации PHPUnit-тестов, написанных под разные версии пакета. Причем если раньше, этот функционал был в виде отдельного пакета rector-phpunit, то на сегодня (для версии 2.6.3) этот функционал уже входит в состав основного пакета.

Итак, у нас были тесты написанные в разное время разными разработчиками под версию PHPUnit, которая была установлена при создании проекта. Вопрос о её обновлении поднимался регулярно, но оценка стоимости актуализации нескольких сотен файлов с несколькими тысячами тестов была довольно большой, пока не появилась возможность сделать это автоматически.

Как шло обновление:
- установили пакет rector/rector
- обновили пакет phpunit
- сделали файл конфига rector.php в котором прописали наборы правил
- запустили сначала в режиме vendor/bin/rector process --dry-run. Увидели, что аннотации @dataProvider не мигрировали в атрибуты #[DataProvider], а сами методы, на которые указывают dataProvider не стали статическими (требования PHPUint 10+).
Добавили необходимые правила в конфиг rector.php и в при первом приближении всё сработало как нужно:

<?php

declare(strict_types=1);

use Rector\Config\RectorConfig;

return RectorConfig::configure()
    // Путь к директории с тестами
    ->withPaths([
        __DIR__ . '/tests',
    ])
    // Включаем синтаксис PHP 8.4
    ->withPhpSets(php84: true)
    // Правила берем для версии phpunit из composer.json
    ->withComposerBased(
        phpunit: true
    )
    // Общие наборы правил для улучшения качества тестов
    ->withPreparedSets(
        phpunitCodeQuality: true
    )
    // Явно запускаем встроенное правило миграции аннотаций PHPUnit в атрибуты
    ->withAttributesSets(
        phpunit: true
    );

Но и после этих инструкций не все методы dataProvider стали статическими. Основные причины были в следующем:
- использование $this в методах dataProvider
- коллизии из-за последовательности выполнения правил рефакторинга в Rector

Что помогло исправить ситуацию:
1. повторный запуск vendor/bin/rector process позволил правилам повторно пройтись по уже исправленным файлам и доделать изменения
2. использование ссылки на текущий объект в методах dataProvider плохая практика, от неё отказались

Теги:
Всего голосов 1: ↑1 и ↓0+3
Комментарии0

Житель Республики Корея показал свою жизнь через историю поездок в Google Maps. Он сделал визуализацию с помощью открытой утилиты Timeline Visualizer. В итоге получилась карта, на которой почти весь год выглядит так: дом — работа — дом — работа. Пару раз линия всё-таки уходит в сторону, но это не отпуск и не приключения, а командировки.

Теги:
Всего голосов 1: ↑1 и ↓0+3
Комментарии1

Математика оказалась самым сложным предметом для учеников начальной школы, согласно шкале трудности учебных предметов, представленной СанПиН (в санитарных правилах РФ). Для детей 1–4 классов математику оценили в восемь баллов из десяти, что выше оценок всех остальных дисциплин.

Второе место по уровню сложности по СанПиН занимают русский или родной язык и иностранный язык (семь баллов). Далее идут информатика и окружающий мир (по шесть баллов) и литературное чтение (пять баллов). Самыми лёгкими для младшеклассников оказались физкультура (один балл), технология (два балла), а также изобразительное искусство и музыка (по три балла).

Теги:
Всего голосов 2: ↑1 и ↓1+2
Комментарии1

Наконец-то дошли руки до повышения версии трекера ошибок Glitchtip с 4.2.5 до 6.2.6, а это значит то, что у меня появилась возможность подружить OpenCode агента с Glitchtip через MCP. Повышение версии трекера прошло без единой ошибки, данные сохранились, на всё ушло минут 30. Как обновлял пошагово могу рассказать отдельно.

Glitchtip - это бесплатный open source трекер ошибок, аналог Sentry, предназначенный для мониторинга и анализа ошибок, производительности на нескольких проектах. Я использую его для быстрого выявления ошибок, в каком приложении возникла проблема, в каком месте и при каких условиях. Подключение по MCP к Glitchtip позволяет автоматизировать анализ и обработку исключений, используя ИИ агентов, например OpenCode.

На данный момент основное используемое мною применение данной связки - это анализ новых ошибок. Раньше я копи-пастил детальную страницу ошибки в чат, теперь процесс можно автоматизировать и экономить токены. У меня в планах сделать полностью автономного агента, который будет создавать утилиты и сайты с нуля под конкретный запрос пользователя, автоматизация трекера ошибок будет одним из кирпичиков этой системы.

Для подключения аналога сентри к ИИ агенту:

Включить MCP в окружении Glitchtip

GLITCHTIP_ENABLE_MCP=True

В моём случае Glitchtip запускается в docker-контейнере. Я просто добавил новую запись в файлы .env и .env.example и перезапустил сервис.

Создать токен доступа в UI Glitchtip с правами на чтение

Тут должно быть изображение, где красными стрелочками показано куда нажимать, но редактор молча игнорирует добавление фото. Если описать навигацию текстом: Profile -> Auth Tokens -> Create New Token

Затем сохранить токен как файл где-то в директории с секретами, чтобы OpenCode смог его подхватить и токен не утёк при git push. Например:

.secrets/glitchtip-auth

Содержание файла:

Bearer {{Ваш токен}}

Добавить MCP и токен в opencode.json

...
"mcp": {
	...
	"glitchtip": {
		"url": "https://errors-report.{{Ваш домен}}.com/mcp",
		"headers": {
			"Authorization": "{file:.secrets/glitchtip-auth}"
		},  
		"type": "remote",
		"enabled": true
	},
	...
...
},

Нужно иметь в виду, что данные MCP Glitchtip будут добавляться к контексту каждого запроса. И когда задача не связана с трекером ошибок, нужно выключить данный MCP, выставив "enabled": false и перезапустив OpenCode.

Перезапустить OpenCode и проверить работу

OpenCode должен стартовать без ошибок, MCP должен отобразиться в статусе. Можно проверить результат подключения, попросив агента: "Check if MCP works on a self-hosted GlitchTip instance". В ответе агента должен быть вызов одного из методов MCP, например:

Let me test the GlitchTip MCP tools against your instance. Вызван glitchtip_list_organizations <<< ------ Ключевой вызов через MCP, маркер успешной настройки. MCP works on your self-hosted GlitchTip instance. It successfully connected and returned your organization:

Organization: ShabalinAS Team Slug: shabalinas-team Accepting events: Yes

Теги:
Всего голосов 2: ↑1 и ↓1+2
Комментарии0

Средняя стоимость токенов для ИИ резко упала с пика в $2,07 за миллион токенов 28 мая до $1,02 за миллион токенов. Основными причинами являются снижение цен на китайские модели ИИ от Kimi и DeepSeek, которые в несколько раз дешевле моделей с закрытым исходным кодом из США.

Теги:
Всего голосов 1: ↑1 и ↓0+3
Комментарии1

Ближайшие события

14 августа была выложена новая версия модели Qwen 3.8 27b и 27b-FP8. 12 августа назад была выложена новая версия модели Qwen 3.8-2.4T-A95B и Qwen 3.8-2.4T-A95B-FP8.

Почему это важно для кибербеза? Семейство квен самое популярное семейство среди моделей на hugging face как по количеству скачиваний так и по использованию для построения\файнтюна своих моделей. Россия в этом плане не сильно отличается от мировых тенденций.

Версия на 27 млрд параметров по общим бенчмаркам способностей находится на уровне GLM-5.2 (max), Deepseek V4Pro 0813, GPT 5.6 Luna. Квантованную до FP8 версию можно попробовать запустить на условно домашней rtx 5090 32 Гб

Версия на 2,4 трлн параметров по общим бенчмаркам способностей находится на уровне Muse Spark 1.2, GPT 5.6 Terra, т.е. можно отнести к SOTA моделям . Эта версия FP8 уже потребует профессиональных минимум 16 видеокарт Nvidia B300.

Как обычно хотелось бы понимать насколько эти модели более защищенная и (или) более способная для задач кибербезопасности.

А тут появляются проблемы, официально у новых моделей нет тех репорта, только карточки на hugging face c ссылками в никуда или на весьма ограниченное описание. Каких либо других независимых отчетов по кибербезопасности и safety мне тоже не удалось найти. В части возможностей самой модели можно с допущениями ориентироваться на тест облачной версии модели Qwen 3.8 Max (как аналога Qwen 3.8-2.4T-A95B) от Aikido:
"Qwen rediscovered 26 of 32 CVEs across three runs, for 81.25% pass@3 recall. That's ahead of GPT-5.6-Sol and matches Opus 5, at roughly half the cost".

Можно попробовать ориентироваться на комплексные бенчи:
Terminal‑Bench 2.1 - навыки работы в командной строке, в том числе для задач кибербезопасности (нахождение и закрытие уязвимостей в коде, реверс-инжиниринг бинарных файлов и безопасная настройка доступов).
DeepSWE 1.1 - бенч для навыков агентов по написанию кода, отдельных разделов по безопасности нет, но это навык смежный с написанием кода.

Значимое отличие - Qwen 3.8 27b единственную из актуальных опенсорс общих моделей можно запустить на одиночном устройстве, особенно если на неофициальном квантовании FP4. Тогда как для "соседей" по бенчмаркам (GLM 5.2, Deepseek V4Pro 0813, GPT 5.6 Luna) потребуется кластер (а иногда и не один) профессиональных видеокарт.

Что на текущий момент является аномальным результатом по соотношению (возможности модели в Terminal‑Bench 2.1)/стоимость оборудования. Соотношение сохраняется в DeepSWE 1.1 и нескольких других бенчах .

Будем ждать новых отчетов по этому семейству, пока Artificial Analysis не включил в бенч по затратам Qwen 3.8 27b, поэтому нужно отнестись сдержанно к получившейся аномальной оценке.

Если у кого то есть локальная RTX 5090 и свободное время - поделитесь впечатлениями ;) .

Исследование Akido
Исследование Akido
Теги:
Всего голосов 5: ↑3 и ↓2+3
Комментарии3

Немного философии Rust, возможно кому то интересно обсудить

Уже почти 3 месяца пишу проект на Rust. Сейчас разработка стала другой, ручная работа стала роскошью, реальные задачи бизнеса быстрее решить LLM-ками. Естественно познание языка в таком режиме замедляется, хочется как-то компенсировать, хотя бы поговорить об этом.

Вот какой аспект. В Rust уровень владения/заимствования объектом - часть контракта. По большому счету можно составить примерно такую таблицу (на самом деле это дерево должно быть, но для упрощения привожу плоскую таблицу):

  • Просто владею объектом → T

  • Временно читаю чужой объект → &T

  • Временно изменяю чужой объект → &mut T

  • Один владелец, нужна куча → Box

  • Несколько владельцев, один поток, чтение → Rc

  • Нужны несколько владельцев, один поток, изменение → Rc<Cell> / Rc<RefCell>

  • Несколько владельцев, несколько потоков, чтение → Arc

  • Несколько владельцев, несколько потоков, изменение → Arc<Mutex> / Arc<RwLock>

По сути чем более строгий уровень доступа (или какой термин тут лучше?) - тем больше проверок сможет сделать компилятор. Если используете Rc - то уже потенциально возможны циклические ссылки и утечка памяти (с Box - это не возможно). Если RefCell - то компилятор не сможет проверить два borrow_mut() одновременно - будет рантайм проверка или паника.

И вот какая фишка. Часто LLM-ка дает уровень больше чем нужно. Как-то где можно обойтись ссылкой - добавит Rc<RefCell>. Т.е., по сути, код то рабочий, но лишние обертки и послабление компил-тайм проверок немного угнетают.

Но иногда бывает оправданно, когда в процессе уровень нужно ослабить, т.к. не всегда предусмотришь на этапе проектирования.

И далее возникла философская идея. А вот неплохо бы чтобы компилятор сам решал какой уровень применять. Т.е. начинаем от самого малого, если его не достаточно - то использует послабления. Если достаточно классической проверяемой ссылки - то использовать ее. Или если нужно множественное владение, но точно нет потоков - то Arc можно не использовать - достаточно Rc (если нет данных то ослабляем - берем Arc).

При этом все еще остаемся в рамках языка без GC - но вместо ручного выбора - выбор осуществляется компилятором при сборке.

Как вы думаете - идея имеет право на жизнь?

Теги:
Всего голосов 3: ↑2 и ↓1+3
Комментарии3

Пару месяцев назад я написал пост о поиске журнала для публикации статьи. Спасибо всем откликнувшимся, особенно Евгению Рудному @rudnyi - именно его советом я и воспользовался. Но все не так просто...
У меня было три задачи: закрепить авторство, сообщить специалистам о работе и подняться в глазах начальства. Третий пункт отпал, поскольку мне пришлось уйти с работы вообще (по ссылке подробности). Соответственно, нужда искать журнал отпала и я решил попробовать препринты по совету Евгения.

Не буду писать все подробно, но опробовано следующее:
1. На сайте "preprints.ru" публикация удалась легко и просто: кто хочет - прочтите мою статью.
2. На сайте "preprints.org" статью отклонили (история ее перевода на инглиш с чатомжпт - это отдельная история). Причину отклонения не указали ("считаем нецелесообразным, спасибо за внимание, удачи на других площадках").
3. На сайте "zenodo.org" статья неделю висела со статусом "на рассмотрении", пока я сам ее не удалил (если удалилась). Почему - я не понял. То ли я что-то не так сделал, то ли что еще. Непонятно ничего!
4. Еще мне посоветовали сайт "academia.edu", где можно публиковать вроде бы что угодно и на любом языке (даже на русском). Но на русском уже есть, я опубликовал английский вариант - если интересно, прочтите. Статья одна и та же, но сейчас мир делится, и не факт, что аудитории пересекаются...

Место осталось, напишу кратко о переводе. Качество оценить не могу, скармливал ЖПТ фрагменты (только текст, без формул). Он несколько раз возвращался к прошлым фрагментам, приходилось переделывать. Один раз я ему дал перевод абзаца, сделанный джемени ("О, это очень интересно! Вот тут она лучше, тут хуже"). Статья в сумме 10 страниц Ворда, много формул и чисел. Но перевод занял не один день! Так что не все так просто пока еще в этой сфере...

Надеюсь, этот пост кому-то будет полезен, не один я площадки для публикаций ищу... Лет 15 назад я сам хотел сделать сайт для публикаций всего "непризнанного официально", чтобы дать площадку альтернативным идеям. Но руки так и не дошли...
Сейчас я сам в поисках интересной работы по моим умениям и желаниям (ссылка во вступлении к посту), но творчество свое буду продолжать и сайты свои развивать.
А статья... Чистая математика! :) Если кому интересно.

Теги:
Всего голосов 4: ↑4 и ↓0+6
Комментарии14

Риккардо Манцотти: Восприятия - это объекты. На пути к теории идентичности разум-объект

Риккардо Манцотти является представителем экстернализмома и он выводит сознание за пределы тела. При этом Манцотти считает себя убежденным физикалистом:

'если сознание реально, оно обязано быть физическим.'

Поместить сознание вне мозга его вынуждают противоречия, связанные с противоположной позицией, интернализмом:

  • Восприятия отличаются от мозга;

  • Восприятия интенциональны;

  • Восприятия cвязаны с квалиа.

Таким образом, Манцотти рассматривает два утверждения

  • Сознание идентично с физическим феноменом (PHYSICAL),

  • Этот феномен находится в теле или в мозгу (BRAINBOUND),

и утверждает, что в рамках физикализма можно оставить первое утверждение и заменить второе на следующее:

  • Сознание - это внешний объект (OBJECTBOUND).

При этом панпсихиз отвергается, как концепция несовместимая с физикализмом. Приведу цитату, в которой Манцотти живо объясняет свою позицию на примере ситуации, когда человек видит желтый банан. На этом пути он рассматривает соотношения между бананом, телом (мозгом) и восприятием:

'В итоге, ваше восприятие объекта желтое и банановое. Банан перед вами также желтый и банановый. Ваше восприятие имеет свойство воспринимаемого объекта. Не является ли это обещающим началом? В действительности многие замечали, что наше восприятие не отличается от окружающего мира - оно состоит из объектов, машин, людей, зданий, деревьев, облаков, Солнца и звезд. Физические свойства тела и свойства объекта известны. Они совпадают! Мозг розовато-серый, липкий и кровянистый. Банан желтый, протянутый и банановый. Ваше восприятие желтое, протянутое и банановое. Что является вещью, которая желтая, протянутая и банановая? Мозг или банан? Ответ очевиден - банан! Что нам нужно еще, чтобы вывести такую очевидную идентичность?'

Убрав противоречия, существующие в интернализме, в своей статье Манцотти берется за решение горы противоречий в предлагаемой версии экстернализма. Больше информации можно найти в статье Винника, в которой рассматривается интернализм и экстернализм:

'Другую радикальную версию феноменологического экстернализма исповедует Р. Манцотти. Он ставит под сомнение разделение на субъект и объект. Согласно Манцотти, это разделение на мир и восприятие может быть отброшено, поскольку то, что мы считаем объектами и их феноменальными репрезентациями, суть только две неполные перспективы одного физического процесса.'

R. Manzotti, Experiences are Objects. Towards a Mind-Object Identity Theory, in Rivista Internazionale di Filosofia e Psicologia, 2016, 7(1), pp. 16-36.

Д. В. Винник, Сознание за пределами мозга - истоки аргументации радикального экстернализма. Вестник Томского государственного университета. Философия. Социология. Политология 2 (10) (2010): 125-136.

Источник

Теги:
Всего голосов 2: ↑1 и ↓1+2
Комментарии0

После года на фрилансе вернулся к поиску постоянной работы, и, надо сказать, за этот год работодатели, кажется, полностью перевели наём на искусственный интеллект. И хоть на рекрутеров за это катят сотни бочек, я могу их понять: в конце концов, первичный отбор в основе своей состоит в поиске общих паттернов между текстом вакансии и текстом резюме — буквально то, в чем ИИ хорош, — так что это вполне ложится в корзину "Оптимизация", а не "Лень".

А то, что после установления контакта часто следует автоматическое анкетирование с вопросами, ответы на которые есть в самом резюме, — это уже скорее вина площадок (да, hh.ru, первую очередь на тебя смотрю): большинство рекрутеров работает с их встроенными инструментами, которые как раз и должны такие вещи стримлайнить.

Логично оптимизировать поиск и со своей стороны, что я и сделал. Технику и pipeline, если будет интересно, опишу в другой раз. Если упрощенно: ИИ с контекстом из собранного опыта, предпочтений, портфолио и прочей важной информации обо мне как специалисте (значительно шире, чем разумно включать в резюме) просматривает вакансии, откликается на подходящие, где нужно — заполняет анкеты и пишет сопроводительные.

Получается, с обеих сторон машина разговаривает с машиной — симметрия и справедливость. Верно? Знать бы, как это выглядит с другой стороны. Мой Claude всегда подписывает сопроводительные строкой "Отклик отправлен AI-ассистентом...", но в 2026-м вряд ли кто-то рассчитывает выдать текст AI за свой, и такая честность стоит немного.

Кто первым пробьется через TL;DR: я прочту вакансию или HR — резюме?

Я пока для себя не решил эту дилемму, поэтому выбрал компромисс: если ИИ находит вакансию, которая ну прям очень про меня, — откладывает ее в отдельный список, который я разбираю сам.

Где для вас граница допустимого участия ИИ в поиске работы?

  1. Только сам, без ИИ

  2. Правки резюме и писем

  3. Поиск и отбор вакансий

  4. Отклики и письма за меня

Ответьте номером в комментариях.

Теги:
Всего голосов 2: ↑2 и ↓0+5
Комментарии2

NUMA и топология CCD Ryzen 9 9950X: как размещение vCPU влияет на задержки.

NUMA и топология CCD Ryzen 9 9950X не равнозначны: гость видит NUMA-схему, но не границы L3. Сравнивать нужно размещение vCPU на одной VM внутри CCD, между CCD и без pinning. Результат зависит от нагрузки, BIOS, ядра, QEMU и SMT.

Как определить, какие vCPU находятся на одном CCD?

Сопоставьте логические CPU с ядрами и SMT-сиблингами, затем найдите группы общего L3-кэша. Каждый CCD объединяет восемь ядер с общим L3, номера CPU зависят от хоста, поэтому проверяйте shared_cpu_list. Запишите BIOS, микрокод, ядро и governor.

lscpu -e=CPU,CORE,SOCKET,NODE,CACHE
grep -H . /sys/devices/system/cpu/cpu*/cache/index3/shared_cpu_list

Границы CCD измеримы: в открытом наборе для 9950X с AGESA 1.2.0.2 средняя задержка CAS через общую строку кэша составила 22,4 нс внутри CCD и 79,5 нс между CCD, тогда как numactl границу не покажет.

От физических ядер к vCPU, emulatorpin и vNUMA

vcpupin связывает vCPU с CPU хоста, но не трогает остальные потоки VM: эмулятор QEMU и IOThread закрепляются отдельно. NUMA node гостя должен отражать домен памяти, а не границу L3, иначе межчиплетная задержка смешается с доступом к удалённой RAM.

virsh vcpupin vm-latency
virsh emulatorpin vm-latency
virsh numatune vm-latency

Компактный CCD, разнесённые CCD и свободное планирование

Сравните одну VM в трёх конфигурациях: внутри одного L3, между CCD и без vcpupin. Число vCPU и RAM не меняйте, пиннинг задавайте по физическим ядрам, SMT проверяйте отдельно.

Насколько размещение между CCD увеличивает задержку?

Универсальной прибавки нет: результат зависит от общих данных, синхронизации, памяти и миграций. Сравнивайте одну нагрузку на одном хосте, сохраняя p50, p95, p99 и разброс. Core-to-core тест измеряет обмен между CCD, а не p99 приложения.

Как не принять boost, нагрев или соседнюю VM за эффект CCD

Прогрейте VM, фиксируйте частоту, температуру и %st: performance не удерживает частоту на Ryzen. Чередуйте схемы A–B–C–C–B–A и записывайте фоновые задачи. vNUMA должна совпадать с доменами памяти хоста.

Связь задержки с миграциями, кэш-промахами и удалённой памятью

Возьмите приложение с общей памятью или синхронизацией и микротест обмена. Перед серией проверьте pinning в libvirt и память QEMU, затем снимайте context switches, миграции и NUMA faults. Для cache-misses нужен vPMU. Нормируйте счётчики: рост вместе с p99 причину не доказывает.

perf stat -e context-switches,cpu-migrations,cache-misses \
   -- ./test
numastat -p "$(pgrep -fo 'guest=vm-latency')"

Когда пиннинг vCPU улучшает p99?

1. Рабочие потоки часто обращаются к общим данным.

2. Без pinning они мигрируют между группами L3.

3. p99 снижается без потери throughput и роста %st.

Где компактность помогает, а где ограничивает параллелизм

Сведите три схемы в таблицу: медиана p99 по повторам и доверительный интервал разницы. Если интервал пересекает ноль, результат в пределах погрешности. Задачам с независимыми потоками компактность ничего не даёт: обмена между ядрами почти нет, а привязка сужает выбор планировщика.

Как превратить топологию 9950X в правило эксплуатации

До теста задайте порог, например снижение p99 на 10% без потери ops/s. В XML подставьте cpuset и узел.

<vcpu>2</vcpu>
<iothreads>1</iothreads>
<cputune>
 <vcpupin vcpu='0' cpuset='0'/>
 <vcpupin vcpu='1' cpuset='1'/>
 <emulatorpin cpuset='2'/>
 <iothreadpin iothread='1' cpuset='3'/>
</cputune>
<numatune><memory mode='strict' nodeset='0'/></numatune>

Закрепляйте vCPU внутри CCD только если улучшение p99 воспроизводится в повторных прогонах. Если throughput падает или p99 не меняется, оставьте свободное планирование. Топология задаёт гипотезу, решение зависит от VM.

Теги:
Всего голосов 4: ↑3 и ↓1+4
Комментарии0

Коннекторы 1С: быстрая интеграция через OData в Digital Q.Integration

Интеграция с решениями 1С остается одной из наиболее востребованных задач в построении корпоративных ИТ-ландшафтов. При этом разработка и сопровождение интеграционных решений зачастую требуют значительных временных и трудовых затрат.

На вебинаре эксперты компании «Диасофт» расскажут, как организовать обмен данными между 1С и внешними системами с помощью готового коннектора платформы Digital Q.Integration, реализованного на базе протокола OData. Вы узнаете, какие подходы для интеграции с 1С существуют, почему именно OData выбран в качестве технологической основы решения и какие преимущества это дает при построении современных интеграционных процессов.

Во время демонстрации покажем, как:

  • настроить подключение к 1С с помощью коннектора Q.Integration;

  • получать данные из 1С;

  • добавлять/изменять данные в 1С;

  • автоматизировать интеграционные процессы средствами платформы Digital Q.Integration.

Программа

13:00 – 13:10 Введение. Почему интеграция с 1С остается актуальной задачей и какие подходы используются для ее реализации.

13:10 – 13:25 Подходы к интеграции с 1С. Рассмотрим основные способы организации обмена данными, сравним интеграцию через OData и использование специализированных конфигураций 1С, разберем преимущества и ограничения каждого подхода.

13:25 – 13:40 Коннектор 1С в Digital Q.Integration. Расскажем, как реализован коннектор, какие процессы автоматизированы, как устроена работа с OData и какие возможности получает пользователь при настройке интеграции.

13:40 – 13:55 Практическая демонстрация. Покажем настройку коннектора, получение данных из 1С и изменение.

13:55 – 14:00 Вопросы и ответы. Ответим на вопросы участников и обсудим практические кейсы использования коннектора.

Кому полезен вебинар:

  • ИТ-директорам и техническим руководителям;

  • архитекторам интеграционных решений;

  • руководителям проектов цифровой трансформации;

  • разработчикам и интеграторам;

  • специалистам по сопровождению корпоративных информационных систем.

Спикеры:

  • Виктор Овчинников, руководитель продукта Digital Q.Integration компании «Диасофт»

  • Андрей Даниленко, ведущий разработчик MSA департамента «Цифровые решения» компании «Диасофт»

Зарегистрироваться на мероприятие можно по ссылке

Теги:
Всего голосов 1: ↑1 и ↓0+3
Комментарии0