Обновить

Все потоки

Сначала показывать
Порог рейтинга
Уровень сложности

Своя GPT‑like LLM по WH40K с нуля. Часть 5: Интеграция с Hugging Face

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели6.6K

Привет, Хабр! Меня зовут Владимир, и это пятая часть цикла статей по написанию и обучению небольшой decoder-only LLM с нуля. В прошлых частях мы собрали и обучили модель LinguaLaboratoriumMechanicus — миниатюрную GPT-like LLM во вселенной Warhammer 40K. В этой части упакуем её в формат Hugging Face: сделаем конфиг и обёртку под transformers, сохраним и зальём модель на Hub.

Читать далее

Рейтинг лучших тепловизоров — неожиданное мини-исследование

Время на прочтение8 мин
Охват и читатели8K

Сам я к стройке отношение имею весьма косвенное — в данном случае это даже хорошо. Получив от руководства задачу приобрести для компании тепловизор, я погрузился в изучение рейтингов и обзоров. И столкнулся со вполне очевидными вопросами, ответов на которые технические материалы почему-то категорически не содержат.

Поэтому сегодня поделюсь результатами моих двухнедельных изысканий и «подсвечу» проблему выбора тепловизора с неожиданной стороны. Мой рейтинг тепловизоров не будет похож на стандартные обзоры с детальным разбором характеристик приборов, от этого я, наоборот, постарался уйти.

Читать далее

KryoSheet — не жидкий не металл

Время на прочтение6 мин
Охват и читатели10K

Для тех, кто ищет способы побороть перегрев ультрабуков, но к жидкому металлу не готов.

Коротко суть проблемы: ультрабук это здорово, это всего кило весу. Но как и с любым ПК всегда хочется чтоб он был максимально быстр. А быстрый = горячий. Только жаль, что любая система охлаждения - это про габариты. Чем крупней радиаторы и вентиляторы, тем больше тепла она может отвести.

Уменьшая габариты и массу ноутбука, приходится уменьшать и охлаждение. Некоторые производители уже с завода наносят жидкий металл под радиатор, ставят большие (по меркам ноутбуков) радиаторы и вентиляторы в ущерб батарее. Ну а некоторые просто забивают на проблему и даже не стараются ничего решать.

Лонгрид и куча фоток

Встроенная аутентификация и авторизация в Manticore Search

Время на прочтение4 мин
Охват и читатели6.3K

Поиск — уже не просто поле на веб‑сайте. Во многих случаях Manticore Search работает как внутренняя служба обработки данных: приложения направляют к нему запросы, процессы загрузки данных обновляют таблицы в нём, панели мониторинга получают из него данные, а операторы изменяют схемы таблиц. Когда всё это опирается лишь на сетевое доверие, контроль доступа быстро становится уязвимым.

Именно поэтому в Manticore Search теперь встроены аутентификация и авторизация. Функциональность добавлена в версиях 27.x и описана в посте о релизе 27.1.5 : она позволяет Manticore проверять, кто подключается и что этому пользователю разрешено делать.

Новая функциональность работает через SQL, HTTP/HTTPS-клиентов, распределённых и удалённых агентов и поддерживает репликацию.

Читать далее

Что в тренде по нейросетям за неделю: 5 ИИ-скиллов, 4 вайбкодинг-проекта и еще 7 ИИ-полезностей

Время на прочтение3 мин
Охват и читатели7.2K

Лучшее по нейросетям за неделю: 5 инструментов для ИИ-агентов, 6 необычных проектов и 6 вирусных экспериментов.

Без долгих вступлений.

Начнем.

Читать далее

Инференс LLM: от KV-кэша до продакшен-деплоя

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели8K

Привет! Я Саша Рыжов, MLOps-инженер в hh.ru, уже три года занимаюсь развитием инфраструктуры для искусственного интеллекта. Компании, которые развивают GenAI, рано или поздно приходят к задачам по запуску LLM на собственном железе. В статье я расскажу, как обстоят дела с движками инференса в 2026 году и как запустить on‑prem-прод и не изобрести при этом велосипед.

Читать далее

Как превратить пилот ИИ в рабочий бизнес‑процесс

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели6.7K

Модель A³: как связать постановку задачи, принятие решений и организационные изменения

ИИ‑проект можно технически завершить успешно и всё равно не получить бизнес‑результата.

Модель подключена к корпоративным данным, интеграции работают, пользователи обучены. Но рекомендации остаются в отдельном интерфейсе, руководители продолжают принимать решения по старой логике, а пилот не выходит за пределы группы энтузиастов.

Технически ИИ внедрён. Работа компании не изменилась.

Причина в том, что ИИ‑инициатива затрагивает не только технологию. Компании необходимо определить, какую проблему она решает, какую роль ИИ будет играть в принятии решения, кто отвечает за последствия этого решения и что должно измениться в организации, чтобы новый способ работы закрепился.

В 2026 году Макс Чан, CIO компании Avnet, предложил A³ — управленческий фреймворк для переосмысления роли CIO в эпоху ИИ: Architect, Augment, Amplify.

Читать далее

Hot Reload, который не заработал. Инкрементальная компиляция в браузере своими руками

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели7.6K

В прошлой статье я рассказывал, как мы делаем онлайн IDE для .NET — дизайн, компиляция и запуск приложений происходят прямо в браузере, без сервера. Проект живёт по адресу xaml.io. С тех пор мы много чего добавили, и в какой-то момент у нас стало получаться загружать в IDE довольно крупные .NET проекты — десятки XAML, сотни C# файлов, несколько референсных проектов и пакетов NuGet.

Одна из главных возможностей — это визуальный UI-дизайнер пользовательских приложений. И у него есть особенность: чтобы дизайнер вообще что-то показывал, приложение должно быть скомпилировано, причём в актуальном состоянии. Не «когда-нибудь», а после каждой правки.

Открыли как-то в IDE один реальный проект (FamilyShow — классическое демонстрационное WPF-приложение), поправили одну строку в .cs и 84 секунды наблюдали за анимацией прогресса. С таким UX никакой интерактивный дизайн невозможен.

Сейчас та же правка занимает 5 секунд, а правка XAML-разметки на типичной странице — меньше секунды. В этой статье — как мы к этому пришли, и какие сюрпризы нам приготовили по дороге Roslyn, OpenSilver, WASM и наш собственный код.

Читать далее

Сейчас будет горячо: нагрев iOS-устройств как продуктовая метрика

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели8.2K

В какой-то момент разработки приложение становится достаточно зрелым, а команда достаточно большой. Или наоборот. Тогда кто-то решает, что пора собирать метрики: Crash Rate, Hitch Rate, время холодного запуска, потребление памяти, сетевые ошибки. Организуются красивые дашборды, пишутся аккуратные отчеты, ставятся четкие квартальные цели.

Все довольны. Пока не придет технический директор и не спросит:

Интересный вопрос

ChatGPT Work как облачный агент

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели8.5K

Недавно OpenAI выкатил фичу под названием ChatGPT Work. Она появилась как в браузерном ChatGPT, так и в Codex. В этой статье будет описана одна полезная особенность этого режима.

Читать далее

Лучшие модели для разработки с ИИ на 1С (бенчмарк v2)

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели12K

Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5, MiniMax M2.7.

Для тех, кому лень читать до конца, текущий итог:

Читать далее

Новые правила контекстной инженерии для Claude 5

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели11K

Ранее я уже писал о том, как лучше всего составлять промпты для нового поколения моделей Claude 5 и работать с ними итеративно, чтобы постепенно понять, что именно вы хотите создать.

Но когда вы отправляете Claude сообщение, сам промпт составляет лишь небольшую часть получаемого моделью контекста. Значительная его часть собирается из системного промпта, навыков, файлов CLAUDE.md, памяти и других источников. Мы называем это контекстной инженерией. От нее во многом зависит результат работы с Claude Code и собственными агентами.

В отличие от промпта, контекст используется сразу во множестве запросов, поэтому он не может быть настолько же конкретным. Как создавать общие инструкции и рекомендации для Claude, особенно если заранее неизвестно, с каким запросом придет пользователь?

По мере развития возможностей Claude эта задача неожиданно усложняется. Недавно мы заметили серьезные изменения в том, как следует составлять инструкции для нового поколения моделей. Мы удалили более 80% системного промпта Claude Code для Claude Opus 5 и Claude Fable 5, при этом наши тесты по программированию не показали измеримого ухудшения результатов.

Ниже мы собрали все, что узнали о промптинге для моделей этого класса, а также рекомендации по обновлению собственной контекстной инженерии.

Читать далее

С нуля до Junior DevOps в 2026 году. Часть 6.1. Terraform: Infrastructure as Code и создание инфраструктуры

Уровень сложностиПростой
Время на прочтение13 мин
Охват и читатели9.7K

В небольших проектах инфраструктуру можно создать вручную через веб-интерфейс облачного провайдера. Но если серверов десятки, а окружений несколько (Development, Testing, Staging и Production), ручное управление становится медленным и приводит к ошибкам.

Поэтому часто в современной DevOps-практике используется Infrastructure as Code (IaC) — подход, при котором инфраструктура описывается в виде кода и может быть создана или изменена одной командой. Одним из самых популярных инструментов для этого является Terraform.

В этой статье разберём, что такое Terraform, как он работает, из каких компонентов состоит и почему знание Terraform стало одним из базовых требований к DevOps-инженерам.

Читать далее

Ближайшие события

Конец бесплатного доступа: что изменили Яндекс и Mail — и как миграция проявится в DNS

Время на прочтение8 мин
Охват и читатели11K

TL;DR. Этим летом Mail (VK) и Яндекс ограничили бесплатный доступ к почте по IMAP/POP3/SMTP — новости об этом на Хабре уже были, эмоций в комментариях тоже хватило. Эта статья — не третья новость, а попытка собрать всю картину по первоисточникам: точную хронологию того, как парольный доступ к почте закрывали Google (2022–2025) и Microsoft (2025–2027), что именно и для кого ограничили в рунете, чем технически парольная авторизация в почтовых протоколах заслужила такую судьбу — и, главное, измеримую точку отсчёта: сколько доменов из Tranco top-1M сидело на MX Яндекса и Mail на момент изменений. Смена почтового провайдера видна в DNS, так что миграцию — кто заплатит, кто уедет и куда — можно будет наблюдать в цифрах, а не в комментариях. Каждое утверждение в тексте снабжено ссылкой на проверяемый источник.

Читать далее

DMARC-театр: 117 тысяч доменов опубликовали запись, которая никуда не отчитывается и ничего не запрещает

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели10K

Анализ DNS-снэпшота OpenINTEL за 2026-07-25

TL;DR. В январе я публиковал общий срез email-инфраструктуры Tranco top-1M — кто на чём принимает и шлёт почту. Самый частый вопрос в комментариях был про DMARC: «ну хорошо, запись есть у двух третей, а толку?» Отвечаю развёрнуто. Из 468 749 доменов top-1M, опубликовавших DMARC, реально применяют политику (p=quarantine/reject) 49.31%. Ещё 25.61% сидят на p=none, но хотя бы получают агрегатные отчёты — это легитимная фаза внедрения. А 25.04% — 117 384 домена — опубликовали запись, у которой p=none и нет ни одного рабочего адреса для отчётов. Такая запись не запрещает ничего, не сообщает никому ничего и существует в DNS исключительно ради галочки. При этом формально во всех отчётах и сканерах эти домены проходят как «DMARC: yes». Ниже — откуда взялся этот слой, чьи подписи в нём видны, почему доля enforcement при этом падает, и что произойдёт с половинчатыми политиками, когда получатели перейдут на DMARCbis.

Читать далее

AI-краулеры в 2026: кого пускать в robots.txt, чтобы попадать в ответы ИИ

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.5K

Полгода назад ко мне постучался один из будущих клиентов с вопросом, почему ChatGPT не знает про его компанию, хотя сайт в топ-3 Google по нужному запросу. Индексация была нормальной, ссылки — тоже. Проблема нашлась за пять минут в логах: в robots.txt висел Disallow: / для всех user-agent, кроме Googlebot и YandexBot. GPTBot, ClaudeBot, PerplexityBot получали 403 ещё на первом запросе. Полгода сайт был невидим для трёх из четырёх крупных AI-поисковиков, и никто об этом не знал — в Search Console и Вебмастере всё выглядело зелёным.

Случай типовой. Проверка индексации показывает, видит ли сайт поисковик. Попадёт ли страница в ответ модели, которая формирует его вместо поисковой выдачи, — вопрос отдельный. Это две разные аудитории ботов, и вторая почти никогда не попадает в стандартный SEO-чеклист.

Читать далее

Почему всё, что мы должны были делать для живых людей, мы в итоге делаем для неживого интеллекта

Время на прочтение5 мин
Охват и читатели11K

Контекст для человеков всегда был важен. На онбординге всегда ломалось много мотивации и employee experience; над передачей знаний и снижением bus factor трудились и тимлиды, и HR-менеджеры, и даже выделенные KM-специалисты. Всё это делалось для людей, и делалось с весьма переменным успехом.

Для ИИ-агентов мы делаем ровно то же самое, но с повышенным рвением, скоростью и отдачей. Вливаем максимальный контекст, пишем подробнейший промпт. Строим волты и описываем весь мир в понятном для агента языковом ключе. Некоторые уже всерьёз думают про developer experience, но для агентов.

Почему на них хватило того, чего никогда не хватало на людей?

Самый напрашивающийся ответ: агент дороже, поэтому его берегут. Я довольно долго на нём стояла и теперь думаю, что он неверен, причём дважды.

Читать далее

Не просто регулярка — почему ELIZA была сложнее, чем вы думали

Время на прочтение7 мин
Охват и читатели12K

На первый взгляд ELIZA Джозефа Вейценбаума кажется чем-то примитивным. Практически набором костылей из регулярных выражений, который тупо менял местами «я» и «вы» и иногда задавал уточняющие вопросы. Да, в массовом сознании она так и осталась игрушкой из 60-х, наивной попыткой обмануть пользователя парой строк кода. И если вы думаете, что про ELIZA уже все давно сказано и разжевано, спешим вас удивить.

Почему эта программа, изначально задуманная как пародия для демонстрации поверхностности диалога с машиной, оказалась архитектурно сложнее, чем можно было предположить, и почему мы до сих пор верим в «разум» чат-ботов — разбираемся в этой статье.

Читать далее

Бенчмаркая Regex: конструктор показал 10 мкс, первый вызов — 1307

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели12K

Проверить строку регулярным выражением в .NET можно по-разному, но совет всегда один: включите RegexOptions.Compiled или возьмите генератор. Замеры это подтверждают.

А вот подготовка выражения оказалась не там, где её меряют: конструктор занимает 10 микросекунд, а первая же проверка на этом объекте — ещё 1307. Разобрался, куда уходит разница, и заодно нашёл границу, на которой статический Regex.IsMatch резко замедляется.

Читать далее

Мой сетап домашнего медиа сервера

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели17K

С момента как появился домашний сервер было желание сделать нормальный медиа сервер - чтобы по красоте смотреть фильмы и сериалы в 4K, без костылей.

Хотелось свести получение любого фильма или сериала к одному действию: нашёл → нажал «скачать» → посмотрел. Всё остальное - поиск релиза, скачивание, проверка качества и языка дорожки, переименование файла, раскладка по нужным папкам библиотеки - должно происходить где-то фоново, без меня.

Читать далее