Обновить

Все потоки

Сначала показывать
Период
Уровень сложности

Техдиректор Microsoft Azure с помощью ИИ за два дня портировал на macOS старую утилиту для Windows

Программист Microsoft Марк Руссинович, который в настоящее время является техническим директором Microsoft Azure, использовал искусственный интеллект, чтобы перенести инструмент Windows ZoomIt, который он поддерживает более 20 лет, на macOS за выходные.

Техдиректор Microsoft Azure с помощью ИИ за два дня портировал на macOS старую утилиту для Windows

Открываем AliceAI-Foundation-80B-A3B-Base — новую языковую модель Яндекса, обученную с нуля

Время на прочтение81 мин
Охват и читатели5.3K

Сегодня мы открываем веса нашей новой модели AliceAI‑Foundation-80B‑A3B‑Base под лицензией Apache 2.0. Модель прошла полный цикл обучения в Яндексе с нуля: мы не использовали веса сторонних опенсорс‑моделей. Её создание — ещё один шаг к нашей единой рассуждающей модели (ЕРМ), на базе которой будут развиваться агентские возможности Алисы AI.

В претрейн‑замерах новая модель обходит более крупные DeepSeek‑V4-Flash‑Base и Nemotron-3-Super на многих задачах — от фактологических и экспертных вопросов до математики и кода, — а на сложных задачах IMO AnswerBench и LiveCodeBench лидирует среди сравниваемых открытых претрейнов. Нашу предыдущую закрытую Alice AI LLM 235B она превосходит по фактологическим знаниям, математике, программированию и работе с длинным контекстом — при почти втрое меньшем общем числе параметров и примерно в семь раз меньшем числе активных.

Недавно наши коллеги открыли претрейн Alice AI Search (кстати, он тоже обучен без применения весов опенсорс‑моделей) и рассказали, как устроена модель быстрых ответов Алисы на Поиске. Сегодня мы подхватим у них эстафетную палочку и расскажем о большом обновлении датасета, который лежал в основе обучения обеих моделей.

Также продолжим историю из декабрьского техрепорта Alice AI LLM. Тогда обучение начиналось с весов Qwen3-235B‑A22B, но в этот раз мы обучали модель полностью с нуля. Благодаря накопленному командой опыту весь путь к релизу этой модели занял около полугода. За это время мы пересобрали корпус, перебрали архитектурные решения, подобрали гиперпараметры и добавили данные для рассуждений и агентских взаимодействий.

За итоговыми скорами стоит много экспериментов, и нам хочется рассказать о них подробно. Поэтому вместе с весами мы публикуем большой технический отчёт: от пайплайнов подготовки данных и протоколов оценки до стабилизации обучения и scaling laws. Для ключевых решений приводим абляционные эксперименты и разбираем подходы, от которых пришлось отказаться. Вклад обновлённого корпуса, архитектуры и гиперпараметров проверили в серии обучений с нуля — по 2 трлн токенов каждое.

Отдельная большая часть отчёта посвящена тому, как измерять качество претрейнов и почему это сложно. Результат базовой модели может сильно зависеть от примеров в промпте, а правильное решение сложной задачи — появляться лишь в одной из многих попыток. Мы подробно рассказываем, как выбирали протоколы замеров, строили бенчмарки, проверяли автоматическую оценку и выясняли, какие метрики позволяют предсказать качество после дообучения. Вместе с весами открываем два фактологических бенчмарка — WikiWebFacts и HardMultiQA с акцентом на русскоязычный контекст — и протоколы их оценки.

Читать далее

Новости

Номерные радиостанции: «Венона» против «Энормоз», первая шпионско‑криптографическая битва Холодной войны

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели11K

В прошлый раз мы отследили путь возникновения схемы, которая легла в основу работы «номерных радиостанций». Мощные коротковолновые станции позволили передавать радиосигнал через океаны и континенты, а шифры Вернама обеспечили при строгом соблюдении процедуры принципиальную недешифруемость сообщений. Соответственно, «центр» или работавшие при посольствах сотрудники спецслужб теперь могли передавать даже сверхсекретные сведения и указания в открытый эфир — и быть почти на 100% уверенными, что расшифровать послания никто не сможет даже при очень большом желании. До ума эта система была доведена к началу Второй мировой войны — и одним из пионеров в её применении стала советская стратегическая разведка. Ещё до разгрома стран Оси на территории США и Британии развернулось незримое для непосвящённых, но масштабное сражение советских и западных спецслужб. Разведчики СССР и их агенты, в том числе высокопоставленные, собирали всю возможную информацию о ядерных разработках Манхэттенского проекта и пересылали её в Москву в основном посредством шифров Вернама. Американские контрразведчики и криптографы, в свою очередь, пытались расшифровать их сообщения, несмотря на применение системы абсолютной криптоаналитической устойчивости, — и «вскрыть» советскую разведывательную сеть, о реальных масштабах которой они поначалу даже не подозревали.

Читать далее

Аналоговые компьютеры решали уравнения мгновенно. Почему это их не спасло

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели10K

«Мгновенно» — слово сильное, я к нему ещё вернусь и отниму примерно всё. Но начну с факта, который в этой истории главный.

В 1956 году в NASA делали пилотажный тренажёр для X-15 — того самого ракетоплана, который летал на семи махах и забирался на 100 километров. Тренажёр должен был считать динамику полёта в реальном времени, потому что за креслом сидел живой пилот. Ни один цифровой компьютер тогда этого не умел. Взяли три аналоговые машины EAI PACE 231R: 380 операционных усилителей, 101 функциональный генератор, 32 сервоусилителя, 5 множительных устройств. Диапазон модели — от 0,2 до 7 махов и от уровня моря до 1 056 000 футов, это примерно 322 км.

То есть человека готовили к полёту на край атмосферы на машине, в которой не было ни одной нулевой или единичной цифры.

Дальше обычно идёт текст про то, что аналоговые машины были в тысячи раз быстрее, что их зря похоронили, и что вот сейчас они возвращаются в виде чипов для нейросетей. Я такой текст читала много раз, и каждый раз спотыкалась в одном и том же месте: рядом со словами «в тысячи раз быстрее» всегда стоит строчка «точность порядка 0,1%», и никто никогда не показывает, что эти две цифры означают вместе.

Ну я и полезла считать.

Читать далее

Скорость разработки кода перестала быть дефицитом. Дефицитом стали денежные идеи

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели18K

Тридцать-сорок лет IT-менеджмент оптимизировал утилизацию дорогих человеко-часов, где чем больше кода писал разработчик, тем лучше компания оценивала свою эффективность. ИИ сделал написание кода дешевым — и выяснилось, что узкое место давно не в разработке, а в идеях, которые стоит реализовывать.

С появлением ИИ у бизнеса появилась возможность собирать MVP, фичи и рефакторинги за недели, а не за кварталы. И оказалось, что подавляющая часть этих MVP - никому не нужна. И это вызвало вопрос: "А действительно ли бутылочное горлышко было в разработке?". Ведь очевидно, если мы генерим MVP достаточно быстро, но эти MVP не находят востребованность, то проблема в нем, а не скорости разработки.

Читать далее

Почему умные NPC SkyrimNet ведут себя как попугаи? Эксперименты с ролеплейным ИИ

Уровень сложностиПростой
Время на прочтение22 мин
Охват и читатели10K

Я пытался сделать NPC более реалистичными. Получился местами несмешной анекдот, а местами — психологический триллер. Я издевался над NPC, они издевались надо мной. Я запрещал им «думать о белой обезьяне», они меня газлайтили и давили моралью. Если готовы к большому тексту — добро пожаловать.

Читать далее

Как за один Хакатон мы вживили ICQ в Битрикс24

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели2.2K

В июле 2026 года мы соединили две технологические эпохи. С одной стороны был классический ICQ начала 2000-х. С другой — корпоративный мессенджер Битрикс24. 

Мы хотели, чтобы коллеги появились в контакт-листе старой аськи, а сообщение, отправленное из ICQ, выглядело в Битрикс24 как обычное личное сообщение от сотрудника. Что получилось и как именно, рассказываю в статье.

Читать далее

Лечим вывих по методу Латарже

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели3.2K

После неудачного вывиха плеча, эта травма может повторяться снова и снова, уже от меньшей нагрузки. Такой рецидив называется повторный вывих. Веками он преследовал несчастных пациентов, а методам его лечения позавидуют пытки инквизиции: плечо буквально прижигали каленым железом, давая хоть какую-то надежду на исцеление.

Однако в пятидесятых годах XX века французский хирург Мишель Латарже придумал отпилить часть «ненужной» кости от скелета и зафиксировать ей сустав. Из этой статьи вы узнаете, откуда в скелете вообще ненужные кости и как родилась популярнейшая (на сегодняшний день) операция по лечению тяжелого вывиха плеча.

Так уж вышло, что сам я прошел эту операцию восемь месяцев назад, потому подробно расскажу не только теорию, но и впечатления от первого лица.

Читать далее

sip2go: Альтернатива SIP клиентам для Android

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели38K

Однажды заказчик, которому я разворачивал офисную телефонию спросил меня: "А можно нашим сотрудникам поставить на телефоны SIP клиенты, чтобы их разговоры с клиентами проходили через офис, попадали в CRM и записывались?"

Мысль заказчика понятна: Почему бы просто не поставить софтфон на мобильник и не настроить его на свой сервер?

Но есть несколько причин, почему это работает откровенно плохо.

Читать далее

Я больше не пишу код руками. Работать стало тяжелее

Уровень сложностиПростой
Время на прочтение20 мин
Охват и читатели11K

Да, я больше не пишу код руками. Сгенерированный код я даже не читаю: мне всё равно, как он написан, если он делает то, что должен. Реализация — расходник. Матёрый сеньор посмотрит на такой код и скажет: так не пишут. По существу он часто прав. Только вопрос давно в другом.

Легче при этом не стало, стало тяжелее. Проект «на выходные» занял два месяца, и на код из них не ушло почти ничего. Ввод текста теперь бесплатный, зато голова занята пятью задачами сразу. Написать тест оказалось сложнее, чем написать код, который он проверяет. А зелёные тесты говорят только о том, что вы догадались проверить.

Иллюзию, что агенты освободят вам вечера, лучше отбросить сразу. Рассказываю, куда ушли два месяца, что подешевело, что осталось дорогим и кто такой продуктовый инженер и за что он отвечает.

Читать далее

LLM против ZX Spectrum. Часть 3

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели11K

У меня был доступ к последним Qwen, GLM и Sol. Рядом лежали аккаунты ко всяким Claude c Astra. Не то, чтобы все это реально требовалось для разработки эмулятора ZX-Spectrum, но остановиться было тяжело. В итоге эмулятор получился просто на загляденье и вы можете прочитать про боли и решения в реальном проекте.

TL;DR: Да, за год БЯМки сильно подросли в своих умениях. Сегодня я смело могу утверждать, что по своему уровню они достигли джунов. Если убрать скорость и стоимость за скобки, то это почти настоящие кожанные мешки. Почему почти? Настоящий кожанный мешок не обладает такой широтой знаний. Но зато умеет творить. Про пруфы читать ниже (смаил).

Практически год назад я написал статью (https://habr.com/ru/articles/956344/), как я писал эмулятор ZX Spectrum на go. Потом полгода назад (https://habr.com/ru/articles/962612/) жаловался, что golang уж очень неподходящий язык для эмуляторов. И вот теперь я опровергаю сам себя…

Читать далее

Китайский ответ Bosch: история и патенты Haier

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.6K

Когда-то Haier Group был небольшим заводом, который производил дешевые холодильники. Теперь это крупная китайская корпорация, чьи акции торгуются сразу на нескольких биржах (кстати, бумаги фирмы доступны в том числе российскому инвестору). Компания производит бытовую технику (холодильники, стиральные машины и т. п.), а также потребительскую электронику. Об истории становления корпорации и ее интеллектуальной собственности рассказываем в нашем материале. 

Читать далее

Откликов все больше, ответов все меньше. Что показали 16 000 вакансий в моей базе

Время на прочтение18 мин
Охват и читатели12K

Всем привет! Этой весной я искал работу, и в какой-то момент пришел к тому, что на сами отклики у меня уходит минут тридцать, а весь остальной вечер я трачу на то, чтобы просто обойти площадки и посмотреть, не появилось ли чего нового. То есть я не работу искал, я вкладки открывал.

Вечером открываешь hh, листаешь. Потом пару телеграм каналов, где вакансия тонет за час. Потом вспоминаешь компании, куда хотелось бы попасть, и идешь по их карьерным страницам руками, а их штук пятнадцать, и на половине ничего не меняется неделями. Половину ты уже видел вчера. Закрыл вкладки, на завтра все то же самое.

Надоело, и в июне я написал себе скрипт. В июле из него вырос сервис, который с тех пор работает каждый день. Сейчас в базе больше 16 000 активных вакансий, и последние месяцы я смотрю на рынок не по ощущениям, а по своим же данным. Ощущения, между тем, мне врали.

Далее две части. Сначала про рынок и про то, что видно из базы, когда вакансии можно посчитать. Потом техническая кухня: что ломалось, что я чинил и какие места, по-моему, полезно знать заранее. Я разработчик, но парсинг, нормализация данных, Postgres, эмбеддинги и инфраструктура были для меня новыми, так что граблей набралось прилично.

И сразу заранее: все цифры ниже про мою базу, а не про рынок целиком. Спорить с ними можно и даже нужно :-)

Читать далее

Джунгли искусственного интеллекта

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели12K

Это эссе я задумал сразу после выхода книги Элиезера Юдковского и Нейта Соареса «If Anyone Builds It, Everyone Dies». Потом книгу неожиданно перевели, и мне казалось, что пост уже потерял изрядную долю актуальности для русскоязычной аудитории.

За то время как переводили книгу LLM начали решать задачи Эрдёша. Затем вышла Mythos 5, из-за которой даже разразился политический скандал, но я всё равно считал, что пока мы находимся в состоянии, когда размышления о скором конце света представляют собой скорее развлечение, сродни чтению художественного романа. Потом наступило лето.

В июле рой агентов сам спланировал и провёл атаку на сервера Hugging Face, а вскоре начали появляться расследования о других диких сообществах LLM-агентов. Не успели толком разобраться, что именно произошло, как OpenAI заявила, что её агенты решили одну из задач тысячелетия, связанную с уравнениями Навье - Стокса. Я понял, что уже мне самому нужен этот текст - хотя бы как имитация разумной деятельности в тот момент, когда мир вот-вот опрокинется в бездну (или вершину) сингулярности.

К началу истории

Ближайшие события

Apache Iceberg: Индиана Джонс и Каталог судьбы в Lakehouse

Уровень сложностиСредний
Время на прочтение15 мин
Охват и читатели8.7K

В феврале этого года проект с красивым именем Polaris незаметно стал полноценным проектом фонда Apache. Новость прошла как-то мимо, ну стал и стал, мало ли. Между тем это одна из тех новостей, которые лет через пять, возможно, будут называть поворотной точкой. Потому что Polaris — это каталог. А каталог в мире Iceberg — то самое место, где на самом деле лежит власть над вашими данными.

Звучит громко, понимаю. Поясню, откуда такая уверенность.

Последние несколько лет хранилища данных строят по новой схеме: файлы лежат в объектном хранилище, поверх них открытый формат в виде метаданных, движки обработки живут отдельно в виде федеративного обработчика и ходят за данными. Схему назвали лейкхаусом (Data LakeHouse), а формат в ней почти везде один и тот же — Apache Iceberg. Вендоры за него отвоевались, открыли и согласовали, и все выдохнули. Данные наконец-то ничьи (формат parquet): лежат у вас, читаются чем угодно, никакой платформы-хозяина.

Выдохнули рано. Зависимость от вендора никуда не делась, она переехала на другой уровень — в каталог. Сервис с виду лаконичный, держит одну-единственную вещь, указатель на актуальную версию таблицы. Заодно через него идут права доступа и временные ключи от хранилища. Получается, кто держит каталог, тот и решает, какие движки увидят ваши данные, а какие останутся снаружи.

Начнём даже не с каталогов, а на шаг раньше — с того, что такое вообще Iceberg, вокруг которого последний год прыгают все вендоры.

Читать далее

Дедупликация строк на доставщике логов: сравниваем OpenTelemetry, Vector, vlagent, Fluent Bit Grafana Alloy и Filebeat

Время на прочтение14 мин
Охват и читатели4.9K

Один и тот же стек трейс, напечатанный 50 тысяч раз, не сделает расследование инцидентов в 50 тысяч раз полезнее. Зато он честно увеличит сетевой трафик, объем хранения и время на извлечение данных.

Решение выглядит очевидно: включить дедупликацию в агенте. Но под дедупликацией у разных лог-шипперов скрываются разные вещи. Один агрегирует повторы и сохраняет их количество, другой молча оставляет только первую запись, третий умеет лишь ограничить частоту, а четвёртый показывает уникальные строки только в интерфейсе — после того как все дубли уже попали в хранилище.

Меня зовут Антон Касимов, я работаю в Gals Software, веду авторский телеграм по наблюдаемости Мониторим ИТ и я сравнил пять известных лог-шипперов (мог бы назвать их популярными, но это субъективно):

- OpenTelemetry Collector

- Vector

- vlagent

- Fluent Bit

- Grafana Alloy

- Filebeat

А затем прогнал через них одинаковый поток данных. Агентов, которые действительно умеют в дедупликацию оказалось два: OpenTelemetry Collector и Vector. У Fluent Bit задачу можно решить скриптом, а у Filebeat, vlagent и Alloy встроенного механизма дедупликации вообще не оказалось.

Вперёд!

Читать далее

Что не так с менеджментом Одиссея

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели4.7K

Разбор «Одиссеи» Нолана с точки зрения управления командой: решение, принятое из страха, риски без исследования, цена эмоций руководителя и единственный эпизод, где Одиссей поступает правильно.

Осторожно, текст содержит спойлеры

Читать далее

Пока Китай отдыхает, DeepSeek дешевеет

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели9.6K

Считать стоимость использования DeepSeek становится всё менее просто. Токены DeepSeek не одинаково полезны стоят сильно по-разному. В пиковые часы цена в два раза дороже.

Сначала пиковые часы были каждый день с 01:00 до 04:00 и с 06:00 до 10:00 UTC. Желающие экономить научились переводить UTC в MSK. Позже выходные дни стали непиковыми целиком. “Экономисты” выучили, когда начинается суббота по UTC. И когда заканчивается воскресенье.

Сейчас к непиковым дням добавляются китайские национальные праздники. Чтож, изучим и их. Ведь скоро праздник середины осени.

Читать далее

PVS-Studio для Go: краткий обзор новых диагностических правил

Время на прочтение11 мин
Охват и читатели2.8K

Вышел PVS-Studio 8.0! Мы добавили поддержку анализа Go проектов и многое другое. В этой статье мы разберем интересные диагностические правила для Go, которые мы подготовили с выходом новой версии нашего анализатора.

Читать далее

Заказ снаружи, десятки систем внутри. Как менялся IT-ландшафт «Петровича»

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели2.7K

Автор: Дмитрий Левин, системный аналитик, отдел системного и бизнес-анализа, Петрович-Тех

Когда мы слышим «Петрович», перед глазами встают обои, смеси, доски, крепеж, краска - и тот самый список покупок, который начинался с «возьмем только самое необходимое», а закончился оформлением доставки, потому что до машины все это уже было не донести.

Но за фасадом строительного ретейлера скрывается слой, который клиент никогда не видит, - IT-ландшафт. Пока покупатель выбирает товар, внутри компании работают системы учета, товарных справочников, складской сборки, маршрутизации, контакт-центра, электронного документооборота, программ лояльности, аналитики и десятков других сервисов - именно они проводят заказ через весь путь: от корзины до двери.

Это история о том, как IT-ландшафт «Петровича» вырос из одной системы в десятки специализированных и теперь движется к единой платформе. А заодно разберемся, чем занимается «Петрович-Тех» и почему его работу можно сравнить со строительством.

Читать далее

Безопасный источник энергии на тысячу лет. Ядерные реакторы IV поколения

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели633

В 2027 году Китай запускает первый в мире мегаваттный ADS (Accelerator-Driven System), управляемый ускорителем подкритический реактор на отработанном ядерном топливе.

Система ADS совмещает в себе ускоритель и реактор, близкий к технологиям IV поколения. Часть вырабатываемой энергии запитывает ускоритель, а тот поддерживает реакцию деления.

Самое главное, что ADS принимает топливо на основе радиоактивных отходов, тория-232, природного урана-238. Так мы получаем сразу несколько преимуществ и решаем главные проблемы современной ядерной энергетики.

Читать далее