Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Путь к ИИ‑сингулярности

У нас было два репозитория неоттестированного вайб‑кода, семьдесят пять тяжеловесных SDD‑спецификаций, пять обмазанных смазкой харнессов, солонка, наполовину полная кастомных скиллов и забитых капслоком правил, с десяток дырявых MCP‑серверов, RAG‑база со свежевекторизованным Confluence, самодельная дощечка имаго‑кодинга и целая россыпь автономных агентов всех мастей, от безобидных автодополнялок до галлюцинирующих субагентов, ставящих пакеты со slopsquatting и втихаря сносящих боевые базы.

Не то чтобы все это было действительно нужно для поездки к ИИ‑сингулярности, но если уж начали участвовать в спуске с горы на велосипеде без седла, остановиться уже невозможно.

Единственное, что вызывало у меня настоящий животный страх, это передача ответственности за ревью самой модели. Тот самый момент, когда седьмой агент подтверждает галлюцинации шестого, потому что все тесты зеленые, и я знал, что рано или поздно мы перейдем на эту дрянь.

Нет ничего более беспомощного, безответственного и испорченного, чем IT‑команда, запустившая мультиагентный оркестр в режиме allow all.

Это критический (и слегка ехидный) обзор того, что произошло с разработкой последние пару лет.

Путь к ИИ‑сингулярности
Новость

День Интернета: почему корзина означает «удалить», а шестерёнка — «настройки»

Время на прочтение3 мин
Охват и читатели471

30 сентября в России отмечают День Интернета. За несколько десятилетий сеть изменила не только то, как мы работаем и общаемся, но и то, как мы взаимодействуем с технологиями.

Откройте незнакомое приложение и попробуйте найти настройки. Скорее всего, взгляд сам остановится на шестерёнке, нужно удалить файл — ищем корзину. Даже если интерфейс новый, а подписи незнакомы, многие действия мы считываем почти не задумываясь.

Разбираемся, как у цифровой среды появился собственный визуальный язык и почему старые метафоры до сих пор работают.

Читать далее

Новости

Новость

Тем, кто размещает на хостинге VPN, будут запрещать на год пользоваться абсолютно любыми российскими хостингами

Время на прочтение1 мин
Охват и читатели683

Начал изучать новый законопроект Минцифры по борьбе с мошенничеством. Нашел интересное:

Федеральный орган исполнительной власти, осуществляющий функции по контролю и надзору в сфере средств массовой информации, массовых коммуникаций, информационных технологий и связи, ведет в порядке, определенном Правительством Российской Федерации, реестр лиц, размещающих на вычислительных мощностях провайдеров хостинга информационно-телекоммуникационные сети, информационные ресурсы (сайт в сети «Интернет» и (или) страница сайта в сети «Интернет», информационная система, программа для электронных вычислительных машин), посредством которых обеспечивается доступ к информационным ресурсам, информационно-телекоммуникационным сетям, доступ к которым ограничен на территории Российской Федерации в соответствии с настоящим Федеральным законом, владельцы которых не выполнили требования, установленные пунктом 1 части 7 статьи 158 настоящего Федерального закона. Правительство Российской Федерации определяет состав информации, подлежащей включению в указанный реестр.

54. Провайдер хостинга при наличии информации, содержащейсяв реестре, предусмотренном частью 53 настоящей статьи, не может осуществлять деятельность по предоставлению вычислительной мощности для размещения информации в информационной системе, постоянно подключенной к сети «Интернет», лицам, содержащимся в указанном реестре и обратившимся к провайдеру хостинга в течение одного года с момента включения такой информации в реестр.

А например если там бот для telegram работает через прокси - тоже на всех хостингах забанят на год? Этак большая часть бизнесов в России закроется. И все айтишники релоцируются.

Читать далее
Статья

Первая проверка «шести рукопожатий» насчитала девять. Дошли 3 письма из 60

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели2.7K

Про шесть рукопожатий знают все, и почти все знают, что это как-то связано с Милгрэмом и письмами где-то в шестидесятых. Но на этом знание обычно заканчивается: есть цифра шесть, есть фамилия, а между ними пустота, которую заполняют пересказы пересказов. Мне стало интересно, что именно Милгрэм проверял, на скольких людях и что у него получилось в действительности, поэтому я окунулся в первоисточники и в работы тех, кто уже успел побывать в его архиве.

Самая первая попытка выглядела так: в Уичито, штат Канзас, по объявлению в газете набрали 60 добровольцев, и до адресата в Кембридже дошли 3 письма, каждое из которых прошло в среднем через восемь человек, то есть девять рукопожатий. Эти цифры Милгрэм так и не опубликовал, а в популярную статью попала ровно одна цепочка из трех, и, как мы дальше увидим, самая короткая.

Дальше расскажу, как был устроен тот эксперимент, куда деваются письма, почему потери портят не только процент успеха, но и саму измеренную длину цепочки, и что получилось у тех, кто перепроверял Милгрэма уже на миллионах людей.

Читать далее
Статья

Зыбкая грань между элементарными и специальными функциями

Время на прочтение3 мин
Охват и читатели2.5K

Мы часто используем привычные нам математические объекты и порой не задумываемся, почему они устроены именно так, а не иначе. На этот вопрос бывает ответить совсем не просто, ведь для этого необходимо взглянуть на повседневные вещи под совершенно другим углом или глубоко обобщить накопленную по ним информацию.

Сегодня я предлагаю подробно разобрать и обобщить информацию об элементарных и специальных функциях. Как мы увидим далее, грань между ними далеко не так очевидна, как кажется на первый взгляд.

Читать далее
Статья

Асимметрия как методологический и инструментальный принцип тестирования моделей

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели2.3K

Цель статьи – показать практический потенциал идеи асимметрии: она возникла как логико-риторическое правило, а сегодня стала реальным методологическим и инструментальным вектором в разработке ИИ.

Фактор логики

Отношение категорий «доказать» и «опровергнуть» имеет асимметричную логическую структуру – один точно подобранный контрпример опровергает утверждение с квантором общности, при этом любое число подтверждающих случаев его не доказывает. Иначе говоря, никаким количеством и качеством подтверждающих аргументов, тестов, экспериментов нельзя доказать общее суждение. Индуктивное умозаключение выполняет не доказательную функцию, а увеличивает степень правдоподобия вывода. Все это известно еще
со времен Аристотеля.

В среде IT эта асимметрия знакома по формуле Эдсгера Дейкстры с конца 1960-х в формулировке «тестирование способно показать наличие ошибок
и никогда не покажет их отсутствия».

О чем мы говорим конструктивно, или методологические следствия для тестирования

Из принципа асимметрии следует распределение усилий по проверке, которая должна следовать той же логике. Тогда разумной стратегией является либо целенаправленный поиск опровергающих случаев (контрпримеров), либо переход от тестирования к формальному доказательству свойства. Промежуточным режимом между этими полюсами является статистическая гарантия.

Отсюда методологические следствия:

Читать далее
Статья

«Выросли на 11% к прошлому месяцу» — и ни одного нового клиента

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели2K

В феврале 28 дней, в марте 31, продавайте одинаково каждый день — и рост на 11% появится сам, без новых клиентов.
В статье разбираю базу, как календарь и сезонность ломают отчёты: три вопроса перед сравнением периодов, SQL-запросы для среднего за день и скользящего среднего, ловушки сравнения год к году.

Читать далее
Статья

Облака над горами: что они нам могут рассказать о ветрах на высоте?

Время на прочтение14 мин
Охват и читатели2.1K

Облака над горами: что они нам могут рассказать о ветрах на высоте?

Съездив  в отпуск в Сочи летом, я также оказался  на верхней точке горнолыжного курорта «Красная поляна».

До этого я бывал в горах  только зимой, когда катался на лыжах.

Летние горы выглядят несколько иначе, чем зимой, особенно это касается  наблюдаемого поведения облаков на склонах и гребнях гор.

Летом  влаги в  воздухе содержится в разы больше,  чем зимой, что делает  летние облачные процессы намного ярче для визуального наблюдения, особенно на  фоне тёмных  каменных склонов и зелёной растительности (см.рис.1-2.)

 

Читать далее
Новость

Reasoning-версию GigaChat 3.5 теперь можно подключить в Evolution Foundation Models

Время на прочтение2 мин
Охват и читатели2K

Летом коммерческий доступ открыли к GigaChat 3.5 Ultra, теперь же в каталоге сервиса Evolution Foundation Models стала доступна версия отечественной нейросети с режимом рассуждений GigaChat 3.5 Reasoning. Модель ориентирована на задачи, связанные с бизнесом, финансами и юриспруденцией и подключается по OpenAI-совместимому API без самостоятельного развертывания инфраструктуры для инференса. Стоимость составляет 96 ₽ за 1 млн входных и 289 ₽ за 1 млн выходных токенов.

GigaChat 3.5 Reasoning построена на той же архитектурной базе, что и уже доступная в сервисе GigaChat 3.5 Ultra. У обеих моделей 432 млрд параметров суммарно и около 28 млрд активных параметров на токен, гибридный механизм внимания MLA + GatedDeltaNet и контекстное окно до 262 тысяч токенов. Поэтому отличие новинки не в размере или длине контекста, а в способе дообучения и решения задач.

Модель дополнительно дообучили с помощью online RL — обучения с подкреплением на решениях, которые она генерировала сама. Разработчики отдельно обучали шесть версий для разных классов задач: математики и естественных наук, генерации кода, работы с репозиториями, агентных сценариев, диалога и следования инструкциям. Для проверки применяли разные сигналы: от сверки финального ответа и запуска тестов до оценки состояния среды после вызова инструментов. Затем полученные навыки объединили в одной модели методом on-policy distillation.

На опубликованных разработчиками тестах наиболее заметный прирост относительно GigaChat 3.5 Ultra Instruct получен в программировании, планировании и следовании инструкциям. Результат IFBench вырос с 43,66 до 77 баллов, Natural Plan — с 64 до 80,19, а LiveCodeBench v6 — с 56,2 до 85,4. Это сравнение показывает преимущество Reasoning в конкретных многошаговых задачах.

Читать далее
Статья

Самый разрушительный технологический переход в истории

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели3K

Мне всего 44, но я помню мир без интернета, мобильных телефонов, навигаторов и мессенджеров. Чтобы позвонить своей будущей жене, я бегал к уличному таксофону и бросал монетку в аппарат. Чтобы что-нибудь узнать, шел в библиотеку и открывал Большую советскую энциклопедию, такой бумажный Google, только без рекламы, комментариев и возможности за три минуты поставить себе смертельный диагноз. Я ездил по городу без навигатора. И мы каким-то чудом умудрялись встречаться с друзьями в точно назначенное время на другом конце города, без возможности поделиться геолокацией и написать “я уже почти подъехал”, когда даже еще не вышел из дома... Это было удивительное время.

Мы легко встречали новые технологии и довольно быстро к ним приспосабливались. Интернет, мобильная связь, компьютеры, смартфоны — все это входило в нашу жизнь постепенно, оставляя нам время освоиться и привыкнуть. Но сейчас скорость изменений стала совсем другой. Мы все еще уверены, что так же легко адаптируемся ко всему следующему? Хотя, боюсь, мы даже близко не представляем, что нас ждет впереди. И на этот раз времени привыкнуть нам могут уже не оставить.

Не, я не буду писать про то, что ИИ резко выйдет из-под контроля, начнет улучшать сам себя и переиграет человечество за считанные месяцы. Скорее всего никакого восстания машин вообще не произойдет: мы просто шаг за шагом передаем алгоритмам управление бизнесом, экономикой, армией и государством, потому что решения ИИ оказываются эффективнее человеческих. В итоге люди формально остаются у руля, но уже ничего толком не решают.

Как вам такое мнение одного из пользователей соцсети:

Читать далее
Статья

Добро пожаловать в пластмассовый мир. Как работает модель BrickGPT/LegoGPT

Время на прочтение6 мин
Охват и читатели2.6K

Приветствую, уважаемые читатели.

Эта статья будет настолько философской и платонической, насколько это возможно на Хабре.

Читать далее
Новость

AMD поглощает World Labs: к команде присоединится «крестная мать ИИ»

Время на прочтение3 мин
Охват и читатели1.9K

AMD покупает стартап World Labs за 8,2 млрд $ акциями. Основательница World Labs Фей-Фей Ли, профессор Стэнфорда и автор датасета ImageNet, с которого в 2012 году началась эпоха глубокого обучения, станет исполнительным вице-президентом и главным научным сотрудником AMD с прямым подчинением CEO Лизе Су. Закрытие сделки ожидается до конца 2026 года после всех нюансов и одобрения регуляторов.

Читать далее
Новость

Разработчик сумел запустить на эмуляторе невышедшую ОС Apple Copland

Время на прочтение2 мин
Охват и читатели2.1K

Разработчик Майкл Стейл сумел запустить на эмуляторе ОС Apple Copland, которая разрабатывалась в 90-х. Для запуска Стейл модифицировал эмулятор Power Mac с открытым исходным кодом DingusPPC; по его словам, для успешного запуска системы потребовалось внести 11 патчей. 

Читать далее
Статья

Быстрые кешбэки для быстрых платежей: как работает платформа лояльности НСПК

Время на прочтение12 мин
Охват и читатели2.4K

Типичный кешбэк, как правило, приходит в конце расчётного периода. Иногда увидеть вознаграждение можно через несколько недель. Но если сам платёж проходит быстро, почему бы не сделать таким же быстрым и вознаграждение?

На связи Константин Гузаров, эксперт направления в команде платформы лояльности «Мир Plat.Form», технологической команды Национальной системы платёжных карт (НСПК), и сегодня я расскажу, как мы запускали моментальный кешбэк за покупки по Системе быстрых платежей (СБП) и что пришлось изменить в платформе, чтобы вознаграждение приходило практически одновременно с платежом. 

Сейчас кешбэк за покупку по СБП начисляется мгновенно по заведённым акциям. Для пользователя это выглядит просто: оплатил покупку — получил кешбэк. Но между этими двумя событиями происходит цепочка операций: процессинговый центр лояльности (ПЦЛ) получает информацию о транзакции, проверяет условия акции, учитывает историю покупок клиента, определяет размер вознаграждения и инициирует процесс выплаты. 

Читать далее

Ближайшие события

Статья

Как мы собрали ИИ-конвейер для разметки продуктового фидбэка

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели2.3K

Привет! На связи Андрей Безруков из команды Авито Рекламы. Если вы работаете с обратной связью от пользователей, то наверняка понимаете, что для разбора нужно не только увидеть комментарий о проблеме, но и понять её точный смысл, сохранить все затронутые темы и применить консистентные правила разметки. Наша команда собрала для этого систему из специализированных ИИ-агентов, Python-помощника и обновляемой таксономии.

В этой статье рассказываем, как распределить задачи между инструментами, чтобы они действительно помогали вам быстрее анализировать фидбэк.

Читать далее
Пост

Тестирую недавно вышедшую SOM (system one model) Laya для наделения CanvasDesk сверхсилами по автодополнению.

Как пользователь, я хочу чтобы проектирование в CanvasDesk было с молниеносным флоу. Я решил тестово прикрутить под это Laya - свежий open-source аналог нашумевшего облачного движка Jev от TypeSafe AI.

Почему не обычная LLM? Большие языковые модели для подсказок в реальном времени не годятся их генерация съедает от секунды до трёх. Я бы не стал ждать автогенирацию так долго. Jev и Laya - из класса System One Models: модели "быстрых интуитивных реакций". Они не разворачивают текст токен за токеном, а за один проход решают типизированные задачи: классифицируют, ранжируют варианты и выдают калиброванную вероятность.

Jev сидит в закрытом облаке по API. Laya вышла под Apache 2.0 и полностью совместима с ним по протоколу, но разворачивается локально. Размер ~421 миллионов параметров. Задержка около 33 мс на GPU и 200–450 мс на обычном офисном CPU. Не требует гонять контекст схемы через внешнюю сеть - для CanvasDesk в b2b исполнении это принципиально.

Что это даёт на практике:
1/ автодополнение формул и переменных: набираешь расчёт нагрузки, система цепляет переменные из апстрим-узлов и предлагает формулу, проверенную локальным парсером,
2/ next-node подсказки: поставил шаблон балансировщика - движок предлагает связать его с очередью и пулом воркеров,
3/ адаптация под роль: архитектору - параметры теории очередей, продакту - связки конверсий и когортного LTV.

Задача Laya - работать умным стрелочником: отбирать лучшие паттерны из каталога за доли секунды и отдавать их только при высокой уверенности. Если эксперимент взлетит, сборка схем перестанет быть укладкой асфальта вручную.

Пока заворачиваю Laya в локальный sidecar на базе python. Результаты теста и замеров скорости выкачу отдельным постом.

А пока можно самостоятельно потестить WASM версию CanvasDesk и написать в комментарий про свой опыт

Теги:
+2
Комментарии0
Новость

Китай строит свою CUDA. DeepSeek выложила TileLang, DeepGEMM и DeepEP для Huawei Ascend

Время на прочтение3 мин
Охват и читатели2K

DeepSeek известна открытыми моделями уровня фронтира при скромных бюджетах. И тут лаборатория выложила в открытый доступ шесть инструментов для программирования ускорителей Huawei Ascend. В набор вошли язык TileLang, библиотеки DeepGEMM, DeepEP, TileKernels, FlashMLA и DeepSelect. Параллельно Huawei рассказала о совместно спроектированной суперноде на 128 чипах Ascend 950.

Читать далее
Статья

range-for перестал ронять программу на временном объекте, зато теперь дольше держит мьютекс

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели2.7K

range-based for в C++ выглядит безопасным местом, пока в него не попадает временный объект с внутренней ссылкой. Такой код может годами работать в продакшене, а затем начать читать освобождённую память после смены компилятора или настроек сборки. В статье разбирается, как C++23 изменил время жизни временных объектов в таких циклах, почему поддержка стандарта зависит от компилятора и какие проверки помогут найти проблемные места в кодовой базе.

Узнать детали
Новость

В OpenIDE обновили поддержку PHP: анализаторы, удалённая отладка и подсказки типов

Время на прочтение2 мин
Охват и читатели2.4K

Вышла версия 0.9.3 плагина PHP for OpenIDE. Переработали настройки внешних анализаторов, добавили отладку через DBGp-прокси и исправили работу с путями к файлам на удалённых серверах и в контейнерах. Также улучшили определение типов, автодополнение и форматирование PHP-кода.

Читать далее
Статья

В Сингапуре тестируют сервис знакомств для госслужащих

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели3.4K

Государственное технологическое агентство Сингапура (Government Technology Agency of Singapore, GovTech) запустило FirstDate, пилотный проект, использующий алгоритм Гейла — Шепли для подбора пар среди государственных служащих в возрасте от 21 до 35 лет. Проект появился на фоне исторически низкой рождаемости в Сингапуре и уже вызвал в интернете как интерес, так и критику.

Некоторые государственные служащие Сингапура могут обнаружить в своей электронной почте необычное приглашение: возможность найти пару через сервис знакомств с верификацией с помощью Singpass, запущенный GovTech.

Ведомство начало пилотный проект FirstDate для государственных служащих в возрасте от 21 до 35 лет. Вместо бесконечной ленты анкет сервис подбирает пары с помощью алгоритма. «Усталости от свайпов больше нет», — говорится на сайте FirstDate. Сейчас проект тестируют в системе государственной службы. Его цель, как сказано на сайте, — способствовать возникновению «осмысленных знакомств». Заявки на участие в текущем раунде принимаются до 5 октября 2026 года. Участвовать могут не состоящие в браке, овдовевшие или разведённые люди.

Читать далее
Новость

В Larian Studios не поняли хейта вокруг ограничений по времени в The Blood of Dawnwalker

Время на прочтение1 мин
Охват и читатели2.8K

Издатель Baldur’s Gate 3 Майкл Даус публично вступился за главную фишку The Blood of Dawnwalker — жесткий лимит по времени. Он заявил, что искренне удивлен шквалом критики в адрес этой механики.

Читать новость далее
1
23 ...