Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле

В отпуске есть время подумать и исследовать. Я натолкнулся на несколько вещей и открытий для себя. Оказалось, что мне как программисту перестали быть нужны самые умные и дорогие ИИ‑модели. Оказывается, есть такой параметр «Cost per Task», и по этому параметру на первое место вырвалась модель GPT-5.6 Luna (max).

При этом, если вы пользуетесь Codex, она самая тупая в списке моделей. Artificial Analysis Intelligence Index у нее всего 38. Для сравнения, у самой умной GPT-6 Astra (max) этот индекс равен 53. В итоге цена выполненной Luna задачи составляет $0.18 против $3.26 у Astra. Разница почти в 20 раз.

Как я понимаю, бенчмарк «Cost per Task» высчитывается так: когда ставится нормальная, грамотно описанная задача, замеряется, сколько токенов было потрачено на ее выполнение. То есть не в формате «из ХЗ сделаю ТЗ», а в формате, когда в хорошо заданном вопросе уже содержится половина ответа.

Я сначала не поверил, что так и есть, и стал работать, используя самую тупую модель Luna в линейке. И знаете, какие меня ожидали результаты?

Я перестал пользоваться самыми умными ИИ‑моделями. Программировать стало быстрее и дешевле
Новость

Выступления на конференции AI R&D DAY

Время на прочтение1 мин
Охват и читатели177

17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.

Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис. 
 
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.

Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
 
Видеозаписи докладов уже доступны в наших соцсетях. А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке

Читать далее

Новости

Пост

ИИ в ИБ: инструмент для аналитика или новая точка риска?

ИИ уже помогает решать задачи, которые раньше требовали значительного участия аналитиков SOC: обрабатывать большие объёмы данных, искать связи между событиями, формировать гипотезы и ускорять расследования. Но одновременно корпоративные ИИ-системы сами становятся объектом защиты.

На вебинаре «ИИ как инструмент и объект защиты» 1 октября в 11:00 эксперты Innostage разберут обе стороны применения ИИ в ИБ.

Искандер Тиморшин, владелец продукта Innostage TDIR, расскажет, как мультиагентная система помогает сокращать объем рутинных операций аналитика и ускорять расследование инцидентов. Отдельно обсудим, как перейти от экспериментов с ИИ к его промышленному применению в SOC.

Айдар Фатыхов, владелец продукта Innostage AIDR, разберёт вопросы защиты корпоративных ИИ-систем: как защищать коммерческую тайну и другие чувствительные данные при работе с ИИ, какие риски возникают при использовании корпоративного ИИ и с чего начать выстраивание его защиты. 

Поговорим с вами о двух взаимосвязанных задачах: как использовать ИИ, чтобы усиливать ИБ, и как не превратить сам ИИ в новую неконтролируемую точку риска.

1 октября, 11:00
Подключиться к вебинару

Теги:
0
Комментарии0
Новость

Google выложила библиотеку эксклюзивных для смартфонов Pixel эмодзи Noto 3D

Время на прочтение2 мин
Охват и читатели302

Google выложила в открытый доступ библиотеку трёхмерных эмодзи Noto 3D на GitHub. Изначально они предназначались эксклюзивно для смартфонов Pixel.

Читать далее
Статья

Угрозы в сетевом трафике, или Что мы нашли в сети за 10 месяцев мониторинга

Уровень сложностиПростой
Время на прочтение19 мин
Охват и читатели512

Для эффективного обнаружения киберугроз в сетевом трафике необходимо регулярно анализировать информацию из различных источников. Отдельные средства защиты выявляют лишь часть признаков вредоносной активности, а для получения общей картины необходимо сопоставлять результаты их работы. Поэтому решения стоит использовать совместно и анализировать события в едином контексте — благодаря этому растет достоверность интерпретации.

Мы проанализировали публичные сведения об инцидентах информационной безопасности, исследования авторитетных организаций и экспертов, взяли собственную экспертизу Positive Technologies, обезличенные данные PT Sandbox, полученные в результате анализа файлов из сетевого трафика PT Network Attack Discovery. Информация в статье охватывает период с октября 2025 года по июль 2026 года.

Читать далее
Новость

Релиз Meta Test 2.0 — российской платформы для создания и запуска автотестов веб‑приложений без навыков программирования

Время на прочтение2 мин
Охват и читатели407

Состоялся второй мажорный релиз проекта Meta Test. Это российская платформа для создания и запуска автотестов веб-приложений без навыков программирования.

Читать далее
Статья

Федерация корпоративного мессенджера: как связать независимые On-Premise-контуры и сохранить контроль над данными

Время на прочтение9 мин
Охват и читатели540

Корпоративный мессенджер обычно работает внутри управляемого контура: ИТ управляет доступом, информационная безопасность — политиками и потоками данных. Но проектные команды редко совпадают с юридическими границами компании. Сотрудникам нужно постоянно общаться с подрядчиками, партнерами и коллегами из дочерних обществ, и желательно не переносить рабочий контекст в публичные сервисы.

В ноябре 2025 года мы выпустили федерацию VK WorkSpace для двух On-Premise-инсталляций. В релизе 26.2, вышедшем в июле 2026 года, сняли ограничение на парное взаимодействие: теперь в одном чате могут работать участники из нескольких независимых контуров. В статье разберем, как устроена модель доверия, почему мы выбрали репликацию данных на стороне каждой организации, что пришлось изменить в клиентских приложениях и какие ограничения у решения остаются.

Меня зовут Андрей Ковайкин, я старший менеджер продукта направления Мессенджер в команде VK WorkSpace. Мы развиваем единый контур корпоративных коммуникаций, а федерация решает его внешний сценарий: позволяет организациям общаться между собой, не объединяя инфраструктуру, администрирование и политики безопасности.

Читать далее
Статья

Windows 11 принудительно включит защиту ядра. Убьет ли это fps

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели491

Microsoft объявила, что с октября начнет включать целостность памяти на подходящих компьютерах самостоятельно, не спрашивая пользователя. Первым обновлением с этим изменением станет ежемесячный набор исправлений 13 октября. Сама по себе эта штука довольно полезная, и спорить с этим трудно, но у нее есть побочный эффект. Про него говорят нечасто, но геймеры знают о нем уже несколько лет. Собственно, из-за особенностей этой функции многие уже давно сняли эту галку в настройках.

Читать далее
Новость

В связности стран Центральной Азии зависимость от российского сетевого транзита снижается, а флагманом стал Казахстан

Время на прочтение3 мин
Охват и читатели436

За последние четыре года в связности стран Центральной Азии зависимость от российского сетевого транзита снизилась, пишет RIPE Labs. Местные операторы и власти диверсифицируют маршруты, расширяют сети точек обмена интернет‑трафиком и укрепляют безопасность маршрутизации. Растёт не только количество прямых соединений между региональными сетями, но и связи с Пакистаном, Китаем, Азербайджаном и Европой, которые предоставляют новые альтернативы традиционным маршрутам.

Читать далее
Статья

Штраф за несвоевременную подачу акта по рекламе: разбор реального кейса, и как снизили штраф в 2 раза

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели593

В один обычный рабочий день на почту ООО пришло определение об истребовании сведений, необходимых для разрешения дела, в том числе сведений (информации), необходимых для расчета размера административного штрафа. Простыми словами: в отношении ООО было возбуждено дело об административном правонарушении. Причина — пропущенный срок подачи акта по Интернет‑рекламе. Возможная сумма штрафа ощутимая для малого бизнеса. Как так вышло и что было дальше — читайте в этом разборе.

Читать далее
Статья

474 712 строк за 35 лет: как мы с LLM и 21 экспертом приводим в порядок справочник автосервиса

Уровень сложностиСредний
Время на прочтение14 мин
Охват и читатели815

НАР РУЧКУ ДВЕРЬ РАСПАШ З ПР С/У

Это не битая кодировка и не ошибка миграции. Это настоящее название работы из нашего справочника. За 35 лет в нём накопилось 474 712 строк: сокращения, дубли, опечатки, разные языки и разные варианты одной и той же операции.

Опытный мастер-консультант многое понимает по контексту. Для специалиста по записи клиентов и аналитика такой справочник уже становится системной проблемой: первый зависит от знаний более опытных коллег, второму приходится вручную собирать разные названия одной операции.

Мы столкнулись с этим при разработке Dealer Digital Platform «Флора». Проект ещё не завершён, но основную часть нормализации уже прошли: дедуплицировали массив, дважды провели его через экспертную проверку и для 96,13% работ после дедупликации подтвердили корректный узел.

Я решил рассказать об этом сейчас, не дожидаясь финального релиза: основные грабли уже случились. Мы отказались от полнотекстового поиска, несколько раз перестроили работу LLM и экспертов, научились возвращать экспертный фидбек в правила и skills агента и ошиблись больше чем втрое в оценке производительности на одной из задач.

Если вы работаете с историческими справочниками, master data или LLM-классификацией, значительную часть этого опыта можно перенести и за пределы автобизнеса.

Читать далее
Новость

Rust стал языком первого уровня в Microsoft

Время на прочтение3 мин
Охват и читатели1.1K

Rust стал языком первого уровня (Tier-1) в Microsoft наряду с C++, C# и TypeScript, являясь одним из наиболее поддерживаемых языков для внутренней разработки. 

Читать далее
Статья

Вы просили вернуть Suno v5, а мы сделали лучше. Встречайте Grom Zvuk

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели1.3K

В мире генеративного ИИ всё меняется стремительно. Этим летом музыкальное ИИ-сообщество столкнулось с сюрпризом: разработчики Suno навсегда отключили полюбившиеся многим старые версии моделей (v4, v4.5, v5 и v5.5).

Пользователи нашей ИИ-платформы GPTunneL (агрегатора нейросетей) массово жаловались: пропал тот самый вайб, а новые алгоритмы стали слишком жесткими. К тому же в Suno всегда была одна фундаментальная проблема, которая бесила многих креаторов – там нельзя было просто взять и поменять текст в уже готовом, сгенерированном треке.

Мы выслушали боль нашей аудитории, посмотрели на то, чего не хватает рынку, и решили сделать свой продукт.

Сегодня, 18 сентября, мы официально запускаем Grom Zvuk – нашу собственную музыкальную ИИ-модель. Она работает на наших серверах, выдает крутое качество, делает невероятные каверы и стоит дешевле западных аналогов. Рассказываем, как она устроена и на что способна.

Читать далее
Статья

Количественная торговля: как искать структуру в шуме и не переобучить модель

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.2K

Как сделать количественную торговлю эффективной? Не каждый аналитик может дать ответ на этот вопрос, но эффективная алгоритмическая торговля базируется на поиске структуры в зашумлённых рыночных данных. Это поиск закономерностей или областей предсказуемости. Например, если рынок растёт два дня подряд, то он обычно растёт и на третий день. Если такое происходит довольно часто, значит, мы нашли закономерность, которую искали. Далее следует торговая стратегия: если рынок растёт два дня подряд, покупайте на закрытии второго дня и продавайте на закрытии третьего. Однако не всё так просто.

Читать далее

Ближайшие события

Статья

Как я сделал спутник для Codex и дошел до разработки из электрички

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели1.5K

Утром оставляю ноутбук включенным и еду на работу. По дороге открываю на телефоне режим «удаленно» и обсуждаю с агентом, что еще доделать в моем приложении. Он пишет код, присылает картинки интерфейса и покадровую нарезку анимаций. Я смотрю: норм или не норм. Если готово — выпускаем.

Приложение — маленький пиксельный спутник, который показывает, чем занят Codex. Называется CoPet. Я работаю аэрокосмическим инженером, люблю все пиксельное и хочу постоянно видеть, что делает мой ИИ‑товарищ. Поэтому спутник с телеметрией в углу рабочего стола кажется мне совершенно естественной потребностью. Такой профессиональный фетиш.

До этого проекта я никогда не собирал самостоятельных приложений. Весь мой опыт программирования помещался в учебные тетрадки Jupyter. Как устроить программу для Windows, как ее запускать и вообще с какой стороны подойти к GitHub — предстояло выяснить.

Начал примерно так: хочу, чтобы Codex работал, а CoPet показывал состояния. Кодекс пыхтел‑пыхтел, сказал «готово». Проверяем — нифига не работает. Окно есть, состояния не меняются.

И началось.

Читать далее
Статья

Wi-Fi из PHP: сканирование, подключение, хотспот и watchdog для Raspberry Pi без монитора и клавиатуры

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели1.8K

Библиотека для PHP, которая сканирует и подключает Wi-Fi, поднимает хотспот и держит на связи Raspberry Pi без монитора: если сеть пропала, watchdog переподключается сам, а если не выходит, поднимает точку доступа для настройки с телефона. Под капотом nmcli, wpa_cli и hostapd. Каждый релиз прогоняется на настоящем Pi, логи в репозитории.

Читать далее
Статья

Почему юридический AI‑сервис нельзя строить как обычный чат: проектируем case‑first SaaS на Go

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели1.6K

Несколько месяцев назад мне понадобилось заключить договор с Леноблводоканалом. Казалось бы, обычная бюрократическая задача: отправил документы, получил ответ, подписал договор. На практике ответа долго не было. Юриста у меня не было. Зато был AI.

Я описал ситуацию, приложил документы и попросил помочь разобраться, какие у меня вообще есть варианты. В результате подготовил две жалобы в УФАС. Через некоторое время история сдвинулась с места, и договор со мной в итоге заключили.

Не хочу делать из этого вывод в духе «ChatGPT заменил юриста». Наоборот. Когда я позже посмотрел на этот процесс уже как backend-разработчик, самым интересным оказалось другое:

обычный чат — довольно плохая архитектура для решения подобных задач.

Именно из этого наблюдения появилась идея небольшого SaaS-проекта.

Читать далее
Пост

Как пройти путь от полного запрета ИИ до AI Native, где код пишут сотни агентов? Расскажем на GoCloud Tech 2026

Внедрение ИИ в разработку — это, к сожалению, не тумблер из легендарной Need for speed, который щелкнул и ускорился. По нашему опыту это путь через пять уровней зрелости, на каждом из которых свои бонусы и грабли. Расскажем, как мы продвигались от тотального запрета на ИИ к AI Native подходу, где сотни агентов пишут код практически без участия человека. Еще честно разберем, где ИИ реально дает +150% к продуктивности, а где превращается в −100% нервов. Обсудим потерю контекста, когнитивную усталость, боль с поддержкой легаси-кода и разный уровень зрелости внутри одной команды, а еще посмотрим на ситуацию глазами компании: безопасность, ценность SDD (spec-driven development) и границу между личными инструментами разработчика и корпоративной ИИ-инфраструктурой.

Спикеры:
Михаил Трифонов — лидер продуктовой платформы, Cloud.ru;
Руслан Таболин — руководитель направления, Cloud.ru.

Трек: Разработка

📅 Когда: 15 октября в 12:00–12:40 мск.

👉 Зарегистрироваться

А пока ждете выступление, можете посмотреть результаты нашего исследования: Почему пилотные ИИ‑проекты умирают, а теневое использование живет: итоги опроса

Теги:
0
Комментарии0
Статья

Статьи по Go, которые стоит почитать

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели1.4K

Если посмотреть на самые обсуждаемые публикации Go-сообщества последних месяцев, можно заметить любопытную закономерность. Среди них почти нет материалов про новые конструкции языка, generics или очередные изменения синтаксиса.

Зато много статей про диагностику утечек горутин, профилирование памяти, внутреннее устройство рантайма, особенности современных процессоров и эксплуатацию высоконагруженных PostgreSQL-кластеров.

В 2026 году экосистема Go значительно «повзрослела». Сама спецификация языка уже стабилизировалась, и фокус инженерного внимания сместился в сторону эксплуатации (Production Engineering) — предсказуемости памяти, автоматической диагностики рантайма, управлению ресурсами железа и устойчивости баз данных под высокой нагрузкой.

На связи команда Golang-инженеров Авито, а ниже — несколько публикаций, которые хорошо показывают этот сдвиг.

Читать далее
Статья

43 минуты в месяц. Как бюджет ошибок заканчивает спор о надёжности

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели1.6K

Когда команда спорит между новыми релизами и надёжностью системы, решения часто принимаются на уровне мнений. Разберём, как бюджет ошибок помогает перевести этот разговор в цифры: оценивать риски, управлять приоритетами и находить баланс между скоростью разработки и стабильностью.

Читать далее
Новость

Гейтс: власти ни одной из стран не готовы к изменениям под влиянием ИИ

Время на прочтение2 мин
Охват и читатели1.7K

Основатель Microsoft Билл Гейтс в интервью агентству Reuters заявил, что ни одно правительство в мире не готово к тем переменам, которые привнесёт искусственный интеллект.

Читать далее
1
23 ...