Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Мощный ИИ агент в 16гб VRAM

Недавно я обновил свою видеокарту до RTX-5060-TI 16GB. Получив новую карту я решил исследовать, что можно на ней запустить из нейросетей. Традиционно пишут, что нормальные ИИ модели начинаются с rtx3090 и выше, что ниже 24GB VRAM жизни нет. В этой статье я постараюсь развеять этот миф.

Мощный ИИ агент в 16гб VRAM
Пост

Как не провалить пилот ESB: разберем два реальных сценария на онлайн-конференции

Когда компания выбирает новую интеграционную шину, почти всегда возникает идея: сначала провести пилот. На бумаге все выглядит просто — взять несколько интеграций, проверить платформу и понять, подходит ли она под текущий ИТ-ландшафт.

На практике вопросов гораздо больше.

  • Что именно включать в пилот?

  • Какие сценарии действительно показательны?

  • Нужно ли проверять только функциональность или еще производительность, мониторинг и удобство сопровождения?

  • Стоит ли отдавать пилот интегратору или пробовать силами внутренней команды?

15 сентября в 11:00 вместе с DATAREON проведем онлайн-конференцию «Архитектурная лаборатория: как выбрать ESB под вашу ИТ-архитектуру». Разберем не только возможности платформы, но и то, как организовать пилот так, чтобы он действительно помог принять решение.

Что будет в программе

Сергей Скирдин, технический директор «Белого кода», расскажет:

  • как сегодня выглядит российский рынок шин данных;

  • какие критерии стоит учитывать при выборе ESB;

  • в чем преимущества DATAREON Platform;

  • зачем пилотировать платформу на реальном ИТ-ландшафте;

  • какие задачи стоит закладывать в пилот.

Иван Макушов, аналитик Ikon Tyres, поделится опытом пилота с внешним подрядчиком:

  • как в компании подходили к выбору новой интеграционной платформы;

  • какие технические требования сформировали;

  • какие сценарии включили в пилот;

  • на что стоит обратить внимание при работе с интегратором..

Дмитрий Сидоренков, архитектор 1С «Уральской Агропромышленной Группы», расскажет про другой путь — пилот и дальнейшее внедрение внутренними силами:

  • почему одного обучения недостаточно, чтобы начать реальный проект;

  • какие специалисты нужны внутри команды;

  • почему хотя бы один человек должен быть глубоко погружен в проект;

  • где самостоятельной команде все же полезна внешняя экспертная поддержка;

  • как перейти от первого работающего обмена к самостоятельному развитию интеграций.

По сути, сравним два сценария:

пилот с подрядчиком
и
пилот внутренней командой.

Если вы сейчас выбираете ESB, планируете пилот DATAREON или пытаетесь понять, сколько своих ресурсов придется в него вложить, думаю, этот разговор будет полезен.

15 сентября, 11:00 по МСК

Участие бесплатное, нужна регистрация.

Регистрация

Теги:
0
Комментарии0

Новости

Статья

CSS в 2026 году: где JavaScript уже не обязателен

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели608

Когда работаешь с такими масштабными продуктами, как мы делаем в VK, быстро начинаешь ценить код, который можно не писать. Особенно если речь о небольших сценариях: открыть поповер, анимировать появление блока или подстроить поле под контент. Ещё недавно для таких задач мы почти автоматически тянулись к JavaScript. Но за последние два года CSS сильно расширил свои возможности для задач, связанных с интерфейсом.

Я Максим Кузнецов, занимаюсь оптимизацией производительности и улучшением стабильности веб-версий ВКонтакте. В этой статье расскажу, что уже можно использовать как альтернативу JS, что стоит попробовать аккуратно, а за чем пока лучше просто следить.

Читать далее
Пост

Системный промпт GPT-6 Astra слили в сеть — файл занимает 331 КБ

В открытом доступе появился файл с системными инструкциями, связанными с GPT-6 Astra и Codex. Репозиторий на GitHub содержит документ на 5051 строку и около 331 КБ.

Внутри собраны инструкции, которые описывают поведение модели: работу с пользователем, правила принятия решений, автономность, стиль общения, работу с инструментами, разрешениями и другими компонентами агентной системы.

Например, в опубликованном тексте отдельно описаны:

правила запроса разрешений и выполнения действий;
— принципы автономной работы агента;
— требования к стилю и технической коммуникации;
— работа с файлами, инструментами и подключаемыми приложениями;
— логика многоагентной работы;
— внутренние ограничения и режимы взаимодействия.

При этом важно понимать: наличие такого файла в публичном репозитории само по себе не подтверждает его подлинность как официально опубликованного OpenAI системного промпта. GitHub-репозиторий является сторонним источником, поэтому к содержимому стоит относиться именно как к опубликованной коллекции промптов, а не к официальной документации компании.

Сам файл доступен в репозитории CL4R1T4S на GitHub.

Интереснее всего здесь не сами 331 КБ текста, а возможность посмотреть, какие принципы заложены в работу AI-агента и как разработчики описывают его поведение на уровне системных инструкций.

Источник техножурнал КОД: https://t.me/kodjournal/274

Теги:
0
Комментарии1
Статья

Три кнопки вместо клавиатуры: HID-кликер на ESP32 своими руками

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели1.4K

Мне надоело тянуться к клавиатуре и мыши, чтобы пролистнуть ролик, — и я собрал кликер для ПК на базе ESP32. Три кнопки, наподобие пульта для презентаций: две листают ленту стрелками вверх и вниз, третья отправляет F13. Её нажатие ловит собственное расширение браузера и ставит лайк.

F13 выбрана не случайно. На большинстве клавиатур ряд функциональных клавиш заканчивается на F12, поэтому F13 гарантированно не столкнётся с чужим сочетанием. Зато событие можно перехватить в расширении и обработать по-своему.

В моём случае получилась игрушка для Firefox, но тот же принцип закрывает и рабочие задачи. SMM-специалист может быстрее модерировать посты: переключаться между ними и помечать подходящие для публикации. Специалист по контролю качества при стационарной проверке — фиксировать брак в ERP одним касанием. Всё это выполняется мышью и клавиатурой, но любой, кто оптимизировал рутину, знает: чем меньше лишних движений, тем быстрее и проще идёт работа. Человек не отвлекается и не путается.

Дальше — весь путь: от печати корпуса и схемы на ёмкостных сенсорах до кода прошивки и расширения под Firefox и Chrome. Со сметой на 450 ₽ и граблями, на которые я наступил.

Читать далее
Статья

Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели1.1K

Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конвейера Алиса делает смету с разделами за 19 секунд и обгоняет Qwen3-235B в четыре раза.

Смотреть результаты забегов
Статья

Зачем бороться со сложностью, если её больше нет?

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели1.2K

Я программист с приличным стажем, ещё в школе писал игрушки для БК‑шек, а сейчас у меня коммерческий стаж на Python, и я считаю себя, в общем‑то, уверенным сеньором.

До недавнего времени из ИИ я пользовался только браузерным Gemini. Он быстрый, живой, отзывчивый — с ним можно приятно поболтать, однако кодит он неважно. Добиться нужного результата частенько получалось только через крепкое словцо, на которое, впрочем, Gemini охотно откликается. Но понятно, что это всё жутко неудобно и надо было переходить на кодинг‑агентов.

Так бы я и канителился, однако получилось так, что вайб‑кодинг, вместе с вайб‑планированием и вайб‑постановками задач в Jira, в нашей команде внедрили волевым решением. Никого не спрашивая, не выясняя, кто что умеет, кто как к этому относится и как это вообще повлияет на разработку.

Сначала я, как и положено старпёру, отнёсся к этой технологии настороженно. Однако Cursor оказался весьма дружелюбным инструментом, да и квест с оплатой оказался несложным.

Читать далее
Новость

«Сбер» показал умное зеркало на базе медицинского ассистента GigaDoc

Время на прочтение2 мин
Охват и читатели968

«Сбер» на международной промышленной выставке «Иннопром. Индия» представил умное зеркало на базе медицинского ассистента GigaDoc (проект СберМедИИ, входит в индустрию здоровья «Сбера»). Гаджет за 15 секунд бесконтактно анализирует 17 ключевых показателей здоровья пользователя.

Читать далее
Статья

Дело о взрыве контекста: поиск случайного гостя, который захотел остаться

Уровень сложностиСредний
Время на прочтение16 мин
Охват и читатели1.1K

Всё началось со странной потери скорости решения задач.

Сначала я думал, что это чисто субъективное наблюдение. Проекты развиваются, документация растёт, архитектурных связей становится больше. Значит, AI-агенту нужно прочитать больше файлов, удержать больше решений и проверить больше зависимостей. Контекст растёт — время выполнения задач тоже растёт. Вроде бы всё логично.

Насчёт лимитов я особо не переживал. Подход моей AI-команды позволяет параллельно работать над несколькими крупными проектами на подписке Claude Code стоимостью 100 долларов. Команда разделена на роли, у каждой роли собственная рабочая область, задачи декомпозируются, а большие исследования можно выносить в отдельные сессии. Система была рассчитана именно на то, чтобы не складывать весь проект в голову одному агенту.

Но затем мой AI-архитектор продукта дважды ушёл в сжатие контекста.

Он работал на Opus с контекстным окном в один миллион токенов.

Первый раз можно списать на случайность. Второй — уже закономерность.

И вот тогда стало понятно: мы имеем дело не просто с тем, что «большие задачи выполняются дольше». Внутри рабочего процесса есть механизм, который незаметно съедает контекст, время или оба ресурса сразу.

Началось расследование.

Тогда я ещё не знал, что системная проблема всей AI-команды началась, скорее всего, с одной моей ошибки в терминале.

Читать далее
Новость

«Сбер» представил GigaChat 3.5 Reasoning с режимом рассуждений

Время на прочтение2 мин
Охват и читатели1K

«Сбер» представил новую версию своей мультимодальной нейросети GigaChat — GigaChat 3.5 Reasoning. В модели появился отдельный режим рассуждений: перед формированием ответа она разбивает задачу на этапы, составляет план решения, при необходимости использует внешние инструменты и проверяет промежуточные результаты. Об этом Хабру рассказали в пресс‑службе компании.

Читать далее
Статья

Преобразование Лежандра со всех сторон

Уровень сложностиСредний
Время на прочтение29 мин
Охват и читатели1.1K

Учась в институте, я встречал преобразование Лежандра в совершенно неожиданных местах: от методов оптимизации до физики. Было очевидно, что существует некоторая фундаментальная структура, сшивающая все воедино. В этой статье пробую нащупать эту нить: показываю, как преобразование Лежандра проявляется в различных областях (от механики и термодинамики до статистики и генеративного ml). Стараюсь идти от конкретных примеров и делать акцент на связях - чтобы выстроить цельную картину

Читать далее
Новость

Несколько спецслужб США выдвинули коллективные обвинения в адрес китайских ИИ‑компаний

Время на прочтение2 мин
Охват и читатели1.1K

Агентство по кибербезопасности и защите инфраструктуры США (CISA) в сотрудничестве с Агентством национальной безопасности и Федеральным бюро расследований выпустило совместное предупреждение о кибербезопасности в области дистилляции знаний. Федеральные агентства указали, что китайские компании в сфере искусственного интеллекта целенаправленно атакуют своих американских конкурентов, чтобы систематически извлекать языковые модели в рамках кампаний по дистилляции знаний.

Читать далее
Статья

SpecaFlow — больше чем SDD

Уровень сложностиСредний
Время на прочтение15 мин
Охват и читатели1.1K

Вайбкоддинг быстро обнажил своё главное слабое место. Как только у проекта появляется реальный потребитель, встаёт вопрос ответственности за его качество. А качественное развитие проекта в глубину невозможно без экспертизы в архитектуре и бизнес‑решениях: модели ИИ хороши в генерации по одному промпту, но теряют свою суперсилу на длинных дистанциях. Планирование продлевает жизнь проекта, который развивается с ИИ, но и это тупиковая ветвь: продукты бывают очень большими и сложными, я это знаю из опыта в бигтехе и госах.

Трудно представить начало сессии с ИИ, в которой модель легко и быстро понимает весь проект и необходимый контекст, чтобы принять от разработчика требования и качественно спроектировать внедрение, не сломав текущее стабильное состояние. Экспертиза инженера‑разработчика или системного аналитика несравненно качественнее — хотя бы потому, что он живёт с ней 24/7.

Читать далее
Статья

В каких играх стоит побаловаться DLSS 5

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели1.4K

3 сентября 2026 года нейронный рендеринг от NVIDIA вышел официально. Формально пока поддержка есть только в NBA 2K27. Однако энтузиасты среди геймеров с технической подготовкой уже реализовали возможность добавлять DLSS 5 практически в любую 3D-игру. Сначала это делалось вручную через установку ReShade и копирование всех необходимых библиотек в корневую папку. Но потом появились удобные утилиты, позволяющие интегрировать нейронный рендеринг парой кликов.

Читать далее

Ближайшие события

Статья

Как создать и настроить свой сервер Counter-Strike 2 на VPS

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели1.3K

Многие из нас когда-то проводили десятки, а то и сотни часов на публичных серверах Counter-Strike разных версий: от 1.6 до Global Offensive. Всех их объединяла атмосфера уникального хаоса, кастомных плагинов, новых знакомств и полуночных разговоров. Но с ростом киберспорта культура публичных серверов стала постепенно уходить на второй план. Молодёжь больше играет в соревновательные режимы — FaceIT или Premier.

С выходом CS2 и переходом на новый движок Source 2 ситуация стала ещё сложнее: старые плагины перестали работать, а инструменты для пользовательских серверов пришлось адаптировать. Постепенно разработчики освоили создание пользовательского контента для новой версии, и публичные серверы снова начали появляться.

В этой статье разберём, как создать собственный сервер Counter-Strike 2 на VPS, установить плагины, настроить карту и добавить на неё собственный контент.

Читать далее
Пост

Нейросеть GPT-6 Astra сделала управление компьютером жестами — ИИ собрала приложение, которое понимает движения руки без камеры. Проект отправляет неслышимый звук и по эффекту Доплера определяет, где находится ладонь пользователя. Подняли руку выше — скролл идёт вверх, опустили — вниз. Двойной тап в воздухе переключает направление.

Теги:
0
Комментарии0
Статья

Runtime-контроль ИИ-агентов: единица контроля не модель, а действие

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели1.2K

Пока рынок спорил, достаточно ли «умного» фильтра на промпт, агенты уже начали вызывать инструменты, ходить в MCP, трогать платёжные API и уносить ключи с рабочих станций. Для нас это был момент, когда защита модели перестала быть достаточным контуром. Промпт можно инспектировать, но действие нужно останавливать до исполнения.

В этой статье опишем рабочую модель runtime-контроля, расскажем как устроен контур, который видит эксплуатация: где перехватывается вызов, как компилируется политика, какой вердикт выносится до исполнения действия и почему «нашли всех агентов» ещё не равно «контролируем агентов».

За агентом всегда есть контур сущностей: скиллы и расширения, MCP-серверы и их инструменты, модели, машины и эндпоинты, сессии, инструменты вызова (tool-call), обращения в сеть, граф межагентного взаимодействия.

Если сотрудник с ноутбука вышел за контролируемый перечень ИИ-моделей и сходил во внешнюю LLM – это тоже событие контура, которое попадает в блок «теневого» ИИ (Shadow AI). Чтобы это было контролируемо – нужно понимать, что происходит на рабочей станции сотрудника. Без агента на хосте остаётся только то, что проходит через шлюз.

Читать далее
Статья

Как мы сделали RAG, который почти не галлюцинирует

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели969

Привет, Хабр! На связи команда CVM (Customer Value Management) B2B из МТС — техлид Артём Каледин и ML-инженер Александр Швайко. 

Менеджер должен быстро разбираться, как строить обсуждение с техническим директором компании. Но даже если информация о продукте есть, иногда бывает сложно быстро найти нужные материалы и выбрать плюсы для конкретного клиента. Раньше коллеги готовились к встречам с помощью Telegram-бота, но недавно от бизнеса поступила задача: сократить время на подготовку и повысить качество рекомендаций и контента. 

В статье по мотивам доклада на Inside AI Meetup расскажем про архитектуру нашей системы и этапы работы, поделимся результатами и планами, а еще — как построили надежный RAG, который не галлюцинирует (ну, почти).

Читать далее
Новость

DeepSeek V4.1-Flash: новая архитектура, 552 млрд параметров и агентные тесты

Время на прочтение3 мин
Охват и читатели1.4K

DeepSeek вывела V4.1-Flash — младшую модель новой архитектурной линейки компании. Это MoE-модель на 552 млрд параметров с нативной поддержкой изображений, контекстом до 1 млн токенов и отдельными режимами reasoning.

Наиболее интересная часть релиза — архитектурные изменения. DeepSeek перешла к асимметричной схеме Causal Encoder–Decoder: при prefill активируется около 8 млрд параметров на токен, а при decode — 16 млрд. То есть вычислительный бюджет для обработки входа и генерации намеренно сделали разным.

В модели также используется новый Engram-модуль на 196 млрд параметров для работы с N-граммами. В сочетании с MoE это позволяет разделить часть знаний и вычислений между параметрами, которые не нужно прогонять через основную сеть на каждом токене.

Отдельно DeepSeek переработала работу с KV-cache. Для длинного контекста это одна из ключевых оптимизаций V4.1-Flash: компания заявляет заметное снижение memory footprint по сравнению с предыдущим поколением. В документации модель также использует QAT для KV-cache и FP4-квантизацию, что дополнительно снижает требования к памяти при инференсе.

Читать далее
Статья

Куда на самом деле ходит Claude Code: ANTHROPIC_BASE_URL, два вида ключей и /status

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели1.3K

Claude Code не привязан к api.anthropic.com: это обычный клиент, и куда он ходит, задаётся двумя переменными. Разбираю, что именно нужно ему от эндпоинта, три способа подключения (shell, settings.json, apiKeyHelper), как проверить curl-ом до запуска и что означают типовые ошибки — 401, 403 с HTML, «auth may not work as expected» и внезапный 404 на haiku. Без названий сервисов, только механика.

Читать далее
Новость

OpenClaw 2.0 появился случайно, и мы осознанно выводим его в маркетплейс отдельным образом

Время на прочтение5 мин
Охват и читатели1.4K

В прошлой статье я рассказывал, как развернуть образ OpenClaw в облаке и не слить ему все свои данные: что мы положили в образ, что сознательно не положили и где проходит граница ответственности. Считайте этот текст второй серией.

Повод серьезный: 30 августа OpenClaw Foundation выпустил версию 2.0 — релиз, в который вошла примерно половина всех pull request за всю историю проекта. Каждый второй PR, когда-либо принятый в OpenClaw, приехал одним обновлением.

Мы выводим OpenClaw 2.0 в маркетплейс отдельным образом рядом с первой версией, а не поверх нее. Ниже расскажу, что случилось с проектом, что реально изменилось для пользователя и почему мажорную версию агента правильно ставить рядом, а не сверху.

И сразу тезис, с которым можно спорить в комментариях: самое важное в версии 2.0 — не мультиплеер, о котором пишут все. Самое важное — то, что самый хайповый опенсорс-проект года впервые притормозил и прибрался.

Читать далее
1
23 ...