Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Мы запустили полный checkpoint Qwen/Qwen3.8-Flash-Next на одной RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, без 4-битной квантизации и дистилляции. Использовался полный checkpoint в bf16, который генерировал обычные токены.

По сравнению с Opus 4.6 Max, согласно собственным данным Qwen:

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM
Пост

Как собрать ИИ-агента под свои рабочие задачи — тренинг от Практикума

Подойдёт руководителям, предпринимателям и всем, кто работает с информацией. Не нужны навыки программирования или опыт в IT.

В программе — теория и много практики:

  • Разберётесь в ИИ-агентах. Узнаете, чем они отличаются от чат-ботов и как работают автономные цепочки действий.

  • Поработаете с промптами. Научитесь формулировать эффективные запросы и управлять поведением ИИ с помощью инструкций, контекста и примеров.

  • Создадите базу знаний. Соберёте ИИ-помощника, который знает внутренние документы компании и отвечает на вопросы по ним.

  • Соберёте собственного ИИ-агента. Настроите его под свою профессиональную задачу, подключите документы или базу знаний и протестируете работу.

В результате у вас будет готовый агент, который можно использовать сразу после тренинга, шаблоны промптов, учебная презентация, бессрочный доступ к записи и свидетельство об обучении.

Тренинг проведёт Евгений Паточенко — академический руководитель магистерской программы «Аналитика больших данных» НИУ ВШЭ. Более 15 лет внедряет бизнес-приложения в крупнейших российских и международных компаниях, специализируется на применении ИИ в бизнесе.

Тренинг пройдёт онлайн и займёт около 5 часов с двумя перерывами по 20 минут. Во время обучения можно задавать вопросы эксперту в чате. Платные подписки на ИИ-инструменты не нужны — для практики можно использовать бесплатные.

→ Записаться на тренинг

Теги:
0
Комментарии0

Новости

Статья

IBM Simon: История прото-смартфона, его взлет и провал

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели71

Некогда IBM произвела революцию в мире персональных компьютеров, утвердив свою архитектуру ПК раз и навсегда. Но мало кто знает, что она была еще на пороге и другой революции: в её руках находился ключ к принципиально новому рынку умных телефонов, но воспользоваться этим ключом по назначению она так и не сумела.

Читать далее
Статья

«Машина времени для света»: голографические лазеры

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели154

Среди всех типов лазеров, пожалуй, особняком стоит один из них, имеющий совершенно уникальные возможности, за счёт чего его даже иногда называют «машиной времени» для света. И речь пойдёт о голографических лазерах…

Читать далее
Статья

5 типовых ошибок пентестера. Две из них наши

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели138

Пентест принято мерить по количеству найденных дыр. По-хорошему мерить надо бы по другому: что осталось после команды. Работает ли инфраструктура, не разошлись ли данные, не прилетело ли тем, кого в проекте вообще не было.

Я работаю в Singleton Security. Ниже 5 ошибок, после которых проект превращается в проблему. Часть я видел со стороны, часть слышал в кулуарах на конференциях, где такое рассказывают охотно, а в отчётах не пишут никогда. Два случая наши собственные: упавший сервер и домен, который не надо было регистрировать. Свои разбирать проще, про них хотя бы точно знаешь, как всё было.

Читать далее
Статья

ПДн, 152-ФЗ и LLM

Время на прочтение4 мин
Охват и читатели226

«Сделай мне аналитику по этим пяти резюме, вот они» — с такого сообщения могла начаться история, из-за которой я вообще стал бы разбираться в обезличивании. Думаю некоторые HR-специалисты крупных компаний смело вставляют в ChatGPT пять резюме целиком: с паспортами, адресами, СНИЛС. Для него это была рутина, экономия часа работы. Для компании — передача персональных данных пяти человек неизвестно куда, без основания, без уведомления, в сервис, чьи серверы стоят за пределами России. Формально — сразу несколько нарушений 152-ФЗ. Все чуть сложнее или проще но в целом посыл был примерно такой.

Я делаю Pigard — прокси, который маскирует ПДн до отправки в LLM, — и большую часть разговоров с заказчиками начинаю не с продукта, а с базы: что закон считает персональными данными, когда обезличивание действительно снимает обязательства, а когда создаёт только видимость защиты. Кажется что потребность только формируется и нужно понятийная база.

Читать далее
Статья

Почему ML-модель в андеррайтинге находит только то, что вы и так знали

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели726

В кулуарах страховых форумов приходится слышать «технологии ИИ сильно переоценены», «мы поставили модель, но результата нет». Хотите об этом поговорить?

Возьмем стандартный случай. Начальство одобряет проект: внедряем машинное обучение в андеррайтинг массовых видов. Нанимают дата-сайентистов, покупают лицензии, обучают градиентный бустинг на исторических данных. Проходит полгода. Сравнивают с действующей тарифной моделью — и прирост точности оказывается в пределах погрешности. И начинается поиск виноватых.

Двадцать лет я занимаюсь аналитикой в страховании, из них большую часть — в ДМС и андеррайтинге в том числе. И кажется, мне есть что сказать по вопросу: что на самом деле отличает ML от привычного GLM; и что стоит за модной темой каузальных моделей, которые сейчас показывают на каждом демо.

Речь пойдёт про массовые виды: ОСАГО, каско, розничный ДМС, имущество физлиц.

Читать далее
Статья

Рынок IT-вакансий сломался и ничего не понятно? А ведь за изучение таких процессов в 2010 году дали Нобелевскую премию

Уровень сложностиСредний
Время на прочтение23 мин
Охват и читатели648

Айтишники рассказывают, как отправляют сотни откликов на HH и не получают ответа. Компании твердят, что количество резюме выросло в разы, но хороших специалистов по-прежнему днем с огнем не сыскать. Зарплатные ожидания кандидатов и предложения работодателей расходятся, как корабли в море. Джуны не могут получить первый опыт, ведь их никуда не берут, а работодатели ищут людей, способных выйти на место и начать приносить пользу с первого дня. И не находят! Везде гремит один и тот же вывод: все пропало, рыночек сломался!

Забавно, что экономисты уже давно знают, как выглядит «сломанный» рынок, и их такими жалобами не проймешь. Более того, в 2010 году Питер Даймонд, Дейл Мортенсен и Кристофер Писсаридес получили за свой анализ Нобелевскую премию по экономике.

Возможно, если бы мы иногда отрывались от обсуждения нового фреймворка и смотрели, за что раздают Нобелевские премии по экономике, сегодняшний кризис найма выглядел бы менее загадочно…

Давайте попытаемся разобраться, что именно увидели экономисты, какие параметры позволяют описать нынешнюю ситуацию на рынке труда цензурными словами, и в конце даже рискнем сделать выводы, что эта хваленая модель вообще может нам сообщить о ситуации в IT-индустрии.

Читать далее
Статья

«Кто я?» — исследуем нестареющую классику OS command injection

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели735

«Кто я?» — вопрос, над которым люди размышляют веками. Но whoami для админа — обычная команда. А для атакующего, который только что нашел OS сommand injection, это буквально первая фраза при знакомстве с сервером. В статье покажем, как из одного слова можно получить 37 196 синтаксически разных вариантов одной и той же команды, а также рассмотрим свежие CVE, связанные с этой уязвимостью.

Читать
Статья

Учет ИТ-активов: как свести данные из пяти систем в одну точку

Время на прочтение9 мин
Охват и читатели1.6K

Скан сети находит 320 устройств, бухгалтерия — 280 на балансе. Кто подключил лишние 40 и на каком складе они лежат не знает никто, потому что информация в пяти разных системах. Разбираем, что каждая из них видит, а что упускает, и как свести их в одну карточку актива.

Читать далее
Статья

Экранный переводчик для macOS: читаем статьи и смотрим видео без переключения окон

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели1.3K

При чтении технической литературы, англоязычных статей или просмотре видео с субтитрами часто натыкаешься на незнакомые слова. В этой статье я рассказываю, как написал утилиту для macOS, которая моментально переводит любое слово на экране по одной клавише.

Читать далее
Статья

AmneziaWG: от 2.0 к 3.1, и что творится у вас под капотом

Уровень сложностиСредний
Время на прочтение15 мин
Охват и читатели1.5K

AmneziaWG 3.0 зашифровал заголовки пакетов, 3.1 добавил случайные хвосты — и оба раза «просто обновить бинарники» оказалось недостаточно. Это конспект двух обновлений, прогнанных через собственную панель: кто в связке awg-quick / awg / amneziawg-go за что отвечает, какие параметры обязаны совпасть на сервере и клиенте побайтово, а какие каждая сторона ставит себе сама, почему S1S4 больше не могут быть меньше 12 и в каком порядке мигрировать живой сервер, чтобы не отключить разом всех клиентов.

Главная особенность всех этих граблей одна: о любой ошибке протокол сообщает вам молчанием. Ни строчки в логе — просто никогда не появляется latest handshake. Ниже карта тех мест, где стоит искать.

Читать далее
Статья

Неожиданные проблемы с ceph tentacle на ubuntu 24.04

Время на прочтение5 мин
Охват и читатели1.2K

Добрый день коллеги, пишу первый раз, поэтому прошу не судить строго. Решил поделиться с вами проблемой, с которой столкнулся совсем недавно и потратил на то чтобы разобраться целый день. А в итоге оказалось, что косяк то не мой.

Все началось, что бы у меня тестовый кластер из трех мониторов, который был установлен без их новомодного инструмента cephadm, ручками, как говорится по старинке. На то он и тестовый кластер, что бы помучиться.

Читать далее
Новость

Вайбкодинг — навык 2026 года. Обсудим 16 сентября

Время на прочтение1 мин
Охват и читатели1.3K

В следующую среду вместе с JustAI собираемся у нас в офисе. Посмотрим кейсы, как неразработчики собирают платформы сами — без единой строчки кода вручную. А технические специалисты расскажут, где граница возможностей и в какой момент всё-таки пора звать разработчика.

Программа и регистрация

Ближайшие события

Статья

Как мы измеряем точность детекции ПДн: pii-bench, golden-выборка и честные метрики

Время на прочтение5 мин
Охват и читатели1.5K

Когда вендор защиты данных пишет на сайте «точность детекции 99%», возникает ровно один вопрос: как это измерено? Без методики цифра не значит ничего — «99%» может означать честный span-level F1 на внешнем бенчмарке, а может — «в 99 из 100 сообщений сканер что-то нашёл». Это разные вещи, и разница между ними — это пропущенные паспорта в проде.

Мы делаем Pigard — прокси, который маскирует персональные данные до отправки в LLM, — и в этой статье показываем методику измерения точности целиком: внешний бенчмарк, собственная golden-выборка, разбор ошибок и честные цифры, включая неудобные. Конкурентов не называем и их заявленные метрики не цитируем — только собственные результаты и способ их получения, чтобы вы могли повторить то же самое с любым вендором, включая нас.

Читать далее
Статья

Почему значок VPN в Android не гарантирует, что VPN действительно работает

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели1.4K

Значок VPN в шторке Android говорит только одно: интерфейс существует. Он ничего не говорит о том, реально ли через этот интерфейс сейчас проходит трафик, а в условиях, где VPN регулярно блокируют, разница между этими двумя состояниями ощущается очень болезненно на практике.

В статье - как Android на самом деле определяет наличие VPN, почему этого недостаточно, какие есть более надёжные способы проверки, и как в итоге из этого исследования вырос виджет для Android, который сам разбирается с этим вопросом, не оставляя пользователя гадать.

Читать далее
Новость

Американца приговорили к 15 годам тюрьмы за шантаж женщин с помощью сгенерированных порнографических видео

Время на прочтение2 мин
Охват и читатели1.5K

Жителя американского штата Огайо Джеймса Стралера приговорили к 15 годам тюремного заключения за изготовление и распространение детской порнографии, шантаж с использованием сгенерированных видео, преследование в сети многочисленных жертв и другие преступления.

Читать далее
Новость

Россиянина экстрадировали из Грузии в США по делу о кибермошенничестве и хищении «миллионов долларов»

Время на прочтение2 мин
Охват и читатели1.3K

Россиянина Сергея Филимонова экстрадировали из Грузии в США по обвинению в участии в транснациональной схеме кибермошенничества и хищении «миллионов долларов» с банковских счетов. Об этом сообщило Министерство юстиции США.

Читать далее
Новость

Chrome переходит на двухнедельный цикл обновлений

Время на прочтение2 мин
Охват и читатели1.3K

Google изменил привычный ритм обновления Chrome: стабильные версии браузера теперь выходят каждые две недели вместо прежних четырёх. Для пользователей изменения будут почти незаметными, а вот разработчикам веб-приложений придётся учитывать новый темп появления изменений в платформе и чаще проверять совместимость своих проектов.

Разобраться в изменениях
Статья

CRM вскрывает проблемы команды, просто вы их не замечаете

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.9K

Вот будь на дворе хоть 2002, хоть 2008, хоть 2026 год — в компаниях происходит одно и то же: внедрение нового средства автоматизации наводит шорох, будоражит нервы, выбивает сотрудников из пресловутой зоны комфорта и воспринимается ни дать, ни взять как набег особо опасного робота на человеческие права и свободы не работать. При этом само внедрение чаще всего полезное и направлено на улучшение ситуации в компании, но слухи, мифы, легенды и сопротивление уже давно заслуживают стать частью эпоса. В общем, тот случай, когда картинка как никогда подходит: вроде котик, вроде мягкий и милый, но вот эти ребята на креслах-грушах и в гамаках возмущённо начнут суетиться через 3…2…1…

Читать далее
Статья

Сколько ваших проверок хоть раз возвращали False?

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели2K

Я делаю систему, которая собирает черновики производственных инструкций. В ней есть детектор опасных формулировок — и он исправно срабатывал на фразе «убедиться, что в зоне движения нет людей». То есть на правиле техники безопасности, как на его нарушении.

Починил и задумался: а остальные шестьдесят проверок качества что-нибудь измеряют? Написал инструмент, который портит документы изнутри схемы и смотрит, какие проверки реагируют. Тридцать не реагируют ни на что.

Дальше оказалось, что этот инструмент сам имел слепую зону, его отчёт считал не проверки, а строки, которые они печатают, а пороги из конфига в код не попадали. Семь уровней, и на каждом одно: проверка выглядит рабочей и не работает.

Читать далее
1
23 ...