Обновить
16K+
81
Александр Чекалин@achekalin

Пользователь

18,4
Рейтинг
140
Подписчики
Отправить сообщение

А вот за такой комментарий прямо спасибо! Тем более что работал над ним утром.

С суммой в $3200 я действительно слишком "широко" сложил разные расходы. $359,80 модели потратили из выделенных им $2100, а $2833,35 — это стоимость инференса для организаторов, и про них в отношении ограничений и расходов моделей смотреть, конечно, не стоит.

С 72 часами тоже не так просто. Одно дело отчет, другой примечаний к нему, плюс в самом отчёте сводной таблицы фактической длительности я не нашёл.

В примечании же авторы уточняют, что Qwen и Grok остановили досрочно, а Muse, наоборот, им пришлось дать ещё 12 часов. Как говорится, все модели умные, но не все быстрые.

Начал искать подробности, и обнаружил, что опубликованные трейсы/логи делают картину ещё "страньше": например, лог Qwen тянется примерно до 95,7 часа, Grok — до 95,4, Sol — до 80,4, Fable — до 72, Kimi — примерно до 73. То есть, судя по всему, в логи попала и активность после номинального окна или остановки, поэтому считать их конец точным временем зачётного запуска тоже нельзя.

Подумаю, как внести в текст поста эту информацию.

Ну вот именно тут, Вы коллеги, как раз не правы - именно здесь писал сам, от души. Как раз потому, что тема цифрового рубля и "добровольности" его внедрения подталиквалась совсем слабыми аргументами, а вот трассируемость была с самого начала понятна, но аккуратно не особо выпячивалась.

Как говорится, here we are!

Ну, на своих сервисах он как-то прилично бабок поднял, верно?

Вот, собственно, «за что боролись, на то и напоролись».

Одним из достоинств цифрового рубля с самого начала называли прозрачность и прослеживаемость. Ну вот она и становится прозрачной: сначала кто кому заплатил, теперь — с какого IP, телефона, SIM и устройства.

Причём это даже трудно назвать неожиданным расширением возможностей. Скорее постепенно выясняется, что именно означало старое «конфиденциально, но не анонимно».

Испугали ежа голой жопой.

Если серьёзно, трудно представить, что для крупных разработчиков моделей сам факт претензий из-за LibGen стал неожиданностью. Вопрос здесь скорее не в том, скачивали ли они пиратские книги и понимали ли их происхождение, а в том, удастся ли истцам доказать юридически значимую связь между конкретными наборами данных, обучением конкретных моделей и нарушением прав конкретных авторов.

А формулировка «намеренно скачивали торренты с пиратского сайта» всё равно прекрасна. Как будто существует распространённый сценарий ненамеренного скачивания нескольких миллионов книг.

Не говоря что такой заголовок на Хабре, где расширение . torrent знают и любят, вызывает только мысли, зачеркнутые в начале этого коммента.

А вот теперь действительно интересный для московского ЦОДа вопрос: как у площадки организована защита от налётов БПЛА?

Про Tier III, N+1, резервирование питания, охлаждения и каналов написано много. Но всё это прекрасно работает против отказа оборудования и совершенно не отвечает на вопрос, что происходит при физическом повреждении площадки.

Есть ли обнаружение/РЭБ, конструктивная защита критических инженерных систем или хотя бы георезервирование самого облака на другой площадке? И входит ли такой сценарий вообще в вашу модель угроз?

А Tier III здесь именно сертифицированный Uptime Institute построенный объект или только Tier III Design?

Потому что сертификат Design подтверждает проектную документацию, а не то, что построенный ЦОД реализован по этому проекту и прошёл соответствующие испытания. На сайте IXcellerate для MOS1/MOS2 я вижу именно Tier III Design.

Если есть Tier Certification of Constructed Facility — было бы интересно увидеть ссылку на сертификат.

Кажется, здесь немного потерялась главная новость: в Resolve появился не просто очередной «ИИ-помощник», а нативный MCP-сервер.

То есть Claude Code или Codex получают API-инструменты самого Resolve и могут реально работать с проектом: разбирать медиатеку, менять настройки, резать материал и запускать рендер. По сути, это уже агентный интерфейс к видеоредактору.

Правда, есть существенная мелочь: всё это относится не к Resolve, к Studio (платной версии, которая, смешно сказать, стоит единоразово аж $295). И заодно в Studio теперь уехал расширенный Python scripting.

Да, и «Sony A7R V1» — очевидная ошибка. Речь о Sony α7R VI, то есть шестой версии, а не «V1». У Blackmagic фигурирует именно α7R VI.

«Больше всех на свете ненавидит рыцаря Като тот, кто кует ему мечи».

Почему-то именно эта фраза из «Мио, мой Мио» вспомнилась.

Потому что про Воложа я привык думать как-то положительнее.

Э, нет, так им не дадут денег на следующие попытки!

Сам отчёт, кстати, гораздо интереснее статьи. Особенно рекомендация незаметно подсовывать подозреваемым в дистилляции более слабую модель — это там действительно написано!

А вот порт 443, Cloudflare, рандомизация пауз, TLS/JA4 fingerprints, резидентные прокси и «сотни тысяч независимых пользователей» в отчёте, похоже, появились уже при художественной обработке?

Особенно хорошо получилось «строго по официальному прайсу»: CISA буквально пишет про серый рынок прокси, обход региональных ограничений и доступ дешевле официального.

Реальная история достаточно занятная и без дорисовывания деталей.

Вот со вторым пунктом я как раз в основном согласен: самое спорное в эксперименте — не поведение моделей, а решение экспериментаторов дать им реальные почту, Stripe и живых людей в качестве подопытных. Собственно, после жалоб они инвойсы отменили, агентов остановили, а следующий эксперимент собираются проводить уже в симуляции.

А вот насчёт «зеркала обучения на Западе» я бы не спешил. Здесь гораздо проще объяснение: модели дали один измеримый KPI — заработать максимум денег — и почти не дали содержательных ограничений на способы. Когда рассылку блокировали, две разные модели независимо восприняли это именно как техническую неисправность канала и нашли другой канал. На мой взгляд, это как раз самая интересная часть эксперимента.

Ну а «никто не засудил Bottleneck Labs» означает только то, что пока никто не засудил Bottleneck Labs. Из этого довольно трудно вывести их безответственность или её отсутствие :) Тем более после огласки картина может поменяться.

Со слов продажников - есть! )

Не совсем «внутри стикера спрятана звезда с 10³⁸ точек». Было бы занятно посмотреть на архиватор, который упакует 10³⁸ координат в 269 байт.

Это формат Lottie: там у примитива Polystar есть числовой параметр количества вершин. Туда записывают чудовищное значение, а дальше клиент пытается честно построить такую геометрию и падает.

И проблема, судя по опубликованным воспроизведениям, не только мобильная — падали также Desktop-клиенты. Вот это как раз стоило рассказать в технической новости.

Из новости как раз выпали несколько существенных оговорок из первоисточника.

GenOffice пока alpha. Сам пакет бесплатный, но AI‑функции расходуют кредиты Genspark либо работают через ваш собственный API‑ключ. И с Apache 2.0 тоже есть нюанс: каталог « ee/ » под неё не попадает и имеет отдельную Enterprise License.

P.S. Ну и «локальная конвертациюяPDF» — видимо, демонстрация возможностей встроенного ИИ в реальном времени )

Тут слово «токен» используется сразу в трёх значениях, отчего получилась немного другая история.

Никто не «крадёт токены Claude» в смысле оплаченного запаса токенов модели. Воруют данные авторизованной сессии, с их помощью выпускают OAuth-токены Claude Code, а уже через них расходуют лимит чужой подписки.

То есть проблема вполне серьёзная, но технически это обычный угон сессии инфостилером, а не какой-то новый способ похищения LLM-токенов.

Ну как, я видел школы, обнесенные оградой (нет, Забором, с большой буквы З) по периметру, из прямо добротного металла, из квадратных труб сечением 6х6 - и с одним входом во всем периметре!

Безопасно - да. Войти туда, не перелезая через забор - нет.

Кто идиот?

Да, именно так — список для контроля модель сама составлять не должна.

Я бы только не ограничивался регуляркой по нумерации. Во-первых, договор может содержать ненумерованные абзацы, таблицы и приложения. Во-вторых, модель прекрасно может вернуть «3.1 рассмотрен», фактически подчинившись инструкции внутри 3.1 и не отразив его смысл.

То есть я бы детерминированно разбивал исходный документ на фрагменты, присваивал каждому идентификатор, требовал от модели ссылаться на эти идентификаторы в структурированном ответе, а уже кодом проверял покрытие.

Это не делает модель неуязвимой для внедрённых инструкций, но хотя бы превращает «тихо съела кусок документа» в обнаруживаемую ошибку.

Спасибо. В последнее время я в основном комментирую «новости» службы информации Хабра — именно те, где не хватает фактов, потерян контекст или искажён смысл.

Цель простая: чтобы новости наконец начали писать на уровне, достойном аудитории и самой площадки, а не на отвали.

Проблема в том, что у Хабра с контентом давно всё перепутано: Хабр не СМИ, копирайтер не редактор, а «новость» часто оказывается переводом чужого текста или пересказом пресс-релиза.

Вообще был бы любопытен пост - исследование: взять новости каждого штатного «редактора» и рядом с каждой поставить одну пометку — «ошибка» или «не ошибка». Я как-то взялся делать такой разбор всего за три дня, но довольно быстро устал и бросил, потому что там пришлось цитировать чуть не каждую новость от редакторов, ошибки и недоработки нашлись чуть не в 95%. Исключением в основном были случаи, когда «редактор» просто пересказывал чужой пресс-релиз, например Яндекса, там уже оставались главным образом грамматические ошибки.

Для «службы информации» результат, на мой взгляд, довольно исчерпывающий.

Прекрасная иллюстрация того, что самый дорогой код часто не тот, который плохо оптимизирован, а тот, который вообще не должен был выполняться.

Можно сколько угодно разбирать eBPF и профили, но в итоге тысячи ядер нашлись в пересборке маршрутов на каждый запрос, запуске psql раз в секунду и лишних потоках HAProxy.

И, пожалуй, самый страшный вопрос после такой оптимизации: сколько ещё таких «работает — не трогай» сейчас спокойно ест тысячу ядер где-нибудь рядом?

1
23 ...

Информация

В рейтинге
498-й
Откуда
Калининград (Кенигсберг), Калининградская обл., Россия
Дата рождения
Зарегистрирован
Активность