Ну так он же и без контекста толком не вмещается в 16 ГБ видеопамяти. А если оставить половину слоёв в основной памяти, производительность будет просто боль, единицы токенов в секунды.
Вот смотрите, есть текущая ситуация, где де-юре право на приватность есть у всех — и у простых людей, и у власть имущих. Вы рассуждаете о некой гипотетической реальности, где его нет ни у тех, ни у других.
Как вы представляете себе переход между этими реальностями такой, чтобы он не остановился на много лет в состоянии “у людей нет права на приватность, у власти такое право есть”?
Без нормальных гражданских прав вы не то что что-то решать, вы даже минимально повлиять не сможете на то, что с вами делают государство и корпорации. В этом свете любой добровольный отказ от уже имеющихся (= добытых предыдущими поколениями) прав — это почти преступление против человечества.
Ценность приватности переоценена, надо с этим бороться.
Вы серьёзно предлагаете бороться против права людей на приватность? Раз вам оно так мешает, государство у вас его с радостью заберёт, но с чего вы вы взяли, что даст что-то взамен? С какой радости оно будет что-то давать слабому и бесправному?
Чтобы было с чем сходить в другую клинику за вторым мнением.
Чтобы было с чем пойти к тому же врачу, если он вдруг сменит место работы.
Чтобы была принципиальная возможность оценить динамику течения заболевания даже через несколько лет, у другого врача, в другом городе.
Результаты были доступны врачу во внутренней системе поликлиники
Их внутренние системы, бывает, дают сбой и теряют данные пациентов. Вы приходите через год к тому же врачу в ту же клинику, а у него больше нет вашего старого снимка.
А кто-то еще пользуется дисками, кроме консольщиков?
Результаты медицинских исследований по типу МРТ или КТ зачастую выдают на оптическом диске без каких-то других вариантов. Флешки в дорогой аппарат совать запрещено, а заморачиваться с электронной почтой и облачными хранилищами ради пациента никто, как правило, не хочет.
Обычному сеньору […] все равно нужно только случайное число от 0 до 100
Этот же самый “обычный сеньор” будет на каждом углу доказывать, что синглтоны и скрытый глобальный стейт — это плохо и антипаттерн. Так вот, функция, возвращающая “просто случайное число” — это и есть скрытый глобальный (скорее, тред-локальный) стейт.
Для решения какой реальной задачи нужны (псевдо)случайные числа неизвестного происхождения с неизвестным распределением, неизвестной воспроизводимостью и неизвестной производительностью?
Генерируете ключ шифрования, IV или токен — вам нужен максимально настоящий и качественный рандом, с тем или иным источником энтропии из реального мира.
Генерируете входные воздействия для тестов или решаете что-то методом Монте-Карло — вам нужен генератор псевдослучайных чисел с определённым балансом между качеством и производительностью.
в удобных языках есть метод random(max_value)
Который, как правило, не подходит для серьёзных применений.
Это всё призывы в пользу бедных, которые можно смело выкинуть.
Вообще-то, эти призывы — это самое ценное, что есть в статье. Понятно, что крупный бизнес будет исходить из парадигмы “куда вы денетесь”, но кто помельче и поадекватнее, может, задумается и сделает по-человечески.
делать локальный логин дорого, неудобно и чревато проблемами
Локальный логин — это совершенно типовая, стандартная функциональность, которая часто доступна вообще в готовом виде в составе фреймворка/CMS. Что там такого дорогого и неудобного? Трудоёмкость этой задачи ниже, чем прикрутить вход через полдюжины российских провайдеров.
oauth с openid и вытеснили локальные логины
Видимо, у нас разная выборка. Среди множества сайтов, на которых я зареган, входа по почте нет только у одного или двух.
В целом, всю статью можно сократить до одной фразы
Не совсем. Там отчётлива виден призыв сделать локальные, не привязанные ни к чему внешнему способы входа: классическую связку “логин + пароль”, passkey, да хоть по PGP-ключу, чтобы не завязывать весь рунет на ВК и Яндекс.
Не очень представляю, чтобы это сработало. У моделей миллиарды параметров, у ПЛИС — хорошо если сотни тысяч LUT’ов. Даже если на кодирование каждого бита весов модели в среднем уйдёт всего лишь один лут, арифметика никак не сходится. К тому же, большие ПЛИС стоят ужасно дорого, будет дешевле видеокартами закупиться.
Куда реалистичнее другой подход: реализовать на ПЛИС базовые операции инференса и прогонять через них данные из памяти в память, как это и делают видеокарты, но и тут есть проблемы:
ПЛИС, способные работать с DDR5, прям недешёвые, а по DDR3 много данных не нагоняешь,
ширина шины памяти тоже ограничена кремнием, хорошо если наберётся подходящих пинов на 256 бит данных (а скорей на 128).
В каком смысле, “любитель 95-го”? Если двигатель спроектирован под 95-й бензин, лить в него 92-й, скажем так, настоятельно не рекомендуется. Как долго можно проездить на неподходящем бензине до того, как двигателю станет плохо, сказать сложно.
ГигаЧат (до сих пор не верю, что это название настоящее)
Однако, вы это название знаете и помните, хотя, скорее всего, самим “гига-чатом” не пользуетесь. Это очевидный успех их команды маркетинга.
теперь вот это
Да просто анимешный маскот, у кого только их нет. “%НашаКомпания%-тян” — стандартный схема именования. Единственное, правильно пишется всё-таки через дефис. Ну и сама графика страшненькая и пластиковая, как из аниме-тайтла третьего эшелона.
Откуда это внезапное высокомерие по отношению к незнакомому человеку?
тоже с потерями но хуже
Почему вы решили, что в задаче автора предложенный вами алгоритм покажет себя лучше? Напомню, в статье речь не про прореживание данных ради экономии места, а про визуализацию временного ряда в реалтайме с масштабированием.
планируется выдавать российским разработчикам сертификаты
У меня есть большое опасение, что эти сертификаты будут именно что выдавать, сразу с приватным ключом, как это делали удостоверяющие центры для российского бизнеса, по типу Тензора, до того, как налоговая всех перевела на аппаратные токены и неизвлекаемые ключи.
Напомню, что по общепринятой мировой практике центры сертификации не выдают приватные ключи. Пользователь сам генерирует ключевую пару и отправляет центру сертификации только публичный ключ, а центр сертификации его подписывает. Подписанный публичный ключ — это и есть сертификат.
Ключевая концепция IPv6 это возврат к глобальным адресам на конечном устройстве
Эта концепция хороша, если у вас есть своя AS и ваш провайдер позволяет вам анонсировать свой префикс (я бы не ожидал такого от провайдеров домашнего инернета и через двадцать лет). Если же вы используете внутри сети тот префикс, что вам выдал провайдер, то вы не можете нигде хардкодить адреса (например, в правилах правилах маршрутизации или фаервола), иначе при смене провайдера всё сломается. Как будто бы fd00::/8 тут меньшее из зол.
Ничто в IPv6 не заставляет так делать, как был фаервол на домашнем или корпоративном роутере, так и останется. В IPv6 фаерволу не нужно заниматься трансляцией адресов, но контролировать входящие и исходящие соединения он всё ещё обязан.
использовать в локалке глобальную адресацию тоже сомнительной нужности решение
Можно не использовать, есть целая fd00::/8 под локальные адреса. При этом для того, чтобы выпустить устройства из локальной IPv6-сети наружу, фаерволу роутера достаточно пары правил для замены префикса вместо динамической таблицы, отслеживающей все соединения в реалтайме.
Кстати говоря, в IPv6 сразу предполагается, что у каждой локалки будет свой рандомный префикс, что весьма удобно, если локальные сети как-то сообщаются. Например, если у вас и дома и на работе 192.168.0.0/24, и вы хотите удалённый доступ в рабочую сеть, кому-то придётся переехать на другой префикс.
говорить о том, что ipv4 кончились […] не приходится.
Если они не кончились, почему они такие дорогие? У облачных провайдеров они уже 2 доллара в месяц за штуку, и дальше будет только дороже.
В корпоративных сетях IPv6 не появится, наверное, никогда.
Если значимая часть, хотя бы одна десятая от общего количества сайтов и сервисов в интернете будет IPv6-only, ещё как появится, хотя бы на внешку.
Или представьте, что в какой-то момент возникнет некий ценный для людей сервис, который по каким-то своим техническим или политическим причинам работает только на IPv6. Если завтра OpenAI и Anthropic выключат у себя IPv4, послезавтра IPv6 появится во всех айтишных офисах.
Нормальных фаерволлов и вообще средств защиты под v6 мизер
Вы про аппаратные фаерволы? Увы, ничего не могу про них сказать. А программным фаерволам ничто принципиально не мешает. Как минимум, в линуксе nftables полноценно поддерживает IPv6 уже давно.
NAT скрывает внутреннюю архитектуру сети
Теоретически, в IPv6 ничто не запрещает устроить трансляцию адресов с маскарадингом, но я не уверен, что такое поддерживается, например, в том же nftables.
Так-то да, это определённая утечка внутренней информации. Возможно, стоило бы как-то её прикрыть, но учитывая масштабы слежки на прикладном уровне, в вебе, не уверен, что стоит начинать решать проблему с сетевого.
Древняя бизнес-критичная система может быть написана несколько десятилетий назад
Никто, в общем-то, на текущем этапе и не призывает отказываться от IPv4. Сначала дуалстек, затем имитация IPv4 средствами IPv6 (см. IPv4-mapped IPv6 address), а там, может, древняя система уже и не нужна будет. Даже если система останется в строю, она будет дополнена слоем совместимости с новой реальностью. Думаю, все наслышаны про древний Коболе в американских банках, но волнует ли это кого-то за пределами этих банков?
терминал на складе, касса, счетчик в АСУТП, станок, принтер этикеток могут не поддерживать v6 и менять их ради этого никто не станет
Эти вещи и сейчас обычно работают в отдельном влане. Ну, останется в IPv6-сети кусочек IPv4, не страшно.
К моменту полного “взлёта” IPv6 они с большой вероятностью придут в негодность, перестанут поддерживаться производителем, морально устареют или просто потеряются.
Неправда, воз тронулся и медленно едет. Например, я сейчас заглянул в меню офисного МФУ — так вот, там есть поддержка IPv6. Была ли она там десять лет назад?
Ну так он же и без контекста толком не вмещается в 16 ГБ видеопамяти. А если оставить половину слоёв в основной памяти, производительность будет просто боль, единицы токенов в секунды.
Вот смотрите, есть текущая ситуация, где де-юре право на приватность есть у всех — и у простых людей, и у власть имущих. Вы рассуждаете о некой гипотетической реальности, где его нет ни у тех, ни у других.
Как вы представляете себе переход между этими реальностями такой, чтобы он не остановился на много лет в состоянии “у людей нет права на приватность, у власти такое право есть”?
Без нормальных гражданских прав вы не то что что-то решать, вы даже минимально повлиять не сможете на то, что с вами делают государство и корпорации. В этом свете любой добровольный отказ от уже имеющихся (= добытых предыдущими поколениями) прав — это почти преступление против человечества.
Вы серьёзно предлагаете бороться против права людей на приватность? Раз вам оно так мешает, государство у вас его с радостью заберёт, но с чего вы вы взяли, что даст что-то взамен? С какой радости оно будет что-то давать слабому и бесправному?
Чтобы было с чем сходить в другую клинику за вторым мнением.
Чтобы было с чем пойти к тому же врачу, если он вдруг сменит место работы.
Чтобы была принципиальная возможность оценить динамику течения заболевания даже через несколько лет, у другого врача, в другом городе.
Их внутренние системы, бывает, дают сбой и теряют данные пациентов. Вы приходите через год к тому же врачу в ту же клинику, а у него больше нет вашего старого снимка.
Результаты медицинских исследований по типу МРТ или КТ зачастую выдают на оптическом диске без каких-то других вариантов. Флешки в дорогой аппарат совать запрещено, а заморачиваться с электронной почтой и облачными хранилищами ради пациента никто, как правило, не хочет.
Этот же самый “обычный сеньор” будет на каждом углу доказывать, что синглтоны и скрытый глобальный стейт — это плохо и антипаттерн. Так вот, функция, возвращающая “просто случайное число” — это и есть скрытый глобальный (скорее, тред-локальный) стейт.
Для решения какой реальной задачи нужны (псевдо)случайные числа неизвестного происхождения с неизвестным распределением, неизвестной воспроизводимостью и неизвестной производительностью?
Генерируете ключ шифрования, IV или токен — вам нужен максимально настоящий и качественный рандом, с тем или иным источником энтропии из реального мира.
Генерируете входные воздействия для тестов или решаете что-то методом Монте-Карло — вам нужен генератор псевдослучайных чисел с определённым балансом между качеством и производительностью.
Который, как правило, не подходит для серьёзных применений.
Вообще-то, эти призывы — это самое ценное, что есть в статье. Понятно, что крупный бизнес будет исходить из парадигмы “куда вы денетесь”, но кто помельче и поадекватнее, может, задумается и сделает по-человечески.
Локальный логин — это совершенно типовая, стандартная функциональность, которая часто доступна вообще в готовом виде в составе фреймворка/CMS. Что там такого дорогого и неудобного? Трудоёмкость этой задачи ниже, чем прикрутить вход через полдюжины российских провайдеров.
Видимо, у нас разная выборка. Среди множества сайтов, на которых я зареган, входа по почте нет только у одного или двух.
Не совсем. Там отчётлива виден призыв сделать локальные, не привязанные ни к чему внешнему способы входа: классическую связку “логин + пароль”, passkey, да хоть по PGP-ключу, чтобы не завязывать весь рунет на ВК и Яндекс.
Вы не помните, а оно было, в том числе и в России.
Замечу ещё, что, в отличие от сабжа статьи, GDPR даёт не только государству новые поводы для штрафов, но и какие-никакие права пользователю.
Не очень представляю, чтобы это сработало. У моделей миллиарды параметров, у ПЛИС — хорошо если сотни тысяч LUT’ов. Даже если на кодирование каждого бита весов модели в среднем уйдёт всего лишь один лут, арифметика никак не сходится. К тому же, большие ПЛИС стоят ужасно дорого, будет дешевле видеокартами закупиться.
Куда реалистичнее другой подход: реализовать на ПЛИС базовые операции инференса и прогонять через них данные из памяти в память, как это и делают видеокарты, но и тут есть проблемы:
ПЛИС, способные работать с DDR5, прям недешёвые, а по DDR3 много данных не нагоняешь,
ширина шины памяти тоже ограничена кремнием, хорошо если наберётся подходящих пинов на 256 бит данных (а скорей на 128).
В каком смысле, “любитель 95-го”? Если двигатель спроектирован под 95-й бензин, лить в него 92-й, скажем так, настоятельно не рекомендуется. Как долго можно проездить на неподходящем бензине до того, как двигателю станет плохо, сказать сложно.
Однако, вы это название знаете и помните, хотя, скорее всего, самим “гига-чатом” не пользуетесь. Это очевидный успех их команды маркетинга.
Да просто анимешный маскот, у кого только их нет. “%НашаКомпания%-тян” — стандартный схема именования. Единственное, правильно пишется всё-таки через дефис. Ну и сама графика страшненькая и пластиковая, как из аниме-тайтла третьего эшелона.
Откуда это внезапное высокомерие по отношению к незнакомому человеку?
Почему вы решили, что в задаче автора предложенный вами алгоритм покажет себя лучше? Напомню, в статье речь не про прореживание данных ради экономии места, а про визуализацию временного ряда в реалтайме с масштабированием.
У меня есть большое опасение, что эти сертификаты будут именно что выдавать, сразу с приватным ключом, как это делали удостоверяющие центры для российского бизнеса, по типу Тензора, до того, как налоговая всех перевела на аппаратные токены и неизвлекаемые ключи.
Напомню, что по общепринятой мировой практике центры сертификации не выдают приватные ключи. Пользователь сам генерирует ключевую пару и отправляет центру сертификации только публичный ключ, а центр сертификации его подписывает. Подписанный публичный ключ — это и есть сертификат.
Эта концепция хороша, если у вас есть своя AS и ваш провайдер позволяет вам анонсировать свой префикс (я бы не ожидал такого от провайдеров домашнего инернета и через двадцать лет). Если же вы используете внутри сети тот префикс, что вам выдал провайдер, то вы не можете нигде хардкодить адреса (например, в правилах правилах маршрутизации или фаервола), иначе при смене провайдера всё сломается. Как будто бы
fd00::/8тут меньшее из зол.Ничто в IPv6 не заставляет так делать, как был фаервол на домашнем или корпоративном роутере, так и останется. В IPv6 фаерволу не нужно заниматься трансляцией адресов, но контролировать входящие и исходящие соединения он всё ещё обязан.
Можно не использовать, есть целая
fd00::/8под локальные адреса. При этом для того, чтобы выпустить устройства из локальной IPv6-сети наружу, фаерволу роутера достаточно пары правил для замены префикса вместо динамической таблицы, отслеживающей все соединения в реалтайме.Кстати говоря, в IPv6 сразу предполагается, что у каждой локалки будет свой рандомный префикс, что весьма удобно, если локальные сети как-то сообщаются. Например, если у вас и дома и на работе
192.168.0.0/24, и вы хотите удалённый доступ в рабочую сеть, кому-то придётся переехать на другой префикс.Если они не кончились, почему они такие дорогие? У облачных провайдеров они уже 2 доллара в месяц за штуку, и дальше будет только дороже.
Если значимая часть, хотя бы одна десятая от общего количества сайтов и сервисов в интернете будет IPv6-only, ещё как появится, хотя бы на внешку.
Или представьте, что в какой-то момент возникнет некий ценный для людей сервис, который по каким-то своим техническим или политическим причинам работает только на IPv6. Если завтра OpenAI и Anthropic выключат у себя IPv4, послезавтра IPv6 появится во всех айтишных офисах.
Вы про аппаратные фаерволы? Увы, ничего не могу про них сказать. А программным фаерволам ничто принципиально не мешает. Как минимум, в линуксе
nftablesполноценно поддерживает IPv6 уже давно.Теоретически, в IPv6 ничто не запрещает устроить трансляцию адресов с маскарадингом, но я не уверен, что такое поддерживается, например, в том же
nftables.Так-то да, это определённая утечка внутренней информации. Возможно, стоило бы как-то её прикрыть, но учитывая масштабы слежки на прикладном уровне, в вебе, не уверен, что стоит начинать решать проблему с сетевого.
Никто, в общем-то, на текущем этапе и не призывает отказываться от IPv4. Сначала дуалстек, затем имитация IPv4 средствами IPv6 (см. IPv4-mapped IPv6 address), а там, может, древняя система уже и не нужна будет. Даже если система останется в строю, она будет дополнена слоем совместимости с новой реальностью. Думаю, все наслышаны про древний Коболе в американских банках, но волнует ли это кого-то за пределами этих банков?
Эти вещи и сейчас обычно работают в отдельном влане. Ну, останется в IPv6-сети кусочек IPv4, не страшно.
К моменту полного “взлёта” IPv6 они с большой вероятностью придут в негодность, перестанут поддерживаться производителем, морально устареют или просто потеряются.
Неправда, воз тронулся и медленно едет. Например, я сейчас заглянул в меню офисного МФУ — так вот, там есть поддержка IPv6. Была ли она там десять лет назад?