Важно: SHA-256 без ключа от email — это псевдонимизация, которая по позиции РКН всё ещё является персональными данными. HMAC с управляемым ключом — иной правовой статус: без ключа значение необратимо.
А как это объясняется? Атака дополнением? Тогда можно SHA-3 вместо SHA-2.
gigachat3.1-10b-a1.8b отлично справляется с этой задачей вы не думали что можно просто дать модели российской маленькой сделать то что вы делали ручками
Скорость более чем подходящая и для стартапа приемлемо иметь более просто и костыльное решение.
NVIDIA GeForce RTX 5060 Ti
VRAM Capacity: 15.93 GB
Мне кажется ваши труды не стоят одной потребительской видюхи.
Во всяком случае ловит эта модель неплохо. Но для коммерции стоит взять либо по больше либо не квантованную.
Да, в такой постановке совет имеет смысл. Наверное, я бы даже сначала просил модель написать небольшой план или пошаговую инструкцию или вообще просто поразмышлять на тему, как лучше это сделать, а потом её же попросить план этот отредактировать с учётом вот этого, вот этого и вот этого просто чтобы ручками этот план не писать. Тем более когда модель сама пишет план, она уже что-то себе надумывает и чуть-чуть разбирается в идее этой задачки, и ты сразу отлавливаешь, какие ошибки понимания есть у модели относительно этой темы.
Все эти расписывания по шагам не нужны, потому что внутри chain of thought и так они составляют план, и так они работают по шагам. Их учили мыслить по шагам. А если чат гпт попросить думать вслух или писать по шагам, он откажеться, потому что его научили не показывать цепочку рассуждений, чтобы не давать конкурентам ее.
[Сущность: Человек] -> [Атрибут: Пальцы = 6, Флаг: Явное переопределение] в итоге нужен NLP который переведет запрос из человек читаемого до машиночитаемого с этими вашими флагами.
заблокирует этот мусорный кадр.
тут вы переизобрели дискриминатор давайте вперед найдите локацию ошибки вымарайте ошибку чтобы модель перегенерировала обратила внимание на это.
Вы снова смотрите на проблему через призму софта (Safety Guardrails), а не железа.
Не согласен. Язык софта может описать язык железа полностью. Так же как алгебра описывает арифметику. Не нужно ссылаться на магическое "железо" если нельзя описать на уровне софта то и не получиться в железе.
парсер на входе формирует граф
Сколько Гигабайт флагов у вас? Мне кажется это ответить на множество вопросов. Посмотрите на N-граммы от дипсик у них вообще терабайт N-грамм.
И пока вообще непонятно вы анализируете внутреннее состояние или входные данные.
В итоге нарисует пришельца, а мне нужен был человек с 6 пальцами
Или более празаичный пример с 4 пальцами. И сечас вы скажите, что она выдаст интент инвалида.
Исходя из всех ваших слов могу предположить, что вы строите векторы отказа как в современных ллм.
Если вы не замечали если спросить любую комерческую ллм например gpt oss или qwen то они без раздумываний зачастую с первого токена. Спросите такую модель о любо теме из запрещенных тем. Даже если ты прикинешься токсикологом или белым хакером, она откажет на первом токене.
Можно использовать ллм и семплировать токены с четными и нечетными номерами чтобы получить на выходе токены которые будут нести информацию. Стенография на новом уровне. Ведь текст правдоподно генерируеться сам.
Мура какая-то. Вы говорите об отсутствии ветвлений но при этом о компиляции.
В статье даже не написано о том что вообще реализуеться. ИИ апскейл или ллм?
Если мы можем за O(1) времени алгоритмически доказать, что текущий интент приведет к структурному сбою
Приведите пример того что должно привести к сбою и как это архтектурно проверяется.
Тем более ллм тоже по вашей логике o(1) потому что они по большой части перемножение матриц без ветвлений.
Почитав коменты добавлю
Если пользователь попросил нарисовать человека с 6 пальцами ваша модель справиться?
Если да то это магия потому что для разрешения самой задачи того что попросил пользователь надо как миниум (n) операций просто анализа слов пользователя.
Да у нас есть Сертификация ФСТЭК а так же Закон об ОРИ(если сервер или мессенджер свой делать) и ос содействии их со следствием. Так что важно оценить легальность и отсутствие последствий.
Дай бог не очень сильно обфусцировали, а то ведь и могли чтобы усложнить реверс инжиниринг. С учетом того что он шлет зашифрованные пакеты и пока даже не понятно какую именно инфу он сливает(только по внешним признакам пока известно) . И не будем подсказывать, что можно делать аутентификацию исполнителя кода(то есть криптографическая проверка, что сообщение отправляется с реального и неизменного клиента MAX) в общем ждем "античит" в максе и надеемся что этого не будет.
Это правда. как вариант пересылать фото внутри ворд документа. Или если есть использовать пересылку как файл. Но это ломает некоторую часть идеи приватности(детектируемости) которой хочется добиться при использовании стеганографии.
Дело в публичности. Нужно чтобы был именно публичный ключ например в виде QR кода на аватарке. Подменять аватарку у других пользователей крайняя мера. Важно отметить что это может быть ключ подписи чтобы каждый мог убедиться что сообщения обмена ключей подписаны лично мной.
Diffie–Hellman уязвим к подмене. Если у нас есть "публичный" канал с аутентификацией то он защищен. То есть если вы уверены что именно ваш дедушка отправил вам это сообщение с публичным ключом то нет никакой опасности. То есть в нашем сценарии если вы уверены что Майор(первая буква MitM) не подменил "рукопожатие" причем с двух сторон то вопросов не возникнет.
Хорошая идея, но в статье нет самого важного для security инструмента: open source, понятного описания хранения пароля, ограничений на слабые пароли и независимой проверяемости билда. И главное - у вас не описан нормальный обмен ключами через публичную криптографию: хотя бы X25519 для обычного key exchange или CRYSTALS-Kyber PQ сценария уже стандартизированный NIST, а сейчас всё держится на заранее общей парольной фразе.
Контекст можно выгружать в RAM, да это снизит скорость генерации, но откроет куда больше возможностей.
"конкретный текст" значит все такие хешируеться промт после санитизации? Тогда у такого текста вполне достаточная энтропия.
Я наверно не очень понимаю, что такое аудит в данном контексте.
Да я понял о каком кейсе идет речь но где используется хеш? Для адресации по базе с PII?
Ключ желательно чтобы был не один. По сути нужен алгоритм посолки или для вас ближе к перчению хешей.
https://en.wikipedia.org/wiki/Pepper_(cryptography)
А как это объясняется? Атака дополнением? Тогда можно SHA-3 вместо SHA-2.
gigachat3.1-10b-a1.8b отлично справляется с этой задачей
вы не думали что можно просто дать модели российской маленькой сделать то что вы делали ручками
Скорость более чем подходящая и для стартапа приемлемо иметь более просто и костыльное решение.
NVIDIA GeForce RTX 5060 Ti
VRAM Capacity: 15.93 GB
Мне кажется ваши труды не стоят одной потребительской видюхи.
Во всяком случае ловит эта модель неплохо. Но для коммерции стоит взять либо по больше либо не квантованную.
Да, в такой постановке совет имеет смысл. Наверное, я бы даже сначала просил модель написать небольшой план или пошаговую инструкцию или вообще просто поразмышлять на тему, как лучше это сделать, а потом её же попросить план этот отредактировать с учётом вот этого, вот этого и вот этого просто чтобы ручками этот план не писать. Тем более когда модель сама пишет план, она уже что-то себе надумывает и чуть-чуть разбирается в идее этой задачки, и ты сразу отлавливаешь, какие ошибки понимания есть у модели относительно этой темы.
Все эти расписывания по шагам не нужны, потому что внутри chain of thought и так они составляют план, и так они работают по шагам. Их учили мыслить по шагам. А если чат гпт попросить думать вслух или писать по шагам, он откажеться, потому что его научили не показывать цепочку рассуждений, чтобы не давать конкурентам ее.
[Сущность: Человек] -> [Атрибут: Пальцы = 6, Флаг: Явное переопределение] в итоге нужен NLP который переведет запрос из человек читаемого до машиночитаемого с этими вашими флагами.
тут вы переизобрели дискриминатор давайте вперед найдите локацию ошибки вымарайте ошибку чтобы модель перегенерировала обратила внимание на это.
Не согласен. Язык софта может описать язык железа полностью. Так же как алгебра описывает арифметику. Не нужно ссылаться на магическое "железо" если нельзя описать на уровне софта то и не получиться в железе.
Сколько Гигабайт флагов у вас? Мне кажется это ответить на множество вопросов.
Посмотрите на N-граммы от дипсик у них вообще терабайт N-грамм.
И пока вообще непонятно вы анализируете внутреннее состояние или входные данные.
И до ротации ключей недалеко.
В итоге нарисует пришельца, а мне нужен был человек с 6 пальцами
Или более празаичный пример с 4 пальцами. И сечас вы скажите, что она выдаст интент инвалида.
Исходя из всех ваших слов могу предположить, что вы строите векторы отказа как в современных ллм.
Если вы не замечали если спросить любую комерческую ллм например gpt oss или qwen то они без раздумываний зачастую с первого токена. Спросите такую модель о любо теме из запрещенных тем. Даже если ты прикинешься токсикологом или белым хакером, она откажет на первом токене.
Можно использовать ллм и семплировать токены с четными и нечетными номерами чтобы получить на выходе токены которые будут нести информацию. Стенография на новом уровне. Ведь текст правдоподно генерируеться сам.
Мура какая-то. Вы говорите об отсутствии ветвлений но при этом о компиляции.
В статье даже не написано о том что вообще реализуеться. ИИ апскейл или ллм?
Приведите пример того что должно привести к сбою и как это архтектурно проверяется.
Тем более ллм тоже по вашей логике o(1) потому что они по большой части перемножение матриц без ветвлений.
Почитав коменты добавлю
Если пользователь попросил нарисовать человека с 6 пальцами ваша модель справиться?
Если да то это магия потому что для разрешения самой задачи того что попросил пользователь надо как миниум (n) операций просто анализа слов пользователя.
Да у нас есть Сертификация ФСТЭК а так же Закон об ОРИ(если сервер или мессенджер свой делать) и ос содействии их со следствием. Так что важно оценить легальность и отсутствие последствий.
Важный момент.
можно даже напрямую из клавиатуру при использовании потокового шифра которым и является галуовый аес
Дай бог не очень сильно обфусцировали, а то ведь и могли чтобы усложнить реверс инжиниринг. С учетом того что он шлет зашифрованные пакеты и пока даже не понятно какую именно инфу он сливает(только по внешним признакам пока известно) . И не будем подсказывать, что можно делать аутентификацию исполнителя кода(то есть криптографическая проверка, что сообщение отправляется с реального и неизменного клиента MAX) в общем ждем "античит" в максе и надеемся что этого не будет.
Это правда. как вариант пересылать фото внутри ворд документа. Или если есть использовать пересылку как файл. Но это ломает некоторую часть идеи приватности(детектируемости) которой хочется добиться при использовании стеганографии.
Дело в публичности. Нужно чтобы был именно публичный ключ например в виде QR кода на аватарке. Подменять аватарку у других пользователей крайняя мера. Важно отметить что это может быть ключ подписи чтобы каждый мог убедиться что сообщения обмена ключей подписаны лично мной.
Diffie–Hellman уязвим к подмене. Если у нас есть "публичный" канал с аутентификацией то он защищен. То есть если вы уверены что именно ваш дедушка отправил вам это сообщение с публичным ключом то нет никакой опасности. То есть в нашем сценарии если вы уверены что Майор(первая буква MitM) не подменил "рукопожатие" причем с двух сторон то вопросов не возникнет.
Хорошая идея, но в статье нет самого важного для security инструмента: open source, понятного описания хранения пароля, ограничений на слабые пароли и независимой проверяемости билда. И главное - у вас не описан нормальный обмен ключами через публичную криптографию: хотя бы X25519 для обычного key exchange или CRYSTALS-Kyber PQ сценария уже стандартизированный NIST, а сейчас всё держится на заранее общей парольной фразе.