здравствуйте, ваш обзор точно и доступно передаёт содержание 3-МР и может использоваться как отправная точка для инвентаризации и gap анализа. Однако выполнение перечисленных организационных мер ещё не означает доказанную безопасность ИИ-системы.
Главный следующий шаг - перейти от наличия политик и контролей к измерению их эффективности: воспроизводимым adversarial-тестам, оценке false positives и false negatives, контролю полномочий агентов, проверке цепочки поставок, безопасному журналированию и регрессионной верификации после каждого изменения. Особенно это важно для агентных систем, где поверхность атаки выходит далеко за пределы самой модели и включает память, RAG, плагины, инструменты и межагентное взаимодействие.
Поэтому 3‑МР следует рассматривать не как готовый сертификат безопасности, а как минимальный каркас управления рисками, который каждая организация должна дополнить собственной моделью угроз, доказательными тестами и непрерывным runtime-контролем
Резюме от Опус 5 (который позавчера выпустили) и я с ним согласен: добротный конспект чужих статей, надевший костюм инженерного отчёта. Если бы автор заменил половину теории одним графиком «наш вот такой сервис, вот такая модель, вот что дал переход с vLLM на SGLang» — вышел бы текст, которого больше нигде не прочитаешь. А так это пересказ документации с корпоративным логотипом.
погонял Claude Science, он подключает к ревью Соннет 5, после того как сам отработает (по умолчанию на 4.8 опусе), так вот пока обвязка в виде Claude Science слабовато, нежели чем работать просто в Claude Code с Opus 4.8 Ultra, но графики и картиночки красивые рисует
потому что 5.5 можно сравнивать только с 4.8 из-за её среза знаний и золежжных возможностей, так что Фэйбл/Мифус как раз и нужно с 5.6 гонять, тем более по заявленным бенчам они плюс минус на одном уровне
Вон то что сверху, там можно деньги отмывать и откатывать, а с помощью вашего друга нет, вот очевиден ответ кого пропиарят и кому будут субсидии выдавать.
здравствуйте, ваш обзор точно и доступно передаёт содержание 3-МР и может использоваться как отправная точка для инвентаризации и gap анализа. Однако выполнение перечисленных организационных мер ещё не означает доказанную безопасность ИИ-системы.
Главный следующий шаг - перейти от наличия политик и контролей к измерению их эффективности: воспроизводимым adversarial-тестам, оценке false positives и false negatives, контролю полномочий агентов, проверке цепочки поставок, безопасному журналированию и регрессионной верификации после каждого изменения. Особенно это важно для агентных систем, где поверхность атаки выходит далеко за пределы самой модели и включает память, RAG, плагины, инструменты и межагентное взаимодействие.
Поэтому 3‑МР следует рассматривать не как готовый сертификат безопасности, а как минимальный каркас управления рисками, который каждая организация должна дополнить собственной моделью угроз, доказательными тестами и непрерывным runtime-контролем
Резюме от Опус 5 (который позавчера выпустили) и я с ним согласен:
добротный конспект чужих статей, надевший костюм инженерного отчёта. Если бы автор заменил половину теории одним графиком «наш вот такой сервис, вот такая модель, вот что дал переход с vLLM на SGLang» — вышел бы текст, которого больше нигде не прочитаешь. А так это пересказ документации с корпоративным логотипом.
"это не Мы" честно соврали в РКН
погонял Claude Science, он подключает к ревью Соннет 5, после того как сам отработает (по умолчанию на 4.8 опусе), так вот пока обвязка в виде Claude Science слабовато, нежели чем работать просто в Claude Code с Opus 4.8 Ultra, но графики и картиночки красивые рисует
потому что 5.5 можно сравнивать только с 4.8 из-за её среза знаний и золежжных возможностей, так что Фэйбл/Мифус как раз и нужно с 5.6 гонять, тем более по заявленным бенчам они плюс минус на одном уровне
вообще не корректное сранение между ними, сегодня/завтра входит 5.6 гпт, вот его с Фэйблом корректно сравнивать
На самом деле очень интересно и очень полезно, даже я бы сказал круто, ваши находки мне тоже помогли решить некоторые вопросы)
SAP вряд ли будет отвечать за это, так как подрядчик Infosys , с ними и будут судиться
не заметил, совсем, что дома, что на работа, сам с Владивостока
победил ChatGPT
Вон то что сверху, там можно деньги отмывать и откатывать, а с помощью вашего друга нет, вот очевиден ответ кого пропиарят и кому будут субсидии выдавать.