Да тут скорее наброс в сторону запрета всех иностранных ИИ, как угрозу нацбезопасности. Ибо мешают ценники выкручивать. Но про дроны всё равно занятно.
Russian defense agency. DeepSeek relayed requests from an IT operator working with data from a Russian government agency associated with its Ministry of Defense. The relayed requests exposed live credentials for a Russian government database.
То есть кто-то из подрядчиков Минобороны РФ сливал в Дипсик чувствительные данные, а Дипсик сливал их Клоду*.
*По мнению компании Anthropic.
Хотя мне почему-то кажется, что это были китайские агрегаторы, которые по дешёвке продают API. Ну и потом сливают все диалоги в Moonshot, DeepSeek и Alibaba.
В гугловском поиске по умолчанию отвечает модель Gemini 3.5 Flash Lite. Но если вопрос касается медицины или каких-то других опасных сфер, то явно включается что-то помощнее, либо режим рассуждения выкручивается на максимум. В итоге по большинству неопасных вопросов оно безбожно галлюцинирует, но по медицине такого не наблюдается. Поэтому лучше самому выбирать нужную модель на сайте Gemini или AI Stutio, чтобы не получать ответы-фантазии. Обычно такие ответы легко проверяются фразой "ты уверен?", на которую тут же Gemini начинает приносить глубочайшие извинения и т. д.
То, что кто-то там специально обучал свои модели грамотному русскому, ещё не значит, что это делали с GPT-3.5. Зачем бы им это было делать? Это вообще был экспериментальный проект, никто тогда даже не подозревал, как он выстрелит. И да, трансформеры хорошо приспособлены для переводов. Но это не ограничивается переводом между обычными языками, это также распространяется и на языки программирования. И такие вот метаморфозы могут приводить к нахождению паттернов, которые помогают в решении других задач тоже. Например, задач по нахождению уязвимостей. Ведь компьютерный код - это просто текст из слов на определённом языке.
Этично ли так делать по отношению к юзерам продуктов OpenAI? Или надо будет потом всем покупать отдельный доступ в 10 раз дороже с опцией "мы не будем потом юзать ваши данные для наших целей"?
В обычном бесплатном тарифе есть отключаемая опция:
Что-то я не понял, откуда возникли претензии. В настройках ChatGPT в разделе "Управление данными" есть пункт об использовании содержимого чатов для обучения модели. Его можно выключить. Бакмастер его выключил? Если нет, то какого хрена он вообще вякает? Он сам согласился скормить своё "решение тысячелетия" и разрешил его использовать. Или он всё же галочку снял?
Вон Останкинскую башню построили по образу и подобию травинки. Следует ли из этого то, что Останкинская башня может зацвести или получать энергию фотосинтезом? Не понятна логическая взаимосвязь.
Всё-таки у телебашни не было задачи быть моделью травинки.
Современные искусственные сети вообще не похожи на те, которые создавались "по образу и подобию". А те, которые создавались "по образу и подобию", создавались на основе не соответствующей действительности модели нейрона.
Модель на то и модель, чтобы быть лишь приближением действительности.
Они вообще не думают. Это J-пространство просто показывает на распределение вероятностей токенов, на которые влияет текущий. Там же в формулах всё написано.
По той же логике и люди вообще не думают. Это просто набор нейронов и распределение вероятностей спайков во времени.
В современных сетях нет даже такого понятия, как отдельный нейрон.
Число в векторе - это и есть то самое понятие нейрона.
То, что в рассмотрении участвуют не отдельные нейроны, а слои, не отменяет того, что сами слои состоят из нейронов. Так же, как рассмотрение высокоуровневого кода не отменяет существование нулей и единиц, из которых в конечном итоге состоит этот высокоуровневый код.
Реальные нейроны работают совершенно не так, как эти слои. Ну, хотя бы потому что, сигналы передаются не уровнями активации, а последовательностями спайков.
Им и не обязательно работать так же. Экскаватору, чтобы выкопать котлован, совершенно не обязательно повторять биологию живых мышц.
Обработка генетического кода и обработка компьютерного кода - это очень разные процессы. Первый квантовомеханический, второй - логический.
Трансляция, транскрипция и репликация ДНК на базовом уровне управляется законами химии и термодинамики. Сам процесс кодирования и считывания информации в ДНК - дискретный, цифровой и логический. Рибосома читает триплеты нуклеотидов и по строгому логическому алгоритму (таблице генетического кода) сопоставляет им аминокислоты. К тому же, не очень понятно, почему вы противопоставляете квантовую механику и логику. Квантовомеханические процессы - это отражение математических абстракций, которые подчиняются строгой квантовой логике. Она не менее строгая, чем классическая, просто у неё другие аксиомы.
На самом деле, мы во многих случаях даже не можем просимулировать эту свёртку протеинов достаточно точно. Поэтому строим всякие грубые приближения типа AlphaFold.
AlphaFold 3 предсказывает 3D-структуры протеинов с атомарной точностью, конкурирующей с дорогими и сложными физическими методами. Тот факт, что мы долгое время не могли просимулировать свёртку протеинов, говорит лишь о недостаточном развитии наших технологий, а не о том, что это какой-то там волшебный механизм, который не подчиняется строгой математике.
И не факт, что процесс синтеза белков по ДНК сводится к логическим вычислениям.
Синтез белка - это сборка цепочки аминокислот по инструкции из ДНК, максимально строгий логический процесс. А вот сворачивание этой цепочки в трёхмерную структуру уже не подчиняется законам строгой логики в дискретной математике. Но его всё равно можно свести к математическим вычислениям, просто это будет математика непрерывных функций.
Люди почему-то требуют, чтобы ИИ был такой же, как они сами. Но ему совсем не обязательно повторять людской интеллект, чтобы быть интеллектом.
На русском - нет. Был даже такой эксперимент, назывался Open Assistant. Там одно из предложений сообщества было - обучить модель переводить данные из датасета на английском, чтобы использовать их для ответов на других языках. Но оказалось, что её этому обучать не требовалось, она сама прекрасно эту задачу решила самостоятельно.
В общем, там ничего такого, что говорило бы о скрытых мотивах или какой-то психологии нейросетей нет.
У вас в мозге как раз нейросеть. По образу и подобию таких нейросетей придумали искусственные нейросети. То, что у вас в голове не трансформер, это всего лишь различие в архитектуре, не более того.
Ничего нового в этом J-пространстве нет.
Это пример, когда они думают одно, а говорить могут другое.
Квантовые аккумуляторы тут на днях изобрели.
Такие интимные подробности даже блокчейн не фиксирует. Разве что по чеку.
Что идёт в разрез с интересами Anthropic и OpenAI.
Да тут скорее наброс в сторону запрета всех иностранных ИИ, как угрозу нацбезопасности. Ибо мешают ценники выкручивать. Но про дроны всё равно занятно.
В оригинальной статье Антропика есть ещё один занятный абзац:
То есть кто-то из подрядчиков Минобороны РФ сливал в Дипсик чувствительные данные, а Дипсик сливал их Клоду*.
*По мнению компании Anthropic.
Хотя мне почему-то кажется, что это были китайские агрегаторы, которые по дешёвке продают API. Ну и потом сливают все диалоги в Moonshot, DeepSeek и Alibaba.
В любом случае Anthropic теперь будет грызть землю, лишь бы тоже что-нибудь доказать из этого списка (ну или опровергнуть).
Ну логи - это одно. А использование логов для обучения - это другое. У Muse Spark даже ценник на API разный в зависимости от этого.
В гугловском поиске по умолчанию отвечает модель Gemini 3.5 Flash Lite. Но если вопрос касается медицины или каких-то других опасных сфер, то явно включается что-то помощнее, либо режим рассуждения выкручивается на максимум. В итоге по большинству неопасных вопросов оно безбожно галлюцинирует, но по медицине такого не наблюдается. Поэтому лучше самому выбирать нужную модель на сайте Gemini или AI Stutio, чтобы не получать ответы-фантазии. Обычно такие ответы легко проверяются фразой "ты уверен?", на которую тут же Gemini начинает приносить глубочайшие извинения и т. д.
Почему же тогда за её решение дают мульён? Я б не отказался от мульёна-то...
А до появления ракет никто на Луну не полетел. И что?
Это всё прекрасно можно реализовать и сейчас с обычным рублём в банке - по МСС-коду. Почему банки такого до сих пор не предлагают - загадка.
Вот только до появления этого калькулятора что-то никто задачу не решил.
То, что кто-то там специально обучал свои модели грамотному русскому, ещё не значит, что это делали с GPT-3.5. Зачем бы им это было делать? Это вообще был экспериментальный проект, никто тогда даже не подозревал, как он выстрелит. И да, трансформеры хорошо приспособлены для переводов. Но это не ограничивается переводом между обычными языками, это также распространяется и на языки программирования. И такие вот метаморфозы могут приводить к нахождению паттернов, которые помогают в решении других задач тоже. Например, задач по нахождению уязвимостей. Ведь компьютерный код - это просто текст из слов на определённом языке.
В обычном бесплатном тарифе есть отключаемая опция:
Что-то я не понял, откуда возникли претензии. В настройках ChatGPT в разделе "Управление данными" есть пункт об использовании содержимого чатов для обучения модели. Его можно выключить. Бакмастер его выключил? Если нет, то какого хрена он вообще вякает? Он сам согласился скормить своё "решение тысячелетия" и разрешил его использовать. Или он всё же галочку снял?
Ну речь-то не про LLM, а про нейроны.
Всё-таки у телебашни не было задачи быть моделью травинки.
Модель на то и модель, чтобы быть лишь приближением действительности.
По той же логике и люди вообще не думают. Это просто набор нейронов и распределение вероятностей спайков во времени.
Число в векторе - это и есть то самое понятие нейрона.
То, что в рассмотрении участвуют не отдельные нейроны, а слои, не отменяет того, что сами слои состоят из нейронов. Так же, как рассмотрение высокоуровневого кода не отменяет существование нулей и единиц, из которых в конечном итоге состоит этот высокоуровневый код.
Им и не обязательно работать так же. Экскаватору, чтобы выкопать котлован, совершенно не обязательно повторять биологию живых мышц.
Трансляция, транскрипция и репликация ДНК на базовом уровне управляется законами химии и термодинамики. Сам процесс кодирования и считывания информации в ДНК - дискретный, цифровой и логический. Рибосома читает триплеты нуклеотидов и по строгому логическому алгоритму (таблице генетического кода) сопоставляет им аминокислоты. К тому же, не очень понятно, почему вы противопоставляете квантовую механику и логику. Квантовомеханические процессы - это отражение математических абстракций, которые подчиняются строгой квантовой логике. Она не менее строгая, чем классическая, просто у неё другие аксиомы.
AlphaFold 3 предсказывает 3D-структуры протеинов с атомарной точностью, конкурирующей с дорогими и сложными физическими методами. Тот факт, что мы долгое время не могли просимулировать свёртку протеинов, говорит лишь о недостаточном развитии наших технологий, а не о том, что это какой-то там волшебный механизм, который не подчиняется строгой математике.
Синтез белка - это сборка цепочки аминокислот по инструкции из ДНК, максимально строгий логический процесс. А вот сворачивание этой цепочки в трёхмерную структуру уже не подчиняется законам строгой логики в дискретной математике. Но его всё равно можно свести к математическим вычислениям, просто это будет математика непрерывных функций.
Люди почему-то требуют, чтобы ИИ был такой же, как они сами. Но ему совсем не обязательно повторять людской интеллект, чтобы быть интеллектом.
На русском - нет. Был даже такой эксперимент, назывался Open Assistant. Там одно из предложений сообщества было - обучить модель переводить данные из датасета на английском, чтобы использовать их для ответов на других языках. Но оказалось, что её этому обучать не требовалось, она сама прекрасно эту задачу решила самостоятельно.
У вас в мозге как раз нейросеть. По образу и подобию таких нейросетей придумали искусственные нейросети. То, что у вас в голове не трансформер, это всего лишь различие в архитектуре, не более того.
Это пример, когда они думают одно, а говорить могут другое.