Pull to refresh
22
25
Subscribers
Send message

Перед Пасхой вопрос «Что есть истина?» всегда становится особенно актуальным. Но Пасха пройдет, а вопрос останется. К счастью сейчас у нас появились принципиально новые децентрализованные технологии, которые могут помочь найти решение вопроса, который никто не мог решить предыдущие 2000 лет.

Да, поэтому мы создаем численный рейтинг достоверности и репутации, чтобы дать людям измеримый ориентир. Мы исходим из того, что по любой теме всегда может быть как минимум три гипотезы: господствующая, устаревшая и новая перспективная, идущая на смену господствующей. Причем все эти гипотезы формируют пространство смыслов с достоверностью больше 0 и меньше 1 с общей картиной мнений, нормированной к общей сумме 100%. В итоге все гипотезы приобретают рейтинг достоверности по принципу 40%+30%+20%+5%+3%+1%+… 

 Это является отражением философской концепции конструктивного альтернативизма, которая сейчас является главенствующей в гносеологии  

https://ru.wikipedia.org/wiki/Конструктивный_альтернативизм

Правда уже и так под угрозой из-за бурного развития многочисленных дипфейк-технологий на основе искусственного интеллекта, которые в ближайшее время заполнят все информационные ресурсы сфальсифицированным контентом. Только от вас зависит, успеем ли мы что-то этому противопоставить. Запугиванием вы нам точно никак в работе не поможете.

А кому вы платить собрались? Интернациональному консенсусу?

Не хочу забегать вперед и прожектерствовать, но цель Киберправды — создание принципиально новой социально-ответственной журналистики.

Пусть сначала с Биткойном разберутся. Но в одном вы правы — их ресурсы несравнимы с возможностями нашей маленькой команды. Нам очень нужны помощь и поддержка.

В алгоритме Киберправды никак не учитывается количество сторонников тех или иных утверждений.

Нет. Аргументы Галилея были логичны, а аргументы церковников бездоказательны, противоречивы и не прошли бы проверку на фальсифицируемость в Киберправде.

Сорри, мы просто не хотим преждевременно подставляться пока идет тестирование и отладка. Потом алгоритм будет прозрачным для любого аудита.

Именно поэтому Киберправда никому не верит, а непрерывно оценивает динамический баланс всех фактов, аргументов и подтверждающих их документов.

Конкретная техническая реализация сейчас работает на нашем сервере в закрытом тестировании.

Именно поэтому Киберправда оценивает не только сиюминутную достоверность, но и долговременную репутацию, которая является результатом игры «в долгую» и зарабатывается на протяжении всей жизни, а разрушена может быть за минуту.

Мы пока не раскрываем все подробности матмодели, чтобы не разглашать ноу-хау, но фактически матмодель буквально дословно описана в этом абзаце:

«Киберправда оценивает баланс аргументов, используемых разными авторами в качестве подтверждений или опровержений различных противоречивых фактов для оценки их достоверности, с точки зрения консенсуса в больших социально-разнородных группах. Из этих фактов авторы выстраивают свои личные описания картины происходящих событий, за достоверность которых они отвечают персональной репутацией. Непредвзятый и объективный корреляционный алгоритм на основе теории графов проверяет эти описания на взаимное соответствие и непротиворечивость по принципу «всех со всеми» и находит наиболее достоверные последовательности фактов, которые описывают разные версии происходящего. Разные версии конкурируют между собой по величине потока смысла, а наиболее достоверные версии становятся аргументами в цепи событий для фактов более высокого или более низкого уровня, что замыкает цепь взаимного влияния аргументов и контраргументов и создает глобальный гиперграф знаний, в котором наибольший поток смысла течет через устойчивые цепочки непротиворечивых научных знаний, в наибольшей степени соответствующих принципу фальсифицируемости и критерию Поппера. Критический путь в последовательности наиболее достоверных фактов формирует автоматически генерируемую статью по каждой из существующих версий событий, которая динамически перестраивается в соответствии с новыми поступающими свидетельствами и желаемыми уровнями достоверности информации в диапазоне от нуля до 100%, установленными читателями в своих персональных настройках. В результате пользователям доступны несколько статей наподобие статей в Википедии, описывающих конкурирующие версии событий, ранжированные по объективности в соответствии с желаемым уровнем достоверности».

Алгоритм повышает рейтинг фактам, у которых есть подтвержденные доказательства с развитыми многочисленными непрерывными цепочками подтвержденных фактов, и при этом понижает рейтинг аргументов, которые опровергаются надежными фактами, подтвержденными своими непрерывными цепочками подтвержденных доказательств. При этом бездоказательные аргументы игнорируются, а цепочки утверждений, которые на них построены, отбрасываются. В результате в глобальном гиперграфе коллективного интеллекта выкристаллизовывается ядро целостных непротиворечивых научных знаний, поскольку только научные знания являются непротиворечивыми, а непротиворечивые данные являются научными.  
  
При этом фейки всегда противоречат друг другу, а реальные факты всегда являются опровержением фейков. В итоге: факты подтверждаются фактами, а фейки противоречат фейкам, да еще и опровергаются фактами. Это структурный дисбаланс, заложенный в основу алгоритма для систематического перевеса в сторону фактов.

Помимо тонких признаков фальсификации, которые можно выявлять и анализировать, дипфейки всегда связаны с каким-то нарративом, который можно разложить на элементарные факты и проверить на взаимную непротиворечивость с другими известными фактами. Это позволяет построить принципиально новую систему анализа достоверности информации и и оценки репутации ее авторов, которая описана и прототип которой показан здесь https://habr.com/ru/sandbox/207462

Вы не хуже меня знаете, что существуют тысячи форумов и блогов специалистов в самых разных областях знаний. Но сейчас статус этих людей в интернете неотличим от всех остальных пользователей и у них нет инструментов, чтобы донести свою точку зрения и пробиться через кликбейтные CEO и SMM технологии. Существуют миллионы ученых и просто грамотных, знающих многое людей, которые сейчас не имеют инструментов кроме Википедии, чтобы донести свою точку зрения. При этом даже в Википедии такие люди подвергаются давлению администраторов. Кроме того, есть миллионы простых людей, которые устали от фейков и лжи. Коллективная сеть всех умов человечества должна дать этим людям инструмент независимой оценки их вклада в общий массив знаний и реального опыта, которого в действительности вообще нет у нейросетей.

Несмотря ни на что, галлюцинации нейросетей являются их фундаментально неустранимым свойством и нейросети будут деградировать в процессе обучения на собственных галлюцинациях в Интернете, а люди деградировать в процессе применения деградировавших нейросетей. Один из ведущих специалистов в мире по системам информационной безопасности, профессор Кембриджского университета Росс Андерсон в своей статье https://arxiv.org/abs/2305.17493v2 вообще уже рассматривает сценарий, когда большая часть интернета будет сгенерированной нейросетевой галлюцинацией. Но ни вы, ни я и никакой эксперт и никто вообще не смогут отличить фейк от реальности. Этот процесс он назвал «коллапс нейросетей». Противопоставить ему можно только коллективную нейросеть всех умов человечества. Для взаимной проверки и самосовершенствования LLM и человека нужна возможность сопоставления знаний искусственного интеллекта с коллективным интеллектом. Это то, что может нас вытащить из персональных туннелей реальности и личных информационных пузырей, в которых мы все глубже застреваем поодиночке.

Это связано со знанием и опытом. У нейросетей их в реальности нет. Реальными знаниями и опытом обладают только люди. А еще теперь к проблеме добавляются и нейросетевые галлюцинации. Это тупик. Бессмысленно надеяться на возможность отловить все галлюцинации, поскольку нейросети достигли превосходства над любым самым умным человеком. Это начало потенциальной катастрофы в информационном мире. Решение может быть только в области противопоставления фейковой информации и информации непротиворечивой с имеющимися научными знаниями, поскольку только научные знания непротиворечивы, а значит имеют право претендовать на достоверность. Вот только беда, системы для анализа на непротиворечивость у вас нет. Как нет больше ни одного человека, обладающего всей полнотой достоверной информации. А доверять сертификатам достоверности государств и корпораций больше нельзя. Поэтому задача может быть решена только с помощью нейросети коллективных знаний всего человечества, в которой люди смогут делиться своим реальным опытом и совместными усилиями выявлять фейки, которые ему противоречат. Мы сейчас как раз запускаем прототип такой информационной системы. Если кому интересно - вэлкам в личку.

Для начала обсуждения информационной безопасности хорошо бы дать сперва определение достоверности информации, иначе невозможно даже понять от чего вы себя вообще пытаетесь обезопасить. Но в статье об этом нет ни слова.

Один из ведущих специалистов в мире по системам информационной безопасности, профессор Кембриджского университета Росс Андерсон в своей статье https://arxiv.org/abs/2305.17493v2 вообще уже рассматривает сценарий, когда большая часть интернета будет сгенерированной нейросетевой галлюцинацией. Но ни вы, ни я и никакой эксперт и никто вообще не смогут отличить фейк от реальности. В результате нейросети будут деградировать в процессе обучения на собственных галлюцинациях в Интернете, а люди деградировать в процессе применения деградировавших нейросетей. Этот процесс он назвал «коллапс нейросетей».

Для взаимной проверки и самосовершенствования LLM и человека нужна возможность сопоставления знаний искусственного интеллекта с коллективным интеллектом всего человечества. Это то, что может нас вытащить из персональных туннелей реальности и личных информационных пузырей, в которых мы все глубже застреваем поодиночке. Для этого нужна глобальная многопользовательская база знаний для определения достоверности информации без участия админов, экспертов, искусственного интеллекта или сертификатов государств и корпораций, без кликбейтных лайков или токенов для голосования, которыми можно подкупить любого пользователя. Фактически, нужен новый децентрализованный алгоритм PageRank на блокчейне, но не для отдельных сайтов и публикаций, а для каждого составляющего их факта и аргумента. Это позволит решить наконец проблему достоверности информации в Интернете, особенно сейчас на фоне бурного развития многочисленных дипфейк-технологий на основе искусственного интеллекта, которые в ближайшее время заполнят все информационные ресурсы сфальсифицированным контентом и сможет дать принципиально новый уровень доверия и достоверности для любых задач и проектов в Интернете, особенно для принципиально нового бурно развивающегося рынка web3-технологий.

Такая база реальных человеческих знаний позволит ввести в обучение LLM новые, чистые, сгенерированные человеком наборы данных с учетом их достоверности и даст возможность избежать коллапса языковых моделей и уменьшить нежелательные ошибки при создании новых более совершенных поколений генеративных нейросетей.

Буду рад найти желающих принять участие в такой разработке.

У меня есть еще одно практическое решение как избежать коллапса больших языковых моделей. Наша команда уже его реализует — мы делаем проект CyberPravda. Компьютерным нейросетям мы противопоставляем коллективную нейросеть умов всего человечества.

Для взаимной проверки и самосовершенствования LLM и человека нужна возможность сопоставления знаний искусственного интеллекта с коллективным интеллектом всего человечества с учетом достоверности любой информации. Это то, что может нас вытащить из персональных туннелей реальности и личных информационных пузырей, в которых мы все глубже застреваем поодиночке.

Мы нашли принципиально новый способ создать глобальную многопользовательскую базу знаний с функцией определения достоверности информации без участия админов, экспертов, искусственного интеллекта или сертификатов государств и корпораций, без кликбейтных лайков или токенов для голосования, которыми можно подкупить любого пользователя. Фактически, мы разработали новый децентрализованный алгоритм PageRank на блокчейне, но не для отдельных сайтов и публикаций, а для каждого составляющего их факта и аргумента. Мы считаем, что способны решить наконец проблему достоверности информации в Интернете, особенно сейчас на фоне бурного развития многочисленных дипфейк-технологий на основе искусственного интеллекта, которые в ближайшее время заполнят все информационные ресурсы сфальсифицированным контентом. Мы делаем систему, которая позволит всем получить бесплатный свободный доступ к достоверной информации.

Такая база реальных человеческих знаний позволяет ввести в обучение LLM новые, чистые, сгенерированные человеком наборы данных с учетом их достоверности и дает возможность избежать коллапса модели и уменьшить нежелательные ошибки при создании новых более совершенных поколений генеративных моделей.

Буду рад рассказать подробнее, пишите в телегу @sadekovtimur

Information

Rating
5,814-th
Registered
Activity