Обновить
0
Руслан@rusfbm

Пилю разумный ИИ

9
Подписчики
Отправить сообщение

Тогда в Африку местным диктаторам. Кто-нибудь да клюнет 🤣

Так сделайте предложение Белоусову, может отвалит деньжат.

А этих данных и не будет без чипированых военных. Значит нужна виртуальная арена с умными ботами. Предлагаю сместить свои исследования в это направление. Грубо говоря, загрузи карту местности, получил данные с дрона -> отправляешь на ваш сервак -> получаешь миссию на захват контрольной точки.

Не думали о тех временах, этак 2050-х, когда все военные будут чипированы, а ии будет централизованно курировать все военные миссии , в том числе прогнозировать поведение врага при помощи микропбла?

Предлагаю сократить до мпро! 🗿

Как считаете, удешевят ли роботов водородные топливные элементы ?

При той же массе в 300 раз дольше работа робота на водороде.

Кто-то идет в сжатие и иерархию единиц, кто-то в графы и онтологии, кто-то в символы. Но почти везде в итоге всплывает один и тот же вопрос: где живёт право на вердикт — в статистике весах или в четких переходах?

Я как раз с другой стороны подошел к этой проблеме : через явное состояние решения, локальный пересмотр при изменении исходных данных и через слой, который обучение не имеет права подменять. Кому интересна это направление — кратко здесь: https://aigalo.com/

По сути я ответил на вопрос "что лежит в основе всего?" что если все не взвешивать, а обучаться на отношениях, но при этом сохранять проверяемый след решения.

По факту более менее кодит фубля. Альтернатив нет и даже, хехе, от гигачата. 🗿

Я похожим образом пытался решить недавно задачу про близнецов. Сжег много токенов, но зато теперь имею представление обо всех подводных камнях задачи. Для этого и нужны агенты.

А статья крутая и очень показательная как нужно работать с ИИ .

Не проще. Просто подключаешь к Алисе умные выключатели и все: можешь лежать в кровати и выключить свет на кухне ! Лепота! Или, допустим , стало тебе холодно: фразой включил себе обогреватель или кондей.

Или ты, допустим, уехал на месяц, а выключить свет забыл ! А так пару кнопок нажал и все под контролем ! Ну и классика: пошпионить за котом !

Эх вы, ментальные старички и борцы с ИИ. Заменит вас ИИ, точно заменит.

P.S. Пройдет лет 10 и по фразе "Алиса, иди ко мне!" к тебе в постель придёт шикарная робот жена! 🗿ну или под стол зайдёт и будет наяривать ! 🤣

А я читал Незнайку в Солнечном городе. Вот там был социализм!

Ссейчас развивается еще другое направление — тензорное сжатие. При это каждый вес не раскладывается в {-1,0,1}, а производится низкоранговая факторизация самих матриц через tensor networks. Multiverse Computing на этом уже поднял оценку примерно до $1,7 миллиарда.

Отсюда вопрос: как квантование стыкуется с тензорным сжатием? Или после агрессивного квантования тензорный подход уже бесполезен?

Я предлагаю довести вашу идею до уровня владения собственным сознанием.

Вот как я понимаю сознание.

Сознание — это координатор между двумя разными мирами. Внешний мир — всё, что приходит извне и не выводится из текущего состояния системы. Внутренний мир — собственный код, структура, законы, по которым система устроена. У внутреннего мира должна быть своя жёсткая физика: что можно менять, что нельзя, какие инварианты нельзя нарушать. Сознание стоит между ними. Оно видит оба мира, сравнивает их и решает, можно ли принимать изменение. Когда они расходятся — оно не даёт контуру закрыться. Именно в этом месте возникает незавершённое ожидание, а не внутри очередного регулятора.

Теперь к статье.

Ouroboros уже очень близко подошёл к рабочей машине самоизменения. Агент переписывает собственное ядро, есть конституция, иммунная система, ревью, откаты. Это сильно. Но роли всё ещё смешаны. Код одновременно является и внутренним миром, и тем, кто этот мир меняет, и отчасти тем, кто принимает решения о допустимости изменений. Получается мощный самопереписывающийся луп, но не чистое триединство.

Чтобы стало чище, нужно развести три вещи жёстко.

Внешний мир — терминал, файлы, инструменты, пользователь, среда. То, что система не контролирует.

Внутренний мир — сам код как отдельная среда со своими законами. Это не про редактирование кода, а собственно физика допустимых мутаций, инвариантов и разрушений.

Сознание — отдельный слой, который не является свободно переписываемой частью ядра. Его задача одна: сравнивать состояние внешнего и состояние внутреннего и либо пропускать изменение, либо ставить boundary.

Тогда самомодификация перестаёт быть просто моделью с агентом, который улучшает сам себя а становится согласованием двух разных онтологий. Агент может эволюционировать, но только через координатора, который держит отношение между миром снаружи и миром собственного кода.

Это, мне кажется, следующий шаг после того, что уже сделано в Ouroboros. Не добавить ещё один умный слой, а провести онтологическую границу.

Давно я нагенерил статью о том, что такое сознание , называется "Сознание как узел сопряжения между внешним и внутренним мирами: построение предельно логичной модели на базе Киотской школы". Можете почитать на досуге. ⁠

Теперь конкретные предложения.

Сделайте три контура с разными правами.

Первый контур — внешний. Субагенты, которые работают только с терминалом, файлами, инструментами, пользователем и средой. Они не имеют права трогать ядро. Их мир — внешний.

Второй контур — внутренний мир. Отдельная группа субагентов (или даже один выделенный), чья единственная среда — сам репозиторий. Они не решают внешние задачи. Они моделируют код как мир: зависимости, инварианты, допустимые мутации, что считается разрушением целостности. У этого мира должны быть явные законы (часть из них уже есть в BIBLE.md и иммунной системе, но их нужно оформить как физику внутреннего мира, а не просто как список запретов).

Третий контур — координатор. Это не обычный субагент из роя. Это привилегированный слой, который:

  • читает состояние внешнего контура,

  • читает состояние внутреннего (код + его законы),

  • и только он имеет право сказать да или нет коммиту в ядро.

Сейчас у вас мультимодельное ревью и scope-review уже почти выполняют эту функцию. Нужно сделать следующий шаг: вынести финальное решение о мутации ядра из общего роя и закрепить его за отдельным, максимально защищённым компонентом. Этот компонент не должен свободно переписывать сам себя. Чем выше уровень, тем меньше свободы на самоизменение.

Можно создать контролирующий LLM , который будет все локальные LLM приводить в соответствие с законом страны .

Спасибо! Вы очень круты !

Ну вы не передергивайте, по gmail в любой компании официальной никто не ничего не пересылает. Мне кажется, по мере распространения локальных LLM появится такая услуга как платная обезличенная выгрузка результатов обучения на сервер агрегатора. Считайте, я вам новый бизнес придумал ☺️

Так можно на сервера алибабы инфу спускать: кто там разберётся 🤣 Китай то не враг, а хозяин нынче. 🤣

А смысл поста в том, что нужно покупать пару видеокарт по 500к и запускать их сразу после утреннего кофе в hh отделе и бухгалтерии ? Как я понял, Вы запускаете на россциском рынке доработанный ии? Как называется и чем отличается ? Похвастайтесь 🔥

Фубля пахала лучше опуса 4.8. Проверял на сложных задачах. Так что конкурентов ей не было до опуса 5.

В том и дело, что в России это порицается. По общему мнению хабра (субъективно), надо быть программистом в сбере или другом банке, тогда жизнь удалась.

Понятно, круто написано, в американском стиле. У нас в основном надсмеиваются и критикуют за стартаперство.

Информация

В рейтинге
6 989-й
Откуда
Апрелевка, Москва и Московская обл., Россия
Дата рождения
Зарегистрирован
Активность

Специализация

Вайбкодер, Научный специалист, исследователь
Средний