Обновить
-4

Пользователь

-0,4
Рейтинг
Отправить сообщение

и в Хабре:
Потребительские нейроинтерфейсы 2024
https://habr.com/ru/articles/846582/

нашел подтверждение, что "намерение - можно":
2023. Разработчик подключил ChatGPT к своему мозгу
https://www.pravilamag.ru/news/science-and-technology/28-03-2023/695613-razrabotchik-podklyuchil-chatgpt-k-svoemu-mozgu

- если правильно понял (из SDK-доки), Обучение (намерению) - проводится только через облачную платформу фирмы (а она - в США. Там еще и "эмуляторы" есть, с подпиской за 50$).

в Read.me SDK (смотрю для Python) - формулируются raw-stream пачки по другому:
Код будет выводить новые эпохи по 16 выборок, примерно каждые 62,5 мс"
- т.е. "JSON с 8*16 float, с темпом 1000/62,5=16 раз в сек)

о как - нашел, что и (уже устаревшая, меньше датчиков) Muse2, за $300 - поддерживает (неофициально?) нефильтрованную выдачу сигналов с датчиков.
Вот, что говорит Google (об аналогах Crown):
{Muse 2 / Muse S (Gen 2)

  • Каналы: 4 канала (в основном лобная и височная зоны).

  • Стриминг сырых данных: Официальное потребительское приложение выдает только обработанные графики, но сырой поток доступен бесплатно через открытые библиотеки, такие как Petme (бывший MuLES) или популярный фреймворк BrainFlow
    }

Но если не окажется затылочных датчиков, то не все методы будут возможны (и незабываем, что сырые данные - придется обрабатывать самим).

еще и "стучать (по мозгам)" можно:
https://docs.neurosity.co/docs/api/haptics

нашел raw-stream:
https://docs.neurosity.co/docs/api/osc/#raw-mode
- каждые 4 ms, выдается по пачке: на каждый датчик (которых 8) * по 16 float выборок (за последние 62.5ms. Странно, мне напрашивается "одно значение-усредненное". Но так получается, что, действительно - передают "нефильтрованное").

Нашел еще один бытовой "обруч", аля Muse, с мини-компом, приложением и связью с внешним AI - "Crown" (за 1.5т$):
https://neurosity.co/guides/moving-objects-with-your-mind-bci
- перемотайте до SSVEP - самый быстрый способ: "наши" 4 кнопки - мерцают, различающимися частотами. Уставшись на нужную кнопку, в затылке - без всяких напряжений мысли, воспроизведется частота. Устройство - только выбирает, какая их 4-х частот навязана (или "нет");
- в Crown - (вроде) поддерживаются все три описанных там метода (в "обруче" - 8 ЭЭГ-датчиков, по нескольким зонам, различающимися методом).
В источнике - много восторженных слов, в стиле Остапа Бендера, про Нью-Васюки.
В описании технологии - "скромнее" (так же, как в Muse - только про общую активность/усталось).
В доке на SDK (https://github.com/orgs/neurosity/) - "доступны сигналы с датчиков", "потренируйте навык «Удар левой рукой»":
https://docs.neurosity.co/docs/tutorials/your-first-node-app
- Устройства Neurosity могут распознавать два основных типа мыслительных процессов: намерение и фоновый процесс.

Везде (кольцами) - "засеять" LoRa-"гильзами" (mesh-tastic/-core, "наш ответ Starlink-у" - "Сыроежка").
Так, чтобы каждому устройству соответствовала фиксированная координата, начинка - пороговое срабатывание (уровня звука) и шифрованная передача только по фронту ("нет-есть", "есть-нет"; ну и ACK, дистанционное обновление).
А (дорогостоящие, защищаемые) "мозги" - централизованно.

увидел интересную статью:
"Что такое сознание на самом деле? Новейшие открытия о стволе мозга, эмоциях и природе мышления"
https://dzen.ru/a/amHoYvV8sB5QT2ur
- (соглано этому источнику) сильные эмоции (которые предложено использовать в Интерфейсе) - вообще не в кортексе, а в стволе мозга (структуре, дошедшей без сильных изменений со времен рептилий - инстинкты и рефлексы. Хотя Google, на вопрос "Уровни триединого мозга", утверждает, что за сами эмоции, отвечает третья система - лимбическая).
Т.е.:
1. (медицинская) ЭЭГ - снимает сигналы "не там", и "не то" (кора - только "обволакивает" семантикой - зашумляет: источник отмечает "дум - параллельно много", и "кора - работает на предсказания, для готовности ко всему, что только возможно").

от себя:
Т.е. сознание - "еще не подумало", а мозг - уже приготовился, прогнал все варианты, отобрал основные и преднастроил нейроны.
В каком порядке, проходили варианты - последовательно или параллельно, каждый раз - по другому ("Здесь - патерна нет!" Ералаш).
Т.е. даже "ну тогда, представить себе цепочку во времени, из предполагаемых действий, для реализации намерения" - только шум, как был "белый", так и остался.

2. (источник заявляет, ссылаясь на эксперименты, что) сознание - прячется именно в стволе.

от себя: (вроде как, это кортекс в детстве научается управлять инстинктами, ставя цели выше "хочу жрать". Что это такое, в пересчете на) "Намерение" для кортекса - надо еще подумать.

>Представить красный треугольник

ну Вы и выразились (понимаю, что сократили конкретику "равнобедренного, со стороной 25 см, дорожного знака, с собакой у столба").
А "черный квадрат"? (гы-гы)

принято.
Но лишнее - меня не цепляло (т.ч. можно дальше как пойдет.
Приучен - в ИТ часто "у нас - так принято", и воспринимаю - как признак отношения ко мне, как к равному).
А сам выкаю - "на автопилоте" (по той же ИТ-привычке сисадмина к пользователям - с неведомым офисным положением.
Да и "жизненный опыт" говорит "надо быть проще - тебе, что жалко выкнуть лишний раз".
А на деле, с кем и как, как-то само получается - например, прямо позавчера, обратил внимание, что, одновременно:
- с одним грузчиком - он ко мне на Вы и дружелюбно, а я - не могу ему выкать, только на ты;
- и с другим, серьезным молчуном, рядом - только на Вы).

Продолжая аналогию "АТС на реле": слушая одни срабатывания реле (при соединении абонентов), не понять "о чем разговор".
Возвращаясь к мозгу: т.е. паттерн шума, в одном моменте времени - не содержит особенностей о намерении.
Вы сами приводили пример с не только "входной" мыслью (сознания), а "последствиями" (тонус мышцы, повышение давления).
"Ловить" их в одной голове - вроде правильно (раньше), но (как выше писал - дорого).

И с защитой (от ложных срабатываний) - надо еще подумать, прежде чем "в массы": "намерение "хочу взять мороженное" - начинаю тянуться, мозг - передал, и предмет сам - к тебе", и хлоп по лбу!
Понимаю, что "я увижу движение и ". И что? "отключу обруч", "намерюсь притормозить"?

до меня, вроде, дошло, где "не сходимся" - на фразе "шум" (кто-то из нас не прав):
Вы - под (медицинской и дорогой аппаратурой) ЭЭГ, как пример, привели (бытовой) Muse.
я же, Muse - представляю, как (один, из где-то пяти, давно уже существующих и широко распространенных - в США, "черных ящиков", "для игр", в прямом или переносном смысле. Каждый):
- результат многолетних медицинских иссследований "Неинвазивный интерфейс мозг-компьютер" (цель - достойная Нобелевки), в виде запатентованного способа Как:
- из нескольких сигналов (каждый - аналоговый "шум", в точке на коже головы, под которой Броня-Защита: кость, слой из кучи "перемешанных проводов", и нескольких слоев нейронов) от датчиков (электропотенциалов в N милливольт);
- выделить и преобразовать;
- в полезные сигналы (цифровые, бинарные по сути: "сейчас - альфа-ритм", и усредненные - за 10 секунд/меняются только 1 раз в 10 секунд).

1. Т.е., с таким классом устройств (как я описал), на выходе - уже нет "шума".
И AI (я понимаю, что Вы под 4-х слойкой- понимаете не "сложную LLM", а только "нейронную сеть") - налету, не к чему цепляться. А если "последовательно, во времени" - то и получится предложенная "Азбука морзе".

2. Может быть, Вы знаете/прочитали, что у Muse (в отличии от других), на выходе - N (для каждого датчика) оцифрованных (АЦП) (хоть и очищенных от технического шума-наводок, но) кодов, с сохранением "пропорционально уровню входного сигнала (линейно/дБ)"?
Если можно, либо ссылку, либо где конкретно прочитать.

3. Как я себе представляю работу мозга:
- (медленная - секунды...минуты) химическая реакция, с ШИМ кодированием, да с электронными потенциалами;
- нет (не нашли, пока) конкретного нейрона "яблоко". Но даже, если есть, его активация - "пыль", среди миллионов других, одновременно/рядом "щелкающих" -- мозг, в целом - "ЭВМ/АТС на реле, постоянно щелкающих". Услышать "из-за стены" и выделить одно реле, когда точно таких - "тысячи" - невероятно;
- не спорю про "нужны паттерны", и даже поверну в свою пользу - мозг не думает только одним "реле-яблоко" - там облака связанностей (целые "схемы", а не одна "ячейка");
- и никто не знает, в каком "облаке" скрыто "яблоко" - все эксперименты по зонам, проводились "а давай отключим и посмотрим, что пропало". А работа мозга - "размазана" по всем отделам, одновременно - все шумят, и по своему. И никто не проводит от обратного/как при препарировании лягушки - "давайте заблокируем все разделы, кроме одного, и посмотрим появится ли мысль о яблоке";
- (управляемое) сознание - фокус (работы всего мозга), который не понятно где и "сосредоточен" ли;
- т.е. одномоментно - человек думает над сотнями вопросов - "шумит".

т.е. ТЗ - "одним мозгом".
1. Пока, даже с зонными (видео, моторная, планирование, слух и воспоминания) датчиками, не выделить "представил себе кошку", а только "зона активирована".
Поэтому и предложил Азбуку Морзе - цепочку (из достаточно длинных) активизаций.
Добавляю (усложняя): если есть детектор "по зонам", то) и меняя зоны.
Я понял идею "AI - разберется", но (как радиоинженер и программист - "не верю!") тогда (когда начнет работать "паттерн яблоко"), придется добавлять защиту от сна и задумался (например, использовать только нереальные объекты. Если с образами - можно придумать, то с другими зонами - "вилять хвостом").

2. "По мелочи" (не описанной в ТЗ).
Если догадываюсь, как (т.е. так же - "мыслями") снять/отключить обруч, то непонятно как надеть обруч.
Видимо, "действия - возможны, но дискомфортны".
Сюда - подходит способ "смартфон, с AI и видеокамерой" - смотрит и "догадывается о намерении" (а добавив 6DoF-манипулятор за 5тр, или машинку-тележку с 4DoF-манипулятором за 15тр - получим "действия").

под смартфон - бывают подставки, в т.ч. с линзой - поставил (на стул) сбоку, и "шевелишь поршнямиперстами" по BT-клаве/кольцу.

>научиться угадывать намерения пользователя и преобразовывать это в ограниченный набор команд

Уточню: лучше "(ограниченный) контекстно-зависимый набор" намерений, из возможных (для активного приложения, плюс глобальные).

Например, для веб-браузера, если с (предложенным в статье) клавишным представлением:
- ограниченный набор: Esc, PgUp, PgDn, Enter.
Такие - уже имеются: пластиковые кольца/перстни (принцип BT-клавиатуры, примерно 300р), с только именно этими кнопками. Надел - и не потеряешь, а смартфон - на тумбочке/в кармане, не уронишь;
- расширенный набор: выбор контрола: "Select", перемещение: "на следуюшую кнопку/ссылку/чекбокс" и "назад", или порядковый номер.
Это - уже (полноценная) BT-клавиатура.

С отдельными предложениями - согласен, но проще сказать “Любая известная технология (ЭЭГ) - работает с мозгом только в целом” (это, как с LLM: где-то там, внутри, есть “всякие” сигналы, и говорят - есть и “намерения”. Но где и какое - смотреть какое значение какой ячейки, технология LLM не позволяет получать). Т.е., пока, выделить конкретное намерение - можно только через внешние “подпорки” (обычно: разложить картинки во времени, реже: на датчики вокруг коры. А “вживлять” - сразу представляется микросхема с матрицей контактов, сверля дырки, в головную кору - это, пока?, “перебор”).

Автору: (как дополнение к Muse-подобным/или более простому датчику напряжения мышцы) 4-кнопки - Азбукой Морзе (придется придумать свой код, “покороче”, чтобы не полысеть, пока эти точки, тире “активируешь”. Может, каждой кнопке - свою длительность. Но сразу тянет расширять: “лидер” - например, две "точки", и “концевик” - два "тире").
Еще одна простая альтернатива ЭЭГ/неинвазивного интерфейса (без AI и Умного дома) - BT-клавиатура: куча кнопок, выбрать удобные, и "навесить" "намерения".

тут надо еще подумать над реализацией - напрашивается "комбинация"/по-этапная реализация:
1. (Предложенные) "обручи" - с двумя датчиками (якобы ЭЭГ) или даже с десятком - показывают очень медленно - на уровне нескольких знаков в минуту, и бинарно (1 - "активно", напряг извилины. По отзывах - быстро устает концентрироваться голова, и болят виски - мышцы, непроизвольно напрягаются):
Обычно - на дисплее (медленно переключаясь) показывается/подсвечивается (элемент матрицы - в нашем случае, 2x2) очередная фигура. На той, где появится "1" - сначала "фокус", ...
Т.е. это - явно дальный этап (для тиражирования во всех смартфонах).
2. если у глаз нет проблем: есть более отработанные "видеомыши" (запущено приложение, умеющее следить через видеокамеру за центром яблока/поворотом головы, и проецировать смещение в координату в (все той же) матрице (тут - тоже устает голова, но приложение - настраивается на небольшую область, поэтому - можно увести взгляд и отдохнуть, или заняться другим) ;
3. в (упоминаемом) "Умном доме" (связь может быть любой - как Zigbee3, так и по BT или Wi-Fi, или даже проводами), есть (миниатюрные - с батарейкой-таблеткой, и относительно дешевые - от 100р) "датчики":
- простые (типа "кнопка пульта ДУ") - "кнопка - выключатель (I/O)", "ручка - регулятор (0...N)".
Простой этап - кандидат на "первый".
- расстояния (емкостной, или ультразвуковой эхолокатор) - реагирует на кисть руки (общая схема: на ленте - несколько датчиков, ленту - прикрепить на кровати);
Тоже простой этап.
- сложные (цены - уже от 1тр) - с микросхемами-гироскопами и альтиметрами (слежения за изменением положения "пульта" в пространстве. В дорогих моделях смартфонов - есть свои, встроенные - для игр. Для примера: Кубик 4см - как статика (номер грани сверху), так и динамика (поворот, встряхивание/падение, трясение). Палочка - 7x2x1.5см - замечает поменьше, но стоит меньше раза в два/три.
Преимущество: в каждом таком "датчике" - по паре десятков значений. Подключить - можно несколько таких "датчиков".
- (продаются в районе 300р) BT-пульты (с гироскопами) - для управления мышкой (координату - наклоном корпуса) и запуска любых макросов (назначенных на кнопки) - т.е. это вариант без завязки на инфраструктуру Умный Дом.
Простой этап.
- "AI-обучить" - тут надо ждать (все по-забанено, если обращаться из РФ. Или покупать самые крутые модели смартфонов, в которых уже есть локальная модель).
Долгий этап. Да и (до экспериментов) пока непонятный - каждый должен будет "учить на себе", или можно будет (тиражировать и) поднастраивать "под себя" (если универсальный - он может выродиться в простую программную логику (войдет внутрь приложения).
Наверняка, не всё перечислил (датчики, принципы управления - на поверхности, что в массовом применении и на нынешнем этапе - достаточно голоса и Алисы).

Информация

В рейтинге
Не участвует
Зарегистрирован
Активность