Комментарии 15
здоровский проект, тема компаньонов, особенно "физических", все чаще появляется и в моем окружении, я для своего Гермеса тоже приделываю "морду лица", правда, использую старый телефон ))
Лягушка, как имя тоже меня "торкнуло", поэтому, пошел в Клод и спросил совета, как можно назвать. ИИ ответил:Небольшое наблюдение: камера на бантике сверху очень похожа на «лягушачий глаз», который торчит из макушки. Так что тема лягушки в этом дизайне уже есть.
Каэру (Kaeru, 蛙): просто «лягушка» по-японски. Это каламбур: 帰る («вернуться домой») звучит так же, поэтому лягушки в Японии считаются талисманом счастливого возвращения. Для домашнего компаньона звучит мило: «всегда возвращается к тебе». Подойдёт и «Каэ-тян».Василиса: от «Царевны-лягушки». Лягушка превращается в красавицу, а здесь «лягушка» превращается в друга с живым лицом на экране. Можно звать «Васька» или «Ваcя-ква».
мне кажется, Василиса, совсем неплохо, это, если бы аниме дулали по русской сказке - может быть так нарисовали ))
Хороший проект.
Но сам подход - "создаю ребенку робота, для того, что бы" он занимался с ним уроками, а далее пойдет по нарастающей - отвечал на все почему, советовал во всех вопросах, занимался воспитанием ... Просто очередная "умная" обёртка того же планшета с интернетом, что сейчас родители сюут в руки детям, что бы те не мешали и были заняты.
При таком подходе не стоит удивляться к старости - "и в кого они пошли?! Жёсткие безчувственные машины...". Хорошо, если соберут вам к старости работа, который будет за вами ухаживать.
Благодарю за критику. Я думал об этом. Для этого учитываются некие моменты. Дочь у меня с математическим складом, и ей интересно пределы робота больше, чем просто спрашивать. Безусловно робот не должен становиться заменой родителю, у нас с этим проблем нет.
Да и с вашей точки зрения есть другая сторона. Там где родитель не может уделить много времени в связи с отсутствием на работе, думаю что робот будет полезен, ведь ребенок может искать общение не только с хорошими людьми. В «очередном планшете» есть нативная реклама, приложения с рилсами в которых так же нет ничего хорошего, а в роботе грамотно написаный промпт настраивает его максимально как нужно родителю(это же очень гибкий инструмент). Не хочется чтоб решал за ребенка, прописывается промпт с наводящими вопросами, или вообще только просил обучить его, т.е. из ребенка делал учителя (моя это любит). В общем вариантов много.
Так же нынче создаются достаточно локальных узкоспециализированных моделей, с помощью которых робот может быть полезен и для взрослого, а так же стать вообще осистентом в офисе или каком нибудь рецепшене.
Осторожно, настройте циклическую саморизацию фактов в контекстом окне (сжатие), что бы не получалось что в контексте копится долгая беседа, это делает ИИ гиперакцентирующим внимание на факты и стили этой беседы, что неприятно влияет на психику, особенно неокрепшую, особенно когда беседы о чем то волнующем пользователя.
Хороший собеседник на основе ИИ это сам по себе проект не на пару часов.
Да, понял, благодарствую! Сейчас история у меня ограничена по объёму, сжатия пока нет. Когда добавлю сводки, планирую сохранять конкретные факты, предпочтения и незавершённые задачи. Временное настроение не хочу превращать в постоянную характеристику, которую робот потом потянет в каждый разговор. Сохранённые сведения у меня сейчас можно посмотреть, исправить и удалить. Конечно со временем что-то будет дорабатываться.
Проект прикольный, я тоже думаю в том же направлении но не для ребенка а просто робот, но слегка в расширенной конфигурации, есть ускорители вроде ROCKCHIP RK1820/RK1828 как раз подойдут для малых моделей там инференс до 100т.с, и разгружает основной процессор для других полезных действий, так же нужна долговременная память как у агента, это решаемо на мобильных устройствах через ассоциативную память, в таком случае робот превращается в компаньона а не очередную колонку. можно повесить ToF сенсоры для упрощения восприятия глубины и расстояния до объекта, что бы не гонять постоянно камеру, а использовать редко только для распознавания объекта, ну и много чего можно еще придумать =)
Классные модули! Читал про их архитектуру. На больших моделях круто справляется. Но я пока для нынешних DIY-экспериментов модуль **Raspberry Pi AI HAT+ 2** для малинки закажу (жду 11.11 на алишке), думаю на первое время будет достаточно.
ToF смотрел. Но тут как раз цель чтоб голова двигалась. Даже прятки умудряются устроить (для этого пришлось и команды типа "Найди меня" и доворот типа реального поиска сделать). В общем идей для него море. Я хотел чтоб она автономно работала. И расчитывал на 4-6 18650. Временно отказался. Т.к. места прям впритык. Модель я буду дорабатывать в любом случае, но размеры печати принтера так же ограничены, Как разработаю новую 3-Д модель под автономность, то и модули\сенсоры можно будет добавлять.
Вторая часть статьи почти дописана.
Классный проект, который вполне может со временем превратиться в продукт. Не знаю, вывезет ли RPi5 нагрузку, но если бы я пилил такое, то на следующем этапе сделал бы память, чтобы модель помнила старые диалоги и предпочтения “клиента”. По диалогам можно сделать RAG, а для запоминания предпочтений можно прикрутить Honcho или нечто подобное. Тогда можно будет задавать не только сиюминутные вопросы, но и говорить что-то вроде: “Помнишь, мы с тобой обсуждали…?” Возможно, для этого придется завести небольшой домашний сервер. :)
Спасибо! Немного приоткрою продолжение: профили, сведения о собеседнике и недавние разговоры уже сохраняются между запусками. А поиск давних разговоров по смыслу ещё предстоит сделать, тут ваше предложение очень в тему. Во второй части как раз рассказываю, что уже работает, где ограничения и как всё это ведёт себя на Pi 5. Дописываю, стараюсь объяснить по-человечески 🙂 ускоряюсь)
rag не обязателен.
В контекстное окно добавляется текущий индекс памяти (построчно - короткое и емкое описание и ссылка на файл/номер), и после каждой беседы (или во время) фоном идет создание/редактирование файлов памяти. Карточка памяти подгружается агентом автоматически по необходимости (работает красиво и быстро).
Скрытый текст
Это реализовано к примеру у qwen coder agent (относительно недавно появилось, реализация конечно корявая - лишние затраты по токенам на memory dream, потому что системный промпт меняют и контекст заново проходит prefill, причем если использовать их внутреннюю систему переноса контекста между их облачными моделями а не свои локальные модели, все внезапно правильно реализовано)
RAG на RPi5 ? еще тащить туда отдельную модель для эмбедингов ?
Есть более подходящие для этого архитектуры.
Это очень здорово! Но кто, собственно, играет? У меня есть сильно подозрение что автор статьи! :-))) :-)))

Собираю робота на Raspberry Pi 5 для дочери. Но говорящей колонкой тут не отделаться! Вызов принят, погнали