Сейчас очень дешевые и большие флеш-накопители. На 64-гиговую флешку влезет примерно 20 суток совершенно несжатого звука в хорошем качестве.
Что за текстовый файл? Почему недостаточно просто разбивать запись на файлы по нажатию?
Можно, конечно, разбивать, но кнопка может быть нажата и с запозданием и во время полезной речи и вовсе не нажата, а фрагменты, порванные кнопкой будут различаться по размеру. Использование в виде сырых файлов (с учетом разбиения на чанки для приемлемого размера) в любом случае неудобно. Полезный контент может попасть на разрыв и нужно будет что-то делать для склеивания. Огромное количество сырых файлов, да ещё и разной длительности неудобно использовать. В любом случае нужен софт, который и порезать и выделить всё что нужно сможет при зарядке.
Текстовый файл потому, что он выравнивается точно также часовыми чанками, содержит в имени дату/время начала чанка, сортируется по имени в едином потоке всех файлов на внутреннем носителе. Можно реализовать циклическую запись с затиранием самых старых чанков, можно удобно бэкапить любой интервал архивов с точностью до часа и данные о нажатиях кнопки не потеряются.
А ещё ранее Вы говорили про голосовые метки/теги и минимальное взаимодействие с устройством руками
Да говорил и если вы не поставили метку, то сделать это можно потом, если она нужна. Запись в любом случае останется. К тому же теоретически метку можно ставить и ключевым словом, а распознавать её при автоматической обработке потом.
На кнопку можно повесить (длительным нажатием) временное выключение (для параноиков). Временное потому, что забыть включить запись может оказаться куда худшим, чем забыть выключить. Именно поэтому я бы встроил в устройство еще и зуммер-пищалку, которая возвещала бы о критическом уровне заряда батареи, о прошествии, скажем, десяти минут после временного отключения записи и т.д.
Зуммер и кнопка очень дешевы и просты. Они не увеличат критично бюджет, ими можно не пользоваться, зато с ними больше возможностей.
Откуда берутся теги? Десктопное ПО их само расставляет по анализу распознанной речи, или как-то иначе?
Да, звук пишется чанками (звуковые файлы стандартного формата длительностью ровно час с выравниванием по началу целого часа). Нажатия на кнопку регистрируются в текстовом файле в виде времени в отдельных строчках. Каждому часу соответствует свой файл. Можно также в эти файлы записывать с какой-то периодичностью статус заряда батареи и даже температуру.
При подключении регистратора к USB он заряжается, детектируется установленным на компьютере ПО, при этом файлы начиная с самых старых выгружаются с устройства, перекодируются, сжимаются, распознаются, маркируются и выгружаются в облако.
При этом несжатые аудио-файлы чанков становятся сжатыми (например, mp3 или что-то ещё). Логи нажатия кнопок остаются в прежнем виде. Плюс добавляются файлы с тегами, полученными после распознавания. Эти файлы также отвечают каждый за свой час и с тем же выравниванием.
Позже через облачный веб-интерфейс пользователь может что-то исправить в распознанных тегах, добавить новые, внести пометки, загрузить GPS-трек (он тоже порежется на часовые куски и ляжет рядом на хранение в архиве).
Таким образом час записи (с учетом сжатия) в архиве будет занимать менее 10 мегабайт в (самом худшем случае), в среднем сильно меньше ввиду хорошего сжатия и периодов тишины. Эти куски легко раздавать и подгружать по мере необходимости.
Ух здорово! Поделитесь наработками? К сожалению я лишь программист и в электронике ужасный дилетант. У меня нет вопросов как делать перекодирование, тегирование, распознавание, ассиметричное шифрование, облачное хранение, API для доступа. Зато есть вопросы как правильно подключить микрофон к АЦП, обвязать контроллер и сделать на борту достаточно точные часы с кварцевым генератором.
Не понятно, как сделать цепь заряда и контроль разряда аккумулятора, эффективную стабилизацию питания контроллера.
Я же уже расписал несколько раз. Мне кажется такие требования очевидны и вытекают из потенциальных возможностей аудиорегистратора.
Итак. Носимый, компактный, лёгкий аудиорегистратор, который непрерывно записывает в зашифрованном виде весь звук в непосредственной близости вокруг человека. Кнопка на устройстве ставит временнУю метку в текстовом файле в памяти устройства.
ПО на компьютере во время зарядки устройства через USB загружает и перекодирует накопившиеся записи, распознаёт речь, индексирует записи временнЫми метками и тегами, позволяет осуществлять полнотекстовый поиск событий и представляет удобный таймлайн для прослушивания любого периода через облако со смартфона.
В дальнейших релизах можно добавить возможность через bluetooth в том же виде локально со смартфона сёрфить по тамлайну и прослушивать пусть пока еще не распознанный и не проиндексированный звук.
Такое простое, в общем-то, устройство позволит отказаться от записывания в блокнотик номеров телефонов, адресов, какой-то другой вербальной информации, позволяет восстанавливать последовательность и длительность событий в путешествиях, легко и непринуждённо сохранять информацию о ценах, путевые заметки, и, вообще, всё что угодно и что можно сказать словами. Благодаря тому что при нажатии кнопки можно что-то произнести (и это будет потом в индексе выглядеть как тег), по таким тегам можно задавать какую-то автоматизацию и фильтрацию. Ссылки с таймкодом на конкретный момент времени (по тегу) можно присылать с помощью бота в чат. Так можно сделать легкое протоколирование любых событий от расходов и заказов на пьянке до каких-то особенных событий в семье. Когда вы (или ваши дети) научились произносить букву «Р»? У вас есть запись этого момента? А когда ребёнок сочинил сказку и начал её рассказывать, вы прервёте её побежав за смартфоном чтобы записать?
Это бытовой носимый аудиорегистратор. Такого устройства ещё нет в массовом пользовании. Смартфоны есть, и, ведь, кто бы подумал во времена Чарли Чаплина, что Фотографию будут использовать чтобы не запоминать цены на прилавке? Может быть лет через 10 смартфон или умный браслет сможет выполнять функции полноценного аудиорегистратора. Пока что не может. Но всё же такое устройство уже возможно соорудить в виде прототипа из китайских компонентов и даже выпустить в серию благодаря краудфандингу, и дешевому китайскому оутсорсу. Мне пофиг на проект, на авторство и выручку, но мне нужно само устройство. Неужели только мне?
Ну прикольно было бы, чтобы та же Алиса постоянно слушала, умела долговременно хранить состояние и контекст, вычленяла полезную информацию из речи, тегировала и трекала в контексте, не тупила, не требовала интернет хотя бы для основных автономных задач. Тогда можно было бы просить её голосом что-то запомнить или вспомнить. Я думаю мы к этому придём лет через 10.
И нет, этот АудиоБлокнот мне не нужен, его нужно ВКЛЮЧАТЬ. О нём нужно ВСПОМИНАТЬ, когда и так не до него, ему нужно ПОВТОРЯТЬ, потом нужно как-то разобраться в накопившихся файлах, как-то разгрести и промаркировать синхронно с GPS-треком и фотографиями с других устройств…
Если я иду по незнакомому городу, где ходят незнакомые люди говорящие на незнакомом языке — идеально чтобы для записи сбивчивого рассказа о том как добраться до вокзала, и на каком автобусе потом ехать, и докуда, и как перемещаться дальше… так вот, идеально, чтобы для этого не требовалось хвататься за смартфон или диктофон, включать их, просить секундочку подождать и повторить все заново. А ещё у смартфона аккумулятор не резиновый. Его на день не хватает.
А ещё сплавляясь по реке мне бы хотелось комментировать где какие пороги или завалы, но хватать и включать дорогой водонепроницаемый диктофон мне не хочется. А хочется, зато, увидеть потом все заметки прямо на карте без малейшего с моей стороны участия, кроме установки прибора в USB. А ещё иногда хочется услышать что я говорил, когда снимал что-то на фотоаппарат. Вот именно в тот момент. Причем я не знал, что захочу этого когда снимал.
Зачем мне NTFS? Пусть будет FAT32. Все равно всё надо рубить на чанки, например по 10 минут или часу. Если рубить по часу, то это 24 файла в сутки по 150 мегабайт каждый. PCM — это тупой равномерный массив 2 байта на отсчет. Если замешкались или поставили паузу, можно тупо прыгнуть на нужный адрес и продолжить запись. Пропущенная область записывается нулями.
во всех смарфонах в камере нет опции отключения звука при фотографировании
О чем вы, сударь? Моя камера в смартфоне снимает абсолютно бесшумно, вот опция:
То есть, по сути вам все-таки нужен диктофон?
У меня есть диктофон и он не удобен. Он не умеет привязывать запись ко времени (ок, некоторые-таки умеют), его нужно включать, он не умеет работать постоянно в циклическом режиме, он не помогает мне автоматически индексировать и маркировать записи, не даёт доступа к тегам через смартфон и не шифрует записанный звук. Нет, мне не нужен диктофон, он у меня есть. Мне нужен аудиотрекер.
Спасибо за ссылки. Я так понял там речь о записи коротких кусочков на внутреннюю память микросхемы и совсем без сжатия (PCM). Ну ок, без сжатия, наверно, вполне можно и обойтись. Скажем на 64-гиговую флешку, если не ошибаюсь, влезет почти 20 суток непрерывного моно-звука с дискретизацией 22кГц 16бит PCM. Наверно аккумулятор окажется критичнее, а кодек его будет тоже потреблять прилично. Можно сжатие делать на лету во время зарядки от USB при копировании с флешки.
Это значит. что мне, видимо, будет достаточно ардуинки=)
Да всё у меня давно описано. И целевая аудитория и кейсы. Прибор в задумке — это именно аудиорегистратор, а все ваши возражения вроде кнопки, записи на смартфон и прочего — это про диктофон.
Аудиорегистратор, как и видеорегистратор в вашем автомобиле, пишет не для того, чтобы кто-то это потом слушал или смотрел, а на всякий случай. То есть 99.9% записанного никогда никем не будет использоваться с очень большой вероятностью. При этом о полезности видеорегистраторов и камер наблюдения не спорит никто.
Громко всех предупреждать, что вокруг меня идёт запись звука, это как кричать всем, что у меня хорошая память, а я ещё и всё записываю. Мне кажется в ближнем кругу все и так будут обо мне знать такие вещи, а посторонние люди мне, в общем-то, в этом плане безразличны. В конце концов когда-то перед самодвижущейся повозкой надлежало идти человеку с фонарём и громко кричать предупреждая прохожих об опасности. Будущее придёт и никого не будет спрашивать, как не спрашивает вас разрешение на съёмку камера у вас в подъезде.
Мне такой прибор нужен для простых и понятных вещей, чтобы меньше думать о рутине и никогда ничего не «забывать». Кнопка на трекере будет лишь для установки тега с голосовой меткой для облегчения поиска нужного места в таймлайне. Кроме этого таймлайн индексируется по распознанным словам и фразам, доступен полнотекстовый поиск.
Лично мне это нужно для путешествий. Иногда пробивает ностальгия и хочется «вернуться» в прошлое, или нужно восстановить какую-то деталь информации, или «вспомнить» адрес или телефон, продиктованный тебе попутчиком, порой руки заняты и неудобно записывать какие-то размеры или рецепт, а ведь их достаточно лишь проговорить, чтобы вернуться позже, возможно спустя годы и всё восстановить.
Наверно кому-то, кто что-то эдакое сказал сгоряча, возможно, и повредит когда-нибудь эдакий гаджет, но мне кажется такая гипотетическая ситуация довольно редка и маловероятна, чтобы ради неё отказываться от удобства. Также мы не отказались от миниатюрных и незаметных камер в смартфонах, хотя ими можно снимать незаметно какие-то интимные и деликатные вещи. Никто не возражает против выпуска диктофонов, которые отлично и молча пишут любой звук лёжа в кармане. Появление нового гаджета на рынке никоим образом не уменьшит приватность и безопасность личного пространства. Напротив, бОльшая доступность и популярность таких гаджетов позволит помнить о возможности записи всех и всегда, а не только тогда, когда припекло и вы уже наговорили на статью в пьяной драке при включённом у кого-то диктофоне на смартфоне.
Вот тут я бы не был так категоричен. Да, я не собираюсь делать прибор скрытым, но сейчас записывать звук совершенно незаметно смартфоном или куда более компактным и незаметным обычным диктофоном уже не проблема.
Рефлексировать о приватности в этом смысле уже поздно. Нужно просто учитывать возможность того. что везде может происходить запись, причем не только звука. Да неуютно, да хочется что-то сделать с этим, но уже ничего не изменить.
Если будет больше популярных приборов, как тот, что описан мной, общество. как мне кажется, сможет отчетливее осознать опасность действительно скрытого наблюдения.
Как-то возражать против таких аудиотрекеров разумной заметности (но без мигалок и звуковых предупреждений) — это то же самое, что сейчас возражать пртив фотовидеосъёмки на вокзалах прикрываясь противотеррористическими мерами. Как будто те, кто готовят терракт будут ходить с огромной зеркалкой и нарочито снимать всё вокруг.
Под распознаванием, как мне кажется. обычно понимается нечто другое. Тут скорее детекция. И я там вам ниже об этом писал.
В плане требований всё по классическому сценарию: максимапльно компактно и дёшево=)
Но если серьёзно. то речь всего лишь о прототипе, так что для начала стот рассмотреть вообще спектр возможных решений и оценить во что это может вылиться. Может быть затея и вовсе не стоит свеч. По крайней мере пока.
Бюджета пока что нет никакого. Вопрос состоит в том, стоит ли лезть с этим на краудфандинг и во что встанет вменяемый прототип такого устройства.
Оптимальный вариант — набор стандартных дешевых модулей с алиэкспресса, вставленных в ардуинку какую-нибудь более-менее энергоэффективную плату на STM.
Если с этой штукой можно будет без боли походить пару месяцев в штатном режиме, то это уже будет история успеха (про прототип).
Ну я тоже пришел к такому выводу. Просто думал, что что-то примитивное вроде режима голосовой активации, какой был еще в древних кассетных диктофонах, вполне сэкономит часы записи по ночам, к примеру. Важно, чтобы это устройство требовало от человека минимального вмешательства. Максимум — регулярно менять его на другое вставляя разряженное и заполненное в USB и доставая оттуда «свежий» (очищенный и заряженный) экземпляр.
Войс-процессор, мне кажется лишним. Максимум — спектрально-интервальный детектор в виде конечного автомата по простым паттернам в отфлильтрованном звуковом канале.
Может быть имеет смысл вообще сделать голосовой детектор двухкаскадным: 1) аппаратный по фильтру голосовых частот, 2) программный, учитывающий простые паттерны, но уже в разбуженном процессоре.
Возможно будет иметь смысл действительно писать всё подряд. На 64-гиговую флешку войдёт много десятков, а то и сотен часов звука, а активацию сделать по уровню шума в довольно широком спектре вокруг голосовых частот. Можно сделать простейший препроцессинг при заливке, чтобы пропускать или снижать приоритет загрузки чанков с тишиной или без голоса.
О, я так понял тут собрались правильные люди.
Подскажите, нужно для прототипа соорудить диктофон, который смог бы часами записывать звук, пропускать тишину и работать от аккумулятора. Эдакий носимый постоянный аудиорегистратор. Интересует именно полоса частот человеческой речи.
Вопрос: как лучше сделать сжатие максимально просто (для прототипа) и чтобы прибор не потерял сильно в компактности? Есть готовые компоненты из китая?
Как правильно обвязать микрофон? Может кто-то скинет ссылки на какие--то открытые проекты с подходящей схемотехникой в отдельных узлах?
Как-то так получилось, что я программист и схемотехнике не обучен. Прям на уровне начинающего дилетанта.
Суть концепта в носимом аудиорегистраторе, который таскаешь как прищепку на одежде, а при наличии знакомого USB девайс заряжается и сливает зашифрованный звук в облако, где он индексируется и раздаётся на смартфон владельца.
И это круто. Я вот вынес из статьи, что ардуина может играть роль звуковухи. Я ХЗ зачем мне это может пригодиться, но теперь я знаю. что так делают.
Вообще радует как из доступных компонентов из китая и палок можно сделать на коленке прикольные штуки.
Похоже автору стоит почитать какую-то книжку (Марк Лутц подойдёт, к примеру) или посмотреть ещё полторы сотни роликов и курсов про программирование на питоне.
Это довольно мило выглядит — оформить первые неуклюжие шаги в изучении чего-то в виде статьи на хабре. Порою матёрые профессионалы в муках перфекционизма по два года держат свои развесистые и проработанные статьи в черновиках оттачивая их до бесконечности, а тут «хоба!»...=)
Мой вам совет, пользуйтесь системами контроля версий. Разместите ваш код в бесплатном репозитории (github, bitbucket), разместите ссылку на него в вашей статье. Многим здесь не составит труда сделать поверхностное или даже подробное ревью вашего получившегося сферического «блинчика». Мне кажется от такого ревью и от навыков работы с репозиторием, правками, пулл-риквестами вы получите куда больше пользы, чем от просмотра того ролика про веб-серверы.
Хотел написать вам про проблемы, ошибки и антипаттерны у вас в коде, но руки опускаются делать это без контроля версий. В вашем коде слишком много проблем.
И не стоит называть это backdoor, это натуральная backhole. =) Без обид. Готов разложить по полочкам и расписать по существу. Го на гитхаб.
У меня фотоархив поскромнее, но я уже «забэкапил» его в гугл (меня устраивает та потеря качества, за которую он мне даёт безлимитный стор на фотки и на семейные ролики про ребёнка). Сейчас яндекс, вроде разрешает то же самое. Собираюсь и туда задублировать всё. Попутно пилю тулзу для удобной манипуляции и синхронизации всего этого фото-видео-добра. Но по-настоящему исчерпывающих проблему решений пока что нет.
А нарисуйте типовую схему какое оборудование на линии есть. Интернет через тот же кабель приходит? Ест же компании, которые ещё и интернетом барыжат. Или у них отдельная кабельная система для этого?
А что если зафигачить своё резюме на гитхабе в открытом репозитории с открытой историей правок?=)
В двух частях (формальная и не очень). И пилить его помаленьку. Может быть за какие-то куски и правки будет порой и стыдно, но сам процесс работы над резюме тоже дал бы какой-то информации о соискателе.
Вообще странная идея, да. Но надо попробовать.
Сейчас очень дешевые и большие флеш-накопители. На 64-гиговую флешку влезет примерно 20 суток совершенно несжатого звука в хорошем качестве.
Можно, конечно, разбивать, но кнопка может быть нажата и с запозданием и во время полезной речи и вовсе не нажата, а фрагменты, порванные кнопкой будут различаться по размеру. Использование в виде сырых файлов (с учетом разбиения на чанки для приемлемого размера) в любом случае неудобно. Полезный контент может попасть на разрыв и нужно будет что-то делать для склеивания. Огромное количество сырых файлов, да ещё и разной длительности неудобно использовать. В любом случае нужен софт, который и порезать и выделить всё что нужно сможет при зарядке.
Текстовый файл потому, что он выравнивается точно также часовыми чанками, содержит в имени дату/время начала чанка, сортируется по имени в едином потоке всех файлов на внутреннем носителе. Можно реализовать циклическую запись с затиранием самых старых чанков, можно удобно бэкапить любой интервал архивов с точностью до часа и данные о нажатиях кнопки не потеряются.
Да говорил и если вы не поставили метку, то сделать это можно потом, если она нужна. Запись в любом случае останется. К тому же теоретически метку можно ставить и ключевым словом, а распознавать её при автоматической обработке потом.
На кнопку можно повесить (длительным нажатием) временное выключение (для параноиков). Временное потому, что забыть включить запись может оказаться куда худшим, чем забыть выключить. Именно поэтому я бы встроил в устройство еще и зуммер-пищалку, которая возвещала бы о критическом уровне заряда батареи, о прошествии, скажем, десяти минут после временного отключения записи и т.д.
Зуммер и кнопка очень дешевы и просты. Они не увеличат критично бюджет, ими можно не пользоваться, зато с ними больше возможностей.
Да, звук пишется чанками (звуковые файлы стандартного формата длительностью ровно час с выравниванием по началу целого часа). Нажатия на кнопку регистрируются в текстовом файле в виде времени в отдельных строчках. Каждому часу соответствует свой файл. Можно также в эти файлы записывать с какой-то периодичностью статус заряда батареи и даже температуру.
При подключении регистратора к USB он заряжается, детектируется установленным на компьютере ПО, при этом файлы начиная с самых старых выгружаются с устройства, перекодируются, сжимаются, распознаются, маркируются и выгружаются в облако.
При этом несжатые аудио-файлы чанков становятся сжатыми (например, mp3 или что-то ещё). Логи нажатия кнопок остаются в прежнем виде. Плюс добавляются файлы с тегами, полученными после распознавания. Эти файлы также отвечают каждый за свой час и с тем же выравниванием.
Позже через облачный веб-интерфейс пользователь может что-то исправить в распознанных тегах, добавить новые, внести пометки, загрузить GPS-трек (он тоже порежется на часовые куски и ляжет рядом на хранение в архиве).
Таким образом час записи (с учетом сжатия) в архиве будет занимать менее 10 мегабайт в (самом худшем случае), в среднем сильно меньше ввиду хорошего сжатия и периодов тишины. Эти куски легко раздавать и подгружать по мере необходимости.
Не понятно, как сделать цепь заряда и контроль разряда аккумулятора, эффективную стабилизацию питания контроллера.
Итак. Носимый, компактный, лёгкий аудиорегистратор, который непрерывно записывает в зашифрованном виде весь звук в непосредственной близости вокруг человека. Кнопка на устройстве ставит временнУю метку в текстовом файле в памяти устройства.
ПО на компьютере во время зарядки устройства через USB загружает и перекодирует накопившиеся записи, распознаёт речь, индексирует записи временнЫми метками и тегами, позволяет осуществлять полнотекстовый поиск событий и представляет удобный таймлайн для прослушивания любого периода через облако со смартфона.
В дальнейших релизах можно добавить возможность через bluetooth в том же виде локально со смартфона сёрфить по тамлайну и прослушивать пусть пока еще не распознанный и не проиндексированный звук.
Такое простое, в общем-то, устройство позволит отказаться от записывания в блокнотик номеров телефонов, адресов, какой-то другой вербальной информации, позволяет восстанавливать последовательность и длительность событий в путешествиях, легко и непринуждённо сохранять информацию о ценах, путевые заметки, и, вообще, всё что угодно и что можно сказать словами. Благодаря тому что при нажатии кнопки можно что-то произнести (и это будет потом в индексе выглядеть как тег), по таким тегам можно задавать какую-то автоматизацию и фильтрацию. Ссылки с таймкодом на конкретный момент времени (по тегу) можно присылать с помощью бота в чат. Так можно сделать легкое протоколирование любых событий от расходов и заказов на пьянке до каких-то особенных событий в семье. Когда вы (или ваши дети) научились произносить букву «Р»? У вас есть запись этого момента? А когда ребёнок сочинил сказку и начал её рассказывать, вы прервёте её побежав за смартфоном чтобы записать?
Это бытовой носимый аудиорегистратор. Такого устройства ещё нет в массовом пользовании. Смартфоны есть, и, ведь, кто бы подумал во времена Чарли Чаплина, что Фотографию будут использовать чтобы не запоминать цены на прилавке? Может быть лет через 10 смартфон или умный браслет сможет выполнять функции полноценного аудиорегистратора. Пока что не может. Но всё же такое устройство уже возможно соорудить в виде прототипа из китайских компонентов и даже выпустить в серию благодаря краудфандингу, и дешевому китайскому оутсорсу. Мне пофиг на проект, на авторство и выручку, но мне нужно само устройство. Неужели только мне?
И нет, этот АудиоБлокнот мне не нужен, его нужно ВКЛЮЧАТЬ. О нём нужно ВСПОМИНАТЬ, когда и так не до него, ему нужно ПОВТОРЯТЬ, потом нужно как-то разобраться в накопившихся файлах, как-то разгрести и промаркировать синхронно с GPS-треком и фотографиями с других устройств…
Если я иду по незнакомому городу, где ходят незнакомые люди говорящие на незнакомом языке — идеально чтобы для записи сбивчивого рассказа о том как добраться до вокзала, и на каком автобусе потом ехать, и докуда, и как перемещаться дальше… так вот, идеально, чтобы для этого не требовалось хвататься за смартфон или диктофон, включать их, просить секундочку подождать и повторить все заново. А ещё у смартфона аккумулятор не резиновый. Его на день не хватает.
А ещё сплавляясь по реке мне бы хотелось комментировать где какие пороги или завалы, но хватать и включать дорогой водонепроницаемый диктофон мне не хочется. А хочется, зато, увидеть потом все заметки прямо на карте без малейшего с моей стороны участия, кроме установки прибора в USB. А ещё иногда хочется услышать что я говорил, когда снимал что-то на фотоаппарат. Вот именно в тот момент. Причем я не знал, что захочу этого когда снимал.
О чем вы, сударь? Моя камера в смартфоне снимает абсолютно бесшумно, вот опция:
У меня есть диктофон и он не удобен. Он не умеет привязывать запись ко времени (ок, некоторые-таки умеют), его нужно включать, он не умеет работать постоянно в циклическом режиме, он не помогает мне автоматически индексировать и маркировать записи, не даёт доступа к тегам через смартфон и не шифрует записанный звук. Нет, мне не нужен диктофон, он у меня есть. Мне нужен аудиотрекер.
Это значит. что мне, видимо, будет достаточно ардуинки=)
Аудиорегистратор, как и видеорегистратор в вашем автомобиле, пишет не для того, чтобы кто-то это потом слушал или смотрел, а на всякий случай. То есть 99.9% записанного никогда никем не будет использоваться с очень большой вероятностью. При этом о полезности видеорегистраторов и камер наблюдения не спорит никто.
Громко всех предупреждать, что вокруг меня идёт запись звука, это как кричать всем, что у меня хорошая память, а я ещё и всё записываю. Мне кажется в ближнем кругу все и так будут обо мне знать такие вещи, а посторонние люди мне, в общем-то, в этом плане безразличны. В конце концов когда-то перед самодвижущейся повозкой надлежало идти человеку с фонарём и громко кричать предупреждая прохожих об опасности. Будущее придёт и никого не будет спрашивать, как не спрашивает вас разрешение на съёмку камера у вас в подъезде.
Мне такой прибор нужен для простых и понятных вещей, чтобы меньше думать о рутине и никогда ничего не «забывать». Кнопка на трекере будет лишь для установки тега с голосовой меткой для облегчения поиска нужного места в таймлайне. Кроме этого таймлайн индексируется по распознанным словам и фразам, доступен полнотекстовый поиск.
Лично мне это нужно для путешествий. Иногда пробивает ностальгия и хочется «вернуться» в прошлое, или нужно восстановить какую-то деталь информации, или «вспомнить» адрес или телефон, продиктованный тебе попутчиком, порой руки заняты и неудобно записывать какие-то размеры или рецепт, а ведь их достаточно лишь проговорить, чтобы вернуться позже, возможно спустя годы и всё восстановить.
Наверно кому-то, кто что-то эдакое сказал сгоряча, возможно, и повредит когда-нибудь эдакий гаджет, но мне кажется такая гипотетическая ситуация довольно редка и маловероятна, чтобы ради неё отказываться от удобства. Также мы не отказались от миниатюрных и незаметных камер в смартфонах, хотя ими можно снимать незаметно какие-то интимные и деликатные вещи. Никто не возражает против выпуска диктофонов, которые отлично и молча пишут любой звук лёжа в кармане. Появление нового гаджета на рынке никоим образом не уменьшит приватность и безопасность личного пространства. Напротив, бОльшая доступность и популярность таких гаджетов позволит помнить о возможности записи всех и всегда, а не только тогда, когда припекло и вы уже наговорили на статью в пьяной драке при включённом у кого-то диктофоне на смартфоне.
Рефлексировать о приватности в этом смысле уже поздно. Нужно просто учитывать возможность того. что везде может происходить запись, причем не только звука. Да неуютно, да хочется что-то сделать с этим, но уже ничего не изменить.
Если будет больше популярных приборов, как тот, что описан мной, общество. как мне кажется, сможет отчетливее осознать опасность действительно скрытого наблюдения.
Как-то возражать против таких аудиотрекеров разумной заметности (но без мигалок и звуковых предупреждений) — это то же самое, что сейчас возражать пртив фотовидеосъёмки на вокзалах прикрываясь противотеррористическими мерами. Как будто те, кто готовят терракт будут ходить с огромной зеркалкой и нарочито снимать всё вокруг.
В плане требований всё по классическому сценарию: максимапльно компактно и дёшево=)
Но если серьёзно. то речь всего лишь о прототипе, так что для начала стот рассмотреть вообще спектр возможных решений и оценить во что это может вылиться. Может быть затея и вовсе не стоит свеч. По крайней мере пока.
Бюджета пока что нет никакого. Вопрос состоит в том, стоит ли лезть с этим на краудфандинг и во что встанет вменяемый прототип такого устройства.
Оптимальный вариант — набор стандартных дешевых модулей с алиэкспресса, вставленных в
ардуинкукакую-нибудь более-менее энергоэффективную плату на STM.Если с этой штукой можно будет без боли походить пару месяцев в штатном режиме, то это уже будет история успеха (про прототип).
Войс-процессор, мне кажется лишним. Максимум — спектрально-интервальный детектор в виде конечного автомата по простым паттернам в отфлильтрованном звуковом канале.
Может быть имеет смысл вообще сделать голосовой детектор двухкаскадным: 1) аппаратный по фильтру голосовых частот, 2) программный, учитывающий простые паттерны, но уже в разбуженном процессоре.
Возможно будет иметь смысл действительно писать всё подряд. На 64-гиговую флешку войдёт много десятков, а то и сотен часов звука, а активацию сделать по уровню шума в довольно широком спектре вокруг голосовых частот. Можно сделать простейший препроцессинг при заливке, чтобы пропускать или снижать приоритет загрузки чанков с тишиной или без голоса.
Подскажите, нужно для прототипа соорудить диктофон, который смог бы часами записывать звук, пропускать тишину и работать от аккумулятора. Эдакий носимый постоянный аудиорегистратор. Интересует именно полоса частот человеческой речи.
Вопрос: как лучше сделать сжатие максимально просто (для прототипа) и чтобы прибор не потерял сильно в компактности? Есть готовые компоненты из китая?
Как правильно обвязать микрофон? Может кто-то скинет ссылки на какие--то открытые проекты с подходящей схемотехникой в отдельных узлах?
Как-то так получилось, что я программист и схемотехнике не обучен. Прям на уровне начинающего дилетанта.
Суть концепта в носимом аудиорегистраторе, который таскаешь как прищепку на одежде, а при наличии знакомого USB девайс заряжается и сливает зашифрованный звук в облако, где он индексируется и раздаётся на смартфон владельца.
Вообще радует как из доступных компонентов из китая и палок можно сделать на коленке прикольные штуки.
Это довольно мило выглядит — оформить первые неуклюжие шаги в изучении чего-то в виде статьи на хабре. Порою матёрые профессионалы в муках перфекционизма по два года держат свои развесистые и проработанные статьи в черновиках оттачивая их до бесконечности, а тут «хоба!»...=)
Мой вам совет, пользуйтесь системами контроля версий. Разместите ваш код в бесплатном репозитории (github, bitbucket), разместите ссылку на него в вашей статье. Многим здесь не составит труда сделать поверхностное или даже подробное ревью вашего получившегося сферического «блинчика». Мне кажется от такого ревью и от навыков работы с репозиторием, правками, пулл-риквестами вы получите куда больше пользы, чем от просмотра того ролика про веб-серверы.
Хотел написать вам про проблемы, ошибки и антипаттерны у вас в коде, но руки опускаются делать это без контроля версий. В вашем коде слишком много проблем.
И не стоит называть это backdoor, это натуральная backhole. =) Без обид. Готов разложить по полочкам и расписать по существу. Го на гитхаб.
В двух частях (формальная и не очень). И пилить его помаленьку. Может быть за какие-то куски и правки будет порой и стыдно, но сам процесс работы над резюме тоже дал бы какой-то информации о соискателе.
Вообще странная идея, да. Но надо попробовать.