Comments 27
Из всего вашего комбайна меня особенно заинтересовала локальная библиотека с глубоким анализом каждого сохранённого в ней произведения, такую библиотеку, а может и с ещё более серьёзным анализом (ии там по более крупному привлечь) действительно хотелось бы иметь локально (на своём пк) чтобы подпихнув ей свою (оффлайн) коллекцию книг (думаю у многих такие коллекции насоветованного да и просто сохранённого есть) получить в итоге максимально широкую статистику для последующего выбора, что бы из неё почитать на ту или иную тему. А то книг сейчас много, описания у них скудные, отзывы противоречивые, и если всё читать самому (выискивая шедевры по своему вкусу) жизни точно не хватит ((. Жаль что у вас всё под айфон и так монструозно. Подумайте о вынесении модуля библиотеки с глубоким анализом в отдельную программу для настольного пк.
По секрету у меня как у разработчике в приложение сразу встроена CLI для обработки файлов локально на мак мини. Понятно что такая комбинация не знает о перегреве который настигает телефон через 10-20 минут транскрипции или перевода. И на ПК я при создании say файла с эмбедингами из книги использую локальную модель для валидации границ сцен, разметки ключевых предложений и разметки персонажей по каждому предложению. Я подумаю как сделать такой дуэт доступным для всех пользователей. И в планах издавать в формате say с эмбедингами и разметкой тексты публичных книг - таких как Остров сокровищ или Затерянный Мир. Главное преимущество нашего формата - один раз модель обрабатывает и размечает книгу и потом семантическая таблица доступна в самой книге без необходимости повторного анализа.
И еще в телефоне выполняется эвристическая обработка почти без ЛЛМ - она легкая и создание эмбедингов самая тяжелая ее часть - это около 1 минуты на книгу 500 страниц и вы сразу получаете размеченную по сценам передачу или главы книги. Это позволяет сразу видеть о чем это - так как название сцен это ключевое предложения из них, а в атмосфере видны все персонажи, статистика и главные леммы по важности из текста. По факту с таким приложением вам не нужен ни сервис транскрипции ни перевода ни суммаризации - все доступно локально на вашем телефоне. И потом возможность сохранить статью локально без рекламы и читать или слушать без баннеров само по себе приятно.
На самом деле, не хватало приложения, которое может извлечь транскрипт из подскаста чтобы слушать и смотреть текст в плеере. Или сохранить статью локально без рекламы, чтобы потом где-нибудь в машине послушать в carplay, особенно при отсутствии "нормального" интернета.
а какие в приложении есть качественные голоса для синтеза на русском языке?
Из системных Милена улучшенный голос самый приятный русский по мне. А так рекомендую ставить Silero - там все нейтронные голоса говорят по русски и есть отличные - можно послушать на сайте. Но обязательно надо скачивать модель для ударений русских - без них синтез будет ужасный! И кстати, если транскрипты русские нужны, то надо и пунктуатор Silero скачивать - Apple не имеет знаков препинания для русских транскриптор, а с Silero текст будет с точками и запятыми. Скачивать можно в настройках приложения - кнопка с шестеренкой.
Спасибо за приложение, сама идея отличная и качество русской озвучки офлайн самое выскокое.
Из минусов — интерфейс кажется перегружен крохотными кнопками, и их назначение можно выяснить только методом тыка. Ещё на моём iPhone 16e (не самый шустрый агрегат) открытие настроек весьма плавное — после нажатия на шестерёнку проходит несколько секунд (3-5) до открытия окна. Я так понимаю, приложение читает инфу о голосах, и это занимает много времени. Может быть, как-то это можно кэшировать? Или хотя бы показывать индикатор занятости после нажатия кнопки, чтобы пользователь не терялся в догадках, сработал ли он.
И не совсем понятно, как редактировать словарь ударений при задании префикса. Допустим, я хочу, чтобы слово «маггловский» имело ударение на первый слог вместе со всеми его формами. Тогда префиксом будет «магглов*», а формой «+магглов»?
Заявлена поддержка FB2, но чаще всего этот формат пакуется в ZIP — *.fb2.zip. Такой файл нельзя импортировать. Конечно, всегда можно предварительно распаковать его, но это дополнительный шаг.
Ещё раз спасибо, озвучка на голову выше Piper TTS.
Большое спасибо за отзыв и именно такие комменты определят каким будет приложение к окончанию тестирования. По шестеренке - посмотрю как ускорить - на симуляторе и на 15 про макс тормозов не было. Словарь ударений - в настройках той самой шестеренке - есть Russian Stress Dictionary - там две колонки магглов* м+агглов - ударение ставим перед гласной, а звездочка это все слова таким же началом маггловский. Этот словарь меняет ударения для всех таких слов в тексте - но если слово омограф - туда лучше не заносить. Мы очень ждем обновление акцентора от Силеро - они обещают улучшение омографов. По fb2.zip добавим в форматы раз это популярно. По маленьким кнопкам - пытались разместить все функции - но уже несколько просьб увеличить - подумаем как. Еще вопрос на каком языке слушали и какие голоса понравились, помогает ли вам разбивка глав на сцены ?
Слушал на русском русскую книжку. Честно говоря, для меня разбивка на сцены неактуальна, я использую только малую долю возможностей, мне достаточно просто озвучки книги вслух.
Мне больше нравятся женские голоса, из русских пока для меня лидирует Saida. Кстати, смена голоса по умолчанию тоже нетривиальна — только случайно узнал, что долгое нажатие на голос делает его таковым.
Ещё пытался настроить перевод английской книги и озвучку сразу на русском, подвисло скачивание файлов для движка, попытался начать с середины файла, но дождался лишь разогрева телефона. Через пару минут ожидания удалил файл, так и не дождавшись.
Готовим к выпуску 8 версию на этой неделе - Добавим режим перевода live - будет перевод и синтез на русском чтобы синтез успевал подхватывать без перевода всей книги и разогрева телефона - идея включаете в плеер три точки - перевод выбираете Listen только слушать перевод Booth слушать и видеть русский текст - приложение будет переводить и синтезировать параллельно без длительного ожидания - в эту же версию добавим fb2.zip .
Ещё несколько вопросов:
Как применить изменения в словаре ударений, чтобы озвучка в текущей книге их учитывала?
Составные слова типа «кто-то», «из-за» движок читает странно. Хотя это, наверное, вопрос к создателям Silero, а не к вам.
Перед началом абзаца читалка замирает на несколько секунд — чем длиннее абзац, тем дольше, см. картинку ниже:

Ещё вопрос: что это за кнопка? При нажатии она меняет внешний вид, озвучка запускается с начала абзаца, но заметных изменений я не слышу:

Вообще, ничего, что я продолжаю в эту ветку обратную связь слать?
Спасибо ещё раз за приложение!
В настройках Settings (шестеренка в библиотеке) - Russian Stress Dictionary - там две колонки - Магглы М+агглы (исходное слов и оно же с правильным ударение) Если напишете Маггл* М+аггл то ударение будет работать со всеми окончаниями Магглов, Магглы и тд
Составные слова поробуйте добавить ударение явное кто-то кт+о-то
Учтите ударения только на голосах Силеро работают - Apple свои голоса сам ставит ударения не управляется - единственный способ две гласные заменить в тексте абзаца - в плеере под закладкой три точки выбрать Edit paragraph и там поставить Маагл две гласные
Кнопка которую вы обвели это ER выразительное чтение - отключение управляет изменение тона скорости и громкости по анализу текста - можно сразу не поймать разницу она работает на семантике ненавязчиво, с ней уходит монотонность. Нажатие перезапускают с текущего абзаца сначала - без нее семантика управляет только паузами.
Подготовка 1-2 секунды до начала это запуск первого абзаца это ожидаемая загрузка пред синтеза - но это происходит один раз при старте с нуля - потом задержки быть не должно пока воспроизведения непрерывное - обновите сборку до версии 8
Хм, пока в TestFlight вижу только 7 версию. У меня включены авто-обновления.
Откройте тест флайт там нужно выбрать наше приложение и переустановить - сейчас еще раз повторил рассылку - вижу 1.0(8) install
Нет, вижу только версию 1.0(7). Попробовал с сайта кнопку Join the beta — то же самое. У вас она работает?
Раздал новую версию 9 - можете проверить ?
SayFable 1.0 (9) is ready to test on iOS.
To test this app, open TestFlight on your iOS device using iOS 18.6 or later and install the update.
Порядок, девятую версию увидел и обновил — теперь настройки мгновенно открываются. И между абзацами пауза исчезла.
Отлично, спасибо большое, что написали - 8я сборка легла неудачно - пришлось обновлять и раздавать повторно
Еще хотел попросить проверить режим чтения перевода - на английской книжке выберите перевод на русский Listen и послушайте синтез на лету перевода - я слушал Легендарные Скарлетт и Альберт из английской книжки достойный перевод получается
Опубликовали Сборку 8 — что изменилось и что тестировать
Синтезированный звук из предыдущих сборок очищен и создастся заново при первом воспроизведении — это ожидаемо, не баг. Книги, записи и импортированное аудио не тронуты.
Перевод звучит из подготовленного файла. Перевод → «Слушать» или «Показывать и слушать». Регулятор скорости в плеере теперь действительно меняет темп перевода, и не должно пропускаться ни одного предложения, короткого абзаца или пункта списка.
Подсветка слов следует тому тексту, который на экране. При чтении — за произносимыми словами. При дубляже поверх видео или подкаста — за оригинальной записью, синхронно.
Нет остановок между абзацами. Запустите главу (лучше такую, где первый абзац длинный) и просто слушайте несколько минут, ничего не нажимая. Если всё же встанет и потребует Play или тапа — сообщите книгу, номер абзаца и примерное время.
Нейроголоса стартуют на первом абзаце. Выберите Silero или Piper, начните главу с начала. После нескольких секунд «Preparing voice…» абзац должен зазвучать сам, без нажатия кнопки ER.
Заблокированный экран. Запустите воспроизведение, заблокируйте экран на несколько минут, разблокируйте. Чтение и прогресс должны идти без сбоев.
Выбор голоса перенесён в карточку книги. «Default Voice» теперь рядом с «Source Language», список отфильтрован по языку книги, есть переключатель «показать все языки». На автоопределении сначала спросит язык.
Импорт .fb2.zip. Импортируйте архив с книгой напрямую, не распаковывая. Проверьте название и главы.
Скорость открытия настроек. Тап по шестерёнке — экран должен появляться мгновенно.
Импорт и голоса. EPUB/PDF/TXT, статья по ссылке, новостная или подкаст-лента. Apple-голоса и загрузка нейропака в Настройки → Silero Voices (или Piper Latvian).
Языковые паки, пунктуация, иммерсивный ридер. Первый импорт книги на неанглийском тихо докачивает словарный пак (0,1–5 МБ) — после этого нажмите «Analyze content» и проверьте разбор слов в иммерсивном ридере. Настройки → Transcription → «Neural Punctuation», затем распознайте запись (главная цель — русский). Попробуйте чат и аналитические слои.
Сообщайте о любых странностях в звуке, вылетах, зависаниях, неверно определённом языке и проблемах интерфейса — с моделью устройства и версией iOS. Требуется iOS 18.6 или новее.
Всё-таки паузы между абзацами есть, но они меньше. Правда, у меня нетипичная книга, где абзацы чуть ли не в страницу.
Пока не нашёл способа применить изменённый словарь ударений: ставлю книгу на паузу, добавляю исключение для ударения, включаю абзац заново — слышу старый вариант ударения, а не исправленный.
Добрый день , убедитесь что вы нажали справа кнопку применить после добовления строки в словарь ударения

Вы должны видеть добавленные изменения ударений в виде строки как на фото
Да, так и делаю. Порядок действий такой: ставлю книгу на паузу, добавляю исключение в словарь ударений, кликаю по абзацу, чтобы начать воспроизведение с начала — ударение звучит по-старому. Для чистоты эксперимента добавлял ударение без префикса.
Может быть, нужно перезапустить анализ книги?
Понял у вас старый синтез в кеше - сбросьте синтез - зайдите в меню книги Clear Synthesis - это сбросит старый синтез и синтезирует по новой и еще вариант поменяйте голос на другой и тогда синтез сброситься автоматом и услышите с ударением
SayFable — офлайн-библиотека с NLP-разметкой, синтезом на 68 языков и чатом по книге