Pull to refresh
8K+
16
Eduard@Kubataba

User

10,1
Rating
5
Subscribers
Send message

Добрый день, мы исправили в сборке 10 , теперь абзацы синтезируется и соединяются в сцены и синтез идет на две сцены вперед - переходы внутри сцен теперь без задержек

Понял у вас старый синтез в кеше - сбросьте синтез - зайдите в меню книги Clear Synthesis - это сбросит старый синтез и синтезирует по новой и еще вариант поменяйте голос на другой и тогда синтез сброситься автоматом и услышите с ударением

Вы должны видеть добавленные изменения ударений в виде строки как на фото

Добрый день , убедитесь что вы нажали справа кнопку применить после добовления строки в словарь ударения

Просьба проверить другую книгу - абзацы большие настройка ждет готовности первого абзаца для старта а если он большой слишком то хоть и скорость синтеза 10x это становиться заметно

Отлично, спасибо большое, что написали - 8я сборка легла неудачно - пришлось обновлять и раздавать повторно

Еще хотел попросить проверить режим чтения перевода - на английской книжке выберите перевод на русский Listen и послушайте синтез на лету перевода - я слушал Легендарные Скарлетт и Альберт из английской книжки достойный перевод получается

Раздал новую версию 9 - можете проверить ?

SayFable 1.0 (9) is ready to test on iOS.

To test this app, open TestFlight on your iOS device using iOS 18.6 or later and install the update.

Откройте тест флайт там нужно выбрать наше приложение и переустановить - сейчас еще раз повторил рассылку - вижу 1.0(8) install

  1. В настройках Settings (шестеренка в библиотеке) - Russian Stress Dictionary - там две колонки - Магглы М+агглы (исходное слов и оно же с правильным ударение) Если напишете Маггл* М+аггл то ударение будет работать со всеми окончаниями Магглов, Магглы и тд

  2. Составные слова поробуйте добавить ударение явное кто-то кт+о-то

    Учтите ударения только на голосах Силеро работают - Apple свои голоса сам ставит ударения не управляется - единственный способ две гласные заменить в тексте абзаца - в плеере под закладкой три точки выбрать Edit paragraph и там поставить Маагл две гласные

  3. Кнопка которую вы обвели это ER выразительное чтение - отключение управляет изменение тона скорости и громкости по анализу текста - можно сразу не поймать разницу она работает на семантике ненавязчиво, с ней уходит монотонность. Нажатие перезапускают с текущего абзаца сначала - без нее семантика управляет только паузами.

  4. Подготовка 1-2 секунды до начала это запуск первого абзаца это ожидаемая загрузка пред синтеза - но это происходит один раз при старте с нуля - потом задержки быть не должно пока воспроизведения непрерывное - обновите сборку до версии 8

Опубликовали Сборку 8 — что изменилось и что тестировать

Синтезированный звук из предыдущих сборок очищен и создастся заново при первом воспроизведении — это ожидаемо, не баг. Книги, записи и импортированное аудио не тронуты.

  1. Перевод звучит из подготовленного файла. Перевод → «Слушать» или «Показывать и слушать». Регулятор скорости в плеере теперь действительно меняет темп перевода, и не должно пропускаться ни одного предложения, короткого абзаца или пункта списка.

  2. Подсветка слов следует тому тексту, который на экране. При чтении — за произносимыми словами. При дубляже поверх видео или подкаста — за оригинальной записью, синхронно.

  3. Нет остановок между абзацами. Запустите главу (лучше такую, где первый абзац длинный) и просто слушайте несколько минут, ничего не нажимая. Если всё же встанет и потребует Play или тапа — сообщите книгу, номер абзаца и примерное время.

  4. Нейроголоса стартуют на первом абзаце. Выберите Silero или Piper, начните главу с начала. После нескольких секунд «Preparing voice…» абзац должен зазвучать сам, без нажатия кнопки ER.

  5. Заблокированный экран. Запустите воспроизведение, заблокируйте экран на несколько минут, разблокируйте. Чтение и прогресс должны идти без сбоев.

  6. Выбор голоса перенесён в карточку книги. «Default Voice» теперь рядом с «Source Language», список отфильтрован по языку книги, есть переключатель «показать все языки». На автоопределении сначала спросит язык.

  7. Импорт .fb2.zip. Импортируйте архив с книгой напрямую, не распаковывая. Проверьте название и главы.

  8. Скорость открытия настроек. Тап по шестерёнке — экран должен появляться мгновенно.

  9. Импорт и голоса. EPUB/PDF/TXT, статья по ссылке, новостная или подкаст-лента. Apple-голоса и загрузка нейропака в Настройки → Silero Voices (или Piper Latvian).

  10. Языковые паки, пунктуация, иммерсивный ридер. Первый импорт книги на неанглийском тихо докачивает словарный пак (0,1–5 МБ) — после этого нажмите «Analyze content» и проверьте разбор слов в иммерсивном ридере. Настройки → Transcription → «Neural Punctuation», затем распознайте запись (главная цель — русский). Попробуйте чат и аналитические слои.

Сообщайте о любых странностях в звуке, вылетах, зависаниях, неверно определённом языке и проблемах интерфейса — с моделью устройства и версией iOS. Требуется iOS 18.6 или новее.

Готовим к выпуску 8 версию на этой неделе - Добавим режим перевода live - будет перевод и синтез на русском чтобы синтез успевал подхватывать без перевода всей книги и разогрева телефона - идея включаете в плеер три точки - перевод выбираете Listen только слушать перевод Booth слушать и видеть русский текст - приложение будет переводить и синтезировать параллельно без длительного ожидания - в эту же версию добавим fb2.zip .

Большое спасибо за отзыв и именно такие комменты определят каким будет приложение к окончанию тестирования. По шестеренке - посмотрю как ускорить - на симуляторе и на 15 про макс тормозов не было. Словарь ударений - в настройках той самой шестеренке - есть Russian Stress Dictionary - там две колонки магглов* м+агглов - ударение ставим перед гласной, а звездочка это все слова таким же началом маггловский. Этот словарь меняет ударения для всех таких слов в тексте - но если слово омограф - туда лучше не заносить. Мы очень ждем обновление акцентора от Силеро - они обещают улучшение омографов. По fb2.zip добавим в форматы раз это популярно. По маленьким кнопкам - пытались разместить все функции - но уже несколько просьб увеличить - подумаем как. Еще вопрос на каком языке слушали и какие голоса понравились, помогает ли вам разбивка глав на сцены ?

Из системных Милена улучшенный голос самый приятный русский по мне. А так рекомендую ставить Silero - там все нейтронные голоса говорят по русски и есть отличные - можно послушать на сайте. Но обязательно надо скачивать модель для ударений русских - без них синтез будет ужасный! И кстати, если транскрипты русские нужны, то надо и пунктуатор Silero скачивать - Apple не имеет знаков препинания для русских транскриптор, а с Silero текст будет с точками и запятыми. Скачивать можно в настройках приложения - кнопка с шестеренкой.

И еще в телефоне выполняется эвристическая обработка почти без ЛЛМ - она легкая и создание эмбедингов самая тяжелая ее часть - это около 1 минуты на книгу 500 страниц и вы сразу получаете размеченную по сценам передачу или главы книги. Это позволяет сразу видеть о чем это - так как название сцен это ключевое предложения из них, а в атмосфере видны все персонажи, статистика и главные леммы по важности из текста. По факту с таким приложением вам не нужен ни сервис транскрипции ни перевода ни суммаризации - все доступно локально на вашем телефоне. И потом возможность сохранить статью локально без рекламы и читать или слушать без баннеров само по себе приятно.

По секрету у меня как у разработчике в приложение сразу встроена CLI для обработки файлов локально на мак мини. Понятно что такая комбинация не знает о перегреве который настигает телефон через 10-20 минут транскрипции или перевода. И на ПК я при создании say файла с эмбедингами из книги использую локальную модель для валидации границ сцен, разметки ключевых предложений и разметки персонажей по каждому предложению. Я подумаю как сделать такой дуэт доступным для всех пользователей. И в планах издавать в формате say с эмбедингами и разметкой тексты публичных книг - таких как Остров сокровищ или Затерянный Мир. Главное преимущество нашего формата - один раз модель обрабатывает и размечает книгу и потом семантическая таблица доступна в самой книге без необходимости повторного анализа.

Силеро как всегда молодцы - выкатили кавказскую модель на 15 языков для которых практически нет синтезаторов кроме их модели CIS . Синтезировал кабардинский и адыгский контрольный текст - скорость на мак мини 80х качество синтеза очень высокое у всех спикеров - ошибок практически нет. Одна удивительная особенность - спикеры на адыгском и абазинском читают кабардинский текст не хуже родных спикеров - так что по факту у нас не 3 голоса а целых 7 пригодных для кабардинского языка. Что еще интереснее синтез кабардинского спикерами осетинского ингушского чеченского почти идеален с небольшим акцентом - но вполне пригоден. Не знаю как ученные а на мой слух версия о едином про северкавказском корне у этих языков кажется вполне убедительной.

Да адыгейский и кабардинский единый исходный язык , но они разошлись достаточно давно, так что разница существенная наверно можно сравнить с русским и белорусским. Я понимаю его достаточно хорошо, там есть ряд замен которые надо знать, чтобы понимать и с гласными там еще хуже чем в кабардинском - их почти нет. Адыгейский более архаичный он конечно близкий родственник, но грамматика своя например Нэху по кабардински свет в адыгейском присходит замена на Ф - Нэфын если ты об этом не знаешь то переведешь как слепой, а не свет :) можно погонять в Яндекс переводчике https://translate.yandex.ru/?source_lang=ru&target_lang=ady&text=свет

Добрый день , спасибо за обновление ! Интонации вопросительных предложений значительно улучшат натуральность синтеза - а возможность выделения ключевых слов подтвердит что Силеро лидер доступных решений синтеза на русском языке ! Очень ждем ваше обновление омографов для русского языка !

модель ставит обычное произношение в этой фразе корректно

📖 Loading vocabulary from /opt/homebrew/lib/python3.11/site-packages/ruaccent/model/vocab.json...

   Vocabulary size: 224

🤖 Initializing model...

📦 Loading weights from /opt/homebrew/lib/python3.11/site-packages/ruaccent/model/acc_model.pt...

✅ Accentor initialized successfully!

Э'то моя' ипоста'сь

Спасибо за оценку, вчера поздно выгружал и упустил, но вы помогли быстро устранить ошибку.

1

Information

Rating
812-th
Registered
Activity

Specialization

Разработчик мобильных приложений, Инженер по автоматизации тестирования
Средний
Python
Английский язык
Алгоритмы и структуры данных
C++
Базы данных