Балаболка яндекса почему не работает
Перейти к содержимому

Балаболка яндекса почему не работает

  • автор:

Можно ли в программе балаболка убрать ограничение на количество тегов для чтения иностранных слов?

5b3a461d44b43302738551.png

Паршу текстовые данные с форумов а затем прослушиваю их через программу преобразования текста в речь балаболка. В процессе работы столкнулся с ограничением на количество добавляемых тегов для чтения иностранных слов. Если спаршенный текст получается достаточно длинным то программа балаболка добавляет теги для чтения иностранных слов только до определённой его длинны. А далее текст их не содержит, что приводит к чтению англоязычного текста русскоязычным голосовым движком. Можно ли как то отключить ограничение на количество тегов для чтения иностранных слов, либо расширить его объём опционально, что бы теги добавлялись даже в достаточно длинные текстовые файлы?

  • Вопрос задан более трёх лет назад
  • 134 просмотра

Комментировать

Решения вопроса 1

VadimSoloviev

Вадим Соловьёв @VadimSoloviev Автор вопроса

Человек из касты создателей

Ограничение на количество тегов для чтения иностранных слов в программе Балаболка нет. Проблема была вызвана наличием в спаршенном тексте Знаков меньше < и Знаков больше >так как в них помещаются теги для чтение иностранных слов. Решить проблему можно заменой знаков «< >» словами «меньше» «больше».

Ответ написан более трёх лет назад

Комментировать

Нравится Комментировать

Балаболка яндекса почему не работает

ЗДЕСЬ МОГЛА БЫТЬ ВАША РЕКЛАМА!

Балаболка Утилита для использования онлайн-сервисов синтеза речи

Консольное приложение позволяет использовать популярные онлайн-сервисы для синтеза речи: текст или субтитры будут преобразованы в звуковые файлы формата WAV. Программа может быть применена в тестовых целях, для изучения возможностей облачных сервисов. Для Yandex SpeechKit было создано отдельное приложение, так как этот сервис принадлежит российской IT-компании.

Онлайн-сервисы для синтеза речи:

  • Google Cloud Text-to-Speech;
  • Amazon Polly;
  • Baidu Text-to-Speech;
  • CereVoice Cloud;
  • IBM Watson Text-to-Speech;
  • Microsoft Azure;
  • Naver Text-to-Speech;
  • Youdao Text-to-Speech;
  • Yandex SpeechKit.
Размер файла: МБ
Версия: История изменений
Тип лицензии: Freeware
Операционная система:

Консольное приложение для Yandex SpeechKit: Скачать ( МБ)
Программа позволяет преобразовать текст или субтитры в звуковые файлы при помощи онлайн-сервиса «Яндекс.Облако». Для выполнения операций через API необходимо получить API-ключ в сервисном аккаунте.

Командная строка

Программа может быть настроена с помощью параметров командной строки. Они отделяются друг от друга пробелом и начинаются с символа «-» (дефис). Значения параметров не чувствительны к регистру букв. Полный список параметров командной строки можно получить, введя команду bal4web.exe с параметрами -? или -h.

-s имя_сервиса Выбрать онлайн-сервис для синтеза речи («google» или «g», «amazon» или «a», «baidu» или «b», «cerevoice» или «c», «ibm» или «i», «microsoft» или «m», «naver» или «n», «youdao» или «y»). По умолчанию значение равно «google». -l идентификатор_языка Выбрать язык для синтеза речи. Идентификатор представляет собой комбинацию кода языка по стандарту ISO 639 (две маленькие буквы) и кода по стандарту ISO 3166 (две большие буквы), объединенных дефисом. Например: en-US, de-DE, ru-RU.
По умолчанию значение равно «en-US» (этот язык поддерживается всеми онлайн-сервисами). -g пол Выбрать пол голоса для синтеза речи (если онлайн-сервис поддерживает такой параметр). Женский пол: «female» или «f». Мужской пол: «male» или «m». Значение по умолчанию отсутствует; онлайн-сервис сам выберет пол голоса для каждого языка.
Параметр поддерживают сервисы Amazon Polly, CereProc TTS, Google TTS, IBM Watson TTS, Microsoft Azure, Naver TTS. -n имя_голоса Указать имя голоса для синтеза речи (если онлайн-сервис поддерживает такой параметр). Значение по умолчанию отсутствует; онлайн-сервис сам выберет голос для каждого языка.
Параметр поддерживают сервисы Amazon Polly, CereProc TTS, Google Cloud TTS, IBM Watson TTS, Microsoft Azure, Naver TTS. -r число Установить скорость речи (если онлайн-сервис поддерживает такой параметр). По умолчанию значение равно «1.0» (средняя скорость человеческой речи).
Для Amazon Polly значения находятся в диапазоне от «0.2» до «2.0».
Для Cereproc TTS значения находятся в диапазоне от «0.3» до «3.0».
Для Google TTS и Microsoft Azure значения находятся в диапазоне от «0.1» до «3.0».
Для IBM Watson TTS значения находятся в диапазоне от «0.3» до «2.0».
Для Naver TTS значения находятся в диапазоне от «0.5» до «1.5». -p целое_число Установить высоту звука в диапазоне от -20 до 20 (если онлайн-сервис поддерживает такой параметр). По умолчанию значение равно 0.
Параметр поддерживают сервисы Amazon Polly, CereProc TTS, Google Cloud TTS, IBM Watson, Microsoft Azure. -v целое_число Установить громкость в диапазоне от 0 до 200 (по умолчанию значение равно 100). -m Показать список языков, поддерживаемых онлайн-сервисом, а также перечислить дополнительные характеристики голосов для каждого языка (если есть). -f имя_файла Открыть текстовый файл. Командная строка может содержать несколько параметров -f. -fl имя_файла Открыть файл со списком текстовых файлов (по одному имени файла на каждой строке). Командная строка может содержать несколько параметров -fl. -w имя_файла Записать звуковой файл в формате WAV. -c Использовать текст из буфера обмена. -t текст Использовать текст из командной строки. Командная строка может содержать несколько параметров -t. -i Использовать текст из стандартного потока ввода (STDIN). -o Записать аудиоданные в стандартный поток вывода (STDOUT); если параметр задан, параметр -w игнорируется. —encoding кодировка или -enc кодировка Кодировка текста из стандартного потока ввода («ansi», «utf8» или «unicode»). По умолчанию значение равно «ansi». —silence-begin число или -sb число Установить длину паузы в начале звукового файла (в миллисекундах). По умолчанию значение равно 0. —silence-end число или -se число Установить длину паузы в конце звукового файла (в миллисекундах). По умолчанию значение равно 0. -ln число Выбрать строку из текстового файла, используя её номер. Нумерация строк начинается с «1». Для выбора нескольких строк можно указать номера начальной и конечной строк в тексте (например, «26-34»). Командная строка может содержать несколько параметров -ln. -e число Установить длину пауз между предложениями (в миллисекундах). Значение должно быть меньше 5000. Если параметр не задан, сервис будет использовать паузы между предложениями по умолчанию. Параметр поддерживает сервис Microsoft Azure (если задан ключ подписки). -d имя_файла Применить к тексту правила для коррекции произношения из словаря (файла с расширением *.BXD, *.DIC или *.REX). Командная строка может содержать несколько параметров -d. Пользователь может редактировать словарь в приложении Балаболка. -lrc Используя исходный текст, создать файл формата LRC. Текст в файле будет синхронизирован с речью в созданном звуковом файле. -srt Используя исходный текст, создать файл формата SRT. Субтитры в файле будет синхронизирован с речью в созданном звуковом файле. -sub Исходный текст представляет собой субтитры и должен быть преобразован в звуковой файл с учетом заданных интервалов времени. Параметр может быть полезен в тех случаях, когда в командной строке заданы параметры -i или -c. -host адрес Указать адрес прокси-сервера. -port число Указать порт прокси-сервера. -fr число Установить частоту дискретизации для аудиопотока, в кГц (8, 11, 16, 22, 24, 32, 44, 48). Если параметр не задан, используется значение по умолчанию для выбранного сервиса. —ignore-square-brackets или -isb Игнорировать текст в [квадратных скобках]. —ignore-curly-brackets или -icb Игнорировать текст в . —ignore-angle-brackets или -iab Игнорировать текст в . —ignore-round-brackets или -irb Игнорировать текст в (круглых скобках). —ignore-url или -iu Игнорировать URL-адреса внутри текста. —ignore-comments или -ic Игнорировать комментарии в тексте. Однострочные комментарии начинаются с // и продолжаются до конца строки. Многострочные комментарии начинаются с /* и завершаются */. -dp Показать индикатор прогресса выполнения в окне консольного приложения. -cfg имя_файла Задать имя файла конфигурации с параметрами командной строки (текстовый файл, каждая строка которого содержит по одному параметру). Если параметр не задан, будет выбран файл bal4web.cfg в той же папке, что и консольное приложение. -h Показать описание параметров командной строки. —lrc-length число Установить максимальную длину строк для файла формата LRC (в символах). —lrc-fname имя_файла Имя файла формата LRC. Параметр может быть полезен в тех случаях, когда в командной строке задан параметр -o. —lrc-enc кодировка Кодировка файла формата LRC («ansi», «utf8» или «unicode»). По умолчанию значение равно «ansi». —lrc-offset число Задать сдвиг времени для файла формата LRC (в миллисекундах). —lrc-artist текст Тег для файла формата LRC: исполнитель произведения. —lrc-album текст Тег для файла формата LRC: альбом. —lrc-title текст Тег для файла формата LRC: название произведения. —lrc-author текст Тег для файла формата LRC: автор. —lrc-creator текст Тег для файла формата LRC: создатель файла. —lrc-sent Вставить пустые строки после предложений при создании файла формата LRC. —lrc-para Вставить пустые строки после абзацев при создании файла формата LRC. —srt-length число Установить максимальную длину строк для файла формата SRT (в символах). —srt-fname имя_файла Имя файла формата SRT. Параметр может быть полезен в тех случаях, когда в командной строке задан параметр -o. —srt-enc кодировка Кодировка файла формата SRT («ansi», «utf8» или «unicode»). По умолчанию значение равно «ansi». —raw Записать аудиоданные в формате RAW PCM; данные не содержат заголовок формата WAV. Параметр используется совместно с параметром -o. —ignore-length или -il Не записывать размер аудиоданных в заголовок формата WAV. Параметр используется совместно с параметром -o. —wss Использовать протокол WebSocket для Microsoft Azure. Это позволит улучшить характеристики аудиофайлов (24 КГц вместо 16 КГц). Параметр игнорируется, если задан ключ подписки для Microsoft Azure Cognitive Services. Параметр -m поможет проверить, поддерживает голос протокол WebSocket или нет. —sub-format текст Формат субтитров («srt», «lrc», «ssa», «ass», «smi» или «vtt»). Если параметр не задан, формат будет определен по расширению имени файла субтитров. —sub-fit или -sf При преобразовании субтитров в речь автоматически увеличивать скорость речи для того, чтобы уложиться в заданные интервалы времени.
Параметр поддерживают сервисы Amazon Polly, CereProc TTS, Google TTS, Microsoft Azure и Naver TTS.

—aws-keyid текст или -ak текст Применить ключ доступа для Amazon Polly. Рекомендуется использовать этот ключ, если он у вас есть. —aws-secret текст или -as текст Применить секретный ключ для Amazon Polly. —aws-region текст или -ar текст Указать регион для Amazon Polly. —crv-email текст или -ce текст Указать электронный адрес, который был использован для регистрации на официальном сайте CereProc. Этот электронный адрес необходим для доступа к Cerevoice Cloud API. —crv-pwd текст или -cp текст Указать пароль, который был использован для регистрации на официальном сайте CereProc. Пароль необходим для доступа к Cerevoice Cloud API. Рекомендуется использовать этот пароль, если он у вас есть. —gc-apikey текст или -gk текст Применить API-ключ для доступа к Google Cloud. Рекомендуется использовать этот ключ, если он у вас есть. —ms-apikey текст или -mk текст Применить ключ подписки для Microsoft Azure Cognitive Services. Рекомендуется использовать этот ключ, если он у вас есть. —ms-region текст или -mr текст Указать регион подписки для Microsoft Azure Cognitive Services.

Примеры команд

Создать текстовый файл со списком языков, поддерживаемых онлайн-сервисом Google TTS:

bal4web -s Google -m > language.txt

Преобразовать текстовый файл BOOK.TXT в звуковой файл BOOK.WAV:

bal4web -f «d:\Text\book.txt» -w «d:\Sound\book.wav» -s Google -l ru-RU -g female

«Яндекс» отключил сервис «Балабоба»

Команда Яндекса приостановила работу сервиса «Балабоба» на основе системы искусственного интеллекта.

«Яндекс» отключил сервис «Балабоба»

«Балабоба» представляет собой генератор текста, способный дописать небольшой текст на основе первой фразы. Сервис начал свою работу летом 2021 года.

«Яндекс» отключил сервис «Балабоба»

Теперь на странице «Балабобы» yandex.ru/lab/yalm выдаётся лишь сообщение: «Балабоба временно не работает». Разработчики пояснили журналистам:

Мы приостановили работу „Балабобы“ по техническим причинам, потому что не можем сейчас гарантировать корректную работу сервиса».

Сроки возобновления работы сервиса пока не объявлены.

Балаболка яндекса почему не работает

Могу предположить, что таким ненавязчивым способом разработчики дают понять, что Вам стоит приобрести платную подписку на их сервисы

Похоже на то.
Но, получается схитрить. При работе с Yandex SpeechKit, Я делю текст на много коротких файлов (2000 символов) и если произошёл сбой, то не придётся переделывать большой фрагмент. И как только, при работе Yandex SpeechKit выскакивает ошибка, то я перезагружаю роутер и всё опять работает, какое-то время. Такое впечатление, словно у этого сервиса лимит, на количество принятых символов, от одного ай пи адреса.

SpeechPro работает намного быстрее чем Yandex SpeechKit. Там, где Yandex SpeechKit делал книгу пол дня (голосом Филипп), у SpeechPro менее часа ушло времени.

Цитата balabolka ( )
В работе сервиса SpeechPro ничего не поменялось
Группа: Пользователи
Сообщений: 8
Статус: Offline
Группа: Модераторы
Сообщений: 139
Статус: Offline
Цитата collega ( )
Балаболка показывает, что произошла ошибка 500, или 403, или 405.

Буду признателен, если те, кто сталкивается с такими ошибками, попытаются собрать информацию о том, как работает доступ к онлайн-сервисам на их компьютерах. Например, сколько времени проходит от первого запроса к серверу до момента возникновения ошибки? Какой общий объем текста удается конвертировать за этот промежуток времени? Какой голос использовался?
Важно помнить, что для каждого сервиса (а в случае с «Яндексом» — и для каждого голоса) доступ организован по-разному. По каждому сервису информацию надо анализировать отдельно.

На своем компьютере, например, замечаю, что очень часто самый первый запрос к любому серверу (имеется ввиду первый запрос в течение суток) заканчивается неудачей: возвращается ошибка 500, «внутренняя ошибка» (скорее всего, внутренняя ошибка моего провайдера). А уже второй запрос выполняется без проблем. Почему так происходит, до сих пор не знаю.

Цитата ttsspeech ( )
Группа: Пользователи
Сообщений: 7
Статус: Offline
Цитата balabolka ( )

Буду признателен, если те, кто сталкивается с такими ошибками, попытаются собрать информацию о том, как работает доступ к онлайн-сервисам на их компьютерах. Например, сколько времени проходит от первого запроса к серверу до момента возникновения ошибки? Какой общий объем текста удается конвертировать за этот промежуток времени? Какой голос использовался?Сервис

SpeechPro, голос «Пётр» — прерывается с ошибками 419 и 403. Происходит это, всегда по разному. Может через несколько секунд после начал, или через полчаса, когда уже несколько файлов создано из очереди. Сохраняю в мр3 файлы. Файл последний, на котором произошёл сбой, получается обрезанный. Приходится его снова запускать.
Началось это, больше года назад, пользовался SpeechPro. Когда стало очень часто повторяться, перешёл на Yandex SpeechKit, голос «Филип».
Некоторое время, не пользовался Балаболкой, а когда недавно запустил Yandex SpeechKit, то оказалось, что голос Филипп стал ПРО и не запускается совсем.
Не смог понять, от чего зависит появление ошибки.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *