v1.0.1
EN
New features:
Input device settings, using system audio as an audio source, and a built-in mixer:
-
A model input device settings window has been added to the input device (microphone) settings. Each device now has a volume control (100% by default) and a real-time volume indicator. Multiple devices can be selected.
-
Selecting more than one device activates the mixer functionality. The program combines the output from the selected devices into a single audio stream.
-
In addition to real input devices, system audio has been added. System audio is also mixed with other selected devices.
Interface changes:
- The main application interface has been optimized. Some button labels have been removed, leaving only icons and symbols.
- The ability to edit text after recognition has been added. Text is cleared from the recognition window only upon user request.
- A visual progress indicator has been added during text recognition from a file.
Video support:
- Added the ability to recognize speech in video files (this can take a long time depending on the video file format and size. FFmpeg is responsible for separating and converting the audio track).
Creating subtitles in .SRT format:
- Added the ability to create subtitles for audio and video files. An "srt" checkbox has been added to activate this feature. This feature generates text compatible with the *.SRT format in the output window. In subtitle creation mode, the "Copy" button is replaced with a "Save" button. The subtitle file is saved in the *.SRT format. To save the subtitle file with the name of the desired media file, select the media file name you want to clone into the new subtitle file when choosing a name and save location in the File Explorer window. File Explorer will warn you that you will overwrite the selected file, but this will not happen. The program only takes the file path and name to save the subtitle file so it can be recognized by video players as subtitles for that media file.
- Subtitle timings are automatically split during pauses in the conversation. If there are no pauses longer than 15 seconds, the text is split by the current word.
Sound recognition mode without real-time output:
- Added "record before recognition" mode. This mode does not use real-time text streaming. The recording is saved as a temporary file and processed after recording is complete. This feature allows the program to be used on devices that do not provide the required real-time performance. This mode provides the best text recognition quality. Dictation defects, repetitions, etc. are removed.
RU
Новые функции:
Настройка устройств ввода, использование системного звука как источника звука, встроенный микшер:
- В настройках устройства ввода (микрофон) добавлено модельное окно настройки устройства ввода. Для каждого устройства добавлена настройка уровня громкости (по умолчанию 100%) и индикатор уровня громкости в реальном времени. Можно выбрать несколько устройств.
- В случае выбора более 1 устройства активируется функционал микшера. Программа собирает выход с выбранных устройств в один звуковой поток.
- Кроме реальных устройств ввода добавлен системный звук. Системный звук тоже микшируется с другими выбранными устройствами.
Изменения интерфейса:
- Оптимизирован основной интерфейс приложения. Убраны некоторые подписи на кнопках, оставлены только пиктограммы и значки.
- Добавлена возможность редактирования текста после распознавания. Текст стирается из окна распознавания только по требованию пользователя.
- Во время распознавания текста из файла появился визуальный индикатор работы.
Поддержка работы с видео:
- Добавлена возможность распознавать речь в видеофайлах (это может занимать много времени в зависимости от формата и размера видеофайла. За отделение и конвертацию аудидорожки отвечает FFmpeg).
Создание субтитров в формате .SRT:
- Добавлена функция создания субтитров для аудио и видео файлов. Добавлен чекбокс "srt", активирующий эту функцию. С данной функцией в окне вывода генерируется текст, совместимый с *.SRT форматом. В режиме создания субтитров кнопка "копировать" заменяется кнопкой "сохранить". Файл субтитров сохраняется в формате *.SRT. Чтобы сохранить файл субтитров с именем нужного медиафайла в процессе выбора названия и места для сохранения в окне проводника выберите медиафайл название которое должно быть клонировано в новом файле субтитров. Проводник будет предупреждать, что вы перезапишете выбранный файл, но этого не произойдёт. Программа только забирает путь к файлу и его название, чтобы сохранить файл субтитров так чтобы он распознался видео проигрывателями как субтитры к этому медифайлу.
- Тайминги субтитров автоматически разделяются во время пауз в разговоре. В случае отсутствия пауз более 15 секунд текст разделяется по текущему слову.
Режим распознавания звука без вывода в реальном времени:
- Добавлен режим "запись перед распознаванием". В этом режиме не используется функционал стриминга текста в реальном времени. Запись сохраняется как временный файл и обрабатывается после окончании записи. Функция позволяет использовать программу на устройствах не обеспечивающих необходимую производительность в реальном времени. В этом режиме наилучшее качество распознавания текста. Убираются дефекты надиктовывая, повторения и т.д.