Отправляется ли аудио на сервер?
Нет. Декодирование и распознавание выполняются в браузере, запись не отправляется на сервер. Подключение к интернету нужно для загрузки моделей и ресурсов, которых ещё нет в кеше.
Преобразуйте речь в текст бесплатно столько раз, сколько нужно. Выберите аудиофайл или запишите звук с микрофона и создайте расшифровку и субтитры на своём устройстве.
Перетащите аудиофайл сюда или нажмите, чтобы выбрать
Аудио обрабатывается в этом браузере и не отправляется на сервер.
Стандартный режим работает быстрее и использует меньше памяти. Улучшенный режим может повысить качество распознавания, но требует загрузки большего объёма данных, больше памяти и времени.
По умолчанию язык определяется автоматически. Если он определён неверно, выберите язык вручную.
Номера говорящих приблизительны; проверьте их.
Перед использованием проверьте текст, временные метки и метки говорящих.
Используйте этот инструмент преобразования аудио в текст для расшифровки голосовых заметок, интервью, лекций и записей встреч. При первом запуске загружаются необходимые модели; при последующих запусках можно повторно использовать кеш браузера, если он доступен. Скорость обработки зависит от устройства. Перед тем как поделиться результатом, проверьте текст, временные метки и метки говорящих, если они есть.
Нет. Декодирование и распознавание выполняются в браузере, запись не отправляется на сервер. Подключение к интернету нужно для загрузки моделей и ресурсов, которых ещё нет в кеше.
Автоматическое определение распознаёт язык по речи в начале записи. Язык также можно выбрать вручную. Доступно много языков, но точность зависит от языка, акцента, шума и качества записи. Смешанная речь на разных языках и одновременные голоса требуют тщательной проверки.
По умолчанию выбран улучшенный режим. Он может повысить качество распознавания, но требует большего объёма первоначальной загрузки, больше памяти и обычно больше времени на обработку. Выбирайте улучшенный режим, если для вас важнее качество распознавания. Стандартный режим работает быстрее и использует меньше памяти, поэтому подходит для длинных записей или устройств с ограниченными ресурсами.
Метки говорящих необязательны и по умолчанию отключены. Они оценивают, кто говорил, и могут быть ошибочными, особенно при коротких репликах и одновременной речи.
Связанные инструменты: Подавление шума в аудио с ИИ · Разделение аудио · Редактор субтитров · Сдвиг времени SRT · Сдвиг времени VTT