Речь в текст (Whisper)
Бесплатное и приватное распознавание речи в браузере. Расшифровывайте или переводите аудио и видео с OpenAI Whisper прямо на вашем устройстве — записывайте с микрофона и экспортируйте TXT или субтитры SRT.
🔒 Работает полностью в вашем браузере — ничего не загружаетсяРаспознавание речи Whisper на вашем устройстве
Этот инструмент превращает устную речь в текст с помощью Whisper — открытой модели распознавания речи, выпущенной OpenAI. В отличие от большинства онлайн-сервисов расшифровки, ничего не отправляется на сервер: браузер декодирует аудио, передискретизирует его до 16 кГц моно и передаёт модели в фоновом Web Worker. Страница выбирает самый быстрый доступный движок — WebGPU на видеокартах и в браузерах, которые его поддерживают, или WebAssembly на процессоре во всех остальных случаях. При первом запуске веса модели загружаются с Hugging Face; затем они остаются в кэше браузера, поэтому последующие сеансы запускаются намного быстрее.
Вы можете расшифровывать интервью, лекции, подкасты, голосовые заметки и записи совещаний, а также звуковую дорожку видеофайла. Короткие фрагменты можно записать прямо с микрофона. Длинные записи обрабатываются перекрывающимися 30-секундными окнами, а индикатор прогресса показывает, сколько окон уже готово. Благодаря этому даже часовую лекцию можно расшифровать, никому её не пересылая.
Расшифровки, переводы и субтитры
Выберите Transcribe, чтобы получить текст на языке оригинала, или Translate to English, чтобы Whisper написал английскую версию речи на другом языке. Автоопределение анализирует первые 30 секунд, чтобы распознать язык; если запись начинается с музыки или тишины, лучше выбрать язык вручную — так результат будет точнее. Включите временные метки, чтобы видеть, когда прозвучало каждое предложение, и скачайте файл субтитров SRT, который можно загрузить в видеоредакторы, на YouTube или в медиаплееры.
Советы для точного результата
Чистый звук важнее всего остального. Записывайте близко к микрофону, избегайте фоновой музыки и давайте говорить одному человеку за раз. Whisper base — компактная модель, поэтому имена, профессиональный жаргон и сильный акцент могут потребовать быстрой ручной правки; всегда вычитывайте текст перед публикацией. Если на устройстве мало памяти, закройте другие тяжёлые вкладки перед расшифровкой длинных файлов и не закрывайте эту вкладку, пока расшифровка не завершится. Очень длинные записи лучше разделить на несколько более коротких файлов и обрабатывать их по очереди.
Как использовать
- Добавьте аудиоПеретащите аудио- или видеофайл в поле либо нажмите «Record from microphone» и начните говорить.
- Выберите язык и задачуОставьте язык на «Auto-detect» или выберите его вручную, затем выберите «Transcribe» или «Translate to English».
- Запустите WhisperНажмите «Transcribe». Модель загружается один раз, а затем работает на вашем устройстве, пока заполняется индикатор прогресса.
- Экспортируйте текстПри необходимости включите временные метки, затем скопируйте расшифровку или скачайте её как файл .txt или субтитры .srt.