Расшифровать голосовое, диктофон или лекцию — текст придёт свёрстанным PDF.
Наоборот: Озвучить PDFПеретащите файл сюда
выберите файл
Макс. размер: 20 МБ
Пятиминутное голосовое проще прочитать за тридцать секунд, чем слушать целиком. Инструмент распознаёт речь и отдаёт готовый текст: не сырую простыню, а разбитый на абзацы по паузам документ, при желании — с таймкодами, чтобы вернуться к нужному месту записи.
Распознаёт нейросеть Whisper прямо на нашем сервере — запись никуда не пересылается и, как и всё здесь, удаляется через час. Русский и английский понимает уверенно, язык определяется автоматически. Знаки препинания расставляются сами.
Честно о границах: качество зависит от записи. Чистая речь в микрофон распознаётся почти без ошибок, разговор двух людей на фоне кафе — с огрехами. Записи длиннее 15 минут не берём — разрежьте на части. И одна особенность очереди: тяжёлые задачи идут по одной, так что в час пик расшифровка может подождать пару минут, прежде чем начнётся.
Бесплатно, без регистрации и водяных знаков. Файл до 20 МБ, удаляется с сервера через час.
MP3, WAV, OGG-голосовое из Телеграма, M4A с диктофона — что угодно.
Или оставьте автоопределение — оно почти не ошибается.
Десятиминутная запись распознаётся за две-пять минут.
Текст разбит на абзацы, кириллица свёрстана нормальным шрифтом.
Загруженный файл и результат удаляются с наших серверов в течение часа.