Аудио в текст (PDF)

Расшифровать голосовое, диктофон или лекцию — текст придёт свёрстанным PDF.

Наоборот: Озвучить PDF

Пятиминутное голосовое проще прочитать за тридцать секунд, чем слушать целиком. Инструмент распознаёт речь и отдаёт готовый текст: не сырую простыню, а разбитый на абзацы по паузам документ, при желании — с таймкодами, чтобы вернуться к нужному месту записи.

Распознаёт нейросеть Whisper прямо на нашем сервере — запись никуда не пересылается и, как и всё здесь, удаляется через час. Русский и английский понимает уверенно, язык определяется автоматически. Знаки препинания расставляются сами.

Честно о границах: качество зависит от записи. Чистая речь в микрофон распознаётся почти без ошибок, разговор двух людей на фоне кафе — с огрехами. Записи длиннее 15 минут не берём — разрежьте на части. И одна особенность очереди: тяжёлые задачи идут по одной, так что в час пик расшифровка может подождать пару минут, прежде чем начнётся.

Бесплатно, без регистрации и водяных знаков. Файл до 20 МБ, удаляется с сервера через час.

Как это работает

  1. 1

    Загрузите запись

    MP3, WAV, OGG-голосовое из Телеграма, M4A с диктофона — что угодно.

  2. 2

    Выберите язык

    Или оставьте автоопределение — оно почти не ошибается.

  3. 3

    Подождите пару минут

    Десятиминутная запись распознаётся за две-пять минут.

  4. 4

    Скачайте PDF

    Текст разбит на абзацы, кириллица свёрстана нормальным шрифтом.

  5. 5

    Удаление через час

    Загруженный файл и результат удаляются с наших серверов в течение часа.

Частые вопросы

Да, формат OGG/Opus поддерживается. Скачайте голосовое из чата и загрузите сюда.

Похожие инструменты

Гайды и инструкции