Расшифровка аудио в текст нейросетью
Пришлите запись разговора, лекцию, подкаст или голосовое сообщение — нейросеть превратит речь в текст и вернёт файлом. Нужна привязка ко времени — включите «С таймингами».
Как это работает
Три шага — и результат у вас в Telegram.
Выберите «Аудио в текст»
В меню «Ещё» на главном экране бота. Выберите, нужны ли тайминги, — цена в час записи видна сразу.
Загрузите запись
mp3, m4a, wav, ogg, flac и другие форматы, в том числе голосовые из мессенджеров. До 150 МБ и 3 часов.
Получите текст
Расшифровка приходит файлом .txt, с таймингами — ещё и субтитры .srt.
Для чего подойдёт расшифровка аудио
Записи звонков и встреч
Протокол созвона или разговор с клиентом превращается в текст, который можно искать и цитировать.
Лекции и подкасты
Конспект лекции или текстовая версия выпуска — без ручной расшифровки.
Голосовые сообщения
Длинное голосовое можно прочитать глазами, а не слушать.
Тайминги по желанию
Текст абзацами или с меткой времени в каждой строке — удобно искать нужный момент в записи.
Длинные записи
До трёх часов за раз: звук режется на части и склеивается с правильными метками времени.
Копейки за час
Стоимость считается по длительности и известна заранее; если речи в записи нет, токены не списываются.
Примеры запросов
Скопируйте любой или придумайте свой.
Сколько это стоит
Платите только за сделанное. 1 токен ≈ 1 ₽ (в базовом пакете 100 токенов — 99 ₽), считаем до десятых.
токена за час
расшифровка часа записи (≈4 ₽)
токена
10 минут записи (меньше рубля)
токенов
дарим на старте — это около 24 часов записи
Вопросы
Как перевести аудио в текст?
Откройте бота, выберите «Ещё» → «Аудио в текст», загрузите запись и нажмите кнопку расшифровки. Текст придёт в чат файлом.
Какие форматы поддерживаются?
mp3, m4a, wav, ogg, opus, flac, aac и другие; подойдёт и звук из видеофайла.
Можно ли получить текст с таймингами?
Да: включите «С таймингами» — в каждой строке будет метка времени, а ещё придёт файл субтитров .srt.
Сколько это стоит?
Около 4 токенов (≈4 ₽) за час записи. Точная цена зависит от длительности и видна до запуска.
Насколько точно распознаётся речь?
Используется модель Whisper: хорошо справляется с русским, но на шумных записях и накладывающихся голосах возможны неточности. Паузы и шум мы очищаем от выдуманных фраз.
Аудио сохраняется на сервере?
Нет, исходная запись удаляется сразу после расшифровки. В чате остаётся только текст.
Ещё в СпросИИ
Всё это — в одном боте и на одном балансе.
Расшифруйте свою первую запись
100 бонусных токенов ждут вас в Telegram 🎁
Начать в Telegram Начать в MAX Открыть в браузере