Расшифровка аудио и видео в текст
Загрузите интервью, совещание, звонок или лекцию и получите готовый текст: реплики разложены по говорящим, знаки препинания расставлены, у каждого слова свой таймкод. Модель обучена на русской речи.
15 пробных минут · дальше от 1 ₽ за минуту · без привязки карты
Возможности
Что вы получаете
Текст, который можно сразу читать, править и цитировать.
Как это работает
Четыре шага
- 1
Загрузите запись
Перетащите файл в кабинете или отправьте запросом к API. Видео тоже подойдёт: звуковую дорожку достанем сами.
- 2
Выберите параметры
Разделение по говорящим, пунктуация, разбивка на реплики. Включается то, что нужно именно для этой записи.
- 3
Дождитесь расшифровки
Файл из кабинета обрабатывается в фоне, страницу можно закрыть. Короткий запрос к API возвращает текст в том же соединении.
- 4
Заберите результат
В кабинете расшифровка открывается рядом с плеером, а скачать её можно текстом, субтитрами SRT и VTT, документом DOCX или PDF. В API она приходит привычной структурой JSON.
Для разработчиков
Переход с Deepgram занимает одну строку
В работающей интеграции меняются два значения: адрес сервиса и ключ. Остальной код можно не открывать.
- Официальные SDK работают без изменений
- Разделение по говорящим и таймкоды слов
- Все расхождения с оригиналом перечислены на странице API
- base_url="https://api.deepgram.com"
+ base_url="https://api.vtext38.ru"
client.listen.rest.v("1").transcribe_file(
{"buffer": audio},
{"smart_format": True, "diarize": True},
)Частые вопросы
Попробуйте на своей записи
15 минут начислим при регистрации, без привязки карты.