Расшифровка аудио и видео в текст
Загрузите интервью, совещание, звонок или лекцию. Получите готовый текст со спикерами, пунктуацией и таймкодами. Модель обучена на русской речи.
15 пробных минут · без привязки карты
Возможности
Что вы получаете
ВТекст 38 расшифровывает русскую речь из аудио, видео и записей разговоров, разделяет говорящих и ставит таймкоды. Сервис доступен клиентам по всей России.
Как это работает
Четыре шага
- 1
Загрузите запись
Перетащите файл в кабинете или отправьте запросом к API. Видео тоже подойдёт: звуковую дорожку достанем сами.
- 2
Выберите параметры
Разделение по говорящим, пунктуация, разбивка на реплики. Включается то, что нужно именно для этой записи.
- 3
Дождитесь расшифровки
Файл из кабинета обрабатывается в фоне, страницу можно закрыть. Короткий запрос к API возвращает текст в том же соединении.
- 4
Заберите результат
В кабинете расшифровка открывается рядом с плеером, а скачать её можно текстом, субтитрами SRT и VTT, документом DOCX или PDF. В API она приходит привычной структурой JSON.
Для разработчиков
Переход с Deepgram занимает одну строку
В работающей интеграции меняются два значения: адрес сервиса и ключ. Остальной код можно не открывать. То же для OpenAI Audio API.
- Официальные SDK Deepgram и OpenAI работают без изменений
- Разделение по говорящим и таймкоды слов
- Все расхождения с оригиналом перечислены на странице API
- base_url="https://api.deepgram.com"
+ base_url="https://vtext38.ru/api"
client.listen.rest.v("1").transcribe_file(
{"buffer": audio},
{"smart_format": True, "diarize": True},
)Частые вопросы
Попробуйте на своей записи
15 минут начислим при регистрации, без привязки карты.