сервис работает

Транскрибация аудио в текст
через API

Расшифровка звонков, голосовых сообщений и интервью на 99 языках. Протокол совместим с OpenAI Whisper — подключение занимает одну строку кода.

10 минут бесплатно — сразу после регистрации

Дальше — до 0.006 USD за минуту аудио, оплата по факту

Почему выбирают voicescribe

99 языков без настройки

Язык определяется автоматически: русский, английский, испанский, польский и десятки других в одном потоке.

Ответ за секунды

Минута записи расшифровывается за пару секунд, текст возвращается в том же запросе — без очередей и опроса статуса.

Данные не копятся

Записи и расшифровки живут не дольше суток — только для проверки качества, — затем удаляются автоматически.

Код менять не нужно

Работает с официальным openai-sdk: меняются только адрес и ключ. Форматы ответов и ошибок совпадают.

Подключение за минуту

Если у вас уже есть код для OpenAI Whisper — замените две строки.

from openai import OpenAI

client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="ваш ключ")
r = client.audio.transcriptions.create(model="whisper-1", file=open("call.ogg", "rb"))
print(r.text)
1
Получите ключ

Регистрация занимает минуту, ключ выдаётся сразу вместе с доступом в личный кабинет.

2
Замените адрес

Укажите наш base_url и свой ключ — остальной код остаётся прежним.

3
Следите в кабинете

Минуты, история расшифровок и счёт за период — в личном кабинете, в реальном времени.

Возможности API распознавания речи

Один эндпоинт POST /v1/audio/transcriptions — как у OpenAI.

Форматы аудио

ogg · opus · mp3 · wav · m4a · webm — до 25 МБ

Форматы ответа

json · text · verbose_json · srt · vtt

Подсказки терминов

Параметр prompt помогает точнее распознавать названия, имена и коды.

Субтитры и таймкоды

Готовые srt и vtt либо сегменты с временем в verbose_json.

Руководства и примеры

Пошаговые инструкции по типовым задачам — с кодом и разбором ошибок.

Частые вопросы

Чем это отличается от OpenAI Whisper API?

Тот же протокол и те же форматы ответов, поэтому код менять не нужно — достаточно указать другой адрес и ключ. Распознавание идёт на наших мощностях.

Какие языки поддерживаются?

99 языков, включая русский, английский, испанский, немецкий и польский. Язык определяется автоматически по звуку, указывать его необязательно.

Сколько времени занимает расшифровка?

Минута аудио обрабатывается за пару секунд. Текст приходит в ответе на тот же запрос — не нужно опрашивать статус задачи.

Что происходит с загруженными записями?

Записи и расшифровки хранятся не дольше суток — только чтобы вы могли проверить качество, — затем удаляются автоматически.

Какие форматы аудио принимаются?

ogg, opus, mp3, wav, m4a, webm и другие популярные форматы до 25 МБ. Ответ доступен в json, text, verbose_json, srt и vtt.

Сколько это стоит?

Оплата за минуты аудио: до 0.006 USD за минуту, при больших объёмах — по договорённости. Считаются только успешные запросы; тишина и ошибки не тарифицируются.