99 языков без настройки
Язык определяется автоматически: русский, английский, испанский, польский и десятки других в одном потоке.
Расшифровка звонков, голосовых сообщений и интервью на 99 языках. Протокол совместим с OpenAI Whisper — подключение занимает одну строку кода.
10 минут бесплатно — сразу после регистрации
Дальше — до 0.006 USD за минуту аудио, оплата по факту
Язык определяется автоматически: русский, английский, испанский, польский и десятки других в одном потоке.
Минута записи расшифровывается за пару секунд, текст возвращается в том же запросе — без очередей и опроса статуса.
Записи и расшифровки живут не дольше суток — только для проверки качества, — затем удаляются автоматически.
Работает с официальным openai-sdk: меняются только адрес и ключ. Форматы ответов и ошибок совпадают.
Если у вас уже есть код для OpenAI Whisper — замените две строки.
from openai import OpenAI
client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="ваш ключ")
r = client.audio.transcriptions.create(model="whisper-1", file=open("call.ogg", "rb"))
print(r.text)
Регистрация занимает минуту, ключ выдаётся сразу вместе с доступом в личный кабинет.
Укажите наш base_url и свой ключ — остальной код остаётся прежним.
Минуты, история расшифровок и счёт за период — в личном кабинете, в реальном времени.
Один эндпоинт POST /v1/audio/transcriptions — как у OpenAI.
ogg · opus · mp3 · wav · m4a · webm — до 25 МБ
json · text · verbose_json · srt · vtt
Параметр prompt помогает точнее распознавать названия, имена и коды.
Готовые srt и vtt либо сегменты с временем в verbose_json.
Пошаговые инструкции по типовым задачам — с кодом и разбором ошибок.
Как перевести телефонные разговоры в текст и поставить это на поток.
Работа с ogg/opus из мессенджеров и точность на коротких записях.
Готовые субтитры из вебинара или ролика одним запросом.
Что менять в коде и как сравнить качество перед переключением.
Тот же протокол и те же форматы ответов, поэтому код менять не нужно — достаточно указать другой адрес и ключ. Распознавание идёт на наших мощностях.
99 языков, включая русский, английский, испанский, немецкий и польский. Язык определяется автоматически по звуку, указывать его необязательно.
Минута аудио обрабатывается за пару секунд. Текст приходит в ответе на тот же запрос — не нужно опрашивать статус задачи.
Записи и расшифровки хранятся не дольше суток — только чтобы вы могли проверить качество, — затем удаляются автоматически.
ogg, opus, mp3, wav, m4a, webm и другие популярные форматы до 25 МБ. Ответ доступен в json, text, verbose_json, srt и vtt.
Оплата за минуты аудио: до 0.006 USD за минуту, при больших объёмах — по договорённости. Считаются только успешные запросы; тишина и ошибки не тарифицируются.