Справочник API
Audio Transcriptions
Распознавание речи
POST
/v1/audio/transcriptionsРаспознаёт речь из аудиофайла.
Когда использовать
- расшифровка звонков;
- заметки по встречам;
- голосовые сообщения;
- поиск по аудиоархиву.
Качество зависит от записи, шума, языка и модели.
Пример запроса
curl {{PUBLIC_API_BASE_URL}}/audio/transcriptions \
-H "Authorization: Bearer gw_live_..." \
-F model="provider/transcription-model" \
-F file="@meeting.mp3" \
-F language="ru"Параметры тела запроса
| Поле | Обязательность | Описание |
|---|---|---|
model | Да | Публичное имя модели распознавания. |
file | Да | Аудиофайл. |
language | Нет | Язык аудио, если известен. |
prompt | Нет | Подсказка с терминами или контекстом. |
response_format | Нет | Формат ответа. |
temperature | Нет | Свобода распознавания, если поддерживается. |
Поля ответа
| Поле | Обязательность | Описание |
|---|---|---|
text | Да | Распознанный текст. |
duration | Нет | Длительность аудио, если доступна. |
language | Нет | Определённый или переданный язык. |
segments | Нет | Сегменты с таймкодами, если выбранный формат это поддерживает. |
Пример ответа
{
"text": "Добрый день. Обсудим запуск новой интеграции."
}