Справочник API
OCR
Распознавание текста на изображениях и документах
POST
/v1/ocrИзвлекает текст из изображения или документа, если выбранная модель поддерживает распознавание.
Где полезно
- обработка сканов;
- разбор фотографий документов;
- перенос текста из изображений;
- подготовка данных для поиска.
Проверяйте качество на своих примерах: таблицы, печати, рукописный текст и плохие фотографии могут распознаваться хуже.
Пример запроса
curl {{PUBLIC_API_BASE_URL}}/ocr \
-H "Authorization: Bearer gw_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "provider/ocr-model",
"image": "https://example.com/document.png"
}'Параметры тела запроса
| Поле | Обязательность | Описание |
|---|---|---|
model | Да | Публичное имя OCR-модели. |
image | Да | Изображение, файл или ссылка в формате, который поддерживает модель. |
prompt | Нет | Дополнительная инструкция: например, извлечь только таблицу. |
language | Нет | Язык документа, если известен. |
Поля ответа
| Поле | Обязательность | Описание |
|---|---|---|
text | Да | Извлечённый текст. |
pages | Нет | Разбивка по страницам, если доступна. |
blocks | Нет | Блоки текста или координаты, если модель их возвращает. |
usage | Нет | Использование токенов, если применимо. |
Пример ответа
{
"text": "Счёт № 42\nИтого: 12 500 ₽"
}