Gateway
Справочник API

OCR

Распознавание текста на изображениях и документах

POST/v1/ocr

Извлекает текст из изображения или документа, если выбранная модель поддерживает распознавание.

Где полезно

  • обработка сканов;
  • разбор фотографий документов;
  • перенос текста из изображений;
  • подготовка данных для поиска.

Проверяйте качество на своих примерах: таблицы, печати, рукописный текст и плохие фотографии могут распознаваться хуже.

Пример запроса

curl {{PUBLIC_API_BASE_URL}}/ocr \
  -H "Authorization: Bearer gw_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "provider/ocr-model",
    "image": "https://example.com/document.png"
  }'

Параметры тела запроса

ПолеОбязательностьОписание
modelДаПубличное имя OCR-модели.
imageДаИзображение, файл или ссылка в формате, который поддерживает модель.
promptНетДополнительная инструкция: например, извлечь только таблицу.
languageНетЯзык документа, если известен.

Поля ответа

ПолеОбязательностьОписание
textДаИзвлечённый текст.
pagesНетРазбивка по страницам, если доступна.
blocksНетБлоки текста или координаты, если модель их возвращает.
usageНетИспользование токенов, если применимо.

Пример ответа

{
  "text": "Счёт № 42\nИтого: 12 500 ₽"
}