Scan Types

Choose the right scan type: Receipt, Invoice, or Other

Обзор типов сканирования

Yomio предлагает три типа сканирования, каждый из которых оптимизирован для определенного вида документов. Выбор подходящего типа является самым важным фактором для успешного извлечения данных.

🧾

Квитанция

Engine: Azure Document Intelligence

Best for: Бумажные чеки, сфотографированные с помощью камеры
Examples: Grocery receipts, restaurant bills, retail store receipts, gas station receipts
Limitations: Работает только с фотографиями настоящих бумажных чеков. Скриншоты, веб-страницы и цифровые заказы не будут приниматься.
How it works: Изображение отправляется в готовую модель Azure DI для распознавания чеков — специализированный алгоритм OCR, обученный на миллионах реальных фотографий чеков.
📄

Invoice

Engine: Azure Document Intelligence

Best for: Formal invoices, bills, and structured financial documents
Examples: Счета-фактуры подрядчиков, счета за коммунальные услуги, подписки на программное обеспечение, счета-фактуры фрилансеров
Limitations: Best with clean digital documents. Handwritten or annotated invoices may have reduced accuracy.
How it works: Изображение отправляется в модель «prebuilt-invoice» службы Azure DI, которая распознает поля, характерные для счетов-фактур.
📋

Прочее

Engine: GPT-4o Vision (OpenRouter)

Best for: Скриншоты, веб-страницы, подтверждения по электронной почте и всё, что выходит за рамки стандартных форматов
Examples: Website shopping cart screenshots, order confirmation pages, email receipts, quotes, estimates
Limitations: Особых ограничений нет — обрабатывает практически любое изображение, содержащее текст.
How it works: Изображение отправляется в GPT-4o — мультимодальный ИИ, который визуально анализирует изображение и извлекает структурированные данные. Отдельного этапа OCR не требуется. Элементы классифицируются автоматически.

Краткое руководство по принятию решений

Не знаете, какой тип выбрать? Действуйте следующим образом:

1

Is it a physical paper receipt from a store or restaurant?

→ Choose: Квитанция

2

Это официальный счет-фактура или счет (в формате PDF или в печатном виде)?

→ Choose: Invoice

3

Это скриншот, веб-страница, электронное письмо или цифровой заказ?

→ Choose: Прочее

4

Did Receipt or Invoice fail with an error?

→ Choose: Другое (попробуйте ещё раз с этим типом)

Типичные сценарии сбоев

Вот наиболее распространённые ошибки и способы их исправления:

ScenarioYou choseResultShould beWhy
Скриншот корзины покупок на веб-сайте (Walmart, Amazon, IKEA и т. д.)Receipt❌ ОШИБКА — OCR_FAILEDOtherМодель распознавания чеков Azure DI рассчитана на фотографию бумажного чека. Скриншот веб-сайта имеет иную верстку, шрифты и контрастность, которые модель не может обработать.
Скриншот письма с подтверждением заказаReceipt❌ ОШИБКА — OCR_FAILEDOtherПо той же причине — макеты электронных писем не напоминают квитанции.
Фотография компьютерного монитора, на котором отображается PDF-файл с квитанциейReceipt❌ ОШИБКА — OCR_FAILEDOtherОтражения на экране, муаровые узоры и артефакты пиксельной сетки мешают модели OCR надежно распознавать текст.
Фотография бумажного чека из продуктового магазинаReceipt✅ УспехКвитанцияStandard use case — works as expected.
Счёт-фактура в формате PDF от подрядчикаСчёт-фактура✅ SuccessСчёт-фактураСтандартный вариант использования — работает как ожидалось.

⚠️Важно

Если сканирование документа типа «Квитанция» или «Счёт-фактура» завершилось неудачей, НЕ загружайте то же изображение повторно. Вместо этого попробуйте ещё раз, выбрав тип «Прочее» — для него используется совершенно другой механизм искусственного интеллекта (GPT-4o vision), способный обрабатывать нестандартные документы.

Как это работает

Каждый тип сканирования направляет ваше изображение в свой конвейер искусственного интеллекта:

Конвейер обработки квитанций и счетов-фактур (версия 1)

Route: POST /documents · Engine: Azure Document Intelligence

  1. File validation and S3 upload
  2. Azure DI OCR (prebuilt-receipt или prebuilt-invoice)
  3. Response parsing into structured data
  4. Создание расходов с использованием позиций (классификация осуществляется посредством отдельного вызова LLM)

Другой конвейер (v2)

Route: POST /v2/documents · Engine: GPT-4o Vision (OpenRouter)

  1. Проверка файлов и загрузка в S3
  2. Image optimisation (auto-rotate, resize, sharpen, contrast)
  3. GPT-4o анализирует изображение и возвращает структурированный JSON
  4. Создание расходов с использованием предварительно классифицированных позиций (без отдельного этапа LLM)

Советы и передовой опыт

✅ Do

  • Take a photo of the physical receipt when possible — it works best with Receipt type
  • Выберите «Другое» для любого скриншота, веб-страницы, электронного письма или цифрового документа
  • Если сканирование завершилось неудачно, перед повторной загрузкой выберите «Другое» и повторите попытку
  • Ensure good lighting and keep the document flat for best results

❌ Don't

  • Не используйте «Receipt» для создания скриншотов веб-сайтов — они не сработают
  • Don't upload the same image twice — just change the scan type
  • Не используйте скриншоты экранов (монитора или телефона, на которых отображается документ) при выборе типа «Квитанция»