Scan Types

Choose the right scan type: Receipt, Invoice, or Other

Přehled typů skenování

Yomio nabízí tři typy skenování, z nichž každý je optimalizován pro jiný druh dokumentu. Výběr správného typu je nejdůležitějším faktorem pro úspěšnou extrakci dat.

🧾

Účtenka

Engine: Azure Document Intelligence

Best for: Papírové účtenky vyfotografované fotoaparátem
Examples: Účtenky z obchodu s potravinami, účty z restaurací, účtenky z maloobchodních prodejen, účtenky z čerpacích stanic
Limitations: Funguje pouze s fotografiemi skutečných papírových účtenek. Snímky obrazovky, webové stránky a digitální objednávky nebudou zpracovány.
How it works: Obrázek se odešle do předem připraveného modelu Azure DI pro účtenky – specializovaného systému OCR, který byl vycvičen na milionech skutečných fotografií účtenek.
📄

Faktura

Engine: Azure Document Intelligence

Best for: Formální faktury, účty a strukturované finanční dokumenty
Examples: Faktury od dodavatelů, účty za služby, předplatné softwaru, faktury od nezávislých pracovníků
Limitations: Nejlepší výsledky dosahuje při zpracování čistých digitálních dokumentů. U ručně psaných nebo poznámkami opatřených faktur může být přesnost snížena.
How it works: Obrázek se odešle do modelu „prebuilt-invoice“ služby Azure DI, který rozpoznává pole specifická pro faktury.
📋

Ostatní

Engine: GPT-4o Vision (OpenRouter)

Best for: Snímky obrazovky, webové stránky, e-mailová potvrzení a cokoli nestandardního
Examples: Snímky obrazovky z internetových nákupních košíků, stránky s potvrzením objednávky, e-mailové potvrzení o platbě, nabídky, cenové odhady
Limitations: Žádná konkrétní omezení – zvládne prakticky jakýkoli obrázek s textem.
How it works: Obrázek se odešle do GPT-4o – multimodální umělé inteligence, která obrázek vizuálně analyzuje a extrahuje strukturovaná data. Není nutný žádný samostatný krok OCR. Položky se kategorizují automaticky.

Průvodce rychlým rozhodnutím

Nejste si jisti, který typ vybrat? Postupujte podle tohoto postupu:

1

Jedná se o papírovou účtenku z obchodu nebo restaurace?

→ Choose: Účtenka

2

Jedná se o formální fakturu nebo účtenku (ve formátu PDF nebo v tištěné podobě)?

→ Choose: Faktura

3

Jedná se o snímek obrazovky, webovou stránku, e-mail nebo digitální objednávku?

→ Choose: Ostatní

4

Došlo při zpracování účtenky nebo faktury k chybě?

→ Choose: Jiné (zkuste to znovu s tímto typem)

Běžné scénáře selhání

Zde jsou nejčastější chyby a jak je opravit:

ScenarioYou choseResultShould beWhy
Snímek obrazovky s nákupním košíkem na webových stránkách (Walmart, Amazon, IKEA atd.)Účtenka❌ CHYBA — OCR_FAILEDOstatníModel Azure DI pro rozpoznávání účtenek očekává fotografii papírové účtenky. Snímek obrazovky webové stránky má odlišné rozložení, písma a kontrast, které model nedokáže zpracovat.
Snímek obrazovky s e-mailem potvrzujícím objednávkuÚčtenka❌ CHYBA — OCR_FAILEDOstatníZe stejného důvodu – rozvržení e-mailů nevypadá jako potvrzení o přijetí.
Fotografie počítačového monitoru, na kterém je zobrazen PDF soubor s účtenkouÚčtenka❌ CHYBA — OCR_FAILEDOstatníOdlesky na obrazovce, moaré efekty a artefakty v podobě mřížky pixelů brání modelu OCR ve spolehlivém rozpoznání textu.
Fotografie papírové účtenky z obchodu s potravinamiÚčtenka✅ ÚspěchÚčtenkaStandardní případ použití — funguje podle očekávání.
Faktura ve formátu PDF od dodavateleFaktura✅ ÚspěchFakturaStandardní případ použití – funguje podle očekávání.

⚠️Důležité

Pokud skenování selže s typem Účtenka nebo Faktura, NENAHRÁVEJTE znovu stejný obrázek. Místo toho zkuste použít jiný typ — používá zcela jiný AI engine (GPT-4o vision), který dokáže zpracovat nestandardní dokumenty.

Jak to funguje

Každý typ skenování přesměruje váš obrázek na jiný kanál AI:

Proces zpracování účtenek a faktur (v1)

Route: POST /dokumenty · Engine: Azure Document Intelligence

  1. Ověření souboru a nahrání na S3
  2. Azure DI OCR (prebuilt-receipt nebo prebuilt-invoice)
  3. Analýza odpovědí a jejich převod do strukturovaných dat
  4. Vytvoření výdaje s položkami (kategorizovanými prostřednictvím samostatného volání LLM)

Další potrubí (v2)

Route: POST /v2/documents · Engine: GPT-4o Vision (OpenRouter)

  1. Ověření souboru a nahrání na S3
  2. Optimalizace obrázků (automatické otočení, změna velikosti, zvýšení ostrosti, kontrast)
  3. GPT-4o analyzuje obrázek a vrátí strukturovaný JSON
  4. Vytvoření výdaje s předem zařazenými položkami (bez samostatného kroku LLM)

Tipy a osvědčené postupy

✅ Do

  • Pokud je to možné, vyfoťte si papírovou účtenku – nejlépe to funguje u typu „Účtenka“
  • Použijte možnost „Jiné“ pro jakýkoli snímek obrazovky, webovou stránku, e-mail nebo digitální dokument
  • Pokud se skenování nezdaří, zkuste to znovu s volbou „Ostatní“ a poté soubor nahrajte znovu
  • Pro dosažení nejlepších výsledků zajistěte dobré osvětlení a dokument udržujte v rovné poloze

❌ Don't

  • Nepoužívejte funkci „Receipt“ pro snímky obrazovky webových stránek – nebude to fungovat
  • Nenahrávejte stejný obrázek dvakrát – stačí změnit typ skenu
  • U typu „Účtenka“ nepoužívejte snímky obrazovky (monitor/telefon zobrazující dokument)