Receipt OCR

Receipt OCR

C'EST QUOI ?

Receipt OCR est un moteur OCR Python spécialisé dans le traitement des reçus. Il combine deux approches : Tesseract pour l'extraction de texte brut, et des LLM (OpenAI, Google Gemini, Groq) pour transformer une image de reçu en données structurées exploitables. L'objectif : passer d'une photo de ticket à un JSON propre, prêt à être ingéré.

POURQUOI C'EST INTÉRESSANT ?

  • Double moteur : Tesseract pour le texte brut, module LLM pour l'extraction structurée. On choisit selon le besoin et le budget.
  • Multi-providers LLM : Support d'OpenAI, Google Gemini et Groq. Pas de lock-in sur un seul fournisseur d'IA.
  • Schéma JSON personnalisable : On définit le schéma d'extraction qu'on veut (marchand, date, lignes, total…) et le LLM remplit la structure.
  • CLI + API FastAPI : Utilisable en ligne de commande pour du one-shot, ou via des REST APIs prêtes pour la prod pour les deux modules.
  • Dockerisé : Déploiement conteneurisé fourni, ce qui simplifie la mise en service côté backend.

CAS D'USAGE

  • Automatiser la saisie de notes de frais à partir de photos de tickets
  • Extraire les lignes d'achat de reçus pour les pousser dans un outil de compta
  • Construire un microservice d'extraction de reçus derrière une API REST
  • Numériser en masse un historique de tickets papier en données structurées