C'EST QUOI ?
Receipt OCR est un moteur OCR Python spécialisé dans le traitement des reçus. Il combine deux approches : Tesseract pour l'extraction de texte brut, et des LLM (OpenAI, Google Gemini, Groq) pour transformer une image de reçu en données structurées exploitables. L'objectif : passer d'une photo de ticket à un JSON propre, prêt à être ingéré.
POURQUOI C'EST INTÉRESSANT ?
- Double moteur : Tesseract pour le texte brut, module LLM pour l'extraction structurée. On choisit selon le besoin et le budget.
- Multi-providers LLM : Support d'OpenAI, Google Gemini et Groq. Pas de lock-in sur un seul fournisseur d'IA.
- Schéma JSON personnalisable : On définit le schéma d'extraction qu'on veut (marchand, date, lignes, total…) et le LLM remplit la structure.
- CLI + API FastAPI : Utilisable en ligne de commande pour du one-shot, ou via des REST APIs prêtes pour la prod pour les deux modules.
- Dockerisé : Déploiement conteneurisé fourni, ce qui simplifie la mise en service côté backend.
CAS D'USAGE
- Automatiser la saisie de notes de frais à partir de photos de tickets
- Extraire les lignes d'achat de reçus pour les pousser dans un outil de compta
- Construire un microservice d'extraction de reçus derrière une API REST
- Numériser en masse un historique de tickets papier en données structurées
