Intelligence Documentaire Gouvernementale
Extraction automatisée de 167 champs par document avec >95% de précision en moins de 60 secondes
167 champs par document
>95% de précision

Contexte
Une agence gouvernementale d'État s'appuyait sur la saisie manuelle de données pour des formulaires numérisés de 4 pages - 15 à 20 minutes par document avec des taux d'erreur de 2 à 5 % sur 167 champs.
Contrainte
Les documents contenaient des PII nécessitant une protection stricte. La qualité de numérisation variait (inclinées, mauvaise impression, manuscrites). La conformité réglementaire était obligatoire.
Intervention
Construit un système OCR multi-moteurs en Rust avec fusion par consensus, rédaction PII basée sur les coordonnées à 65 zones et une API de production Axum - avec 663 tests.
Résultat
167 champs extraits à >95% de précision en moins de 60 secondes (16x plus rapide), conformité PII totale, 663 tests automatisés - livré en 15 semaines.
Architecture
Du formulaire numérisé aux données structurées et validées
Prétraitement des Documents
Extraction Multi-Moteurs
Protection des PII
API de Production
Stack Technique
Langage Principal
Rust
Cloud
AWS (ECS Fargate, Textract, S3, Secrets Manager)
Framework API
Axum
Traitement de Documents
Traitement TIFF/image, OCR multi-moteurs
Déploiement
Docker, ECS Fargate
Tests
663 tests automatisés
Résultats
Vous Préparez un Mandat Comparable ?
Un appel découverte direct pour parler du problème, des contraintes et du chemin le plus crédible pour avancer.
Nous répondons sous 4 heures pendant les heures ouvrables
