API OCR pour l’extraction structurée de documents

Extrayez des données fiables et validées à partir de factures, contrats, bons de commande et PDF complexes grâce à une API OCR prête pour la production.

Essayez Koncile
Essayez Koncile
Documentation
Documentation
upload.py
Document splitting...
200 OK
10 000+ utilisateurs nous font confiance
Case study
Case study
Case study
Case study
Case study
Case study
Case study
Case study
Case study
Case study
Type de document

Comment fonctionne l’API OCR ?

Les documents sont envoyés à l’API Koncile dans leur format brut. Grâce à l’interface de configuration, définissez comment les données sont extraites. Envoyez les documents via l’API : ils seront catégorisés, séparés intelligemment, et les données structurées seront renvoyées directement au format JSON vers votre outil.

Votre outil
Documents sources
Données JSON ou CSV
Type de document

Une API OCR pour tous vos types de documents

Factures, fiches de paie ou relevés bancaires : chaque document possède ses propres champs paramétrables et adaptés vos contraintes métier. 

Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Facture

Montants modifiés, édition post-émission et incohérences tarifaires.
Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Fiche de paie

Vérification de la cohérence brut-net et des montants règlementaires
Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Relevé bancaire

Identification des transactions manquantes et soldes incohérents.
Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Déclaration d’impôts

Cross-check reported income, tax withholdings and employer data.
Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Relevé d’assurance

Validate payer identity, reported income and tax consistency.
Fiche de paie (Avalon) avec salaire et cotisations, analysée par Koncile pour vérifier la cohérence brut-net

Facture d’énergie

Detect altered usage data, address mismatches and edited billing periods.
Voir la liste complète
Voir la liste complète
50m
 
documents par mois
97%+
 
précision moyenne
5
 
lignes de code
Koncile vs. Autres

Une API OCR pensée pour les usages métier exigeants

Pensée pour les plateformes SaaS, les ERP et les organisations qui traitent des volumes documentaires importants, avec des exigences fortes en matière de précision et de fiabilité.

Fonctionnalités
Extraction
Données structurées
Configuration
Pipeline documentaire
Technologie OCR + LLM, précis jusqu’à 97%, comprend le contexte, pas juste les caractères
Tables et éléments récurrents extraits nativement
Interface visuelle, vos experts métier définissent les bons champs à extraire
Séparation, classification, renommage intégrés
APIs OCR traditionnelles
Extraction brute, nécessite du post-traitement
JSON plat, structuration à votre charge
Config par code uniquement
Extraction seule, pipeline à construire
Créer un compte gratuitement
Créer un compte gratuitement
Securité

Conçu pour les environnements réglementés

Fondé par un ancien avocat, Koncile a été conçu avec la conformité et la protection des données au cœur de son architecture. Nous sommes audités par un tiers selon les standards SOC 2 et conformes aux exigences RGPD, HDS et HIPAA.

Consulter notre documentation sécurité
Consulter notre documentation sécurité
Illustration d'un document passé au crible par les systèmes de détection de fraude de Koncile
Photos de profil d'experts Koncile, Tristan Thommen, Jules Ratier

Parler avec un expert qui connaît votre secteur.

  • Obtenez l'avis d'un expert externe sur votre cas d'usage spécifique
  • Des benchmarks et résultats issus de centaines de clients de votre secteur
  • Un accompagnement pour activer les fonctionnalités Koncile adaptées à votre workflow
Parler à un expert
Parler à un expert
Gratuit · Sans engagement
Capabilities

Accédez à tous outils de traitement de documents

Gérez la classification, l’extraction, le découpage et les contrôles via une seule API.

Parler à un expert
Parler à un expert
"amount": "4 200 €"
"date": "2026-01-14"
"vendor": "Acme Corp"

Extraction de Données

Des données structurées issues de documents non structurés. Chaque champ, à chaque fois.

Classification de Documents

Finis les tris manuels de documents. Notre API reconnaît instantanément les types de documents.
signature

Reconnaissance Manuscrite

Écriture cursive, imprimée ou mixte, notre modèle déchiffre chaque champ manuscrit avec une grande précision.

Extraction de Tableaux

Tableaux complexes, cellules fusionnées, mises en page à plusieurs colonnes : le tout est extrait proprement au format JSON structuré.
3bF9_ae2d_0081_v3.pdf
Invoice_123_Supplier.pdf

Renommage Intelligent

De scan_001.pdf à Payslip_Martin_Jan2026.pdf. Automatiquement.

Découpage Intelligent

Un seul fichier PDF, douze documents ? Nous les séparons pour vous.

Analyse des métadonnées

Découvrez ce qui se cache derrière le document : auteur, date de création, historique des modifications.
97%
confidence score

Score de Confiance

Chaque champ extrait est accompagné d'un indice de confiance qui vous permet de valider ou de vérifier le résultat.

Détection Falsifications & Fraudes

Identifiez les documents falsifiés et les schémas suspects avant qu'ils ne causent des dommages.
Essayer Koncile maintenant
Essayer Koncile maintenant
INterface

Un éditeur d’extraction simple et puissant

Mettez en place une extraction robuste en quelques heures.Vos experts métier configurent les modèles directement, sans dépendre uniquement des développeurs.

Nos derniers articles

Nos retours terrain sur l'automatisation documentaire

Toutes les ressources
Toutes les ressources
OCR hébreu : ce qui marche sur les documents professionnels
Analyse

OCR hébreu : ce qui marche sur les documents professionnels

La plupart des éditeurs d'OCR annoncent prendre en charge l'hébreu. Beaucoup moins prennent en charge l'hébreu manuscrit, et aucun ne vous dit que 91 % de précision au caractère peut signifier qu'un mot sur deux est faux.

Lire l’article
Détecter un faux relevé de compte : nos 9 méthodes
Analyse

Détecter un faux relevé de compte : nos 9 méthodes

Le relevé de compte est un document particulièrement sujet à la fraude. Chez Koncile, on détecte jusqu'à 1,4 % de relevés modifiés ou altérés sur un jeu de 150 000 relevés. On parle beaucoup des deepfakes générés par l'IA, mais se focaliser uniquement là dessus aujourd'hui serait une erreur.

Lire l’article
Top 10 des logiciels de détection de fraude documentaire en 2026
Comparatif

Top 10 des logiciels de détection de fraude documentaire en 2026

Voici un comparatif des 10 meilleurs logiciels de détection de fraude documentaire et des six contrôles qu'un faux document de 2026 doit encore réussir à passer. Chaque chiffre de précision avancé sur ce marché est souvent autodéclaré et non vérifié de manière indépendante. Pendant ce temps, des services de fraude documentaire vendent, ouvertement et sur le web, des documents conçus spécifiquement pour déjouer des éditeurs de détection.

Lire l’article
Des développeurs créent MacDoc, un outil illégal de création de faux passeports
actualité

Des développeurs créent MacDoc, un outil illégal de création de faux passeports

En février 2026, la justice américaine a fermé OnlyFake, un outil de génération de faux documents largement utilisé. Quelques semaines plus tard, un service identique a rouvert sous le nom de MacDoc. Ses faux parviennent à déjouer les contrôles “KYC” de grandes institutions comme Paypal, Airbnb ou Coinbase.

Lire l’article
Deepfakes documentaires : détecter les faux que vos contrôles laissent passer (2026)
FEATURE

Deepfakes documentaires : détecter les faux que vos contrôles laissent passer (2026)

En 2026, la fraude documentaire a un nouveau visage : le deepfake documentaire, un faux entièrement généré par IA. D'après l'Identity Fraud Index 2026 de Shufti, c'est la catégorie de fraude qui progresse le plus vite, avec une hausse annualisée estimée à près de 3 900 %. Leur particularité : ils sont propres en surface. Voici comment détecter ceux qui passent encore vos contrôles.

Lire l’article
FAQ

Toutes vos questions sur Koncile

Une API OCR (Optical Character Recognition) est un service accessible via une interface de programmation qui convertit automatiquement des images, des PDF ou des documents numérisés en données textuelles structurées et exploitables. Les solutions modernes d'OCR IA vont bien au-delà de la simple reconnaissance de caractères : elles comprennent la structure du document, extraient des champs spécifiques, identifient des tableaux et valident des données, en s'appuyant sur des modèles de deep learning entraînés sur des millions de documents.

L'OCR IA fonctionne en plusieurs étapes : prétraitement de l'image (correction de l'orientation, amélioration de la résolution), détection des zones de texte, reconnaissance des caractères via des réseaux de neurones, extraction structurée des données, puis post-traitement et validation. Contrairement à l'OCR classique basé sur des règles rigides, l'OCR IA s'appuie sur des modèles de type Transformer et des grands modèles de langage (LLM) pour interpréter le contexte du document, tolérer des mises en page complexes et améliorer sa précision en continu.

L'OCR classique se contente de reconnaître des caractères sur une image, sans comprendre leur signification ni leur contexte. Il peine face aux documents manuscrits, aux mises en page complexes, ou aux documents dégradés, avec des taux d'erreur pouvant dépasser 15 %. L'OCR IA, en revanche, comprend la structure sémantique du document, extrait des informations précises (montants, dates, noms, numéros de référence), gère plusieurs langues simultanément et atteint des précisions supérieures à 99 % sur des documents standards. Il peut également détecter des incohérences et signaler des documents suspects.

Avec Koncile, les taux de précision observés sur des documents standards de bonne qualité (factures, bons de commande, fiches de paie, relevés) sont généralement très élevés, grâce à une approche qui combine OCR, structuration intelligente des données et contrôles de cohérence configurables. La précision dépend toutefois de plusieurs facteurs : qualité et résolution du document source, complexité de la mise en page, variabilité des formats fournisseurs, ou présence éventuelle de texte manuscrit. Contrairement aux OCR traditionnels qui se limitent à la reconnaissance de caractères, Koncile applique une logique d’extraction orientée champs et tables, avec scores de confiance et alertes d’incohérence, ce qui permet d’atteindre un niveau de fiabilité nettement supérieur dans des environnements opérationnels exigeants.

Koncile est capable de traiter des documents contenant du texte manuscrit, mais comme pour toute technologie OCR basée sur l’IA, la précision reste généralement inférieure à celle obtenue sur du texte imprimé structuré. Les performances dépendent fortement de la lisibilité de l’écriture, de la qualité du scan et du niveau de standardisation du formulaire. L’approche de Koncile repose sur une extraction orientée champs et contexte : lorsque le manuscrit est intégré dans un document structuré (formulaire, case à remplir, annotation courte), les résultats peuvent être exploitables, avec scores de confiance associés. Pour des usages critiques nécessitant une fiabilité maximale, il est recommandé de combiner l’extraction avec des règles de validation ou une revue humaine sur les champs sensibles.

Une API OCR IA peut traiter une très large gamme de documents : factures fournisseurs et clients, fiches de paie, relevés bancaires, contrats et accords commerciaux, pièces d'identité et passeports, avis d'imposition, attestations administratives, ordonnances médicales, bulletins de livraison, bons de commande, notes de frais, et formulaires divers. Les solutions les plus avancées gèrent aussi bien les documents numérisés, les PDF natifs que les photos prises sur smartphone.

L'API OCR est utilisée dans de nombreux secteurs : la finance et la banque (traitement de relevés, vérification KYC, automatisation des comptes fournisseurs), les ressources humaines (traitement des fiches de paie, vérification des dossiers d'embauche), le juridique (analyse de contrats, archivage de documents), la santé (dossiers patients, ordonnances), la logistique (bons de livraison, étiquettes), les assurances (gestion des sinistres), et les administrations publiques (traitement de formulaires et de courriers). Partout où des documents entrent dans un processus métier, l'OCR IA peut automatiser leur traitement.

L’intégration d’une API OCR dans un système d’information repose généralement sur des appels HTTP REST : vous envoyez le document (PDF ou image) à un endpoint sécurisé, et l’API retourne un JSON structuré contenant les données extraites. Avec Koncile, vous pouvez soit effectuer des appels synchrones pour récupérer immédiatement le résultat, soit configurer des webhooks afin de recevoir automatiquement les données une fois le traitement terminé. Au-delà de l’OCR classique, vous définissez les champs à extraire via des templates configurables, et l’API renvoie des données structurées, des scores de confiance et des alertes de cohérence, prêtes à être injectées dans vos ERP ou outils métiers. Pour les détails techniques, consultez notre documentation API → Voir notre documentation.

La vitesse de traitement d’une API OCR IA dépend de l’architecture et du niveau d’analyse appliqué au document. Avec Koncile, le traitement d’une page s’effectue généralement en quelques secondes, incluant non seulement l’extraction des champs mais aussi la structuration des tables, le calcul des scores de confiance et les contrôles de cohérence configurés. Pour des volumes importants, l’API est conçue pour fonctionner en mode batch avec mise à l’échelle automatique. Pour les workflows nécessitant une intégration fluide, Koncile propose à la fois des appels synchrones et un mode asynchrone avec webhooks, permettant de déclencher automatiquement des actions dès que le traitement est terminé, que ce soit pour une validation en ligne, un workflow ERP ou un pipeline documentaire.

Avec Koncile, les données sont hébergées sur une infrastructure sécurisée avec chiffrement en transit et au repos, et un cadre contractuel clair via un Data Processing Agreement. Les documents traités ne sont pas utilisés pour entraîner des modèles génériques, et les politiques de conservation peuvent être adaptées selon les exigences du client. Pour les environnements sensibles, Koncile s’inscrit dans une démarche de conformité alignée avec les standards reconnus du marché, incluant des exigences de sécurité et d’audit adaptées aux organisations réglementées. Il reste essentiel d’analyser le DPA et les garanties mises en place afin de s’assurer que les données personnelles extraites bénéficient pleinement des protections requises par le RGPD.

Les modèles de tarification varient selon les fournisseurs : tarification à la page, abonnement mensuel avec quota de pages incluses, ou tarification à l'appel API. Certaines plateformes proposent un accès gratuit avec des limites de volume, idéal pour tester la solution. Pour des volumes importants, les tarifs entreprise négociés offrent généralement les coûts unitaires les plus compétitifs. Il convient aussi de comparer le coût total en incluant la précision obtenue : une solution moins chère mais moins précise peut revenir plus cher en corrections manuelles.