← Retour aux réalisations
Immobilier

Extraction automatique des documents de financement immobilier.

Pipeline IA développé pour RealAdvisors Finance, qui extrait automatiquement les informations clés des documents financiers suisses (identité, salaires, prévoyance, fiscalité) avec un score de confiance par champ.

ActivitéFinancement
PaysSuisse
Pipeline extraction · RealAdvisors
45/doc
Champs extraits
150–600ms
Latence
50docs
Parallélisme
Stack technique
Backend
PythonFastAPIUvicorn
IA
Azure Document IntelligenceGPT-4.1-nano
Intégrations
Zoho WorkDriveAzure OpenAI
Sécurité
OAuth2X-API-KeyRGPD
Cadre projet
  • Hébergement datacenter européen
  • Conformité RGPD
  • Aucun stockage intermédiaire des documents
  • Authentification double token (OAuth2 + X-API-Key)
01Le client

Du conseil financier sur le financement immobilier suisse.

RealAdvisors Finance accompagne les particuliers et les professionnels dans le montage de leurs dossiers de financement immobilier en Suisse. Cette activité repose sur l'analyse de nombreux documents administratifs et financiers transmis par les clients : pièces d'identité, certificats de salaire, fiches de prévoyance, déclarations fiscales.

02Le problème

Des dizaines de documents à lire et classer pour chaque dossier.

Pour chaque nouveau dossier client, les conseillers devaient traiter manuellement des dizaines de documents arrivant par différents canaux. Chaque pièce devait être ouverte, identifiée, classée dans la bonne catégorie, renommée selon une convention interne, puis ses informations clés saisies à la main dans le système.

Cette étape de préparation mobilisait un temps considérable avant que l'analyse financière à proprement parler puisse commencer. Sur des documents qui se ressemblent (un certificat de salaire et une attestation de prévoyance ont parfois des formats voisins), les erreurs de classification étaient fréquentes.

Les enjeux identifiés
Temps de préparation des dossiers
Saisie manuelle des champs clés
Risque d'erreur de classification
Hétérogénéité des formats de documents
03La solution

Un pipeline qui lit, classe, extrait et restitue.

Nous avons développé un pipeline d'extraction documentaire qui prend en charge l'ensemble du traitement, depuis la récupération du document jusqu'à la restitution structurée des données. Chaque champ extrait est accompagné d'un score de confiance qui permet au conseiller de savoir où porter son attention.

01 · RÉCUPÉRATION
Collecte
Documents depuis Zoho WorkDrive
02 · CONVERSION
Préparation
Mise au format de traitement standardisé
03 · OCR
Lecture
Azure Document Intelligence extrait le texte
04 · CLASSIFICATION
Identification
Reconnaissance du type parmi 7 catégories
05 · EXTRACTION
Données
45 champs structurés avec score de confiance
06 · RENOMMAGE
Nommage
Convention standardisée appliquée au fichier
07 · RÉSULTAT
Restitution JSON
Le conseiller récupère un fichier structuré exploitable directement dans son outil de travail

Le pipeline traite jusqu'à 50 documents en parallèle par requête, avec une latence comprise entre 150 et 600 millisecondes par document selon sa complexité. L'ensemble s'intègre directement dans l'environnement de travail existant des conseillers.

04La méthodologie

Un système construit par couches, testé sur les vrais documents.

Le projet a démarré par l'analyse des documents réellement traités par les conseillers : repérer les 7 types de documents à couvrir, identifier les 45 champs à extraire, comprendre les variantes de formats rencontrées en pratique.

Le pipeline a ensuite été construit étape par étape, chaque couche validée sur des documents réels avant de passer à la suivante. La classification a été calibrée en premier, puisqu'elle conditionne la qualité de l'extraction qui suit.

05Le résultat

Un pipeline en production, intégré au workflow des conseillers.

Le pipeline est aujourd'hui utilisé pour le traitement des dossiers de financement. Les conseillers ne passent plus leur temps à ouvrir, lire et saisir manuellement le contenu de chaque document. Ils interviennent sur les champs où le score de confiance est plus faible.

L'ensemble est hébergé dans un datacenter européen, en conformité avec le RGPD. L'authentification est sécurisée par double token (OAuth2 + X-API-Key) et aucun document n'est stocké intermédiairement : le traitement se fait entièrement en mémoire.