Protection des données

Nous apprécions votre confiance et travaillons dur pour garder vos informations en sécurité.

Comment Parsio traite vos données selon ses moteurs d'extraction

Parsio n'est pas un pipeline unique et universel. Vous choisissez le moteur d'extraction adapté à chaque boîte de réception — AI Parser, GPT Parser, Template Parser ou OCR Converter — et chacun suit un parcours de données réellement différent, avec des prestataires différents (ou aucun) impliqués. Nous tenons à être précis sur ce qui se passe dans chaque cas, pour que vous n'ayez pas à nous croire sur parole.

Cette page complète notre page Sécurité générale, avec un examen plus détaillé de la façon dont chaque moteur traite vos données.

Quatre moteurs, quatre parcours de données différents

AI Parser traite votre document à l'aide de modèles d'extraction préentraînés et prêts à l'emploi — aucune configuration, aucun prompt, aucun modèle à créer. GPT Parser envoie le texte du document (ou sa version obtenue par OCR) accompagné d'un prompt que vous rédigez, à un grand modèle de langage, pour les documents dont la mise en page et le libellé varient trop pour des règles fixes. Template Parser compare votre document à un modèle que vous créez en cliquant sur des positions de champs fixes — aucun prestataire d'IA ou de LLM n'est impliqué. OCR Converter extrait le texte brut et les tableaux à partir de scans, PDF et images, sans les interpréter en champs structurés.

AI Parser — modèles préentraînés, aucune configuration

AI Parser utilise les modèles prêts à l'emploi de Microsoft Azure Document Intelligence, chacun spécialisé pour un type de document (factures, reçus, pièces d'identité, cartes de visite, relevés bancaires, et plus encore). Vous n'écrivez pas de prompt et ne créez pas de modèle — le modèle sait déjà quoi rechercher. Aucune instruction en texte libre n'est envoyée nulle part ; seul le document lui-même est traité par le modèle.

GPT Parser — votre prompt, un modèle d'IA

GPT Parser est conçu pour les documents dont la mise en page ou le libellé est trop irrégulier pour des règles fixes. Vous rédigez un prompt en langage naturel décrivant les champs souhaités ; Parsio extrait le texte natif du document (ou effectue d'abord un OCR s'il s'agit d'un scan ou d'une image) et envoie ce texte, ainsi que votre prompt, à OpenAI pour l'extraction. Ces données sont chiffrées en transit et ne sont jamais utilisées pour entraîner les modèles d'OpenAI.

Template Parser — aucune IA, aucun appel à un modèle tiers

Si vous préférez n'impliquer aucun prestataire d'IA, Template Parser est une véritable option sans IA : vous définissez un modèle en marquant les positions des champs sur un document type, et chaque futur document ayant cette mise en page y est comparé à l'aide d'une logique basée sur des règles, qui s'exécute entièrement sur l'infrastructure propre de Parsio. Aucun contenu de document n'est envoyé à OpenAI, Microsoft, Mistral ou à tout autre fournisseur d'IA pour ce moteur.

OCR Converter — extraction de texte et de tableaux

OCR Converter transforme les scans, PDF et images en texte brut et en tableaux à l'aide d'AWS Textract ou de l'OCR de Mistral, selon la configuration. Il n'interprète pas le résultat en champs structurés comme le font les trois autres moteurs — il s'agit d'une étape d'extraction de texte, souvent utilisée comme brique de base en amont de Template Parser ou de votre propre traitement en aval.

Entraînement et conservation des données

  • Nous n'entraînons ni n'affinons jamais aucun modèle avec vos données, et nous ne les vendons jamais. Il s'agit d'un engagement permanent, pas d'une fonctionnalité réservée à certains forfaits.
  • Nos accords avec nos sous-traitants IA — OpenAI, Microsoft et Mistral — leur interdisent d'utiliser les données soumises pour extraction afin d'entraîner leurs modèles.

Chiffrement et transport

Toutes les communications avec nos sous-traitants IA s'effectuent via des connexions chiffrées (HTTPS/TLS 1.2+), la même norme que nous appliquons à toutes les autres parties de notre infrastructure.

Cloisonnement des données

Les documents, modèles et résultats de chaque compte Parsio sont isolés logiquement de ceux de tout autre compte. Le traitement du document d'un client n'expose ni ne mélange jamais les données d'un autre client.

Ce qui reste sous votre contrôle

  • Vous êtes le Responsable du traitement ; Parsio et ses sous-traitants agissent uniquement en tant que Sous-traitants, selon vos instructions.
  • Vous pouvez supprimer n'importe quel document, modèle ou l'intégralité de votre compte à tout moment.
  • Des politiques de conservation configurables vous permettent de supprimer automatiquement les données traitées entre 1 et 180 jours.
  • Vous choisissez le moteur — et donc les prestataires, le cas échéant — qui traite chaque document, boîte de réception par boîte de réception.

Questions fréquentes

Quel moteur utiliser si je ne veux impliquer aucun prestataire d'IA ?

Template Parser. Il s'agit d'une correspondance de positions de champs basée sur des règles, qui s'exécute entièrement sur l'infrastructure propre de Parsio — aucun contenu de document n'est envoyé à OpenAI, Microsoft ou Mistral.

Parsio n'est-il qu'une simple surcouche à ChatGPT ?

Non. Seul GPT Parser appelle OpenAI, et uniquement pour les documents que vous lui destinez. AI Parser utilise les modèles d'extraction prêts à l'emploi de Microsoft, Template Parser n'utilise aucun prestataire d'IA, et OCR Converter utilise AWS Textract ou Mistral uniquement pour l'extraction de texte.

Le fichier brut est-il envoyé aux fournisseurs d'IA, ou seulement le texte extrait ?

Cela dépend du moteur. GPT Parser envoie le texte extrait (natif ou obtenu par OCR) ainsi que votre prompt à OpenAI. AI Parser et OCR Converter traitent le document directement via le modèle de leur fournisseur respectif. Template Parser n'envoie jamais le contenu d'un document à un prestataire d'IA.

Utilisez-vous des embeddings ou une recherche vectorielle pour les documents longs ?

Non. Parsio n'utilise actuellement pas d'embeddings ni de recherche vectorielle — GPT Parser envoie directement le texte extrait et votre prompt.

Les employés de Parsio peuvent-ils lire mes documents ?

L'accès aux données clients est limité selon le principe du moindre privilège, restreint à ce qui est nécessaire pour le support ou le dépannage, et fait l'objet d'audits réguliers. Consultez notre page Sécurité pour plus de détails.

Mes données servent-elles à améliorer les modèles de Parsio ou de ses fournisseurs d'IA ?

Non. Nous n'entraînons pas nos modèles avec vos données, et nos contrats avec nos sous-traitants IA — OpenAI, Microsoft et Mistral — le leur interdisent également.

Que se passe-t-il si je supprime un document ?

Il est retiré immédiatement des systèmes actifs, puis des sauvegardes et des journaux dans le délai de conservation que vous avez configuré (1 à 180 jours).

Des questions ?

Si vous avez besoin de plus de détails pour votre propre revue de sécurité ou de vos fournisseurs, contactez-nous à [email protected].