Documentation

Tout ce qu'il vous faut pour utiliser Docurensic

De votre première analyse aux moteurs forensiques qui la sous-tendent, aux outils autonomes, à l'automatisation qui se déclenche après chaque verdict, à l'API complète, aux cas d'usage concrets et à la façon dont votre compte et vos données sont traités. Choisissez un onglet — chaque page reflète le code réellement en production, rien n'est de l'ordre de l'intention.

COMMENCER ICI

Qu'est-ce que Docurensic

Docurensic est un service de forensique documentaire. Téléversez un PDF, un fichier Office, un e-mail, une image ou une archive : le service inspecte le fichier comme le ferait un examinateur de documents — métadonnées, polices, historique des révisions, images intégrées, signatures et les chiffres figurant sur la page — puis renvoie un rapport en langage clair, assorti d'un score de preuve forensique et d'une action opérationnelle explicite. Tout fonctionne depuis votre navigateur — sans installation ni extension ; les documents sont analysés côté serveur dans un traitement isolé.

Ce qu'il fait bien

Détecter les factures et relevés bancaires modifiés, les certificats et pièces d'identité falsifiés, les messages de phishing / compromission de messagerie professionnelle (BEC), les logiciels malveillants dissimulés dans des macros Office et les textes ou images générés par IA — la fraude du quotidien qui arrive sous forme de fichier.

Ce qu'il ne prétend pas

Docurensic fait ressortir les signaux d’alerte forensiques ; il ne certifie pas qu’un document est authentique. Un faible score signifie qu’aucune preuve de manipulation n’a été trouvée, et non que l’authenticité est garantie. Les constats et les actions appuient une décision humaine ; ils ne prouvent pas l’authenticité.

À qui s'adresse-t-il

Les courtiers en fret qui vérifient des confirmations de tarif, les prêteurs qui examinent bulletins de salaire et factures, les assureurs qui contrôlent des attestations, les équipes RH qui intègrent de nouveaux collaborateurs avec des formulaires W-2/W-9 et quiconque reçoit des documents qu'il ne peut pas accepter sans vérification.

01

Lancez votre première analyse

Trois étapes. Les fichiers simples se terminent souvent en quelques secondes ; les fichiers volumineux ou complexes peuvent prendre plus de temps. Tout se passe depuis la page Documents — le premier élément de la barre latérale.

1

Importez un document

Faites glisser un fichier dans la zone de dépôt, ou cliquez sur Parcourir les fichiers. Docurensic accepte les fichiers PDF, Word / Excel / PowerPoint (y compris les formats anciens et compatibles macros), les e-mails .eml / .msg, les images, les fichiers CSV/TSV, et les archives .zip / .7z / .rar, jusqu'à 150 Mo.

Le fichier est traité temporairement dans un environnement isolé, puis supprimé après l’analyse. En mode stockage, l’original analysé est automatiquement chiffré dans le coffre-fort de fichiers lorsque le stockage du coffre est disponible et que le quota le permet. Le mode sans stockage ne crée aucune nouvelle copie source ; un fichier déjà présent dans le coffre ou un stockage connecté y demeure. Son historique allégé conserve le nom du fichier et les métadonnées d’analyse de base, le verdict forensique, l’action de décision, les constats, le type de document sûr et l’empreinte de vérification.

2

Exécuter une seule analyse cohérente

Il n’y a aucun sélecteur de profondeur d’analyse. Les moteurs forensiques applicables s’exécutent toujours. Lorsque le document contient un texte extractible ou OCR borné, l’examen indépendant par IA s’exécute dans le même flux et reste consultatif.

3

Lisez le rapport

Vous obtenez une action globale (Accepter, Vérifier ou Rejeter), un résultat d’authenticité forensique distinct et un score de preuve de 0 à 100, un niveau de menace distinct, ainsi que chaque constat classé par gravité et expliqué en langage clair. Cliquez sur Rapport détaillé pour voir l’analyse complète, ou retrouvez-le à tout moment dans Historique des analyses.

02

Analyse par IA lorsque le texte du document est disponible

Chaque analyse exécute les moteurs forensiques applicables. Lorsqu’un texte natif ou OCR borné est disponible, elle exécute aussi un examen indépendant alimenté par l’IA — aucun niveau de profondeur ou palier d’IA n’est à choisir. Un document sans texte indique que l’examen était indisponible au lieu d’appeler un modèle avec une entrée vide. L’IA ne modifie jamais le score ni le verdict forensique.

Appel 1 · classification

Type de document

Un modèle d'IA classe le texte extrait dans l'un des 33 types de documents canoniques (facture, relevé bancaire, COI, acte, …), avec une réponse conforme à un schéma imposé — ou Indéfini si rien ne correspond.

Appel 2 · graphe de preuves

Vérifications adaptées au type + entités

Le modèle n'exécute que les vérifications d'intégrité applicables au type identifié — cohérence arithmétique financière, dates et validité, cohérence partie/émetteur, cohérence d'ensemble — et renvoie un motif en langage clair par vérification, ses propres signaux d'alerte et sa propre lecture de la fraude, ainsi que des entités structurées (e-mails, téléphones, identifiants, comptes, adresses, domaines, noms) pour le rapprochement des dossiers.

Confidentialité

Uniquement le texte, jamais le fichier

Les deux appels reçoivent le texte extrait, les métadonnées et les signaux des moteurs — le fichier document lui-même n'est jamais transmis au modèle.

L'IA est toujours consultative. Son résultat figure dans une section distincte du rapport (type de document, score de fraude IA de 0 à 100, résumé en deux phrases et signaux d'alerte) et n'est jamais intégré aux scores forensiques ni au verdict. Si l'appel à l'IA échoue, l'analyse forensique reste valable — le rapport comporte alors simplement un ai_analysis.error. Chaque appel à l'IA est journalisé dans votre page Utilisation avec le nombre de tokens et le coût.
03

Lire votre rapport

Le rapport commence par une seule action opérationnelle tout en maintenant visiblement séparés l’authenticité forensique, la menace du fichier, la politique du compte et l’IA consultative.

Action globale et preuves forensiques

L’action principale est Accepter, Vérifier ou Rejeter. Juste en dessous, le verdict d’authenticité forensique et le score de preuve de 0 à 100 expliquent l’évaluation de l’altération. Une menace ou une politique de compte peut rendre l’action plus stricte sans réécrire ces preuves.

ACCEPTER REVIEW REJECT

Niveau de menace

Un axe distinct pour les logiciels malveillants, le phishing et le contenu actif. Un document propre, d'apparence authentique, peut tout de même présenter un niveau de menace élevé s'il dissimule, par exemple, un lien à exécution automatique ou une charge utile dans une macro.

Identification du document

Un bloc unique qui réconcilie le vote de type de chaque moteur (classificateur par mots-clés, moteur de reconnaissance, moteur champs et type) en un seul type de document principal, avec le niveau de confiance de chaque moteur affiché côte à côte.

Préoccupations et preuves classées

Les constats importants sont regroupés en préoccupations avec leur gravité, leur emplacement, des preuves en langage clair, un contexte bénin et une prochaine étape. Les signaux de niveau inférieur restent accessibles en détail, jamais sous la forme d’un simple score.

Analyse des champs

Les champs métier typés extraits par le moteur — numéros de facture/bon de commande, montants, dates, IBAN, numéros MC/DOT — chacun marqué validé ou non validé (par exemple, une somme de contrôle IBAN incorrecte).

Revue IA

Lorsque le texte du document est disponible, l’analyse indépendante de Docurensic AI — type de document, raisons par contrôle, signaux d’alerte et son propre score consultatif — apparaît dans sa propre section avec un pied de page sur les jetons et le coût, séparée visuellement et informatiquement du verdict forensique. Un rapport sans texte indique que l’analyse était indisponible.

04

Se repérer dans l'application

La barre latérale regroupe tout sous Espace de travail, Analyse et Organisation.

Documents

Importez de nouveaux fichiers et parcourez tout votre historique d'analyses. Votre point de départ.

Dossiers

Regroupez des documents liés (un dossier de candidature, les documents d'une expédition) afin de faciliter le suivi des liens entre eux.

Analyses

Le volume, la répartition des verdicts et les signaux les plus fréquents dans vos analyses.

File de vérification

Documents dont l’action finale est Vérifier ou Rejeter et qui nécessitent encore une décision humaine — approuver, rejeter ou transmettre.

Coffre de fichiers

Votre stockage de documents chiffré — les originaux d'analyse conservés et les fichiers que vous importez directement, organisés en dossiers, que vous seul pouvez ouvrir.

Outils

Le hub de tous les outils autonomes : analyseur d'URL, analyseur d'entreprise, laboratoire de métadonnées, analyse forensique d'images, vérification de signatures, comparaison, PDF Studio et l'atelier X-Ray Engine.

Workflows

Automatisez la suite d'une analyse — « quand un document obtient un score élevé, alerter le canal fraude et le mettre en quarantaine ». Construit visuellement, sans code.

Connexions

Tout ce à quoi Docurensic est relié : dossiers Dropbox/Drive surveillés, Slack, Teams, Discord, Telegram, Google Chat, listes d'e-mails, plateformes d'automatisation et vos propres webhooks.

Notifications

Alertes dans l'application provenant de vos workflows, de vos dossiers et du système.

Paramètres

Mode de stockage, sensibilité, préréglage sectoriel, contrôles de détection, options de fonctionnalités, accès API, export des données et suppression du compte. Détaillé dans Compte et confidentialité.

05

Automatisez ce qui vient ensuite

Docurensic ne s'arrête pas au verdict — vous décidez une fois de ce qui vient ensuite, et cela s'applique ensuite à chaque document, sans code. Dans le générateur visuel Workflows, vous écrivez des règles sous la forme quand un événement survient sur un document, si il correspond à vos conditions, alors exécuter des étapes — alerter un canal, étiqueter, mettre en quarantaine, ouvrir un dossier, lancer un outil ou passer la main à un autre workflow. Enregistrez une fois vos canaux Slack, listes d'e-mails, dossiers cloud et webhooks dans Connections et réutilisez-les par leur nom, et laissez les nouveaux fichiers d'un dossier Dropbox ou Drive surveillé s'analyser d'eux-mêmes.

Le catalogue complet des déclencheurs, conditions et actions — avec branchements, planifications, formules et connecteurs — se trouve dans l'onglet Automatisation.

La référence technique complète : ce que chaque moteur vérifie, comment l’authenticité forensique, la menace du fichier et la politique du compte produisent une seule action opérationnelle, ainsi que le catalogue à jour de tous les signaux que les moteurs peuvent émettre. Aller à une section :

01

Ce que vérifie Docurensic

Plusieurs catégories forensiques, des dizaines de signaux individuels. La plupart des falsifications laissent des traces dans plus d'une seule.

Structure et métadonnées

Compte les marqueurs de révision, vérifie les contradictions dans le DocInfo. La paire /ID du trailer révèle des réenregistrements que le document prétend n'avoir jamais subis.

Nombre de %%EOFPaire /IDVérification ModDate

Empreinte des polices

Chaque police intégrée porte une étiquette de sous-ensemble unique. Des préfixes différents pour une même police de base sur une page signalent un contenu remanié par un logiciel d'édition.

Étiquettes de sous-ensembleDétection de l'éditeurCatalogue des polices

Historique des révisions

Le PDF stocke les modifications en ajoutant du nouveau contenu. Plusieurs marqueurs %%EOF signifient que des révisions antérieures existent et peuvent être récupérées — un signe clair de modification.

Mises à jour incrémentiellesRévisions antérieures

Analyse du contenu

Extrait tout le texte et vérifie son extractibilité — les documents numérisés composés uniquement d'images sont signalés comme nécessitant une vérification OCR distincte.

Extraction du texteDétection de numérisation

Empreinte de l'éditeur

Les éditeurs PDF connus — Acrobat, Photoshop, GIMP, iText, PDF-XChange — laissent des traces dans les champs producteur et créateur qui signalent une modification postérieure à la création.

Champ producteurChamp créateurDétection de l'outil

Notation du risque

Les signaux forensiques sont pondérés selon leur gravité, plafonnés par catégorie, puis soumis à des règles pour produire un verdict d’authenticité. L’action opérationnelle finale tient compte séparément de la menace du fichier et de la politique explicite du compte.

Score de preuve de 0 à 100Axes séparésUne seule action
02

Six moteurs, un seul rapport

Chaque téléversement est dirigé selon son type vers les moteurs qui savent l’analyser. Tous produisent la même structure de rapport normalisée. Les constats restent séparés en informations d’authenticité, de menace, de contenu généré par IA, d’identité ou de politique de compte avant qu’un contrat de décision unique produise l’action opérationnelle. Chaque moteur est protégé à l’importation et isolé en cas d’échec — une dépendance manquante ou une erreur d’exécution dégrade uniquement ce moteur, jamais toute l’analyse.

pdf_forensics

Le moteur PDF principal — intégrité structurelle, métadonnées, polices, analyse forensique des images matricielles, signatures, formulaires, contenu intégré et vérifications sémantiques des champs.

axe · falsification + menace

multi-format

Office (OOXML + formats hérités + compatibles macros), e-mail, archives, fraude sur tableurs/données tabulaires et validation croisée code-barres/MRZ.

axe · falsification

ai_text / ai_image

Détection stylométrique de texte rédigé par IA et détection d'images synthétiques — l'axe de fiabilité du contenu, exécuté sur les types de fichiers concernés et exposé directement via l'API.

axe · ai_content

reconnaissance

Reconnaissance de documents par ML multi-source et fusion de type (magika, libmagic, mise en page, texte) — l'axe d'identité. Les sources légères s'exécutent directement à chaque analyse.

axe · identité

url_reputation

Analyse passive de la réputation des URL / phishing et détection de typosquatting sur tous les liens contenus dans un document ou un e-mail.

axe · menace

intelligence

Intelligence inter-documents superposée à chaque analyse — vélocité des soumissions, détection de quasi-doublons, détection de réseaux de fraude par liens d'entités, et le registre de modèles.

Adossé à Supabase
Import Orienté vers les moteurs Signaux séparés selon leur autorité Décision + dossier de cas créés Rapport enregistré (fichier supprimé) Action + preuves retournées
Un moteur de reconnaissance multi-source plus poussé est disponible à la demande via POST /api/recognize — il fusionne jusqu'à onze sources ML / forensiques optionnelles (magika, DiT, docling, OCR, un modèle vision-langage, signatures pyHanko) pour obtenir un second avis sur le type de document et son authenticité. Voir l'onglet API.
03

Moteur forensique PDF

S'exécute sur chaque fichier .pdf importé. Chaque vérification est isolée — une vérification en échec est enregistrée comme une erreur et ne fait jamais échouer la requête.

Métadonnées et chronologie

Producer/Creator/Author/Subject/Keywords, clés personnalisées du dictionnaire Info, cohérence XMP vs DocInfo, logique CreationDate/ModDate (adaptée au type de document — la date d'expiration future d'un certificat n'est pas traitée comme une antidate).

Intégrité structurelle

Détection des mises à jour incrémentielles, comptage des objets/flux/object-streams, détection de réparation de la table xref (le parseur reconstruisant silencieusement une table endommagée), cohérence du /ID du trailer, linéarisation.

Analyse des polices et du texte

Inventaire des polices, intégrée vs sous-ensemble, réaffectation de glyphes de chiffres (une police qui dessine visuellement un chiffre mais en déclare un autre dans sa table ToUnicode), anomalies Unicode — caractères de contrôle d'inversion du sens d'écriture, caractères de largeur nulle, homoglyphes de chiffres non latins.

Analyse forensique des images matricielles

Error-Level Analysis, détection de copier-déplacer/clonage, JPEG-ghost/double compression, analyse des tables de quantification, cohérence du DPI, extraction EXIF/GPS/logiciel d'édition des images intégrées.

Historique des révisions

Récupération et comparaison des révisions antérieures, détection de numérisation synthétique (un PDF nativement numérique réexporté en image pour contourner les vérifications matricielles).

Signatures numériques

Présence, validité cryptographique, couverture de la plage d'octets, détection d'attaque shadow, signatures de certification vs. d'approbation.

Formulaires

Parcours complet de l'arborescence des champs AcroForm — un champ masqué à la visionneuse qui porte tout de même une valeur, ou un texte de remplacement de modèle resté non renseigné.

Contenu intégré

Les octets des pièces jointes sont extraits (pas seulement listés), avec détection de déguisement magic-byte vs extension, et une réanalyse récursive via le moteur multi-format pour tout ce qu'il sait traiter.

URL et liens

Chaque URL est classée comme visible (annotation Link ou texte imprimé) ou cachée (accessible uniquement via une action OpenAction/intégrée — jamais montrée au lecteur), avec en plus la détection d'adresses IP littérales, de punycode et de raccourcisseurs de liens.

Logique sémantique et des champs

Arithmétique croisée entre champs, validation de somme de contrôle IBAN/numéro de routage/VIN, extraction d'entités (e-mails, téléphones, numéros MC/DOT/police d'assurance), correspondance pHash de modèles avec un registre.

Repli OCR

Les pages composées uniquement d'images passent par l'OCR afin que les vérifications de contenu/logique s'appliquent aussi aux documents numérisés, pas seulement à ceux nativement numériques.

Filigrane et modèle

Présence du filigrane attendu selon le type de document, et correspondance par hachage perceptuel de la première page avec les modèles d'émetteurs enregistrés.

04

Moteur multi-format

Traite tout ce qui n'est pas un PDF : documents Office (y compris les variantes compatibles macros), e-mails, archives, tableurs et images autonomes.

Office (OOXML + formats hérités)

.docx/.xlsx/.pptx/.docm/.xlsm/.pptm et les formats hérités .doc/.xls/.ppt — propriétés core/app, récupération du suivi des modifications, contenu masqué, détection de macros VBA, liens de données externes, réconciliation formule vs valeur en cache.

E-mail (.eml/.msg)

Analyse des en-têtes SPF/DKIM/DMARC, incohérence From/Reply-To/Return-Path (le schéma de redirection propre au BEC — sévérité élevée uniquement quand le Reply-To pointe vers une messagerie web gratuite), usurpation de marque par nom d'affichage, détection de domaines en punycode, récursion sur les pièces jointes.

Archives

Listage des entrées zip/7z/rar avec une protection basée sur le taux de compression contre les zip bombs.

Fraude sur tableurs et CSV

Loi de Benford (test du chi carré sur un échantillon réel), réconciliation des soldes, regroupement de doublons/nombres ronds, détection de trous dans les séquences, transactions à date future.

Code-barres / QR / MRZ

Décodage 1D/2D, validation de la clé de contrôle MRZ des passeports TD3 et réconciliation entre le contenu du QR code et le texte imprimé — un faussaire qui modifie le numéro imprimé mais oublie le code est détecté ici.

Images autonomes

Passe par le détecteur d'images IA, le décodage code-barres/MRZ, et la réconciliation QR basée sur l'OCR.

Discipline de notation : comme pour le moteur PDF, les verdicts ici sont conditionnés par un signal déterminant, une corroboration entre deux catégories ou plus, ou un score calibré — jamais par un simple signal bruité de gravité moyenne.
05

Moteur IA / fiabilité du contenu

Un détecteur distinct pour le contenu synthétique et les liens dangereux, exécuté automatiquement sur les images importées et disponible directement pour l'analyse de texte/URL.

Détection d'images IA

ELA, résidu de bruit et artefacts dans le domaine fréquentiel, ainsi que les signatures de métadonnées de générateurs connus.

Indicateurs de texte IA

Notation stylométrique sur sept signaux pondérés — variabilité de la longueur des phrases (burstiness), densité de marqueurs de tournures IA, amorces par mots de transition, diversité des amorces, répétition de n-grammes, style de ponctuation et taux de contractions — plus un passage optionnel de perplexité + burstiness par modèle de langage. Chaque signal est rapporté individuellement afin qu'un verdict reste explicable, et non une boîte noire. Délibérément prudent — à visée informative, jamais une accusation autonome, en raison de taux de faux positifs bien documentés sur les écrits de registre formel et ceux rédigés par des locuteurs non natifs de l'anglais.

Réputation d'URL

Heuristiques d'ancienneté de domaine, détection de typosquatting/imitation de marque et un point d'intégration pour une vérification externe Safe Browsing — appliqués à chaque URL détectée par une analyse ou par l'analyseur d'e-mails.

L'analyse de texte est exposée directement — POST /api/analyze/text — pour un usage indépendant de tout import de fichier (voir l'onglet API) ; pour une analyse d'URL autonome, utilisez la page Analyseur d'URL.
06

Moteur de reconnaissance et de fusion

Un second avis sur le type de document et son authenticité, fusionné à partir de jusqu'à onze sources indépendantes — chacune optionnelle, chacune ignorée proprement si sa dépendance n'est pas installée. Un verdict de type est conditionné par corroboration : deux sources en accord produisent une confiance élevée ; une seule source est plafonnée et marquée uncorroborated_type.

Identification du format

Identification du format par ML (magika), recoupée avec libmagic — un désaccord entre les deux, ou avec l'extension de fichier déclarée, constitue un signal de déguisement.

Porte d'entrée forensique PDF

PyMuPDF restitue chaque page nativement, détermine si le document est nativement numérique ou numérisé, et extrait les métadonnées de provenance ainsi que les données d'intégration des polices en une seule passe partagée par toutes les autres sources.

Classification du type

Un modèle de type de document à 16 classes (DiT), complété par une lecture vision-langage (Qwen2.5-VL) pour l'extraction libre du type, du sous-type et des champs clés.

Mise en page et tableaux

Ordre de lecture, régions de mise en page et structure des tableaux via docling, avec deepdoctection comme corroborateur indépendant en pipeline complet.

OCR conditionnel

S'exécute par défaut uniquement sur les pages composées uniquement d'images ; en mode always, il alimente aussi une comparaison de falsification texte intégré vs OCR — une discordance signifie que la page visible ne correspond pas au flux de contenu.

Intégrité des signatures

pyHanko rapporte le nombre de signatures PDF intégrées, leur couverture (fichier entier vs. partielle) et leur intégrité cryptographique.

Exposé en tant que POST /api/recognize. Les sources vision-langage et mise en page sont les plus lourdes ; transmettez disable=vlm (ou toute liste de sources séparées par des virgules) pour les ignorer lors d'appels sensibles à la latence.
07

Moteur champs et type

S'exécute au sein de chaque analyse. Extrait des champs métier typés, ne retient un type de document que lorsque des preuves indépendantes le corroborent (refusant de deviner dans le cas contraire) et suit dans le temps la dérive terminologique propre à chaque fournisseur. Son résultat alimente les blocs d'identification du document et d'analyse des champs du rapport.

Extraction des champs

Un large éventail de types de champs — numéros de facture/bon de commande, montants, dates, IBAN, numéros de routage, numéros MC/DOT, VIN, numéros de police d'assurance, adresses et bien plus — chacun avec un indicateur validé / non validé.

Classification du type

Conditionné par corroboration : un document dont les signaux de terminologie/champs/structure ne concordent pas est signalé comme unclassified plutôt que de forcer une estimation peu fiable. Les documents composites (plusieurs types dans un même fichier) sont signalés comme tels.

Identification à trois voies

Réconcilie son propre vote de type avec ceux du classificateur par mots-clés et du moteur de reconnaissance en un seul type principal par rapport, avec le niveau de confiance de chaque moteur affiché côte à côte.

Référence de dérive fournisseur

Référence de fréquence des termes par fournisseur, propre à chaque utilisateur et hébergée dans Supabase ; un document auquel il manque des termes que l'historique de ce fournisseur inclut toujours, ou qui comporte des termes qu'il n'a jamais utilisés, est signalé comme une dérive dès que l'historique est suffisant.

Cohérence des champs inter-documents

Un champ facture/bon de commande/montant partagé dont la valeur diffère entre deux documents liés est un indice central de document altéré ou de double courtage.

08

Renseignement inter-documents

S'exécute après chaque analyse, en comparant le document actuel aux soumissions précédentes — volontairement non limité à un seul compte, car les réseaux de fraude s'étendent sur plusieurs clients.

Vélocité des soumissions

Le même fichier (par SHA-256) soumis à plusieurs reprises dans une fenêtre de temps courte.

Détection de quasi-doublons

La comparaison SimHash détecte une version légèrement modifiée d'un document, différente au niveau des octets mais structurellement identique.

Détection de liens d'entités / réseaux de fraude

Numéros MC/DOT/police/IBAN/VIN/routage, e-mails ou téléphones partagés entre des documents autrement sans rapport.

Registre de modèles

Mises en page d'émetteurs reconnues comme fiables (hachage perceptuel de la page 1) auxquelles la correspondance de modèles PDF se compare.

File de vérification

Rapports signalés (à vérifier/rejeté) en attente d'une décision humaine — approuver, rejeter ou escalader.

09

Couverture des formats

Les formats acceptés par les moteurs — acheminés automatiquement selon l'extension et les magic bytes, de sorte qu'un fichier déguisé soit analysé pour ce qu'il est réellement, et non pour ce qu'il prétend être.

PDF DOCX/XLSX/PPTX Macros .docm/.xlsm/.pptm Formats hérités .doc/.xls/.ppt E-mail .eml/.msg Images + EXIF HEIC/HEIF CSV / TSV Codes-barres / QR / MRZ Archives zip/7z/rar
10

Authenticité forensique, menace et action finale

Les preuves d’authenticité, le danger du fichier et la politique de traitement du compte restent séparés ; ainsi, un courriel d’hameçonnage, une facture falsifiée et une règle d’acheminement ne sont jamais confondus dans un même score.

ACCEPTER REVIEW REJECT

Axe d’authenticité

Preuves structurelles, de métadonnées, de contenu et de champs — ce document est-il bien ce qu’il prétend être et a-t-il été altéré ?

Axe de menace

Risque de logiciel malveillant, d’hameçonnage et de contenu actif — l’ouverture de ce document ou une action fondée sur celui-ci pourrait-elle vous nuire ?

Politique du compte

Les règles de l’entreprise, du type de document et de traitement personnalisé peuvent exiger une vérification ou un rejet sans modifier le score d’authenticité ni prétendre à une altération.

Verrou de corroboration

Le verdict forensique ne s’aggrave qu’en présence d’un signal décisif sélectionné, d’une corroboration entre au moins deux catégories distinctes ou d’un score étalonné — jamais à cause d’un seul constat bruyant de gravité moyenne.

Plafonds par catégorie

La contribution de chaque catégorie de signaux est plafonnée avant addition, afin qu'un domaine bruité (par exemple dix remarques de sévérité faible sur les polices) ne puisse pas dépasser en score un problème véritablement transversal.

11

Catalogue des vérifications

Chaque catégorie de signaux que les moteurs peuvent déclencher, avec le nombre de contrôles distincts du code source pouvant la déclencher — calculé en direct à partir du code en cours d'exécution (GET /api/checks), et non un chiffre maintenu manuellement qui pourrait dériver.

Chargement…

OUTILS

Outils autonomes

Au-delà de l'analyse complète, Docurensic propose des outils ciblés, fichier par fichier — de petits laboratoires forensiques et un atelier PDF que vous pointez sur un document, un lien ou une entreprise. Ils s'ouvrent tous depuis la page Outils (barre latérale → Analyse), et la plupart peuvent récupérer un fichier directement depuis votre File Vault, ce qui vous évite de le téléverser à nouveau. Accédez à l'un d'eux :

Tous ces outils sont consultatifs. Ils servent à l'investigation et à la manipulation quotidienne des documents — aucun d'eux ne modifie jamais le score d'authenticité ni le verdict d'une analyse forensique et, sauf si vous enregistrez explicitement quelque chose dans le vault, rien de ce que vous y passez n'est conservé.

Analyseur d'URL

Un lien, deux perspectives : est-il dangereux, et le site qui se cache derrière est-il bien construit ?

Collez une URL ou un simple domaine et Docurensic construit une image partagée du site à partir de sondes réelles et en direct, puis la lit de deux façons : un verdict de sécurité soumis à corroboration et une fiche de qualité notée de A à F sur six dimensions. Il ne condamne jamais sur un seul indice — un site n'est signalé que lorsque les preuves concordent sur au moins deux niveaux indépendants et trois catégories. Utilisez-le avant de faire confiance à un lien dans un e-mail, une facture ou un message — un portail fournisseur, une page de paiement, un lien « vérifiez votre compte » ou un domaine de prestataire que vous n'avez jamais côtoyé.

  • Vérifications lexicales du lien — schéma non sécurisé, hôtes en adresse IP brute, astuces d'autorité avec « @ », domaines typosquattés ou imitant une marque, noms en punycode/homographes, mots-clés suspects, raccourcisseurs d'URL dépliés et paramètres de redirection ouverte.
  • Enregistrement et infrastructure — âge du domaine (un domaine récemment enregistré est un fort indice de fraude), bureau d'enregistrement et verrous, enregistrements DNS et de messagerie (SPF/DMARC/CAA), et une poignée de main de certificat TLS en direct.
  • Contenu de la page d'accueil — formulaires de connexion sur des domaines flambant neufs, formulaires d'identifiants qui envoient les données ailleurs, champs masqués, scripts obscurcis, iframes invisibles et titres revendiquant une marque sur des domaines sans rapport.
  • Fiche de qualité — Configuration/Sécurité, SSL/TLS, Optimisation, SEO, Pile technique et Ancienneté/Confiance, chacune notée, avec une liste hiérarchisée « à corriger en priorité » et une empreinte de la pile technique (avec signalement des technologies en fin de vie).

Bon à savoir : une vérification de réputation externe ne s'exécute que si elle est configurée ; un résultat propre ne garantit pas qu'un site est sûr. Ouvrir l'URL Analyzer →

Analyseur d'entreprises

Cette entreprise est-elle réelle, qui la dirige, quelle est sa réputation et à quoi faut-il faire attention ?

Donnez-lui un nom d'entreprise, un domaine ou un numéro d'enregistrement et il renvoie un rapport d'entreprise consolidé. Des sources de données ciblées vérifient chacune un seul fait, la recherche en source ouverte complète l'identité et l'historique, et un analyste IA rédige le tout en langage clair. Le score de confiance et le verdict sont calculés par des règles fixes et auditables — l'IA ne fait qu'écrire l'explication autour des chiffres, jamais les chiffres eux-mêmes. Utilisez-le lors de l'intégration d'un fournisseur ou d'une contrepartie — avant de signer avec un nouveau fournisseur, d'accorder un crédit ou de payer une première facture.

  • Profil et personnes — raison sociale/nom affiché, secteur, année de création, siège social, téléphone, site web, estimation de l'effectif et noms des dirigeants lorsqu'ils sont identifiables.
  • Réputation — extraits d'avis et une note, thèmes de sentiment, et résumés d'actualités datés et sourcés.
  • Vérifications indépendantes — une adresse réelle et accessible, si le téléphone est une ligne active (et son type), et si le domaine du site web est signalé comme dangereux (un net basculement vers un risque élevé).
  • Une lecture claire — un score de confiance de 0 à 100, une note en lettre et un verdict assorti d'un niveau de confiance, une matrice de corroboration (identité / adresse / téléphone / sécurité / avis / direction) et une liste de contrôle « avant de vous engager ».

Bon à savoir : les résultats dépendent des sources de données activées ; considérez-le comme un point de départ rapide, pas comme une due diligence formelle. Ouvrir le Company Analyzer →

Metadata Lab

Tout ce qu'un fichier dit de lui-même — et chaque endroit où son propre récit se contredit.

Inspectez en profondeur les métadonnées d'un fichier sans lancer d'analyse complète. L'outil présente chaque propriété du fichier, regroupée par source, construit une chronologie des dates que le fichier revendique et fait ressortir une liste de contradictions — les endroits où le fichier se contredit. Utilisez-le pour interroger rapidement la provenance d'un document : une facture scannée dont les dates semblent douteuses, un contrat que vous soupçonnez d'avoir été modifié après signature, une photo dont vous voulez connaître l'histoire appareil/GPS, ou un e-mail dont vous voulez voir les en-têtes détaillés.

  • Propriétés regroupées — Info PDF + XMP (brut et analysé), historique des modifications, polices et chiffrement ; EXIF/GPS/appareil des images ; propriétés core/app d'Office et présence de macros ; en-têtes d'e-mail et chaîne de relais.
  • Chronologie des dates — chaque date revendiquée dans l'ordre, chacune étiquetée avec sa provenance.
  • Contradictions — dates qui remontent dans le temps ou se situent dans le futur, désaccords entre Info et XMP, contenu ajouté après une signature, et macros, fichiers ou JavaScript intégrés.
  • Historique des révisions — la carte des mises à jour incrémentielles d'un PDF, avec la révision que couvre chaque signature.

Bon à savoir : une contradiction est une piste à explorer, pas une preuve de falsification — et des métadonnées cohérentes ne prouvent pas l'authenticité. Ouvrez n'importe quel fichier du vault via son action « Metadata ». Ouvrir le Metadata Lab →

Analyse forensique d'images

Cinq perspectives visuelles indépendantes sur une même image pour révéler retouches, clones et compressions incohérentes.

Passez une image — ou une page PDF rastérisée — à travers cinq perspectives d'analyse de manipulation, chacune présentée sous forme de carte thermique ou de calque. L'outil vous donne délibérément des perspectives et des preuves à interpréter, pas un verdict ni un score. Utilisez-le sur une photo ou un document image suspect — un reçu, une photo de pièce d'identité, une capture d'écran, une facture photographiée — lorsque vous voulez voir si un chiffre, un tampon, une signature ou une zone a été retouché, cloné ou collé.

  • Analyse du niveau d'erreur (ELA) à trois qualités — des cartes thermiques qui mettent en évidence les zones retouchées ou collées avec un historique de compression différent.
  • Balayage de fantômes JPEG — une carte bloc par bloc qui révèle une zone porteuse de son propre historique de compression distinct.
  • Détection de copier-déplacer / clonage — superpose des lignes et des cadres source/destination là où une partie de l'image a été dupliquée pour masquer ou répéter du contenu.
  • Cohérence du bruit — signale les zones lissées ou insérées dont le bruit ne correspond pas à l'image environnante ; ainsi que les tables de quantification JPEG et une estimation de la qualité d'enregistrement d'origine.

Bon à savoir : chaque perspective a ses angles morts déclarés — des images fortement ré-enregistrées, redimensionnées ou issues de captures d'écran peuvent effacer les signaux. Lisez les perspectives ensemble comme un faisceau de preuves, pas comme une réponse unique. Ouvrir Image Forensics →

Vérification des signatures

Vérification cryptographique réelle des signatures numériques d'un PDF — ce qu'elles couvrent et ce qui a changé ensuite.

Vérifie les signatures numériques d'un PDF sans avoir besoin d'un magasin de confiance. Pour chaque signature, l'outil contrôle la cryptographie sous-jacente, lit le certificat que le fichier contient au sujet du signataire, confirme que les octets couverts sont intacts depuis la signature, et indique exactement ce que la signature couvre et ce qui a été ajouté par la suite. Un second mode compare géométriquement deux images de signature. Utilisez-le chaque fois qu'un PDF signé compte — un contrat, un accord ou un certificat — pour confirmer que la signature est intacte et que le document n'a pas été modifié après signature.

  • Couverture et scellement — quelle part du document chaque signature couvre, quelle révision elle scelle, et si des octets ont été ajoutés après la signature.
  • Intégrité cryptographique — l'empreinte du document correspond toujours à la plage d'octets signée, et la clé du signataire a bien produit la signature (RSA/PSS/ECDSA).
  • Certificat du signataire — sujet/émetteur, détection d'auto-signature, période de validité, et présence éventuelle d'un horodatage de confiance.
  • Comparaison de signatures — un score de similarité géométrique pour deux images de signature (recouvrement d'encre, forme, direction des traits).

Bon à savoir : l'outil ne juge délibérément pas si le certificat du signataire remonte jusqu'à une racine de confiance et ne vérifie pas la révocation, et il le précise. Compare est une aide à la similarité, pas une identification d'écriture manuscrite. Ouvrir Signature Checks →

Compare

Superposez deux versions d'un document et voyez chaque changement — jusqu'à la police.

Place deux documents côte à côte et fait ressortir chaque différence — modifications de texte, contenu déplacé, et même substitutions de police ou de taille sur un texte par ailleurs identique, de sorte qu'un montant modifié saisi dans une police légèrement différente saute aux yeux. Utilisez-le lorsque vous disposez d'un original et d'une copie renvoyée ou contresignée du même document — un contrat, un bon de commande, une facture ou un certificat — et que vous devez confirmer que rien n'a été discrètement altéré.

  • Comparaison au niveau des mots avec les zones modifiées localisées sur la page.
  • Analyse forensique des polices — signale les endroits où le même texte apparaît dans une police ou une taille différente, avec un inventaire complet des polices de chaque côté et ce qui est nouveau ou manquant.
  • Quatre modes visuels — une superposition de canal X-ray avec clignotement, une carte thermique des différences de pixels, des cadres de différences regroupés, et des changements surlignés côte à côte.
  • Les images sont acceptées — chaque côté peut être un fichier téléversé ou un fichier du vault, et une image est convertie en document d'une page pour que vous puissiez comparer une photo à un PDF.

Bon à savoir : l'outil vous montre ce qui diffère — c'est à vous de décider si un changement est légitime. Les entrées du vault y renvoient directement via leur action « Compare ». Ouvrir Compare →

PDF Studio

Un atelier PDF complet dans le navigateur : éditer, organiser, signer, convertir, caviarder et protéger.

Des utilitaires PDF du quotidien intégrés directement au produit, pour vous éviter une application séparée — tout se fait octets en entrée, octets en sortie, sans rien conserver sauf si vous l'enregistrez. C'est une trousse de productivité, pas un analyseur forensique : rien ici n'alimente les scores ni les verdicts d'analyse. Utilisez-le pour la manipulation courante des documents autour d'un dossier — regrouper des pièces, extraire des pages, caviarder des données personnelles avant partage, appliquer l'OCR à un scan, remplir un formulaire ou protéger un fichier par mot de passe.

  • Pages et conversions — fusionner, insérer, diviser, pivoter, réorganiser, rogner, compresser ; convertir depuis/vers du texte, du HTML et des images ; et appliquer l'OCR à un scan pour le rendre consultable.
  • Annotation et formulaires — formes, flèches, surlignage/soulignement/barré, tampons d'investigation, et champs de formulaire à lister/remplir/créer.
  • Caviardage permanent par zone, terme de recherche ou motif (SSN/SIN, numéros de carte, e-mail, téléphone) — le contenu sous le cadre est réellement supprimé, pas seulement masqué.
  • Signer et protéger — signer, tamponner, ajouter du texte, filigraner, modifier les métadonnées, aplatir, et protéger par mot de passe ou déverrouiller. Aller-retour avec le vault : ouvrez un PDF du vault, enregistrez la modification en tant que nouveau fichier.

Bon à savoir : le caviardage par recherche/motif ne trouve que le texte qu'il peut lire — des données personnelles incrustées dans une image scannée nécessitent un caviardage par zone (lancez d'abord « Rendre consultable » pour vérifier). Ouvrir PDF Studio →

X-Ray Engine

Un atelier axé sur les preuves qui reconstitue l'historique d'un PDF et expose des explications concurrentes.

Un atelier d'investigation autonome, réservé aux PDF, qui va plus loin qu'une analyse normale : il reconstitue l'historique des modifications d'un document, localise précisément où et quoi a changé, et expose des explications concurrentes avec les preuves pour et contre chacune. C'est explicitement un outil de raisonnement et de preuve, pas un évaluateur réussite/échec. Utilisez-le sur un PDF à fort enjeu où « ce qui a changé exactement, et où » doit être défendable. (Une version distillée Deep X-Ray s'exécute aussi automatiquement après chaque analyse PDF ordinaire et apparaît dans le rapport.)

  • Valeurs récupérées — reconstitue les révisions antérieures récupérables et montre des extraits avant / après / différence de ce que disait exactement un champ.
  • Signaux localisés — ancre chaque signal à une zone précise de la page, avec des extraits de révision des valeurs clés à vérifier par rapport à votre source de vérité.
  • Calques et construction — reconstitue les calques du document et le contenu masqué ou recouvert, et classe la façon dont le document a été construit (natif numérique, scan consultable, capture image uniquement, mixte).
  • Une couverture honnête — un rapprochement des montants et une carte thermique d'attention pour orienter la revue, avec une mention complète / limitée / ignorée / échouée sur chaque perspective ; une couverture manquante ne signifie jamais « propre ».

Bon à savoir : le mode de construction n'est pas l'authenticité, les marqueurs d'outils n'identifient pas la personne qui a édité le document, et l'outil ne porte ni score de risque ni verdict — il présente des preuves, pas une intention. Ouvrir le X-Ray Engine →

ESPACE DE TRAVAIL

Fichiers, dossiers et votre espace de travail

L'endroit où vivent vos documents, la façon de les regrouper, et où apparaissent les décisions et l'activité.

Coffre de fichiers

Votre espace privé et chiffré pour vos documents. Chaque fichier est chiffré dès que vous le téléversez et reste chiffré au repos sous une clé propre à votre compte, de sorte que vous seul pouvez ouvrir vos fichiers. Organisez-les en dossiers ; votre quota de stockage dépend de votre forfait. Chaque analyse range automatiquement l'original dans un dossier « Documents analysés » (les doublons ne sont pas stockés deux fois) et lui appose son dernier verdict, et chaque fichier propose « Envoyer à l'analyse » pour relancer l'analyse complète. Ouvrir File Vault →

Connexions cloud

Apportez votre propre stockage sans déplacer de fichiers. Connectez un dossier Dropbox ou Google Drive en tant que miroir en lecture seule : les fichiers restent dans votre cloud, sont indexés plutôt que copiés, et ne consomment aucun quota de votre vault. Le miroir se rafraîchit selon une planification et via « Synchroniser maintenant », et l'analyse automatique par connexion traite tout nouveau fichier qui arrive après la connexion (jamais votre import initial). Vous déconnecter supprime simplement l'index et l'accès — vos fichiers restent en place. Ouvrir Connections →

Dossiers

Regroupez des documents liés — un dossier de candidature, les papiers d'une expédition, un sinistre — et enquêtez sur eux comme un seul ensemble. Docurensic suggère des liens lorsque deux documents partagent un identifiant fort (e-mail, IBAN, VIN, téléphone) ou un modèle, et vous pouvez les lier à la main ; un graphe de connexions dessine les relations, et tout l'ensemble peut être revu et traité d'un seul tenant. Ouvrir Cases →

File de vérification

La file de décision humaine. Tout document dont l'action finale est ressortie À vérifier ou Rejet attend ici la décision d'une personne, afin que rien qui mérite un second regard ne passe entre les mailles. Enregistrez une décision — Approuver, Rejeter ou Escalader — avec une note facultative ; elle est suivie séparément du verdict automatisé et alimente vos statistiques de revue et vos workflows. Ouvrir la Review inbox →

Analyses

Une vue d'ensemble de votre activité : combien de documents vous avez analysés au fil du temps, la répartition entre fiable / à vérifier / rejet avec la tendance par rapport à la période précédente, votre taux de signalement global, et les signaux forensiques qui se déclenchent le plus souvent dans vos rapports récents. Ajustez la fenêtre temporelle pour affiner. Ouvrir Analytics →

Notifications

Votre flux d'alertes dans l'application (distinct de la Review inbox). Il rassemble les alertes déclenchées par vos Smart Workflows — un document signalé, un fichier routé — ainsi que les messages système de l'équipe Docurensic, les plus récents en premier. Marquez-en une ou toutes comme lues, supprimez une alerte, ou effacez tout ce que vous avez déjà lu. Ouvrir Notifications →

AUTOMATISATION

Smart Workflows — décidez une fois, appliqué à chaque document

Docurensic ne s'arrête pas au verdict. Dans le générateur visuel et sans code Workflows, vous écrivez des règles sous la forme QUAND quelque chose se produit, SI cela correspond à vos conditions, ALORS exécuter ces étapes — et cela s'applique automatiquement à chaque document par la suite. Accédez à une section :

01

Le modèle QUAND / SI / ALORS

Chaque workflow se lit de la même façon. QUAND choisit le moment (un document qui termine son analyse, une décision humaine, une minuterie ou une exécution manuelle). SI est un ensemble de filtres facultatifs, tous combinés par ET — laissez-les vides pour agir sur tout. ALORS est un arbre d'étapes qui s'exécutent dans l'ordre : chaque étape est une action ou un embranchement conditionnel.

QUAND · un déclencheur s'active SI · toutes vos conditions sont remplies ALORS · les étapes s'exécutent dans l'ordre
Les workflows sont un ciment d'automatisation, jamais un jugement forensique. Les actions peuvent notifier, étiqueter, classer, mettre en quarantaine, annoter et router — mais elles ne peuvent jamais modifier le score de risque d'authenticité ni le verdict d'un document. « Changer le statut » n'écrit que la décision opérationnelle de revue, le même champ qu'un relecteur humain renseigne. Tout est isolé des défaillances : si une étape échoue, elle est consignée et les autres s'exécutent quand même, et le traitement des workflows ne peut jamais ralentir ni faire échouer l'analyse sous-jacente.
02

Déclencheurs — le QUAND

L'événement qui démarre un workflow. La plupart découlent d'une analyse terminée ; deux s'exécutent d'eux-mêmes.

DéclencheurSe déclenche quand
Analyse terminéeUne analyse s'est terminée, quel qu'en soit le résultat — le point de départ fourre-tout.
Document téléverséUn fichier est entré dans le pipeline : téléversé ici, envoyé via l'API, ajouté au Vault, ou provenant d'un dossier Dropbox/Drive connecté.
Document classéLe type de document a été identifié (facture, pièce d'identité, certificat…). À associer à la condition « type de document » pour router selon le genre.
Score de fraude élevéLe score de risque forensique a atteint votre seuil (60 par défaut ; définissez le vôtre avec la condition de risque minimum).
Nécessite une revueLa décision finale requiert une intervention humaine — y compris pour des motifs distincts de menace ou de nature consultative.
Action finale : rejetLa décision finale est le rejet, qu'elle découle de preuves forensiques ou de la politique de votre compte.
Action finale : acceptationLa décision finale est l'acceptation. Utilisez-la pour classer automatiquement les documents qui ne nécessitent aucune revue.
Menace détectéeUn niveau de menace liée au contenu actif / à la charge utile a été relevé (détection structurelle, pas un antivirus).
Signature détectéeUne signature numérique, un champ de signature ou une marque de signature visible a été trouvée.
Doublon trouvéLe même document, ou un document quasi identique, a déjà été analysé (possible double soumission).
Document expiréUn signal d'expiration s'est déclenché — une assurance échue, un certificat périmé.
E-mail jetable trouvéUn e-mail de contact figurant sur le document utilise un domaine jetable / de boîte temporaire.
Faible confiance d'analyseLes moteurs étaient incertains de leur évaluation ou du type du document.
OCR terminéDu texte a été lu à partir d'une image — un scan ou une photo qui nécessitait l'OCR.
QR / code-barres luUn QR code ou un code-barres a été décodé (étiquettes d'expédition, billets, certificats).
Revue manuelle terminéeUn relecteur a enregistré une décision (approuvé / rejeté / escaladé). Se déclenche depuis la Review inbox, pas depuis une analyse.
Règle du moteur déclenchéeUne de vos règles personnalisées Engine Detection s'est déclenchée. Affinez avec la condition « Noms de règles du moteur ».
Sur planificationS'exécute selon une minuterie que vous définissez (toutes les heures / quotidienne / hebdomadaire / mensuelle dans votre fuseau horaire), sans être lié à un document en particulier.
Exécuter manuellementNe s'exécute que lorsque vous appuyez sur Exécuter — sur un document que vous choisissez dans l'historique, ou sur l'échantillon en mode test.
03

Conditions — le SI

Des filtres facultatifs, tous combinés par ET. Laissez-les vides et le workflow agit sur tout ce que le déclencheur capte ; ajoutez-en quelques-uns pour le restreindre exactement aux documents qui vous intéressent.

ConditionNe s'exécute que si
Score de risque au moins / au plusLe score de risque forensique est ≥ / ≤ à votre valeur (0–100). Combinez les deux pour une plage.
Le verdict est l'un deLe verdict d'authenticité forensique est fiable, à vérifier ou rejet (à votre choix). Il peut différer de l'action finale lorsqu'une politique impose une revue.
Le niveau de menace est au moinsLe niveau de menace liée au contenu actif est au moins modéré, élevé ou critique.
Comporte une menace liée au contenu actifLe document porte une menace de type charge utile / contenu actif.
Est un doublonCe document correspond à un document déjà analysé.
Comporte un signal d'expiration / d'échéanceUn signal d'expiration ou de couverture échue s'est déclenché.
Comporte une signatureLe document est signé.
Le montant est au moins / au plus ($)Le total extrait du document est ≥ / ≤ à votre montant (par exemple, les factures dépassant une limite d'approbation).
Le type de document est l'un deLe document est de l'un des types listés (facture, assurance…). Toute correspondance suffit.
Le nom de fichier contientLe nom du fichier inclut ce texte (par exemple « contract »).
Le nom de fichier correspond au motifLe nom correspond à un motif glob où * représente une suite quelconque de caractères et ? un seul (par exemple INV-*.pdf).
Comporte l'une des étiquettesLe rapport porte au moins une des étiquettes listées.
Provient deL'origine du document est un téléversement depuis l'application, un téléversement via l'API, une exécution planifiée ou une exécution manuelle.
Noms de règles du moteurUne des règles personnalisées Engine Detection nommées a correspondu (à associer au déclencheur « Règle du moteur déclenchée »).
04

Actions — le ALORS

Ce que fait un workflow, réparti en cinq familles. Les actions de message peuvent réutiliser une Connection enregistrée au lieu d'une URL collée, et prennent en charge des formules comme {{filename}}.

Alertes et messages

Touchez votre équipe là où elle travaille déjà, ou envoyez une requête POST vers n'importe quelle URL. Notification dans l'application, E-mail, Slack, Microsoft Teams, Discord, Telegram, Google Chat et Webhook (le JSON complet de l'événement, signé lorsqu'un secret est défini — un pont vers Zapier, Make, n8n, Power Automate ou vos propres systèmes).

Étiqueter, classer et organiser

Ajouter des étiquettes au rapport pour un filtrage ultérieur, Déplacer vers un dossier du vault, Mettre en quarantaine (déplace vers un dossier Quarantaine et l'étiquette), Créer un dossier (ouvre une investigation et y rattache le document), et Supprimer le document (retire définitivement votre propre copie du vault — le rapport conserve ses signaux).

Revue et notes

Changer le statut définit la décision de revue humaine — approuvé / rejeté / escaladé. Il s'agit uniquement de la décision opérationnelle ; cela ne modifie jamais le score ni le verdict forensiques. Ajouter une note ajoute une note (avec formules) aux notes du relecteur du rapport.

Enquêter avec les outils

Lancer un contrôle de métadonnées et Lancer un contrôle de signature exécutent le Metadata Lab ou Signature Checks dans le cadre du flux et étiquettent/annotent le rapport en cas de contradictions ou de signature brisée. Ouvrir dans un outil publie une alerte dans vos Notifications avec un lien en un clic qui ouvre le document, préchargé depuis le vault, dans Metadata Lab, Image Forensics, Signature Checks, Compare ou PDF Studio.

Contrôle du flux

Attendre, puis continuer met en pause puis reprend le reste des étapes après un délai de 1 minute à 7 jours. Arrêter le flux termine le workflow par anticipation (même à l'intérieur d'un embranchement). Démarrer un autre workflow exécute les étapes d'un second workflow sur le même document (chaînage sur un niveau).

05

Branchements — un flux, plusieurs chemins

Le côté ALORS est un arbre d'étapes, pas une simple liste plate. Toute étape peut être un embranchement conditionnel : plusieurs chemins étiquetés, chacun avec sa propre condition, plus un « Sinon » facultatif. Seul le premier chemin dont la condition correspond s'exécute — exactement comme un aiguillage — puis le flux se poursuit après l'embranchement. Les embranchements peuvent s'imbriquer jusqu'à trois niveaux de profondeur.

WHEN   Analysis completed
THEN   split on:
         ┌ High risk (score ≥ 75)   → create case + alert #fraud
         ├ Needs review             → tag "to-review" + email the queue
         └ Otherwise                → move to "Cleared" folder

Une simple liste d'actions sans embranchement se valide et s'exécute de la même façon ; le branchement est donc entièrement facultatif. Des limites gardent les flux lisibles : jusqu'à 10 étapes de premier niveau, jusqu'à 6 chemins par embranchement, et jusqu'à 40 actions dans l'ensemble de l'arbre.

06

Planifications et attente

Sur planification

Exécutez un workflow selon une minuterie plutôt que sur un document. Choisissez une fréquence horaire, quotidienne, hebdomadaire ou mensuelle et une heure, le tout dans un fuseau horaire IANA que vous sélectionnez (avec gestion correcte de l'heure d'été). Un planificateur en arrière-plan déclenche les workflows arrivés à échéance et réarme la prochaine exécution. Usages typiques : un résumé quotidien de l'activité vers votre boîte de réception, ou un rappel hebdomadaire de la file de revue vers Slack.

Résumé d'activité

Les exécutions planifiées transportent un résumé que vous pouvez insérer dans vos messages : {{stats.scans}}, {{stats.high_risk}}, {{stats.rejected}}, {{stats.review_pending}} et {{period}} (la fenêtre couverte, par exemple « les dernières 24 heures »).

Attendre, puis continuer

L'étape « Attendre » met en pause un flux et reprend les étapes restantes après un délai compris entre 1 minute et 7 jours — vous pouvez ainsi « alerter maintenant, puis relancer demain » ou « mettre en quarantaine maintenant, attendre 7 jours, puis supprimer ». Lors d'une exécution de test, elle continue immédiatement au lieu d'attendre réellement.

07

Testez-le avant de lui faire confiance

Trois façons sûres d'essayer un workflow sans attendre qu'un vrai document le déclenche.

Tester dans le générateur

Le bouton Tester du générateur exécute votre brouillon non enregistré sur un échantillon intégré et montre le résultat de chaque étape — sans enregistrer le workflow ni consigner d'exécution. Essayez librement les embranchements et les formules avant de valider.

Tester un workflow enregistré

Déclenchez un workflow enregistré sur le document échantillon. Ses actions s'exécutent réellement, mais les messages sortants sont marqués comme des tests et les actions qui modifient le document sont ignorées (l'échantillon n'a pas de vrai fichier). Limité à ce seul workflow.

Exécuter maintenant

Exécutez un workflow enregistré à la demande sur un vrai rapport que vous choisissez dans votre historique — exécution réelle, effets réels — ou sur l'échantillon en mode test. Les conditions filtrent toujours l'exécution, sauf si vous choisissez de la forcer.

08

Partir d'un modèle

Vous partez rarement d'une page blanche.

Galerie de règles suggérées

Des workflows prêts à l'emploi en un clic, regroupés en Triage et routage, Résumés planifiés, Enquêter avec les outils, Alertes essentielles et Intégrations. En choisir un l'ouvre prérempli pour que vous puissiez ajuster les seuils et les destinataires avant d'enregistrer — triage par risque (un embranchement à trois voies), routage des factures par montant, résumés quotidiens/hebdomadaires, relance des cas à haut risque avec un délai, quarantaine puis purge, et envoi vers Slack/Teams/Discord/Telegram/Google Chat/webhook.

Modèles de départ par défaut

Un petit filet de sécurité est mis en place automatiquement la première fois que vous ouvrez Smart Workflows — notifier à la fin, étiqueter les documents nécessitant une revue, ouvrir automatiquement un dossier en cas de risque très élevé, alerter en cas de rejet / doublon / expiration / menace, et classer les documents par niveau de risque. Ce sont des règles ordinaires que vous pouvez modifier, désactiver ou supprimer, et un modèle par défaut supprimé n'est jamais recréé.

09

Formules — insérez les données du document dans vos messages

Chaque champ de message — notifications, e-mails, messages de chat et de webhook, notes, titres de dossier — prend en charge des jetons de formule de la forme {{field|filter:arg}}. Un sélecteur d'insertion de données dans le générateur vous évite de saisir les noms de jetons.

Exemple concret — un message Slack
🚩 {{filename}} — {{doc_type|title}} — scored {{risk_score}}/100
Verdict: {{verdict|upper}}   Amount: {{amount|currency:$|number}}
Review it: {{report_url}}

Les champs comprennent des données du document ({{filename}}, {{doc_type}}, {{amount}}, {{tags}}), des données d'analyse ({{verdict}}, {{risk_score}}, {{threat_level}}, {{report_url}}), des données d'exécution ({{workflow}}, {{date}}), et les statistiques du résumé planifié ci-dessus. Les filtres s'enchaînent après une barre verticale : upper, lower, title, round:1, currency:€, number (séparateurs de milliers), truncate:40 et default:none. Un champ connu sans valeur affiche un tiret cadratin, un jeton mal orthographié reste visible pour que vous le repériez, et une formule cassée ne fait jamais échouer le message.

10

Connections — définissez une destination une fois, réutilisez-la partout

Enregistrez une URL ou un jeton une fois sur la page Connections et chaque workflow peut y faire référence par son nom — mettez à jour la connexion et chaque flux qui l'utilise se met à jour également. Chaque connexion enregistrée dispose d'un test ping en un clic, et les champs secrets (comme les jetons de bot) sont en écriture seule.

Messagerie et alertes

Slack, Microsoft Teams, Discord, Telegram, Google Chat, et des listes nommées de destinataires d'e-mails. Mattermost et Rocket.Chat s'enregistrent comme type Slack (ils parlent le format webhook de Slack).

Stockage de fichiers

Des dossiers Dropbox et Google Drive qui se reflètent en lecture seule dans votre vault et peuvent analyser automatiquement les nouveaux arrivants — les mêmes connexions cloud décrites sous Fichiers et espace de travail.

Ponts d'automatisation

Zapier, Make, n8n et Power Automate en tant que webhooks catch-hook — une seule connexion atteint des milliers d'applications en aval (CRM, ERP, tableurs, billetterie).

Webhooks pour développeurs et cycle de vie d'analyse

Vos propres points de terminaison webhook personnalisés, ainsi que des webhooks de plateforme qui abonnent vos systèmes aux événements du cycle de vie d'une analyse (en file d'attente / en cours de traitement / terminée / échouée), filtrés par niveau de risque et signés par HMAC à chaque livraison.

Chaque entrée de la galerie sur la page Connections comporte de brèves étapes « comment obtenir votre URL ou votre jeton », de sorte que raccorder une nouvelle destination se fait par copier-coller, pas par une chasse au trésor.
API

Integration API (clés API)

La manière prise en charge et stable d'utiliser Docurensic depuis vos propres systèmes. Il s'agit d'une petite surface réservée à l'analyse, sous /api/v1, authentifiée par une clé API — distincte des points de terminaison de session navigateur décrits plus bas sur cette page.

Obtenir une clé

Ouvrez Paramètres → Accès API, activez Activer l'accès API (l'interrupteur principal — tant qu'il est désactivé, chaque requête API renvoie 403), puis cliquez sur Générer une clé. La clé (drk_live_…) n'est affichée qu'une seule fois — conservez-la en lieu sûr ; seul un hachage SHA-256 est conservé côté serveur. Régénérez-la ou révoquez-la dans les Paramètres à tout moment ; la clé précédente cesse aussitôt de fonctionner. Envoyez-la à chaque requête via Authorization : Bearer drk_live_… ou X-API-Key : drk_live_….

curl -s https://docurensic.com/api/v1/analyze \
  -H "Authorization: Bearer $DOCURENSIC_API_KEY" \
  -F "[email protected]"

Mêmes types acceptés et même limite de 150 Mo que l'application. L'appel est synchrone — la latence typique est de quelques dizaines de secondes pour l'analyse forensique + IA complète. La réponse est la charge utile de document v1 fixe (verdict, score, le contrat decision, le type de document et les answers condensées du dossier). Référence complète champ par champ : le guide de l'API fourni avec votre déploiement.

post/api/v1/analyzeclé API

Analyse un document. Corps multipart : file. Renvoie la charge utile de document v1 avec un document_key que vous pouvez récupérer à nouveau. Exécute le même pipeline que l'application (rapport conservé dans votre historique, archivé automatiquement dans le File Vault sauf en mode sans stockage, déclenchement des webhooks).

get/api/v1/meclé API

Vérification de la clé. Renvoie 200 avec votre user_id lorsque la clé est valide et que l'accès API est activé.

get/api/v1/documents/{document_key}clé API

Récupère une analyse antérieure (créée via l'API ou l'application — l'historique est unique). 404 si la clé n'existe pas ou appartient à un autre compte.

get/api/v1/scans/{scan_id}/xrayclé API

Le manifeste de couches X-Ray à titre indicatif joint à une analyse PDF terminée ; les artefacts de superposition sont servis depuis /api/v1/scans/{scan_id}/xray/artifacts/{artifact_id}.

Limites de débit. POST /api/v1/analyze partage le budget d'analyse de votre compte (20 / minute) ; les autres points de terminaison v1 autorisent 60 requêtes / minute par compte. Les jetons de session navigateur ne sont pas acceptés sur /api/v1/*, et les clés API ne sont pas acceptées sur les points de terminaison applicatifs ci-dessous — les deux surfaces sont délibérément distinctes, ce qui rend l'usage attribuable.
API

Points de terminaison de l'application (session navigateur)

Chaque fonctionnalité de l'application repose sur un point de terminaison REST sous /api. Il s'agit de la surface navigateur propre à l'application — authentifiée par un jeton de session Supabase, et non par une clé API — documentée ici à titre de référence. Pour une intégration programmatique depuis vos propres systèmes, utilisez l'Integration API ci-dessus. Les requêtes et réponses sont en JSON, sauf en cas d'envoi de fichier (alors multipart/form-data).

Authentification

Docurensic utilise Supabase Auth. Connectez-vous pour obtenir un jeton d'accès, puis envoyez-le comme jeton porteur à chaque requête. Les jetons sont vérifiés côté serveur (avec un cache en mémoire de 60 secondes). Quelques points de terminaison de référence sont publics — ils sont marqués public ci-dessous.

curl https://docurensic.com/api/scan \
  -H "Authorization: Bearer <your-access-token>" \
  -F "[email protected]"
Limites de débit. Les analyses et les reconnaissances autonomes sont chacune limitées à 20 requêtes par 60 secondes et par compte, dans des buckets distincts (afin que l'exécution du reconnaisseur n'entame pas votre quota d'analyses). Les envois sont plafonnés à 150 Mo. Le dépassement d'une limite renvoie 429 ; un fichier trop volumineux renvoie 413.

Analyse et historique

Effectuez une analyse forensique complète et gérez les rapports qu'elle produit. Un rapport est conservé dans votre espace de travail (sauf si votre compte est en mode sans stockage) et n'est jamais visible que par vous.

post/api/scanuser

Analyse forensique complète. Corps multipartite : file (le document). Retourne le rapport complet — action de décision, verdict et score forensiques, niveau de menace, identification, signaux, champs et, lorsque le texte du document est disponible, l’examen par IA (classification + contrôles adaptés au type + entités). Les documents sans texte retournent un état d’indisponibilité explicite.

get/api/scan/historyuser

Liste vos rapports. Paramètres de requête : q (nom de fichier ou préfixe SHA-256), verdict (trusted/review/reject), needs_review, limit (1 à 100, 50 par défaut), offset. Renvoie {rows, total, limit, offset}.

get/api/scan/{report_id}user

Récupère un rapport complet par id.

delete/api/scan/{report_id}user

Supprime un rapport unique.

delete/api/scan/historyuser

Efface la totalité de votre historique d'analyses.

get/api/scan/statsuser

Comptages agrégés pour l'espace de travail. Voir aussi /api/scan/analytics, /api/scan/analytics/overview et /api/scan/analytics/flags pour les données de la page Analytics.

get/api/tools/hash/{sha256}user

Recherche des rapports dans votre espace de travail par SHA-256 complet ou par un préfixe d'au moins 12 caractères.

Analyse autonome

Exécutez un seul moteur directement, sans analyse complète — les points de terminaison derrière la page Tools.

post/api/analyze/textuser

Détection de texte généré par IA sur un texte collé. Corps JSON : { "text": "…", "engine": "auto", "perplexity": false }. Renvoie le verdict, un score, et chaque signal stylométrique pris individuellement. perplexity: true ajoute une passe de perplexité par modèle de langage (plus lente).

post/api/analyze/text/fileuser

Même analyse de texte IA sur un fichier envoyé (multipart file) — le texte est d'abord extrait du PDF/DOCX/TXT/de l'image (OCR si disponible).

post/api/analyze/metadatauser

Métadonnées et provenance uniquement (pas d'analyse complète). Multipart file ; PDF et Office (docx/xlsx/pptx/doc/xls/ppt) uniquement. Renvoie producteur/créateur, horodatages, classification de l'origine, et tout signal de provenance — les mêmes fonctions qu'utilise une analyse complète, afin que les chiffres ne puissent pas dériver.

post/api/analyze/emailuser

Analyse des en-têtes et du message e-mail. Corps JSON : { "raw": "…" } — en-têtes bruts collés ou message brut complet. Renvoie les en-têtes clés, les résultats SPF/DKIM/DMARC analysés, la chaîne de relais Received avec les délais par saut, les signaux forensiques (redirection reply-to BEC, usurpation du nom d'affichage, incohérence texte de lien/href), et chaque URL du corps avec un score de réputation passif { risk, band }.

post/api/analyze/email/fileuser

Même analyse pour un fichier .eml / .msg envoyé (multipart file).

post/api/recognizeuser

Reconnaissance de documents multi-sources et fusion forensique (bucket de limite de débit dédié). Multipart file ; paramètres de requête disable (liste de sources séparées par des virgules, ex. disable=vlm), ocr_mode, ocr_engine. Renvoie le type de document avec le nombre d'accords, natif numérique/numérisé, l'état de signature, et la liste des sources utilisées.

Exemple — réponse de réputation URL

{
  "domain": "paypal.com.account-verify.ru",
  "risk": 88,
  "band": "flag",
  "confidence": "high",
  "engine": "aidetect_single",
  "structural_flags": ["brand_token_outside_etld1", "suspicious_keyword"],
  "domain_age_days": 12,
  "evidence": [
    { "feature": "typosquat_distance", "score": 0.9, "note": "resembles paypal.com" }
  ]
}

Compte

get/api/account/usageuser

Le nombre de vos analyses, réparti par verdict et niveau de menace, ainsi que l'horodatage de votre dernière analyse.

get/api/account/settingsuser

Vos paramètres de configuration d'analyse, fusionnés avec les valeurs par défaut.

put/api/account/settingsuser

Mise à jour partielle. Clés : storage_mode, sensitivity, industry_preset, et une map features. Les clés inconnues sont ignorées ; les valeurs invalides sont rejetées. Voir l'onglet Compte pour la liste complète des valeurs acceptées.

get/api/account/exportuser

Tout ce qui est conservé pour votre compte — rapports d'analyse, paramètres et références fournisseurs — sous la forme d'un téléchargement JSON portable unique. Gratuit sur toutes les formules.

delete/api/accountuser

Supprime définitivement votre compte et toutes les données associées. Irréversible — l'interface le protège derrière une confirmation à saisir.

get/api/ai-usageuser

Votre journal d'utilisation de l'IA Docurensic — jetons, modèle, latence et coût estimé par appel. /api/ai-usage/{row_id} renvoie une seule entrée.

Vérification et dossiers

get/api/review/queueuser

Documents dont l’action finale est Vérifier ou Rejeter, sans décision encore enregistrée, en attente d’une vérification humaine. /api/review/queue/count retourne uniquement le nombre pour le badge de navigation.

post/api/review/{report_id}/dispositionuser

Enregistre la décision d'un examinateur. Corps JSON : { "disposition": "approved" | "rejected" | "escalated", "reviewer_note": "…" }.

post/api/cases · get/api/casesuser

Crée un dossier ({ "title": "…" }) ou liste vos dossiers avec le nombre de documents. En récupère un avec GET /api/cases/{case_id}.

post/api/cases/{case_id}/documentsuser

Associe un document à un dossier : { "scan_id": "…", "link_reason": "manual" }. Le retire avec DELETE /api/cases/{case_id}/documents/{scan_id}.

Référence et état — public, sans authentification

get/api/checkspublic

Le catalogue de contrôles en direct — chaque catégorie de signaux émise par les moteurs, son libellé lisible, et le nombre de contrôles distincts du code source pouvant la déclencher. C'est ce qui alimente le tableau du catalogue dans l'onglet Comment ça marche.

get/api/reference/producerspublic

Le tableau des niveaux de fiabilité des producteurs (quels outils de création sont fiables ou suspects), classés du plus élevé au plus faible. Également consultable sur /producers.

get/api/auth/configpublic

L'URL Supabase et la clé anon dont le client du navigateur a besoin pour se connecter.

get/api/healthpublic

Vérification de disponibilité.

Les points de terminaison administratifs nécessitent un compte administrateur ; un jeton d'utilisateur standard est rejeté. Le registre de modèles est global — tout utilisateur connecté peut le lire via GET /api/templates, et seuls les administrateurs peuvent y écrire.
CAS D'USAGE

Docurensic dans votre entreprise

Docurensic propose des profils ajustés pour les types de documents les plus exposés à la fraude, ainsi que des packs de règles sectoriels qui ajoutent des vérifications propres à chaque secteur. Vous pouvez épingler votre espace de travail à un secteur dans Paramètres → Préréglage sectoriel (auto, freight, insurance, lending, legal ou hr), ou laisser la détection automatique activée. Les scénarios ci-dessous s'appuient sur les profils par type de document et l'intelligence inter-documents réellement exécutés par les moteurs.

Transport et logistique

Courtiers, 3PL et transporteurs qui vérifient les documents d'expédition

Le double courtage et la fraude à l'identité du transporteur reposent sur des confirmations de tarif et des connaissements falsifiés. Le pack de règles fret de Docurensic extrait les numéros MC/USDOT de la page et les signale pour vérification FMCSA, tandis que l'intelligence inter-documents détecte une même identité de transporteur réutilisée sur des chargements sans lien apparent.

rate_confirmationbill_of_lading customs_documentmc_authority
  • Extraction MC/USDOT et disponibilité FMCSA — le pack de règles fret fait remonter le numéro d'autorisation du transporteur et le signale pour vérification.
  • Liens d'entités inter-documents — un numéro MC/DOT, un e-mail ou un téléphone partagé entre des documents autrement sans lien est un indice de réseau frauduleux.
  • Falsification de tarif / montant — un montant de confirmation de tarif modifié après émission laisse des traces dans les métadonnées et des indices de substitution de police.
  • Détection de quasi-doublons — une copie légèrement modifiée d'une véritable confirmation de tarif, différente au niveau des octets mais structurellement identique.

Crédit et finance

Souscripteurs et équipes financières qui vérifient les pièces justificatives

Les décisions de prêt et de crédit reposent sur des documents faciles à trafiquer — factures, bons de commande, bulletins de salaire, relevés bancaires. Docurensic vérifie l'arithmétique et les numéros de compte, pas seulement l'apparence, et applique des tests statistiques de fraude à toute donnée tabulaire.

invoicepurchase_order payment_receiptbank_statement (CSV)
  • Validation de somme de contrôle — les clés de contrôle IBAN, numéro de routage bancaire et VIN sont vérifiées, de sorte qu'un compte bénéficiaire substitué échoue arithmétiquement.
  • Arithmétique inter-champs — des lignes de détail dont la somme ne correspond pas au total indiqué, ou une taxe qui ne se réconcilie pas.
  • Loi de Benford et réconciliation des soldes — les relevés au format tableur/CSV font l'objet d'un test du khi carré de Benford, d'une détection des doublons et des regroupements de montants ronds, ainsi que des ruptures de séquence et des dates futures.
  • Cohérence des champs inter-documents — un numéro de facture ou un montant qui diffère entre un bon de commande et sa facture.

Assurance

Transporteurs et courtiers qui vérifient les justificatifs de couverture

Une attestation d'assurance est triviale à modifier dans un lecteur PDF — augmenter un plafond de garantie, prolonger une date d'expiration, substituer un nom d'assuré. Le profil par type de document de Docurensic tient compte des dates (une expiration future est normale et n'est pas traitée comme une antidate) et détecte les modifications elles-mêmes.

certificate_of_insurancepolicy_document
  • Vérifications chronologiques par type de document — une expiration future est normale pour une attestation d'assurance (COI) ; une date modifiée après émission, ou un horodatage impossible, ne l'est pas.
  • Détection de substitution de police et de révisions — un plafond de garantie ou un numéro de police modifié laisse un sous-ensemble de police incohérent ou une révision antérieure récupérable.
  • Liens d'entités par numéro de police — un même numéro de police apparaissant sur des attestations sans lien.
  • Correspondance de modèles — hachage perceptuel de la page 1 comparé à un registre de mises en page d'émetteurs connus.

RH et intégration

Vérification des documents d'identité et fiscaux à l'embauche

Les dossiers d'intégration sont un vecteur courant d'identités synthétiques — un W-2 trafiqué, un W-9 fabriqué, une pièce d'identité retouchée. Docurensic vérifie la structure des formulaires fiscaux et valide la zone de lecture automatique des pièces d'identité numérisées.

w2_formw9 id_document (MRZ)
  • Validation des clés de contrôle MRZ — les zones de lecture automatique TD3 (passeport / pièce d'identité) sont vérifiées chiffre par chiffre ; un faussaire qui modifie le numéro imprimé mais oublie la MRZ est démasqué.
  • Logique des champs des formulaires fiscaux — champs obligatoires W-2/W-9, format EIN/SSN et cohérence inter-champs.
  • Détection d'images IA et de numérisations synthétiques — une photo d'identité générée par IA, ou un formulaire né numérique reconverti en image pour échapper aux vérifications matricielles.
  • EXIF des images intégrées — traces de logiciel d'édition et de GPS laissées dans les images d'un document numérisé.

Services juridiques et professionnels

Contrats, signatures et l'e-mail qui les accompagne

Un contrat PDF signé, et le message qui l'a transmis, constituent tous deux des surfaces d'attaque. Docurensic valide les signatures numériques par cryptographie et analyse les en-têtes d'authentification des e-mails pour repérer le schéma de redirection propre à la compromission de messagerie professionnelle (BEC).

contract (PDF)signed_agreement email .eml/.msg
  • Intégrité de la signature — validité cryptographique, couverture de la plage d'octets, détection des « shadow attacks », et distinction entre signatures de certification et d'approbation.
  • Modifications cachées — une mise à jour incrémentielle après la signature, ou un champ de formulaire modifié après l'exécution du contrat.
  • Authentification des e-mails — analyse SPF/DKIM/DMARC et incohérence entre From/Reply-To/Return-Path (la redirection BEC classique).
  • Usurpation de liens et de marque — domaines punycode, typosquattage, et URL cachées à exécution automatique dans le document ou le message.
Regroupez un dossier complet avec les Dossiers. Lorsque plusieurs documents vont ensemble — une demande, les documents d'une expédition, un sinistre — ajoutez-les à un Dossier afin que les liens d'entités et les signaux de cohérence des champs entre eux apparaissent en un seul endroit, et que la File de vérification puisse porter une décision unique pour l'ensemble.
AJUSTEMENT

Adaptez la détection à votre flux de travail

Chaque compte est analysé par le même moteur calibré, mais aucun flux documentaire ne se ressemble : les confirmations de tarif d’un courtier en fret, les relevés bancaires d’un prêteur et les diplômes d’une équipe RH ont chacun leur « normal ». Le panneau Détection de la page Paramètres vous permet de régler ce qui est signalé, la rigueur avec laquelle les verdicts sont rendus et ce que vos propres règles métier ajoutent par-dessus — sans jamais affaiblir le cœur forensique. Les contrôles ci-dessous sont en lecture seule jusqu’à ce que vous activiez l’option Paramètres moteur personnalisés en haut du panneau Détection — le curseur de sensibilité s’applique dans tous les cas, et tant que l’option est désactivée le moteur fonctionne selon ses réglages calibrés par défaut.

Molette de sensibilité

Une seule molette qui ajuste les seuils de revue et de rejet. Baissez-la quand un flux d'entrée bruyant produit trop de revues limites ; montez-la quand un faux manqué coûte plus cher qu'un examen manuel supplémentaire.

Paramètres → Détection → Sensibilité

Interrupteurs de catégories

Les catégories consultatives — analyse de contenu IA, corroboration web et vérifications de contexte similaires — peuvent être désactivées par compte. Les signaux d'une catégorie désactivée sont écartés avant le calcul du score : une catégorie qui ne concerne pas vos documents cesse totalement de générer du bruit.

Consultatif uniquement

Seuils de verdict

Définissez vos propres limites de score de revue et de rejet par compte. Relever un seuil réduit le bruit des cas limites ; cela ne l'emporte jamais sur une preuve solide (voir le plancher de sécurité ci-dessous).

Des chiffres que vous contrôlez

Le plancher de sécurité

Les vérifications forensiques de base — structure du fichier, historique des révisions, analyse des polices, couverture des signatures — s'exécutent toujours et ne peuvent jamais être désactivées. Et tant qu'un signal forensique dur subsiste, le verdict du moteur sert de plancher : vos seuils peuvent réduire le bruit, mais jamais faire passer silencieusement pour fiable une falsification détectée.

Toujours actif
Un compte non modifié ne change rien. L'ajustement s'applique après l'analyse du moteur, de façon déterministe — si vous n'ouvrez jamais le panneau Détection, vos analyses se comportent exactement comme la calibration d'usine, à l'octet près.
RÈGLES PERSONNALISÉES

Vos règles métier, sous forme de formules

Les règles personnalisées expriment ce que le moteur ne peut pas savoir : quels montants comptent pour vous, quels fournisseurs vous font confiance, quels types de documents méritent un examen renforcé. Les règles se construisent dans un éditeur de formules visuel — sans code — à partir de trois types d'ingrédients, et leur résultat est toujours une action de politique distincte (étiqueter le rapport, exiger une revue), jamais une modification de la preuve forensique elle-même.

Champs du document

Des valeurs extraites du document — le montant total, les dates, le domaine de l'expéditeur, le nombre de pages. Exemple d'opérande : total du document.

Scores du moteur

Les propres chiffres de l'analyse — score de risque, niveau de menace, probabilité de contenu IA — utilisables en comparaisons : score de risque ≥ 40.

Indicateurs de détection

Une famille de vérifications s'est-elle déclenchée ? anomalie de police détectée, contradiction de métadonnées détectée — des faits oui/non combinables avec ET / OU / NON.

Exemple concret
WHEN   document type is Invoice
IF     document total ≥ 10,000
AND    (font anomaly fired  OR  revision history fired)
THEN   require review  +  tag "large-invoice-check"

Cette règle n'affirme jamais que la facture est falsifiée — elle consigne que votre politique exige un regard humain sur les grosses factures présentant un constat de typographie ou d'historique d'édition. L'étiquette appliquée est visible sur le rapport, filtrable dans votre historique et utilisable comme déclencheur des Smart Workflows (« ma règle personnalisée a correspondu ») pour alerter un canal ou router automatiquement le document vers un outil.

Partez d'un modèle. L'éditeur de règles inclut une galerie de départ par type de document — contrôles de factures à montant élevé, garde-fous de cohérence des relevés, examen renforcé des certificats — pour que les règles courantes se réduisent à un clic et un chiffre, pas à une page blanche.
PROFILS

Profil d'entreprise et réglages par type

Deux couches supplémentaires adaptent les analyses à vos documents plutôt qu'aux documents en général.

Contrôles du profil d'entreprise

Renseignez les coordonnées de votre propre entreprise — nom, identifiant fiscal, compte bancaire — et Docurensic confronte les documents qui prétendent être les vôtres à ces références. Une facture « de votre entreprise » portant un compte bancaire inconnu est exactement le schéma de fraude au détournement de paiement ; l'écart demande une revue en tant que constat de politique.

Réglages par type de document

Une sévérité différente selon le type : analysez les relevés bancaires un cran plus sensiblement que la correspondance générale, ou exigez une revue pour chaque contrat quel que soit le score. Les réglages s'appliquent au type de document identifié par l'analyse.

Politique et preuve — bien séparées

Tout ce qui figure sur cette page ajuste la politique opérationnelle : ce qui nécessite une revue dans votre flux de travail. Le score de risque forensique et le verdict restent fondés sur les seules preuves, de sorte qu'un rapport montre toujours honnêtement quels constats relèvent de la preuve du moteur et lesquels relèvent des règles de votre compte.

Modifier les réglages en toute sécurité. Changez une molette à la fois, puis relancez l'analyse de quelques documents que vous savez authentiques et d'un que vous savez frauduleux — le récit du score de chaque rapport montre exactement comment vos réglages ont façonné le résultat, pour en constater l'effet avant de lui faire confiance en production.
COMPTE

Votre compte

Connexion, configuration du comportement des analyses et gestion de vos données. Tout se trouve sur la page Paramètres.

Connexion

Docurensic utilise une authentification par e-mail et mot de passe (Supabase Auth). Créez un compte sur la page d'inscription ; si vous oubliez votre mot de passe, utilisez le lien de réinitialisation sur la page de connexion. Votre session est ce qui autorise chaque analyse et garde votre historique privé.

Ce qui est lié à votre compte

Chaque analyse, rapport, dossier et référence de dérive fournisseur est rattaché à votre identifiant utilisateur et protégé par la sécurité au niveau des lignes (row-level security) — vous seul pouvez le consulter ou le supprimer. Votre e-mail, votre nom d'affichage et votre historique de connexion proviennent directement de votre session d'authentification.

01

Paramètres d'analyse

Configurez le comportement de chaque analyse. Voici exactement les clés acceptées par le point de terminaison PUT /api/account/settings.

ParamètreValeursEffet
storage_mode store · storageless store conserve le rapport complet et archive automatiquement l’original analysé sous forme chiffrée lorsque le stockage du coffre est disponible et que le quota le permet. storageless ne crée aucune nouvelle copie source ; un fichier déjà présent dans le coffre ou un stockage connecté y demeure. Un historique allégé conserve le nom du fichier et les métadonnées d’analyse de base, le verdict forensique, l’action de décision, les constats, le type de document sûr et l’empreinte de vérification, sans les charges utiles du modèle, des plages X-Ray ou des valeurs de provenance.
sensitivity conservative · balanced · aggressive La facilité avec laquelle le verdict d’authenticité forensique s’aggrave. Équilibré est la valeur par défaut ; prudent réduit les faux positifs, agressif fait remonter davantage de preuves limites pour vérification. Les actions de politique du compte restent séparées.
industry_preset auto · freight · insurance · lending · legal · hr Épingle le pack de règles sectoriel appliqué à vos documents. auto le détecte à partir du type de document ; seul un pack ajusté correspondant au type de document est jamais appliqué.
features un ensemble de bascules marche/arrêt Activez ou désactivez individuellement les détecteurs — ai_text, ai_image, recognition, url_reputation, cross_document. Désactivés par défaut : les outils provisoires (tool_mrz et les fonctionnalités de labo étendues).
02

Confidentialité et sécurité

Conservation contrôlée

Chaque téléversement utilise un traitement temporaire supprimé après l’analyse. Le mode Stocker chiffre automatiquement l’original dans File Vault lorsque le stockage et le quota sont disponibles. Le mode Sans stockage ne crée aucune nouvelle copie source ; les fichiers existants dans le coffre ou un stockage connecté y restent, et seul un historique allégé est ajouté.

Accès authentifié

Chaque analyse, entrée d'historique, dossier et rapport est rattaché à votre compte via Supabase Auth et protégé par la sécurité au niveau des lignes (row-level security), de sorte que vous seul puissiez le consulter ou le supprimer.

Traitement des données par l'IA

Lorsqu’un texte de document borné est disponible, l’examen par IA ne voit que le texte extrait, les métadonnées et les constats des moteurs — le fichier lui-même n’est jamais envoyé au modèle. Le texte brut du document n’est pas conservé par défaut dans le journal d’utilisation, et ne l’est jamais en mode sans stockage.

Limitation de débit

20 analyses (et 20 reconnaissances) par tranche de 60 secondes et par compte, dans des quotas distincts, pour garder le service utilisable par tous.

Transport et en-têtes

HSTS sur HTTPS, X-Frame-Options : DENY, X-Content-Type-Options : nosniff, une Referrer-Policy stricte, et une Permissions-Policy restrictive sur chaque réponse.

Rejet en cas d'incohérence de contenu

Les fichiers téléversés sont analysés par leurs octets magiques ; un fichier dont le contenu réel est un exécutable, ou une archive déguisée avec une extension de document, est rejeté avant qu'aucun analyseur ne le traite.

03

Exporter et supprimer vos données

Tout exporter

Depuis Paramètres (ou via GET /api/account/export), vous pouvez télécharger tout ce qui est conservé pour votre compte — chaque rapport d'analyse, vos paramètres et vos références de dérive fournisseur — sous la forme d'un seul fichier JSON portable. Gratuit sur toutes les formules, à tout moment.

Supprimer votre compte

La suppression du compte est en libre-service et définitive. Elle efface votre historique d'analyses, vos références de dérive fournisseur et vos paramètres, puis supprime votre identifiant de connexion lui-même. Il n'existe aucun délai de récupération — l'interface la conditionne à une confirmation saisie manuellement.

FAQ

Foire aux questions

Docurensic peut-il détecter si un PDF a été altéré ?

Oui. Comme le format PDF enregistre les modifications en ajoutant du contenu à la suite, nous détectons plusieurs marqueurs de révision (%%EOF) indiquant l'existence de versions antérieures. Des horodatages de métadonnées physiquement impossibles signalent également une falsification.

Combien de temps prend une analyse ?

Le délai varie selon le format, la taille, le nombre de pages, les besoins d’OCR et la disponibilité de l’IA externe. Les contrôles structurels sont généralement les plus rapides ; les documents volumineux, numérisés ou complexes prennent plus de temps.

Mon document est-il conservé après l'analyse ?

Chaque fichier utilise un traitement temporaire supprimé après l’analyse. En mode stockage, l’original analysé est automatiquement chiffré dans le coffre-fort de fichiers lorsque le stockage est disponible et que le quota le permet. Le mode sans stockage ne crée aucune nouvelle copie source ; un fichier déjà présent dans le coffre ou un stockage connecté y demeure. L’historique allégé conserve le nom du fichier et les métadonnées d’analyse de base, le verdict forensique, l’action de décision, les constats, le type de document sûr et l’empreinte de vérification.

Docurensic peut-il prouver qu'un document est authentique ?

Non — il détecte des signaux d'alerte forensiques, il ne certifie pas l'authenticité. Un score de risque faible signifie que nous n'avons trouvé aucune preuve de manipulation, pas une garantie d'authenticité.

Mon document est-il envoyé à un modèle d'IA ?

Le fichier lui-même n’est jamais envoyé. Lorsqu’un texte extractible ou OCR borné existe, l’examen par IA utilise uniquement ce texte, les métadonnées et les constats des moteurs forensiques. Sans texte extractible, les appels externes à l’IA sont ignorés.

Quels types de fichiers sont pris en charge ?

PDF (toutes versions), Word/Excel/PowerPoint (y compris les formats hérités et avec macros), e-mails (.eml/.msg), images, CSV/TSV, et archives (.zip/.7z/.rar) — jusqu'à 150 Mo.

Fonctionne-t-il sur des documents papier numérisés ?

Oui, avec une couverture de signaux réduite. Les PDF uniquement numérisés (sans texte extractible) sont signalés comme image seule puis passés à l'OCR afin que les vérifications de contenu et de logique s'exécutent malgré tout — et l'indicateur « image seule » est lui-même utile pour un document qui prétend être né numérique.

Où puis-je signaler un problème ou demander de l'aide ?

Ouvrez un dossier sur la page Aide et assistance — problèmes techniques, questions, retours et demandes de fonctionnalités arrivent tous dans la même file, et les réponses vous parviennent dans l’application et par e-mail. La page Outils vous permet d’exécuter un moteur isolé sur un fichier ou une URL ponctuels pendant votre investigation.

Vous n'avez pas trouvé ce que vous cherchiez ?

Ouvrez un dossier de support et un humain vous répondra — généralement sous un jour ouvré. La section que vous lisiez est jointe automatiquement, pour ne jamais avoir à expliquer où vous étiez bloqué.

Ouvrir un dossier de support