By · Last updated 2026-08-12

Accueil/Documentation/breadcrumb.imageRedaction
Retour à la documentation

Caviardage des PII dans les images — Guide d'utilisation

Détectez et masquez les données personnelles dans les scans, photos et captures d'écran. Ce guide passe en revue le flux de téléversement, analyse, caviardage et téléchargement, les limites de taille et de format, la prise en charge des langues OCR, et l'appel API sous-jacent.

Flux de travail : téléverser, analyser, caviarder, télécharger

Chaque image passe par les quatre mêmes étapes, que vous utilisiez l'application web, que vous appeliez l'API directement, ou que vous invoquiez l'outil anonym_legal_redact_image via le serveur MCP.

1. Téléversement

Choisissez un fichier PNG ou JPG. L'application vérifie le type et la taille du fichier par rapport à la limite de téléversement de votre plan avant d'envoyer quoi que ce soit au serveur.

2. Analyse

L'OCR (Tesseract) lit le texte dans l'image et enregistre l'emplacement de chaque portion de texte. Ce texte extrait passe ensuite par le même détecteur de PII utilisé pour les documents, renvoyant les entités trouvées et leurs positions — rien n'est encore caviardé.

3. Caviardage

Relancez la requête avec mode défini sur « redact » pour recouvrir chaque zone détectée d'un rectangle noir opaque dessiné directement sur les pixels de l'image. Il s'agit d'un caviardage visuel à sens unique, et non d'un chiffrement réversible.

4. Téléchargement

L'image caviardée est renvoyée sous forme de fichier (PNG ou le type de contenu original) que vous enregistrez localement — rien n'est conservé sur le serveur après l'envoi de la réponse.

Limites de taille et de pixels

  • Seuls PNG et JPG (JPEG) sont pris en charge. Les autres formats raster comme TIFF, BMP, WebP et GIF ne sont pas actuellement pris en charge.
  • Les images sont plafonnées à 20 Mo côté serveur. La limite propre à votre plan peut être plus basse — le plan Basic plafonne les téléversements à 5 Mo (Pro 10 Mo, Business 20 Mo) ; le plan gratuit n'inclut pas du tout le caviardage des PII dans les images.
  • La résolution totale (largeur × hauteur) est plafonnée à 150 mégapixels. Les téléversements dépassant cette limite sont rejetés avant traitement.

Prise en charge des langues OCR

L'OCR fonctionne avec Tesseract. Le champ language de l'API accepte un code ISO 639-1 (par défaut "en" pour l'anglais) associé à un pack de langue Tesseract — environ trois douzaines de langues sont associées, y compris l'allemand, le français, l'espagnol, l'italien, le portugais, le néerlandais, le polonais, le russe, l'ukrainien, l'arabe, l'hébreu, l'hindi, le japonais, le coréen, le chinois, le thaï, le vietnamien et le turc. La disponibilité réelle dépend des packs Tesseract installés sur l'hôte OCR ; une langue non disponible se replie sur l'anglais.

Référence API

L'expurgation d'images est disponible directement via l'API pour les intégrations qui ne passent pas par l'application web, et via le serveur MCP en tant qu'outil anonym_legal_redact_image (mode « analyze » ou « redact ») pour les clients MCP tels que Claude.

POST /api/presidio/image

Authentication: Authentifiez-vous avec un token Bearer dans l'en-tête Authorization (un token API ou une session authentifiée, comme pour les endpoints d'analyse de texte). Les requêtes sans token valide renvoient 401.

Request body: Envoyez un corps multipart/form-data. Champs requis : file (l'image PNG ou JPG) et mode ("analyze" ou "redact"). Champs optionnels : language (code de langue OCR ISO 639-1, par défaut "en"), entities (un tableau JSON de types d'entités auxquels restreindre la détection), score_threshold, et fill_color (mode redact uniquement, par défaut "black"), operator (redact mode only: "redact" | "replace" | "mask", default "redact"), and mask_char (redact mode with operator="mask" only, default "*").

Response: En mode analyze, la réponse est du JSON : les entités détectées (type, position du texte et score de confiance) plus un champ tokens_charged. En mode redact, la réponse est l'image caviardée elle-même (binaire, Content-Type image/png ou le type original) avec le coût en tokens renvoyé dans l'en-tête X-Tokens-Charged.

Questions fréquentes

Quels formats d'image sont pris en charge ?

Uniquement PNG et JPG (JPEG). Les autres formats raster comme TIFF, BMP, WebP et GIF ne sont pas actuellement pris en charge.

Quelles sont les limites de taille et de résolution ?

20 Mo et 150 mégapixels de résolution totale, davantage limitées par la propre limite de téléversement de votre plan (5 Mo sur Basic, 10 Mo sur Pro, 20 Mo sur Business).

Le caviardage des PII dans les images nécessite-t-il un plan payant ?

Oui. Le caviardage des PII dans les images nécessite un plan Basic ou supérieur. Le plan gratuit ne prend en charge que l'anonymisation de texte.

Le caviardage est-il réversible ?

Non. Le caviardage recouvre la zone détectée d'un rectangle noir opaque directement sur les pixels de l'image — un caviardage visuel à sens unique, et non un chiffrement réversible comme celui proposé par l'anonymiseur de texte.

Comment appeler directement l'API sans utiliser l'application web ?

Envoyez une requête POST à /api/presidio/image avec un token Bearer dans l'en-tête Authorization et un corps multipart/form-data contenant file et mode ("analyze" ou "redact"). Consultez la section référence API ci-dessus pour la liste complète des champs et la forme de la réponse.

Essayez le caviardage des PII dans les images

Téléversez un scan, une photo ou une capture d'écran et voyez les PII détectées recouvertes en quelques secondes.

Ouvrir l'application web

Limitations / Important note

  • OCR-based text extraction is probabilistic; low-quality scans and handwriting lower detection recall.
  • Redaction is a visual, one-way black box over the detected region — not reversible encryption.
  • This page is informational and is not legal advice.

How we measure — our methodology

About this page

We update this page when our platform or the law changes.

Read our founder note for how we work.

Each change shows up in the timestamp at the top.

We follow these rules

  • GDPR (EU 2016/679).
  • ISO/IEC 27001:2022, held by our hosting provider.
  • NIS2 (EU 2022/2555).
  • HIPAA safe harbor under 45 CFR § 164.514(b)(2).

Our promise

We do not sell your data.

We do not train models on your text.

We store your files in Germany.

You can delete your account at any time.

You own your work.

Where we run

Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.

Hetzner holds ISO 27001 certification.

All data stays in the EU.

Backups run every day.

Need help?

Email support@anonym.legal.

We reply within one business day.

How we test

Automated checks run on every release.

Each surface gets its own sweep script and report.

Human reviewers spot-check the output each week.

We test detection against sample documents before each release.

A failing unit or integration run stops the release.

What we never do

  • We never sell your information to third parties.
  • We never train models on what you upload.
  • We never keep your work after you delete it.
  • We never share keys with any outside firm.
  • We never run ads inside the product.

Plans in plain words

We sell credits, not seats.

One credit covers one short job.

Long jobs use a few credits each.

Paid plans can buy top-up credits.

Credits reset at the end of each cycle.

Read the plans page for current rates.

Who built this

A small team of engineers and lawyers built this.

We ship from Europe and work in the open.

Our founder note spells out why we started.

Where to start

How the parts fit

A browser add-on cleans text inside Chrome.

A Word plug-in handles drafts in Office.

A small desktop tool works on whole folders.

An agent protocol link feeds large models safely.

All four share one core engine and one rule set.

Words from our team

We started this work after a lunch about cookies.

One friend kept getting odd ads on her phone.

We asked why a court file leaked through a draft.

We sketched the first build on a napkin that week.

By month three we had a tiny demo for a friend.

She used it on her first case the next day.

Common questions we hear

Can the tool read scanned PDFs? Yes, with OCR.

Does it work on long files? Yes, in small chunks.

Can I roll my own rule set? Yes, save it as a preset.

Does it run offline? The desktop build runs offline.

Do you keep my files? No, the cloud build wipes after each run.

Will it learn from my work? No, we never train on inputs.

A short tour of the workflow

Upload a file or paste a snippet of prose.

Pick the entities you want gone from the draft.

Choose a method: replace, mask, hash, encrypt, or redact.

Press run and watch the side panel show each hit.

Skim the result and tweak any rule that misfired.

Save the cleaned file or send it to a teammate.