By · Last updated 2026-08-12

Hasiera/Dokumentazioa/breadcrumb.imageRedaction
Itzuli Dokumentaziora

Irudietako PII Ezkutatzea — Erabilera Gida

Detektatu eta estali datu pertsonalak eskaneatzeen, argazkien eta pantaila-argazkien barnean. Gida honek igoera, azterketa, ezkutatze eta deskarga lan-fluxua, tamaina eta formatu mugak, OCR hizkuntza euskarria, eta oinarrizko API deia azaltzen ditu.

Lan-fluxua: igo, aztertu, ezkutatu, deskargatu

Irudi bakoitzak lau urrats berberak zeharkatzen ditu, web aplikazioa erabili, APIari zuzenean deitu, edo anonym_legal_redact_image tresna MCP zerbitzariaren bidez exekutatu, edonola ere.

1. Igotzea

Aukeratu PNG edo JPG fitxategi bat. Aplikazioak fitxategiaren mota eta tamaina zure planaren igoera-mugarekin egiaztatzen ditu, zerbitzarira ezer bidali aurretik.

2. Aztertzea

OCRk (Tesseract) irudiko testua irakurtzen du eta testu-zati bakoitza non dagoen erregistratzen du. Ondoren erauzitako testu horrek dokumentuetarako erabiltzen den PII detektatzaile berbera zeharkatzen du, aurkitutako entitateak eta haien kokapenak itzuliz — oraindik ezer ez da ezkutatu.

3. Ezkutatzea

Berregin eskaera, moduarekin (mode) "redact" ezarrita, detektatutako eremu bakoitza irudiaren pixeletan zuzenean marraztutako kutxa beltz solido batekin estaltzeko. Noranzko bakarreko ezkutatze bisuala da, ez enkriptazio itzulgarria.

4. Deskargatzea

Ezkutatutako irudia fitxategi gisa itzultzen da (PNG edo jatorrizko eduki-mota), lokalki gordetzen duzuna — erantzuna bidali ondoren ezer ez da zerbitzarian mantentzen.

Tamaina eta pixel mugak

  • PNG eta JPG (JPEG) bakarrik onartzen dira. Beste raster formatu batzuk, hala nola TIFF, BMP, WebP eta GIF, momentuz ez dira onartzen.
  • Irudiak 20 MB-tan mugatuta daude zerbitzari-aldean. Zure planaren muga bera baxuagoa izan daiteke — Basic planak igoerak 5 MB-tan mugatzen ditu (Pro 10 MB, Business 20 MB); plan doaneak ez du irudietako PII ezkutatzerik batere biltzen.
  • Bereizmen osoa (zabalera × altuera) 150 megapixeletan mugatuta dago. Muga hori gainditzen duten igoerak baztertu egiten dira prozesatu aurretik.

OCR hizkuntza euskarria

OCRak Tesseract-en gainean funtzionatzen du. APIaren language eremuak ISO 639-1 kode bat onartzen du (lehenetsia "en", ingelesa), Tesseract hizkuntza-pakete batekin mapatua — hiru dozena hizkuntza inguru mapatuta daude, besteak beste alemana, frantsesa, gaztelania, italiera, portugesa, nederlandera, poloniera, errusiera, ukrainera, arabiera, hebreera, hindia, japoniera, koreera, txinera, thailandiera, vietnamera eta turkiera. Benetako eskuragarritasuna OCR zerbitzarian instalatuta dauden Tesseract paketeen araberakoa da; eskuragarri ez dagoen hizkuntza batek ingelesera itzultzen du.

API Erreferentzia

Irudietako PII ezkutatzea zuzenean eskuragarri dago APIaren bidez, web aplikaziotik pasatzen ez diren integrazioetarako, eta MCP zerbitzariaren bidez anonym_legal_redact_image tresna gisa ("analyze" edo "redact" moduan), Claude bezalako MCP bezeroentzat.

POST /api/presidio/image

Authentication: Autentifikatu zaitez Bearer token batekin Authorization goiburuan (API token bat edo autentifikatutako saio bat, testu-analisirako endpointetan bezala). Token baliogabearekin egindako eskaerek 401 itzultzen dute.

Request body: Bidali multipart/form-data gorputz bat. Beharrezko eremuak: file (PNG edo JPG irudia) eta mode ("analyze" edo "redact"). Aukerako eremuak: language (ISO 639-1 OCR hizkuntza-kodea, lehenetsia "en"), entities (detekzioa mugatuko zaion entitate-motan JSON array bat), score_threshold, eta fill_color (redact moduan bakarrik, lehenetsia "black"), operator (redact mode only: "redact" | "replace" | "mask", default "redact"), and mask_char (redact mode with operator="mask" only, default "*").

Response: Analyze moduan erantzuna JSON da: detektatutako entitateak (mota, testu-kokapena eta konfiantza-puntuazioa) gehi tokens_charged eremu bat. Redact moduan erantzuna ezkutatutako irudia bera da (bitarra, Content-Type image/png edo jatorrizko mota), token-kostua X-Tokens-Charged goiburuan itzulita.

Maiz Egiten Diren Galderak

Zein irudi-formatu onartzen dira?

PNG eta JPG (JPEG) bakarrik. Beste raster formatu batzuk, hala nola TIFF, BMP, WebP eta GIF, momentuz ez dira onartzen.

Zein dira tamaina eta bereizmen mugak?

20 MB eta 150 megapixel bereizmen osoan, zure planaren igoera-mugak are gehiago mugatuta (5 MB Basic-en, 10 MB Pro-n, 20 MB Business-en).

Irudietako PII ezkutatzeak plan ordaindua behar al du?

Bai. Irudietako PII ezkutatzeak Basic plana edo altuagoa behar du. Plan doaneak testua anonimizatzea bakarrik onartzen du.

Ezkutatzea itzulgarria al da?

Ez. Ezkutatzeak detektatutako eremua kutxa beltz opaku batekin estaltzen du irudiaren pixeletan zuzenean — noranzko bakarreko ezkutatze bisuala, ez testu-anonimizatzaileak eskaintzen duen bezalako enkriptazio itzulgarria.

Nola deitu APIari zuzenean, web aplikazioa erabili gabe?

Bidali POST eskaera bat /api/presidio/image helbidera, Bearer token batekin Authorization goiburuan eta multipart/form-data gorputz batekin, file eta mode ("analyze" edo "redact") edukiz. Ikusi goiko API erreferentzia atala eremu-zerrenda osoa eta erantzunaren forma ikusteko.

Probatu irudietako PII ezkutatzea

Igo eskaneatze bat, argazki bat edo pantaila-argazki bat, eta ikusi detektatutako PIIa segundo gutxitan estaltzen.

Ireki web aplikazioa

Limitations / Important note

  • OCR-based text extraction is probabilistic; low-quality scans and handwriting lower detection recall.
  • Redaction is a visual, one-way black box over the detected region — not reversible encryption.
  • This page is informational and is not legal advice.

How we measure — our methodology

About this page

We update this page when our platform or the law changes.

Read our founder note for how we work.

Each change shows up in the timestamp at the top.

We follow these rules

  • GDPR (EU 2016/679).
  • ISO/IEC 27001:2022, held by our hosting provider.
  • NIS2 (EU 2022/2555).
  • HIPAA safe harbor under 45 CFR § 164.514(b)(2).

Our promise

We do not sell your data.

We do not train models on your text.

We store your files in Germany.

You can delete your account at any time.

You own your work.

Where we run

Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.

Hetzner holds ISO 27001 certification.

All data stays in the EU.

Backups run every day.

Need help?

Email support@anonym.legal.

We reply within one business day.

How we test

Automated checks run on every release.

Each surface gets its own sweep script and report.

Human reviewers spot-check the output each week.

We test detection against sample documents before each release.

A failing unit or integration run stops the release.

What we never do

  • We never sell your information to third parties.
  • We never train models on what you upload.
  • We never keep your work after you delete it.
  • We never share keys with any outside firm.
  • We never run ads inside the product.

Plans in plain words

We sell credits, not seats.

One credit covers one short job.

Long jobs use a few credits each.

Paid plans can buy top-up credits.

Credits reset at the end of each cycle.

Read the plans page for current rates.

Who built this

A small team of engineers and lawyers built this.

We ship from Europe and work in the open.

Our founder note spells out why we started.

Where to start

How the parts fit

A browser add-on cleans text inside Chrome.

A Word plug-in handles drafts in Office.

A small desktop tool works on whole folders.

An agent protocol link feeds large models safely.

All four share one core engine and one rule set.

Words from our team

We started this work after a lunch about cookies.

One friend kept getting odd ads on her phone.

We asked why a court file leaked through a draft.

We sketched the first build on a napkin that week.

By month three we had a tiny demo for a friend.

She used it on her first case the next day.

Common questions we hear

Can the tool read scanned PDFs? Yes, with OCR.

Does it work on long files? Yes, in small chunks.

Can I roll my own rule set? Yes, save it as a preset.

Does it run offline? The desktop build runs offline.

Do you keep my files? No, the cloud build wipes after each run.

Will it learn from my work? No, we never train on inputs.

A short tour of the workflow

Upload a file or paste a snippet of prose.

Pick the entities you want gone from the draft.

Choose a method: replace, mask, hash, encrypt, or redact.

Press run and watch the side panel show each hit.

Skim the result and tweak any rule that misfired.

Save the cleaned file or send it to a teammate.