By George Curta · Last updated 2026-08-12
Скрытие данных на изображениях — руководство по использованию
Обнаруживайте и закрывайте персональные данные на сканах, фотографиях и скриншотах. Это руководство описывает процесс загрузки, анализа, скрытия данных и скачивания, лимиты размера и формата, поддержку языков OCR и базовый вызов API.
Рабочий процесс: загрузка, анализ, скрытие, скачивание
Каждое изображение проходит одни и те же четыре шага — используете ли вы веб-приложение, обращаетесь к API напрямую или вызываете инструмент anonym_legal_redact_image через MCP-сервер.
1. Загрузка
Выберите файл PNG или JPG. Приложение проверяет тип и размер файла на соответствие лимиту загрузки вашего тарифа, прежде чем отправить что-либо на сервер.
2. Анализ
OCR (Tesseract) считывает текст на изображении и фиксирует расположение каждого фрагмента текста. Затем этот извлечённый текст проходит через тот же детектор PII, что используется для документов, возвращая найденные сущности и их положения — ничего ещё не скрыто.
3. Скрытие
Повторите запрос с параметром mode, установленным в значение "redact", чтобы закрыть каждую обнаруженную область сплошным чёрным блоком, нарисованным прямо на пикселях изображения. Это необратимое визуальное скрытие, а не обратимое шифрование.
4. Скачивание
Изображение со скрытыми данными возвращается в виде файла (PNG или исходный тип содержимого), который вы сохраняете локально — ничего не остаётся на сервере после отправки ответа.
Лимиты размера и пикселей
- Поддерживаются только PNG и JPG (JPEG). Другие растровые форматы, такие как TIFF, BMP, WebP и GIF, в настоящее время не поддерживаются.
- Изображения ограничены 20 МБ на стороне сервера. Собственный лимит вашего тарифа может быть ниже — тариф Basic ограничивает загрузки до 5 МБ (Pro — 10 МБ, Business — 20 МБ); бесплатный тариф вообще не включает скрытие данных на изображениях.
- Общее разрешение (ширина × высота) ограничено 150 мегапикселями. Загрузки, превышающие этот лимит, отклоняются до начала обработки.
Поддержка языков OCR
OCR работает на основе Tesseract. Поле языка в API принимает код ISO 639-1 (по умолчанию "en" для английского), сопоставляемый с языковым пакетом Tesseract — сопоставлено около трёх десятков языков, включая немецкий, французский, испанский, итальянский, португальский, нидерландский, польский, русский, украинский, арабский, иврит, хинди, японский, корейский, китайский, тайский, вьетнамский и турецкий. Фактическая доступность зависит от того, какие пакеты Tesseract установлены на хосте OCR; недоступный язык автоматически заменяется английским.
Справочник API
Скрытие данных на изображениях доступно напрямую через API — для интеграций, которые не используют веб-приложение, — а также через MCP-сервер как инструмент anonym_legal_redact_image (режим "analyze" или "redact") для MCP-клиентов, таких как Claude.
POST /api/presidio/imageAuthentication: Аутентифицируйтесь с помощью Bearer-токена в заголовке Authorization (API-токен или аутентифицированная сессия, как и для конечных точек анализа текста). Запросы без действительного токена возвращают 401.
Request body: Отправьте тело запроса в формате multipart/form-data. Обязательные поля: file (изображение PNG или JPG) и mode ("analyze" или "redact"). Необязательные поля: language (код языка OCR ISO 639-1, по умолчанию "en"), entities (массив JSON типов сущностей, к которым ограничивается обнаружение), score_threshold и fill_color (только для режима redact, по умолчанию "black"), operator (redact mode only: "redact" | "replace" | "mask", default "redact"), and mask_char (redact mode with operator="mask" only, default "*").
Response: В режиме analyze ответ представляет собой JSON: обнаруженные сущности (тип, положение текста и оценка достоверности) плюс поле tokens_charged. В режиме redact ответом является само изображение со скрытыми данными (бинарные данные, Content-Type image/png или исходный тип) со стоимостью в токенах, возвращаемой в заголовке X-Tokens-Charged.
Часто задаваемые вопросы
Какие форматы изображений поддерживаются?
Только PNG и JPG (JPEG). Другие растровые форматы, такие как TIFF, BMP, WebP и GIF, в настоящее время не поддерживаются.
Каковы лимиты размера и разрешения?
20 МБ и общее разрешение 150 мегапикселей, дополнительно ограниченные собственным лимитом загрузки вашего тарифа (5 МБ на Basic, 10 МБ на Pro, 20 МБ на Business).
Требует ли скрытие данных на изображениях платного тарифа?
Да. Скрытие данных на изображениях требует тарифа Basic или выше. Бесплатный тариф поддерживает только анонимизацию текста.
Обратимо ли скрытие данных?
Нет. Скрытие данных закрывает обнаруженную область непрозрачным чёрным блоком прямо на пикселях изображения — это необратимое визуальное скрытие, а не обратимое шифрование, как в текстовом анонимайзере.
Как обратиться к API напрямую, вместо использования веб-приложения?
Отправьте POST-запрос на /api/presidio/image с Bearer-токеном в заголовке Authorization и телом multipart/form-data, содержащим file и mode ("analyze" или "redact"). См. раздел справочника API выше для полного списка полей и формата ответа.
Попробуйте скрытие данных на изображениях
Загрузите скан, фотографию или скриншот и посмотрите, как обнаруженные PII скрываются за несколько секунд.
Открыть веб-приложениеLimitations / Important note
- OCR-based text extraction is probabilistic; low-quality scans and handwriting lower detection recall.
- Redaction is a visual, one-way black box over the detected region — not reversible encryption.
- This page is informational and is not legal advice.
About this page
We update this page when our platform or the law changes.
Read our founder note for how we work.
Each change shows up in the timestamp at the top.
Related reading
We follow these rules
- GDPR (EU 2016/679).
- ISO/IEC 27001:2022, held by our hosting provider.
- NIS2 (EU 2022/2555).
- HIPAA safe harbor under 45 CFR § 164.514(b)(2).
Our promise
We do not sell your data.
We do not train models on your text.
We store your files in Germany.
You can delete your account at any time.
You own your work.
Where we run
Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.
Hetzner holds ISO 27001 certification.
All data stays in the EU.
Backups run every day.
Need help?
Email support@anonym.legal.
We reply within one business day.
How we test
Automated checks run on every release.
Each surface gets its own sweep script and report.
Human reviewers spot-check the output each week.
We test detection against sample documents before each release.
A failing unit or integration run stops the release.
What we never do
- We never sell your information to third parties.
- We never train models on what you upload.
- We never keep your work after you delete it.
- We never share keys with any outside firm.
- We never run ads inside the product.
Plans in plain words
We sell credits, not seats.
One credit covers one short job.
Long jobs use a few credits each.
Paid plans can buy top-up credits.
Credits reset at the end of each cycle.
Read the plans page for current rates.
Who built this
A small team of engineers and lawyers built this.
We ship from Europe and work in the open.
Our founder note spells out why we started.
Where to start
- Open the web app and try a sample file.
- Learn how credits get counted.
- See current plans and limits.
- Meet the team behind the product.
How the parts fit
A browser add-on cleans text inside Chrome.
A Word plug-in handles drafts in Office.
A small desktop tool works on whole folders.
An agent protocol link feeds large models safely.
All four share one core engine and one rule set.
Words from our team
We started this work after a lunch about cookies.
One friend kept getting odd ads on her phone.
We asked why a court file leaked through a draft.
We sketched the first build on a napkin that week.
By month three we had a tiny demo for a friend.
She used it on her first case the next day.
Common questions we hear
Can the tool read scanned PDFs? Yes, with OCR.
Does it work on long files? Yes, in small chunks.
Can I roll my own rule set? Yes, save it as a preset.
Does it run offline? The desktop build runs offline.
Do you keep my files? No, the cloud build wipes after each run.
Will it learn from my work? No, we never train on inputs.
A short tour of the workflow
Upload a file or paste a snippet of prose.
Pick the entities you want gone from the draft.
Choose a method: replace, mask, hash, encrypt, or redact.
Press run and watch the side panel show each hit.
Skim the result and tweak any rule that misfired.
Save the cleaned file or send it to a teammate.