Presidio: 3 тижні налаштування проти managed PII
Microsoft Presidio має тисячі зірок на GitHub і сотні відкритих питань. Складність налаштування, накладні витрати на інтеграцію з PySpark і конфлікти залежностей Python роблять виробниче розгортання тривалим проєктом.
Від 6 тижнів до 3 днів: managed PII API
Команди медичних SaaS-сервісів витрачають 6 тижнів на виробниче розгортання самостійно розміщеного Presidio, перш ніж перейти на managed API. Managed API замінює весь процес розгортання.
«Безкоштовне» виявлення PII коштує €13 000 на рік
Самостійне розгортання Presidio вимагає 40–80 годин початкового налаштування та 5–10 годин на місяць поточного обслуговування. За ставкою €100 на годину це €13 200 і більше.
Проблема точності Presidio: 22,7%
Бенчмарк 2024 року показав, що розпізнавач імен осіб у Presidio досягає точності 22,7% у ділових документах — це означає, що 77,3% виявлень є хибними спрацюваннями.
Відтворювана конфіденційність: пресети для ML
Анонімізація навчальних даних ML має бути послідовною та відтворюваною. Якщо дата-сайєнтисти А і Б застосовують різні типи сутностей, навчальні набори даних стають.
GDPR-безпечний конвеєр: анонімізуйте PII перед завантаженням
Теги стовпців у dbt — це не відповідність GDPR. Необроблені дані клієнтів потрапляють до вашого сховища Snowflake без маскування ще до того, як застосовуються політики на основі тегів.
FOIA: ШІ скорочує редагування з тижнів до годин
Федеральний уряд витратив близько 500 млн доларів на обробку запитів FOIA у 2024 році, переважно на ручне редагування. ARPA-H прямо шукала програмне забезпечення для редагування на основі ШІ.
Анонімізація навчальних даних для ML відповідно до GDPR
GDPR обмежує використання персональних даних для навчання ML-моделей поза межами початкової мети збору. Команди, що покладаються на ситуативні Python-скрипти, створюють проблеми відповідності.
Як державні органи можуть скоротити час обробки FOIA на 80% завдяки пакетному редагуванню персональних даних
Федеральні органи США отримали 1,5 млн запитів FOIA у 2024 фінансовому році при середній вартості $482 за запит. Пакетне редагування персональних даних скорочує час обробки з тижнів до днів.
Presidio проти anonym.legal: розробити чи придбати
Microsoft Presidio технічно безкоштовний, але розгортання займає 40–80 годин інженерної роботи. anonym.legal забезпечує однакову точність ML як керований SaaS.
Конфіденційність в ізольованих мережах: анонімізація без інтернету
Середовища FedRAMP та ITAR мають одну спільну рису — хмара не є варіантом. Оборотня псевдонімізація відповідно до статті 4(5) GDPR та керівних принципів EDPB 05/2022.
Податок на хибні спрацьовування інструментів PII
Обговорення #1071 на GitHub Microsoft Presidio фіксує систематичні хибні спрацьовування. Дослідження 2024 року виявило точність 22,7% на корпоративних наборах даних із кількома мовами.
Арабська та іврит: західні інструменти не справляються
GDPR не закінчується на Босфорі. Персональні дані арабською та івритом у робочих процесах ЄС систематично залишаються незахищеними. Багатомовне виявлення на основі XLM-RoBERTa та кросмовна архітектура.
PII у змішаномовних документах: однoмовні інструменти дають збій
72% підприємств ЄС одночасно обробляють документи трьома і більше мовами. Змішаномовні документи призводять до 45% вищого рівня пропуску PII в одномовних NER-інструментах.
PII в APAC: тайська, індонезійська, в'єтнамська
Сінгапурський фінтех, що обробляє 500 000 чатів підтримки на місяць 12 мовами APAC, виявив, що їхній інструмент лише для англійської пропускав PII у 60% неанглійських записів.
Хибні спрацьовування: чому ML-редакція дає збої
Тест-порівняння 2024 року показав, що Presidio згенерував 13 536 хибних спрацьовувань при виявленні імен серед 4 434 зразків — позначаючи займенники, назви суден і країн як імена осіб.
ISO 27001 + ZK скорочує час оцінки постачальника
Опитування 2025 року показало, що «відсутність визнаної сертифікації безпеки» — друга за частотою причина, через яку CISO дискваліфікують SaaS-постачальників. Ось що дає поєднання ISO 27001 і ZK.
Архітектура ZK скорочує цикли продажів
Корпоративні анкети безпеки постачальників містять 100+ питань. Архітектура zero-knowledge дає вичерпні відповіді на найскладніші з них — і допомагає укладати угоди.
Злом LastPass: уроки безпеки постачальника
LastPass шифрував дані своїх користувачів. Сховища все одно вилучили. За цим пішло 600 тис.+ записів Okta. Інциденти безпеки SaaS зросли на 300% з 2022 по 2024 рік. Чеклист аудиту для переоцінки хмарних постачальників.
Оцінка ZK-заяв після LastPass
Після зламу LastPass у зловмисників виявилися 'зашифровані' сховища, і вони вкрали $438 млн у користувачів. ICO наклав штраф у £1,2 млн. Чеклист для оцінки того, чи є ZK-заява постачальника реальною.
LangChain CVE-2025-68664: як PII витікає через ваш RAG-конвеєр
CVSS 9,3. Функції серіалізації LangChain розкривають змінні середовища та секрети LLM, контрольованим зловмисником. Як виявити та виправити витоки PII.
Розширення LibreOffice для анонімізації PII
Покрокове керівництво з анонімізації PII в документах LibreOffice за допомогою розширення anonym.legal.
LibreOffice проти Office: редагування PII
Детальне порівняння можливостей анонімізації PII в LibreOffice (розширення anonym.legal) проти Microsoft Office (надбудова Office).
Чому бінарне виявлення ПДн не відповідає вимогам комплаєнсу
«Виявлено/не виявлено» недостатньо для контекстів відповідності, що вимагають людського судження. Ось чому оцінювання довіри перетворює анонімізацію ПДн на справжнє рішення для дотримання вимог.
Фрагментація форматів документів в інструментах захисту PII
Одна відповідь на DSAR може охоплювати контракти Word, рахунки PDF, списки клієнтів Excel та CSV-експорти. Використання різних інструментів для кожного формату створює прогалини у відповідності.
Анонімізація журналів відповідно до GDPR: зберігаємо налагодження
Журнали застосунків мовчки накопичують електронні адреси, IP-адреси та номери рахунків користувачів. Ось як безпечно передавати журнали третім сторонам, підрядникам та платформам спостережуваності.
GDPR у журналах застосунків: відповідність PII в JSON
Журнали застосунків містять адреси електронної пошти клієнтів, IP-адреси та номери рахунків, управління якими вимагає Стаття 5(1)(e) GDPR.
Міжпрограмний захист ПДн: Word, Chrome та ШІ
Дані клієнтів переміщуються з браузера до документів Word і до запитів Claude. Кожне перемикання між програмами — потенційна точка витоку.
Міжплатформна відповідність ПДн: Mac, Linux та Windows
Офіцери конфіденційності на Mac, юридичні відділи на Windows, інженери з даних на Linux — всі обробляють ті самі дані різними інструментами. Ось чому виявлення, незалежне від ОС, є вирішальним.
PII в ізольованих мережах: офлайн-підхід для оборонної сфери
41% корпоративних політик безпеки забороняють хмарну обробку класифікованих документів.
Оборотне проти постійного редагування: як обрати правильний підхід
GDPR розрізняє анонімізацію та псевдонімізацію. Суди вимагають оригінали. Дослідники потребують повторної ідентифікації. Дізнайтеся, коли використовувати кожен підхід.
Багатомовний NER: англійські моделі не справляються з арабською
Англійські NER-моделі досягають 85-92% точності. Арабська та китайська? Часто лише 50-70%. Дізнайтеся про технічні проблеми та як будувати дійсно багатомовний захист.
Використовуйте Claude і ChatGPT без витоку PII
Посібник розробника з безпечного використання ШІ-асистентів. Налаштуйте інтеграцію MCP Server для прозорого захисту PII в Claude Desktop, Cursor та VS Code.
Почніть захищати свої дані сьогодні
285+ типів сутностей, 48 мов, безпека корпоративного рівня за стартовими цінами.
About this page
We update this page when our platform or the law changes.
Read our founder note for how we work.
Each change shows up in the timestamp at the top.
Related reading
We follow these rules
- GDPR (EU 2016/679).
- ISO/IEC 27001:2022.
- NIS2 (EU 2022/2555).
- HIPAA safe harbor under 45 CFR § 164.514(b)(2).
Our promise
We do not sell your data.
We do not train models on your text.
We store your files in Germany.
You can delete your account at any time.
You own your work.
Where we run
Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.
Hetzner holds ISO 27001 certification.
All data stays in the EU.
Backups run every day.
Need help?
Email support@anonym.legal.
We reply within one business day.
How we test
We run a full check suite on every release.
Each surface gets its own sweep script and report.
Human reviewers spot-check the output each week.
We track recall and precision on a labelled set.
Bad runs block the deploy.
What we never do
- We never sell your information to third parties.
- We never train models on what you upload.
- We never keep your work after you delete it.
- We never share keys with any outside firm.
- We never run ads inside the product.
Plans in plain words
We sell credits, not seats.
One credit covers one short job.
Long jobs use a few credits each.
You can top up at any time.
Unused credits roll over each month.
Read the plans page for current rates.
Who built this
A small team of engineers and lawyers built this.
We ship from Europe and work in the open.
Our founder note spells out why we started.
Where to start
- Open the web app and try a sample file.
- Learn how credits get counted.
- See current plans and limits.
- Meet the team behind the product.
How the parts fit
A browser add-on cleans text inside Chrome.
A Word plug-in handles drafts in Office.
A small desktop tool works on whole folders.
An agent protocol link feeds large models safely.
All four share one core engine and one rule set.
Words from our team
We started this work after a lunch about cookies.
One friend kept getting odd ads on her phone.
We asked why a court file leaked through a draft.
We sketched the first build on a napkin that week.
By month three we had a tiny demo for a friend.
She used it on her first case the next day.
Common questions we hear
Can the tool read scanned PDFs? Yes, with OCR.
Does it work on long files? Yes, in small chunks.
Can I roll my own rule set? Yes, save it as a preset.
Does it run offline? The desktop build runs offline.
Do you keep my files? No, the cloud build wipes after each run.
Will it learn from my work? No, we never train on inputs.
A short tour of the workflow
Upload a file or paste a snippet of prose.
Pick the entities you want gone from the draft.
Choose a method: replace, mask, hash, encrypt, or redact.
Press run and watch the side panel show each hit.
Skim the result and tweak any rule that misfired.
Save the cleaned file or send it to a teammate.