Инсайты о конфиденциальности данных
Экспертные статьи о безопасности ИИ, соблюдении GDPR, защите данных в здравоохранении и лучших практиках анонимизации PII.
Все статьи
Юридическая редакция: сохранение форматирования
73% юристов сообщают о повреждении форматирования при использовании сторонних инструментов редакции (Bloomberg Law 2024). Провал редакции в файлах Министерства юстиции по делу Эпштейна.
Excel и GDPR: риски данных в таблицах
Запросы на реализацию права на доступ по GDPR выросли на 180% с 2021 по 2024 год (EDPB). Ручная обработка среднего DSAR занимает 12 часов. HR-отделы, управляющие тысячами записей сотрудников, сталкиваются с серьёзным пробелом в соответствии.
Корпоративный ИИ: доступ разработчиков без риска
Банки запрещали ChatGPT. Их разработчики всё равно использовали его — из дома. 27,4% всего контента, передаваемого в корпоративные ИИ-чатботы, содержит конфиденциальные данные (Zscaler).
Работа с Cursor и Claude без утечки кода
Cursor по умолчанию загружает .env-файлы в контекст ИИ. Финансовая компания потеряла 12 миллионов долларов после того, как проприетарные торговые алгоритмы были отправлены на ИИ-ассистент.
Политика ИИ без технических средств контроля не работает
77% сотрудников передают чувствительные рабочие данные инструментам ИИ вопреки запрещающим политикам. Государственный подрядчик вставил данные заявителей FEMA на получение помощи при наводнениях в ChatGPT.
Налог ложных срабатываний на инструменты PII
Issue #1071 на GitHub Presidio документирует систематические ложные срабатывания. Исследование 2024 года выявило точность 22,7% на смешанноязычных корпоративных наборах данных.
LLM пропускают 50% клинических PHI
Исследование 2025 года показало: LLM пропускают более 50% клинических PHI в многоязычных документах. 34,8% всех вводимых данных в ChatGPT содержат конфиденциальную информацию.
Арабский и иврит: западные инструменты PII дают сбои
GDPR не заканчивается у Босфора. Арабский и иврит-PII в рабочих процессах европейского бизнеса систематически остаются незащищёнными. XLM-RoBERTa и кросс-лингвальное обнаружение для RTL-текстов.
IDE и браузер: безопасность ИИ для разработчиков
Разработчики используют ИИ в двух средах: IDE (Cursor, VS Code) и браузер (Claude.ai, ChatGPT). Каждая требует собственных средств контроля.
83% ИИ-расширений никогда не проходили аудит
83% расширений Chrome с широкими разрешениями никогда не проходили аудит безопасности (USENIX, 2025). 45% сотрудников предприятий используют несанкционированные расширения.
39 млн утечек на GitHub: риски ИИ-программирования
67% разработчиков случайно раскрывали секреты в коде (GitGuardian 2025). В 2024 году на GitHub утекло 39 миллионов секретов — рост на 25% год к году.
KYC в масштабе: стоимость ложных срабатываний
Цифровой банк, обрабатывающий 5 000 KYC-заявок ежедневно в 15 странах ЕС, обнаружил, что этап обнаружения ПДн создаёт двухдневный журнал ожидания.
Объяснимое редактирование: аудиты HIPAA
Метод экспертного определения HIPAA требует задокументированной методологии. Юридическое раскрытие требует обоснований по каждому факту редактирования. 34% сотрудников по защите данных сообщают о недостаточных инструментах для документирования.
ПДн в многоязычных документах: одноязычные инструменты дают сбои
72% предприятий ЕС обрабатывают документы на трёх и более языках одновременно. Смешанноязычные документы повышают долю пропущенных ПДн в одноязычных NER-инструментах на 45%.
Один инструмент, 45 стран: более 267 типов сущностей
Бразильский CPF имеет контрольные цифры. Индийский PAN — 10-символьный буквенно-цифровой код. IBAN в ЕС различается по странам. Глобальные платформы электронной коммерции не могут позволить себе отдельные инструменты.
ПДн в APAC: тайский, индонезийский, вьетнамский
Сингапурская финтех-компания, обрабатывающая 500 000 чатов поддержки ежемесячно на 12 языках APAC, обнаружила, что её инструмент на английском языке пропускает ПДн в 60% неанглийских обращений.
Ложные срабатывания: почему ML-редактирование даёт сбои
Бенчмарк 2024 года выявил 13 536 ложных срабатываний при обнаружении имён в Presidio на 4 434 образцах — инструмент помечал местоимения, названия судов и стран как имена людей.
Защита редактирования в суде: оценки достоверности ИИ
Судья спросил, почему 47% документа было отредактировано. Ответ «ИИ это пометил» юридически несостоятелен. Вот как выглядит обоснованное автоматическое редактирование.
Инструменты защиты ПДн только на английском: риски GDPR
Применение GDPR одинаково для нарушений на всех языках ЕС. Когда инструмент обнаружения ПДн, ориентированный на английский язык, пропускает немецкие, французские или польские идентификаторы — компания несёт правовую ответственность.
Инструменты защиты ПДн только на английском: пробел в GDPR
Немецкий Steuer-ID (11 цифр с контрольной суммой) структурно отличается от американского SSN. Французский номер NIR содержит 15 цифр. Польский PESEL и шведский Personnummer.
ISO 27001 + нулевое знание сокращают время оценки поставщиков
Опрос 2025 года: «отсутствие признанного сертификата безопасности» — вторая причина, по которой CISO отклоняют SaaS-поставщиков. Вот что даёт комбинация ISO 27001 и нулевого знания.
Архитектура нулевого знания сокращает циклы продаж
Корпоративные вопросники по безопасности поставщиков в среднем содержат 100+ вопросов. Архитектура нулевого знания даёт исчерпывающие ответы на самые сложные из них.
Взлом LastPass: уроки безопасности для поставщиков
LastPass шифровал данные пользователей. Хранилища всё равно были украдены. Затем последовали 600 000+ записей Okta. SaaS-инциденты выросли на 300% с 2022 по 2024 год.
Оценка заявлений о нулевом знании после LastPass
$438 млн похищено у пользователей LastPass после взлома «зашифрованных» хранилищ. Штраф ICO £1,2 млн. Вот чеклист для проверки заявлений поставщика о нулевом знании.
Начните защищать ваши данные сегодня
267+ типов сущностей, 48 языков, безопасность корпоративного уровня по стартовым ценам.
About this page
We update this page when our platform or the law changes.
Read our founder note for how we work.
Each change shows up in the timestamp at the top.
Related reading
We follow these rules
- GDPR (EU 2016/679).
- ISO/IEC 27001:2022, held by our hosting provider.
- NIS2 (EU 2022/2555).
- HIPAA safe harbor under 45 CFR § 164.514(b)(2).
Our promise
We do not sell your data.
We do not train models on your text.
We store your files in Germany.
You can delete your account at any time.
You own your work.
Where we run
Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.
Hetzner holds ISO 27001 certification.
All data stays in the EU.
Backups run every day.
Need help?
Email support@anonym.legal.
We reply within one business day.
How we test
Automated checks run on every release.
Each surface gets its own sweep script and report.
Human reviewers spot-check the output each week.
We test detection against sample documents before each release.
A failing unit or integration run stops the release.
What we never do
- We never sell your information to third parties.
- We never train models on what you upload.
- We never keep your work after you delete it.
- We never share keys with any outside firm.
- We never run ads inside the product.
Plans in plain words
We sell credits, not seats.
One credit covers one short job.
Long jobs use a few credits each.
Paid plans can buy top-up credits.
Credits reset at the end of each cycle.
Read the plans page for current rates.
Who built this
A small team of engineers and lawyers built this.
We ship from Europe and work in the open.
Our founder note spells out why we started.
Where to start
- Open the web app and try a sample file.
- Learn how credits get counted.
- See current plans and limits.
- Meet the team behind the product.
How the parts fit
A browser add-on cleans text inside Chrome.
A Word plug-in handles drafts in Office.
A small desktop tool works on whole folders.
An agent protocol link feeds large models safely.
All four share one core engine and one rule set.
Words from our team
We started this work after a lunch about cookies.
One friend kept getting odd ads on her phone.
We asked why a court file leaked through a draft.
We sketched the first build on a napkin that week.
By month three we had a tiny demo for a friend.
She used it on her first case the next day.
Common questions we hear
Can the tool read scanned PDFs? Yes, with OCR.
Does it work on long files? Yes, in small chunks.
Can I roll my own rule set? Yes, save it as a preset.
Does it run offline? The desktop build runs offline.
Do you keep my files? No, the cloud build wipes after each run.
Will it learn from my work? No, we never train on inputs.
A short tour of the workflow
Upload a file or paste a snippet of prose.
Pick the entities you want gone from the draft.
Choose a method: replace, mask, hash, encrypt, or redact.
Press run and watch the side panel show each hit.
Skim the result and tweak any rule that misfired.
Save the cleaned file or send it to a teammate.