Técnico
Análisis profundos sobre detección de PII, NER y tecnología de anonimización
33 artículos
Presidio es poderoso. También es un proyecto de...
Microsoft Presidio tiene miles de estrellas en GitHub y cientos de problemas abiertos.
De 6 Semanas de Infierno DevOps a una Integración de...
Los equipos de SaaS de atención médica pasan 6 semanas en el despliegue de producción de Presidio autoalojado antes de cambiar a una API gestionada.
El Costo Real de la Detección de PII de Código...
La autoalojamiento de Presidio requiere de 40-80 horas de configuración inicial y 5-10 horas/mes de mantenimiento continuo.
El Problema de Precisión del 22.7% de Presidio...
Un estudio de referencia de 2024 encontró que el reconocedor de nombres de personas de Presidio logra un 22.7% de precisión en documentos...
Privacidad Reproducible: Por Qué los Equipos de ML...
La anonimización de datos de entrenamiento de ML debe ser consistente y reproducible.
Construyendo un Pipeline de Datos Seguro para el...
Las etiquetas de columna de dbt no son cumplimiento del GDPR. Los datos de clientes sin procesar llegan a tu almacén de Snowflake sin enmascarar...
FOIA en la Era de la IA: Cómo las Agencias Están...
El gobierno federal gastó un estimado de $500M en el procesamiento de FOIA en 2024, principalmente en redacción manual.
Datos de Entrenamiento de ML Cumpliendo con el GDPR...
El GDPR restringe el uso de datos personales para el entrenamiento de ML más allá de su propósito original de recolección.
Cómo las agencias gubernamentales pueden reducir el...
Las agencias federales de EE. UU. recibieron 1.5 millones de solicitudes de FOIA en el año fiscal 2024 a un costo promedio de $482 por solicitud.
Presidio vs. anonym.legal: Lo que obtienes cuando...
Microsoft Presidio es técnicamente gratuito, pero cuesta de 40 a 80 horas de ingeniería para implementarlo correctamente.
Privacidad Air-Gapped: Cómo Anonimizar Documentos...
Los entornos FedRAMP e ITAR tienen una cosa en común: la nube no es una opción. La pseudonimización reversible bajo el Art.
El Impuesto de Falsos Positivos: Por Qué el Problema...
El problema de falsos positivos sistemáticos se documenta en el problema de GitHub de Presidio #1071.
La Brecha de Cumplimiento en Oriente Medio...
El GDPR no termina en el Bósforo. La PII en árabe y hebreo en los flujos de trabajo empresariales de la UE está sistemáticamente desprotegida.
El Problema del Documento en Lenguas Mixtas...
El 72% de las empresas de la UE procesan documentos en 3+ idiomas simultáneamente.
Privacidad de Datos en APAC: Por Qué Su Herramienta...
Una fintech de Singapur que procesa 500,000 chats de soporte mensuales en 12 idiomas de APAC encontró que su herramienta solo en inglés no detectó...
El Problema del Falso Positivo: Por Qué la Redacción...
Un estudio de referencia de 2024 encontró que Presidio generó 13,536 detecciones de nombres falsos positivos en 4,434 muestras...
Cómo ISO 27001 + Arquitectura de Conocimiento Cero...
Una encuesta de 2025 encontró que 'falta de certificación de seguridad reconocida' fue la razón #2 por la que los CISO descalifican a los...
Responder las Preguntas Más Difíciles del...
Los cuestionarios de seguridad de proveedores empresariales promedian más de 100 preguntas.
Lo que la violación de LastPass debería haber...
LastPass cifró los datos de sus usuarios. Las bóvedas aún fueron exfiltradas. Más de 600K registros de Okta siguieron.
Por qué 'Encriptamos tus datos' No Es Suficiente...
$438 millones robados a usuarios de LastPass después de que sus bóvedas 'encriptadas' fueran violadas.
LangChain CVE-2025-68664: Cómo se Filtra DCP a Través...
CVSS 9.3. Las funciones de serialización de LangChain exponen variables de entorno y secretos a LLMs controlados por atacantes.
Anonimización de PII en LibreOffice...
Guía paso a paso para anonimizar PII en documentos de LibreOffice usando la extensión anonym.legal.
LibreOffice vs. Microsoft Office para Redacción de...
Comparación detallada de capacidades de anonimización de PII en LibreOffice (extensión anonym.legal) vs. Microsoft Office (Office Add-in).
Por qué la detección binaria de PII está fallando a...
Detectado/no detectado es insuficiente para contextos de cumplimiento que requieren juicio humano.
El Problema de la Fragmentación de Formatos de...
Una sola respuesta a un DSAR puede abarcar contratos de Word, facturas en PDF, listas de clientes en Excel y exportaciones en CSV.
Compartición de Registros Cumpliendo con el GDPR...
Los registros de aplicaciones acumulan silenciosamente correos electrónicos de usuarios, IPs y números de cuenta.
GDPR en Sus Registros de Aplicación...
Los registros de aplicación contienen direcciones de correo electrónico de clientes, IPs y números de cuenta que el Artículo 5(1)(e) del GDPR...
Protección de PII entre Aplicaciones...
Los datos de los clientes fluyen desde la investigación en el navegador hasta los borradores de Word y los mensajes de Claude.
Cumplimiento de PII Multiplataforma...
Oficiales de privacidad en Mac, legales en Windows, ingenieros de datos en Linux: todos procesando los mismos datos con diferentes herramientas.
Anonimización de PII en Entornos Aislados...
El 41% de las políticas de seguridad empresarial prohíben el procesamiento en la nube de documentos clasificados.
Redacción Reversible vs. Permanente...
El GDPR distingue entre anonimización y seudonimización. Los tribunales requieren documentos originales. La investigación necesita re-identificación.
NER Multilingüe: Por Qué Tu Modelo Entrenado en...
Los modelos de NER en inglés logran una precisión del 85-92%. ¿Árabe y chino? A menudo 50-70%.
Cómo Usar Claude y ChatGPT Sin Filtrar Secretos de la...
Una guía para desarrolladores sobre cómo usar asistentes de IA de manera segura.
Comience a Proteger Sus Datos Hoy
Más de 285 tipos de entidades, 48 idiomas, seguridad de nivel empresarial a precios de inicio.
About this page
We update this page when our platform or the law changes.
Read our founder note for how we work.
Each change shows up in the timestamp at the top.
Related reading
We follow these rules
- GDPR (EU 2016/679).
- ISO/IEC 27001:2022.
- NIS2 (EU 2022/2555).
- HIPAA safe harbor under 45 CFR § 164.514(b)(2).
Our promise
We do not sell your data.
We do not train models on your text.
We store your files in Germany.
You can delete your account at any time.
You own your work.
Where we run
Our company HQ is in Saarbrücken, Germany. Our servers run in Hetzner's Falkenstein datacenter.
Hetzner holds ISO 27001 certification.
All data stays in the EU.
Backups run every day.
Need help?
Email support@anonym.legal.
We reply within one business day.
How we test
We run a full check suite on every release.
Each surface gets its own sweep script and report.
Human reviewers spot-check the output each week.
We track recall and precision on a labelled set.
Bad runs block the deploy.
What we never do
- We never sell your information to third parties.
- We never train models on what you upload.
- We never keep your work after you delete it.
- We never share keys with any outside firm.
- We never run ads inside the product.
Plans in plain words
We sell credits, not seats.
One credit covers one short job.
Long jobs use a few credits each.
You can top up at any time.
Unused credits roll over each month.
Read the plans page for current rates.
Who built this
A small team of engineers and lawyers built this.
We ship from Europe and work in the open.
Our founder note spells out why we started.
Where to start
- Open the web app and try a sample file.
- Learn how credits get counted.
- See current plans and limits.
- Meet the team behind the product.
How the parts fit
A browser add-on cleans text inside Chrome.
A Word plug-in handles drafts in Office.
A small desktop tool works on whole folders.
An agent protocol link feeds large models safely.
All four share one core engine and one rule set.
Words from our team
We started this work after a lunch about cookies.
One friend kept getting odd ads on her phone.
We asked why a court file leaked through a draft.
We sketched the first build on a napkin that week.
By month three we had a tiny demo for a friend.
She used it on her first case the next day.
Common questions we hear
Can the tool read scanned PDFs? Yes, with OCR.
Does it work on long files? Yes, in small chunks.
Can I roll my own rule set? Yes, save it as a preset.
Does it run offline? The desktop build runs offline.
Do you keep my files? No, the cloud build wipes after each run.
Will it learn from my work? No, we never train on inputs.
A short tour of the workflow
Upload a file or paste a snippet of prose.
Pick the entities you want gone from the draft.
Choose a method: replace, mask, hash, encrypt, or redact.
Press run and watch the side panel show each hit.
Skim the result and tweak any rule that misfired.
Save the cleaned file or send it to a teammate.