Cuándo usar la clasificación y el ocultamiento de texto
A continuación, se muestran algunos casos de uso comunes:
- Sanea la entrada del usuario antes de la persistencia de la base de datos: Oculta la IIP sensible (como números de seguridad social, números de tarjetas de crédito o licencias de conducir) del texto de formato libre antes de escribir registros en las bases de datos de almacenamiento o de aplicaciones.
- Anonimizar registros y transcripciones de atención al cliente: Elimina la información personal identificable de los historiales de chat, los tickets de asistencia y los hilos de correos electrónicos antes de que los revise el agente o se ingieran los datos de entrenamiento.
- Identifica entidades sensibles para el etiquetado posterior: Clasifica el texto para extraer infoTypes y calificaciones de probabilidad, y usa esta información en flujos de trabajo personalizados para enrutar o marcar mensajes de alto riesgo.
- Enmascara los datos confidenciales en las instrucciones de IA generativa: Oculta la información patentada o regulada de las instrucciones del usuario antes de enviar el contenido a LLMs públicos o de terceros.
Clasificación de texto
Considera la siguiente entrada de texto:
Please update my records with the following information: Email address: foo@example.com National Provider Identifier: 1245319599 Driver's license: AC333991
Se muestra una lista de resultados organizada en las siguientes categorías:
InfoTypeLikelihoodOffset(en qué parte de la string se encontró elInfoTypepotencial)
En la siguiente tabla, se muestra un resultado de ejemplo.
InfoType |
Likelihood |
Offset |
|---|---|---|
US_HEALTHCARE_NPI |
VERY_LIKELY |
122 |
EMAIL_ADDRESS |
LIKELY |
72 |
US_DRIVERS_LICENSE_NUMBER |
LIKELY |
155 |
CANADA_BC_PHN |
VERY_UNLIKELY |
122 |
UK_TAXPAYER_REFERENCE |
VERY_UNLIKELY |
122 |
CANADA_PASSPORT |
VERY_UNLIKELY |
155 |
Ocultamiento automático de texto
El ocultamiento automático produce un resultado con las coincidencias de datos sensibles ya quitadas en lugar de darte una lista de hallazgos.
A continuación, se muestra un ejemplo de entrada de ocultamiento automático:
Please update my records with the following information: Email address: foo@example.com National Provider Identifier: 1245319599 Driver's license: AC333991
El siguiente es un ejemplo de resultado con un marcador de posición “***”:
Please update my records with the following information: Email address: *** National Provider Identifier: *** Driver's license: ***
Recursos
- Si quieres obtener más información para usar Sensitive Data Protection para ocultar texto, consulta Oculta datos sensibles en el contenido de texto.
- Si quieres obtener más información para usar Sensitive Data Protection y desidentificar datos sensibles en contenido de texto (lo que incluye "enmascarar" datos sensibles, reemplazarlos por una cadena de "token" y encriptarlos y reemplazarlos con una clave predeterminada o generada de forma aleatoria), consulta Desidentifica datos sensibles en contenido de texto.