Clasificación y ocultamiento de texto

Cuándo usar la clasificación y el ocultamiento de texto

A continuación, se muestran algunos casos de uso comunes:

  • Sanea la entrada del usuario antes de la persistencia de la base de datos: Oculta la IIP sensible (como números de seguridad social, números de tarjetas de crédito o licencias de conducir) del texto de formato libre antes de escribir registros en las bases de datos de almacenamiento o de aplicaciones.
  • Anonimizar registros y transcripciones de atención al cliente: Elimina la información personal identificable de los historiales de chat, los tickets de asistencia y los hilos de correos electrónicos antes de que los revise el agente o se ingieran los datos de entrenamiento.
  • Identifica entidades sensibles para el etiquetado posterior: Clasifica el texto para extraer infoTypes y calificaciones de probabilidad, y usa esta información en flujos de trabajo personalizados para enrutar o marcar mensajes de alto riesgo.
  • Enmascara los datos confidenciales en las instrucciones de IA generativa: Oculta la información patentada o regulada de las instrucciones del usuario antes de enviar el contenido a LLMs públicos o de terceros.

Clasificación de texto

Considera la siguiente entrada de texto:

Please update my records with the following information:
Email address: foo@example.com

National Provider Identifier: 1245319599

Driver's license: AC333991

Se muestra una lista de resultados organizada en las siguientes categorías:

  • InfoType
  • Likelihood
  • Offset (en qué parte de la string se encontró el InfoType potencial)

En la siguiente tabla, se muestra un resultado de ejemplo.

InfoType Likelihood Offset
US_HEALTHCARE_NPI VERY_LIKELY 122
EMAIL_ADDRESS LIKELY 72
US_DRIVERS_LICENSE_NUMBER LIKELY 155
CANADA_BC_PHN VERY_UNLIKELY 122
UK_TAXPAYER_REFERENCE VERY_UNLIKELY 122
CANADA_PASSPORT VERY_UNLIKELY 155

Ocultamiento automático de texto

El ocultamiento automático produce un resultado con las coincidencias de datos sensibles ya quitadas en lugar de darte una lista de hallazgos.

A continuación, se muestra un ejemplo de entrada de ocultamiento automático:

Please update my records with the following information:
Email address: foo@example.com

National Provider Identifier: 1245319599

Driver's license: AC333991

El siguiente es un ejemplo de resultado con un marcador de posición “***”:

Please update my records with the following information:
Email address: ***

National Provider Identifier: ***

Driver's license: ***

Recursos

  • Si quieres obtener más información para usar Sensitive Data Protection para ocultar texto, consulta Oculta datos sensibles en el contenido de texto.
  • Si quieres obtener más información para usar Sensitive Data Protection y desidentificar datos sensibles en contenido de texto (lo que incluye "enmascarar" datos sensibles, reemplazarlos por una cadena de "token" y encriptarlos y reemplazarlos con una clave predeterminada o generada de forma aleatoria), consulta Desidentifica datos sensibles en contenido de texto.