В недавней публикации обсуждается модельно-независимый детектор PII, который может работать на любой большой языковой модели, управляемой Amazon Bedrock. Этот детектор был протестирован на пяти публичных корпусах PII и показал свою эффективность в сравнении с другими инструментами, такими как OpenAI PrivacyFilter.
Обнаружение PII представляет собой сложную задачу, поскольку модели, обученные на неочищенных текстах, могут запоминать конфиденциальную информацию, такую как имена, адреса и номера банковских счетов. Это может привести к утечке данных, если модель будет использоваться неправильно. В статье также приводится пример кода для реализации детектора, который доступен в пакете pii-detector.
Данная разработка имеет значительное значение для обеспечения конфиденциальности данных в условиях растущих требований к защите личной информации. Использование таких инструментов помогает организациям минимизировать риски утечек и повысить уровень безопасности при работе с чувствительными данными.