3 / 3494

PII-Erkennung ohne Modellbindung: jedes LLM auf Amazon Bedrock wird zum Detektor

TL;DR

AWS zeigt einen konfigurierbaren PII-Detektor, der jedes große Sprachmodell auf Amazon Bedrock zur Erkennung sensibler Daten nutzt. Die zu erkennenden Entitäten stehen im Prompt statt im Code, deshalb lassen sich neue Typen ohne Retraining ergänzen. In Tests über fünf öffentliche Korpora schlägt der Ansatz ein fertiges Standardtool und neun weitere LLM-basierte Detektoren. Relevant wird das, wenn du Datenschutzprüfungen flexibel halten und ohne Modellwechsel anpassen willst.

Nauti's Take

Einen PII-Detektor über den Prompt statt über Code zu konfigurieren, ist praktisch, weil neue Entitätstypen ohne Retraining dazukommen und das Modell austauschbar bleibt. Die Kehrseite: Die Erkennungsqualität hängt damit an der Prompt-Formulierung, und bei sensiblen Daten werden schon wenige Fehltreffer teuer.

Teams mit wechselnden Compliance-Anforderungen gewinnen Flexibilität, regulierte Kernprozesse brauchen weiterhin harte Tests.

Quellen