Eigene Screening-Listen erstellen
Sanktions- und PEP-Listen sind standardmäßig integriert. Was jedoch fehlt, sind die spezifischen Listen, die Ihr Unternehmen benötigt: branchenspezifische Personenlisten, im Bundesanzeiger oder Amtsblatt veröffentlichte Beschlüsse oder interne Blacklists. Truvali erstellt diese Listen auf drei Wegen: durch Definition einer offiziellen Quell-URL, eines News-Feeds oder durch das Hochladen eines Dokuments. In allen drei Fällen werden Namen, Aliase und Identitätsdaten extrahiert und in screeningbereite Datensätze umgewandelt.
Warum Standardlisten nicht ausreichen
Sanktions- und PEP-Listen stammen aus internationalen Quellen und sind für jeden Marktteilnehmer identisch. Die Listen, die ein Unternehmen tatsächlich benötigt, gehen jedoch oft weit darüber hinaus.
Für einen Wettanbieter sind es Funktionäre, die den Spielausgang beeinflussen könnten; für ein Zahlungsinstitut sind es risikoreiche Händler; für eine Bank die eigene Blacklist und für eine Krypto-Plattform bestimmte Wallet-Adressen. Keine dieser Listen ist käuflich erwerbbar, da sie hochspezifisch sind.
Diese Listen manuell zu pflegen, ist ineffizient: Wenn ein Beschluss im Amtsblatt veröffentlicht oder ein Kader von einem Verband bekannt gegeben wird, ist die für die manuelle Aktualisierung zuständige Person meist mit anderen Aufgaben ausgelastet.
Weg eins: Offizielle Quell-URL
Bei der Definition einer Quelle geben Sie deren URL, Sprache und Land an. Hinzu kommen drei Screening-Parameter:
- Zu verfolgendes Link-Muster. Die zu überwachenden Links der Website werden durch ein Muster eingeschränkt. Das bedeutet, dass das Screening nicht die gesamte Website erfasst, sondern gezielt auf den relevanten Bereich abzielt.
- Tiefe und Seitenlimit. Es wird festgelegt, wie viele Ebenen tief gesucht und wie viele Seiten maximal gelesen werden sollen. Das Screening ist somit klar begrenzt.
- Screening-Häufigkeit. Bestimmt, in welchem Stundenintervall die Quelle erneut ausgelesen wird.
Der Quelle werden ein Themencode und eine Voreinstellung für den Analyse-Prompt zugewiesen. Die aus der Quelle abgerufenen Inhalte werden mit diesem Prompt verarbeitet und in Datensätze umgewandelt. Zudem ist jederzeit ersichtlich, wann jede Quelle zuletzt synchronisiert wurde.
Weg zwei: News-Feed
Für das Adverse-Media-Screening wird ein News-Feed definiert: welche Keywords, welche Sprache, welches Land, wie viele Tage zurückgeschaut werden soll und wie viele Nachrichten maximal pro Seite abgerufen werden.
Die aus dem Feed eingehenden Nachrichten werden zunächst in eine Warteschlange gestellt und nach der Verarbeitung als Datensätze erfasst. Der Zeitpunkt der letzten Feed-Abfrage wird protokolliert.
Weg drei: Dokumenten-Upload
Ein Amtsblatt, ein Gerichtsurteil, ein Rundschreiben einer Regulierungsbehörde oder eine interne Liste des Unternehmens wird als Datei hochgeladen. Für den Upload wird eine Voreinstellung für den Analyse-Prompt ausgewählt und das Dokument verarbeitet. Der Status des Prozesses sowie der Abschlusszeitpunkt sind sichtbar. Auch die Rohantwort wird gespeichert, sodass nachträglich überprüft werden kann, was bei der Extraktion ausgelesen wurde.
Voreinstellungen für Analyse-Prompts
Die Extraktion ist nicht an ein starres Muster gebunden. Eine Voreinstellung für den Analyse-Prompt verfügt über einen Namen und ein Template. Das Unternehmen definiert diese Voreinstellungen nach eigenem Bedarf und verknüpft sie mit Quellen, Feeds oder Dokumenten.
Die Extraktion von Namen aus einem Amtsblattbeschluss unterscheidet sich grundlegend von der Extraktion aus einer Verbandskaderliste – die Voreinstellung trägt diesem Unterschied Rechnung.
Welche Daten ein Datensatz enthält
Jeder extrahierte Datensatz enthält weit mehr als nur einen Namen: Vorname, Nachname, Firmenname, Aliase, Geschlecht, Geburtsdatum, Geburtsjahr und Stadt. Der Datensatz wird einem Thema und einer Sanktionsbehörde zugeordnet, wobei der Ländercode der Behörde separat erfasst wird.
Dass das Geburtsjahr ein separates Feld neben dem Geburtsdatum ist, ist eine bewusste Entscheidung: In offiziellen Quellen ist oft nur das Jahr angegeben. Das Warten auf ein vollständiges Datum würde den Datensatz unbrauchbar machen.
Ein Datensatz kann sowohl als Sanktionseintrag als auch als interner Blacklist-Eintrag markiert werden. Beide fließen in denselben Screening-Prozess ein, ihre Quelle bleibt jedoch eindeutig unterscheidbar.
Integration in den Screening-Workflow
Die erstellte Liste wird nicht isoliert aufbewahrt. Sie wird beim Onboarding (KYC), beim laufenden Monitoring und in der Rule Engine im selben Workflow wie die Standardlisten ausgewertet. Im Krypto-Bereich werden auch Wallet-Adressen als eigenständige Entitäten gescreent.
Die Vorteile für Ihr Unternehmen
- Eigene Listen decken Risiken ab, die über kommerziell erwerbbare Listen hinausgehen.
- Bei der Veröffentlichung offizieller Beschlüsse muss die Liste nicht manuell aktualisiert werden; die Quelle wird automatisch neu eingelesen.
- Die ausgelesenen Rohdaten der Extraktion werden gespeichert, sodass die Liste keine Blackbox ist.
- Da Datensätze mit Aliasen und unvollständigen Geburtsdaten angereichert sind, hängt die Matching-Qualität nicht von einem einzelnen Namen ab.
Häufige Fragen
- Wie tief reicht das Screening, wenn wir eine Website-URL angeben?
- Das zu verfolgende Link-Muster, die Tiefe und die maximale Seitenzahl werden separat definiert. Das Screening erfasst nicht die gesamte Website, sondern nur den durch das Muster definierten Bereich und ist somit klar begrenzt.
- Können wir sehen, was aus dem hochgeladenen Dokument extrahiert wurde?
- Ja. Der Status des Prozesses und der Abschlusszeitpunkt sind einsehbar. Zudem wird die Rohantwort gespeichert, sodass nachträglich überprüft werden kann, was bei der Extraktion ausgelesen wurde.
- Können wir das Extraktionsmuster selbst definieren?
- Ja. Voreinstellungen für Analyse-Prompts sind Strukturen mit einem Namen und einem Template. Sie werden mit Quellen, Feeds und Dokumenten verknüpft. Diese Unterscheidung ist notwendig, da sich beispielsweise die Extraktion von Namen aus einem Amtsblatt grundlegend von der aus einer Kaderliste unterscheidet.
- Enthält ein Datensatz nur Namen?
- Nein. Es werden Vorname, Nachname, Firmenname, Aliase, Geschlecht, Geburtsdatum, Geburtsjahr und Stadt erfasst. Das Geburtsjahr ist ein separates Feld, da in offiziellen Quellen oft nur das Jahr angegeben ist.
- Vermischen sich interne Blacklists mit Sanktionseinträgen?
- Nein. Ein Datensatz kann entsprechend markiert werden und beide fließen in denselben Screening-Workflow ein. Die Quelle des Eintrags und die zugehörige Behörde bleiben jedoch stets eindeutig unterscheidbar.