Abstract zu wichtigen Aspekten von GxP-relevanter Validierung von Machine Learning-Modellen
Ein Auszug: Introduction and Objective Machine learning (ML) systems are widely used for automatic entity recognition in pharmacovigilance. Publicly...
1 Min. Lesezeit
Reiner Strauß : 12. September 2022

Juergen Dietrich, Senior Lead Data Scientist bei der Bayer AG
In allen Bereichen werden heute sog. Natural Language Processing (NLP) - Verfahren eingesetzt, die eine Extraktion und Charakterisierung von Text- und Sprachinformationen erlauben. Neben der klassischen ‚Named Entity Recognition‘ werden auch Ähnlichkeitsanalysen von Freitextinformation eingesetzt. Letzteres wird dafür benutzt, um ähnliche Inhalte in anderen Texten zu identifizieren.
Erstens: Identische Terme können unterschiedliche Bedeutung (zum Beispiel Nebenwirkung eines Medikaments, dessen Anwendungsgebiet und Begleiterkrankung). Darüber hinaus bestehen – je nach Anwendungsfall – Probleme bei der Identifizierung von Sarkasmus und Ironie. Und obwohl die aktuellen Methoden satzübergreifend Relationen (Kontext) herstellen können, ist das in einem Schritt zu verarbeitende Datenvolumen begrenzt.
Wir haben ein Trainingsdatensatz für ein KI-Modell mit einer hohen Güte und absichtlich mit unterschiedlichen Sprachtypen erzeugt. Unsere Experimente zeigen, dass neben einer Identifizierung identische Terme mit unterschiedlicher Bedeutung auch bei unterschiedlichen Sprachtypen möglich ist. Das erzeugte KI-Modell ist daher robuster, kostengünstiger und lässt sich vielseitiger einsetzen.
Ein Auszug: Introduction and Objective Machine learning (ML) systems are widely used for automatic entity recognition in pharmacovigilance. Publicly...
„Wir freuen uns darauf, mit Teilnehmenden über AI, Data Science, Digital Validation oder GxP-konforme Cloud-Lösungen zu sprechen“, so Reiner Strauß,...
Am 11. März 2026 richtet die Syncwork AG das 47. GAMP D-A-CH-Forum in Berlin aus. Die Veranstaltung dient als unabhängige Austauschplattform für die...