Schätzen der Klassenzugehörigkeitswahrscheinlichkeit zur Definition des Arbeitsbereichs von chemieinformatorischen Klassifikationsmodellen -  Miriam Mathea

Schätzen der Klassenzugehörigkeitswahrscheinlichkeit zur Definition des Arbeitsbereichs von chemieinformatorischen Klassifikationsmodellen (eBook)

eBook Download: PDF
2018 | 1. Auflage
318 Seiten
Cuvillier Verlag
978-3-7369-8722-7 (ISBN)
Systemvoraussetzungen
55,90 inkl. MwSt
  • Download sofort lieferbar
  • Zahlungsarten anzeigen
In der vorliegenden Arbeit wurden unterschiedliche Regressions- und Klassifikationstechniken hinsichtlich ihrer Fähigkeit analysiert, Klassenzugehörigkeits-Wahrscheinlichkeiten möglichst exakt schätzen zu können. Zusätzlich wurden der Effekt der Kalibrierung mittels logistischer Regression, sowie die Einflussfaktoren Korrektklassifizierungsrate, Korrelation der Daten und Datensatzgröße untersucht. Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer können verwendet werden um einen Anwendungsbereich für ein betrachtetes Klassifikations- oder Regressionsmodell zu definieren. Die Verwendung von Klassenzugehörigkeits-Wahrscheinlichkeits-schätzern zur Definition eines Anwendungsbereiches (Reject-Option) wurde verglichen mit dem Ansatz des Conformal Predictors. Das Ergebnis ist, dass alle untersuchten Techniken (Random Forests, Random Forest Regression, Support Vector Machines, Support Vector Regression, K-Nächste-Nachbarn, Partial Least Squares Discriminant Analysis, Sparse Partial Least Squares Regression, Ridge Regression, Elastic Net, Least Absolute Shrinkage and Selection Operator) mit Ausnahme der Linearen Diskriminanz Analyse, der Neuronalen Netze und des Naive Bayesian Klassifikators von der Kalibrierung mittels logistischer Regression profitieren. Die erhaltenen Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer befinden sich danach näher an der wahren Wahrscheinlichkeit. Die größten Einflussfaktoren sind die Korrektklassifizierungsrate und die Korrelation der Daten. Bei einer Vielzahl der Techniken führt eine steigende Korrektklassifizierungsrate und eine abnehmende Korrelation der Daten zu schlechteren Schätzwerten. Die Bildung von Hetero-Ensemblen führt zu stabileren Schätzwerten. Gut kalibrierte Klassenzugehörigkeits-Wahrscheinlichkeitsschätzer sind, verglichen mit dem Conformal Predictor, dazu in der Lage besonders effizient, ohne viele Objekte zu verlieren, einen Anwendungsbereich zu definieren. This study analyses several regression- and classification techniques regarding their ability to estimate class-probabilities precisely. Furthermore the effect of the calibration (with use of logistic regression) and the influence factors: accuracy, correlation structure and data-set-size were analyzed. Class-probability-estimates can be used to define an applicability domain for a regression- or classification-model. The definition of an applicability domain by using class-probability-estimates (Reject Option) was compared to the approach of the Conformal Predictors. In summary, all studied techniques (Random Forests, Random Forest Regression, Support Vector Machines, Support Vector Regression, K-Nearest-Neighbor, Partial Least Squares Discriminant Analysis, Sparse Partial Least Squares Regression, Ridge Regression, Elastic Net, Least Absolute Shrinkage and Selection Operator), except Linear Discriminant Analysis, Neural Networks and Naïve Bayesian Classifier benefit from calibration with logistic regression. The accuracy and the correlation structure have the strongest impact. The stability of class-probability-estimates improves by generating hetero-ensembles. Good calibrated class-probability-estimates are able to define an applicability domain in a very efficient way, compared to the conformal predictor.
Erscheint lt. Verlag 29.1.2018
Sprache deutsch
ISBN-10 3-7369-8722-6 / 3736987226
ISBN-13 978-3-7369-8722-7 / 9783736987227
Haben Sie eine Frage zum Produkt?
Wie bewerten Sie den Artikel?
Bitte geben Sie Ihre Bewertung ein:
Bitte geben Sie Daten ein:
PDFPDF (Wasserzeichen)
Größe: 4,8 MB

DRM: Digitales Wasserzeichen
Dieses eBook enthält ein digitales Wasser­zeichen und ist damit für Sie persona­lisiert. Bei einer missbräuch­lichen Weiter­gabe des eBooks an Dritte ist eine Rück­ver­folgung an die Quelle möglich.

Dateiformat: PDF (Portable Document Format)
Mit einem festen Seiten­layout eignet sich die PDF besonders für Fach­bücher mit Spalten, Tabellen und Abbild­ungen. Eine PDF kann auf fast allen Geräten ange­zeigt werden, ist aber für kleine Displays (Smart­phone, eReader) nur einge­schränkt geeignet.

Systemvoraussetzungen:
PC/Mac: Mit einem PC oder Mac können Sie dieses eBook lesen. Sie benötigen dafür einen PDF-Viewer - z.B. den Adobe Reader oder Adobe Digital Editions.
eReader: Dieses eBook kann mit (fast) allen eBook-Readern gelesen werden. Mit dem amazon-Kindle ist es aber nicht kompatibel.
Smartphone/Tablet: Egal ob Apple oder Android, dieses eBook können Sie lesen. Sie benötigen dafür einen PDF-Viewer - z.B. die kostenlose Adobe Digital Editions-App.

Buying eBooks from abroad
For tax law reasons we can sell eBooks just within Germany and Switzerland. Regrettably we cannot fulfill eBook-orders from other countries.