Zur Community

Informatik KI – Entscheidungsbäume und Random Forest

14 KartenInformatikatrio02.10.2026Nur mit Link

Karteikarten zum Thema „Informatik“ · 14 Karten · von atrio. Beispiele: Was ist ein Entscheidungsbaum im Machine Learning? · Welche Splitting-Kriterien nutzt…

Karten

14 Karten
STANDARD

Was ist ein Entscheidungsbaum im Machine Learning?

Rückseite

Ein Entscheidungsbaum ist ein hierarchisches Modell, das Daten durch rekursive binäre Splits basierend auf Merkmalswerten in homogene Teilmengen unterteilt.

STANDARD

Welche Splitting-Kriterien nutzt ein Entscheidungsbaum bei Klassifikation?

Rückseite

Bei Klassifikation werden Gini-Impurität und Entropie (Informationsgewinn) als Splitting-Kriterien verwendet, um die Reinheit der Kindknoten zu maximieren.

STANDARD

Wie erfolgt das Splitting bei Regressionsbäumen?

Rückseite

Regressionsbäume minimieren den mittleren quadratischen Fehler (MSE) oder mittleren absoluten Fehler (MAE) in den resultierenden Kindknoten als Splitting-Kriterium.

STANDARD

Warum neigen tiefe Entscheidungsbäume zu Overfitting?

Rückseite

Tiefe Bäume memorieren Trainingsdaten bis auf Blatt-Ebene, erfassen Rauschen statt Muster und generalisieren schlecht auf unbekannte Testdaten.

STANDARD

Was bewirkt Pruning bei Entscheidungsbäumen?

Rückseite

Pruning entfernt verzweigte Knoten, die die Validierungsleistung nicht verbessern – Pre-Pruning stoppt früh, Post-Pruning kürzt nachträglich.

STANDARD

Was ist das Prinzip von Bagging bei Random Forests?

Rückseite

Bagging trainiert viele Entscheidungsbäume auf Bootstrap-Stichproben der Trainingsdaten und mittelt deren Vorhersagen zur Varianzreduktion.

STANDARD

Wie unterscheidet sich Random Forest von einem einzelnen Entscheidungsbaum?

Rückseite

Random Forest kombiniert Bagging mit zufälliger Merkmalsauswahl pro Split (Feature Subsampling), was Korrelation zwischen Bäumen reduziert und Varianz weiter senkt.

STANDARD

Welche Rolle spielt max_features im Random Forest?

Rückseite

max_features begrenzt die Anzahl zufällig gewählter Merkmale pro Split (typischerweise √p bei Klassifikation), was Baum-Korrelation verringert und Generalisierung verbessert.

STANDARD

Was ist der Out-of-Bag-Error beim Random Forest?

Rückseite

Der OOB-Error nutzt die ~37 % nicht in der Bootstrap-Stichprobe enthaltenen Samples pro Baum als interne Validierung ohne separaten Testdatensatz.

STANDARD

Wie wird Feature Importance im Random Forest berechnet?

Rückseite

Mean Decrease Impurity summiert die gewichtete Impuritätsreduktion über alle Splits eines Merkmals across all Bäume – höherer Wert bedeutet wichtigere Features.

STANDARD

Welchen Effekt hat der Hyperparameter n_estimators?

Rückseite

n_estimators legt die Anzahl der Bäume im Ensemble fest – mehr Bäume reduzieren Varianz bis zur Sättigung, erhöhen aber Rechenzeit linear.

STANDARD

Wie beeinflusst max_depth die Random-Forest-Leistung?

Rückseite

max_depth begrenzt die Tiefe einzelner Bäume – niedrige Werte verhindern Overfitting, zu hohe Werte erhöhen Korrelation zwischen Bäumen und Rechenaufwand.

STANDARD

Was ist der Hauptvorteil von Random Forest gegenüber einzelnen Bäumen?

Rückseite

Random Forests erreichen durch Ensemble-Averaging und Feature-Subsampling deutlich bessere Generalisierung und Robustheit gegen Ausreißer bei vergleichbarer Einfachheit.

STANDARD

Wann sind Random Forests gegenüber Gradient Boosting nachteilig?

Rückseite

Random Forests sind schwerer interpretierbar als einzelne Bäume, trainieren langsamer bei großen Datensätzen und erreichen oft geringere Peak-Performance als optimiertes Boosting.

Lerne diese Karten mit Spaced Repetition

Kopiere das Deck kostenlos in deine Bibliothek und starte den Lernmodus mit dem FSRS-5 Algorithmus.