Review-Log — Zulassungsarbeit

Nachtrag 2026-08-05 bis 2026-08-08: Strategiewechsel PNRB15-Fokusversion + Vault-Bereinigung

MetaWert
Datum2026-08-05 bis 2026-08-08
AuslöserUmfangsdruck (20 S. Zielmaximum) und Verteidigungsökonomie: statt breiter Quellenpalette Fokussierung auf 6 Sach-Quellen entlang des PNRB15-Random-Forest-Bogens
EntscheidungLiteraturarbeit-Modus mit 6 Sach-Quellen: BFOS84, Bre96b, Bre96a, Bre01, CBHK02, PNRB15

Gestrichene Quellen (aus Bibliografie und Vault entfernt)

  • Sha48 (Shannon 1948) — 2026-08-05: nicht als Primärquelle gelesen, Zeitstrahl-Nennung fallengelassen
  • Qui86 (Quinlan 1986, ID3) — 2026-08-06: Quinlan-Achse verworfen
  • Qui93 (Quinlan 1993, C4.5) — 2026-08-06: Quinlan-Achse verworfen
  • RS04 (Raileanu/Stoffel 2004, Gini vs. IG) — 2026-08-06: ohne Quinlan gegenstandslos

Neu aufgenommen

  • CBHK02 (Chawla et al. 2002, SMOTE) — 2026-08-06 als Grundlage für neues Kap. 4.4 (Datenvorverarbeitung)
  • Bre96b (Breiman 1996, Heuristics of Instability and Stabilization) — 2026-08-07 als Primärquelle für Instabilitäts-Beleg in Kap. 4.1 (bisher Bre96 Bagging als Sekundärverweis)

Strukturelle Änderungen im Manuskript

  • Kap. 3.6 (ID3/C4.5 nach Quinlan) — 2026-08-06 komplett gelöscht (archiviert unter E_manuskript/archiv/kap-3.6_id3-c45-quinlan_2026-08-06.tex)
  • Anhang A.3+A.4 (Information-Gain-Beispielrechnung + Vergleich) — 2026-08-06 gelöscht (archiviert unter E_manuskript/archiv/anhang_ig-teil_2026-08-06.tex)
  • Kap. 3.5 (Vergleich Gini vs. IG) — bereits vorher als Section entfernt
  • Kap. 1 Einleitung + Kap. 2.4 Zeitstrahl — 2026-08-05/06 umgeschrieben: Zwei-Linien-Struktur aufgelöst, sechs Meilensteine (BFOS84, Bre96a, Bre01, CBHK02, PNRB15) alternierend, Chawla mit -|-Pfeil zu Prytz
  • Kap. 4.4 (Datenvorverarbeitung mit SMOTE) — 2026-08-05 neu angelegt
  • Bibkey-Refactoring 2026-08-07: Bre94Bre96b (Heuristics), Bre96Bre96a (Bagging), weil beide Breiman-Werke im Jahr 1996 erscheinen (geralpha-Suffix a/b)

Vault-Bereinigung 2026-08-07/08

  • Literaturverzeichnis aufgeräumt: DOI/ISBN ins note-Feld (geralpha rendert doi/isbn-Felder nicht)
  • Block A (2026-08-08): 12 obsolete Dateien gelöscht — 4 PDFs (Sha48/Qui86/Qui93/RS04), 4 Quellen-Karten, 3 Lernmaterial-Zusammenfassungen, BSS22-Lesetagebuch
  • Block B (2026-08-08): 5 Konzept-Dokumente mit Zwei-Linien-Narrativ gelöscht — historische-verortung.md, historie-lesepfad.md, roter-faden.md, A_konzept/outline.md, A_konzept/struktur-v2.md
  • F_abgabe-Snapshots: alte Quellen-PDFs + ZIPs entfernt (werden nach Markierungslauf mit den aktuellen 6 Sach-Quellen neu befüllt)
  • Zeilenlöschung in Kap. 2 + Kap. 3 Lernphase-Highlights + Lesepläne (gestrichene Quellen entfernt, Zeitstrahl auf aktuelle 5 Meilensteine aktualisiert)

Offen

  • Block C: 9 Dateien mit obsoleten Passagen inhaltlich neu schreiben (lernmaterial/index.md, grundlagen.md, entscheidungsbäume/index.md, fachvokabular-englisch.md [nur Header], beschaffung.md, zitat-kontexte.md, zitat-index.md, quellen/BFOS84.md, quellen/Bre01.md)
  • Beleg-Verifikation Kap. 4 + Kap. 5 durch eigenes Lesen der Primärquellen (Bre96b, Bre96a, Bre01, PNRB15)

Abschluss 2026-08-01: Lernphase Kap. 2 (Grundlagen) — abgeschlossen

MetaWert
Datum2026-08-01
GegenstandFormaler Abschluss der Lernphase Kap. 2 nach Umsetzung aller relevanten Befunde aus Vollreview 2026-07-26, Kurzreview 2026-07-30 und Laien-Review 2026-08-01
Umfang IST364 Zeilen gesamt (inkl. 4 TikZ-Grafiken + Description-Liste); Fließtext ca. 130 Zeilen
ErgebnisAbschlussreif — alle drei Hoch-Befunde des Kurzreviews umgesetzt, ergänzende Laien-Optimierungen (Split-Definition, CART-Verfahren, Baumtiefe-Absatz, Caption-Entschärfung) eingespielt, Terminologie-Vereinheitlichung „Linie/Familie” → „Entwicklungen” manuskriptweit, Gedankenstriche im Fließtext entfernt
Vollständige Reports_zusammenfassung (Kurzreview); session und entscheidungen (Abschluss-Doku)

Umgesetzte Maßnahmen aus dem Kurzreview 2026-07-30

#PrioritätAktionStatus
1HochZ. 40: „Güte des Algorithmus” → „Güte des Modells”✅ umgesetzt
2HochZ. 65: Klammerverweise für CART und Ensembleverfahren; später „CART-Familie” → „CART-Verfahren”✅ umgesetzt
3HochSplit-Kriterium-Definition in 2.4 (Z. 222–226) — statt zu verschieben komplett gestrichen (Nutzerentscheidung; Fachbegriffe im Glossar)✅ umgesetzt
4MittelZ. 42–46 umformulieren (Modell nicht mehr als Lernendes) — Überanpassungs-Definition auf Option C komprimiert✅ umgesetzt
5MittelGrafik-Labels „Gini-Idx.” / „IG” ausschreiben✅ umgesetzt
6MittelBrückensatz 2.1 → 2.2 — konsistent gestrichen wie andere Übergangsabsätze⏹ abgelehnt (Konsistenz mit Meta-Text-Verzicht)
7MittelZeitstrahl-Einleitung Kap-3/4-Anker⏹ offen gelassen (Description-Liste selbst ist Auflösung; Section-Refs in Kap. 3/4 tragen den Rückverweis implizit)

Ergänzende Änderungen 2026-07-31 / 08-01

  • Fachbegriffs-Migration Phase 2: 3 Erstnennungen glossar-verlinkt (CART, Ensembleverfahren, Predictive Maintenance) + weitere Verlinkungen in der 2.4-Description-Liste. Glossar-Slug-Fix ensembleensembleverfahren (behebt broken hyperref-Link aus Kap. 1–4). Glossar-Layout: \abbreviation mit \vspace{0.6\baselineskip} zwischen Einträgen.
  • Laien-Review 2026-08-01: „CART-Familie” → „CART-Verfahren”; Split-Definition bei Erstverwendung inline ergänzt; „bekanntestes Baumverfahren” → „eines der ersten”; neuer Absatz zur Baumtiefe (kategorial vs. stetig, mit Ausblick auf Kap. 3); Caption + Fließtext-Intro von „Allgemeine Struktur” → „Beispielhafte Struktur”; überflüssiger Ref auf 2.4 nach CART entfernt.
  • Stil-Vereinheitlichung 2026-08-01: Terminologie „Linie/Familie” → „Entwicklungen” bzw. „Arbeiten von Quinlan/Breiman und Kollegen” (5 Kap.-2-Stellen, 7 gesamt manuskriptweit). Gedankenstriche --- im Fließtext manuskriptweit entfernt (Nutzer-Präferenz, neu als Memory gespeichert).

Offen (bewusst verschoben)

  • Verständnisprüfung Kap. 2 → ans Ende aller Kapitel geschoben (Grundsatz: nur verteidigen, was gelernt)
  • Zielumfang Kap. 2 → wartet auf Antwort Frau Thomm zum Umfangsmodell; Kap. 2 wurde nicht primär auf Umfang, sondern auf ontologische Präzision, Belegtreue und Laienzugänglichkeit optimiert

Detail-Entscheidungen: entscheidungen


Review 2026-07-30: Kurzreview Kap. 2 (Grundlagen)

MetaWert
Datum2026-07-30
GegenstandKap. 2 (Grundlagen) nach Autor-Überarbeitung (ontologische Präzisierung ML/Maschine/Algorithmus/Modell, Cite-Finalisierung Z. 66, Karteileichen-Streichung im Zeitstrahl)
Beteiligtewissenschaftlicher_gutachter, laien_leser, strukturkritiker, stil_redakteur (Kurzreview-Modus)
AuslöserVerifikation vor formalem Abschluss der Überarbeitung
Ergebnis⚠️ Bedingt akzeptiert — 3 Hoch-Fixes + 4 Mittel-Fixes vor Abschluss; keine strukturelle Überarbeitung nötig
Umfang IST363 Zeilen (inkl. 4 TikZ-Grafiken + Description-Liste); Fließtext ca. 155 Zeilen
Vollständige Reports_zusammenfassung

Kernbefunde

  • H1 — Z. 65–66: „CART-Familie” und „Ensembleverfahren” vorverwendet ohne Auflösung (CART erst Z. 202; Ensemble erst Kap. 4). Micro-Fix: Klammerverweise ergänzen.
  • H2 — Z. 222–226: Split-Kriterium-Definition steht mitten in 2.4 (Historische Verortung); strukturell fehl am Platz. Fix: vor die Zeitstrahl-Grafik verschieben.
  • H3 — Z. 40: „Güte des Algorithmus” bricht die ontologische Trennung (Maschine → Algorithmus → Modell). Fix: „Güte des Modells”.
  • M1–M5 — Modell-als-Lernendes (Z. 42–46), Grafik-Labels „Gini-Idx.”/„IG”, fehlender Brückensatz 2.1→2.2, Zeitstrahl-Einleitung ohne Kap-3/4-Anker, Pruning/Information-Gain vor Definition.
  • Ontologische Präzisierung in 2.2–2.4 nicht gebrochen; Karteileichen sauber gestrichen; Cite Z. 66 prüfungsfest; Description-Liste ohne Seitenzahlen ist bibliografische Nennung, kein \beleg-Bedarf.

Maßnahmen

#PrioritätAktionStatus
1HochZ. 40: „Güte des Algorithmus” → „Güte des Modells”offen
2HochZ. 65: Klammerverweise für CART und Ensembleverfahrenoffen
3HochAbsatz Z. 222–226 vor Zeitstrahl-Grafik verschiebenoffen
4MittelZ. 42–46 umformulieren (Modell → Maschine/passiv)offen
5MittelGrafik-Labels „Gini-Idx.” und „IG” ausschreibenoffen
6MittelBrückensatz zu Beginn von 2.2offen
7MittelZeitstrahl-Einleitung: „Verfahrensbausteine in Kap. 3/4 entfaltet”offen

Verteidigungssimulation Kap. 2 wie Kap. 1 an Ende der Lernphase aller Kapitel verschoben.


Review 2026-07-29: Kurzreview Kap. 1 (Einleitung) — Abschluss

MetaWert
Datum2026-07-29
GegenstandKap. 1 (Einleitung) nach vollständiger Umsetzung des Vollreviews 2026-07-28 und weiterer eigenständiger Überarbeitung durch den Autor
Beteiligtewissenschaftlicher_gutachter, laien_leser, strukturkritiker (Kurzreview-Modus)
AuslöserVerifikation nach Nutzer-Überarbeitung; Vorbereitung zum formalen Abschluss der Lernphase Kap. 1
ErgebnisAbschlussreif — 2 Micro-Fixes empfohlen und umgesetzt (Ensemble-Anker + Teilfrage-Umformulierung)
Umfang IST52 Fließtextzeilen (Start: 64, Ersparnis 12 = −19 %); SOLL weiter offen
Vollständige Reports_zusammenfassung

Kernbefunde

  • K7 — „Ensemble-Erweiterungen” in Teilfrage 1 fällt ohne Vorspur. Umgesetzt: „(Ensemble)” als Klammerbegriff in 1.1 gesetzt (laien_leser).
  • K8 — Teilfrage 2 „lässt sich überprüfen” methodisch statt ergebnisorientiert. Umgesetzt: „stellt sich dar” (wissenschaftlicher_gutachter).
  • Offen gelassen: „zwei zentrale Fragestellungen des ML” ist starke Zuschreibung — mündlich verteidigbar durch „exemplarisch”, kein Blocker.
  • Verteidigungssimulation Kap. 1 geschoben ans Ende aller Kapitel (Grundsatz: nur verteidigen, was verstanden ist).

Maßnahmen

#PrioritätAktionStatus
1MicroEnsemble-Anker in 1.1✅ umgesetzt
2MicroTeilfrage 2 auf „stellt sich dar”✅ umgesetzt
3offenVerteidigungssimulation Kap. 1 (im Rahmen der Gesamt-Verteidigungsvorbereitung)verschoben

Zwischen Vollreview 2026-07-28 und Kurzreview 2026-07-29 eigenständig umgesetzte Änderungen

  • Motivations-Absatz: unbelegte Behauptungen („ältesten”, „vielfach eingesetzten”, „weiter Verbreitung”) ersetzt durch verifizierbare Anker
  • ML-Kernfragen von drei auf zwei reduziert („Umgang mit Ungenauigkeiten” gestrichen — nicht durchgängig gedeckt)
  • Fragestellung von Titel-Umformulierung auf zwei präzise Teilfragen umgebaut
  • Quellen-Bogen-Absatz aufgelöst, ersetzt durch rückwirkende Ableitung + generische Ausklammerung (ohne konkrete Fachbegriffe)
  • „Rahmen”-Doppelung in 1.3 gefixt (→ „übergreifendes Prinzip”)

Detail-Entscheidungen: entscheidungen


Review 2026-07-28: Lernphase Kap. 1 (Einleitung)

MetaWert
Datum2026-07-28
GegenstandKap. 1 (Einleitung) — E_manuskript/latex/chapters/01_Einleitung.tex, Sektionen 1.1–1.3
Beteiligtewissenschaftlicher_gutachter, laien_leser, strukturkritiker, umfang_pruefer
AuslöserKapitel-Lernphase Kap. 1 (siehe FRAMEWORK Abschnitt 3.3)
Ergebnis⚠️ Bedingt akzeptiert — 0 Kritisch, 2 Hoch, 6 Mittel, 5 Niedrig, 4 Info
Umfang IST64 Fließtextzeilen; SOLL noch offen (Antwort Frau Thomm zum Umfangsmodell steht aus)
Vollständige Reports_zusammenfassung

Kernbefunde

  • H1 — Fragestellung nennt weiterhin „Anwendungsfelder” (Plural) im Wortlaut; die 2026-07-26 nachgeschobene Präzisierung steht als getrennter Folgesatz, nicht als Klammer in der Frage selbst (wissenschaftlicher_gutachter #1).
  • H2 — Doppelte Aufbauskizze in 1.2 Absatz 1 und 1.3 mit identischer Schlagwortliste; Redundanz kostet ca. 12–13 Zeilen (strukturkritiker #1, umfang_pruefer Vorschlag #1).
  • Ersparnispotential ohne Substanzverlust (Bündel A des Umfangs-Prüfers): 8–12 Zeilen; mit H2-Umsetzung 20–25 Zeilen.
  • Sektion 1.1 (Motivation) durchweg positiv bewertet — laienzugänglich ohne Fachvokabular.

Maßnahmen

#PrioritätAktionReviewer-ReferenzFristStatus
1HOCHKlammer-Präzisierung in Fragestellung selbst integrieren (1.2 Z. 27–29)wissenschaftlicher_gutachter #1vor Kap.-1-Freigabeoffen
2HOCHAufbauteil aus 1.2 streichen (Z. 29–42); Kapitelskizze nur noch in 1.3strukturkritiker #1 + umfang_pruefer #1vor Kap.-1-Freigabeoffen
3MITTEL„Predictive Maintenance” bei erster Nennung mit deutscher Kurzübersetzunglaien_leser #2vor Abgabeoffen
4MITTELQuellenrahmen-Absatz (1.2 Z. 44–54) auf 2–3 Sätze reduzieren, Detail in Kap. 2strukturkritiker #2 + wissenschaftlicher_gutachter #3vor Abgabeoffen
5MITTELHalbsatz zur Rechtfertigung der Fallstudien-Auswahl (PM statt Alternativen)wissenschaftlicher_gutachter #2vor Abgabeoffen
6NIEDRIG„naheliegender Untersuchungsgegenstand” → neutralere Formulierungwissenschaftlicher_gutachter #4 + umfang_pruefer #7vor Abgabeoffen
7NIEDRIGSatz „inhaltlicher Bogen …” (1.2 Z. 44–48) in zwei Sätze aufteilen (entfällt bei #4)laien_leser #5vor Abgabeoffen
8OFFENZeilenziel Kap. 1 bestimmen, sobald Umfangsmodell von Frau Thomm zurückumfang_pruefer (SOLL-Feld)wenn Antwort dawartend

Review 2026-07-26: Zahlen- und Fakten-Prüfung (zahlen_pruefer)

MetaWert
Datum2026-07-26
GegenstandBelegtreue jedes \cite-Zitats gegen die Primärquellen-PDFs (Kap. 1–6 + Kurzfassung)
Beteiligtezahlen_pruefer (neu eingeführt)
AuslöserManuelle Vorabprüfung PNRB15 mit 33 % Fehlerquote bei Seitenangaben
Ergebnis⚠️ Bedingt akzeptiert — 11 Findings (0 Kritisch, 7 Hoch, 3 Mittel, 1 Info), 41 von 49 Zitaten korrekt (84 %)
Vollständiger Reportzahlen_pruefer
Nachtrag in Zusammenfassung_zusammenfassung (Abschnitt „Nachtrag zahlen_pruefer”)

Befunde nach Quelle

QuelleZitate✗ Seite⚠ InhaltFehlerquote
PNRB151895328–44 %
BFOS8417152012 %
Qui8665010–17 %
Bre96a77000 %
Bre0177000 %
Qui9333000 %
RS0411000 %
Sha4822000 %
Summe49417314 % ✗, 6 % ⚠

Maßnahmen

#PrioritätBefundMaßnahmeFristStatus
1HOCHPNRB15 Z.31 „1000 EUR/Tag” S.140 → S.142Seitenangabe korrigierenvor Abgabeoffen
2HOCHPNRB15 Z.59 posteriore Wahrscheinlichkeit S.141 → S.142Seitenangabe korrigierenvor Abgabeoffen
3HOCHPNRB15 Z.117 SMOTE-Definition S.144 f. → S.145Seitenangabe korrigierenvor Abgabeoffen
4HOCHPNRB15 Z.166 Accuracy-Schwäche S.142 → S.144Seitenangabe korrigierenvor Abgabeoffen
5HOCHPNRB15 Z.173 Profit-Formel Gl.(3) S.142 → S.143Seitenangabe korrigierenvor Abgabeoffen
6HOCHPNRB15 Z.262 „Usage vs Wear” S.149 → S.147 oder S.148 Tab.~1Seitenangabe präzisierenvor Abgabeoffen
7HOCHBFOS84 Z.29 + Z.146 Regressionsimpurität S.216 → S.230Beide Vorkommen in 03_Funktionsprinzipien.tex korrigierenvor Abgabeoffen
8MITTELQui86 Z.27 „häufigste Klasse” S.91 → S.88 (allgemeine Regel)Präzisieren oder Formulierung auf Fallback anpassenvor Abgabeoffen
9MITTELPNRB15 Z.254 „110 EUR pro Fahrzeug und Jahr” — Zusatz „pro Jahr” ohne Beleg„pro Jahr” streichen oder als Extrapolation kennzeichnenvor Abgabeoffen
10MITTELPNRB15 Z.72 „S.141 f.” — Kernentscheidungen ausschließlich auf S.142S.~141 f.S.~142vor Abgabeoffen
11INFOPNRB15 Z.237 Balkendiagramm-Werte exakt aus Tab.~1 S.148 — mustergültigKeine — als Referenz-Beispiel behaltenerledigt

Systematisches Muster

Die fünf PNRB15-Seitenverschiebungen folgen dem Muster „Journal-Seite um 1–2 zu niedrig angegeben”, vermutlich durch Verwechslung mit PDF-interner Seitennummerierung während der Fließtext-Erstellung. Ein einziger Edit-Durchgang in 05_Anwendung.tex behebt Punkte 1–5.

Bewertung

  • Keine kritischen Findings: keine falsche Zahl, keine falsche Formel, keine verzerrte Kernaussage
  • Alle numerischen Werte des Balkendiagramms Z.237 exakt übernommen
  • Alle Formeln (Bagging, Random Forest, Gini, Information Gain, Shannon, Regressionsimpurität) notationstreu
  • Fünf Quellen (Bre96a, Bre01, Qui93, RS04, Sha48) fehlerfrei
  • Nach Umsetzung der 10 offenen Maßnahmen ist die Belegtreue der Arbeit sauber

Review 2026-07-26: Vollständige Multi-Reviewer-Prüfung (7 Reviewer)

MetaWert
Datum2026-07-26
GegenstandGesamte Zulassungsarbeit (Kurzfassung + Kap. 1–6 + Anhang)
Beteiligtewissenschaftlicher_gutachter, zitations_pruefer, stil_redakteur, formaler_pruefer, verteidigungs_pruefer, laien_leser, strukturkritiker
Ergebnis⚠️ Bedingt akzeptiert — 2 kritische Blocker, mehrere Hoch-Befunde
Vollständige Reports_zusammenfassung

Befund-Übersicht nach Schweregrad

SchwereAnzahlWo
Kritisch3formaler_pruefer (2), verteidigungs_pruefer (kritische Angriffsflächen)
Hoch~30alle Reviewer
Mittel~25überwiegend stil_redakteur + strukturkritiker + laien_leser
Niedrig~15überwiegend stil_redakteur
Info~10positive Befunde und Hinweise

Kritische Blocker (VOR ABGABE ZWINGEND)

K1 — Eigenständigkeitserklärung nicht eingebunden

  • Reviewer: formaler_pruefer #1
  • Ort: vorlage-wa.tex\input{chapters/Eigenständigkeitserklärung} fehlt
  • Aktion: Include-Zeile ergänzen (üblich vor \bibliography)

K2 — Eigenständigkeitserklärung enthält unmodifizierten Gruppenarbeits-Vorlagentext

  • Reviewer: formaler_pruefer #2
  • Ort: chapters/Eigenständigkeitserklärung.tex
  • Details: Leere Ankreuzboxen, „Autor 1, Autor 2, Autor 3”, Fremdthemen der Beispielvorlage („Warum existieren unterschiedliche Konsistenzmodelle?”), fiktive Codepakete, Vorlagen-KI-Zeilen
  • Aktion: Als Einzelarbeit reduzieren, wahrheitsgemäß befüllen, KI-Nutzung aus I_admin/ki-nutzungs-log einfließen lassen

K3 — Multiple offene Angriffsflächen für Verteidigung (siehe verteidigungs_pruefer)

Die kritischsten Prüfungsfragen (vor Abgabe im Text präzisieren oder mündlich sicher vorbereiten):

  • Gini-1912-Zitierweise (Frage 2)
  • RS04-Übertragbarkeit auf mehrdimensionale/stetige Datensätze (Frage 7)
  • Permutation Importance bei korrelierten Merkmalen (Frage 14)
  • PNRB15-Auswahlbegründung (Frage 16)
  • Fehlendes Boosting/XGBoost (Frage 20)

Hoch-Befunde nach Kapitel (Auszug)

Kap. 1 Einleitung

  • Fragestellung nennt „Anwendungsfelder” (Plural), geliefert wird eine Fallstudie (wissenschaftlicher_gutachter #1)
  • Plakative Formulierung „breiter praktischer Verbreitung” (stil_redakteur #1)
  • „Baum-Familien” → „Baumfamilien”; „Baum-Ensembles” → „Baumensembles” (stil_redakteur #6)

Kap. 2 Grundlagen

  • „Maschinen trainieren” ist Personifizierung → „Modelle trainieren” (stil_redakteur #8)
  • Zeitstrahl-Farbcode in Caption erklären (laien_leser #5)
  • Beschreibungsliste: Fachbegriffe werden ohne Erklärung genannt (laien_leser #6)
  • Übergang Kap. 2 → Kap. 3 fehlt (strukturkritiker #5)
  • Abbildungshäufung: 4 Abbildungen in Kap. 2, keine in Kap. 5 (strukturkritiker #7) — fig:baum-regression streichen

Kap. 3 Funktionsprinzipien

  • Reihenfolge 3.3 (Regression) durchbricht Klassifikationsfaden (strukturkritiker #1) → hinter 3.6 verschieben
  • MSE-Impurität in 3.2 UND 3.3 belegt (strukturkritiker #2)
  • ID3 im binären Rahmen ohne Rechtfertigung (wissenschaftlicher_gutachter #3)
  • Übersprungener algebraischer Zwischenschritt Gini-Doppelsumme → Quadratsumme (laien_leser #1)
  • Post-Pruning ohne Cost-Complexity-α-Formel (wissenschaftlicher_gutachter #7)
  • „mündet” (plakativ) in 2.4 (stil_redakteur #2)
  • „sortenrein” ist Umgangssprache (stil_redakteur #11)
  • „praktisch entscheidende Frage” (stil_redakteur #18)

Kap. 4 Ensembleverfahren

  • Datei/Include-Mismatch: 04_Anwendungen.tex enthält „Ensembleverfahren” (strukturkritiker #3) → umbenennen
  • Permutation Importance doppelt in 4.3 und 4.4 (strukturkritiker #8)
  • Notationsbruch m (Text) vs. M (Abbildung 4.2) (laien_leser #10, strukturkritiker #9)
  • „Bäume treffen Entscheidungen” personifiziert (stil_redakteur #3)
  • Ho 1995 / Amit-Geman 1997 als Vorläufer nicht erwähnt (wissenschaftlicher_gutachter #5)

Kap. 5 Anwendung PM

  • Kein einziges Bild trotz 113 Fließtextzeilen (bereits bekannter offener Punkt)
  • Symbol f in Dichteintegral nicht eingeführt (laien_leser #2)
  • Abkürzungen ECUR/CPR/TP/FP unerklärt (laien_leser #3)
  • /Precision/Accuracy unerklärt (laien_leser #4)
  • Wrapper/Filter-Dichotomie ohne Einführung (laien_leser #12)
  • Anwendungsdomänen-Übersicht fehlt (Konzept 5.1) (strukturkritiker #4)
  • Übergang Kap. 5 → Kap. 6 fehlt (strukturkritiker #6)

Kap. 6 Zusammenfassung

  • Unzulässige Generalisierung „relativiert die Annahme, dass Domänenwissen unverzichtbar sei” — n=1-Studie (wissenschaftlicher_gutachter #2)
  • RS04-Randbedingungen fehlen (wissenschaftlicher_gutachter #4)

Kurzfassung

  • 98%-Befund ohne Qualifikation der RS04-Randbedingungen (wissenschaftlicher_gutachter #4)

Zitationsapparat — sauber

Positiver Gesamtbefund vom zitations_pruefer:

  • Drei-Wege-Konsistenz (BibKey ↔ \cite ↔ Bibliografie) vollständig
  • ~- und f./ff.-Konventionen durchgehend eingehalten
  • Kein Sekundärzitat-Verstoß
  • Alle 8 Bibkey-Einträge werden zitiert, keine Karteileichen
  • Gini-1912-Fußnote transparent gemacht

Offen: Kompletter M-Marker-Durchgang (bekannt, in der Finalphase).


Konsistenz-Befunde (überwiegend stil_redakteur)

Inkonsistente Schreibweisen durchgängig im Manuskript:

  • „Ensemble-Verfahren” vs. „Ensembleverfahren” → durchgängig zusammen
  • „Kandidaten-Split” vs. „Kandidatensplit” → durchgängig zusammen
  • „Sensormesswert” vs. „Sensorwerte” vs. „Sensor- und Zählerwerte” → einheitlich
  • „Feature-Importance” vs. „Permutation Importance” vs. „Merkmalswichtigkeit” → einheitlich

Weitere Anglizismen im deutschen Text:

  • „Stopping-Rules” → „Abbruchkriterien”
  • „Precision” → deutsche Entsprechung oder in Klammern
  • „Feature-Importance” → „Merkmalswichtigkeit”

Verteidigungs-Vorbereitung (25 Prüfungsfragen)

Die 25 Fragen des verteidigungs_pruefer sind separat einsehbar (Report als Task-Output). Fokus für mündliche Vorbereitung:

  • Bias/Varianz bei Bagging (Frage 11)
  • OOB-Herleitung via (1-1/N)^N → 1/e (Frage 13) — als Fußnote ins Manuskript
  • Konkavität/Symmetrie der Impurität und Konsequenz Δi ≥ 0 (Frage 4)
  • Basis-Invarianz des Information Gain (Frage 6)
  • Rechenkomplexität stetige Merkmale O(dN log N) (Frage 8)
  • Cost-Complexity-α und C4.5-Binomialgrenze mündlich formelhaft (Frage 9)
  • Bias vs. Varianz bei Bagging (Frage 11)
  • -Regel (√M) (Frage 12)

Maßnahmenplan (priorisiert)

#PrioritätAktionReviewer-Referenz
1KRITISCHEigenständigkeitserklärung einbinden + Text als Einzelarbeit befüllenformaler_pruefer #1+#2
2HOCHFragestellung 1.2 auf Singular oder Anwendungsdomänen-Übersicht in Kap. 5 einfügenwissenschaftlicher_gutachter #1, strukturkritiker #4
3HOCHDatei 04_Anwendungen.tex04_Ensembleverfahren.tex umbenennenstrukturkritiker #3
4HOCHKap. 5: Symbole/Abkürzungen (f, ECUR, CPR, TP, FP, F₁, Precision) einführenlaien_leser #2–4
5HOCHBindestrichkomposita-Konsistenz (Ensembleverfahren, Kandidatensplit, Baumfamilien, Baumensembles)stil_redakteur #4–7
6HOCHPlakative Ausdrücke entfernen („mündet”, „breit”, „praktisch”, „gewinnt”, „sortenrein”)stil_redakteur #1, 2, 11, 13, 18
7HOCHGeneralisierung in 6.1 („Domänenwissen unverzichtbar”) entschärfenwissenschaftlicher_gutachter #2
8HOCHRS04-Randbedingungen in Kurzfassung + 6.1 ergänzenwissenschaftlicher_gutachter #4
9ABGELEHNTKap. 3.3 hinter 3.6 verschiebenstrukturkritiker #1 — siehe Begründung unten
10HOCHNotation m/M/m_try in 4.3 vereinheitlichenlaien_leser #10, strukturkritiker #9
11ABGELEHNTÜbergangsabsätze Kap. 2→3 und Kap. 5→6strukturkritiker #5, #6 — siehe Begründung unten
12MITTELKreuzvalidierung + Binomial-Obergrenze verbal in 2.1/3.8 einführenlaien_leser #8
13MITTELFußnote OOB-Herleitung 1/everteidigungs_pruefer #13
14ABGELEHNTHo 1995 / Amit-Geman als RF-Vorläufer nennenwissenschaftlicher_gutachter #5 — siehe Begründung unten
15ABGELEHNTCost-Complexity α-Formel ergänzenwissenschaftlicher_gutachter #7 — siehe Begründung unten
16NIEDRIGLaTeX-Overfull-hbox-Fixes, pdf-Metadatenformaler_pruefer #5, #6
17OFFENM-Marker-Durchgang (Finalphase)zitations_pruefer
18OFFENAbbildung in Kap. 5 (Profit-Balkendiagramm oder Pipeline)bereits bekannt

Abgelehnte Reviewer-Empfehlungen mit Begründung

H8 (strukturkritiker #1): Verschiebung von Kap. 3.3 „Regressionsbäume” hinter 3.6

Empfehlung des Reviewers: Sektion 3.3 durchbricht den Klassifikationsfaden zwischen 3.2 (Impuritätsrahmen) und 3.4/3.5 (Gini/IG als Klassifikations-Kriterien). Vorschlag: 3.3 nach 3.6 (Vergleich) verschieben.

Entscheidung des Verfassers: Nicht umgesetzt.

Begründung: Der Impuritätsrahmen in 3.2 endet mit einem expliziten Vorwärtsverweis auf die Regression und der Erwähnung der mittleren quadratischen Abweichung als Regressionsimpurität. Sektion 3.3 nimmt diesen Verweis unmittelbar auf und schließt den Rahmen für beide Aufgabentypen (Klassifikation + Regression), bevor die Klassifikations-spezifischen Kriterien in 3.4/3.5 im Detail entwickelt werden. Diese Anordnung behandelt Regression nicht als Randfall, sondern als natürliche Ausdehnung des gemeinsamen Rahmens. Die Klassifikations-Kriterien 3.4/3.5 stützen sich anschließend auf den vollständig etablierten Rahmen. Die vom Reviewer gesehene Fadenunterbrechung ist inhaltlich beabsichtigt: der gemeinsame Rahmen wird zuerst geschlossen, dann werden die zwei alternativen konkreten Impuritätsfunktionen verglichen.

M1 (strukturkritiker #5+#6): Übergangsabsätze Kap. 2→3 und Kap. 5→6

Empfehlung des Reviewers: Am Ende von Kap. 2 einen Brückenabsatz zu Kap. 3 ergänzen; am Ende von Kap. 5 einen Verweis auf Kap. 6.

Entscheidung des Verfassers: Nicht umgesetzt.

Begründung: Übergangsabsätze sind strukturell die gleiche Kategorie wie die bereits bewusst gestrichenen Kapiteleinleitungen („Dieses Kapitel behandelt…”, „Nach Kapitel~X folgt in diesem Kapitel…”). Sie bringen keinen inhaltlichen Mehrwert, sondern verdoppeln die Struktur, die dem Leser bereits aus Inhaltsverzeichnis und Kapitelüberschriften ersichtlich ist. Der Verzicht auf beide Formen von Meta-Text wird konsequent gehalten.

M4 (wissenschaftlicher_gutachter #5): Ho 1995 / Amit-Geman als RF-Vorläufer nennen

Empfehlung des Reviewers: Halbsatz oder Fußnote, die Ho (Random Subspaces 1995) und Amit/Geman (geometric randomization 1997) als von Breiman selbst zitierte RF-Vorläufer erwähnt.

Entscheidung des Verfassers: Nicht umgesetzt.

Begründung: Eine namentliche Erwähnung ohne Zitat wäre unsauber und würde die Prüfungsfrage provozieren, warum diese Werke nicht als Primärquellen aufgenommen sind — beantwortbar nur nach Lektüre der Arbeiten. Eine Aufnahme als Primärquellen würde den v2-Rahmen (acht Anker) sprengen und weitere Angriffsflächen (Vollständigkeit der Vorläuferkette, Auswahlbegründung) öffnen. Der bewusst gesetzte historische Rahmen der Arbeit reicht von Sha48 bis PNRB15; eine tiefere Rekonstruktion der Randomisierungs-Vorgeschichte gehört nicht zum Untersuchungsgegenstand.

M5 (wissenschaftlicher_gutachter #7): Cost-Complexity α-Formel in 3.8 ergänzen

Empfehlung des Reviewers: Formel für das Cost-Complexity-Kriterium in 3.8 aufnehmen, Beleg BFOS84 S. 69.

Entscheidung des Verfassers: Nicht umgesetzt.

Begründung: Die für den Beleg nötige Seite BFOS84 S. 69 ist nicht in den bereits legal beschafften Zitat-Kontexten enthalten und müsste separat via Subito bestellt werden. Der Verteidigungs-Prüfer (Frage 9) hat selbst empfohlen, im Manuskript die verbale Fassung zu belassen und die Formel für die mündliche Verteidigung schriftlich vorzubereiten — genau diese Verteidigungslinie mit der ausformulierten Formel ist in I_admin/reviews/2026-07-26/verteidigungs_pruefer.md unter Frage 9 hinterlegt. Konsequenz: verbale Fassung im Text bleibt, Formel wird mündlich präsentiert.


Zusammenhänge

  • Framework: FRAMEWORK
  • Nutzer-Memory: feedback_zulassungsarbeit_stil, feedback_komposita_ohne_bindestrich, feedback_zitat_seitenangaben
  • Skill: /review-thesis