Review-Log — Zulassungsarbeit
Nachtrag 2026-08-05 bis 2026-08-08: Strategiewechsel PNRB15-Fokusversion + Vault-Bereinigung
| Meta | Wert |
|---|---|
| Datum | 2026-08-05 bis 2026-08-08 |
| Auslöser | Umfangsdruck (20 S. Zielmaximum) und Verteidigungsökonomie: statt breiter Quellenpalette Fokussierung auf 6 Sach-Quellen entlang des PNRB15-Random-Forest-Bogens |
| Entscheidung | Literaturarbeit-Modus mit 6 Sach-Quellen: BFOS84, Bre96b, Bre96a, Bre01, CBHK02, PNRB15 |
Gestrichene Quellen (aus Bibliografie und Vault entfernt)
- Sha48 (Shannon 1948) — 2026-08-05: nicht als Primärquelle gelesen, Zeitstrahl-Nennung fallengelassen
- Qui86 (Quinlan 1986, ID3) — 2026-08-06: Quinlan-Achse verworfen
- Qui93 (Quinlan 1993, C4.5) — 2026-08-06: Quinlan-Achse verworfen
- RS04 (Raileanu/Stoffel 2004, Gini vs. IG) — 2026-08-06: ohne Quinlan gegenstandslos
Neu aufgenommen
- CBHK02 (Chawla et al. 2002, SMOTE) — 2026-08-06 als Grundlage für neues Kap. 4.4 (Datenvorverarbeitung)
- Bre96b (Breiman 1996, Heuristics of Instability and Stabilization) — 2026-08-07 als Primärquelle für Instabilitäts-Beleg in Kap. 4.1 (bisher Bre96 Bagging als Sekundärverweis)
Strukturelle Änderungen im Manuskript
- Kap. 3.6 (ID3/C4.5 nach Quinlan) — 2026-08-06 komplett gelöscht (archiviert unter
E_manuskript/archiv/kap-3.6_id3-c45-quinlan_2026-08-06.tex) - Anhang A.3+A.4 (Information-Gain-Beispielrechnung + Vergleich) — 2026-08-06 gelöscht (archiviert unter
E_manuskript/archiv/anhang_ig-teil_2026-08-06.tex) - Kap. 3.5 (Vergleich Gini vs. IG) — bereits vorher als Section entfernt
- Kap. 1 Einleitung + Kap. 2.4 Zeitstrahl — 2026-08-05/06 umgeschrieben: Zwei-Linien-Struktur aufgelöst, sechs Meilensteine (BFOS84, Bre96a, Bre01, CBHK02, PNRB15) alternierend, Chawla mit
-|-Pfeil zu Prytz - Kap. 4.4 (Datenvorverarbeitung mit SMOTE) — 2026-08-05 neu angelegt
- Bibkey-Refactoring 2026-08-07:
Bre94→Bre96b(Heuristics),Bre96→Bre96a(Bagging), weil beide Breiman-Werke im Jahr 1996 erscheinen (geralpha-Suffix a/b)
Vault-Bereinigung 2026-08-07/08
- Literaturverzeichnis aufgeräumt: DOI/ISBN ins
note-Feld (geralpha rendertdoi/isbn-Felder nicht) - Block A (2026-08-08): 12 obsolete Dateien gelöscht — 4 PDFs (Sha48/Qui86/Qui93/RS04), 4 Quellen-Karten, 3 Lernmaterial-Zusammenfassungen, BSS22-Lesetagebuch
- Block B (2026-08-08): 5 Konzept-Dokumente mit Zwei-Linien-Narrativ gelöscht —
historische-verortung.md,historie-lesepfad.md,roter-faden.md,A_konzept/outline.md,A_konzept/struktur-v2.md - F_abgabe-Snapshots: alte Quellen-PDFs + ZIPs entfernt (werden nach Markierungslauf mit den aktuellen 6 Sach-Quellen neu befüllt)
- Zeilenlöschung in Kap. 2 + Kap. 3 Lernphase-Highlights + Lesepläne (gestrichene Quellen entfernt, Zeitstrahl auf aktuelle 5 Meilensteine aktualisiert)
Offen
- Block C: 9 Dateien mit obsoleten Passagen inhaltlich neu schreiben (
lernmaterial/index.md,grundlagen.md,entscheidungsbäume/index.md,fachvokabular-englisch.md[nur Header],beschaffung.md,zitat-kontexte.md,zitat-index.md,quellen/BFOS84.md,quellen/Bre01.md) - Beleg-Verifikation Kap. 4 + Kap. 5 durch eigenes Lesen der Primärquellen (Bre96b, Bre96a, Bre01, PNRB15)
Abschluss 2026-08-01: Lernphase Kap. 2 (Grundlagen) — abgeschlossen
| Meta | Wert |
|---|---|
| Datum | 2026-08-01 |
| Gegenstand | Formaler Abschluss der Lernphase Kap. 2 nach Umsetzung aller relevanten Befunde aus Vollreview 2026-07-26, Kurzreview 2026-07-30 und Laien-Review 2026-08-01 |
| Umfang IST | 364 Zeilen gesamt (inkl. 4 TikZ-Grafiken + Description-Liste); Fließtext ca. 130 Zeilen |
| Ergebnis | ✅ Abschlussreif — alle drei Hoch-Befunde des Kurzreviews umgesetzt, ergänzende Laien-Optimierungen (Split-Definition, CART-Verfahren, Baumtiefe-Absatz, Caption-Entschärfung) eingespielt, Terminologie-Vereinheitlichung „Linie/Familie” → „Entwicklungen” manuskriptweit, Gedankenstriche im Fließtext entfernt |
| Vollständige Reports | _zusammenfassung (Kurzreview); session und entscheidungen (Abschluss-Doku) |
Umgesetzte Maßnahmen aus dem Kurzreview 2026-07-30
| # | Priorität | Aktion | Status |
|---|---|---|---|
| 1 | Hoch | Z. 40: „Güte des Algorithmus” → „Güte des Modells” | ✅ umgesetzt |
| 2 | Hoch | Z. 65: Klammerverweise für CART und Ensembleverfahren; später „CART-Familie” → „CART-Verfahren” | ✅ umgesetzt |
| 3 | Hoch | Split-Kriterium-Definition in 2.4 (Z. 222–226) — statt zu verschieben komplett gestrichen (Nutzerentscheidung; Fachbegriffe im Glossar) | ✅ umgesetzt |
| 4 | Mittel | Z. 42–46 umformulieren (Modell nicht mehr als Lernendes) — Überanpassungs-Definition auf Option C komprimiert | ✅ umgesetzt |
| 5 | Mittel | Grafik-Labels „Gini-Idx.” / „IG” ausschreiben | ✅ umgesetzt |
| 6 | Mittel | Brückensatz 2.1 → 2.2 — konsistent gestrichen wie andere Übergangsabsätze | ⏹ abgelehnt (Konsistenz mit Meta-Text-Verzicht) |
| 7 | Mittel | Zeitstrahl-Einleitung Kap-3/4-Anker | ⏹ offen gelassen (Description-Liste selbst ist Auflösung; Section-Refs in Kap. 3/4 tragen den Rückverweis implizit) |
Ergänzende Änderungen 2026-07-31 / 08-01
- Fachbegriffs-Migration Phase 2: 3 Erstnennungen glossar-verlinkt (CART, Ensembleverfahren, Predictive Maintenance) + weitere Verlinkungen in der 2.4-Description-Liste. Glossar-Slug-Fix
ensemble→ensembleverfahren(behebt broken hyperref-Link aus Kap. 1–4). Glossar-Layout:\abbreviationmit\vspace{0.6\baselineskip}zwischen Einträgen. - Laien-Review 2026-08-01: „CART-Familie” → „CART-Verfahren”; Split-Definition bei Erstverwendung inline ergänzt; „bekanntestes Baumverfahren” → „eines der ersten”; neuer Absatz zur Baumtiefe (kategorial vs. stetig, mit Ausblick auf Kap. 3); Caption + Fließtext-Intro von „Allgemeine Struktur” → „Beispielhafte Struktur”; überflüssiger Ref auf 2.4 nach CART entfernt.
- Stil-Vereinheitlichung 2026-08-01: Terminologie „Linie/Familie” → „Entwicklungen” bzw. „Arbeiten von Quinlan/Breiman und Kollegen” (5 Kap.-2-Stellen, 7 gesamt manuskriptweit). Gedankenstriche
---im Fließtext manuskriptweit entfernt (Nutzer-Präferenz, neu als Memory gespeichert).
Offen (bewusst verschoben)
- Verständnisprüfung Kap. 2 → ans Ende aller Kapitel geschoben (Grundsatz: nur verteidigen, was gelernt)
- Zielumfang Kap. 2 → wartet auf Antwort Frau Thomm zum Umfangsmodell; Kap. 2 wurde nicht primär auf Umfang, sondern auf ontologische Präzision, Belegtreue und Laienzugänglichkeit optimiert
Detail-Entscheidungen: entscheidungen
Review 2026-07-30: Kurzreview Kap. 2 (Grundlagen)
| Meta | Wert |
|---|---|
| Datum | 2026-07-30 |
| Gegenstand | Kap. 2 (Grundlagen) nach Autor-Überarbeitung (ontologische Präzisierung ML/Maschine/Algorithmus/Modell, Cite-Finalisierung Z. 66, Karteileichen-Streichung im Zeitstrahl) |
| Beteiligte | wissenschaftlicher_gutachter, laien_leser, strukturkritiker, stil_redakteur (Kurzreview-Modus) |
| Auslöser | Verifikation vor formalem Abschluss der Überarbeitung |
| Ergebnis | ⚠️ Bedingt akzeptiert — 3 Hoch-Fixes + 4 Mittel-Fixes vor Abschluss; keine strukturelle Überarbeitung nötig |
| Umfang IST | 363 Zeilen (inkl. 4 TikZ-Grafiken + Description-Liste); Fließtext ca. 155 Zeilen |
| Vollständige Reports | _zusammenfassung |
Kernbefunde
- H1 — Z. 65–66: „CART-Familie” und „Ensembleverfahren” vorverwendet ohne Auflösung (CART erst Z. 202; Ensemble erst Kap. 4). Micro-Fix: Klammerverweise ergänzen.
- H2 — Z. 222–226: Split-Kriterium-Definition steht mitten in 2.4 (Historische Verortung); strukturell fehl am Platz. Fix: vor die Zeitstrahl-Grafik verschieben.
- H3 — Z. 40: „Güte des Algorithmus” bricht die ontologische Trennung (Maschine → Algorithmus → Modell). Fix: „Güte des Modells”.
- M1–M5 — Modell-als-Lernendes (Z. 42–46), Grafik-Labels „Gini-Idx.”/„IG”, fehlender Brückensatz 2.1→2.2, Zeitstrahl-Einleitung ohne Kap-3/4-Anker, Pruning/Information-Gain vor Definition.
- Ontologische Präzisierung in 2.2–2.4 nicht gebrochen; Karteileichen sauber gestrichen; Cite Z. 66 prüfungsfest; Description-Liste ohne Seitenzahlen ist bibliografische Nennung, kein
\beleg-Bedarf.
Maßnahmen
| # | Priorität | Aktion | Status |
|---|---|---|---|
| 1 | Hoch | Z. 40: „Güte des Algorithmus” → „Güte des Modells” | offen |
| 2 | Hoch | Z. 65: Klammerverweise für CART und Ensembleverfahren | offen |
| 3 | Hoch | Absatz Z. 222–226 vor Zeitstrahl-Grafik verschieben | offen |
| 4 | Mittel | Z. 42–46 umformulieren (Modell → Maschine/passiv) | offen |
| 5 | Mittel | Grafik-Labels „Gini-Idx.” und „IG” ausschreiben | offen |
| 6 | Mittel | Brückensatz zu Beginn von 2.2 | offen |
| 7 | Mittel | Zeitstrahl-Einleitung: „Verfahrensbausteine in Kap. 3/4 entfaltet” | offen |
Verteidigungssimulation Kap. 2 wie Kap. 1 an Ende der Lernphase aller Kapitel verschoben.
Review 2026-07-29: Kurzreview Kap. 1 (Einleitung) — Abschluss
| Meta | Wert |
|---|---|
| Datum | 2026-07-29 |
| Gegenstand | Kap. 1 (Einleitung) nach vollständiger Umsetzung des Vollreviews 2026-07-28 und weiterer eigenständiger Überarbeitung durch den Autor |
| Beteiligte | wissenschaftlicher_gutachter, laien_leser, strukturkritiker (Kurzreview-Modus) |
| Auslöser | Verifikation nach Nutzer-Überarbeitung; Vorbereitung zum formalen Abschluss der Lernphase Kap. 1 |
| Ergebnis | ✅ Abschlussreif — 2 Micro-Fixes empfohlen und umgesetzt (Ensemble-Anker + Teilfrage-Umformulierung) |
| Umfang IST | 52 Fließtextzeilen (Start: 64, Ersparnis 12 = −19 %); SOLL weiter offen |
| Vollständige Reports | _zusammenfassung |
Kernbefunde
- K7 — „Ensemble-Erweiterungen” in Teilfrage 1 fällt ohne Vorspur. Umgesetzt: „(Ensemble)” als Klammerbegriff in 1.1 gesetzt (laien_leser).
- K8 — Teilfrage 2 „lässt sich überprüfen” methodisch statt ergebnisorientiert. Umgesetzt: „stellt sich dar” (wissenschaftlicher_gutachter).
- Offen gelassen: „zwei zentrale Fragestellungen des ML” ist starke Zuschreibung — mündlich verteidigbar durch „exemplarisch”, kein Blocker.
- Verteidigungssimulation Kap. 1 geschoben ans Ende aller Kapitel (Grundsatz: nur verteidigen, was verstanden ist).
Maßnahmen
| # | Priorität | Aktion | Status |
|---|---|---|---|
| 1 | Micro | Ensemble-Anker in 1.1 | ✅ umgesetzt |
| 2 | Micro | Teilfrage 2 auf „stellt sich dar” | ✅ umgesetzt |
| 3 | offen | Verteidigungssimulation Kap. 1 (im Rahmen der Gesamt-Verteidigungsvorbereitung) | verschoben |
Zwischen Vollreview 2026-07-28 und Kurzreview 2026-07-29 eigenständig umgesetzte Änderungen
- Motivations-Absatz: unbelegte Behauptungen („ältesten”, „vielfach eingesetzten”, „weiter Verbreitung”) ersetzt durch verifizierbare Anker
- ML-Kernfragen von drei auf zwei reduziert („Umgang mit Ungenauigkeiten” gestrichen — nicht durchgängig gedeckt)
- Fragestellung von Titel-Umformulierung auf zwei präzise Teilfragen umgebaut
- Quellen-Bogen-Absatz aufgelöst, ersetzt durch rückwirkende Ableitung + generische Ausklammerung (ohne konkrete Fachbegriffe)
- „Rahmen”-Doppelung in 1.3 gefixt (→ „übergreifendes Prinzip”)
Detail-Entscheidungen: entscheidungen
Review 2026-07-28: Lernphase Kap. 1 (Einleitung)
| Meta | Wert |
|---|---|
| Datum | 2026-07-28 |
| Gegenstand | Kap. 1 (Einleitung) — E_manuskript/latex/chapters/01_Einleitung.tex, Sektionen 1.1–1.3 |
| Beteiligte | wissenschaftlicher_gutachter, laien_leser, strukturkritiker, umfang_pruefer |
| Auslöser | Kapitel-Lernphase Kap. 1 (siehe FRAMEWORK Abschnitt 3.3) |
| Ergebnis | ⚠️ Bedingt akzeptiert — 0 Kritisch, 2 Hoch, 6 Mittel, 5 Niedrig, 4 Info |
| Umfang IST | 64 Fließtextzeilen; SOLL noch offen (Antwort Frau Thomm zum Umfangsmodell steht aus) |
| Vollständige Reports | _zusammenfassung |
Kernbefunde
- H1 — Fragestellung nennt weiterhin „Anwendungsfelder” (Plural) im Wortlaut; die 2026-07-26 nachgeschobene Präzisierung steht als getrennter Folgesatz, nicht als Klammer in der Frage selbst (wissenschaftlicher_gutachter #1).
- H2 — Doppelte Aufbauskizze in 1.2 Absatz 1 und 1.3 mit identischer Schlagwortliste; Redundanz kostet ca. 12–13 Zeilen (strukturkritiker #1, umfang_pruefer Vorschlag #1).
- Ersparnispotential ohne Substanzverlust (Bündel A des Umfangs-Prüfers): 8–12 Zeilen; mit H2-Umsetzung 20–25 Zeilen.
- Sektion 1.1 (Motivation) durchweg positiv bewertet — laienzugänglich ohne Fachvokabular.
Maßnahmen
| # | Priorität | Aktion | Reviewer-Referenz | Frist | Status |
|---|---|---|---|---|---|
| 1 | HOCH | Klammer-Präzisierung in Fragestellung selbst integrieren (1.2 Z. 27–29) | wissenschaftlicher_gutachter #1 | vor Kap.-1-Freigabe | offen |
| 2 | HOCH | Aufbauteil aus 1.2 streichen (Z. 29–42); Kapitelskizze nur noch in 1.3 | strukturkritiker #1 + umfang_pruefer #1 | vor Kap.-1-Freigabe | offen |
| 3 | MITTEL | „Predictive Maintenance” bei erster Nennung mit deutscher Kurzübersetzung | laien_leser #2 | vor Abgabe | offen |
| 4 | MITTEL | Quellenrahmen-Absatz (1.2 Z. 44–54) auf 2–3 Sätze reduzieren, Detail in Kap. 2 | strukturkritiker #2 + wissenschaftlicher_gutachter #3 | vor Abgabe | offen |
| 5 | MITTEL | Halbsatz zur Rechtfertigung der Fallstudien-Auswahl (PM statt Alternativen) | wissenschaftlicher_gutachter #2 | vor Abgabe | offen |
| 6 | NIEDRIG | „naheliegender Untersuchungsgegenstand” → neutralere Formulierung | wissenschaftlicher_gutachter #4 + umfang_pruefer #7 | vor Abgabe | offen |
| 7 | NIEDRIG | Satz „inhaltlicher Bogen …” (1.2 Z. 44–48) in zwei Sätze aufteilen (entfällt bei #4) | laien_leser #5 | vor Abgabe | offen |
| 8 | OFFEN | Zeilenziel Kap. 1 bestimmen, sobald Umfangsmodell von Frau Thomm zurück | umfang_pruefer (SOLL-Feld) | wenn Antwort da | wartend |
Review 2026-07-26: Zahlen- und Fakten-Prüfung (zahlen_pruefer)
| Meta | Wert |
|---|---|
| Datum | 2026-07-26 |
| Gegenstand | Belegtreue jedes \cite-Zitats gegen die Primärquellen-PDFs (Kap. 1–6 + Kurzfassung) |
| Beteiligte | zahlen_pruefer (neu eingeführt) |
| Auslöser | Manuelle Vorabprüfung PNRB15 mit 33 % Fehlerquote bei Seitenangaben |
| Ergebnis | ⚠️ Bedingt akzeptiert — 11 Findings (0 Kritisch, 7 Hoch, 3 Mittel, 1 Info), 41 von 49 Zitaten korrekt (84 %) |
| Vollständiger Report | zahlen_pruefer |
| Nachtrag in Zusammenfassung | _zusammenfassung (Abschnitt „Nachtrag zahlen_pruefer”) |
Befunde nach Quelle
| Quelle | Zitate | ✓ | ✗ Seite | ⚠ Inhalt | Fehlerquote |
|---|---|---|---|---|---|
| PNRB15 | 18 | 9 | 5 | 3 | 28–44 % |
| BFOS84 | 17 | 15 | 2 | 0 | 12 % |
| Qui86 | 6 | 5 | 0 | 1 | 0–17 % |
| Bre96a | 7 | 7 | 0 | 0 | 0 % |
| Bre01 | 7 | 7 | 0 | 0 | 0 % |
| Qui93 | 3 | 3 | 0 | 0 | 0 % |
| RS04 | 1 | 1 | 0 | 0 | 0 % |
| Sha48 | 2 | 2 | 0 | 0 | 0 % |
| Summe | 49 | 41 | 7 | 3 | 14 % ✗, 6 % ⚠ |
Maßnahmen
| # | Priorität | Befund | Maßnahme | Frist | Status |
|---|---|---|---|---|---|
| 1 | HOCH | PNRB15 Z.31 „1000 EUR/Tag” S.140 → S.142 | Seitenangabe korrigieren | vor Abgabe | offen |
| 2 | HOCH | PNRB15 Z.59 posteriore Wahrscheinlichkeit S.141 → S.142 | Seitenangabe korrigieren | vor Abgabe | offen |
| 3 | HOCH | PNRB15 Z.117 SMOTE-Definition S.144 f. → S.145 | Seitenangabe korrigieren | vor Abgabe | offen |
| 4 | HOCH | PNRB15 Z.166 Accuracy-Schwäche S.142 → S.144 | Seitenangabe korrigieren | vor Abgabe | offen |
| 5 | HOCH | PNRB15 Z.173 Profit-Formel Gl.(3) S.142 → S.143 | Seitenangabe korrigieren | vor Abgabe | offen |
| 6 | HOCH | PNRB15 Z.262 „Usage vs Wear” S.149 → S.147 oder S.148 Tab.~1 | Seitenangabe präzisieren | vor Abgabe | offen |
| 7 | HOCH | BFOS84 Z.29 + Z.146 Regressionsimpurität S.216 → S.230 | Beide Vorkommen in 03_Funktionsprinzipien.tex korrigieren | vor Abgabe | offen |
| 8 | MITTEL | Qui86 Z.27 „häufigste Klasse” S.91 → S.88 (allgemeine Regel) | Präzisieren oder Formulierung auf Fallback anpassen | vor Abgabe | offen |
| 9 | MITTEL | PNRB15 Z.254 „110 EUR pro Fahrzeug und Jahr” — Zusatz „pro Jahr” ohne Beleg | „pro Jahr” streichen oder als Extrapolation kennzeichnen | vor Abgabe | offen |
| 10 | MITTEL | PNRB15 Z.72 „S.141 f.” — Kernentscheidungen ausschließlich auf S.142 | S.~141 f. → S.~142 | vor Abgabe | offen |
| 11 | INFO | PNRB15 Z.237 Balkendiagramm-Werte exakt aus Tab.~1 S.148 — mustergültig | Keine — als Referenz-Beispiel behalten | — | erledigt |
Systematisches Muster
Die fünf PNRB15-Seitenverschiebungen folgen dem Muster „Journal-Seite um 1–2 zu niedrig angegeben”, vermutlich durch Verwechslung mit PDF-interner Seitennummerierung während der Fließtext-Erstellung. Ein einziger Edit-Durchgang in 05_Anwendung.tex behebt Punkte 1–5.
Bewertung
- Keine kritischen Findings: keine falsche Zahl, keine falsche Formel, keine verzerrte Kernaussage
- Alle numerischen Werte des Balkendiagramms Z.237 exakt übernommen
- Alle Formeln (Bagging, Random Forest, Gini, Information Gain, Shannon, Regressionsimpurität) notationstreu
- Fünf Quellen (Bre96a, Bre01, Qui93, RS04, Sha48) fehlerfrei
- Nach Umsetzung der 10 offenen Maßnahmen ist die Belegtreue der Arbeit sauber
Review 2026-07-26: Vollständige Multi-Reviewer-Prüfung (7 Reviewer)
| Meta | Wert |
|---|---|
| Datum | 2026-07-26 |
| Gegenstand | Gesamte Zulassungsarbeit (Kurzfassung + Kap. 1–6 + Anhang) |
| Beteiligte | wissenschaftlicher_gutachter, zitations_pruefer, stil_redakteur, formaler_pruefer, verteidigungs_pruefer, laien_leser, strukturkritiker |
| Ergebnis | ⚠️ Bedingt akzeptiert — 2 kritische Blocker, mehrere Hoch-Befunde |
| Vollständige Reports | _zusammenfassung |
Befund-Übersicht nach Schweregrad
| Schwere | Anzahl | Wo |
|---|---|---|
| Kritisch | 3 | formaler_pruefer (2), verteidigungs_pruefer (kritische Angriffsflächen) |
| Hoch | ~30 | alle Reviewer |
| Mittel | ~25 | überwiegend stil_redakteur + strukturkritiker + laien_leser |
| Niedrig | ~15 | überwiegend stil_redakteur |
| Info | ~10 | positive Befunde und Hinweise |
Kritische Blocker (VOR ABGABE ZWINGEND)
K1 — Eigenständigkeitserklärung nicht eingebunden
- Reviewer: formaler_pruefer #1
- Ort:
vorlage-wa.tex—\input{chapters/Eigenständigkeitserklärung}fehlt - Aktion: Include-Zeile ergänzen (üblich vor
\bibliography)
K2 — Eigenständigkeitserklärung enthält unmodifizierten Gruppenarbeits-Vorlagentext
- Reviewer: formaler_pruefer #2
- Ort:
chapters/Eigenständigkeitserklärung.tex - Details: Leere Ankreuzboxen, „Autor 1, Autor 2, Autor 3”, Fremdthemen der Beispielvorlage („Warum existieren unterschiedliche Konsistenzmodelle?”), fiktive Codepakete, Vorlagen-KI-Zeilen
- Aktion: Als Einzelarbeit reduzieren, wahrheitsgemäß befüllen, KI-Nutzung aus
I_admin/ki-nutzungs-logeinfließen lassen
K3 — Multiple offene Angriffsflächen für Verteidigung (siehe verteidigungs_pruefer)
Die kritischsten Prüfungsfragen (vor Abgabe im Text präzisieren oder mündlich sicher vorbereiten):
- Gini-1912-Zitierweise (Frage 2)
- RS04-Übertragbarkeit auf mehrdimensionale/stetige Datensätze (Frage 7)
- Permutation Importance bei korrelierten Merkmalen (Frage 14)
- PNRB15-Auswahlbegründung (Frage 16)
- Fehlendes Boosting/XGBoost (Frage 20)
Hoch-Befunde nach Kapitel (Auszug)
Kap. 1 Einleitung
- Fragestellung nennt „Anwendungsfelder” (Plural), geliefert wird eine Fallstudie (wissenschaftlicher_gutachter #1)
- Plakative Formulierung „breiter praktischer Verbreitung” (stil_redakteur #1)
- „Baum-Familien” → „Baumfamilien”; „Baum-Ensembles” → „Baumensembles” (stil_redakteur #6)
Kap. 2 Grundlagen
- „Maschinen trainieren” ist Personifizierung → „Modelle trainieren” (stil_redakteur #8)
- Zeitstrahl-Farbcode in Caption erklären (laien_leser #5)
- Beschreibungsliste: Fachbegriffe werden ohne Erklärung genannt (laien_leser #6)
- Übergang Kap. 2 → Kap. 3 fehlt (strukturkritiker #5)
- Abbildungshäufung: 4 Abbildungen in Kap. 2, keine in Kap. 5 (strukturkritiker #7) —
fig:baum-regressionstreichen
Kap. 3 Funktionsprinzipien
- Reihenfolge 3.3 (Regression) durchbricht Klassifikationsfaden (strukturkritiker #1) → hinter 3.6 verschieben
- MSE-Impurität in 3.2 UND 3.3 belegt (strukturkritiker #2)
- ID3 im binären Rahmen ohne Rechtfertigung (wissenschaftlicher_gutachter #3)
- Übersprungener algebraischer Zwischenschritt Gini-Doppelsumme → Quadratsumme (laien_leser #1)
- Post-Pruning ohne Cost-Complexity-α-Formel (wissenschaftlicher_gutachter #7)
- „mündet” (plakativ) in 2.4 (stil_redakteur #2)
- „sortenrein” ist Umgangssprache (stil_redakteur #11)
- „praktisch entscheidende Frage” (stil_redakteur #18)
Kap. 4 Ensembleverfahren
- Datei/Include-Mismatch:
04_Anwendungen.texenthält „Ensembleverfahren” (strukturkritiker #3) → umbenennen - Permutation Importance doppelt in 4.3 und 4.4 (strukturkritiker #8)
- Notationsbruch
m(Text) vs.M(Abbildung 4.2) (laien_leser #10, strukturkritiker #9) - „Bäume treffen Entscheidungen” personifiziert (stil_redakteur #3)
- Ho 1995 / Amit-Geman 1997 als Vorläufer nicht erwähnt (wissenschaftlicher_gutachter #5)
Kap. 5 Anwendung PM
- Kein einziges Bild trotz 113 Fließtextzeilen (bereits bekannter offener Punkt)
- Symbol
fin Dichteintegral nicht eingeführt (laien_leser #2) - Abkürzungen ECUR/CPR/TP/FP unerklärt (laien_leser #3)
- /Precision/Accuracy unerklärt (laien_leser #4)
- Wrapper/Filter-Dichotomie ohne Einführung (laien_leser #12)
- Anwendungsdomänen-Übersicht fehlt (Konzept 5.1) (strukturkritiker #4)
- Übergang Kap. 5 → Kap. 6 fehlt (strukturkritiker #6)
Kap. 6 Zusammenfassung
- Unzulässige Generalisierung „relativiert die Annahme, dass Domänenwissen unverzichtbar sei” — n=1-Studie (wissenschaftlicher_gutachter #2)
- RS04-Randbedingungen fehlen (wissenschaftlicher_gutachter #4)
Kurzfassung
- 98%-Befund ohne Qualifikation der RS04-Randbedingungen (wissenschaftlicher_gutachter #4)
Zitationsapparat — sauber
Positiver Gesamtbefund vom zitations_pruefer:
- Drei-Wege-Konsistenz (BibKey ↔
\cite↔ Bibliografie) vollständig ~- undf./ff.-Konventionen durchgehend eingehalten- Kein Sekundärzitat-Verstoß
- Alle 8 Bibkey-Einträge werden zitiert, keine Karteileichen
- Gini-1912-Fußnote transparent gemacht
Offen: Kompletter M-Marker-Durchgang (bekannt, in der Finalphase).
Konsistenz-Befunde (überwiegend stil_redakteur)
Inkonsistente Schreibweisen durchgängig im Manuskript:
- „Ensemble-Verfahren” vs. „Ensembleverfahren” → durchgängig zusammen
- „Kandidaten-Split” vs. „Kandidatensplit” → durchgängig zusammen
- „Sensormesswert” vs. „Sensorwerte” vs. „Sensor- und Zählerwerte” → einheitlich
- „Feature-Importance” vs. „Permutation Importance” vs. „Merkmalswichtigkeit” → einheitlich
Weitere Anglizismen im deutschen Text:
- „Stopping-Rules” → „Abbruchkriterien”
- „Precision” → deutsche Entsprechung oder in Klammern
- „Feature-Importance” → „Merkmalswichtigkeit”
Verteidigungs-Vorbereitung (25 Prüfungsfragen)
Die 25 Fragen des verteidigungs_pruefer sind separat einsehbar (Report als Task-Output). Fokus für mündliche Vorbereitung:
- Bias/Varianz bei Bagging (Frage 11)
- OOB-Herleitung via
(1-1/N)^N → 1/e(Frage 13) — als Fußnote ins Manuskript - Konkavität/Symmetrie der Impurität und Konsequenz
Δi ≥ 0(Frage 4) - Basis-Invarianz des Information Gain (Frage 6)
- Rechenkomplexität stetige Merkmale
O(dN log N)(Frage 8) - Cost-Complexity-α und C4.5-Binomialgrenze mündlich formelhaft (Frage 9)
- Bias vs. Varianz bei Bagging (Frage 11)
- -Regel (√M) (Frage 12)
Maßnahmenplan (priorisiert)
| # | Priorität | Aktion | Reviewer-Referenz |
|---|---|---|---|
| 1 | KRITISCH | Eigenständigkeitserklärung einbinden + Text als Einzelarbeit befüllen | formaler_pruefer #1+#2 |
| 2 | HOCH | Fragestellung 1.2 auf Singular oder Anwendungsdomänen-Übersicht in Kap. 5 einfügen | wissenschaftlicher_gutachter #1, strukturkritiker #4 |
| 3 | HOCH | Datei 04_Anwendungen.tex → 04_Ensembleverfahren.tex umbenennen | strukturkritiker #3 |
| 4 | HOCH | Kap. 5: Symbole/Abkürzungen (f, ECUR, CPR, TP, FP, F₁, Precision) einführen | laien_leser #2–4 |
| 5 | HOCH | Bindestrichkomposita-Konsistenz (Ensembleverfahren, Kandidatensplit, Baumfamilien, Baumensembles) | stil_redakteur #4–7 |
| 6 | HOCH | Plakative Ausdrücke entfernen („mündet”, „breit”, „praktisch”, „gewinnt”, „sortenrein”) | stil_redakteur #1, 2, 11, 13, 18 |
| 7 | HOCH | Generalisierung in 6.1 („Domänenwissen unverzichtbar”) entschärfen | wissenschaftlicher_gutachter #2 |
| 8 | HOCH | RS04-Randbedingungen in Kurzfassung + 6.1 ergänzen | wissenschaftlicher_gutachter #4 |
| 9 | ABGELEHNT | Kap. 3.3 hinter 3.6 verschieben | strukturkritiker #1 — siehe Begründung unten |
| 10 | HOCH | Notation m/M/m_try in 4.3 vereinheitlichen | laien_leser #10, strukturkritiker #9 |
| 11 | ABGELEHNT | Übergangsabsätze Kap. 2→3 und Kap. 5→6 | strukturkritiker #5, #6 — siehe Begründung unten |
| 12 | MITTEL | Kreuzvalidierung + Binomial-Obergrenze verbal in 2.1/3.8 einführen | laien_leser #8 |
| 13 | MITTEL | Fußnote OOB-Herleitung 1/e | verteidigungs_pruefer #13 |
| 14 | ABGELEHNT | Ho 1995 / Amit-Geman als RF-Vorläufer nennen | wissenschaftlicher_gutachter #5 — siehe Begründung unten |
| 15 | ABGELEHNT | Cost-Complexity α-Formel ergänzen | wissenschaftlicher_gutachter #7 — siehe Begründung unten |
| 16 | NIEDRIG | LaTeX-Overfull-hbox-Fixes, pdf-Metadaten | formaler_pruefer #5, #6 |
| 17 | OFFEN | M-Marker-Durchgang (Finalphase) | zitations_pruefer |
| 18 | OFFEN | Abbildung in Kap. 5 (Profit-Balkendiagramm oder Pipeline) | bereits bekannt |
Abgelehnte Reviewer-Empfehlungen mit Begründung
H8 (strukturkritiker #1): Verschiebung von Kap. 3.3 „Regressionsbäume” hinter 3.6
Empfehlung des Reviewers: Sektion 3.3 durchbricht den Klassifikationsfaden zwischen 3.2 (Impuritätsrahmen) und 3.4/3.5 (Gini/IG als Klassifikations-Kriterien). Vorschlag: 3.3 nach 3.6 (Vergleich) verschieben.
Entscheidung des Verfassers: Nicht umgesetzt.
Begründung: Der Impuritätsrahmen in 3.2 endet mit einem expliziten Vorwärtsverweis auf die Regression und der Erwähnung der mittleren quadratischen Abweichung als Regressionsimpurität. Sektion 3.3 nimmt diesen Verweis unmittelbar auf und schließt den Rahmen für beide Aufgabentypen (Klassifikation + Regression), bevor die Klassifikations-spezifischen Kriterien in 3.4/3.5 im Detail entwickelt werden. Diese Anordnung behandelt Regression nicht als Randfall, sondern als natürliche Ausdehnung des gemeinsamen Rahmens. Die Klassifikations-Kriterien 3.4/3.5 stützen sich anschließend auf den vollständig etablierten Rahmen. Die vom Reviewer gesehene Fadenunterbrechung ist inhaltlich beabsichtigt: der gemeinsame Rahmen wird zuerst geschlossen, dann werden die zwei alternativen konkreten Impuritätsfunktionen verglichen.
M1 (strukturkritiker #5+#6): Übergangsabsätze Kap. 2→3 und Kap. 5→6
Empfehlung des Reviewers: Am Ende von Kap. 2 einen Brückenabsatz zu Kap. 3 ergänzen; am Ende von Kap. 5 einen Verweis auf Kap. 6.
Entscheidung des Verfassers: Nicht umgesetzt.
Begründung: Übergangsabsätze sind strukturell die gleiche Kategorie wie die bereits bewusst gestrichenen Kapiteleinleitungen („Dieses Kapitel behandelt…”, „Nach Kapitel~X folgt in diesem Kapitel…”). Sie bringen keinen inhaltlichen Mehrwert, sondern verdoppeln die Struktur, die dem Leser bereits aus Inhaltsverzeichnis und Kapitelüberschriften ersichtlich ist. Der Verzicht auf beide Formen von Meta-Text wird konsequent gehalten.
M4 (wissenschaftlicher_gutachter #5): Ho 1995 / Amit-Geman als RF-Vorläufer nennen
Empfehlung des Reviewers: Halbsatz oder Fußnote, die Ho (Random Subspaces 1995) und Amit/Geman (geometric randomization 1997) als von Breiman selbst zitierte RF-Vorläufer erwähnt.
Entscheidung des Verfassers: Nicht umgesetzt.
Begründung: Eine namentliche Erwähnung ohne Zitat wäre unsauber und würde die Prüfungsfrage provozieren, warum diese Werke nicht als Primärquellen aufgenommen sind — beantwortbar nur nach Lektüre der Arbeiten. Eine Aufnahme als Primärquellen würde den v2-Rahmen (acht Anker) sprengen und weitere Angriffsflächen (Vollständigkeit der Vorläuferkette, Auswahlbegründung) öffnen. Der bewusst gesetzte historische Rahmen der Arbeit reicht von Sha48 bis PNRB15; eine tiefere Rekonstruktion der Randomisierungs-Vorgeschichte gehört nicht zum Untersuchungsgegenstand.
M5 (wissenschaftlicher_gutachter #7): Cost-Complexity α-Formel in 3.8 ergänzen
Empfehlung des Reviewers: Formel für das Cost-Complexity-Kriterium in 3.8 aufnehmen, Beleg BFOS84 S. 69.
Entscheidung des Verfassers: Nicht umgesetzt.
Begründung: Die für den Beleg nötige Seite BFOS84 S. 69 ist nicht in den bereits legal beschafften Zitat-Kontexten enthalten und müsste separat via Subito bestellt werden. Der Verteidigungs-Prüfer (Frage 9) hat selbst empfohlen, im Manuskript die verbale Fassung zu belassen und die Formel für die mündliche Verteidigung schriftlich vorzubereiten — genau diese Verteidigungslinie mit der ausformulierten Formel ist in I_admin/reviews/2026-07-26/verteidigungs_pruefer.md unter Frage 9 hinterlegt. Konsequenz: verbale Fassung im Text bleibt, Formel wird mündlich präsentiert.
Zusammenhänge
- Framework: FRAMEWORK
- Nutzer-Memory:
feedback_zulassungsarbeit_stil,feedback_komposita_ohne_bindestrich,feedback_zitat_seitenangaben - Skill:
/review-thesis