Lässt sich um 09:30 vorhersagen, ob heute ein Trend Day wird (RTH Body Ratio ≥ 0,6)?
Kriterium nicht erfüllt — BSS -1.9 % [-3.6 ; -0.3], AUC 50.3 %, Accuracy 61.6 % gegen eine Base Rate von 36.2 %, n = 904 Tage pooled forward.
Kriterium: BSS > 2 und AUC ≥ 57, pooled forward über 2023–2026
| Entscheidungszeitpunkt | 09:30 New York — Bars bis t−1 komplett, Opening Print und alle Ticks der Session t vor 09:30 |
| Zielgröße | Body Ratio br = |rc − ro| / (rh − rl) ≥ 0,6 |
| Datenfenster | 2020-05-29 bis 2026-08-14 · 1607 Tages-Bars · letzter Tag 2026-08-14 |
| Walk-Forward | Dev ≤ 2022 (nur Definitionen), Test 2023 / 2024 / 2025 / 2026, expanding mit jährlichem Refit |
| Modell | L2-LogReg auf 15 vorregistrierten Set-C-Features, standardisiert auf dem Trainingsfenster; C aus innerer Validierung (letztes Trainingsjahr). Features: gap_atr, abs_gap_atr, on_range_atr, ln_on_relr, on_vol_rel, on_delta_norm, open_pos_on, on_ext_recency, pre_range_share, on_high_vs_rh1_atr, on_low_vs_rl1_atr, open_pos_va, prev_ln_relr_rth, prev_ln_relr_mean5, prev_atr5_atr20 |
| Holdout | Der PX-Holdout ab 2026-05-01 betrifft die PX-Thesen auf dem Tick-Store. Diese Studie ist ein Walk-Forward über 2023 bis 2026 auf Tagesdaten — vom User für die Regime-Runden 1 und 2 ausdrücklich so freigegeben. Jedes Testjahr wird nur aus Daten davor gerechnet; kein Fit sieht seinen eigenen Testabschnitt. |
Jede Zeile ist eine Prognose auf denselben Tagen. Base Rate, Majority und Persistence sind die Baselines; das Modell muss sie schlagen, sonst zählt es nicht.
| Zeile | Jahr | n | Base Rate % | Acc % | AUC % | Brier | BSS % |
|---|---|---|---|---|---|---|---|
| Base Rate | 2023 | 246 | 39.8 | 60.2 | 50.0 | 0.2397 | 0.0 |
| Majority | 2023 | 246 | 39.8 | 60.2 | — | — | — |
| Persistence | 2023 | 246 | 39.8 | 60.2 | 54.7 | 0.2375 | 0.9 |
| Modell (LogReg) | 2023 | 246 | 39.8 | 54.1 | 48.5 | 0.2516 | -5.0 |
| Base Rate | 2024 | 250 | 33.2 | 66.8 | 50.0 | 0.2262 | 0.0 |
| Majority | 2024 | 250 | 33.2 | 66.8 | — | — | — |
| Persistence | 2024 | 250 | 33.2 | 66.8 | 50.5 | 0.2283 | -0.9 |
| Modell (LogReg) | 2024 | 250 | 33.2 | 65.2 | 54.6 | 0.2265 | -0.1 |
| Base Rate | 2025 | 251 | 37.8 | 62.2 | 50.0 | 0.2353 | 0.0 |
| Majority | 2025 | 251 | 37.8 | 62.2 | — | — | — |
| Persistence | 2025 | 251 | 37.8 | 62.2 | 55.3 | 0.2328 | 1.0 |
| Modell (LogReg) | 2025 | 251 | 37.8 | 61.8 | 46.3 | 0.2390 | -1.6 |
| Base Rate | 2026 | 157 | 32.5 | 67.5 | 50.0 | 0.2226 | 0.0 |
| Majority | 2026 | 157 | 32.5 | 67.5 | — | — | — |
| Persistence | 2026 | 157 | 32.5 | 67.5 | 46.8 | 0.2264 | -1.7 |
| Modell (LogReg) | 2026 | 157 | 32.5 | 67.5 | 53.6 | 0.2232 | -0.3 |
| Base Rate | gesamt | 904 | 36.2 | 63.8 | 49.9 | 0.2317 | 0.0 |
| Majority | gesamt | 904 | 36.2 | 63.8 | — | — | — |
| Persistence | gesamt | 904 | 36.2 | 63.8 | 52.6 | 0.2317 | 0.0 |
| Modell (LogReg) | gesamt | 904 | 36.2 | 61.6 | 50.3 | 0.2362 | -1.9 |
Block-Bootstrap (20-Tage-Blöcke, 1000 Läufe, pooled forward): BSS-95-%-Intervall [-3.6 ; -0.3].
Konfusionsmatrix pooled: wahr 0 richtig 532 von 577, wahr 1 richtig 25 von 327 (Recall 0 = 92.2 %, Recall 1 = 7.6 %).
Gewählte Regularisierung je Refit — 2023: C = 0.1, n_train = 580 · 2024: C = 0.01, n_train = 826 · 2025: C = 0.01, n_train = 1076 · 2026: C = 0.01, n_train = 1327.
| Dezil | n | Ø p % | beobachtet % | Differenz |
|---|---|---|---|---|
| 1 | 91 | 30.7 | 41.8 | 11.1 |
| 2 | 91 | 35.2 | 29.7 | -5.5 |
| 3 | 91 | 36.8 | 30.8 | -6.1 |
| 4 | 91 | 37.8 | 39.6 | 1.7 |
| 5 | 90 | 38.8 | 40.0 | 1.2 |
| 6 | 90 | 40.0 | 33.3 | -6.6 |
| 7 | 90 | 41.3 | 37.8 | -3.5 |
| 8 | 90 | 43.0 | 31.1 | -11.9 |
| 9 | 90 | 45.7 | 36.7 | -9.0 |
| 10 | 90 | 53.4 | 41.1 | -12.3 |
Sharpness: p ≥ 0,7 an 0.0 % der Tage (n = 0), dort trifft es — % · p ≤ 0,3 an 3.2 % (n = 29), dort trifft es 58.6 %.
| Base Rate | die unbedingte Häufigkeit im Trainingsfenster, zugleich die konstante Vergleichsprognose. |
| Baseline | die Zahl, die ein Modell schlagen muss. Hier drei davon: Base Rate, Majority (immer die häufigere Klasse) und Persistence. |
| Persistence | die Prognose „heute wie gestern" — der Wert derselben Zielgröße am Vortag, in eine Rate umgerechnet. |
| BSS | Brier Skill Score: wie viel Prozent des Brier-Scores der Base-Rate-Konstante das Modell einspart. 0 heißt gleich gut, negativ heißt schlechter. |
| AUC | die Wahrscheinlichkeit, dass ein zufälliger positiver Tag höher bewertet wird als ein zufälliger negativer. 50 ist ein Münzwurf. |
| Brier | der mittlere quadratische Fehler der Wahrscheinlichkeit. Kleiner ist besser. |
| Sharpness | an wie viel Prozent der Tage das Modell etwas Deutliches sagt (p ≥ 0,7 bzw. ≤ 0,3) und wie oft es dort trifft. Ein kalibriertes Modell ohne Sharpness ist unbrauchbar. |
| Value Area | das Preisband [rval, rvah], in dem 70 % des RTH-Volumens gehandelt wurde. Hier immer das des Vortags. |
| Trend Day | ein RTH mit Body Ratio ≥ 0,6 — der Körper der Tageskerze füllt mindestens 60 % ihrer Range. |
| Body Ratio | br = |rc − ro| / (rh − rl), gerechnet auf der RTH-Session. |
| relr | RTH-Range geteilt durch den Median der 20 vorherigen RTH-Ranges. relr ≥ 1 heißt: heute ist größer als der typische der letzten vier Wochen. |
| Walk-Forward | jedes Testjahr wird aus einem Modell gerechnet, das nur Daten davor gesehen hat; das Trainingsfenster wächst mit jedem Jahr. Kein Fit sieht seinen eigenen Test. |
Die Zahlen dieses Reports werden bei jedem Publish neu gerechnet — aus data/daily-bars-*.json und data/open-features-*.json, die der Extractor aus dem Tick-Store baut.
Lauf: 1607 Tages-Bars, 0.6 s.