Lässt sich um 09:30 vorhersagen, ob heute ein Trend Day wird (RTH Body Ratio ≥ 0,6)?
Kriterium nicht erfüllt — BSS -1.2 % [-2.7 ; 0.2], AUC 52.4 %, Accuracy 62.2 % gegen eine Base Rate von 36.4 %, n = 905 Tage pooled forward.
Kriterium: BSS > 2 und AUC ≥ 57, pooled forward über 2023–2026
| Entscheidungszeitpunkt | 09:30 New York — Bars bis t−1 komplett, Opening Print und alle Ticks der Session t vor 09:30 |
| Zielgröße | Body Ratio br = |rc − ro| / (rh − rl) ≥ 0,6 |
| Datenfenster | 2020-05-29 bis 2026-08-14 · 1607 Tages-Bars · letzter Tag 2026-08-14 |
| Walk-Forward | Dev ≤ 2022 (nur Definitionen), Test 2023 / 2024 / 2025 / 2026, expanding mit jährlichem Refit |
| Modell | L2-LogReg auf 15 vorregistrierten Set-C-Features, standardisiert auf dem Trainingsfenster; C aus innerer Validierung (letztes Trainingsjahr). Features: gap_atr, abs_gap_atr, on_range_atr, ln_on_relr, on_vol_rel, on_delta_norm, open_pos_on, on_ext_recency, pre_range_share, on_high_vs_rh1_atr, on_low_vs_rl1_atr, open_pos_va, prev_ln_relr_rth, prev_ln_relr_mean5, prev_atr5_atr20 |
| Holdout | Der PX-Holdout ab 2026-05-01 betrifft die PX-Thesen auf dem Tick-Store. Diese Studie ist ein Walk-Forward über 2023 bis 2026 auf Tagesdaten — vom User für die Regime-Runden 1 und 2 ausdrücklich so freigegeben. Jedes Testjahr wird nur aus Daten davor gerechnet; kein Fit sieht seinen eigenen Testabschnitt. |
Jede Zeile ist eine Prognose auf denselben Tagen. Base Rate, Majority und Persistence sind die Baselines; das Modell muss sie schlagen, sonst zählt es nicht.
| Zeile | Jahr | n | Base Rate % | Acc % | AUC % | Brier | BSS % |
|---|---|---|---|---|---|---|---|
| Base Rate | 2023 | 248 | 39.5 | 60.5 | 50.0 | 0.2394 | 0.0 |
| Majority | 2023 | 248 | 39.5 | 60.5 | — | — | — |
| Persistence | 2023 | 248 | 39.5 | 60.5 | 45.2 | 0.2421 | -1.1 |
| Modell (LogReg) | 2023 | 248 | 39.5 | 58.5 | 52.7 | 0.2395 | -0.0 |
| Base Rate | 2024 | 251 | 37.5 | 62.5 | 50.0 | 0.2354 | 0.0 |
| Majority | 2024 | 251 | 37.5 | 62.5 | — | — | — |
| Persistence | 2024 | 251 | 37.5 | 62.5 | 52.8 | 0.2352 | 0.1 |
| Modell (LogReg) | 2024 | 251 | 37.5 | 60.2 | 51.9 | 0.2431 | -3.2 |
| Base Rate | 2025 | 251 | 33.5 | 66.5 | 50.0 | 0.2271 | 0.0 |
| Majority | 2025 | 251 | 33.5 | 66.5 | — | — | — |
| Persistence | 2025 | 251 | 33.5 | 66.5 | 53.3 | 0.2266 | 0.2 |
| Modell (LogReg) | 2025 | 251 | 33.5 | 65.7 | 49.4 | 0.2300 | -1.3 |
| Base Rate | 2026 | 155 | 34.2 | 65.8 | 50.0 | 0.2272 | 0.0 |
| Majority | 2026 | 155 | 34.2 | 65.8 | — | — | — |
| Persistence | 2026 | 155 | 34.2 | 65.8 | 52.4 | 0.2268 | 0.1 |
| Modell (LogReg) | 2026 | 155 | 34.2 | 65.8 | 53.6 | 0.2267 | 0.2 |
| Base Rate | gesamt | 905 | 36.4 | 63.6 | 52.8 | 0.2328 | 0.0 |
| Majority | gesamt | 905 | 36.4 | 63.6 | — | — | — |
| Persistence | gesamt | 905 | 36.4 | 63.6 | 50.5 | 0.2333 | -0.2 |
| Modell (LogReg) | gesamt | 905 | 36.4 | 62.2 | 52.4 | 0.2357 | -1.2 |
Block-Bootstrap (20-Tage-Blöcke, 1000 Läufe, pooled forward): BSS-95-%-Intervall [-2.7 ; 0.2].
Konfusionsmatrix pooled: wahr 0 richtig 532 von 576, wahr 1 richtig 31 von 329 (Recall 0 = 92.4 %, Recall 1 = 9.4 %).
Gewählte Regularisierung je Refit — 2023: C = 0.01, n_train = 581 · 2024: C = 1, n_train = 829 · 2025: C = 0.01, n_train = 1080 · 2026: C = 0.01, n_train = 1331.
| Dezil | n | Ø p % | beobachtet % | Differenz |
|---|---|---|---|---|
| 1 | 91 | 32.0 | 31.9 | -0.1 |
| 2 | 91 | 36.1 | 37.4 | 1.3 |
| 3 | 91 | 38.2 | 26.4 | -11.8 |
| 4 | 91 | 39.5 | 39.6 | 0.1 |
| 5 | 91 | 40.5 | 38.5 | -2.0 |
| 6 | 90 | 41.7 | 38.9 | -2.8 |
| 7 | 90 | 43.1 | 40.0 | -3.1 |
| 8 | 90 | 44.8 | 36.7 | -8.1 |
| 9 | 90 | 47.2 | 35.6 | -11.7 |
| 10 | 90 | 52.6 | 38.9 | -13.7 |
Sharpness: p ≥ 0,7 an 0.0 % der Tage (n = 0), dort trifft es — % · p ≤ 0,3 an 1.5 % (n = 14), dort trifft es 71.4 %.
| Base Rate | die unbedingte Häufigkeit im Trainingsfenster, zugleich die konstante Vergleichsprognose. |
| Baseline | die Zahl, die ein Modell schlagen muss. Hier drei davon: Base Rate, Majority (immer die häufigere Klasse) und Persistence. |
| Persistence | die Prognose „heute wie gestern" — der Wert derselben Zielgröße am Vortag, in eine Rate umgerechnet. |
| BSS | Brier Skill Score: wie viel Prozent des Brier-Scores der Base-Rate-Konstante das Modell einspart. 0 heißt gleich gut, negativ heißt schlechter. |
| AUC | die Wahrscheinlichkeit, dass ein zufälliger positiver Tag höher bewertet wird als ein zufälliger negativer. 50 ist ein Münzwurf. |
| Brier | der mittlere quadratische Fehler der Wahrscheinlichkeit. Kleiner ist besser. |
| Sharpness | an wie viel Prozent der Tage das Modell etwas Deutliches sagt (p ≥ 0,7 bzw. ≤ 0,3) und wie oft es dort trifft. Ein kalibriertes Modell ohne Sharpness ist unbrauchbar. |
| Value Area | das Preisband [rval, rvah], in dem 70 % des RTH-Volumens gehandelt wurde. Hier immer das des Vortags. |
| Trend Day | ein RTH mit Body Ratio ≥ 0,6 — der Körper der Tageskerze füllt mindestens 60 % ihrer Range. |
| Body Ratio | br = |rc − ro| / (rh − rl), gerechnet auf der RTH-Session. |
| relr | RTH-Range geteilt durch den Median der 20 vorherigen RTH-Ranges. relr ≥ 1 heißt: heute ist größer als der typische der letzten vier Wochen. |
| Walk-Forward | jedes Testjahr wird aus einem Modell gerechnet, das nur Daten davor gesehen hat; das Trainingsfenster wächst mit jedem Jahr. Kein Fit sieht seinen eigenen Test. |
Die Zahlen dieses Reports werden bei jedem Publish neu gerechnet — aus data/daily-bars-*.json und data/open-features-*.json, die der Extractor aus dem Tick-Store baut.
Lauf: 1607 Tages-Bars, 0.4 s.