Lässt sich um 09:30 vorhersagen, ob der RTH über seinem Open schließt?
Kriterium nicht erfüllt — BSS -1.3 % [-2.2 ; -0.6], AUC 46.7 %, Accuracy 49.2 % gegen eine Base Rate von 53.5 %, n = 916 Tage pooled forward.
Kriterium: BSS > 0 und Accuracy ≥ 55 %, pooled forward über 2023–2026
| Entscheidungszeitpunkt | 09:30 New York — Bars bis t−1 komplett, Opening Print und alle Ticks der Session t vor 09:30 |
| Zielgröße | rc − ro > 0 |
| Datenfenster | 2020-05-29 bis 2026-08-14 · 1607 Tages-Bars · letzter Tag 2026-08-14 |
| Walk-Forward | Dev ≤ 2022 (nur Definitionen), Test 2023 / 2024 / 2025 / 2026, expanding mit jährlichem Refit |
| Modell | L2-LogReg auf 15 vorregistrierten Set-C-Features, standardisiert auf dem Trainingsfenster; C aus innerer Validierung (letztes Trainingsjahr). Features: open_below_va, open_above_va, open_pos_va, open_dist_vah_atr, open_dist_val_atr, gap_atr, on_range_atr, on_delta_norm, open_pos_on, on_high_vs_rh1_atr, on_low_vs_rl1_atr, open_vs_on_vwap_atr, on_ext_recency, prev_ln_relr_rth, prev_box20_pos |
| Holdout | Der PX-Holdout ab 2026-05-01 betrifft die PX-Thesen auf dem Tick-Store. Diese Studie ist ein Walk-Forward über 2023 bis 2026 auf Tagesdaten — vom User für die Regime-Runden 1 und 2 ausdrücklich so freigegeben. Jedes Testjahr wird nur aus Daten davor gerechnet; kein Fit sieht seinen eigenen Testabschnitt. |
Jede Zeile ist eine Prognose auf denselben Tagen. Base Rate, Majority und Persistence sind die Baselines; das Modell muss sie schlagen, sonst zählt es nicht.
| Zeile | Jahr | n | Base Rate % | Acc % | AUC % | Brier | BSS % |
|---|---|---|---|---|---|---|---|
| Base Rate | 2023 | 252 | 57.1 | 57.1 | 50.0 | 0.2467 | 0.0 |
| Majority | 2023 | 252 | 57.1 | 57.1 | — | — | — |
| Persistence | 2023 | 252 | 57.1 | 57.1 | 49.0 | 0.2465 | 0.1 |
| Immer long | 2023 | 252 | 57.1 | 57.1 | — | — | — |
| Modell (LogReg) | 2023 | 252 | 57.1 | 46.0 | 42.8 | 0.2545 | -3.2 |
| Base Rate | 2024 | 255 | 52.5 | 52.5 | 50.0 | 0.2496 | 0.0 |
| Majority | 2024 | 255 | 52.5 | 52.5 | — | — | — |
| Persistence | 2024 | 255 | 52.5 | 52.5 | 52.3 | 0.2496 | -0.0 |
| Immer long | 2024 | 255 | 52.5 | 52.5 | — | — | — |
| Modell (LogReg) | 2024 | 255 | 52.5 | 51.4 | 49.3 | 0.2511 | -0.6 |
| Base Rate | 2025 | 252 | 51.2 | 51.2 | 50.0 | 0.2505 | 0.0 |
| Majority | 2025 | 252 | 51.2 | 51.2 | — | — | — |
| Persistence | 2025 | 252 | 51.2 | 51.2 | 52.2 | 0.2503 | 0.1 |
| Immer long | 2025 | 252 | 51.2 | 51.2 | — | — | — |
| Modell (LogReg) | 2025 | 252 | 51.2 | 49.6 | 50.1 | 0.2516 | -0.4 |
| Base Rate | 2026 | 157 | 52.9 | 52.9 | 50.0 | 0.2492 | 0.0 |
| Majority | 2026 | 157 | 52.9 | 52.9 | — | — | — |
| Persistence | 2026 | 157 | 52.9 | 52.9 | 48.8 | 0.2495 | -0.1 |
| Immer long | 2026 | 157 | 52.9 | 52.9 | — | — | — |
| Modell (LogReg) | 2026 | 157 | 52.9 | 50.3 | 43.9 | 0.2518 | -1.0 |
| Base Rate | gesamt | 916 | 53.5 | 53.5 | 48.0 | 0.2490 | 0.0 |
| Majority | gesamt | 916 | 53.5 | 53.5 | — | — | — |
| Persistence | gesamt | 916 | 53.5 | 53.5 | 49.4 | 0.2489 | 0.0 |
| Immer long | gesamt | 916 | 53.5 | 53.5 | — | — | — |
| Modell (LogReg) | gesamt | 916 | 53.5 | 49.2 | 46.7 | 0.2523 | -1.3 |
Block-Bootstrap (20-Tage-Blöcke, 1000 Läufe, pooled forward): BSS-95-%-Intervall [-2.2 ; -0.6].
Konfusionsmatrix pooled: wahr 0 richtig 35 von 426, wahr 1 richtig 416 von 490 (Recall 0 = 8.2 %, Recall 1 = 84.9 %).
Gewählte Regularisierung je Refit — 2023: C = 0.01, n_train = 588 · 2024: C = 0.01, n_train = 840 · 2025: C = 0.01, n_train = 1095 · 2026: C = 0.01, n_train = 1347.
| Dezil | n | Ø p % | beobachtet % | Differenz |
|---|---|---|---|---|
| 1 | 92 | 47.5 | 67.4 | 19.9 |
| 2 | 92 | 50.6 | 62.0 | 11.4 |
| 3 | 92 | 51.7 | 43.5 | -8.2 |
| 4 | 92 | 52.5 | 51.1 | -1.4 |
| 5 | 92 | 53.3 | 48.9 | -4.4 |
| 6 | 92 | 54.0 | 53.3 | -0.8 |
| 7 | 91 | 54.7 | 50.5 | -4.1 |
| 8 | 91 | 55.4 | 51.6 | -3.8 |
| 9 | 91 | 56.5 | 58.2 | 1.8 |
| 10 | 91 | 58.8 | 48.4 | -10.5 |
Sharpness: p ≥ 0,7 an 0.0 % der Tage (n = 0), dort trifft es — % · p ≤ 0,3 an 0.0 % (n = 0), dort trifft es — %.
| Base Rate | die unbedingte Häufigkeit im Trainingsfenster, zugleich die konstante Vergleichsprognose. |
| Baseline | die Zahl, die ein Modell schlagen muss. Hier drei davon: Base Rate, Majority (immer die häufigere Klasse) und Persistence. |
| Persistence | die Prognose „heute wie gestern" — der Wert derselben Zielgröße am Vortag, in eine Rate umgerechnet. |
| BSS | Brier Skill Score: wie viel Prozent des Brier-Scores der Base-Rate-Konstante das Modell einspart. 0 heißt gleich gut, negativ heißt schlechter. |
| AUC | die Wahrscheinlichkeit, dass ein zufälliger positiver Tag höher bewertet wird als ein zufälliger negativer. 50 ist ein Münzwurf. |
| Brier | der mittlere quadratische Fehler der Wahrscheinlichkeit. Kleiner ist besser. |
| Sharpness | an wie viel Prozent der Tage das Modell etwas Deutliches sagt (p ≥ 0,7 bzw. ≤ 0,3) und wie oft es dort trifft. Ein kalibriertes Modell ohne Sharpness ist unbrauchbar. |
| Value Area | das Preisband [rval, rvah], in dem 70 % des RTH-Volumens gehandelt wurde. Hier immer das des Vortags. |
| Trend Day | ein RTH mit Body Ratio ≥ 0,6 — der Körper der Tageskerze füllt mindestens 60 % ihrer Range. |
| Body Ratio | br = |rc − ro| / (rh − rl), gerechnet auf der RTH-Session. |
| relr | RTH-Range geteilt durch den Median der 20 vorherigen RTH-Ranges. relr ≥ 1 heißt: heute ist größer als der typische der letzten vier Wochen. |
| Walk-Forward | jedes Testjahr wird aus einem Modell gerechnet, das nur Daten davor gesehen hat; das Trainingsfenster wächst mit jedem Jahr. Kein Fit sieht seinen eigenen Test. |
Die Zahlen dieses Reports werden bei jedem Publish neu gerechnet — aus data/daily-bars-*.json und data/open-features-*.json, die der Extractor aus dem Tick-Store baut.
Lauf: 1607 Tages-Bars, 0.1 s.