Range-Kalibrierungs-Audit 2026-08-28 — Over-Crediting bestätigt, aber EV-neutral

# Gen4 Range-Kalibrierungs-Audit — Ergebnis & Einordnung

**2026-08-28.** Ziel: Ursache des Ring-Lochs (−2 BB/100 vs Gen2 bei Gen3 UND Gen4) klären. Werkzeug: neues `range_audit_path`-Instrument (Commit 0dc9e87) — Showdown-Hände werden als gewichtetes CDF-Perzentil innerhalb der vorhergesagten Range gerankt (Board-Stärke-Ordnung). Kalibriert = U(0,1); Verzerrung = Over/Under-Crediting.

## Messergebnisse

1. **Over-Crediting ist real und massiv:** Median-Perzentil 0.04, 72.6% der Showdown-Hände im untersten Dezil, z = −12.6σ (G4 vs G2-Persönlichkeitspool, 9-max). Richtung bestätigt R9 (Gen3: engere Ranges besser) und die RangeNet-„~2x"-Erkenntnis.
2. **`scurve_floor` korrigiert marginal, monoton:** 0.05→0.15→0.30→0.50 senkt Bottom-Dezil 72.6→56.8→39.7→30.8%. Aber selbst 0.50 (halb uniform) erreicht kein Kalibrierungs-Niveau — Restfehler ist strukturell (Skalen-Mismatch: Range in Preflop-Perzentil-Raum vs Audit in Board-Stärke-Raum).
3. **Aber: EV bewegt sich NICHT:** g2/t4v5 = −1.6±0.1 über alle Floor-Varianten; Corrector allein ebenfalls −1.7. Floor ≈ globale hs-Verschiebung ≈ Threshold-Shift — beides bereits gesweept und am Plateau.

## Kern-Erkenntnis

**Marginale Kalibrierung ≠ bedingte Diskriminierung.** Das Ring-Loch ist kein Kalibrierungs- sondern ein Konditional-Problem: welche Hände in *dieser* Action-Sequenz. Skalare Knobs und Junk-Floors synthetisieren keine bedingte Information. Das ist exakt die Aufgabe, für die G51 gebaut wurde (RangeNet-NN-Ranges + Action-Likelihood-Corrector + eq_cc — das Gesamtpaket, nicht der Corrector allein).

## Konsequenzen

- **Gen4-final bleibt wie committed** (fl070 + Fixes, `a453c47`): schlägt Gen1 flächendeckend (+87 Duel/+28 t3/+1 9max), Gen3 überall, verliert nur gegen den ring-getunten Gen2-Bully mit ~−2. Dokumentierte Grenze heuristischer Ranges.
- **Das Ring-Loch schließt sich in Gen5**, nicht Gen4: RangeNet+Corrector+eq_cc ist der designede Weg. Das Audit (`range_audit_path`) ist das permanente Messwerkzeug dafür — RangeNet-Modelle können jetzt direkt auf Kalibrierung geprüft werden (Perzentil-Histogramm als Metrik, non-EV-Feedback).
- Audit-Infrastruktur + Persönlichkeits-Pools (G2/G3, preflop-differenziert) committed (d98de7d).

## Offen

- Skalen-Mismatch-Fix (Umrankung via flop_distributions) als Gen5/RangeNet-Input dokumentiert
- Personality-Feinschliff (echte Stations via `call_w_*`-Pfade, G2-Postflop bleibt undifferenziert — bekannt)
- Short-Stack-Messlücke (reset_bankroll blendet Stack-Tiefe aus)

id: 634b0109bf16476fa524f0d41a4e78b2
parent_id: e13f1845
created_time: 2026-08-28T08:12:12.309Z
updated_time: 2026-08-28T08:12:12.309Z
is_conflict: 0
latitude: 0.00000000
longitude: 0.00000000
altitude: 0.0000
author: 
source_url: 
is_todo: 0
todo_due: 0
todo_completed: 0
source: joplin-desktop
source_application: net.cozic.joplin-desktop
application_data: 
order: 1787904732309
user_created_time: 2026-08-28T08:12:12.309Z
user_updated_time: 2026-08-28T08:12:12.309Z
encryption_cipher_text: 
encryption_applied: 0
markup_language: 1
is_shared: 0
share_id: 
conflict_original_id: 
master_key_id: 
user_data: 
deleted_time: 0
is_locked: 0
extracted_resource_ids: 
type_: 1