id: 6cb23b90d2624b07927d7a81d8502b92
parent_id: 84e7fedea08b44349d8c1c247f08795e
item_type: 1
item_id: ec1518e71453490f8fe5ab75cff7180c
item_updated_time: 1787405278630
title_diff: "[{\"diffs\":[[0,\"2 — \"],[-1,\"championship, eq_cc fix\"],[1,\"Batch-1 Durchbruch\"],[0,\")\"]],\"start1\":31,\"start2\":31,\"length1\":28,\"length2\":23}]"
body_diff: "[{\"diffs\":[[0,\"-22 \"],[-1,\"— championship + eq_cc fix + live adapter)\\\n\\\n> **Live: paused, g51 binary now STALE vs master** (call-model + position + eq_cc fixes + live range collection in tree; live_server rebuilt — resume = data engine now works). **Production sim reference: g51-with-fixes, all fixes uncommitted-to-live.**\\\n\\\n## Championship-Ergebnis (Idee #9, 100K Hände, 2026-08-22)\\\nStation +20.4 /\"],[1,\"abends — Batch-1-Durchbruch)\\\n\\\n> **Live: pausiert. Batch-1 (Station-Kette) verdreifacht die Championship-Performance. Voll-Sanity läuft über Nacht.**\\\n\\\n## Batch-1: Station-Kette gefixt (commits, Review 27c500f5)\\\n| Fix | Änderung |\\\n|---|---|\\\n| S1 | alpha→0-Station-Switch ENTFERNT — immer NN (Jan-Direktive); heuristische Fallback-Anker endeten bei VPIP 0.70 |\\\n| S2 | opp_looseness: sqrt-Map, clamp [0.7, 1.7] (linear saturierte bei VPIP 0.57 — alle Thresholds eingefroren im Station-Regime) |\\\n| S3 | static_fold_equity liest beobachtetes fold_to_bet (≥8 obs) statt Java-Konstanten 0.756/0.766/0.774 |\\\n| S4 | Observer.set_hero_seat: Hero aus Table-Aggregat ausgeschlossen (2 tighte Bots deflatierten Station-Tisch 0.85→0.63) |\\\n\\\n## Championship A/B (gleiche Seeds, 5×8K Hände)\\\n| Seat | Vorher | Nachher |\\\n|---|---|---|\\\n| Station | +19.1 | **−11.5** (−30.6!) |\\\n|\"],[0,\" Maniac\"],[1,\" |\"],[0,\" +5.\"],[-1,\"2 / Tag −1.1 / **G51 −1.3** / G48 −2.3 / Whale −3.1 / **G58 −4.0** / Gen3 −6.0 / Gen2 −7.8\\\n1. **Station gewinnt** — Calling Station schlägt alle smarten Bots im losen Mixed Field. Die Live-Fisch-Feld-Lücke ist messbar: zu viel Bluff in Caller, zu wenig Thin Value. DAS ist der nächste strategische Hebel (Gen 6 mirrors/rollouts oder Thin-Value-Verbesserung).\\\n2. G58 < G51 konsistent (Championship + Isolation: g51 +1.80 vs g58 +1.22 vs Gen2, selber Harness). v22-Modell = kein Promotionskandidat. Isolation-vs-Sanity Zahlenlücke (isolate ~4x höher) unverklärt — Vergleiche NUR innerhalb eines Harness.\\\n3. Generations-Ranking: G51≈G48>G58>Gen3>Gen2.\\\n\\\n## Fixes 2026-08-22 (commits)\"],[1,\"3 | +18.1 |\\\n| Tag | −0.4 | +5.1 |\\\n| **CAND** | **−2.3** | **+4.1** (#3) |\\\n| G48 | −3.7 | −6.2 |\\\n| Gen2 | −4.4 | −6.0 |\\\n\\\n**Die gesamte Station-Kante war unser geleaktes Geld.** CAND jetzt #3; Lücke zu #1: Maniac +18, Tag +5 (Aggressions-Exploitation = nächste Angriffsfläche, review F-Funde V1/V2/V4 + Gen 6).\\\n\\\n## Baselines (auf aktuellem Stand gemessen)\\\n- g48 voll: Championship CAND(g48) −2.34, Station +19.1; Gate 3 Gen2 +0.4/Gen3 +0.5/Nit +0.2, G48/TAG-Ties; Gate 6 (nach Harness-Fix nachholen)\\\n- g51 vor Batch-1: CAND +0.31, Station +17.2 (konsistent mit g48-Run)\\\n- Station-Specialist (1 Seed, vor Batch-1): g51 **+60.2 BB/100** vs 8×Station — reines Station-Feld war nie das Problem, die Mixtisch-Adaption war es (S2/S4 bestätigt)\\\n\\\n## Heute weitere Landungen\"],[0,\"\\\n- \"],[-1,\"**\"],[0,\"eq_c\"]],\"start1\":31,\"start2\":31,\"length1\":1075,\"length2\":1644},{\"diffs\":[[0,\"nish\"],[-1,\"** (decision_math): equity_vs_continue war Current-Board-hs → Flush-Draws = High Card am Turn → jedes Paar pass den Gate. Jetzt E[river hs] = hs(1−npot)+(1−hs)ppot. 4_5_99: Flop-Check + Delayed-Turn-Bet (legitime Linie; Test jetzt konditional: Turn-Assertion nur bei echtem Flop-Cbet). 53/53 Replays, 538 Lib-Tests.\"],[1,\"-Fix (E[river hs] statt Current-Board-hs) — 4_5_99 löst sich als legitime Delayed-Cbet-Linie\\\n- Gate 5 (#1-Ziel) + Gate 6 (Format-Matrix 1v1/3v3/4v4, 10 Gegner inkl. Chump/Flock) im Sanity-Script; Gate-6-Datei-Bug gefixt (Clobber + Empty-Pass-Guard)\"],[0,\"\\\n- \"],[-1,\"**\"],[0,\"Live\"],[-1,\" \"],[1,\"-\"],[0,\"Range\"],[-1,\" \"],[1,\"-\"],[0,\"Coll\"]],\"start1\":1685,\"start2\":1685,\"length1\":339,\"length2\":270},{\"diffs\":[[0,\"tion\"],[-1,\" \"],[1,\"-\"],[0,\"Adapter\"],[-1,\"**: Gen5 puffert showdown_event-Reveals, baut Samples bei on_hand_end (~300-500/h Tag). Live-Config: range_data_path=/home/jan/gen5_data/live_history/range_data.jsonl.\"],[1,\" (Showdown-Puffer → Samples);\"],[0,\" liv\"]],\"start1\":1957,\"start2\":1957,\"length1\":183,\"length2\":45},{\"diffs\":[[0,\"uilt\"],[-1,\".\"],[0,\"\\\n- \"],[-1,\"VPID-Sensitivität 4_5_99: NEIN — Barrel war VPID-unabhängig (0.12..0.32), Wurzel war der eq_cc-Gate, nicht der Range-Read.\\\n\\\n## Status Modelle\\\n- v22 (range_v22_board): offline besser (tgtNLL 4.8447), im Spiel schlechter als v17. Ursachen-Hypothesen: calErr 0.135, nur 32.7% soft targets, Realismus-Pool ≠ Pool der Sanity-Gegner (G48/TAG sind alte Formula-Bots mit altem Call-Verhalten → Distribution-Mismatch Training-vs-Eval).\\\n- Nächster Trainingszyklus (v23): mehr Samples (Caps hoch), evtl. calErr-gewichtete Selection, gemischtes Corpus (v22 + Anteil alte Formula-Bots für Eval-Distribution).\\\n\\\n## Punkte 1-6 (2026-08-21, kompakt)\\\n- Call-Model-Fix a5b6264 + Position-Ranges 7aa9ad1: Pool VPIP 0.13-0.78, Flop 86.5%, 4 Regressionstests\\\n- G48/TAG Sanity-Gates: Ties (Extended: G48 +0.36, TAG −0.33) — Gates für ALLE Kandidaten incl. g51 failend seit Fix; Policy-Entscheidung offen (≥Tie statt strikt positiv?)\\\n- v22-Zyklus: collect→oracle→per-class targets→train→g58; KQs-Test gefixt, 4_5_99 via eq_cc-Fix\\\n\\\n## Gen 6: mirrors + rollouts (Ideen f3c42f44). Station-Befund gibt Gen 6 die stärkste Begründung: strukturelle Exploitation statt Threshold-Tuning.\\\n\\\n## Key notes\\\n\"],[1,\"Championship-Gate-Baseline + volle Bestandsaufnahme g48/g51\\\n\\\n## Nächste Schritte\\\n1. Overnight: g51-batch1 Voll-Sanity (6 Gates, offizielles Bild)\\\n2. Maniac/Tag-Angriffsfläche (Batch 2 des Reviews: V1 eq_cc multiway, V2 River-Band, V4 second_barrel-Konditionierung, D1 Double-Counts)\\\n3. v23-Training (RangeNet auf neuem Pool + vielleicht calErr-Selection) — G58-Diagnose: offline besser, im Spiel schlechter; Distribution-Mismatch Trainings-Pool vs Eval-Pool\\\n4. Live-Wiederaufnahme als Datenquelle (Adapter fertig)\\\n\\\n## Key notes\\\nReview `27c500f5` | \"],[0,\"Idea\"]],\"start1\":2014,\"start2\":2014,\"length1\":1181,\"length2\":559}]"
metadata_diff: {"new":{},"deleted":[]}
encryption_cipher_text: 
encryption_applied: 0
updated_time: 2026-08-22T13:36:29.734Z
created_time: 2026-08-22T13:36:29.734Z
is_locked: 0
type_: 13