BTC 5-MINUTE RESEARCH SYSTEM

Обучение

Журнал экспериментов, promotion decisions и контрольные точки.

STALEОбновлено
Активный championмодель еще не загруженаProduction probability layer
Markets в базе— snapshots сохранено
Размеченные rowsДля calibration checks
Закрытые сделки0Trading outcome sample
Runtime calibrationOFFВыключена, пока holdout не улучшится
Следующий checkpoint26h OOSSeason-05 unattended test

Контракт обучения

Quality-first promotion rules
TargetP(UP)CatBoost предсказывает только вероятность, не всю стратегию.
Главная метрикаBrier / LogLossКалибровка важнее простой row accuracy.
Trading metricCandidate precisionСмотрим rows, которые проходят edge gates, не все 2s rows.
PromotionHoldout winDeploy только если row, market и candidate metrics согласованы.
Production model обучается на labels resolved markets. Entry policy, position manager и risk agent остаются отдельными от probability layer.

Следующий эксперимент

Season-05 unattended validation
  1. Season-05 balanced profile: MIN_EDGE_UP=0.06, MIN_EDGE_DOWN=0.08, P_UP=0.60, P_DOWN=0.65, MAX_ENTRY_PRICE=0.65.
  2. Через 26 часов проверить out-of-sample: сделки, winrate, exit_regret, BUY_UP/BUY_DOWN отдельно.
  3. После 1000+ resolved markets повторить raw/6s/10s challenger experiments и grid поверх новой модели.
  4. Runtime calibration держать выключенной, пока она не улучшит Brier, logloss и entry-candidate precision на holdout.
ssh root@185.230.67.77
cd /opt/p5b
/opt/p5b/.venv/bin/python scripts/ops_check.py

Матрица challengers

Все lanes paper-only; старые профили удалены из текущего контура
LaneProbabilityEntryOpen managerRuntime
Open challenger: только shadow-метрики, runtime-выход остается детерминированным до walk-forward проверки.

Журнал экспериментов

История promotion decisions с самого начала
2026-07-07Прозрачный baseline

brownian_v0 оставался fallback probability layer, пока collector набирал первые размеченные snapshots.

archive
2026-07-07Первая валидация CatBoost

Day-01 CatBoost обучен на ранних resolved markets. Test Brier 0.1432, logloss 0.4509, accuracy 0.8003.

baseline
2026-07-08Season-03 retrain отклонен

Retrain на 204 markets оказался слабее активной модели. Calibration ухудшила метрики, поэтому модель не promoted.

rejected
2026-07-08Fresh Season-03 challenger отклонен

Challenger на 312 markets был слабее на том же split: active Brier 0.1507 против fresh model 0.1731.

rejected
2026-07-09Combined from scratch promoted

589 markets и 229k rows. Raw test Brier 0.138802, logloss 0.422469, accuracy 0.7930, ECE 0.027257, market accuracy 0.8652.

deployed
2026-07-09Challenger runner подготовлен

scripts/experiment_challengers.py сравнивает raw, 6s и 10s views, CatBoost, fine-tune, LightGBM и XGBoost candidates.

ready
2026-07-09Season-04 checkpoint: 197 markets

196 resolved markets. New CatBoost challengers не получили clean promotion; главный вывод — проверить MIN_EDGE=0.12 и ужесточить BUY_DOWN gates.

watch
2026-07-10Pre Season-05 experiment

872 resolved markets. Raw CatBoost combined from scratch выбран для Season-05; live-adjusted entry gates: UP 6%, DOWN 8%, P 60/65%, max entry 0.65.

deployed

Таблица model experiments

Champion и challengers
RunДанныеViewBrierLogLossAccuracyMarket acc.Candidate precisionРешение
brownian_v0earlyrawFallback
catboost day-01224 marketsraw0.14320.450980%Baseline
season-03 retrain204 marketsraw0.1780.530273.2%Отклонено
season-03 calibrated204 marketsraw0.24410.748864.1%Отклонено
fresh season-03312 marketsraw0.17310.512274.4%Отклонено
active before combined312 marketsraw0.15070.444376%Оставлено
combined_from_scratch589 marketsraw0.1388020.42246979.3%86.5%66.7%Deployed
catboost 10s589 markets10s0.1360330.41587479.6%85.4%81.8%Перспективно
catboost fine-tune 10s589 markets10s0.1368020.41528879.4%85.4%78.6%Challenger
current champion on S04196 marketsraw0.1506260.45716177.6%82.1%50%Оставлено
S04 raw CatBoost785 marketsraw0.1502480.45530377.6%82.1%53.3%No promote
S04 6s CatBoost785 markets6s0.1506510.45546777.6%82.1%50%No promote
S04 10s CatBoost785 markets10s0.1522980.46216377.5%82.1%59.8%Shadow
S04 LightGBM/XGBoost785 marketsraw/6s/10s0.170090.50984474.9%81.4%62.3%Rejected
pre-s05 raw CatBoost872 marketsraw0.1430490.43796379%87%77.8%Deploy S05
pre-s05 fine-tune872 marketsraw0.1427550.43821278.9%87.8%69.2%Reject
pre-s05 6s CatBoost872 markets6s0.1439030.43598878.4%86.3%72.7%Shadow
pre-s05 10s CatBoost872 markets10s0.1434640.4359878.6%86.3%62.5%Reject

Pre Season-05 checkpoint

872 resolved markets
Paper trades24
S04 Net P&L$7.63
Model choiceraw combined CatBoost
Policy choicelive-adjusted 6/8 + price cap
Promotion is a controlled Season-05 test, not proof of positive expectancy. The next 26h are out-of-sample validation.

Agent decision board

Что менять / что оставить
ModelDeploy pre-s05 rawRaw combined CatBoost: 77.8% candidate precision on S04 holdout.
EntryBalanced liveUP 6%, DOWN 8%, P 60/65%, max entry 0.65.
BUY_DOWNStill stricterDOWN requires 8% edge and P(DOWN) >= 65%.
RiskKeep blocksНе отключать consecutive-loss / cooldown gates.
ExitMonitor, not rootГлавная проблема раньше: entry quality.
NextSeason-05 OOS26h unattended test после rotate на новой базе.

Policy gate experiment

Saved-probability grid plus new-model replay
MIN_EDGESnapshot candidatesBUY decisionsTradesWinrateNet P&LDecision
Live adjusted: UP06/DOWN08 P60/65 price<=0.6579797965.8%$406.15season05
New-model replay: UP08/DOWN10 P65/70 price<=0.6533333369.7%$261.77research
Rejected strict: UP18/DOWN20 P70/80 price<=0.6544475%$40.61research
Old live 0.12/0.1324$7.63research
The strict 18/20 profile came from saved historical probabilities and was rejected after live Season-05 produced zero runtime candidates. Current validation uses the new-model replay profile: UP 6%, DOWN 8%, P 60/65, max price 0.65.

Что смотреть

Почему 80% row accuracy может не давать прибыль
Row accuracyКаждый сохраненный 2s snapshot
Market accuracyОдин финальный label на 5m market
Entry precisionТолько rows, прошедшие gates
Exit qualityP&L, regret и giveback
Модель может правильно классифицировать много легких late-market rows, но переоценивать редкие моменты, где стратегия реально входит.

Что добавлять дальше

Dashboard coverage
Data readinessResolved markets по сезонам
Side biasBUY_UP / BUY_DOWN drift
Gate funnelSnapshot -> candidate -> entry
Challenger boardRaw / 6s / 10s рядом
Это следующие панели после того, как Season-05 даст свежие метрики для эксперимента.