Détail historique

run_0005_gru_directional_rmsprop

Statut: run historique · protocole protocol_v2_val3m_test3m

Arch / lossgru / directionalrmsprop
Robust score0.4811Val mean - std
Folds12 / 12eligible

Synthèse du run

run_0005_gru_directional_rmsprop

gru · directional · rmsprop
Val DirAcc mean0.5240sélection
Val DirAcc std0.0428stabilité folds
Robust Val score0.4811mean - std
Econ Val scoren/apessimiste sélection v2
Val raw scoren/aavant pénalités
No-trade seuiln/apercentile confidence
Worst month Valn/apénalité transfert
Econ Test scoren/areport only
Worst month Testn/areport only
Econ DD Testn/adrawdown réel
Val BT score1.9037legacy research
Val PNL proxy2.97544diagnostic
Test DirAcc mean0.4960confirmation
Test DirAcc std0.0437stabilité folds
Gap Test-Val-0.0279alerte si très négatif
Test PNL proxy-0.50559sans frais
Test BT score-0.2170report only
Max DD proxy-3.92763diagnostic
Sharpe proxy-0.196diagnostic
Folds12/ 12
Params3533<100k

Résumé modèle

arch=gru · loss=directional · opt=rmsprop · units=20 · layers=1 · dropout=0.22 · l2=0.0002 · params=3533

Stratégieablation récurrence
NiveauL1
Succès attendugap Test-Val moins négatif que les GRU précédents
Échecnouveau GRU reproduit l'instabilité

Réflexion et direction prise

Où en est-on: meilleur officiel run_0004_cnn1d_pnl_adamw score robuste=0.5383; familles fortes: cnn1d/pnl best=0.538, mlp/directional best=0.503, tcn/directional best=0.488. Blocage: les GRU précédents n'ont pas confirmé en Test PNL. Direction choisie: ablation récurrence. Pourquoi maintenant: Ablation GRU plus petite et plus régularisée pour tester si la récurrence sur-ajuste. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: gap Test-Val moins négatif que les GRU précédents. Échec: nouveau GRU reproduit l'instabilité. Suite prévue: si échoue, déprioriser GRU jusqu'au protocole régime

Hypothèse opérationnelle

Ablation GRU plus petite et plus régularisée pour tester si la récurrence sur-ajuste.

Conclusion

WF folds=12/12; Robust Val score=0.4811; Val DirAcc mean=0.5240; Test DirAcc mean=0.4960; Val/Test PNL proxy=2.97544/-0.505592.

Ouvrir graphique loss
Loss run_0005_gru_directional_rmsprop

Folds détaillés

FoldPériode trainVal DAVal PNLTest DATest PNLEpochs
12023-10-01 00:00:00+00:00
→ 2024-09-30 18:00:00+00:00
0.50274.533390.4583-3.8138619
22023-11-01 00:00:00+00:00
→ 2024-10-31 18:00:00+00:00
0.50547.701840.4803-5.5439830
32023-12-01 00:00:00+00:00
→ 2024-11-30 18:00:00+00:00
0.4417-1.479070.51363.0824625
42024-01-01 00:00:00+00:00
→ 2024-12-31 18:00:00+00:00
0.4944-3.292720.50550.7465114
52024-02-01 00:00:00+00:00
→ 2025-01-31 18:00:00+00:00
0.5000-3.378300.49182.1831030
62024-03-01 00:00:00+00:00
→ 2025-02-28 18:00:00+00:00
0.55984.304100.52721.2147721
72024-04-01 00:00:00+00:00
→ 2025-03-31 18:00:00+00:00
0.58245.191700.59787.3697130
82024-05-01 00:00:00+00:00
→ 2025-04-30 18:00:00+00:00
0.51633.082060.50540.1767816
92024-06-01 00:00:00+00:00
→ 2025-05-31 18:00:00+00:00
0.54355.653940.4286-7.6344819
102024-07-01 00:00:00+00:00
→ 2025-06-30 18:00:00+00:00
0.60608.911120.4728-0.5654330
112024-08-01 00:00:00+00:00
→ 2025-07-31 18:00:00+00:00
0.54081.301370.4402-3.9104225
122024-09-01 00:00:00+00:00
→ 2025-08-31 18:00:00+00:00
0.49453.175880.53060.6277416

Configuration complète

{
  "arch": "gru",
  "loss": "directional",
  "optimizer": "rmsprop",
  "units": 20,
  "dropout": 0.22,
  "l2": 0.0002,
  "hypothesis": "Ablation GRU plus petite et plus régularisée pour tester si la récurrence sur-ajuste.",
  "protocol_id": "protocol_v1_walkforward_2025_signflip_train_only",
  "protocol_level": "L1",
  "research_strategy": "ablation récurrence",
  "success_criterion": "gap Test-Val moins négatif que les GRU précédents",
  "failure_criterion": "nouveau GRU reproduit l'instabilité",
  "next_implication": "si échoue, déprioriser GRU jusqu'au protocole régime",
  "research_reflection": "Où en est-on: meilleur officiel run_0004_cnn1d_pnl_adamw score robuste=0.5383; familles fortes: cnn1d/pnl best=0.538, mlp/directional best=0.503, tcn/directional best=0.488. Blocage: les GRU précédents n'ont pas confirmé en Test PNL. Direction choisie: ablation récurrence. Pourquoi maintenant: Ablation GRU plus petite et plus régularisée pour tester si la récurrence sur-ajuste. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: gap Test-Val moins négatif que les GRU précédents. Échec: nouveau GRU reproduit l'instabilité. Suite prévue: si échoue, déprioriser GRU jusqu'au protocole régime",
  "planner_priority": 64
}