Détail historique

run_0014_mlp_directional_rmsprop

Statut: run historique · protocole protocol_v4_direction_scout_val3m_test3m

Arch / lossmlp / directionalrmsprop
Robust score-2.0732Val mean - std
Folds12 / 12eligible

Synthèse du run

run_0014_mlp_directional_rmsprop

mlp · directional · rmsprop
Val DirAcc mean0.5733sélection
Val DirAcc std0.0351stabilité folds
Robust Val score0.5382mean - std
Capital score Test-58.0598gain% - 1.5×DD%
Gain Test %-9.66capital 100
Max DD Test %-32.26drawdown capital
Capital score Val14.7388seuil capital choisi sur Val
Capital seuil p0appliqué au Test capital
Calmar Test-0.299gain% / DD%
Econ Val score-2.0732ancien score éco
Val raw score1.9594avant pénalités
No-trade seuil80percentile confidence
Worst month Val-0.87119pénalité transfert
Econ Test score-29.5706report only
Worst month Test-7.37554report only
Econ DD Test-7.78726drawdown réel
Val BT score3.1342legacy research
Val PNL proxy4.89780diagnostic
Test DirAcc mean0.5327confirmation
Test DirAcc std0.0575stabilité folds
Gap Test-Val-0.0406alerte si très négatif
Test PNL proxy2.36260sans frais
Test BT score1.5199report only
Max DD proxy-4.11157diagnostic
Sharpe proxy1.252diagnostic
Folds12/ 12
Params93630<100k

Résumé modèle

arch=mlp · loss=directional · opt=rmsprop · dense=32 · layers=1 · dropout=0.28 · l2=0.0002 · scaler=robust_winsor · features=regime · win/out=120/40 · params=93630

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel run_0003_tcn_huber_adamw score sélection=23.9501; familles fortes: tcn/huber best=23.950, cnn1d/pnl best=20.013, mlp/directional best=19.343. Blocage: dégrossir l'idée longer_input_120 sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout longer_input_120: MLP stable pour tester l'idée sans architecture complexe. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout longer_input_120: MLP stable pour tester l'idée sans architecture complexe.

Conclusion

WF folds=12/12; Robust Val score=0.5382; Val DirAcc mean=0.5733; Test DirAcc mean=0.5327; Val/Test PNL proxy=4.8978/2.3626.

Ouvrir graphique loss
Loss run_0014_mlp_directional_rmsprop Validation portfolio run_0014_mlp_directional_rmspropTest portfolio run_0014_mlp_directional_rmspropCapital % Validation run_0014_mlp_directional_rmspropCapital % Test run_0014_mlp_directional_rmsprop

Folds détaillés

FoldPériode trainVal DAVal PNLTest DATest PNLEpochs
12023-10-01 00:00:00+00:00
→ 2024-09-30 18:00:00+00:00
0.55433.412460.57509.4955018
22023-11-01 00:00:00+00:00
→ 2024-10-31 18:00:00+00:00
0.5435-0.184660.58159.1794645
32023-12-01 00:00:00+00:00
→ 2024-11-30 18:00:00+00:00
0.61679.093420.5054-0.1488323
42024-01-01 00:00:00+00:00
→ 2024-12-31 18:00:00+00:00
0.60839.877600.4835-1.7655045
52024-02-01 00:00:00+00:00
→ 2025-01-31 18:00:00+00:00
0.57588.512410.4348-4.6849722
62024-03-01 00:00:00+00:00
→ 2025-02-28 18:00:00+00:00
0.51362.281260.5109-0.5323345
72024-04-01 00:00:00+00:00
→ 2025-03-31 18:00:00+00:00
0.60446.495900.4918-2.8921234
82024-05-01 00:00:00+00:00
→ 2025-04-30 18:00:00+00:00
0.5136-2.126170.57886.4511736
92024-06-01 00:00:00+00:00
→ 2025-05-31 18:00:00+00:00
0.56252.964830.56875.5147817
102024-07-01 00:00:00+00:00
→ 2025-06-30 18:00:00+00:00
0.59243.896230.63869.1871920
112024-08-01 00:00:00+00:00
→ 2025-07-31 18:00:00+00:00
0.57885.703570.56256.4982145
122024-09-01 00:00:00+00:00
→ 2025-08-31 18:00:00+00:00
0.61548.846800.4611-7.9514141

Configuration complète

{
  "scaler_mode": "robust_winsor",
  "feature_set": "regime",
  "input_window": 120,
  "output_window": 40,
  "scout_idea": "longer_input_120",
  "arch": "mlp",
  "loss": "directional",
  "optimizer": "rmsprop",
  "dense": 32,
  "dropout": 0.28,
  "l2": 0.0002,
  "hypothesis": "Scout longer_input_120: MLP stable pour tester l'idée sans architecture complexe.",
  "protocol_id": "protocol_v4_direction_scout_val3m_test3m",
  "protocol_level": "L3",
  "research_strategy": "protocole scout 4 runs/idée",
  "success_criterion": "amélioration du Test pessimiste médian ou baisse worst-month/gap",
  "failure_criterion": "Val meilleure mais Test fragile ou run isolé non répétable",
  "next_implication": "après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes",
  "research_reflection": "Où en est-on: meilleur officiel run_0003_tcn_huber_adamw score sélection=23.9501; familles fortes: tcn/huber best=23.950, cnn1d/pnl best=20.013, mlp/directional best=19.343. Blocage: dégrossir l'idée longer_input_120 sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout longer_input_120: MLP stable pour tester l'idée sans architecture complexe. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes",
  "planner_priority": 220
}