Run courant

Recherche DL Quant

Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.

Runs comparables14après purge
Best robust score25.3446run_0008_res_tcn_directional_adamw
Val mean best0.6011non sélectionnant
Rendu2.8 mingénération page

Raisonnement

Introduction avant tests

Lecture mémoire: 13 runs archivés, meilleur run run_0008_res_tcn_directional_adamw avec score sélection=25.344635555032237. Research planner: Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting File d'hypothèses candidates: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.

Run courant / dernier test

run_0014_cnn1d_pnl_adamw

cnn1d · pnl · adamw
Val DirAcc mean0.5160sélection
Val DirAcc std0.0704stabilité folds
Robust Val score0.4456mean - std
Econ Val score12.6651pessimiste sélection v2
Val raw score19.2077avant pénalités
No-trade seuil80percentile confidence
Worst month Val-1.75408pénalité transfert
Econ Test score-14.0607report only
Worst month Test-2.97873report only
Econ DD Test-5.25300drawdown réel
Val BT score2.1769legacy research
Val PNL proxy4.15516diagnostic
Test DirAcc mean0.4573confirmation
Test DirAcc std0.0939stabilité folds
Gap Test-Val-0.0587alerte si très négatif
Test PNL proxy-3.18168sans frais
Test BT score-2.3627report only
Max DD proxy-11.05232diagnostic
Sharpe proxy-1.674diagnostic
Folds12/ 12
Params3049<100k

Résumé modèle

arch=cnn1d · loss=pnl · opt=adamw · conv=16/8 · kernel=5 · dropout=0.28 · l2=0.0003 · scaler=robust · params=3049

Stratégienormalisation Phase A / M6
NiveauL3
Succès attenduréduire worst-month et gap Val/Test vs baseline v3 standard
ÉchecVal meilleure mais Test/worst-month pas amélioré

Réflexion et direction prise

Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting

Hypothèse opérationnelle

Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.

Conclusion

WF folds=12/12; Robust Val score=0.4456; Val DirAcc mean=0.5160; Test DirAcc mean=0.4573; Val/Test PNL proxy=4.15516/-3.18168.

Ouvrir graphique loss
Loss run_0014_cnn1d_pnl_adamw Validation portfolio run_0014_cnn1d_pnl_adamwTest portfolio run_0014_cnn1d_pnl_adamw

Best run à battre

run_0008_res_tcn_directional_adamw

res_tcn · directional · adamw
Val DirAcc mean0.6011sélection
Val DirAcc std0.0452stabilité folds
Robust Val score0.5559mean - std
Econ Val score25.3446pessimiste sélection v2
Val raw score32.5352avant pénalités
No-trade seuil70percentile confidence
Worst month Val-0.30970pénalité transfert
Econ Test score-28.0529report only
Worst month Test-5.34982report only
Econ DD Test-12.12658drawdown réel
Val BT score6.7201legacy research
Val PNL proxy11.11717diagnostic
Test DirAcc mean0.4683confirmation
Test DirAcc std0.0886stabilité folds
Gap Test-Val-0.1328alerte si très négatif
Test PNL proxy-3.96798sans frais
Test BT score-3.0820report only
Max DD proxy-10.86810diagnostic
Sharpe proxy-2.332diagnostic
Folds12/ 12
Params4667<100k

Résumé modèle

arch=res_tcn · loss=directional · opt=adamw · filters=14 · dilations=[1, 2, 4, 8] · blocks=4 · dropout=0.12 · l2=0.0001 · scaler=standard · params=4667

Stratégiestructure richer under budget
NiveauL1
Succès attenduVal robuste proche du best v2 avec gap Test-Val contenu
Échecsurajustement ou instabilité folds

Réflexion et direction prise

Où en est-on: meilleur officiel run_0006_cnn1d_pnl_adamw score sélection=18.1429; familles fortes: cnn1d/pnl best=18.143, mlp/directional best=12.461. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple

Hypothèse opérationnelle

Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres.

Conclusion

WF folds=12/12; Robust Val score=0.5559; Val DirAcc mean=0.6011; Test DirAcc mean=0.4683; Val/Test PNL proxy=11.1172/-3.96798.

Ouvrir graphique loss
Loss run_0008_res_tcn_directional_adamw Validation portfolio run_0008_res_tcn_directional_adamwTest portfolio run_0008_res_tcn_directional_adamw

Diagnostic Val/Test

Un écart Test-Val négatif important signale une instabilité temporelle ou un sur-ajustement validation. Le modèle est sélectionné sur le robust Val score; le Test reste confirmation/reporting.

Dernières lignes log

[2026-07-03T20:01:47+00:00] Nouvelle session autonome
[2026-07-03T20:02:00+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl
[2026-07-03T20:02:01+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 13 runs archivés, meilleur run run_0008_res_tcn_directional_adamw avec score sélection=25.344635555032237. Research planner: Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting File d'hypothèses candidates: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
[2026-07-03T20:02:01+00:00] Supervised X=(9673, 80, 31), features=31, folds=12; sign_flip_train=True; flipped_features=11
[2026-07-03T20:02:01+00:00] Hypothèse run_0014_cnn1d_pnl_adamw: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
[2026-07-03T20:04:31+00:00] WF folds=12/12; Robust Val score=0.4456; Val DirAcc mean=0.5160; Test DirAcc mean=0.4573; Val/Test PNL proxy=4.15516/-3.18168.