Run courant
Recherche DL Quant
Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.
Raisonnement
Introduction avant tests
Lecture mémoire: 13 runs archivés, meilleur run run_0008_res_tcn_directional_adamw avec score sélection=25.344635555032237. Research planner: Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting File d'hypothèses candidates: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
Run courant / dernier test
run_0014_cnn1d_pnl_adamw
Résumé modèle
arch=cnn1d · loss=pnl · opt=adamw · conv=16/8 · kernel=5 · dropout=0.28 · l2=0.0003 · scaler=robust · params=3049
Réflexion et direction prise
Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting
Hypothèse opérationnelle
Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
Conclusion
WF folds=12/12; Robust Val score=0.4456; Val DirAcc mean=0.5160; Test DirAcc mean=0.4573; Val/Test PNL proxy=4.15516/-3.18168.
Ouvrir graphique loss

Best run à battre
run_0008_res_tcn_directional_adamw
Résumé modèle
arch=res_tcn · loss=directional · opt=adamw · filters=14 · dilations=[1, 2, 4, 8] · blocks=4 · dropout=0.12 · l2=0.0001 · scaler=standard · params=4667
Réflexion et direction prise
Où en est-on: meilleur officiel run_0006_cnn1d_pnl_adamw score sélection=18.1429; familles fortes: cnn1d/pnl best=18.143, mlp/directional best=12.461. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple
Hypothèse opérationnelle
Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres.
Conclusion
WF folds=12/12; Robust Val score=0.5559; Val DirAcc mean=0.6011; Test DirAcc mean=0.4683; Val/Test PNL proxy=11.1172/-3.96798.
Ouvrir graphique loss

Diagnostic Val/Test
Dernières lignes log
[2026-07-03T20:01:47+00:00] Nouvelle session autonome
[2026-07-03T20:02:00+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl
[2026-07-03T20:02:01+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 13 runs archivés, meilleur run run_0008_res_tcn_directional_adamw avec score sélection=25.344635555032237. Research planner: Où en est-on: meilleur officiel run_0008_res_tcn_directional_adamw score sélection=25.3446; familles fortes: res_tcn/directional best=25.345, cnn1d/pnl best=18.388, mlp/directional best=12.461. Blocage: tester méthodiquement robust; progression actuelle {'standard': 7, 'robust': 2, 'standard_winsor': 2, 'robust_winsor': 2}. Direction choisie: normalisation Phase A / M6. Pourquoi maintenant: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: réduire worst-month et gap Val/Test vs baseline v3 standard. Échec: Val meilleure mais Test/worst-month pas amélioré. Suite prévue: continuer l'ordre standard→robust→standard_winsor→robust_winsor; ensuite envisager rolling/vol-targeting File d'hypothèses candidates: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
[2026-07-03T20:02:01+00:00] Supervised X=(9673, 80, 31), features=31, folds=12; sign_flip_train=True; flipped_features=11
[2026-07-03T20:02:01+00:00] Hypothèse run_0014_cnn1d_pnl_adamw: Normalisation Phase A (robust) alternative CNN PNL légère si le MLP exact existe déjà.
[2026-07-03T20:04:31+00:00] WF folds=12/12; Robust Val score=0.4456; Val DirAcc mean=0.5160; Test DirAcc mean=0.4573; Val/Test PNL proxy=4.15516/-3.18168.