Run courant
Recherche DL Quant
Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.
Raisonnement
Introduction avant tests
Lecture mémoire: 84 runs archivés, meilleur run run_0040_tcn_huber_adamw avec score sélection=27.178870236376284. Research planner: Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.
Run courant / dernier test
run_0085_mlp_directional_adamw
Résumé modèle
arch=mlp · loss=directional · opt=adamw · dense=40 · layers=1 · dropout=0.22 · l2=0.0001 · scaler=robust_winsor · features=base · win/out=80/20 · params=94919
Réflexion et direction prise
Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes
Hypothèse opérationnelle
Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.
Conclusion
WF folds=12/12; Robust Val score=0.5025; Val DirAcc mean=0.5277; Test DirAcc mean=0.5277; Val/Test PNL proxy=1.32658/1.42039.
Ouvrir graphique loss



Best run à battre
run_0040_tcn_huber_adamw
Résumé modèle
arch=tcn · loss=huber · opt=adamw · filters=8 · dilations=[1, 2] · blocks=2 · dropout=0.3 · l2=0.0003 · scaler=robust_winsor · features=regime · win/out=40/40 · params=1257
Réflexion et direction prise
Où en est-on: meilleur officiel run_0003_tcn_huber_adamw score sélection=23.9501; familles fortes: tcn/huber best=23.950, cnn1d/pnl best=20.013, mlp/directional best=19.343. Blocage: dégrossir l'idée short_input_40 sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout short_input_40: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes
Hypothèse opérationnelle
Scout short_input_40: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout.
Conclusion
WF folds=12/12; Robust Val score=0.5161; Val DirAcc mean=0.6073; Test DirAcc mean=0.5141; Val/Test PNL proxy=8.278/0.907339.
Ouvrir graphique loss



Diagnostic Val/Test
Dernières lignes log
[2026-07-08T18:19:57+00:00] Nouvelle session autonome [2026-07-08T18:22:43+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl [2026-07-08T18:22:43+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 84 runs archivés, meilleur run run_0040_tcn_huber_adamw avec score sélection=27.178870236376284. Research planner: Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. [2026-07-08T18:22:43+00:00] Supervised X=(9693, 80, 31), features=31, folds=12; sign_flip_train=True; flipped_features=11 [2026-07-08T18:22:43+00:00] Hypothèse run_0085_mlp_directional_adamw: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. [2026-07-08T18:26:02+00:00] WF folds=12/12; Robust Val score=0.5025; Val DirAcc mean=0.5277; Test DirAcc mean=0.5277; Val/Test PNL proxy=1.32658/1.42039.