Run courant
Recherche DL Quant
Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.
Raisonnement
Introduction avant tests
Lecture mémoire: 2 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple File d'hypothèses candidates: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. | Tester une TCN depthwise separable pour élargir le champ temporel avec très peu de paramètres. | TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables.
Run courant / dernier test
run_0003_res_tcn_directional_adamw
Résumé modèle
arch=res_tcn · loss=directional · opt=adamw · filters=14 · dilations=[1, 2, 4, 8] · blocks=4 · dropout=0.12 · l2=0.0001 · scaler=robust_winsor · features=regime · win/out=80/40 · params=5003
Réflexion et direction prise
Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple
Hypothèse opérationnelle
Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres.
Conclusion
WF folds=12/12; Robust Val score=0.5234; Val DirAcc mean=0.5778; Test DirAcc mean=0.5115; Val/Test PNL proxy=6.36697/0.0782165.
Ouvrir graphique loss



Diagnostic Val/Test
Dernières lignes log
[2026-07-05T22:56:23+00:00] Nouvelle session autonome [2026-07-05T22:56:23+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl [2026-07-05T22:56:23+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 2 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple File d'hypothèses candidates: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. | Tester une TCN depthwise separable pour élargir le champ temporel avec très peu de paramètres. | TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables. [2026-07-05T22:56:23+00:00] Supervised X=(9673, 80, 37), features=37, folds=12; sign_flip_train=False; flipped_features=11 [2026-07-05T22:56:23+00:00] Hypothèse run_0003_res_tcn_directional_adamw: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. [2026-07-05T23:00:42+00:00] Nouveau record robust_val_directional_accuracy_mean_minus_std: 0.5234; robust val=0.5234; mean test DA=0.5115; modèle sauvé /home/aalex/dev/quant_trading/backtests/protocols/one_shot_gap_val3m_test1m/models/best_model.keras [2026-07-05T23:00:42+00:00] WF folds=12/12; Robust Val score=0.5234; Val DirAcc mean=0.5778; Test DirAcc mean=0.5115; Val/Test PNL proxy=6.36697/0.0782165.