Run courant
Recherche DL Quant
Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.
Raisonnement
Introduction avant tests
Lecture mémoire: 0 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_test15d_mini sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_test15d_mini: MLP stable pour tester l'idée sans architecture complexe. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout temporal_gap_test15d_mini: MLP stable pour tester l'idée sans architecture complexe. | Scout temporal_gap_test15d_mini: CNN PNL légère pour tester si l'idée améliore la courbe économique. | Scout temporal_gap_test15d_mini: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout.
Run courant / dernier test
run_0004_mlp_directional_adamw
Résumé modèle
arch=mlp · loss=directional · opt=adamw · dense=40 · layers=1 · dropout=0.22 · l2=0.0001 · scaler=robust_winsor · features=regime · win/out=80/40 · params=95297
Réflexion et direction prise
Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_test15d_mini sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_test15d_mini: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes
Hypothèse opérationnelle
Scout temporal_gap_test15d_mini: MLP alternative pour vérifier répétabilité sous même idée.
Conclusion
WF folds=12/12; Robust Val score=0.4830; Val DirAcc mean=0.5147; Test DirAcc mean=0.5069; Val/Test PNL proxy=1.17697/0.052361.
Ouvrir graphique loss



Best run à battre
run_0002_cnn1d_pnl_adamw
Résumé modèle
arch=cnn1d · loss=pnl · opt=adamw · conv=16/8 · kernel=5 · dropout=0.28 · l2=0.0003 · scaler=robust_winsor · features=regime · win/out=80/40 · params=3529
Réflexion et direction prise
Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_test15d_mini sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_test15d_mini: CNN PNL légère pour tester si l'idée améliore la courbe économique. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes
Hypothèse opérationnelle
Scout temporal_gap_test15d_mini: CNN PNL légère pour tester si l'idée améliore la courbe économique.
Conclusion
WF folds=12/12; Robust Val score=0.4471; Val DirAcc mean=0.5518; Test DirAcc mean=0.5417; Val/Test PNL proxy=7.04193/1.05347.
Ouvrir graphique loss



Diagnostic Val/Test
Dernières lignes log
[2026-07-05T23:55:16+00:00] Nouvelle session autonome [2026-07-05T23:55:16+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl [2026-07-05T23:55:16+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 0 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_test15d_mini sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_test15d_mini: MLP stable pour tester l'idée sans architecture complexe. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout temporal_gap_test15d_mini: MLP stable pour tester l'idée sans architecture complexe. | Scout temporal_gap_test15d_mini: CNN PNL légère pour tester si l'idée améliore la courbe économique. | Scout temporal_gap_test15d_mini: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. [2026-07-05T23:55:16+00:00] Supervised X=(9673, 80, 37), features=37, folds=12; sign_flip_train=False; flipped_features=11 [2026-07-05T23:55:16+00:00] Hypothèse run_0001_mlp_directional_rmsprop: Scout temporal_gap_test15d_mini: MLP stable pour tester l'idée sans architecture complexe. [2026-07-05T23:56:52+00:00] Nouveau record validation_economic_portfolio_score: -1.1036; robust val=0.4685; mean test DA=0.4972; modèle sauvé /home/aalex/dev/quant_trading/backtests/protocols/one_shot_v4_gap_val3m_test15d_mini_20260706/models/best_model.keras [2026-07-05T23:56:52+00:00] WF folds=12/12; Robust Val score=0.4685; Val DirAcc mean=0.5251; Test DirAcc mean=0.4972; Val/Test PNL proxy=1.55791/-0.105474. [2026-07-05T23:56:53+00:00] Hypothèse run_0002_cnn1d_pnl_adamw: Scout temporal_gap_test15d_mini: CNN PNL légère pour tester si l'idée améliore la courbe économique. [2026-07-05T23:58:20+00:00] Nouveau record validation_economic_portfolio_score: 13.8331; robust val=0.4471; mean test DA=0.5417; modèle sauvé /home/aalex/dev/quant_trading/backtests/protocols/one_shot_v4_gap_val3m_test15d_mini_20260706/models/best_model.keras [2026-07-05T23:58:20+00:00] WF folds=12/12; Robust Val score=0.4471; Val DirAcc mean=0.5518; Test DirAcc mean=0.5417; Val/Test PNL proxy=7.04193/1.05347. [2026-07-05T23:58:21+00:00] Hypothèse run_0003_tcn_huber_adamw: Scout temporal_gap_test15d_mini: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. [2026-07-06T00:00:56+00:00] WF folds=12/12; Robust Val score=0.4790; Val DirAcc mean=0.5588; Test DirAcc mean=0.5514; Val/Test PNL proxy=6.04251/1.00886. [2026-07-06T00:00:57+00:00] Hypothèse run_0004_mlp_directional_adamw: Scout temporal_gap_test15d_mini: MLP alternative pour vérifier répétabilité sous même idée. [2026-07-06T00:02:32+00:00] WF folds=12/12; Robust Val score=0.4830; Val DirAcc mean=0.5147; Test DirAcc mean=0.5069; Val/Test PNL proxy=1.17697/0.052361.