Run courant

Recherche DL Quant

Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.

Runs comparables85après purge
Best robust score27.1789run_0040_tcn_huber_adamw
Val mean best0.6073non sélectionnant
Rendu6.3 mingénération page

Raisonnement

Introduction avant tests

Lecture mémoire: 84 runs archivés, meilleur run run_0040_tcn_huber_adamw avec score sélection=27.178870236376284. Research planner: Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.

Run courant / dernier test

run_0085_mlp_directional_adamw

mlp · directional · adamw
Val DirAcc mean0.5277sélection
Val DirAcc std0.0252stabilité folds
Robust Val score0.5025mean - std
Capital score Test-15.0169gain% - 1.5×DD%
Gain Test %-0.69capital 100
Max DD Test %-9.55drawdown capital
Capital score Val-32.4251seuil capital choisi sur Val
Capital seuil p80appliqué au Test capital
Calmar Test-0.072gain% / DD%
Econ Val score-6.6262ancien score éco
Val raw score-1.1735avant pénalités
No-trade seuil80percentile confidence
Worst month Val-0.53555pénalité transfert
Econ Test score-7.2125report only
Worst month Test-0.56728report only
Econ DD Test-1.29062drawdown réel
Val BT score1.1958legacy research
Val PNL proxy1.32658diagnostic
Test DirAcc mean0.5277confirmation
Test DirAcc std0.0270stabilité folds
Gap Test-Val0.0000alerte si très négatif
Test PNL proxy1.42039sans frais
Test BT score1.3288report only
Max DD proxy-1.68930diagnostic
Sharpe proxy1.021diagnostic
Folds12/ 12
Params94919<100k

Résumé modèle

arch=mlp · loss=directional · opt=adamw · dense=40 · layers=1 · dropout=0.22 · l2=0.0001 · scaler=robust_winsor · features=base · win/out=80/20 · params=94919

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.

Conclusion

WF folds=12/12; Robust Val score=0.5025; Val DirAcc mean=0.5277; Test DirAcc mean=0.5277; Val/Test PNL proxy=1.32658/1.42039.

Ouvrir graphique loss
Loss run_0085_mlp_directional_adamw Validation portfolio run_0085_mlp_directional_adamwTest portfolio run_0085_mlp_directional_adamwCapital % Validation run_0085_mlp_directional_adamwCapital % Test run_0085_mlp_directional_adamw

Best run à battre

run_0040_tcn_huber_adamw

tcn · huber · adamw
Val DirAcc mean0.6073sélection
Val DirAcc std0.0912stabilité folds
Robust Val score0.5161mean - std
Capital score Test-58.1068gain% - 1.5×DD%
Gain Test %-3.78capital 100
Max DD Test %-36.22drawdown capital
Capital score Val155.7658seuil capital choisi sur Val
Capital seuil p0appliqué au Test capital
Calmar Test-0.104gain% / DD%
Econ Val score27.1789ancien score éco
Val raw score36.4453avant pénalités
No-trade seuil70percentile confidence
Worst month Val-0.71958pénalité transfert
Econ Test score-29.7923report only
Worst month Test-11.55950report only
Econ DD Test-13.08581drawdown réel
Val BT score5.2573legacy research
Val PNL proxy8.27800diagnostic
Test DirAcc mean0.5141confirmation
Test DirAcc std0.0679stabilité folds
Gap Test-Val-0.0931alerte si très négatif
Test PNL proxy0.90734sans frais
Test BT score0.4501report only
Max DD proxy-8.12145diagnostic
Sharpe proxy0.542diagnostic
Folds12/ 12
Params1257<100k

Résumé modèle

arch=tcn · loss=huber · opt=adamw · filters=8 · dilations=[1, 2] · blocks=2 · dropout=0.3 · l2=0.0003 · scaler=robust_winsor · features=regime · win/out=40/40 · params=1257

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel run_0003_tcn_huber_adamw score sélection=23.9501; familles fortes: tcn/huber best=23.950, cnn1d/pnl best=20.013, mlp/directional best=19.343. Blocage: dégrossir l'idée short_input_40 sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout short_input_40: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout short_input_40: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout.

Conclusion

WF folds=12/12; Robust Val score=0.5161; Val DirAcc mean=0.6073; Test DirAcc mean=0.5141; Val/Test PNL proxy=8.278/0.907339.

Ouvrir graphique loss
Loss run_0040_tcn_huber_adamw Validation portfolio run_0040_tcn_huber_adamwTest portfolio run_0040_tcn_huber_adamwCapital % Validation run_0040_tcn_huber_adamwCapital % Test run_0040_tcn_huber_adamw

Diagnostic Val/Test

Un écart Test-Val négatif important signale une instabilité temporelle ou un sur-ajustement validation. Le modèle est sélectionné sur le robust Val score; le Test reste confirmation/reporting.

Dernières lignes log

[2026-07-08T18:19:57+00:00] Nouvelle session autonome
[2026-07-08T18:22:43+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl
[2026-07-08T18:22:43+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 84 runs archivés, meilleur run run_0040_tcn_huber_adamw avec score sélection=27.178870236376284. Research planner: Où en est-on: meilleur officiel run_0040_tcn_huber_adamw score sélection=27.1789; familles fortes: tcn/huber best=27.179, cnn1d/pnl best=25.467, mlp/directional best=11.240. Blocage: dégrossir l'idée fee2bps_shorter_output20_base sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes File d'hypothèses candidates: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.
[2026-07-08T18:22:43+00:00] Supervised X=(9693, 80, 31), features=31, folds=12; sign_flip_train=True; flipped_features=11
[2026-07-08T18:22:43+00:00] Hypothèse run_0085_mlp_directional_adamw: Scout fee2bps_shorter_output20_base: MLP alternative pour vérifier répétabilité sous même idée.
[2026-07-08T18:26:02+00:00] WF folds=12/12; Robust Val score=0.5025; Val DirAcc mean=0.5277; Test DirAcc mean=0.5277; Val/Test PNL proxy=1.32658/1.42039.