Run courant

Recherche DL Quant

Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.

Runs comparables3après purge
Best robust score0.5234run_0003_res_tcn_directional_adamw
Val mean best0.5778non sélectionnant
Rendu4.3 mingénération page

Raisonnement

Introduction avant tests

Lecture mémoire: 2 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple File d'hypothèses candidates: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. | Tester une TCN depthwise separable pour élargir le champ temporel avec très peu de paramètres. | TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables.

Run courant / dernier test

run_0003_res_tcn_directional_adamw

res_tcn · directional · adamw
Val DirAcc mean0.5778sélection
Val DirAcc std0.0544stabilité folds
Robust Val score0.5234mean - std
Capital score Test-54.7116gain% - 1.5×DD%
Gain Test %1.93capital 100
Max DD Test %-37.76drawdown capital
Capital score Val66.3496seuil capital choisi sur Val
Capital seuil p0appliqué au Test capital
Calmar Test0.051gain% / DD%
Econ Val score18.4832ancien score éco
Val raw score24.6420avant pénalités
No-trade seuil70percentile confidence
Worst month Val-1.47065pénalité transfert
Econ Test score-6.8238report only
Worst month Test-2.73793report only
Econ DD Test-5.01649drawdown réel
Val BT score4.0774legacy research
Val PNL proxy6.36697diagnostic
Test DirAcc mean0.5115confirmation
Test DirAcc std0.1488stabilité folds
Gap Test-Val-0.0662alerte si très négatif
Test PNL proxy0.07822sans frais
Test BT score0.2183report only
Max DD proxy-3.82756diagnostic
Sharpe proxy0.220diagnostic
Folds12/ 12
Params5003<100k

Résumé modèle

arch=res_tcn · loss=directional · opt=adamw · filters=14 · dilations=[1, 2, 4, 8] · blocks=4 · dropout=0.12 · l2=0.0001 · scaler=robust_winsor · features=regime · win/out=80/40 · params=5003

Stratégiestructure richer under budget
NiveauL1
Succès attenduVal robuste proche du best v2 avec gap Test-Val contenu
Échecsurajustement ou instabilité folds

Réflexion et direction prise

Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple

Hypothèse opérationnelle

Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres.

Conclusion

WF folds=12/12; Robust Val score=0.5234; Val DirAcc mean=0.5778; Test DirAcc mean=0.5115; Val/Test PNL proxy=6.36697/0.0782165.

Ouvrir graphique loss
Loss run_0003_res_tcn_directional_adamw Validation portfolio run_0003_res_tcn_directional_adamwTest portfolio run_0003_res_tcn_directional_adamwCapital % Validation run_0003_res_tcn_directional_adamwCapital % Test run_0003_res_tcn_directional_adamw

Diagnostic Val/Test

Un écart Test-Val négatif important signale une instabilité temporelle ou un sur-ajustement validation. Le modèle est sélectionné sur le robust Val score; le Test reste confirmation/reporting.

Dernières lignes log

[2026-07-05T22:56:23+00:00] Nouvelle session autonome
[2026-07-05T22:56:23+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl
[2026-07-05T22:56:23+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 2 runs archivés, meilleur run None avec score sélection=None. Research planner: Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: la meilleure v2 TCN baisse encore sa loss; tester un chemin plus profond mais régularisé. Direction choisie: structure richer under budget. Pourquoi maintenant: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: Val robuste proche du best v2 avec gap Test-Val contenu. Échec: surajustement ou instabilité folds. Suite prévue: si positif, explorer la profondeur/dilatation; sinon revenir TCN simple File d'hypothèses candidates: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres. | Tester une TCN depthwise separable pour élargir le champ temporel avec très peu de paramètres. | TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables.
[2026-07-05T22:56:23+00:00] Supervised X=(9673, 80, 37), features=37, folds=12; sign_flip_train=False; flipped_features=11
[2026-07-05T22:56:23+00:00] Hypothèse run_0003_res_tcn_directional_adamw: Tester une TCN résiduelle légère: plus de profondeur/dilatation sans dépasser le budget de paramètres.
[2026-07-05T23:00:42+00:00] Nouveau record robust_val_directional_accuracy_mean_minus_std: 0.5234; robust val=0.5234; mean test DA=0.5115; modèle sauvé /home/aalex/dev/quant_trading/backtests/protocols/one_shot_gap_val3m_test1m/models/best_model.keras
[2026-07-05T23:00:42+00:00] WF folds=12/12; Robust Val score=0.5234; Val DirAcc mean=0.5778; Test DirAcc mean=0.5115; Val/Test PNL proxy=6.36697/0.0782165.