Run courant

Recherche DL Quant

Page dédiée au dernier run. Les historiques sont séparés dans une page dédiée pour garder la lecture claire.

Runs comparables55après purge
Best robust score27.9405run_0045_tcn_directional_adamw
Val mean best0.5800non sélectionnant
Rendu5.2 mingénération page

Raisonnement

Introduction avant tests

Lecture mémoire: 54 runs archivés, meilleur run run_0045_tcn_directional_adamw avec score sélection=27.940531119064758. Research planner: Où en est-on: meilleur officiel run_0045_tcn_directional_adamw score sélection=27.9405; familles fortes: tcn/directional best=27.941, tcn/huber best=26.564, cnn1d/pnl best=18.143. Blocage: le backlog comparable est consommé mais on refuse de relancer un doublon. Direction choisie: mutation anti-répétition guidée par diagnostic. Pourquoi maintenant: Mutation anti-répétition: explorer TCN tiny avec paramètres frais. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: produire un signal nouveau comparable. Échec: résultat dominé par les familles déjà testées. Suite prévue: si les mutations plafonnent, préparer explicitement un protocol_v2 L3 File d'hypothèses candidates: Mutation anti-répétition: explorer TCN tiny avec paramètres frais. | Mutation anti-répétition: explorer TCN tiny avec paramètres frais. | Mutation anti-répétition: explorer TCN tiny avec paramètres frais.

Run courant / dernier test

run_0055_tcn_directional_adamw

tcn · directional · adamw
Val DirAcc mean0.5881sélection
Val DirAcc std0.0564stabilité folds
Robust Val score0.5318mean - std
Econ Val score26.9831pessimiste sélection v2
Val raw score34.7826avant pénalités
No-trade seuil70percentile confidence
Worst month Val-0.30748pénalité transfert
Econ Test score-21.5358report only
Worst month Test-8.13527report only
Econ DD Test-8.19629drawdown réel
Val BT score6.6924legacy research
Val PNL proxy10.82664diagnostic
Test DirAcc mean0.4896confirmation
Test DirAcc std0.0698stabilité folds
Gap Test-Val-0.0985alerte si très négatif
Test PNL proxy-0.98425sans frais
Test BT score-0.9069report only
Max DD proxy-8.94095diagnostic
Sharpe proxy-0.571diagnostic
Folds12/ 12
Params2241<100k

Résumé modèle

arch=tcn · loss=directional · opt=adamw · filters=12 · dilations=[1, 2, 4] · blocks=3 · dropout=0.09 · l2=0.0002 · params=2241

Stratégiemutation anti-répétition guidée par diagnostic
NiveauL1
Succès attenduproduire un signal nouveau comparable
Échecrésultat dominé par les familles déjà testées

Réflexion et direction prise

Où en est-on: meilleur officiel run_0045_tcn_directional_adamw score sélection=27.9405; familles fortes: tcn/directional best=27.941, tcn/huber best=26.564, cnn1d/pnl best=18.143. Blocage: le backlog comparable est consommé mais on refuse de relancer un doublon. Direction choisie: mutation anti-répétition guidée par diagnostic. Pourquoi maintenant: Mutation anti-répétition: explorer TCN tiny avec paramètres frais. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: produire un signal nouveau comparable. Échec: résultat dominé par les familles déjà testées. Suite prévue: si les mutations plafonnent, préparer explicitement un protocol_v2 L3

Hypothèse opérationnelle

Mutation anti-répétition: explorer TCN tiny avec paramètres frais.

Conclusion

WF folds=12/12; Robust Val score=0.5318; Val DirAcc mean=0.5881; Test DirAcc mean=0.4896; Val/Test PNL proxy=10.8266/-0.984246.

Ouvrir graphique loss
Loss run_0055_tcn_directional_adamw Validation portfolio run_0055_tcn_directional_adamwTest portfolio run_0055_tcn_directional_adamw

Best run à battre

run_0045_tcn_directional_adamw

tcn · directional · adamw
Val DirAcc mean0.5800sélection
Val DirAcc std0.0642stabilité folds
Robust Val score0.5158mean - std
Econ Val score27.9405pessimiste sélection v2
Val raw score35.6397avant pénalités
No-trade seuil80percentile confidence
Worst month Val-0.00076pénalité transfert
Econ Test score0.1795report only
Worst month Test-2.21381report only
Econ DD Test-2.78582drawdown réel
Val BT score5.6823legacy research
Val PNL proxy9.17571diagnostic
Test DirAcc mean0.5206confirmation
Test DirAcc std0.0952stabilité folds
Gap Test-Val-0.0594alerte si très négatif
Test PNL proxy1.70631sans frais
Test BT score1.0738report only
Max DD proxy-7.92001diagnostic
Sharpe proxy1.086diagnostic
Folds12/ 12
Params2241<100k

Résumé modèle

arch=tcn · loss=directional · opt=adamw · filters=12 · dilations=[1, 2, 4] · blocks=3 · dropout=0.24 · l2=0.0002 · params=2241

StratégieTCN anti-overfit / M5
NiveauL1
Succès attenduworst-month Val/Test amélioré vs TCN précédentes
Échecnouvelle Val explosive mais Test négatif

Réflexion et direction prise

Où en est-on: meilleur officiel run_0039_tcn_huber_adamw score sélection=26.5645; familles fortes: tcn/huber best=26.564, cnn1d/pnl best=18.143, mlp/directional best=6.928. Blocage: les TCN précédentes sur-sélectionnent la Validation; on impose forte régularisation et score pessimiste. Direction choisie: TCN anti-overfit / M5. Pourquoi maintenant: TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: worst-month Val/Test amélioré vs TCN précédentes. Échec: nouvelle Val explosive mais Test négatif. Suite prévue: si échoue, déprioriser TCN au profit MLP/no-trade

Hypothèse opérationnelle

TCN contrainte: garder le contexte temporel mais réduire la capacité pour éviter les Val explosives non transférables.

Conclusion

WF folds=12/12; Robust Val score=0.5158; Val DirAcc mean=0.5800; Test DirAcc mean=0.5206; Val/Test PNL proxy=9.17571/1.70631.

Ouvrir graphique loss
Loss run_0045_tcn_directional_adamw Validation portfolio run_0045_tcn_directional_adamwTest portfolio run_0045_tcn_directional_adamw

Diagnostic Val/Test

Un écart Test-Val négatif important signale une instabilité temporelle ou un sur-ajustement validation. Le modèle est sélectionné sur le robust Val score; le Test reste confirmation/reporting.

Dernières lignes log

[2026-07-02T21:25:30+00:00] Nouvelle session autonome
[2026-07-02T21:25:54+00:00] Chargement cache dataset: /home/aalex/dev/quant_trading/data/dataset_processed_6h.pkl
[2026-07-02T21:25:54+00:00] INTRO HYPOTHÈSES: Lecture mémoire: 54 runs archivés, meilleur run run_0045_tcn_directional_adamw avec score sélection=27.940531119064758. Research planner: Où en est-on: meilleur officiel run_0045_tcn_directional_adamw score sélection=27.9405; familles fortes: tcn/directional best=27.941, tcn/huber best=26.564, cnn1d/pnl best=18.143. Blocage: le backlog comparable est consommé mais on refuse de relancer un doublon. Direction choisie: mutation anti-répétition guidée par diagnostic. Pourquoi maintenant: Mutation anti-répétition: explorer TCN tiny avec paramètres frais. Niveau protocole: L1. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: produire un signal nouveau comparable. Échec: résultat dominé par les familles déjà testées. Suite prévue: si les mutations plafonnent, préparer explicitement un protocol_v2 L3 File d'hypothèses candidates: Mutation anti-répétition: explorer TCN tiny avec paramètres frais. | Mutation anti-répétition: explorer TCN tiny avec paramètres frais. | Mutation anti-répétition: explorer TCN tiny avec paramètres frais.
[2026-07-02T21:25:54+00:00] Supervised X=(9673, 80, 31), features=31, folds=12; sign_flip_train=True; flipped_features=11
[2026-07-02T21:25:54+00:00] Hypothèse run_0055_tcn_directional_adamw: Mutation anti-répétition: explorer TCN tiny avec paramètres frais.
[2026-07-02T21:30:39+00:00] WF folds=12/12; Robust Val score=0.5318; Val DirAcc mean=0.5881; Test DirAcc mean=0.4896; Val/Test PNL proxy=10.8266/-0.984246.