Sélection économique
Backtest portefeuille 3 modèles
Simulation chronologique: jusqu'à 3 fold-models chevauchants, capital 1/3, fees=0.0 bps. La sélection v2 utilise uniquement le score économique Validation; Test reste confirmation.
Dernier backtest économique
run_0003_tcn_huber_adamw
Résumé modèle
arch=tcn · loss=huber · opt=adamw · filters=8 · dilations=[1, 2] · blocks=2 · dropout=0.3 · l2=0.0003 · scaler=robust_winsor · features=regime · win/out=80/40 · params=1257
Réflexion et direction prise
Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_val12m_test1m_tcn sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_val12m_test1m_tcn: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes
Hypothèse opérationnelle
Scout temporal_gap_val12m_test1m_tcn: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout.
Conclusion
WF folds=12/12; Robust Val score=0.4880; Val DirAcc mean=0.5192; Test DirAcc mean=0.4815; Val/Test PNL proxy=10.7708/-0.194465.
Ouvrir graphique loss



Classement économique
| Run | Arch | Val pessim. | Val raw | Seuil p | Val PNL | Worst Val | Val DD | Val σ mois | Test score | Test PNL | Worst Test | Test DD | Test Sharpe |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| run_0003_tcn_huber_adamw | tcn | 4.7145 | 12.3200 | 80 | 11.71502 | -3.22999 | -5.29263 | 1.8600 | 8.7293 | 8.86946 | -0.51093 | -1.69822 | 7.159 |
Garde-fous
HERMES_TRADING_FEE_BPS. Le score économique sélectionne sur Validation uniquement.