Sélection économique

Backtest portefeuille 3 modèles

Simulation chronologique: jusqu'à 3 fold-models chevauchants, capital 1/3, fees=0.0 bps. La sélection v2 utilise uniquement le score économique Validation; Test reste confirmation.

Runs avec courbe1signaux stockés
Fees0.00 bpsparamétrable

Dernier backtest économique

run_0003_tcn_huber_adamw

tcn · huber · adamw
Val DirAcc mean0.5192sélection
Val DirAcc std0.0312stabilité folds
Robust Val score0.4880mean - std
Capital score Test18.5199gain% - 1.5×DD%
Gain Test %24.76capital 100
Max DD Test %-4.16drawdown capital
Capital score Val15.2292seuil capital choisi sur Val
Capital seuil p80appliqué au Test capital
Calmar Test5.950gain% / DD%
Econ Val score4.7145ancien score éco
Val raw score12.3200avant pénalités
No-trade seuil80percentile confidence
Worst month Val-3.22999pénalité transfert
Econ Test score8.7293report only
Worst month Test-0.51093report only
Econ DD Test-1.69822drawdown réel
Val BT score4.0345legacy research
Val PNL proxy10.77079diagnostic
Test DirAcc mean0.4815confirmation
Test DirAcc std0.1812stabilité folds
Gap Test-Val-0.0376alerte si très négatif
Test PNL proxy-0.19447sans frais
Test BT score-0.2001report only
Max DD proxy-3.81656diagnostic
Sharpe proxy-0.140diagnostic
Folds12/ 12
Params1257<100k

Résumé modèle

arch=tcn · loss=huber · opt=adamw · filters=8 · dilations=[1, 2] · blocks=2 · dropout=0.3 · l2=0.0003 · scaler=robust_winsor · features=regime · win/out=80/40 · params=1257

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_val12m_test1m_tcn sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_val12m_test1m_tcn: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout temporal_gap_val12m_test1m_tcn: TCN très contrainte pour tester contexte temporel sans sur-capacité ni timeout.

Conclusion

WF folds=12/12; Robust Val score=0.4880; Val DirAcc mean=0.5192; Test DirAcc mean=0.4815; Val/Test PNL proxy=10.7708/-0.194465.

Ouvrir graphique loss
Loss run_0003_tcn_huber_adamw Validation portfolio run_0003_tcn_huber_adamwTest portfolio run_0003_tcn_huber_adamwCapital % Validation run_0003_tcn_huber_adamwCapital % Test run_0003_tcn_huber_adamw

Classement économique

RunArchVal pessim.Val rawSeuil pVal PNLWorst ValVal DDVal σ moisTest scoreTest PNLWorst TestTest DDTest Sharpe
run_0003_tcn_huber_adamwtcn4.714512.32008011.71502-3.22999-5.292631.86008.72938.86946-0.51093-1.698227.159

Garde-fous

Aucun seuil n'est appris sur Test. Les frais sont à zéro pour démarrer mais paramétrables via HERMES_TRADING_FEE_BPS. Le score économique sélectionne sur Validation uniquement.