Sélection économique

Backtest portefeuille 3 modèles

Simulation chronologique: jusqu'à 3 fold-models chevauchants, capital 1/3, fees=0.0 bps. La sélection v2 utilise uniquement le score économique Validation; Test reste confirmation.

Runs avec courbe4signaux stockés
Fees0.00 bpsparamétrable

Dernier backtest économique

run_0004_mlp_directional_adamw

mlp · directional · adamw
Val DirAcc mean0.5147sélection
Val DirAcc std0.0317stabilité folds
Robust Val score0.4830mean - std
Capital score Test-21.4904gain% - 1.5×DD%
Gain Test %3.75capital 100
Max DD Test %-16.83drawdown capital
Capital score Val8.1244seuil capital choisi sur Val
Capital seuil p0appliqué au Test capital
Calmar Test0.223gain% / DD%
Econ Val score-1.7390ancien score éco
Val raw score1.5090avant pénalités
No-trade seuil70percentile confidence
Worst month Val-1.06825pénalité transfert
Econ Test score-6.9528report only
Worst month Test-2.54412report only
Econ DD Test-5.00780drawdown réel
Val BT score0.6696legacy research
Val PNL proxy1.17697diagnostic
Test DirAcc mean0.5056confirmation
Test DirAcc std0.0792stabilité folds
Gap Test-Val-0.0090alerte si très négatif
Test PNL proxy0.13728sans frais
Test BT score0.2144report only
Max DD proxy-1.72923diagnostic
Sharpe proxy0.074diagnostic
Folds12/ 12
Params95297<100k

Résumé modèle

arch=mlp · loss=directional · opt=adamw · dense=40 · layers=1 · dropout=0.22 · l2=0.0001 · scaler=robust_winsor · features=regime · win/out=80/40 · params=95297

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée temporal_gap_test1m_mini sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout temporal_gap_test1m_mini: MLP alternative pour vérifier répétabilité sous même idée. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout temporal_gap_test1m_mini: MLP alternative pour vérifier répétabilité sous même idée.

Conclusion

WF folds=12/12; Robust Val score=0.4830; Val DirAcc mean=0.5147; Test DirAcc mean=0.5056; Val/Test PNL proxy=1.17697/0.137281.

Ouvrir graphique loss
Loss run_0004_mlp_directional_adamw Validation portfolio run_0004_mlp_directional_adamwTest portfolio run_0004_mlp_directional_adamwCapital % Validation run_0004_mlp_directional_adamwCapital % Test run_0004_mlp_directional_adamw

Classement économique

RunArchVal pessim.Val rawSeuil pVal PNLWorst ValVal DDVal σ moisTest scoreTest PNLWorst TestTest DDTest Sharpe
run_0002_cnn1d_pnl_adamwcnn1d13.833122.10058015.94535-1.41623-4.091153.30778.463512.16577-0.71842-4.624846.513
run_0003_tcn_huber_adamwtcn12.082518.60637014.25700-1.40907-2.819252.37799.286115.21628-2.33012-4.993046.655
run_0001_mlp_directional_rmspropmlp-1.10365.7726706.98592-2.73743-5.482222.0166-4.75552.74478-2.63673-4.195651.218
run_0004_mlp_directional_adamwmlp-1.73901.5090702.61854-1.06825-3.017260.9728-6.95281.61807-2.54412-5.007800.721

Garde-fous

Aucun seuil n'est appris sur Test. Les frais sont à zéro pour démarrer mais paramétrables via HERMES_TRADING_FEE_BPS. Le score économique sélectionne sur Validation uniquement.