Sélection économique

Backtest portefeuille 3 modèles

Simulation chronologique: jusqu'à 3 fold-models chevauchants, capital 1/3, fees=0.0 bps. La sélection v2 utilise uniquement le score économique Validation; Test reste confirmation.

Runs avec courbe1signaux stockés
Fees0.00 bpsparamétrable

Dernier backtest économique

run_0001_mlp_directional_rmsprop

mlp · directional · rmsprop
Val DirAcc mean0.5068sélection
Val DirAcc std0.0390stabilité folds
Robust Val score0.4678mean - std
Capital score Test-25.6448gain% - 1.5×DD%
Gain Test %-0.68capital 100
Max DD Test %-16.64drawdown capital
Capital score Val-2.7972seuil capital choisi sur Val
Capital seuil p60appliqué au Test capital
Calmar Test-0.041gain% / DD%
Econ Val score-2.2806ancien score éco
Val raw score-0.2783avant pénalités
No-trade seuil70percentile confidence
Worst month Val-1.12245pénalité transfert
Econ Test score-5.3102report only
Worst month Test-1.56288report only
Econ DD Test-2.70281drawdown réel
Val BT score0.6029legacy research
Val PNL proxy0.82807diagnostic
Test DirAcc mean0.5023confirmation
Test DirAcc std0.0537stabilité folds
Gap Test-Val-0.0045alerte si très négatif
Test PNL proxy0.30588sans frais
Test BT score0.5072report only
Max DD proxy-1.65426diagnostic
Sharpe proxy0.335diagnostic
Folds12/ 12
Params92790<100k

Résumé modèle

arch=mlp · loss=directional · opt=rmsprop · dense=32 · layers=1 · dropout=0.28 · l2=0.0002 · scaler=robust_winsor · features=multi_resolution · win/out=80/20 · params=92790

Stratégieprotocole scout 4 runs/idée
NiveauL3
Succès attenduamélioration du Test pessimiste médian ou baisse worst-month/gap
ÉchecVal meilleure mais Test fragile ou run isolé non répétable

Réflexion et direction prise

Où en est-on: meilleur officiel n/a score sélection=nan; familles fortes: pas encore assez d'historique. Blocage: dégrossir l'idée multi_resolution_regime_output20 sans conclure sur un seul run. Direction choisie: protocole scout 4 runs/idée. Pourquoi maintenant: Scout multi_resolution_regime_output20: MLP stable pour tester l'idée sans architecture complexe. Niveau protocole: L3. Comparabilité directe: pas de changement data/features/cible/folds/augmentation/sélection (L0-L2). Succès attendu: amélioration du Test pessimiste médian ou baisse worst-month/gap. Échec: Val meilleure mais Test fragile ou run isolé non répétable. Suite prévue: après 4 runs, passer à l'idée suivante; après 2-3 jours, promouvoir les directions robustes

Hypothèse opérationnelle

Scout multi_resolution_regime_output20: MLP stable pour tester l'idée sans architecture complexe.

Conclusion

WF folds=12/12; Robust Val score=0.4678; Val DirAcc mean=0.5068; Test DirAcc mean=0.5023; Val/Test PNL proxy=0.828071/0.305883.

Ouvrir graphique loss
Loss run_0001_mlp_directional_rmsprop Validation portfolio run_0001_mlp_directional_rmspropTest portfolio run_0001_mlp_directional_rmspropCapital % Validation run_0001_mlp_directional_rmspropCapital % Test run_0001_mlp_directional_rmsprop

Classement économique

RunArchVal pessim.Val rawSeuil pVal PNLWorst ValVal DDVal σ moisTest scoreTest PNLWorst TestTest DDTest Sharpe
run_0001_mlp_directional_rmspropmlp-2.2806-0.2783700.52694-1.12245-1.516990.4083-5.3102-0.28430-1.56288-2.70281-0.161

Garde-fous

Aucun seuil n'est appris sur Test. Les frais sont à zéro pour démarrer mais paramétrables via HERMES_TRADING_FEE_BPS. Le score économique sélectionne sur Validation uniquement.