Diagnostic transfert
Validation → Test
Objectif prioritaire: réduire les gros écarts négatifs, pas maximiser une Validation spectaculaire.
Runs économiques4avec signaux
Corr Val/Test-0.293plus haut = meilleur transfert
Risques de sur-sélection Validation
| Run | Arch | Val score | Test score | Gap | Worst Val | Worst Test | Seuil p | Diagnostic |
|---|---|---|---|---|---|---|---|---|
| run_0002_cnn1d_pnl_adamw | cnn1d | 13.8331 | -9.4869 | -23.3199 | -1.41623 | -4.27540 | 80 | Val-overfit suspect |
| run_0003_tcn_huber_adamw | tcn | 12.0825 | 2.4706 | -9.6118 | -1.40907 | -2.14408 | 70 | ok/à suivre |
| run_0001_mlp_directional_rmsprop | mlp | -1.1036 | -4.0248 | -2.9212 | -2.73743 | -2.11244 | 70 | ok/à suivre |
| run_0004_mlp_directional_adamw | mlp | -1.7390 | 0.8271 | 2.5662 | -1.06825 | -0.78141 | 70 | ok/à suivre |
Règle de recherche
Les prochains runs doivent chercher à améliorer le Test économique médian et à réduire les gros Test négatifs via score pessimiste, no-trade Validation-only et modèles plus stables. Le Test reste interdit pour sélectionner un seuil ou un best.