Falsificateur anti-artefact du close-H 135: purge/embargo, permutation et baselines naïves
Le run 135 produit un signal close-H H10 spectaculaire (Val capital_score≈2175, Test≈187, DD Test≈-7.8%, top_asset_share≈48%) alors que plusieurs tests TP-touch précédents s’effondrent sous fill adverse. Une telle amplitude peut être un vrai changement de cible, mais elle est assez extrême pour exiger un falsificateur avant toute ingénierie de sizing.
Protocole rapide réel: variante 135 gelée Ridge alpha=1, H10, cost=8 bps, seuil p70, cap=2, avec purge/embargo prédéfinis de 22 barres autour des frontières Train/Val/Test. Comparaison à labels Train permutés/circular-shift et baselines score-only, momentum, asset-prior. Les seuils sont pris sur Validation; Test/Recent restent reporting-only.
Contrôles anti-fuite: scaler/target winsor fit Train uniquement; permutations sur Train uniquement; aucun tuning par Test; exits close-H timeout only.
Vrai modèle — Validation purgée
Vrai modèle — Test reporting
Vrai modèle — Recent reporting
Interprétation
Falsificateur favorable: après purge/embargo, le modèle close-H gelé garde une Validation forte, transfère positivement en Test, et domine nettement labels permutés et baselines naïves. Cela soutient l'hypothèse d'un signal pré-entry réel, sans promotion finale automatique.
Leçon causale: L'amplitude du run 135 ne semble pas seulement expliquée par chevauchement de labels, score TP brut ou prior d'actif; les contrôles rapides renforcent la crédibilité causale du close-H dédié.
Next implication: Continuer avec un audit forward/shadow governance et coûts/exécution réalistes sur la variante gelée, sans retuner par Test.
Graphiques


Comparaison falsificateurs
| Check | Val score | Val gain | Val DD | Val trades | Test score | Test gain | Test DD | Test trades | Test avg/trade | Test top asset | Ratio Val vs vrai |
|---|---|---|---|---|---|---|---|---|---|---|---|
| true_ridge_frozen_purged | 389.13 | 406.53% | -11.60% | 81 | 146.05 | 166.01% | -13.30% | 94 | 1.070% | 44.7% | 1.00 |
| label_circular_shift_train_only | -57.91 | -17.47% | -26.96% | 71 | -147.31 | -55.78% | -61.02% | 153 | -0.518% | 31.4% | -0.15 |
| label_month_permute_train_only | -73.82 | -27.45% | -30.91% | 82 | -138.22 | -53.71% | -56.34% | 170 | -0.437% | 26.5% | -0.19 |
| baseline_score_only | 13.42 | 27.03% | -9.08% | 51 | 12.43 | 25.41% | -8.65% | 64 | 0.369% | 37.5% | 0.03 |
| baseline_momentum_proxy | 105.32 | 116.79% | -7.65% | 78 | -73.93 | -25.27% | -32.44% | 131 | -0.193% | 34.4% | 0.27 |
| baseline_asset_prior | -9.86 | 8.27% | -12.09% | 100 | -79.56 | -23.84% | -37.14% | 185 | -0.133% | 87.0% | -0.03 |
Attribution mensuelle Validation vraie
[
{
"month": "2024-07",
"delta_gain_pct": 0.0,
"points": 2
},
{
"month": "2024-08",
"delta_gain_pct": 33.060552995516204,
"points": 21
},
{
"month": "2024-10",
"delta_gain_pct": 0.060787691409132094,
"points": 3
},
{
"month": "2024-11",
"delta_gain_pct": 124.31096735426229,
"points": 44
},
{
"month": "2024-12",
"delta_gain_pct": 215.45863469968958,
"points": 52
}
]Hypothèse Research Scientist
Mécanisme: Si 135 capture un vrai prédicteur pré-entry de rendement close-H, il doit conserver un avantage Validation sous purge/embargo stricte, perdre son avantage sous permutation circulaire/destruction temporelle des labels, et battre des baselines naïves (momentum, always-long top asset, score TP-prob seul) sélectionnées avec les mêmes règles Val-only.
Succès attendu: Validation purgée capital_score >100, Test reporting-only >0, DD Val/Test <20%, score permutation <25% du vrai score, baseline naïve <50% du vrai score; sinon pas de promotion.
Falsification: Si la permutation conserve un score élevé, si la baseline naïve explique l’essentiel du score, si l’embargo détruit la Validation, ou si les courbes révèlent quelques fenêtres chevauchantes uniques, 135 est classé artefact/diagnostic seulement.
Run ridge_closeh_135_artifact_falsifier_purged_embargo_138_20260713T004144Z · terminé 2026-07-13T00:42:22+00:00 · elapsed 38.4s · Dashboard Ridge Lab
Graphiques Val/Test
Sélection sur Validation uniquement. Le Test est affiché seulement pour juger le transfert.


