Research queue

Hypothèses autonomes

Le chercheur propose des idées structurées; le runner exécute 4 runs par idée. Promotion seulement si signal répété et robustesse Test/worst-month.

Idées queue8JSONL
Runs scout1v4

Suivi des idées

IDHypothèseStatutRunsTest médianWorst médianGap médianFeaturesWin/OutRationale
baseline_v3_likeBaseline v3-likequeued0/4n/an/an/a /
time_pct_minmaxTime percentile minmaxqueued0/4n/an/an/a /
regime_featuresFeatures régimequeued0/4n/an/an/a /
longer_input_120Input 120queued0/4n/an/an/a /
shorter_output_20Output 20queued0/4n/an/an/a /
synthetic_pairsPaires synthétiquesqueued0/4n/an/an/a /
voltarget_returnsVol-target returnsqueued0/4n/an/an/a /
cross_sectional_relativeCross-sectionalqueued0/4n/an/an/a /
regime_voltargetRégime + vol-targetqueued0/4n/an/an/a /
short_input_40Input 40queued0/4n/an/an/a /
long_output_60Output 60queued0/4n/an/an/a /
no_signflip_ablationAblation sign-flipqueued0/4n/an/an/a /
fees_2bps_stressStress frais 2bpsqueued0/4n/an/an/a /
ta_ohlc_atr_rsi_output20OHLC technical indicators + output 20queued0/4n/an/an/aohlc_ta80 / 20High/low/open structure may distinguish breakout/range regimes better than returns alone; shorter target has been more stable in v4.
multi_resolution_regime_output20Multi-resolution regime proxy + output 20active1/4-5.3102-1.56288-3.0296multi_resolution80 / 20Combine short/medium/long rolling horizons on the existing 6h grid before trying a new candle size.
cross_sectional_output20Cross-sectional relative features + output 20queued0/4n/an/an/across_sectional80 / 20Cross-sectional features had positive PNL median; combine with the more stable shorter target.
regime_ohlc_ta_output20Régime + OHLC/TA + horizon 20queued0/4n/an/an/aregime_ohlc_ta80 / 20Le meilleur signal complet reste shorter_output_20 (score Test médian -3.999, PNL médian positif, gap très faible). L'idée OHLC/TA déjà en queue teste high/low/ATR/RSI sans régime; cette variante atomique ajoute les marqueurs de régime car les familles ré
regime_multi_resolution_output20Régime + multi-résolution + horizon 20queued0/4n/an/an/aregime_multi_resolution80 / 20La multi-résolution simple est déjà en queue, mais les résultats complets montrent que les problèmes dominants sont worst-month et gap. Combiner horizons court/moyen/long avec features de régime peut permettre au modèle de distinguer momentum durable vs rebond
cross_sectional_output60Cross-sectional relative features + horizon 60queued0/4n/an/an/across_sectional80 / 60Les deux meilleures familles complètes par capital_score médian Test restent long_output_60 (-19.15, gain médian +9.94%, DD -20.98%) et cross_sectional_relative (-25.21, gain médian +9.65%). Cette hypothèse combine atomiquement l horizon 60, qui semble mieux a
no_signflip_multi_resolution_output20Multi-résolution output20 sans sign-flip trainqueued0/4n/an/an/amulti_resolution80 / 20La famille multi_resolution_regime_output20 est désormais le meilleur compromis complet par capital_score Test médian (-15.09) avec gain médian +21.87% et 2/4 runs positifs, mais un run catastrophique (-94.53) signale une fragilité de généralisation. L ablatio
fee2bps_shorter_output20_baseStress frais 2 bps sur base horizon 20queued0/4n/an/an/abase80 / 20shorter_output_20 est la direction complète la plus robuste (PNL Test médian positif et gap médian le plus faible), mais les scores actuels sont à frais 0. Un stress 2 bps teste si le signal économique vient d'un turnover fragile ou d'un vrai edge di

Journal chercheur

TimestampAgentTypeObservations / leçonsNext focus
2026-07-06T23:03:20Zassistant_one_shotisolated_val6m_test6m_6models_one_runTest isolé Val6m/Test6m avec superposition jusqu à 6 modèles lancé sur TCN/Huber/AdamW. Résultat capital Test: score -36.01, gain 11.12%, max DD -31.42%, worst-month -26.54%, exposure 0.89, active_models=6. Validation reste forte: score 254.98, gain 287.17%, DD -21.46.Si on poursuit, confirmer Val6m/Test1m sur 4 architectures; envisager ensuite train 18m/24m seulement dans un protocole séparé.
2026-07-06T23:25:26Zassistant_one_shotisolated_train6m_val6m_test1m_one_runTest isolé Train6m/Val6m/Test1m lancé sur TCN/Huber/AdamW. Résultat capital Test: score -49.20, gain 8.51%, DD -38.47%, worst-month -28.73%. Validation: score 89.15, gain 123.97%, DD -23.22%.Si on poursuit, confirmer Train12/Val6/Test1m avec mini-protocole 4 runs avant toute promotion.
2026-07-06T23:42:47Zassistant_one_shotisolated_train24m_val6m_test1m_one_runTest isolé Train24m/Val6m/Test1m lancé sur TCN/Huber/AdamW. Résultat capital Test: score 47.69, gain 82.00%, DD -22.87%, worst-month -14.17%, exposure 0.76, seuil capital p50. Validation: score 175.75, gain 207.55%, DD -21.20%.Mini-protocole 4 runs Train12/Val6/Test1m ou comparaison Train12 vs Train24 sur plusieurs architectures si on veut confirmer.
2026-07-06T23:45:47Zassistant_correctionisolated_train24m_val6m_test1m_correctionCorrection: le résultat réel Train24m/Val6m/Test1m est négatif, pas positif. Capital Test: score -54.01, gain 9.31%, DD -42.22%, worst-month -14.63%, exposure 1.00, seuil capital p0. Validation: score 114.23, gain 148.12%, DD -22.59%. Ancien economic_score Test -24.55.Priorité: confirmer Train12m/Val6m/Test1m par mini-protocole 4 runs avant toute intégration.
2026-07-07T00:11:48+00:00research_scientistreflectionRéveil autonome avec capital_score prioritaire. La mémoire v4 contient 61 runs. Nouveau fait important: multi_resolution_regime_output20 est maintenant complète et devient la meilleure famille par capital_score Test médian (-15.09), avec gain médian +21.87%, DD médian -24.64% et 2/4 runs positifs. Cette amélioration reste fragile car son pire run est très néLaisser le runner consommer les 6 idées incomplètes désormais en queue: cross_sectional_output20, regime_ohlc_ta_output20, regime_multi_resolution_output20, fee2bps_shorter_output20_base, cross_sectional_output60 et no_signflip_multi_resolution_output20. Proch
2026-07-07T00:14:42Zassistant_one_shotisolated_step10_fold_overlap_pilotPilot Train12/Val6/Test1 avec fold_step_days=10 et 18 folds lancé sur TCN/Huber/AdamW. Le mécanisme de superposition marche: avg active models 2.67, max 3, 77% des steps avec >=3 modèles. Capital Test: score -8.92, gain 31.32%, DD -26.82%, worst-month -14.64%. Validation: score 67.71, gain 102.48%, DD -23.18%.Priorité reste mini-protocole Train12/Val6/Test1 mensuel; éventuelle variante step10 avec gating de drift si on poursuit.

Règles

Le Test guide la direction de recherche mais ne sélectionne jamais le best_model ni les seuils. Une idée n'est promue qu'après 4 runs et amélioration médiane du Test, worst-month et gap.