Research queue

Hypothèses autonomes

Le chercheur propose des idées structurées; le runner exécute 4 runs par idée. Promotion seulement si signal répété et robustesse Test/worst-month.

Idées queue6JSONL
Runs scout4v4

Suivi des idées

IDHypothèseStatutRunsTest médianWorst médianGap médianFeaturesWin/OutRationale
baseline_v3_likeBaseline v3-likequeued0/4n/an/an/a /
time_pct_minmaxTime percentile minmaxqueued0/4n/an/an/a /
regime_featuresFeatures régimequeued0/4n/an/an/a /
longer_input_120Input 120queued0/4n/an/an/a /
shorter_output_20Output 20queued0/4n/an/an/a /
synthetic_pairsPaires synthétiquesqueued0/4n/an/an/a /
voltarget_returnsVol-target returnsqueued0/4n/an/an/a /
cross_sectional_relativeCross-sectionalqueued0/4n/an/an/a /
regime_voltargetRégime + vol-targetqueued0/4n/an/an/a /
short_input_40Input 40queued0/4n/an/an/a /
long_output_60Output 60queued0/4n/an/an/a /
no_signflip_ablationAblation sign-flipqueued0/4n/an/an/a /
fees_2bps_stressStress frais 2bpsqueued0/4n/an/an/a /
ta_ohlc_atr_rsi_output20OHLC technical indicators + output 20queued0/4n/an/an/aohlc_ta80 / 20High/low/open structure may distinguish breakout/range regimes better than returns alone; shorter target has been more stable in v4.
multi_resolution_regime_output20Multi-resolution regime proxy + output 20queued0/4n/an/an/amulti_resolution80 / 20Combine short/medium/long rolling horizons on the existing 6h grid before trying a new candle size.
cross_sectional_output20Cross-sectional relative features + output 20queued0/4n/an/an/across_sectional80 / 20Cross-sectional features had positive PNL median; combine with the more stable shorter target.
regime_ohlc_ta_output20Régime + OHLC/TA + horizon 20queued0/4n/an/an/aregime_ohlc_ta80 / 20Le meilleur signal complet reste shorter_output_20 (score Test médian -3.999, PNL médian positif, gap très faible). L'idée OHLC/TA déjà en queue teste high/low/ATR/RSI sans régime; cette variante atomique ajoute les marqueurs de régime car les familles ré
regime_multi_resolution_output20Régime + multi-résolution + horizon 20queued0/4n/an/an/aregime_multi_resolution80 / 20La multi-résolution simple est déjà en queue, mais les résultats complets montrent que les problèmes dominants sont worst-month et gap. Combiner horizons court/moyen/long avec features de régime peut permettre au modèle de distinguer momentum durable vs rebond
fee2bps_shorter_output20_baseStress frais 2 bps sur base horizon 20queued0/4n/an/an/abase80 / 20shorter_output_20 est la direction complète la plus robuste (PNL Test médian positif et gap médian le plus faible), mais les scores actuels sont à frais 0. Un stress 2 bps teste si le signal économique vient d'un turnover fragile ou d'un vrai edge di

Journal chercheur

TimestampAgentTypeObservations / leçonsNext focus
2026-07-05T19:56:32+00:00research_scientistreflection10 idées complètes et 1 idée incomplète observées dans la mémoire v4. shorter_output_20 reste le meilleur complet par robustesse relative: score économique Test médian -3.999, PNL médian +0.899, worst-month médian -1.500, gap médian -2.023. cross_sectional_relative a PNL médian positif (+1.709) mais score/gap encore dégradés; régime seul limite certaines catLaisser le runner finir long_output_60 puis consommer les 6 idées queue. Surveiller spécialement: OHLC/TA vs régime+OHLC/TA, multi-résolution vs régime+multi-résolution, et résistance de base output20 à 2 bps. Ne promouvoir qu'après 4 runs par idée et sans sél
2026-07-05T20:19:06Zassistant_analysismethodology_correctionLe journal indiquait shorter_output_20 comme meilleure direction médiane, mais après complétion de long_output_60 les métriques ont changé: long_output_60 est légèrement devant au score Test économique médian (-3.53 vs -4.00) et nettement devant en PNL médian, mais avec drawdown/worst-month beaucoup plus élevés. La courbe plus jolie vient probablement d’un hAjouter une page/métrique de comparaison normalisée: return per horizon, drawdown per horizon, Calmar, score risk-normalized, et envisager un backtest économique qui applique les positions sur rendements 6h réalisés plutôt que sur labels cumulés chevauchants.
2026-07-05T20:53:53Zassistant_implementationcapital_score_rolloutMise en place du score capital% normalisé: capital initial 100, rendement par step approximé par signal × y/output_window, seuil no-trade choisi sur Validation via capital_score, score = gain_pct - 1.5 × abs(max_drawdown_pct). Tous les runs v4 historiques ont été recalculés.Le Research Scientist doit utiliser la page capital.html et le capital_score médian comme critère principal de comparaison, tout en gardant les garde-fous DD%, runs positifs, exposure et Test reporting-only.
2026-07-05T22:02:14Zassistant_implementationcapital_page_val_test_clarityLa page capital a été revue pour afficher explicitement Validation et Test: best run choisi sur score capital Validation, puis colonnes Val score/gain/DD et Test score/gain/DD. Les graphiques capital % ont été ajoutés à chaque run en plus des anciens graphiques économiques absolus.Le Research Scientist doit utiliser capital.html ainsi: sélection run = best Val; promotion idée = Test médian + gain/DD médian + runs positifs + gap Val/Test.
2026-07-05T23:05:19Zassistant_one_shotisolated_temporal_gap_testTest isolé lancé sans toucher au protocole autonome: protocol one_shot_v4_gap_val3m_test1m, Val 3 mois / Test 1 mois, config TCN Huber AdamW no-signflip proche de run_0046. Résultat: capital Test score 56.38, gain 96.93%, max DD -27.04%, vs run_0046 actif Test 3m score 10.04, gain 59.26%, max DD -32.81%.Continuer auto actuel; utiliser la page special-temporal-gap-test1m.html comme preuve préliminaire pour décider si on crée un mini-protocole isolé.
2026-07-05T23:59:19+00:00research_scientistreflectionLecture v4 avec capital_score prioritaire. Les idées complètes restent toutes négatives en score capital Test médian. Le meilleur compromis par score capital médian est long_output_60 (score -19.1541, gain médian +9.94%, DD médian -20.98%, 1/4 runs positifs), devant cross_sectional_relative (-25.2097, gain +9.65%, DD -25.10%, 1/4) et short_input_40 (-36.7206Laisser le runner terminer no_signflip_ablation puis consommer les 6 idées queued. Surveiller en priorité si no_signflip garde au moins 2/4 runs positifs, puis comparer les variantes output20 enrichies au meilleur capital_score médian actuel long_output_60. Pr

Règles

Le Test guide la direction de recherche mais ne sélectionne jamais le best_model ni les seuils. Une idée n'est promue qu'après 4 runs et amélioration médiane du Test, worst-month et gap.