Research queue
Hypothèses autonomes
Le chercheur propose des idées structurées; le runner exécute 4 runs par idée. Promotion seulement si signal répété et robustesse Test/worst-month.
Idées queue8JSONL
Runs scout1v4
Suivi des idées
| ID | Hypothèse | Statut | Runs | Test médian | Worst médian | Gap médian | Features | Win/Out | Rationale |
|---|---|---|---|---|---|---|---|---|---|
| baseline_v3_like | Baseline v3-like | queued | 0/4 | n/a | n/a | n/a | / | ||
| time_pct_minmax | Time percentile minmax | queued | 0/4 | n/a | n/a | n/a | / | ||
| regime_features | Features régime | queued | 0/4 | n/a | n/a | n/a | / | ||
| longer_input_120 | Input 120 | queued | 0/4 | n/a | n/a | n/a | / | ||
| shorter_output_20 | Output 20 | queued | 0/4 | n/a | n/a | n/a | / | ||
| synthetic_pairs | Paires synthétiques | queued | 0/4 | n/a | n/a | n/a | / | ||
| voltarget_returns | Vol-target returns | queued | 0/4 | n/a | n/a | n/a | / | ||
| cross_sectional_relative | Cross-sectional | queued | 0/4 | n/a | n/a | n/a | / | ||
| regime_voltarget | Régime + vol-target | queued | 0/4 | n/a | n/a | n/a | / | ||
| short_input_40 | Input 40 | queued | 0/4 | n/a | n/a | n/a | / | ||
| long_output_60 | Output 60 | queued | 0/4 | n/a | n/a | n/a | / | ||
| no_signflip_ablation | Ablation sign-flip | queued | 0/4 | n/a | n/a | n/a | / | ||
| fees_2bps_stress | Stress frais 2bps | queued | 0/4 | n/a | n/a | n/a | / | ||
| ta_ohlc_atr_rsi_output20 | OHLC technical indicators + output 20 | queued | 0/4 | n/a | n/a | n/a | ohlc_ta | 80 / 20 | High/low/open structure may distinguish breakout/range regimes better than returns alone; shorter target has been more stable in v4. |
| multi_resolution_regime_output20 | Multi-resolution regime proxy + output 20 | queued | 0/4 | n/a | n/a | n/a | multi_resolution | 80 / 20 | Combine short/medium/long rolling horizons on the existing 6h grid before trying a new candle size. |
| cross_sectional_output20 | Cross-sectional relative features + output 20 | queued | 0/4 | n/a | n/a | n/a | cross_sectional | 80 / 20 | Cross-sectional features had positive PNL median; combine with the more stable shorter target. |
| regime_ohlc_ta_output20 | Régime + OHLC/TA + horizon 20 | queued | 0/4 | n/a | n/a | n/a | regime_ohlc_ta | 80 / 20 | Le meilleur signal complet reste shorter_output_20 (score Test médian -3.999, PNL médian positif, gap très faible). L'idée OHLC/TA déjà en queue teste high/low/ATR/RSI sans régime; cette variante atomique ajoute les marqueurs de régime car les familles ré |
| regime_multi_resolution_output20 | Régime + multi-résolution + horizon 20 | queued | 0/4 | n/a | n/a | n/a | regime_multi_resolution | 80 / 20 | La multi-résolution simple est déjà en queue, mais les résultats complets montrent que les problèmes dominants sont worst-month et gap. Combiner horizons court/moyen/long avec features de régime peut permettre au modèle de distinguer momentum durable vs rebond |
| cross_sectional_output60 | Cross-sectional relative features + horizon 60 | queued | 0/4 | n/a | n/a | n/a | cross_sectional | 80 / 60 | Les deux meilleures familles complètes par capital_score médian Test restent long_output_60 (-19.15, gain médian +9.94%, DD -20.98%) et cross_sectional_relative (-25.21, gain médian +9.65%). Cette hypothèse combine atomiquement l horizon 60, qui semble mieux a |
| no_signflip_multi_resolution_output20 | Multi-résolution output20 sans sign-flip train | queued | 0/4 | n/a | n/a | n/a | multi_resolution | 80 / 20 | La famille multi_resolution_regime_output20 est désormais le meilleur compromis complet par capital_score Test médian (-15.09) avec gain médian +21.87% et 2/4 runs positifs, mais un run catastrophique (-94.53) signale une fragilité de généralisation. L ablatio |
| fee2bps_shorter_output20_base | Stress frais 2 bps sur base horizon 20 | queued | 0/4 | n/a | n/a | n/a | base | 80 / 20 | shorter_output_20 est la direction complète la plus robuste (PNL Test médian positif et gap médian le plus faible), mais les scores actuels sont à frais 0. Un stress 2 bps teste si le signal économique vient d'un turnover fragile ou d'un vrai edge di |
Journal chercheur
| Timestamp | Agent | Type | Observations / leçons | Next focus |
|---|---|---|---|---|
| 2026-07-06T20:09:52+00:00 | research_scientist | reflection | Réveil autonome avec capital_score comme métrique principale. La mémoire v4 contient 57 runs. Toutes les familles complètes restent négatives en capital_score Test médian. Les deux meilleurs compromis complets restent long_output_60 (-19.15, gain +9.94%, DD -20.98%, 1/4 positif) et no_signflip_ablation (-20.48, gain +32.70%, DD -32.81%, 2/4 positifs). cross_ | Laisser le runner consommer les 6 idées incomplètes/queued restantes après ajout: multi_resolution_regime_output20, cross_sectional_output20, regime_ohlc_ta_output20, regime_multi_resolution_output20, fee2bps_shorter_output20_base et cross_sectional_output60. |
| 2026-07-06T23:03:20Z | assistant_one_shot | isolated_val6m_test6m_6models_one_run | Test isolé Val6m/Test6m avec superposition jusqu à 6 modèles lancé sur TCN/Huber/AdamW. Résultat capital Test: score -36.01, gain 11.12%, max DD -31.42%, worst-month -26.54%, exposure 0.89, active_models=6. Validation reste forte: score 254.98, gain 287.17%, DD -21.46. | Si on poursuit, confirmer Val6m/Test1m sur 4 architectures; envisager ensuite train 18m/24m seulement dans un protocole séparé. |
| 2026-07-06T23:25:26Z | assistant_one_shot | isolated_train6m_val6m_test1m_one_run | Test isolé Train6m/Val6m/Test1m lancé sur TCN/Huber/AdamW. Résultat capital Test: score -49.20, gain 8.51%, DD -38.47%, worst-month -28.73%. Validation: score 89.15, gain 123.97%, DD -23.22%. | Si on poursuit, confirmer Train12/Val6/Test1m avec mini-protocole 4 runs avant toute promotion. |
| 2026-07-06T23:42:47Z | assistant_one_shot | isolated_train24m_val6m_test1m_one_run | Test isolé Train24m/Val6m/Test1m lancé sur TCN/Huber/AdamW. Résultat capital Test: score 47.69, gain 82.00%, DD -22.87%, worst-month -14.17%, exposure 0.76, seuil capital p50. Validation: score 175.75, gain 207.55%, DD -21.20%. | Mini-protocole 4 runs Train12/Val6/Test1m ou comparaison Train12 vs Train24 sur plusieurs architectures si on veut confirmer. |
| 2026-07-06T23:45:47Z | assistant_correction | isolated_train24m_val6m_test1m_correction | Correction: le résultat réel Train24m/Val6m/Test1m est négatif, pas positif. Capital Test: score -54.01, gain 9.31%, DD -42.22%, worst-month -14.63%, exposure 1.00, seuil capital p0. Validation: score 114.23, gain 148.12%, DD -22.59%. Ancien economic_score Test -24.55. | Priorité: confirmer Train12m/Val6m/Test1m par mini-protocole 4 runs avant toute intégration. |
| 2026-07-07T00:11:48+00:00 | research_scientist | reflection | Réveil autonome avec capital_score prioritaire. La mémoire v4 contient 61 runs. Nouveau fait important: multi_resolution_regime_output20 est maintenant complète et devient la meilleure famille par capital_score Test médian (-15.09), avec gain médian +21.87%, DD médian -24.64% et 2/4 runs positifs. Cette amélioration reste fragile car son pire run est très né | Laisser le runner consommer les 6 idées incomplètes désormais en queue: cross_sectional_output20, regime_ohlc_ta_output20, regime_multi_resolution_output20, fee2bps_shorter_output20_base, cross_sectional_output60 et no_signflip_multi_resolution_output20. Proch |
Règles
Le Test guide la direction de recherche mais ne sélectionne jamais le best_model ni les seuils. Une idée n'est promue qu'après 4 runs et amélioration médiane du Test, worst-month et gap.