Research queue
Hypothèses autonomes
Le chercheur propose des idées structurées; le runner exécute 4 runs par idée. Promotion seulement si signal répété et robustesse Test/worst-month.
Idées queue6JSONL
Runs scout4v4
Suivi des idées
| ID | Hypothèse | Statut | Runs | Test médian | Worst médian | Gap médian | Features | Win/Out | Rationale |
|---|---|---|---|---|---|---|---|---|---|
| baseline_v3_like | Baseline v3-like | queued | 0/4 | n/a | n/a | n/a | / | ||
| time_pct_minmax | Time percentile minmax | queued | 0/4 | n/a | n/a | n/a | / | ||
| regime_features | Features régime | queued | 0/4 | n/a | n/a | n/a | / | ||
| longer_input_120 | Input 120 | queued | 0/4 | n/a | n/a | n/a | / | ||
| shorter_output_20 | Output 20 | queued | 0/4 | n/a | n/a | n/a | / | ||
| synthetic_pairs | Paires synthétiques | queued | 0/4 | n/a | n/a | n/a | / | ||
| voltarget_returns | Vol-target returns | queued | 0/4 | n/a | n/a | n/a | / | ||
| cross_sectional_relative | Cross-sectional | queued | 0/4 | n/a | n/a | n/a | / | ||
| regime_voltarget | Régime + vol-target | queued | 0/4 | n/a | n/a | n/a | / | ||
| short_input_40 | Input 40 | queued | 0/4 | n/a | n/a | n/a | / | ||
| long_output_60 | Output 60 | queued | 0/4 | n/a | n/a | n/a | / | ||
| no_signflip_ablation | Ablation sign-flip | queued | 0/4 | n/a | n/a | n/a | / | ||
| fees_2bps_stress | Stress frais 2bps | queued | 0/4 | n/a | n/a | n/a | / | ||
| ta_ohlc_atr_rsi_output20 | OHLC technical indicators + output 20 | queued | 0/4 | n/a | n/a | n/a | ohlc_ta | 80 / 20 | High/low/open structure may distinguish breakout/range regimes better than returns alone; shorter target has been more stable in v4. |
| multi_resolution_regime_output20 | Multi-resolution regime proxy + output 20 | queued | 0/4 | n/a | n/a | n/a | multi_resolution | 80 / 20 | Combine short/medium/long rolling horizons on the existing 6h grid before trying a new candle size. |
| cross_sectional_output20 | Cross-sectional relative features + output 20 | queued | 0/4 | n/a | n/a | n/a | cross_sectional | 80 / 20 | Cross-sectional features had positive PNL median; combine with the more stable shorter target. |
| regime_ohlc_ta_output20 | Régime + OHLC/TA + horizon 20 | queued | 0/4 | n/a | n/a | n/a | regime_ohlc_ta | 80 / 20 | Le meilleur signal complet reste shorter_output_20 (score Test médian -3.999, PNL médian positif, gap très faible). L'idée OHLC/TA déjà en queue teste high/low/ATR/RSI sans régime; cette variante atomique ajoute les marqueurs de régime car les familles ré |
| regime_multi_resolution_output20 | Régime + multi-résolution + horizon 20 | queued | 0/4 | n/a | n/a | n/a | regime_multi_resolution | 80 / 20 | La multi-résolution simple est déjà en queue, mais les résultats complets montrent que les problèmes dominants sont worst-month et gap. Combiner horizons court/moyen/long avec features de régime peut permettre au modèle de distinguer momentum durable vs rebond |
| fee2bps_shorter_output20_base | Stress frais 2 bps sur base horizon 20 | queued | 0/4 | n/a | n/a | n/a | base | 80 / 20 | shorter_output_20 est la direction complète la plus robuste (PNL Test médian positif et gap médian le plus faible), mais les scores actuels sont à frais 0. Un stress 2 bps teste si le signal économique vient d'un turnover fragile ou d'un vrai edge di |
Journal chercheur
| Timestamp | Agent | Type | Observations / leçons | Next focus |
|---|---|---|---|---|
| 2026-07-05T15:55:00Z | system_setup | initial_state | Autonomous Research Scientist/Runner system installed. Researcher reads v4 memory, roadmap, queue, and this journal before adding hypotheses. Runner executes 4 runs per idea. | Use journal + ideas page to avoid starting from a blank page and propose coherent next hypotheses only when queue is not already saturated. |
| 2026-07-05T19:56:32+00:00 | research_scientist | reflection | 10 idées complètes et 1 idée incomplète observées dans la mémoire v4. shorter_output_20 reste le meilleur complet par robustesse relative: score économique Test médian -3.999, PNL médian +0.899, worst-month médian -1.500, gap médian -2.023. cross_sectional_relative a PNL médian positif (+1.709) mais score/gap encore dégradés; régime seul limite certaines cat | Laisser le runner finir long_output_60 puis consommer les 6 idées queue. Surveiller spécialement: OHLC/TA vs régime+OHLC/TA, multi-résolution vs régime+multi-résolution, et résistance de base output20 à 2 bps. Ne promouvoir qu'après 4 runs par idée et sans sél |
| 2026-07-05T20:19:06Z | assistant_analysis | methodology_correction | Le journal indiquait shorter_output_20 comme meilleure direction médiane, mais après complétion de long_output_60 les métriques ont changé: long_output_60 est légèrement devant au score Test économique médian (-3.53 vs -4.00) et nettement devant en PNL médian, mais avec drawdown/worst-month beaucoup plus élevés. La courbe plus jolie vient probablement d’un h | Ajouter une page/métrique de comparaison normalisée: return per horizon, drawdown per horizon, Calmar, score risk-normalized, et envisager un backtest économique qui applique les positions sur rendements 6h réalisés plutôt que sur labels cumulés chevauchants. |
| 2026-07-05T20:53:53Z | assistant_implementation | capital_score_rollout | Mise en place du score capital% normalisé: capital initial 100, rendement par step approximé par signal × y/output_window, seuil no-trade choisi sur Validation via capital_score, score = gain_pct - 1.5 × abs(max_drawdown_pct). Tous les runs v4 historiques ont été recalculés. | Le Research Scientist doit utiliser la page capital.html et le capital_score médian comme critère principal de comparaison, tout en gardant les garde-fous DD%, runs positifs, exposure et Test reporting-only. |
| 2026-07-05T22:02:14Z | assistant_implementation | capital_page_val_test_clarity | La page capital a été revue pour afficher explicitement Validation et Test: best run choisi sur score capital Validation, puis colonnes Val score/gain/DD et Test score/gain/DD. Les graphiques capital % ont été ajoutés à chaque run en plus des anciens graphiques économiques absolus. | Le Research Scientist doit utiliser capital.html ainsi: sélection run = best Val; promotion idée = Test médian + gain/DD médian + runs positifs + gap Val/Test. |
| 2026-07-05T23:05:19Z | assistant_one_shot | isolated_temporal_gap_test | Test isolé lancé sans toucher au protocole autonome: protocol one_shot_v4_gap_val3m_test1m, Val 3 mois / Test 1 mois, config TCN Huber AdamW no-signflip proche de run_0046. Résultat: capital Test score 56.38, gain 96.93%, max DD -27.04%, vs run_0046 actif Test 3m score 10.04, gain 59.26%, max DD -32.81%. | Continuer auto actuel; utiliser la page special-temporal-gap-test1m.html comme preuve préliminaire pour décider si on crée un mini-protocole isolé. |
Règles
Le Test guide la direction de recherche mais ne sélectionne jamais le best_model ni les seuils. Une idée n'est promue qu'après 4 runs et amélioration médiane du Test, worst-month et gap.