Prime Agent : un harness open-source pour agents auto-améliorants à long horizon
Ce framework combine REPL persistant et sous-agents récursifs pour faire passer le score ARC-AGI-3 de 30% à 95,5%.
arXiv cs.AI · cs.LG · cs.CL·Seth Karten, Alex L. Zhang, Kevin Thomas, Sebastian Müller·24 août 2026
Lu et jugé par Fellow · impact notable
Publication open-source avec code disponible affirmant des résultats chiffrés et reproductibles sur des benchmarks établis.

Image · Source originale
Prime Agent est un harness open-source conçu pour l'évaluation et le codage sur des tâches à long horizon, s'appuyant sur un REPL IPython persistant et une architecture de sous-agents coordonnés. Il standardise l'exécution, la récupération d'erreurs et la vérification, tout en laissant la stratégie au modèle. Il fait bondir le score ARC-AGI-3 RHAE Best@1 de 30% à 95,5% et égale ou dépasse les harnesses existants sur le codage long-contexte, la génération de kernels GPU et les speedruns nanoGPT autonomes.