RECHERCHE
OpenForgeRL : entraînement d'agents harness-native
Un framework open-source pour entraîner des agents de bout en bout via des infrastructures d'inférence complexes.
arXiv cs.AI · cs.LG · cs.CL·Xiao Yu, Baolin Peng, Ruize Xu, Hao Zou·23 juillet 2026

Image · Source originale
OpenForgeRL est un framework conçu pour l'entraînement end-to-end d'agents basés sur des harness d'inférence complexes. Il utilise un proxy léger et un orchestrateur Kubernetes pour découpler l'entraînement de l'inférence, permettant de travailler sur n'importe quel environnement. Les résultats montrent des performances supérieures aux baselines ouvertes sur des benchmarks comme OSWorld et WebVoyager.