Toutes les news taguées avec ce sujet.
Une méthode sépare la génération de tests de la réparation pour améliorer les performances des agents.
Un framework léger prédit l'issue d'une tâche d'agent avant sa fin, coupant jusqu'à 44% des tokens consommés sans perte de précision.
Une méthode de filtrage en deux étapes optimise le fine-tuning des LLM pour le code.
Un système multi-rôles (Manager, Planner, Engineer, Reviewer) qui persiste ou pivote selon les preuves, avec état projet durable et vérification.