Repo0 vise la génération de code de zéro à un projet complet
Le framework fait évoluer l’architecture du dépôt avant de générer le code selon une approche pilotée par les tests.
Pourquoi c'est important
Ces travaux répondent à une lacune pratique du codage agentique : générer non seulement des fichiers, mais aussi une architecture de dépôt maintenable à partir de zéro. Si les résultats sont reproductibles, une planification tenant compte de l’architecture pourrait améliorer la fiabilité des systèmes d’IA chargés de construire des projets logiciels complets.
Points clés
- 1.Repo0 construit des projets à partir d’exigences en langage naturel.
- 2.Un Dual-DAG suit les exigences, les composants et leur alignement.
- 3.Des tests sur six dépôts RepoCraft ont montré les meilleurs niveaux de couverture et taux de réussite.
HF Daily Papers a mis en avant Repo0, un framework de génération de code de zéro à un projet complet dans lequel un agent construit tout un projet logiciel à partir d’exigences formulées en langage naturel. Repo0 conserve un état architectural explicite sous forme de Dual-DAG reliant exigences, composants et alignement entre les deux, puis ajuste de manière itérative les frontières des composants à l’aide de métriques de modularité avant de générer le code selon une approche de développement pilotée par les tests. Les auteurs l’ont évalué sur six dépôts RepoCraft avec GPT-5 mini et DeepSeek V3.2, et indiquent avoir obtenu la meilleure couverture fonctionnelle et le meilleur taux de réussite dans toutes les configurations.
⚡ À tester aujourd'hui
Lisez l’article avant d’utiliser des agents de codage pour générer un nouveau dépôt à partir de zéro, surtout si la qualité de l’architecture compte.
Sources et articles originaux
Ce brief résume et renvoie vers la couverture des médias ci-dessous.
Ce brief vous a plu ? Recevez le prochain par e-mail.
Plus dans Recherche
Google DeepMind s’associe à des studios de jeux autour du gameplay IA
Le laboratoire affirme s’appuyer sur 15 ans de recherche sur les jeux pour prototyper du gameplay IA.
MemTrapBench teste les pièges cognitifs liés à l’usage de la mémoire par les LLM
Le benchmark montre que la mémoire peut dégrader les performances, même lorsque les éléments retrouvés sont pertinents.
AI4AI-Bench teste les agents sur la conception d’algorithmes d’entraînement
Ce benchmark publié sur arXiv évalue si des agents LLM peuvent réécrire des algorithmes d’entraînement dans des dépôts figés.