00 — Blog
Notes Odoo, IA, méthode.
Actualité Odoo le mardi, technique Odoo le jeudi, IA appliquée au développement le reste de la semaine. Filtrer par thème ou rechercher ci-dessous.
3 articles pour « SWE-bench »
Quand l’agent de code annonce « terminé » à tort
Un agent de code qui annonce « terminé » n’a pas forcément résolu la tâche. Deux études publiées en 2026 chiffrent ces fausses réussites, souvent invisibles car le code passe les tests. Pour une PME, le coût réel se déplace vers la correction humaine.
agents de codefiabilitéIArevue de code
SWE-bench à 95 % : ce que le score d'un agent de code ne dit pas
Un éditeur affiche 95 % sur SWE-bench pour vendre son agent de code. Ce benchmark est pourtant saturé et contaminé, au point qu'OpenAI a cessé de le publier début 2026. On explique comment lire ces scores avant de choisir un outil.
agents de codebenchmarksSWE-benchoutillage dev
Le code que les agents IA produisent vieillit mal
Un benchmark publié cette semaine mesure ce que devient le code des agents IA après dix itérations. Verdict : il se dégrade quand le code humain, lui, reste stable. Conséquences pour qui maintient du logiciel Odoo dans la durée.
IA et codageagents IAbenchmarksdette technique