Notes Odoo, IA, méthode.
9 articles pour « benchmarks »
Odoo 19 accélère vos pivots avec GROUPING SETS, read_group déprécié
Odoo 19 regroupe les requêtes des vues pivot en une seule grâce aux GROUPING SETS de PostgreSQL, et déprécie read_group au profit de _read_group et formatted_read_group. Le gain de vitesse est gratuit, mais vos surcharges de read_group demandent une relecture.
SWE-bench à 95 % : ce que le score d'un agent de code ne dit pas
Un éditeur affiche 95 % sur SWE-bench pour vendre son agent de code. Ce benchmark est pourtant saturé et contaminé, au point qu'OpenAI a cessé de le publier début 2026. On explique comment lire ces scores avant de choisir un outil.
La rétention nette devient l'arbitre des valorisations SaaS en 2026
Snowflake a publié 125 % de rétention nette pendant que son action perdait la moitié de sa valeur. En 2026, le NRR est devenu le chiffre qui trie les valorisations SaaS, et le passage au pricing à l'usage l'a rendu volatile dans les deux sens. Pour l'acheteur PME, la clause de consommation pèse désormais autant que le prix affiché.
Odoo master, fin mai 2026 : trois commits qui parlent vraiment
On a ouvert le dépôt Odoo pour la semaine du 28 mai au 5 juin 2026. Validation de stock divisée par cinq, retours clients en self-service et une refonte discrète du cœur de l'ORM. La lecture d'un intégrateur.
Le code que les agents IA produisent vieillit mal
Un benchmark publié cette semaine mesure ce que devient le code des agents IA après dix itérations. Verdict : il se dégrade quand le code humain, lui, reste stable. Conséquences pour qui maintient du logiciel Odoo dans la durée.
Opus 4.8 transforme Claude Code en chef d'orchestre. On a regardé sous le capot
Le 28 mai, Anthropic a sorti Opus 4.8 et les Dynamic Workflows : Claude Code peut désormais lancer des centaines de sous-agents en parallèle sur une seule session. Le benchmark phare parle d'une migration de 750 000 lignes en 11 jours. Lecture côté studio, réserves comprises.
Claude Opus 4.7 : ce qui change vraiment dans un workflow SaaS
Anthropic a sorti Opus 4.7. Sur le papier, une incrémentation. Dans un workflow de studio qui livre en production, plusieurs changements obligent à retoucher prompts, budgets tokens et permissions Claude Code.
Claude Mythos : le modèle qu'on ne peut pas avoir change déjà tout
Anthropic vient de dévoiler Mythos, son modèle le plus puissant à ce jour — et refuse de le rendre public. Pour les builders SaaS, ce n'est pas juste une annonce sécurité. C'est un avant-goût de ce à quoi le développement va ressembler dans six mois.
Les agents de codage passent à l'échelle industrielle
Skill-creator avec des evals, Copilot CLI en v1.0, GPT-5.4 dans Copilot : la semaine a été chargée côté outillage. Ce qui change concrètement pour les équipes qui shipent.