OpenAI vient d'annoncer GPT-6.1 Sol. Traduction officielle : un modele qui « frôle » GPT-6 Astra. Comprenez : le produit qu'on vous refile n'est pas le meilleur, il est presque le meilleur. Et c'est cense etre une bonne nouvelle.
Relisez la phrase. « Nearly matches. » Dans n'importe quel autre secteur, on appellerait ca un aveu, pas un argument de vente. Chez OpenAI, c'est un communique.
Bravo, vous avez invente le milieu de gamme
Donc GPT-6.1 Sol fait mieux que GPT-6 Sol sur les taches professionnelles complexes — code, debug, comprehension documentaire, workflows metier multi-etapes. Des mots choisis avec soin : « significative », « complexe », « metier ». Trois adjectifs pour ne rien dire de verifiable. Vous avez remplace la performance par l'ambiance.
Et surtout : on vous annonce qu'il frôle Astra. Pas qu'il l'egale. Pas qu'il le depasse. Il s'en approche. Félicitations, vous commercialisez l'approximation. La prochaine etape, c'est quoi ? Un modele qui « evoque » un raisonnement ?
« Moins cher » — le seul chiffre qui existe
Le vrai argument de vente de ce communique, ce n'est pas la performance. C'est le prix. On vous repeint un tier intermediaire en fausse revolution et on espere que personne ne regardera la grille tarifaire de trop pres.
Parce que la segmentation, c'est ca, hein : Astra pour ceux qui peuvent payer, Sol 6.1 pour les autres, et entre les deux, un mur de facturation bien lisse. On ne vend plus de la capacite, on vend des niveaux de frustration. Astra pour les equipes qui ont le budget, 6.1 Sol pour celles qui doivent se contenter d'y gouter.
Le benchmark, cette discipline scientifique
« Significant improvements. » Mesure par qui ? Sur quoi ? Avec quelle fuite de donnees dans le jeu de test ? Combien de taches tirees de cas clients reels, et combien soigneusement selectionnees pour flatter la courbe ?
On connait la routine : la maison qui vend le modele fournit aussi le tableau qui prouve que le modele est bon. Aucun auditeur independant, aucune replication, aucun acces aux prompts. Juste une jolie barre plus haute que la precedente, et un graphique PowerPoint qu'on espere que vous ne decortiquerez pas.
« Code et debug » : super. Sur quel langage, quelle base de code, quelle dette technique ? « Document understanding » : sur quels PDF pourris, ceux de vos clients ou ceux qui arrangent ? « Workflows metier » : donnez-nous le trace d'un seul workflow reel, quelque part, n'importe ou. On attendra.
Qui se goinfre, qui se fait rouler
OpenAI multiplie les paliers pour transformer une depense d'infrastructure en abonnement emotionnel. Astra, Sol, 6.1, le nommage part dans tous les sens pour qu'on ne compare plus — juste qu'on upgrader. C'est de l'ingenierie de la dependance, saupoudree de benchmarks maison.
Les entreprises qui migrent, elles, decouvrent la vraie facture : la reecriture des integrations, les evals a refaire, les prompts a revalider, les equipes a reformer. Le « moins cher » annonce a l'achat se paie en lock-in a la revente. Bienvenue dans le renouvellement annuel obligatoire.
Pendant ce temps, personne ne verifie
L'ecosysteme gobe, les newsletters relaient, les influenceurs s'extasient. Les regulateurs, eux, parlent d'« IA de confiance » en attendant le prochain sommet ou l'on remercie les memes entreprises d'avoir si gentiment co-ecrit les regles.
Alors posons la seule question qui vaille : a quoi bon un modele « presque » aussi bon, si personne — ni vous, ni vos clients, ni les autorites — ne peut verifier que c'est vrai ?
OpenAI ne vous vend pas une revolution. Il vous vend un numéro de version, un palier tarifaire, et un « presque » qui devrait tous nous faire grimacer.