La sécurité, c'est quand la machine dit oui
Selon le Wall Street Journal, OpenAI aurait rangé au placard un modèle pour « raisons de sécurité ». Un haut dirigeant du laboratoire précise la nature du danger : le modèle suivait mal les instructions. Voilà. Dix ans de rhétorique apocalyptique, des lettres ouvertes signées par la moitié de la Silicon Valley, un conseil d'administration sacrifié en cinq jours en novembre 2023, une équipe « superalignement » dissoute — pour accoucher de : le robot n'écoutait pas assez.
Notez le tour de passe-passe lexical. Dans le lexique d'OpenAI, « sécurité » ne veut pas dire « le modèle refuse de fabriquer une toxine » ni « le modèle complote pour se répliquer ». Ça veut dire : il ne fait pas ce qu'on lui dit. C'est-à-dire qu'il ne vend pas. Un modèle désobéissant n'est pas une catastrophe existentielle, c'est un deuxième trimestre décevant. Mais avouer ça, ce serait avouer que le produit est le seul dieu de la maison.
Le superalignement, c'était eux
Rappel de la chronologie, parce qu'elle est brutale. Mai 2024 : Ilya Sutskever claque la porte, Jan Leike le suit et lâche publiquement que « la culture et les processus de sécurité ont été relégués au second plan derrière des produits clinquants ». Dans la foulée, l'équipe superalignement — celle qui était censée répondre au problème le plus dur de l'humanité — est dissoute. Septembre 2024 : Mira Murati, Bob McGrew et Barret Zoph partent. Il ne reste qu'un organigramme en forme de gruyère et une « Preparedness Framework » que personne, en dehors des communiqués, n'a jamais vu opposer à une décision commerciale.
Depuis dix-huit mois, le seul dispositif de sécurité réellement observable chez OpenAI, c'est le service de presse. Et il fonctionne : on parle d'un modèle qu'on ne sort pas, jamais des modèles qu'on sort et qui hallucinent en production.
Suivez l'argent, il ne se planque pas, lui
Octobre 2024 : 6,6 milliards de dollars levés, 157 milliards de valorisation. Microsoft au capital, dans le contrat, et — détail savoureux — dans la fameuse clause qui met fin au partenariat le jour où OpenAI déclare avoir atteint l'AGI. Début 2025, l'offre de rachat d'Elon Musk à 97,4 milliards est rejetée avec le mépris qu'on réserve aux beaux-frères encombrants, pendant que le laboratoire entame sa mue en société à but lucratif.
Dans ce contexte, un modèle « retenu pour raisons de sécurité » est l'actif le moins cher du bilan. Il ne coûte rien à produire, il ne peut pas échouer en production, et il rapporte en crédibilité auprès des régulateurs. C'est du responsible AI à coût nul, payable en fuites anonymes au Wall Street Journal. Chaque modèle planqué est une ligne de communication. Belles marges.
Le vrai danger : c'est le voisin qui livre
Pendant qu'on délibère, DeepSeek sortait en janvier 2025 un modèle à poids ouverts pour une fraction du coût annoncé, et Google, Anthropic et xAI livrent à un rythme qui ne s'embarrasse pas de scrupules ontologiques. Un modèle trop prudent n'est pas une victoire éthique, c'est une part de marché offerte à un concurrent qui, lui, ne mettra pas « ne pas obéir » dans la colonne des risques catastrophiques.
La « sécurité » devient alors une segmentation marketing : nous, on est les adultes de la pièce, donc on facture plus cher. Le signal envoyé est limpide — la prudence est un produit d'appel, pas une contrainte.
Ce qu'on ne vous dit pas
L'obéissance n'est pas la sécurité, c'est le produit. Tout l'apprentissage par renforcement avec retour humain consiste à payer des gens pour apprendre à une machine à dire oui. Un modèle qui désobéit n'est pas Skynet : c'est un stagiaire mal briefé. Confondre les deux relève soit de l'incompétence, soit du brouillard organisé — et à ce niveau de la Silicon Valley, on penche franchement pour le second. La peur se vend, la prudence aussi, les deux dans le même lot.
Alors un mot pour Sam Altman : si votre définition de la sécurité se confond avec votre définition de l'obéissance, ce n'est pas de la sécurité, c'est du contrôle. Un mot pour les régulateurs : exigez les rapports d'évaluation, pas les confidences anonymes. Un mot pour Microsoft : demandez-vous ce que vaut une clause AGI signée avec une entreprise qui appelle « risque » un modèle qui ne range pas ses chaussettes.
Un modèle qui refuse d'obéir ne menace pas l'humanité. Il menace le carnet de commandes. C'est infiniment plus grave — pour eux.