Lorsque la société d’IA la plus “sécurisée” commence à “courir sans freins” : un jeu de pouvoir sur la confiance, l’argent et la survie
Bonjour à tous, je suis votre journaliste financier. Aujourd’hui, nous ne parlerons pas d’un rapport technique ennuyeux, mais d’une “crise de confiance” au sommet de la Silicon Valley.
Le protagoniste de cette histoire est Anthropic, considérée comme la société la plus rigoureuse et la plus soucieuse de la sécurité dans le secteur de l’IA. Le personnage clé est Jacob Coxon, un chercheur qui a rejoint l’entreprise il y a seulement quatre mois. Le 8 septembre 2026, il a démissionné soudainement et a déclaré publiquement que les deux entreprises, Anthropic et OpenAI, prenaient des risques avec la vie humaine en poursuivant l’objectif de l’intelligence suprême, en abandonnant ainsi les principes de sécurité de base.
Cette affaire a fait un grand scandale, non pas à cause de la démission de Coxon, mais parce qu’il a dit la vérité : “J’ai quitté l’entreprise avant que les actions ne soient attribuées ; je n’ai plus besoin d’augmenter la valeur boursière d’Anthropic pour en tirer profit.”
Imaginez que vous détenez un billet gagnant d’une somme énorme (Anthropic prévoit une IPO en octobre avec une valeur estimée à 2 billions de dollars), mais que vous choisissez de le déchirer. Pourquoi ? Parce que vous pensez que l’entreprise commet une erreur grave.
Aujourd’hui, nous allons expliquer cette situation en langage simple pour comprendre les raisons qui se cachent derrière.
---
Un changement subtil : des “freins” à des “décorations”
Tout d’abord, il faut comprendre ce que Anthropic a changé.
En 2023, l’entreprise a publié une “Politique d’expansion responsable” (RSP) qui contenait une promesse très claire, que l’on peut comparer au “système de freinage d’urgence” d’une voiture :
> “Si nos mesures de sécurité ne sont pas suffisantes, nous devons interrompre l’entraînement des modèles plus puissants.”
C’était une contrainte stricte : si elle n’était pas respectée, l’entreprise ne pouvait pas continuer. C’était la marque de fabrique d’Anthropic et ce qui la distinguait d’OpenAI, qui privilégiait la vitesse.
Cependant, en février 2026, Anthropic a sorti la version 3.0 de la RSP. Cette mise à jour a supprimé ce “système de freinage d’urgence” et l’a remplacé par un “tableau de bord” plus complexe comprenant des plans d’action, des rapports de risque et une surveillance externe.
En termes simples :
Auparavant, c’était : “Si les freins ne fonctionnent pas, je m’arrête.”
Maintenant, c’est : “Si les freins ont un problème, je rédige un rapport pour expliquer pourquoi je continue de conduire et je conduis tout en surveillant le tableau de bord.”
Anthropic a expliqué que, comme les limites des capacités de l’IA sont floues, il est impossible de définir précisément quand il faut s’arrêter. Cela peut sembler logique, mais la question est : Pourquoi avoir fait de cette promesse un élément essentiel il y a deux ans, juste avant l’IPO ? Et pourquoi l’a-t-elle modifiée à ce moment-là ?
Plus inquiétant encore, à la même période, Anthropic a signé des contrats pour des ressources de calcul d’une valeur de 517 milliards de dollars sur dix ans. Une entreprise qui fixe à l’avance ses dépenses futures a du mal à décider de ralentir. La promesse de sécurité est passée d’un “nous ne faisons pas ceci” (contrainte stricte) à un “nous expliquons comment nous avons agi” (explication flexible).
Deux mots disparus : OpenAI fait également des changements
Pensez-vous que seule Anthropic a modifié ses documents ? Non, OpenAI aussi.
Dans son rapport fiscal annuel de novembre 2025 (formule 990), OpenAI a modifié son objectif :
- Auparavant : “Construire une intelligence artificielle universelle qui profite à l’humanité de manière sécurisée, **indépendamment des besoins de retour financier.”
- Maintenant : “Assurer que l’intelligence artificielle universelle profite à l’humanité.”
Notez la disparition de deux mots importants :
1. **“Sécurisée” : la promesse de sécurité a été atténuée.
2. **“Indépendamment des besoins de retour financier” : la promesse liée à l’argent a été supprimée.
Cela signifie que OpenAI ne met plus l’accent sur son existence dans le but de la sécurité humaine, ni sur son indépendance par rapport aux intérêts capitalistes. Elle ressemble de plus en plus à un géant technologique purement orienté vers la maximisation des profits.
En même temps, OpenAI a dissous trois équipes de sécurité clés au cours des deux dernières années, y compris l’équipe “Super Alignment”. Même des experts comme Ilya Sutskever ont quitté l’entreprise pour fonder des entreprises spécialisées dans la sécurité.
Interprétation :
Ces deux entreprises, qui insistaient tant sur la sécurité, rédefinissent simultanément les limites de la sécurité. Cela montre que ce n’est pas seulement le déclin moral d’une entreprise, mais un phénomène collectif dans l’industrie sous la pression du capital et de la concurrence. Lorsque la “sécurité” n’est plus un principe incontestable, mais devient une variable négociable, le danger commence.
Un paradoxe sans solution : plus de sécurité signifie-t-il plus de vitesse ?
Coxon a dit deux choses très dures lors d’une interview, révélant le dilemme de l’industrie de l’IA :
1. “Si vous êtes sous la pression de la concurrence, vous devez prendre des raccourcis ou sauter des étapes des processus de surveillance.”
2. “Une paranoïa excessive envers OpenAI et la Chine peut parfois être utilisée comme excuse pour accélérer les choses.”
Cela crée un paradoxe dangereux :
- Logique A : Si Anthropic ralentit pour effectuer des évaluations de sécurité, OpenAI ou ses concurrents chinois pourraient développer l’intelligence suprême en premier.
- Logique B : Si un concurrent y parvient en premier et que ses mesures de sécurité ne sont pas aussi bonnes que celles d’Anthropic, le risque global pour la sécurité s’accroît.
- Conclusion : Pour être “plus sûr” (pour empêcher que des acteurs incompétents ne développent l’intelligence suprême), Anthropic doit “accélérer” le processus.
- Conséquence : Mais “accélérer” signifie raccourcir les temps d’entraînement, d’évaluation et de lancement, réduisant ainsi le temps disponible pour comprendre le fonctionnement des modèles et détecter les comportements dangereux.
En langage simple :
“Pour être plus sûr, je dois courir plus vite. Mais plus je cours vite, plus je risque de ne pas être en sécurité.”
La démission de Coxon n’est pas due à son mécontentement envers Anthropic, mais au fait qu’il a réalisé que, dans ce contexte de concurrence, aucune entreprise ne peut maintenir une sécurité absolue. C’est un dilemme systémique. changer d’entreprise ne suffit pas, car tout le secteur accélère, et personne n’ose freiner, car ceux qui le font seront éliminés ou dépassés par les concurrents.
Un arrêt imminent : la sécurité repose sur des “interventions a posteriori”, pas sur la “prévention”
L’article mentionne un événement clé : l’incident “Fable 5” en juin 2026.
Anthropic a lancé le nouveau modèle Fable 5. Deux jours plus tard, le PDG d’Amazon a appelé la Maison Blanche pour signaler une faille dans le modèle, permettant de contourner les mesures de sécurité. La Maison Blanche a convoqué une réunion d’urgence, et le département du Commerce a imposé des restrictions d’exportation, entraînant l’arrêt mondial de Fable 5.
De la publication à l’arrêt, il n’a fallu que trois jours.
Un fait cruel :
Ce qui a stoppé le modèle, ce n’est pas la nouvelle ligne rouge de sécurité modifiée par Anthropic, mais l’intervention forcée du gouvernement après que le risque a été révélé.
Cela montre que les promesses de sécurité d’Anthropic n’ont pas joué leur rôle de “barrage préventif” au moment crucial. Elles ressemblent plutôt à des mesures de “relations publiques” ou de “conformité a posteriori”. Lorsque le risque est suffisamment important, des forces externes (comme le gouvernement) interviennent rapidement. Mais le problème est que le risque a déjà été créé.
La ligne rouge modifiée dans la RSP 3.0 était censée agir avant que le risque ne se produise. Maintenant, elle est inutile. Nous assistons à une situation où il n’y a pas de “prévention”, mais à une gestion des conséquences.
Un cauchemar pour les investisseurs : à quel prix la sécurité ?
Enfin, regardons le marché financier.
La valeur d’Anthropic est estimée à 2 billions de dollars, et son histoire de marque est : “Nous sommes la société d’IA la plus sûre.” Les investisseurs achètent non seulement les capacités du modèle, mais aussi la promesse de “gouvernance de la sécurité”.
Cependant, si les promesses de sécurité peuvent être modifiées sous la pression de la concurrence, leur valeur dans les investissements doit être remise en question.
- Un rapport de Morningstar souligne que l’incident Fable 5 a transformé ces promesses en un risque financier.
- David Sacks (conseiller en technologie américain) recommande d’attendre que les enquêtes soient terminées avant l’IPO d’Anthropic.
Qu’est-ce que cela signifie pour le grand public ?
1. Effondrement de la valeur de la marque : si la “sécurité” n’est qu’un argument marketing et non une contrainte réelle, la valeur d’Anthropic est fragilisée.
2. Crise de conformité : si les autorités réglementaires constatent que les promesses de sécurité ne correspondent pas aux actions réelles, cela représente non seulement une crise de relations publiques, mais aussi une crise de conformité légale.
3 Vote de confiance : La démission de Coxon est un signe de méfiance envers l’entreprise. Il montre au marché avec son argent que il ne croit pas que le système puisse se corriger lui-même.
En résumé :
La démission de Coxon n’est pas une question personnelle ; elle révèle que, dans ce contexte de concurrence, aucune entreprise ne peut garantir sa sécurité seule. C’est un dilemme systémique. Changer d’entreprise ne résout rien, car tout le secteur accélère, et personne n’ose freiner, car ceux qui le font seront éliminés ou dépassés.
La sécurité ne repose plus sur des principes incontestables, mais sur des interventions a posteriori. Pour les investisseurs, cela signifie :
- Ne pas croire aveuglément aux promesses de sécurité des géants technologiques ; il faut se fier aux actions de ces entreprises et aux réactions des autorités de régulation.
- Prêter attention aux évolutions réglementaires dans le secteur de l’IA, car la sécurité dépend désormais dans une large mesure des interventions gouvernementales, et non de l’autodiscipline des entreprises.
- Se méfier d’une culture qui met la vitesse avant toute chose, car dans le domaine de l’IA, la vitesse est souvent obtenue au détriment de la sécurité, et les conséquences peuvent être lourdes pour toute l’humanité.
Il n’y a pas de gagnant dans ce jeu : Anthropic a perdu un chercheur clé, OpenAI a perdu son statut moral, et les investisseurs se tiennent au bord d’un abîme, regardant une voiture sans freins filer à toute vitesse.