Cuando las empresas de IA “más seguras” comienzan a actuar de manera imprudente: un juego sobre la confianza, el dinero y la supervivencia
Hola a todos, soy vuestro periodista financiero. Hoy no vamos a hablar de un aburrido informe técnico, sino de una “crisis de confianza” que ocurre en la cima de Silicon Valley.
El protagonista de esta historia es Anthropic, la empresa considerada la más responsable y segura en el sector de la IA. El personaje central es Jacob Coxon, un investigador que acaba de unirse a la compañía hace cuatro meses. El 8 de septiembre de 2026, presentó su renuncia y declaró públicamente que ambas empresas, Anthropic y OpenAI, están arriesgando la vida de las personas al perseguir la superinteligencia, abandonando así los principios básicos de seguridad.
Lo que hizo que este asunto saltara a la vista no fue tanto su renuncia como el hecho de que Coxon dijo algo muy importante: “Me fui antes de que se definieran los derechos de propiedad de las acciones; ya no necesito aumentar la valoración de Anthropic para obtener beneficios”.
Imagínense tener en sus manos un boleto ganador de una enorme cantidad de dinero (se espera que Anthropic realice su IPO en octubre con una valoración de 2 billones de dólares) y decidir destruirlo. ¿Por qué? Porque cree que la empresa está haciendo algo incorrecto, algo extremadamente erróneo.
Hoy vamos a desglosar la lógica detrás de esto en términos sencillos para que todos puedan entenderlo.
---
I. De los “frenos” a los “adornos”: la modificación silenciosa de los compromisos de seguridad
Primero, debemos entender qué cambió en Anthropic.
En 2023, Anthropic publicó la “Política de Expansión Responsable” (RSP), que incluía una promesa muy estricta que podríamos considerar el equivalente al “sistema de frenos de emergencia” de un coche:
> “Si nuestras medidas de seguridad no son adecuadas, debemos suspender el entrenamiento de modelos más potentes.”
Era una restricción firme: si no se cumplía, no se podía continuar. En ese momento, esto era la marca distintiva de Anthropic y su principal diferencia con OpenAI, que buscaba la velocidad.
Pero en febrero de 2026, Anthropic lanzó la RSP 3.0. En esta actualización, ese “sistema de frenos de emergencia” desapareció y fue reemplazado por un conjunto más complejo de herramientas, como mapas de ruta y informes de riesgo, así como supervisión externa.
En términos sencillos:
Antes era: “Si los frenos fallan, me detengo”.
Ahora es: “Si hay algún problema con los frenos, escribo un informe explicando por qué sigo conduciendo y lo hago mientras observo el panel de control”.
Anthropic argumentó que, debido a la incertidumbre sobre los límites de la capacidad de la IA, no es posible definir con precisión cuándo debemos detenernos, por lo que los frenos estrictos no son viables. Esto puede parecer lógico, pero la pregunta es: ¿por qué se estableció esta promesa como un punto destacado hace dos años? ¿Y por qué se modificó justo antes de la IPO?
Lo que es aún más preocupante es que, en ese mismo período, Anthropic firmó contratos por un valor de 517 mil millones de dólares para computación para los próximos diez años. Una empresa que ya ha asegurado sus gastos futuros es menos propensa a detenerse. El compromiso de seguridad pasó de “no hacer algo” (una restricción estricta) a “cómo explicar lo que hemos hecho” (una explicación flexible).
II. Dos palabras que desaparecieron: OpenAI también está “desmaquillándose”
¿Pensaban que solo Anthropic estaba modificando sus documentos? No, OpenAI también está haciendo cambios.
En su formulario fiscal anual (990) de noviembre de 2025, OpenAI modificó discretamente su declaración de misión:
- Antes: “Construir inteligencia artificial general que beneficie a toda la humanidad de manera segura, sin estar restringida por las necesidades de retorno financiero.
- Ahora: “Asegurar que la inteligencia artificial general beneficie a toda la humanidad”.
Noten la ausencia de dos palabras clave:
1. “Seguro”: La promesa de seguridad se ha atenuado.
2. **“Sin estar restringida por las necesidades de retorno financiero”: La promesa relacionada con el dinero también ha desaparecido.
Esto significa que OpenAI ya no enfatiza que existe para la seguridad de la humanidad, ni que actúa independientemente de los intereses financieros. Se ha convertido en un gigante tecnológico que busca maximizar las ganancias.
Al mismo tiempo, OpenAI disolvió tres equipos centrales de seguridad en los últimos dos años, incluido el famoso “Equipo de Superalineación”. Incluso figuras destacadas como Ilya Sutskever dejaron la empresa para fundar otra dedicada a la seguridad.
Interpretación: Estas dos empresas, que siempre han enfatizado la seguridad, están redefiniendo los límites de lo que es seguro en el mismo período. Esto no es un problema de una sola empresa, sino un fenómeno colectivo en toda la industria, impulsado por la presión del capital y la competencia. Cuando la “seguridad” deja de ser un principio innegociable y se convierte en un elemento negociable, surge el peligro.
III. Un paradoja sin solución: ¿Más seguridad significa ir más rápido?
En sus declaraciones, Coxon mencionó dos puntos muy dolorosos que revelan el dilema del sector de la IA:
1. “Si estás bajo presión competitiva, debes tomar atajos o omitir pasos del proceso de supervisión”.
2. “La paranoia excesiva hacia OpenAI y China a veces se utiliza como excusa para acelerar el desarrollo”.
Esto crea un terrible paradoja de seguridad:
- Lógica A: Si Anthropic se ralentiza para realizar evaluaciones de seguridad, OpenAI o sus competidores chinos podrían desarrollar la superinteligencia primero.
- Lógica B: Si los competidores lo logran primero y sus medidas de seguridad no son tan buenas como las de Anthropic, el riesgo global aumenta.
- Conclusión: Para ser “más seguros” (para evitar que alguien inseguro desarrolle la superinteligencia primero), Anthropic debe alcanzar la superinteligencia más rápido.
- Consecuencia: Pero “más rápido” significa acortar el tiempo de entrenamiento, evaluación y lanzamiento, lo que reduce el tiempo disponible para comprender los mecanismos internos de los modelos y detectar comportamientos peligrosos.
En resumen:
“Para ser más seguros, debo correr más rápido. Pero cuanto más rápido corro, menos seguro soy”.
Coxon renunció no porque odiara a Anthropic, sino porque se dio cuenta de que, en este entorno competitivo, ninguna empresa puede mantener la seguridad por sí sola. Es un dilema sistémico: cambiar de empresa no ayuda, ya que todo el sector está acelerando y nadie se atreve a frenar, ya que quienes lo hagan serán eliminados o superados por sus competidores.
IV. Tres días para retirar el producto: la seguridad depende de la “intervención posterior” y no de la “prevencción”
El artículo menciona un evento clave: el incidente con el modelo Fable 5 en junio de 2026.
Anthropic lanzó el nuevo modelo Fable 5. Dos días después, el CEO de Amazon llamó al White House para informar que el modelo tenía una vulnerabilidad que permitía evitar las restricciones de seguridad. El White House convocó una reunión de emergencia y el Departamento de Comercio emitió una orden de control de exportación, lo que llevó a la retirada del modelo en todo el mundo.
Desde el lanzamiento hasta la retirada, solo pasaron tres días.
Aquí hay un hecho cruel: Lo que hizo que el modelo fuera retirado no fue la nueva política de seguridad de Anthropic, sino la intervención del gobierno una vez que el riesgo ya se había producido.
Esto demuestra que los compromisos de seguridad de Anthropic no funcionaron como un mecanismo de “intercepción previa”. Más bien, se trataba de una herramienta de “relaciones públicas posterior” o de cumplimiento con las regulaciones. Cuando el riesgo es lo suficientemente grande, las autoridades intervienen, pero el daño ya ha ocurrido.
V. El sueño roto de los inversores: ¿Cuánto vale una promesa de seguridad?
Finalmente, dirigimos nuestra atención al mercado de capitales.
La valoración de Anthropic alcanza los 2 billones de dólares, y su historia de marca es: “Somos la empresa de IA más segura”. Los inversores no solo compran la capacidad del modelo, sino también el compromiso de “gobierno de la seguridad”.
Pero si los compromisos de seguridad pueden ser modificados por la presión competitiva, entonces su valoración debería ser reducida en las evaluaciones de inversión.
- Un informe de Morningstar señala que el incidente con Fable 5 convirtió la promesa de seguridad en un riesgo financiero.
- David Sacks (asesor tecnológico estadounidense) ha sugerido que la IPO de Anthropic debería ser pospuesta hasta que se investigue a fondo.
¿Qué significa esto para la gente común?:
1. El colapso del valor de la marca: Si la “seguridad” es solo una promesa de marketing y no una obligación real, la base de la valoración de Anthropic se debilita.
2. Una crisis de cumplimiento: Si las autoridades determinan que sus compromisos de seguridad no coinciden con sus acciones reales, se trata no solo de una crisis de relaciones públicas, sino también de una crisis legal.
3. Un voto de confianza: La renuncia de Coxon es como un voto de desconfianza hacia la empresa. Con su dinero, está diciendo al mercado: “No creo que este sistema sea capaz de corregirse por sí mismo”.
En resumen:
La renuncia de Coxon puede parecer insignificante frente a una valoración de 2 billones de dólares, pero sus palabras son muy importantes. Indican que la promesa de seguridad de Anthropic no es tan sólida como parece. Esto pincha el balón más ostentoso del sector de la IA: pensábamos que estábamos construyendo un futuro más seguro, pero en realidad estamos creando máquinas más caras, más incontrolables y que dependen del gobierno para garantizar su seguridad.
Cuando la “seguridad” deja de ser un principio innegociable y se convierte en algo que se puede negociar, perdemos no solo los mecanismos de control técnico, sino también los principios morales.
Para la gente común, esto significa:
- No confiar ciegamente en las promesas de seguridad de las empresas tecnológicas; debemos observar sus acciones y la respuesta de las autoridades reguladoras.
- Prestar atención a las tendencias de regulación en el sector de la IA, ya que la seguridad actual depende en gran medida de la intervención gubernamental, no de la autodisciplina de las empresas.
- Ser conscientes de la cultura que prioriza la velocidad, ya que en el ámbito de la IA, la velocidad a menudo se logra a costa de la seguridad, y este precio puede ser pagado por toda la humanidad.
En este juego no hay ganadores. Anthropic ha perdido a uno de sus investigadores más importantes, OpenAI ha perdido su posición moral, y los inversores se encuentran al borde de un abismo, observando cómo los coches sin frenos pasan a toda velocidad.