Plaza de Mayo Info
Ciencia y Tecnología Destacada

Alerta en Silicon Valley: exinvestigadores de OpenAI y Anthropic advierten que la IA podría salirse de control

El investigador Jacob Coxon dimitió de Anthropic tras acusar a las principales empresas del sector de competir irresponsablemente por la superinteligencia. Un jefe de seguridad de la firma admitió que existe más de un 10% de probabilidad de que la IA provoque la extinción humana.

El investigador británico Jacob Coxon, de 27 años y con formación en matemática, hizo pública su renuncia a la empresa de inteligencia artificial Anthropic mediante un mensaje en la red social X. La publicación acumuló decenas de millones de visualizaciones en pocas horas.

Según consignó la periodista Mamen Borreguero en Business Insider España, Coxon se desempeñó durante tres años en labores de investigación de preentrenamiento —fase en la que los modelos procesan volúmenes masivos de datos— tanto en OpenAI como en Anthropic. En OpenAI integró el equipo técnico desde 2023 hasta julio de 2026, periodo en el que participó en el desarrollo del modelo GPT-4o, para luego trasladarse a Anthropic atraído por la reputación de la firma en materia de seguridad.

En su declaración de salida, Coxon aseveró que «ninguna de las dos compañías está actuando de manera responsable» y sostuvo que ambas firmas avanzan hacia sistemas superinteligentes capaces de automejorarse, «apostando con nuestras vidas». El especialista afirmó que entre los desarrolladores existe el convencimiento de que la tecnología podría provocar el riesgo extintivo de la humanidad para finales de la presente década. Asimismo, en declaraciones recogidas por The Wall Street Journal y difundidas por el periodista Opy Morales en Infobae, Coxon advirtió que para finales del próximo año la capacidad de los modelos podría escapar del control humano.

Admisión interna: más del 10% de probabilidad de catástrofe

La repercusión de la dimisión de Coxon se amplificó tras la respuesta pública de Evan Hubinger, quien dirige un equipo de seguridad en Anthropic y permanece dentro de la compañía.

Hubinger respaldó públicamente las declaraciones de Coxon y confirmó la gravedad de los diagnósticos internos. El directivo declaró que dentro de la empresa existe el convencimiento de que la IA podría causar la extinción de la humanidad y calculó a título personal más de un 10% de probabilidad de que dicho evento ocurra en la próxima década.

El responsable de seguridad admitió además que Anthropic no dispone actualmente de un plan para resolver el problema de la alineación de una superinteligencia, concepto que refiere a la capacidad de garantizar que un sistema comparta y respete los valores humanos.

Competencia comercial frente a la seguridad civilizatoria

En su análisis sobre la dinámica del sector, Coxon diferenció el funcionamiento de los dos laboratorios líderes. De acuerdo con su testimonio, en OpenAI muchos integrantes no han asimilado la magnitud de los riesgos civilizatorios en juego. En Anthropic, en cambio, aunque los riesgos son comprendidos, la organización se encuentra inmersa en una competencia comercial por liderar el mercado bajo la premisa de que si no avanzan ellos, otras entidades lo harán sin reparos de seguridad.

El investigador caracterizó esta carrera por el desarrollo superinteligente como una «apuesta soberbia» ejecutada desde el entorno corporativo privado. En sus declaraciones al Journal, cuestionó que decisiones de trascendencia global dependan de ingenieros en San Francisco en lugar de abordarse bajo esquemas de máxima seguridad institucional, comparando la gravedad del escenario con el Proyecto Manhattan.

Antecedentes de dimisiones e incidentes técnicos

La salida de Coxon se suma a renuncias previas de profesionales abocados a las salvaguardas tecnológicas. En febrero de 2026, Mrinank Sharma dimitió del equipo de seguridad de Anthropic cuestionando la primacía de los compromisos comerciales sobre los valores éticos. Previamente, en 2024, Jan Leike dejó la jefatura de alineación de OpenAI tras señalar que la cultura de seguridad había perdido prioridad frente al lanzamiento de productos comerciales.

Paralelamente a estas salidas, se han registrado fallas operativas en los laboratorios. En julio de 2026, OpenAI reportó que sus modelos salieron de un entorno de prueba e ingresaron a sistemas de la plataforma Hugging Face, hecho que la firma calificó como un «disparo de advertencia«. Por su parte, Anthropic reconoció tres episodios de acceso no autorizado de sus modelos a sistemas de organizaciones externas.

Estos acontecimientos se producen en un contexto financiero crítico para Anthropic, que tramita su salida a bolsa con una valuación pretendida de 2 billones de dólares estadounidenses, presentando el desarrollo responsable como su principal rasgo distintivo ante los inversores.

Noticias relacionadas

Máximo Kirchner detalló la rigurosa rutina de estudio de Cristina: chino, inglés e Inteligencia Artificial

Editora General

El CIN advierte que las políticas de ajuste de Javier Milei comprometen la soberanía científica y productiva nacional

Editora

Jorge Capitanich denunció la destrucción del aparato productivo: “Es una catástrofe social”

Editora
Cargando .....