Qué significa que Jacob Coxon dimita de Anthropic y su jefe de alineamiento cifre el riesgo en más del 10% — 9 de septiembre de 2026
noticias ia para empresas agentes de ia automatizacion de procesos seguridad de la ia anthropic openai superinteligencia

Qué significa que Jacob Coxon dimita de Anthropic y su jefe de alineamiento cifre el riesgo en más del 10% — 9 de septiembre de 2026

· CompaniesAutomation

Edición flash del Radar: Jacob Coxon dimite de Anthropic acusando a la empresa y a OpenAI de correr hacia una superinteligencia que se automejora, y Evan Hubinger, responsable de alineamiento, le responde en público que sitúa el riesgo de extinción por encima del 10% en la próxima década. Qué cambia de verdad para tu empresa: nada en los modelos de hoy, mucho en cómo contratas a tu proveedor y en qué automatizaciones dejas correr sin nadie mirando.

Edición flash. Jacob Coxon ha dimitido de Anthropic acusando a la empresa y a OpenAI de «jugarse nuestras vidas», y el jefe de alineamiento de Anthropic le ha dado la razón en público. Complemento del Radar de esta mañana.

Qué ha pasado

Coxon, que ha pasado tres años haciendo investigación de preentrenamiento en OpenAI y después en Anthropic, anunció su dimisión este miércoles: «Ninguna de las dos empresas está actuando de forma responsable. Van directas a una superinteligencia que se automejora y se están jugando nuestras vidas» (su mensaje en X). Dice que dentro de Anthropic el riesgo se entiende, pero que la empresa se cree obligada a correr. Lo inusual llegó después: Evan Hubinger, responsable de Ciencia del Alineamiento en Anthropic, le respondió que «Jacob tiene razón: creemos sinceramente que la IA podría matarnos a todos», que él lo sitúa en «más del 10% en la próxima década» y que Anthropic «no tiene todavía un plan para resolver el alineamiento de la superinteligencia» (su respuesta, recogida por Forbes). La empresa no ha hecho declaración oficial.

Por qué importa

Lee la letra pequeña: Hubinger dice que el riesgo de los modelos de hoy es bajo y que lo que le preocupa es la superinteligencia por automejora recursiva. Nada de esto cambia tu hoja de ruta. Lo que sí cambia es el perfil de tu proveedor: cuando el responsable de seguridad de un laboratorio admite en abierto que no hay plan, has dejado de contratar una utility estable y estás contratando a una empresa en carrera, con fuga de gente de seguridad y presión de calendario. Eso es riesgo de continuidad, no de ciencia ficción.

Para tu empresa

Tres cosas, ninguna cuesta dinero. Una: haz el inventario de lo que ya actúa sin ti. Lista cada automatización que puede mover dinero, borrar datos o escribir a un cliente sin aprobación humana, y anota quién la para y en cuántos segundos. Sin respuesta, no está lista para el peldaño desatendido. Dos: escribe tu propio «cuándo paramos» —el umbral de error, coste o queja al que se apaga el bucle— antes de subir de peldaño; los que construyen los modelos la están teniendo en público porque no la tuvieron antes. Tres: pide por escrito el aviso previo de cambio de modelo y ten un segundo proveedor ya probado con veinte casos reales. La lección operativa de hoy no es la extinción: es que tu automatización no debería depender de que una sola empresa mantenga el rumbo.

Preguntas frecuentes

¿Debo dejar de usar Claude o los modelos de Anthropic?

No, y quien dimite tampoco lo pide. El aviso va de sistemas futuros que se automejoran, no del modelo que hoy te resume correos. Lo sensato es tener alternativa probada, como con cualquier proveedor crítico.

¿Ese «más del 10%» es la postura oficial de Anthropic?

No. Es la estimación personal de Evan Hubinger, que dirige el equipo de alineamiento; Anthropic no ha publicado respuesta corporativa. Cítalo así en tu comité: opinión de un directivo, no cifra de la casa.

¿Cambia algo en el AI Act o en mis obligaciones?

Nada hoy: siguen siendo transparencia y alfabetización en IA. Este debate no crea deberes nuevos, pero alimenta la presión regulatoria de 2027.