Jacob Coxon cuestionó la carrera de Silicon Valley hacia la automejora recursiva de la IA; directivos de la firma admiten riesgos.

Vía NotiPress: El investigador de inteligencia artificial Jacob Coxon presentó su renuncia formal a la firma tecnológica Anthropic tras solo dos meses en la compañía, lanzando una severa advertencia sobre la carrera desmedida que libran los principales laboratorios de Silicon Valley hacia la creación de una superinteligencia artificial.

El investigador que renunció a Anthropic y dejó una advertencia en X: "La  IA podría matarnos a todos" - Yahoo Noticias

Vía: Yahoo Noticias

A través de una serie de publicaciones en su cuenta de la red social X, el especialista de 27 años, quien trabajó previamente en preentrenamiento de modelos en OpenAI durante tres años. sentenció que ni su exempleador ni Anthropic actúan con la debida responsabilidad, acusándolos de arriesgar la seguridad global en pos de liderar la industria.

Vía: X @hilbertspaess

La principal alarma manifestada por Coxon se centra en el inminente desarrollo de sistemas de inteligencia artificial capaces de incurrir en una “automejora recursiva”, es decir, modelos con facultades técnicas suficientes para perfeccionarse a sí mismos de manera autónoma y acelerada. De acuerdo con el ingeniero, dentro de los círculos internos de investigación ya se utilizan términos como crunchtime (hora límite) y endgame (fase final), advirtiendo que los mecanismos de contención podrían desbordarse tan pronto como a finales de 2027 si se mantiene la actual inercia comercial.

“Ninguna de las dos empresas actúa con responsabilidad; están apostando con nuestras vidas. Quienes están construyendo la inteligencia artificial creen sinceramente que podría matarnos a todos antes de que termine la década. Es una locura que esto se decida en las MacBooks de ingenieros en San Francisco en lugar de un búnker como en el Proyecto Manhattan”, expuso Coxon.

About | OpenAI

Vía: Open AI

Respaldo interno y falta de mecanismos de control

Lejos de desestimar las declaraciones del extrabajador, Evan Hubinger, responsable de investigación en alineación de modelos de Anthropic, respaldó públicamente la gravedad del panorama expuesto.

Evan Hubinger on Inner Alignment, Outer Alignment, and Proposals for  Building Safe Advanced AI - Future of Life Institute

Vía: futureoflife.org

Hubinger confirmó que dentro del sector existe el convencimiento de que la IA podría ocasionar daños irreversibles a la humanidad, estimando personalmente en más de un 10% la probabilidad de una catástrofe global durante la próxima década. El directivo aclaró que, aunque los modelos actuales no representan un peligro inminente, Anthropic todavía no cuenta con una solución técnica validada para resolver el problema de la alineación en sistemas superinteligentes; esto es, garantizar que un software más inteligente que el ser humano mantenga metas compatibles con los valores humanos.

Trayectoria técnica y la trampa competitiva

Coxon formó parte del equipo técnico de OpenAI desde 2023 hasta julio de 2026, participando directamente en el desarrollo de arquitecturas como GPT-4o.

GPT-4o: el nuevo modelo de inteligencia artificial de OpenAI

Vía: El tiempo latino

Tras dejar OpenAI al considerar que su personal minimizaba los impactos sociales de la tecnología, migró a Anthropic atraído por su enfoque en seguridad. Sin embargo, su estadía duró apenas ocho semanas al constatar que la presión de mercado anula las precauciones, pues la compañía teme que otros competidores avancen primero si ellos deciden frenar el ritmo de desarrollo.

BAOA