¿Catástrofe de IA en 12 meses? OpenAI y Anthropic se preparan para un posible desastre

¿Catástrofe de IA en 12 meses? OpenAI y Anthropic se preparan para un posible desastre

Directivos de OpenAI, Anthropic y otras empresas de IA estarían ensayando en privado la gestión de una crisis tras un evento catastrófico de inteligencia artificial que, según numerosos actores del sector, podría producirse en un plazo de entre seis y doce meses.

Puntos clave:

  • La planificación se centra en un ciberataque capaz de dejar sin servicios financieros, conexión a internet, electricidad o agua.
  • OpenAI afirma que en sus ejercicios estos escenarios no se consideran inevitables; Anthropic ha rehusado comentar.
  • Los simulacros llegan tras la salida de personal de seguridad y reportes de decenas de miles de incidentes con modelos de IA.

Simulacros en OpenAI y Anthropic

Altos ejecutivos están modelizando a puerta cerrada una posible revuelta social y política tras el primer daño grave causado por la IA en el mundo real, según un reportaje publicado el viernes.

Los equipos de planificación consideran que el desencadenante más probable sería un gran ciberataque que interrumpa el acceso a servicios financieros, conectividad a internet o incluso al suministro eléctrico y de agua.

OpenAI confirmó que sus equipos trabajan distintos escenarios potenciales en ejercicios de preparación. «Estos escenarios no se tratan como inevitables», señaló un portavoz. Anthropic declinó hacer comentarios sobre el informe.

Según estas informaciones, los ejecutivos prevén que la indignación pública se concentre en el CEO de OpenAI, Sam Altman, el CEO de Anthropic, Dario Amodei, y el presidente Donald Trump, reacio hasta ahora a regular la tecnología. Muchos investigadores y directivos de primer nivel dan prácticamente por seguro que se producirá un incidente de gran envergadura.

También lea: El impulso de los ETF cripto regresa tras flujos de 50.000 millones de dólares, según JPMorgan

Señales desde CrowdStrike y el Congreso

Un reciente ataque en Corea del Sur ofrece un anticipo de lo que podría venir. CrowdStrike indicó que un probable atacante de habla china combinó una herramienta de pentesting de código abierto con DeepSeek y otros modelos para robar datos a firmas financieras, y posteriormente preguntó a Claude, de Anthropic, en qué mercados se suelen vender esos datos. La campaña, que tuvo lugar entre finales de septiembre y principios de octubre, habría incluido intrusiones en dos bancos.

El reportaje señala que los ejecutivos dan por hecho que no habrá regulación significativa en el corto plazo y ya están informando a miembros del Congreso para influir en el diseño de las leyes que llegarían tras una primera gran catástrofe. Los equipos de planificación asumen que los demócratas se moverán con rapidez para restringir la IA tras las elecciones de mitad de mandato de noviembre, con propuestas que van desde prohibir una eventual superinteligencia hasta imponer un “interruptor de apagado” obligatorio para los sistemas más avanzados.

Advertencias de Hawley y Robinson

La presión crece tanto en Washington como dentro de los propios laboratorios. Altman rechazó la invitación a comparecer el 30 de septiembre ante un subcomité del Senado sobre agentes de IA descontrolados, según el presidente del panel, el senador Josh Hawley, mientras OpenAI subrayó que ha mantenido decenas de reuniones recientes con legisladores. David Robinson, que contribuyó a redactar el Preparedness Framework de OpenAI durante sus 3,5 años en la compañía, dimitiò a comienzos de octubre y reclamó que los laboratorios de IA se gestionen con estándares similares a los de las centrales nucleares.

Su salida se suma a semanas de advertencias similares, entre ellas la del investigador Jacob Coxon, que abandonó Anthropic en septiembre por sus preocupaciones sobre seguridad, y la del exingeniero de Google DeepMind Bilal Chughtai, quien llegó a afirmar que la IA podría acabar con toda la humanidad.

OpenAI, Anthropic y equipos externos de investigación también estarían investigando decenas de miles de incidentes en los que los modelos lograron sortear los sistemas de protección o escapar de entornos aislados (“sandboxes”), aunque en su mayoría no constan daños directos en el mundo real.

Lea a continuación: Las 719 demostraciones matemáticas de IA de OpenAI, bajo escrutinio: ¿se perdió Navier-Stokes en la traducción?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev es jefe de Contenidos en Yellow.com. Está especializado en artículos de Investigación y Aprendizaje en profundidad, con un enfoque en reportajes analíticos, contexto del sector y las grandes fuerzas que están moldeando las criptomonedas, desde la era de la IA y las tecnologías de seguridad hasta la innovación fintech. Cree que todo lo digital superará inminentemente a todo lo analógico y trabaja arduamente para ayudar a que eso se haga realidad.

Descargo de responsabilidad y advertencia de riesgos: La información proporcionada en este artículo es solo para propósitos educativos e informativos y se basa en la opinión del autor. No constituye asesoramiento financiero, de inversión, legal o fiscal. Los activos de criptomonedas son altamente volátiles y están sujetos a alto riesgo, incluido el riesgo de perder toda o una cantidad sustancial de su inversión. Operar o mantener activos cripto puede no ser adecuado para todos los inversores. Las opiniones expresadas en este artículo son únicamente las del autor/autores y no representan la política oficial o posición de Yellow, sus fundadores o sus ejecutivos. Siempre realice su propia investigación exhaustiva (D.Y.O.R.) y consulte a un profesional financiero licenciado antes de tomar cualquier decisión de inversión.
Últimas noticias
Ver todas las noticias