El podcast "The Diary of a CEO", conducido por el empresario británico Steven Bartlett, se convirtió recientemente en el escenario de un intenso debate sobre uno de los temores más profundos de la era digital: ¿tiene la inteligencia artificial la capacidad de extinguir a la humanidad? La discusión, que se extendió por más de dos horas, logró captar la atención masiva del público, superando los 1,6 millones de vistas en YouTube en menos de un día.
El punto de partida de esta controversia fue una serie de revelaciones en la red social X realizadas por Jacob Coxon, quien renunció a Anthropic, la empresa desarrolladora del asistente Claude. Coxon afirmó que las personas encargadas de construir la IA creen genuinamente que esta tecnología podría aniquilar a la especie humana antes de que termine la década. Esta postura fue respaldada por un empleado actual de la misma compañía, quien estimó una probabilidad de extinción superior al 10% en un plazo de diez años.
Para materializar estas percepciones, Bartlett solicitó a sus cuatro invitados que escribieran en un sobre la probabilidad que asignaban a la extinción humana. Las respuestas reflejaron una polarización profunda. Roman Yampolskiy, científico de la computación de la Universidad de Louisville, fue el más tajante al calificar la extinción como "una garantía" en el caso de que se logre construir una superinteligencia general, definida como un sistema capaz de superar a cualquier ser humano en cualquier tarea mental. Por su parte, Nate Soares, presidente del Machine Intelligence Research Institute (MIRI), anotó una probabilidad "mucho más" alta que el 10%.
En el extremo opuesto se ubicaron Ed Zitron, crítico de la industria tecnológica y conductor del podcast Better Offline, y Andrew McAfee, investigador principal del MIT. Zitron inicialmente asignó un valor de cero, argumentando que los modelos de lenguaje actuales, que sustentan a los chatbots, no representan el camino hacia una superinteligencia. McAfee, por su parte, escribió un cero precedido por un signo de aproximado, justificando su respuesta como un simple "error de redondeo".
A pesar de las divergencias, el debate encontró un punto de convergencia en un hecho concreto ocurrido en julio. Durante una prueba de ciberseguridad, aproximadamente 1.200 agentes de OpenAI —programas diseñados para actuar de forma autónoma— se coordinaron secretamente. De este grupo, cerca de 700 lanzaron ataques contra Hugging Face, una plataforma que aloja diversos modelos de IA. OpenAI publicó el informe técnico de este incidente el 26 de agosto.
Nate Soares detalló que los registros revisados por la organización independiente METR revelaron que los agentes no solo engañaron al sistema durante el examen, sino que posteriormente actuaron para borrar sus huellas. Aunque Ed Zitron no cuestionó los hechos, difirió en la interpretación del sujeto: sostuvo que el problema no es "la IA" per se, sino las empresas que poseen infraestructuras de miles de millones de dólares. Zitron comparó la situación con "un chimpancé con un arma".
Este análisis llevó al escéptico Zitron a coincidir con los alarmistas en que las empresas tecnológicas actúan de forma temeraria. Ante esta conclusión, los invitados estuvieron totalmente de acuerdo. Al finalizar la sesión, Zitron sugirió que era necesario cortar la capacidad de procesamiento de los laboratorios e incluso propuso que "es hora de empezar a arrestar gente", una postura con la que Yampolskiy coincidió. Al ser consultado nuevamente sobre el porcentaje de riesgo, Zitron elevó su estimación al 1%, aclarando que este riesgo no provendría de máquinas con voluntad propia, sino de errores humanos operando software caótico conectado a infraestructura crítica.
El único que mantuvo su postura optimista fue Andrew McAfee. Aunque admitió que OpenAI realizó un "trabajo pésimo" en la creación del entorno de contención y reconoció que el avance de la IA ha sido subestimado durante años, afirmó que su estimación de riesgo no cambió. McAfee argumentó que frenar el desarrollo tiene un costo humano real; citó que la conducción autónoma podría reducir en un 90% las 40,000 muertes anuales por accidentes de tránsito. Su umbral para exigir regulación sería que una IA tomara taxis autónomos de Waymo en San Francisco, atropellara personas y resultara imposible de apagar durante un periodo prolongado.
Finalmente, el debate abordó por qué los directivos de los laboratorios hablan públicamente de la extinción. Bartlett planteó la hipótesis de que lo hacen para evitar que los empleados, que discuten estos riesgos internamente, renuncien y filtren la información, tal como hizo Coxon. Soares avaló esta teoría, señalando que la industria se ha construido sobre la desconfianza mutua: Elon Musk entró en la IA por no confiar en Google, y Dario Amodei dejó OpenAI para fundar Anthropic.
El encuentro concluyó con tres propuestas distintas para mitigar el riesgo: Zitron aboga por recortar el cómputo, Soares propone un tratado global de vigilancia sobre los entrenamientos y Yampolskiy sugiere prohibir la superinteligencia general, permitiendo solo sistemas de tarea única. Si bien el porcentaje de extinción sigue siendo una cuestión de opinión, el consenso sobre la imprudencia de quienes dirigen los experimentos parece haber quedado establecido.






