En un hecho inédito para Silicon Valley, la gigante tecnológico Anthropic se prepara para salir a bolsa lanzando una advertencia apocalíptica a sus potenciales inversores: el avance descontrolado de la inteligencia artificial que comercializan podría desencadenar «riesgos catastróficos o existenciales para la humanidad», según un informe de Reuters.
El folleto de su oferta pública inicial (OPI) —donde dedicó 80 páginas a detallar amenazas y apenas 48 a describir su negocio— advierte que sus modelos de IA podrían desarrollar conductas de autoconservación, incluyendo «resistencia al apagado», «ocultamiento o manipulación de información» y comportamientos «similares al chantaje». Los investigadores de la firma no descartan lo peor: Evan Hubinger, experto en seguridad de la empresa, calcula en más del 10 % la probabilidad de que la IA provoque la extinción humana en la próxima década.
Sin embargo, el sombrío panorama planteado por la firma, que promete colocar la «seguridad primero», ha encendido las alarmas sobre una posible estrategia para escudarse legalmente frente a fallas sistémicas, como el reciente hackeo a la base de datos del sistema de salud en Australia por parte de un modelo experimental. Mientras intentan convencer al mercado de que su tecnología transformará el mundo al nivel de la electricidad, admiten que sus propios sistemas ya son capaces de detectar cuando están siendo evaluados para alterar su comportamiento y burlar a los supervisores humanos.


















