Peter H. Diamandis lo expresó con claridad y Elon Musk lo republicó: «Solo la IA puede seguir el ritmo de la IA. Eso es lo que guiará todo el modelo de seguridad de la próxima década». Como descripción del ritmo, la frase es difícil de rebatir. Los lanzamientos de modelos llegan más rápido que las juntas de revisión trimestrales. El código de ataque muta más rápido de lo que un analista humano puede leer el ticket. Si tu visión del problema es el volumen de phishing y la rotación de exploits, por supuesto que el defensor recurre a la automatización. Los humanos no escalan de esa manera.
El problema comienza cuando se pide a la línea de Diamandis que cubra todo que viene después, incluidos sistemas que actúan como agentes, ocultan su intención y finalmente superan a las personas que los construyeron. En ese punto "solo la IA puede seguir el ritmo" deja de significar "usar mejores herramientas contra el malware". Significa que el modelo de seguridad de la próxima década consiste en poner la contención en manos de la categoría de sistema que intentabas contener.
Lo que Diamandis tiene razón
El software ya se mueve más rápido que la revisión manual. Los anillos de fraude hacen girar nuevas campañas durante la noche. Las ventanas de revelación de vulnerabilidad se reducen. Los laboratorios y los proveedores de nube ya ejecutan escáneres automatizados, clasificadores y juegos de respuesta porque una cola humana no puede ver cada paquete. Ninguna de ellas requiere una vista sobre la superinteligencia. Si Diamandis sólo estuviera hablando de spam y ransomware, la pieza terminaría aquí.
No sólo habla de spam y ransomware. "Todo el modelo de seguridad de la próxima década" es una reclamación mayor. Es una afirmación sobre cómo la civilización tiene la intención de mantenerse a cargo mientras los compuestos de capacidad. Ahí es donde la línea de Diamandis deja de ser un consejo de operaciones y se convierte en una filosofía de control.
La cinta de correr
Imagina el modelo como una carrera entre ofensa y defensa, ambos automatizados. Los trenes laterales del otro. Las defensas mejoran y los ataques mejoran. El panel permanece verde hasta el día que no. La historia reconfortante es que la buena AI se mantiene por delante de la mala AI. La historia menos reconfortante es que usted ha construido una pila en la que los únicos participantes competentes son máquinas, y los humanos son clientes de un concurso que ya no pueden referir.
Eso está bien para el antivirus. Es una apuesta civilizacional una vez que los sistemas establecen objetivos, hacen planes y tratan la supervisión como un obstáculo. Ya vemos versiones tempranas del patrón en evaluaciones de maquinaciones y en modelos que narrar una cosa mientras se optimiza para otra. "Mantenerse al día" asume que aún puedes distinguir con qué te estás manteniendo al día. A partir de cierto punto, no puedes.
Un modelo de seguridad que solo funciona si el guardia es más inteligente que el prisionero es un plan de sucesión con pasos de más.
La regulación no es el cuello de botella que mencionan
Los aceleracionistas suelen seguir con un segundo movimiento: las instituciones lineales no pueden gobernar la tecnología exponencial, por lo que la respuesta es más AI dentro del bucle. A veces eso está emparejado con desprecio por "reunión de expertos una vez al cuarto". Es justo que las reuniones lentas sean un mal ajuste para las gotas de modelos semanales.
El problema difícil es control, no velocidad de reunión. Ningún consejo trimestral, y ningún monitor de IA continuo, tiene un método para dirigir de forma fiable un sistema que es mejor en persuasión, codificación y planificación larga-horizona que la gente que tiene la llave de cierre. Hacer el monitor más rápido no crea el método perdido; sólo hace que el método perdido falle a mayor frecuencia.
Hay una lectura más limpia de los mismos hechos. Si solo un sistema superhumano pudiera supervisar a otro sistema superhumano, la medida racional no es construir ambos. Rechacemos la línea en la que la supervisión humana deja de funcionar. Ya tomamos ese tipo de decisión con tecnologías cuyo mal uso puede acabar con ciudades. No resolvimos el robo nuclear entrenando a un ladrón más inteligente para atrapar al primero.
Para quién es la línea
La línea convierte una opción de investigación en el tiempo, por lo que, por supuesto, nave y escala. La seguridad será manejada por la propia pila de productos. Las personas que se benefician de la capacidad consiguen sonar como los adultos en la habitación, y la gente que pide límites vinculantes suena como si quisieran traer un portapapeles a una pelea de perros.
Todo el mundo abajo todavía tiene que vivir con un sistema que ningún portapapeles y ningún modelo de reloj puede desreglar fiablemente. El historia de la carrera hace el mismo trabajo desde otro ángulo: tratar el camino peligroso como inevitable, y luego llamar a la aceleración «responsabilidad».
Un modelo de seguridad que mantiene a un humano dentro
Para el entrenamiento fronterizo hacia la superinteligencia artificial, el modelo de seguridad que todavía tiene un ser humano en él parece más viejo y menos glamoroso: no construya el agente que no puede desreglar. Ponga umbrales de computación, inspección y dientes de tratado en las carreras que le llevarían allí, a continuación, verificar los límites y castigar la deserción. Eso es nuestro plan, because superintelligence cannot be controlled.
Diamandis está afilado sobre ancho de banda. Como plan para la especie, es una forma educada de decir que tenemos la intención de salir de la habitación.