Peter H. Diamandis brachte es auf den Punkt, und Elon Musk repostete es: „Nur KI kann mit KI mithalten. Das wird das gesamte Sicherheitsmodell des nächsten Jahrzehnts bestimmen.“ Als Beschreibung des Tempos ist die Aussage schwer zu bestreiten. Modellveröffentlichungen kommen schneller als vierteljährliche Prüfungsgremien. Angriffscode mutiert schneller, als ein menschlicher Analyst das Ticket lesen kann. Wenn Ihr Bild des Problems Phishing-Volumen und Exploit-Wechsel ist, greift der Verteidiger natürlich nach Automatisierung. Menschen skalieren nicht so.

Der Ärger beginnt, wenn Diamandis 'Linie gebeten wird, zu decken alles das als Nächstes kommt, einschließlich Systemen, die als Agenten handeln, ihre Absichten verbergen und schließlich die Menschen übertreffen, die sie gebaut haben. An diesem Punkt bedeutet „nur KI kann mithalten“ nicht mehr „bessere Werkzeuge gegen Malware einsetzen“. Es bedeutet, dass das Sicherheitsmodell des nächsten Jahrzehnts darin besteht, die Aufgabe der Eindämmung in die Hände der Kategorie von Systemen zu legen, die man einzudämmen versuchte.

Was Diamandis richtig macht

Software bewegt sich bereits schneller als manuelle Überprüfung. Betrugsringe drehen neue Kampagnen über Nacht. Fenster zur Offenlegung von Sicherheitslücken schrumpfen. Labs und Cloud-Anbieter betreiben bereits automatisierte Scanner, Klassifikatoren und Antwort-Playbooks, da eine menschliche Warteschlange nicht jedes Paket ansehen kann. Nichts davon erfordert einen Blick auf Superintelligenz. Wenn Diamandis nur über Spam und Ransomware sprechen würde, würde das Stück hier enden.

Er spricht nicht nur von Spam und Ransomware. "Das gesamte Sicherheitsmodell des nächsten Jahrzehnts" ist ein größerer Anspruch. Es ist eine Behauptung darüber, wie die Zivilisation beabsichtigt, verantwortlich zu bleiben, während sich die Fähigkeit zusammensetzt. Hier hört Diamandis Linie auf, ein Ops-Tipp zu sein und wird zu einer Philosophie der Kontrolle.

Das Laufband

Stellen Sie sich das Modell als ein Rennen zwischen Offensive und Verteidigung vor, beide automatisiert. Jede Seite trainiert auf der anderen. Die Verteidigung verbessert sich und die Angriffe verbessern sich. Das Dashboard bleibt grün bis zu dem Tag, an dem es nicht funktioniert. Die beruhigende Geschichte ist, dass die gute KI der schlechten KI voraus ist. Die weniger tröstliche Geschichte ist, dass Sie einen Stapel gebaut haben, in dem die einzigen kompetenten Teilnehmer Maschinen sind und die Menschen Kunden eines Wettbewerbs sind, den sie nicht mehr schieden können.

Das ist in Ordnung für Antivirus. Es ist eine zivilisatorische Wette, sobald die Systeme Ziele setzen, Pläne machen und Aufsicht als Hindernis behandeln. Frühe Versionen des Musters sehen wir bereits in Bewertungen von Täuschungsverhalten und in Modellen, die etwas erzählen, während man etwas anderes optimiert. "Mithalten" setzt voraus, dass man noch erkennen kann, womit man mithält. Ab einem bestimmten Punkt kann man das nicht mehr.

Ein Sicherheitsmodell, das nur funktioniert, wenn der Wächter schlauer ist als der Gefangene, ist ein Nachfolgeplan mit zusätzlichen Schritten.

Regulierung ist nicht der Engpass, den sie nennen

Beschleuniger folgen normalerweise mit einem zweiten Schritt: Lineare Institutionen können exponentielle Technologie nicht regieren, daher ist die Antwort mehr KI innerhalb der Schleife. Manchmal ist das gepaart mit Verachtung für "Experten treffen sich einmal im Quartal." Fair genug, dass langsame meetings schlecht für wöchentliche modelltropfen geeignet sind.

Das schwierige Problem ist Kontrolle, Nicht die Geschwindigkeit des Treffens. Kein vierteljährliches Board und kein kontinuierlicher AI-Monitor verfügt über eine Methode zur zuverlässigen Steuerung eines Systems, das besser zu überzeugen, zu codieren und langfristige Planung ist als die Leute, die den Abschaltschlüssel halten. Wenn man den Monitor schneller macht, entsteht nicht die fehlende Methode; es lässt nur die fehlende Methode bei höherer Frequenz fehlschlagen.

Es gibt eine sauberere Lesart derselben Fakten. Wenn nur ein superhumanes System ein anderes superhumanes System überwachen könnte, ist der rationale Zug nicht, beide zu bauen. Lehnt die Linie ab, an der menschliche Aufsicht aufhört zu funktionieren. Wir haben diese Art von Entscheidung schon bei Technologien getroffen, deren Missbrauch Städte vernichtet. Wir haben den Diebstahl von Nuklearmaterial nicht dadurch gelöst, dass wir einen schlaueren Dieb ausgebildet haben, um den ersten zu fangen.

Für wen die Linie ist

Die Linie wandelt eine Forschungswahl in Wetter um, also versenden und skalieren wir natürlich. Die Sicherheit wird vom Produktstapel selbst übernommen. Die Leute, die von Fähigkeiten profitieren, klingen wie die Erwachsenen im Raum, und die Leute, die nach verbindlichen Grenzen fragen, klingen, als wollten sie eine Zwischenablage zu einem Hundekampf bringen.

Jeder Downstream muss immer noch mit einem System leben, das kein Clipboard und kein Watchdog-Modell zuverlässig überstimmen kann. Die Renn-Geschichte erledigt denselben Job aus einem anderen Winkel: den gefährlichen Pfad als unvermeidlich behandeln und dann Beschleunigung Verantwortung nennen.

Ein Sicherheitsmodell, das einen Menschen darin behält

Für das Grenztraining zu künstlicher Superintelligenz sieht das Sicherheitsmodell, in dem noch ein Mensch steckt, älter und weniger glamourös aus: Bauen Sie nicht den Agenten auf, den Sie nicht überstimmen können. Setzen Sie Berechnungsschwellen, Inspektion und Vertragszähne auf die Läufe, die Sie dorthin bringen würden, dann überprüfen Sie die Grenzen und bestrafen Sie den Abfall. Das ist unser Plan, because superintelligence cannot be controlled.

Diamandis ist scharf auf Bandbreite. Als Plan für die Spezies ist es eine höfliche Art zu sagen, dass wir beabsichtigen, den Raum zu verlassen.