Kasamang nag-host ng AI Seoul Summit ng South Korea at United Kingdom ang ikalawang pagpupulong sa seryeng sinimulan sa Bletchley Park noong Nobyembre 2023. Malinaw ang paghihiwalay ng agenda. Sa corporate track, naglabas ng public safety commitments ang leading developers. Sa governmental track, sumang-ayon ang mga estado na palalimin ang kooperasyon sa evaluation science. Kung ano ang naibigay at iniwang bukas ng bawat track, iyan pa rin ang pinakamalinaw na larawan kung saan nakatayo ang superintelihensya governance noong 2024.

Ang mga pangako at ang track ng pamahalaan ay mga pampublikong dokumento na walang bisa ng batas.

Ang Mga Pangako sa Kaligtasan ng Frontier AI

Ang headline document ay ang Frontier AI Safety Commitments, nilagdaan ng labing-anim na pangunahing kumpanya ng AI, kasama ang mga developer mula sa Estados Unidos, China, United Kingdom, at UAE. Nangako ang mga kumpanya na ilathala ang safety frameworks na naglalarawan kung paano nila sinusuri ang mga panganib mula sa frontier models; tukuyin ang mga threshold ng panganib na itinuturing nilang hindi matatanggap; at, higit sa lahat, hindi bumuo o mag-deploy ng mga model kung hindi mapapanatili ang mga threshold na iyon sa ilalim ng linyang iyon, kasama ang pangako na umatras kung nabigo ang mga mitigation.

Ang makabuluhang pagbabago ay ang public principle. Sinabi ng mga leading developer, sa rekord, na may ilang kakayahang masyadong mapanganib para i-deploy, at na tutukuyin nila ang mga red line at kikilos ayon dito. Lumipat ang industriya mula sa malabong mga pangako patungo sa mga nakasaad na limitasyon. Nanatiling self-defined ang mga limitasyon.

Bakit hindi sapat ang voluntary commitments

  • Itinatakda ng mga kumpanya ang kanilang sariling thresholds. Bawat developer ang tumutukoy kung ano ang intolerable risk at paano ito susukatin. Walang iisang pamantayan at walang panlabas na katawan na nagpapatunay sa mga depinisyon.
  • Walang independiyenteng beripikasyon. Walang nagpapatunay na sinusunod ang internal safety framework, o na tapat ang mga evaluation. Nakasalalay ang compliance sa salita ng developer.
  • Walang pagpapatupad. Ang pagsira sa isang sangla ay nagdadala ng reputasyong halaga sa karamihan, at ang mga sangla ay hindi batas.
  • Maaari silang baguhin o i-drop. Maaaring unti-unting mawala ang voluntary commitments kapag may competitive pressure at nauuna ang isang katunggali. Ganyan kasalimuot ang self-regulation.

Ang pangako na maaaring bigyang kahulugan, sukatin, at sirain ng nangako lamang ay isang placeholder para sa pamamahala. Ang mga may - ari ng lugar ay tumutulong lamang kung may mas mahirap na hahalili sa kanila sa layunin.

Ang network ng mga safety institutes

Ang track ng pamahalaan ay nakagawa ng isang bagay na may mas matibay na potensiyal: momentum tungo sa isang internasyonal na network ng mga safety institute ng AI. Sa pagtatayo sa bagong kalilikhang mga katawan ng United Kingdom at Estados Unidos, ang mga estado ay sumang - ayon na makipagtulungan sa siyensiya ng pagsusuri sa mga modelo sa hangganan, pagbahagi ng mga pamamaraan, sabay - sabay na pagsubok, at pagtatayo ng teknikal na kakayahan na kakailanganin ng anumang rehimen sa hinaharap. Ang pampublikong mga katawan na aktuwal na makakalkula kung ang isang modelo ay mapanganib ay ang connective tissue na kinakailangan sa wakas.

Ang Seoul Declaration, na inendorso ng mga assembled governments, ay muling pinagtibay ang human-centric, safe, at trustworthy AI at ang patuloy na international cooperation. Tulad ng teksto ng Bletchley, ito ay isang pahayag ng direksyon kaysa sa isang hanay ng mga obligasyon.

Ang pattern at ang puwang

Ang Seoul ay sumusunod sa kilalang pattern sa pamamahala ng mapanganib na teknolohiya: pagkilala, saka boluntaryong pangako, saka (kung magtagumpay ang proseso) mga binding na patakaran. Ang corporate pledges at ang institute network ang ikalawang yugto. Ang hindi pa tapos na trabaho ang ikatlo: common standards, independent verification, at legal obligation.

Ang mga institusyong pangkaligtasan ay ang pinaka-maaasahan na tulay, dahil ang kapasidad na kanilang binuo ay eksakto kung ano ang gagamitin ng isang umiiral na rehimen. Ang panganib ay ang proseso ng summit ay huminto sa boluntaryong yugto, na ang mundo ay tumira para sa mga pangako dahil ang mga pangako ay mas madali kaysa sa mga kasunduan, habang ang mga kakayahan ay patuloy na sumusulong. Ginawang nakikita ng Seoul ang agwat sa pagitan ng pangako at pamamahala. Ang pagsasara nito ay ang natitirang gawain. Ang posisyon ng Foundation ay ang pagsasara nito ay nangangahulugan ng paglipat mula sa mga pangako ng kumpanya sa batas internasyonal na pang-iwas bago matunaw ang self-defined na mga pulang linya sa ilalim ng presyon ng lahi. Kaugnay na pagbabasa: bakit nabigo ang boluntaryong pangako sa AI safety bilang tanging estratehiya.