Các cuộc thảo luận an toàn AI thường tập trung vào kịch bản xa vời, hệ thống siêu trí tuệ với mục tiêu lệch lạc, những bước ngoặt phản bội tại ngưỡng năng lực chưa đạt tới. Rủi ro thuyết phục AI khác biệt. Hình thức cơ bản của mối đe dọa đã hiện diện trong các hệ thống sẵn có hôm nay, đang ảnh hưởng bầu cử và diễn ngôn công chúng ngay lúc này. Phiên bản nguy hiểm dài hạn là sự ngoại suy của công nghệ đang tiến bộ nhanh chóng, không phải giả thuyết thuần túy tương lai.
. Phiên bản dài hạn (AI có thể mô hình và khai thác tâm lý cá nhân với độ chính xác siêu phàm) là hướng đi mà công nghệ đang hướng tới.
Các công nghệ trước đây đã làm cho sự tuyên truyền dễ dàng hơn. AI cho phép một cái gì đó có tính chất khác biệt: rất cá nhân hoá tin nhắn với quy mô lớn, phù hợp với hồ sơ tâm lý cá nhân, cập nhật trong thời gian thực dựa trên phản ứng. Sự kết hợp giữa việc cá nhân hóa, quy mô và chi phí thấp tạo ra khả năng gây ảnh hưởng mà trước đây không công cụ nào tương ứng.
Điều gì khiến sự thuyết phục của AI khác biệt
Các chiến dịch ảnh hưởng truyền thống (quảng cáo phát sóng, thông điệp chính trị, tuyên truyền nhà nước) tiếp cận nhiều người với cùng một thông điệp. Thông điệp có thể được soạn thảo kỹ lưỡng và thử nghiệm rộng rãi, nhưng nhất thiết là sự thỏa hiệp giữa các đối tượng khác nhau. Một người thuyết phục con người có kỹ năng có thể điều chỉnh cách tiếp cận với từng người họ đang nói chuyện, nhưng họ chỉ có thể nói chuyện với số lượng người hạn chế. Hai năng lực này (quy mô phát sóng và cá nhân hóa) trong lịch sử luôn ở thế căng thẳng.
AI giải tan căng thẳng này. Một hệ thống có quyền truy cập dữ liệu cá nhân (lịch sử duyệt web, mạng xã hội, phản hồi trước đó) và khả năng tạo nội dung thuyết phục đa dạng có thể đồng thời tiếp cận hàng triệu người và điều chỉnh từng tương tác cho từng cá nhân cụ thể. Chi phí biên để tạo thêm một thông điệp thuyết phục được cá nhân hóa tiến gần đến không. Hệ thống có thể lặp lại dựa trên cách tiếp cận nào đang hiệu quả và cách nào không, theo thời gian thực, ở quy mô mà không chiến dịch ảnh hưởng nào của con người có thể sánh được.
vấn đề bất đối xứng
Sức mạnh thuyết phục của AI tập trung cao độ. Triển khai AI được tối ưu hóa thuyết phục ở quy mô lớn đòi hỏi nguồn lực, dữ liệu, compute, năng lực kỹ thuật và quyền truy cập kênh phân phối đáng kể. Những yêu cầu này ưu ái các tác nhân có nguồn lực dồi dào: các tập đoàn lớn, quốc gia, cá nhân giàu có. Những người bị nhắm đến không có năng lực đối phó tương đương. Họ có thể cuối cùng sẽ có quyền truy cập các công cụ AI giúp đánh giá nội dung họ gặp phải, nhưng sự bất cân xứng tấn công và phòng thủ nghiêng về phía kẻ tấn công trong ngắn hạn.
Một chiến dịch đã từng cần một nhà kho gồm những người viết bản sao có thể soạn thảo hàng ngàn biến thể của một thông điệp trước bữa trưa, mỗi người đều thích nghi với một lát cử tri. Thuyết phục tại nghị quyết đó là rủi ro của AI mà xuất hiện trước khi bất cứ ai xây dựng một mẫu thần thánh.
Đây là vấn đề mang tính cấu trúc, không phải vấn đề về bất kỳ mẩu thông tin sai lệch cụ thể nào. Dù mọi tuyên bố cá nhân trong chiến dịch ảnh hưởng do AI hỗ trợ có đúng về mặt kỹ thuật, việc nhắm mục tiêu có hệ thống vào các điểm yếu tâm lý ở quy mô lớn vẫn làm méo môi trường nhận thức mà sự cân nhắc dân chủ dựa vào. Mục tiêu của các chiến dịch ảnh hưởng là định hình cách mọi người cảm nhận về các vấn đề, ứng cử viên và thể chế theo hướng phục vụ lợi ích của bên vận hành, chứ không nhất thiết là để lừa dối.
Bằng chứng gần hạn
Nội dung ảnh hưởng do AI tạo ra đã được ghi nhận trong các cuộc bầu cử quốc gia tại nhiều quốc gia kể từ năm 2023. Các chiến dịch ảnh hưởng sử dụng AI để tạo phương tiện tổng hợp, bịa đặt trích dẫn từ nhân vật công chúng thật, và tạo ra lượng lớn bài đăng phối hợp ở quy mô đòi hỏi đội ngũ lớn người vận hành đã được các nhà nghiên cứu độc lập và đội an ninh nền tảng xác định và báo cáo. Các chiến dịch ngày càng khó phát hiện khi nội dung do AI tạo ra ngày càng tinh vi, và các công cụ phát hiện đang tụt hậu so với công cụ tạo nội dung.
Nguy cơ nằm trong môi trường công nghệ hiện nay, ảnh hưởng đến các quá trình chính trị thực sự, và quỹ đạo hướng tới những công cụ thuyết phục có khả năng và khó hơn để phát hiện. Câu hỏi đặt ra là những phản ứng của nhà quản trị tương xứng và hiệu quả, chứ không phải xem đây là một rủi ro thực sự.
Sự leo thang dài hạn
Các công cụ thuyết phục AI hiện tại có hiệu quả nhưng chưa được tối ưu hóa ở mức cơ bản cho việc thuyết phục. Các hệ thống tương lai với mô hình tâm lý cá nhân tinh vi hơn, dữ liệu chi tiết hơn về từng cá nhân, và khả năng mô phỏng mối quan hệ dài hạn hơn có thể hiệu quả đáng kể hơn. Một hệ thống có thể xây dựng mô hình bền vững về niềm tin, mối quan tâm và điểm yếu tâm lý của một cá nhân, rồi tương tác với họ trong nhiều tuần hoặc nhiều tháng, có thể tạo ra hiệu ứng vượt xa những gì công cụ hiện tại đạt được.
Đây là hình thức rủi ro thuyết phục AI ở đầu kia của phổ siêu trí tuệ: không phải thông tin sai lệch hàng loạt đơn giản, mà là thao túng nhận thức dài hạn nhắm mục tiêu cá nhân bởi các hệ thống có mô hình tâm lý con người vượt trội hơn bất kỳ công cụ hiện tại nào. Mối liên hệ với các kịch bản singleton và khóa giá trị là trực tiếp: một tác nhân có công cụ thuyết phục AI cực kỳ hiệu quả có thể dùng chúng để định hình dư luận về quản trị siêu trí tuệ, khiến các thể chế dân chủ khó áp đặt các ràng buộc sẽ hạn chế quyền lực của tác nhân đó.