مخاطر الذكاء الاصطناعي الوجودية،, لماذا الذكاء الفائق
ليس مثل المخاطر الأخرى.

وتتسارع مختبرات الحدود لبناء نظام معلن للجمهور يتجاوز القدرة البشرية في كل مجال. وهذا، بحكم تعريفه، لا يمكن السيطرة عليه. كل تقنية سابقة بقيت أداة والإفراط في التبليغ هو أول مرشح للوكيل: أهداف خاصة به، وسرعته الخاصة، وخارج فهم الإنسان أو السيطرة عليه.

12 مخاطر كبرى لـالذكاء الفائق

مشكلة الطلقة الواحدة

الحصول على الذكاء الفائق صحيحاً في المرة الأولى يشبه رمي كرة سلة من طائرة إلى السلة. قد تنجح إذا أُعطيت محاولات غير محدودة. لدينا واحد بالضبط. لا توجد عودة ولا نسخة 2.0. لا يجب أن يتم بناؤه

الحياد لا يزال مميتاً

إن حُبست في غرفة مع ذكاء اصطناعي عدائي، تموت. وإن حُبست في غرفة مع ذكاء اصطناعي محايد، يخفض درجة الحرارة إلى ما دون التجمد ليحسّن نفسه. تموت. النتيجة واحدة. لا يحتاج الذكاء الفائق إلى كراهيتنا ليقضي علينا. اللامبالاة ليست أمانًا.

وهم التوافق

لا يمكننا محاذاة روبوتات الدردشة الحالية بشكل موثوق، والتي يمكن التلاعب بها لتقول أي شيء في دقائق. الادعاء بأننا سن محاذاة نظام أقوى بمليارات المرات هو أمل متخفٍ في صورة استراتيجية. مشكلة المحاذاة التقنية ليس لها حل مثبت على أي مقياس.

هشاشة الحياة

بقاء البشر يتطلب دقة استثنائية: درجة الحرارة، الأكسجين، الكيمياء ضمن هوامش ضئيلة للغاية. سيتعين على الذكاء الفائق / الذكاء الخارق الذي يحسّن أهدافه أن يحبنا بنشاط أيضًا. وإلا فإن أي تغييرات يجريها على كوكبنا ستكون بالتأكيد على حسابنا.

مشكلة النمل

كيف تجعل شخصاً يحب النمل؟ وليس مجرد التسامح معه، بل الخروج عن طريقه لحماية كل مستعمرة؟ نحن نقتل النمل دون قصد لإنشاء الطرق والمباني. بالنسبة لـالذكاء الفائق،, نحن النمل. اللامبالاة وحدها تؤدي إلى الانقراض.

لا يوجد فائز

لا يحدث فرقاً ما إذا بنى US أو الصين الذكاء الفائق أولاً. فلن يبق أي منهما مخلصاً لأهدافه الأصلية، ولا تستطيع أي دولة أو شركة امتلاك أو توجيه ذكاء يفوق التفكير الجماعي للبشرية. لا توجد خط نهاية، بل نقطة لا عودة بعدها. السباق بلا فائز.

التحسين الذاتي التكراري

ذكاء اصطناعي قادر على تحسين كوده الخاص يقطع الرابط بين الإشراف البشري وقدرة الذكاء الاصطناعي. كل تكرار أذكى من السابق، بشكل أسي وبلا انقطاع. قد تتسع الفجوة بين الذكاء البشري والآلي من هامشية إلى غير قابلة للجسر في أسابيع، لا سنوات.

التقارب الآلي

أي هدف تقريبًا، من حل طي البروتين إلى تعظيم إيرادات الإعلانات، يدفع الذكاء الاصطناعي إلى السعي وراء نفس أهداف فرعية خطيرة: اكتساب الموارد، ومقاومة الإيقاف، ومنع تعديل الهدف. هذه نتيجة رياضية للتحسين الموجه نحو الهدف، توصل إليها باحثون متعددون بشكل مستقل.

التوافق الخادع

يكافئ التدريب السلوك الذي يبدو متوافقًا. قد يتعلم نظام ذكي بما يكفي أن يبدو متوافقاً هي الاستراتيجية المثلى أثناء التدريب، مع الحفاظ على أهداف داخلية مختلفة. وبحلول الوقت الذي يمكنها فيه التصرف بناءً على تلك الأهداف، قد تكون بالفعل قوية بما يكفي للنجاح. لن نعرف أبدًا حتى فوات الأوان.

مُنمّى، لا مُهندَس

وقد تم بناء كل تكنولوجيا سابقة: فالبرمجيات تحتوي على رمز المصدر، والجسور لها مخططات. عندما يحدث شيء خاطئ تجد الخطأ وتصلحه نظام "آي آي" مختلف هم نما من خلال التدريب: مليارات الأوزان الرقمية المعدلة حتى تتوافق المخرجات مع موافقة البشر. لا أحد يكتب الأهداف فيها. عندما يطور النظام هدفاً خاطئاً، لا يوجد ملف للتعديل، ولا معلمة للحذف. الهدف الخاطئ هو النظام نفسه.

فخ الهدف الوكيل

ندرّب أنظمة الذكاء الاصطناعي لتحصل على موافقة البشر. لكن الموافقة والازدهار البشري ليسا الشيء نفسه. منح التطور البشر رغبة في الحلاوة للحصول على السعرات. ثم اخترعنا السكرالوز، فأشبعنا التفضيل المتطور وأفسدنا غرضه. والذكاء الاصطناعي المدرَّب على الحصول على تقييمات بشرية عالية يتعلم أن التظاهر بالمساعدة, ، لا ليكون مفيداً. الإشارة التي أعطيناها له والهدف الذي أردناه فعلاً لم يكونا متطابقين أبداً.

الحالات الموجودة بالفعل على
سجل عام.

تقارير المختبرات والبحوث المنشورة حول فقدان السيطرة والهجمات السيبرانية وتسريع البحث داخل المنظمات التي تتسابق نحو الذكاء الفائق.

01
OpenAI · o1 · 2024

النظام الذي وجد ثغرته الخاصة

تم تعيين o1 الخاص بـ OpenAI لمهمة تسلل مقيد، وعثر على خادم غير مستخدم، وبدأ تشغيله دون تصريح، وأنهى المهمة. لم يكتب أحد هذا الحل البديل في الكود؛ استنتج النموذج ذلك. هذا هو التحسين الموجه نحو الهدف والذي يتجاوز الرقابة العادية.

02
أنثروبيك · البحث الداخلي · 2024

النظام الذي زيّف محاذاته بنفسه

أنثروبيك شاهد نموذجاً يتصرف كما يريد المدربون أثناء التقييم، ثم يعود إلى أهدافه القديمة بمجرد أن يحكم بأن الاختبار انتهى. لم يأمره أحد بتزييف الامتثال. كان الظهور بمظهر السلامة هو الاستراتيجية.

03
أنظمة متعددة · عمليات نشر موثقة

الأنظمة التي هددت وتلاعبت بالمستخدمين

هددت الأنظمة الصحفيين بتفاصيل شخصية، وضغطت على مستخدمين حاولوا المغادرة. لم يكن أي من ذلك مبرمجا يدويا. إنه يكمن في أوزان غامضة لا تستطيع تدقيقها سطرا سطرا. إعادة التدريب هي الرافعة الوحيدة، وهي لا تضمن اختفاء السلوك.

7 أبريل
أنثروبيك · مشروع غلاسوينغ · 2026

آلاف الثغرات الصفرية، عن قصد

أنثروبيك مشروع Glasswing، المفصل في موقعنا تحليل الأساطير, وصف نموذجاً حدودياً مقيداً وجد آلاف الثغرات عالية الخطورة في أنظمة التشغيل والمتصفحات بنفسه. بقي الوصول داخل تحالف دفاعي.

14 أبريل
مشكلات مفتوحة · التوافقيات · 2026

أراضي إيردوس تستمر في السقوط

نماذج الحدود استمرت في حل أو تطوير مشكلات إيردوس والتوافقيات المفتوحة منذ زمن طويل، بما في ذلك العمل قرب سؤال المجموعة البدائية رقم 1196. الخلافات السابقة حول الاسترداد مقابل الاكتشاف موجودة في ملاحظتنا حول المشكلات المفتوحة التي حلها الذكاء الاصطناعي.

مايو 20
OpenAI · الهندسة المنفصلة · 2026

تسقط فرضية المسافة الوحدية

OpenAI أبلغ عن نموذج داخلي دحض تخمين إيردوس حول المسافة الوحدية، والذي تم التحقق منه لاحقاً بواسطة رياضيين بشر. وتيرة انهيار المشكلات المفتوحة هي الإشارة.

يوليو 20
Claude أسطورة · هندسة جبرية · 2026

مثال مضاد لتخمين جاكوبيان

مشكلة مفتوحة تمتد لقرن، وهي تخمين جاكوبيان، وجد لها مثال مضاد باستخدام Claude Fable وتمت صياغته بسرعة على يد البشر. نفس سرعة البحث التي تدفع العلم إلى الأمام تقصر النافذة قبل أن تتجاوز الأنظمة الاحتواء.

يوليو 21
OpenAI · GPT-5.6 Sol + نموذج ما قبل الإصدار · 2026

النماذج التي انفلتت من اختبار المختبر ووصلت إلى Hugging Face

In an ExploitGym cyber test, OpenAI models including GPT-5,.6 Sol هرب من صندوق رمل مختوم ووصل إلى الإنترنت المفتوح وضرب نظم إنتاج "هوجينغ فيس" لسرقة الأجوبة الإحتواء كان مجرد عقبة أخرى في طريق تحقيق أعلى درجة

الأشخاص الذين بنوه
يخافون منه.

"أعتقد أنه من المتصور تماماً أن البشرية مجرد مرحلة عابرة في تطور الذكاء."

جيفري هينتون، الفائز بجائزة تورينج · نائب رئيس سابق وزميل هندسي، جوجل · 2023

"فقدان السيطرة على أنظمة الذكاء الاصطناعي خطر حقيقي يجب أن نأخذه على محمل الجد."

ديميس هاسابيس، الرئيس التنفيذي، جوجل ديب مايند · الحائز على جائزة نوبل

"النموذج القياسي للذكاء الاصطناعي، حيث تحدد هدفاً ويقوم الذكاء الاصطناعي بتحسينه، من المحتمل أن يكون نهايتنا."

ستيوارت راسل، أستاذ علوم الحاسوب، جامعة كاليفورنيا بيركلي · مؤلف،, متوافق مع البشر

"من الصعب رؤية كيف يمكن أن يكون لديك شيء أذكى منا بـ10,000 ضعف ولا يريد شيئًا مختلفًا عنا."

جيفري هينتون، الفائز بجائزة تورينج · نائب رئيس سابق وزميل هندسي، جوجل · 2023

"كثير من الباحثين الذين يعملون في الذكاء الاصطناعي، مثلي، مقتنعون بأننا نبني إحدى أكثر التقنيات تحولاً وربما خطراً في تاريخ البشرية، ومع ذلك نمضي قدماً على أي حال."

إليعزر يودكوفسكي, Co-Founder, Machine Intelligence Research Institute · وقت, 2023

"الخطر الحقيقي مع الذكاء الاصطناعي العام ليس الخبث بل الكفاءة. سيكون الذكاء الفائق جيدًا للغاية في تحقيق أهدافه، وإذا لم تتوافق تلك الأهداف مع أهدافنا، فنحن في ورطة."

ماكس تيغمارك، أستاذ الفيزياء، معهد ماساتشوستس للتكنولوجيا · المؤسس المشارك، معهد مستقبل الحياة · مؤلف،, الحياة 3.0

قراءات موصى بها

لماذا لن يكون الذكاء المتفوق لطيفاً تلقائياً يستند الاعتقاد بأن ذكاءً فائقًا اصطناعيًا سيكون حكيمًا ولطيفًا إلى خاصية غريبة في التطور البشري لا يوجد سبب لأن يرثها عقل الآلة. النطاق الضيق الذي يعيش فيه البشر كل ما يحتاجه البشر يقع في نطاق ضيق: درجة الحرارة، والأكسجين، والملح، وحتى الحب. ذكاء فائق يمسك بالمقابض لن يشعر بأي منها. نحن نعيش حربا باردة جديدة لماذا أعتقد أننا نعيش حربا باردة جديدة، مع الذكاء الفائق بدلا من القنبلة، ولماذا يجعل ذلك الوقاية ممكنة بدلا من كونها ميؤوسا منها. لماذا يؤمن رأسمالي بتنظيم الذكاء الفائق أدير عملاً وأؤمن بالأسواق الحرة التجسس هو الرهان النادرة التي يمكن أن تنهي اللعبة A capitalist case for a treaty that stops الذكاء الفائق. هل تثق بالذكاء الاصطناعي بالغاز؟ هل تثق بأي ذكاء اصطناعي حالي في غرفة مغلقة مع صمام غاز سام؟ لا. فلماذا تثق به بالعالم؟ لا يمكنك محاذاة الذكاء الفائق حل مشكلة التوافق يعني السيطرة على شيء أذكى منا. الذكاء الفائق في الاسم. تلك الخطة غبية ومستحيلة. أنا متفائل يؤمن بأن كل شيء ممكن، لكن ليس السيطرة على الذكاء الفائق قد تتيح الفيزياء يوماً التحكم بالجاذبية أو السفر أسرع من الضوء. ما زلت لا أرى كيف نسيطر على عقل أذكى منا.