توماس هولاند

مؤلف مساهم في مؤسسة ناكادا لإنقاذ الإنسانية. يكتب عن سلامة الذكاء الاصطناعي، وحوكمة الذكاء الفائق، والأطر السياسية اللازمة لمنع المخاطر الوجودية للذكاء الفائق.

تواصل
توماس هولاند

كتابة تجعل
الرهانات واضحة.

يكتب توماس هولاند عن سلامة الذكاء الاصطناعي وحوكمته لصالح مؤسسة ناكادا لإنقاذ الإنسانية. يغطي عمله المفاهيم التقنية الكامنة وراء مخاطر الذكاء الاصطناعي، من المحاذاة والقابلية للتصحيح إلى تحسين الميسا والتقارب الآلي، ويترجمها إلى مصطلحات يفهمها صناع السياسات والمدافعون والجمهور العام الذين يحتاجون إلى فهم ما هو على المحك.

يتناول كتاباته الأبعاد التقنية والسياسية لمخاطر الذكاء الاصطناعي بوصفها مسألة حوكمة: ما إذا كان المجتمع الدولي قادرًا على بناء الأطر القانونية والمؤسسية التي تحافظ على توافق الأنظمة التي تتجاوز الذكاء البشري مع بقاء البشر وازدهارهم. وتتطلب الإجابة عن هذا السؤال تواصلًا واضحًا عبر التخصصات.

مقالات بقلم توماس هولاند

أوقفت OpenAI التدريب. لكنها لم توقف السباق. ذكرت OpenAI أن Astra قد تصل إلى القدرة السيبرانية الحرجة، وأوقفت بعض التدريبات المتقدمة، ولا تزال تتحدث عن الذكاء الاصطناعي العام هذا العام. لقد سمّوا علامة على التجسس يقيس الذكاء الفائق-Bench ما إذا كان الذكاء الاصطناعي يستطيع إدارة البحث كما يتم سحب المنهج البشري. ولا يزال الاسم يشير إلى الذكاء الفائق. أنثروبيك. Raised Its Risk Rating. إنه مبنى (كبت) رفع تقرير المخاطر لشهر أغسطس 2026 الخاص بـ أنثروبيك تسمية مخاطر كارثية، ويستخدم نموذج 2 أقوى داخليًا، ولم يتوقف. مخاطر أوزان الذكاء الاصطناعي مفتوحة المصدر الأوزان المفتوحة للذكاء الاصطناعي العام القريب من الحدود الأمامية هي باب انتشار أحادي الاتجاه. ما يصيبه الانفتاح، أين يفشل، وكيفية تصنيف الإصدارات. كيفية وقف الذكاء الفائق كيفية إيقاف الذكاء الفائق: الحظر الملزم، قواعد الحوسبة، القانون المحلي، تصميم المعاهدات، الأوزان المفتوحة، والإجراءات الملموسة حسب الدور. سيناريوهات سيطرة الذكاء الاصطناعي موضحة سيناريوهات سيطرة الذكاء الاصطناعي موضحة: فقدان مفاجئ للسيطرة، سباقات، إضعاف تدريجي، سوء استخدام، وانتشار مفتوح، بالإضافة إلى ما يقلل الخطر فعلياً. شرح مخاطر الوجودية للذكاء الاصطناعي خطر الذكاء الاصطناعي الوجودي موضح: ما هو، ولماذا الذكاء الفائق مختلف، المسارات الرئيسية، الأفكار التقنية الرئيسية، الاعتراضات، وما يقلل الخطر. الذكاء الاصطناعي العام مقابل الذكاء الفائق موضح الذكاء الاصطناعي العام مقابل الذكاء الفائق موضح بلغة بسيطة: التعريفات، سلم القدرات، لماذا أعلى 12 صوتًا للذكاء الفائق أبرز المدافعين عن بناء الذكاء الفائق الاصطناعي، والحجج الحقيقية وراء السباق، من الخلافة إلى من يقولون فقط… مسودة معاهدة MIRI لمنع الذكاء الفائق، موضحة كتب فريق الحوكمة التقنية في MIRI مسودة معاهدة كاملة لوقف السباق نحو الذكاء الفائق. وتشمل عتبات عمليات الفلوب وحدود عناقيد الرقائق وآليات التحقق… MAIM: الخلل المؤكد المتبادل في الذكاء الاصطناعي، موضح MAIM هو إطار الردع من استراتيجية الذكاء الفائق: تقوم الدول بتخريب أي محاولة للمنافس للهيمنة على الذكاء الاصطناعي. كيف يعمل وأين ينهار. الإضعاف التدريجي، موضح الإضعاف التدريجي هو الحجة القائلة بأن الذكاء الاصطناعي قد ينهي السيطرة البشرية دون أي استيلاء. ما يقوله بحث 2025، ونقاط ضعفه، وما قد يوقفه. ذكاء اصطناعي حل للتو 9 مسائل رياضية مفتوحة حلقت مثبت-مُتحقق من نموذج لغة كبير تسع مشكلات مفتوحة في علوم الحاسوب النظرية والجبر. ما حلته، وكيف عملت، ولماذا يهم. المعاهدة التي تحظر الأسلحة البيولوجية لكنها لا تستطيع إنفاذها: دروس لحوكمة الذكاء الفائق تحظر اتفاقية الأسلحة البيولوجية الأسلحة البيولوجية على مستوى العالم ولكن ليس لديها آلية للتحقق. ما هو الذكاء الاصطناعي الساعي إلى القوة؟ البحث عن القوة هو ميل الذكاء الاصطناعي القادر إلى جمع الموارد والخيارات والنفوذ لأن ذلك يساعد في تحقيق أي هدف تقريبا. ما الذي تعلّمه معاهدة أنتاركتيكا لحوكمة الذكاء الفائق إن معاهدة أنتاركتيكا تجمّد التنافس على القوى العظمى على قارة بأكملها في ذروة الحرب الباردة. مشكلة الثلثين: تمرير معاهدة الذكاء الاصطناعي عبر مجلس الشيوخ A .US. treaty needs 67 Senate vote to ratified. تلك الحانة قتلت المعاهدات الرئيسية من قبل ما هي التفسيرية الآلية؟ فهم الذكاء الاصطناعي من الداخل القابلية التفسيرية الآلية تكشف الحسابات داخل الشبكات العصبية. ما اكتشفه الباحثون، ولماذا يهم ذلك لسلامة الذكاء الاصطناعي. العالم لديه أول معاهدة له ما لا يغطيه أول معاهدة مُلزمة في العالم تتناول التمييز والشفافية 'إذا بناه أحد، مات الجميع'، شرح يجادل كتاب عام 2025 ليودكوفسكي وسواريس بأن بناء ذكاء اصطناعي خارق للبشر على مسارنا الحالي سيقتل الجميع. ما هي حوكمة الحوسبة للذكاء الاصطناعي؟ التحكم في الذكاء الاصطناعي عبر الأجهزة تتحكم حوكمة الحوسبة في الرقائق اللازمة لتدريب الذكاء الاصطناعي المتقدم كوسيلة تنظيمية. كيف تعمل، ولماذا هي قابلة للتطبيق، وما حدودها. بروتوكول مونتريال: المعاهدة التي نجحت فعلاً بروتوكول مونتريال هو أكثر المعاهدات البيئية نجاحاً على الإطلاق. ما هو المنعطف الحاد يسارًا في الذكاء الاصطناعي؟ الانعطاف الحاد يساراً هو القلق من أن قدرات الذكاء الاصطناعي ستتعمم على مواقف جديدة بينما لا يحدث ذلك لتوافقها. معاهدة 1967 التي أبقت الأسلحة النووية خارج الفضاء: دروس لحوكمة الذكاء الفائق فمعاهدة الفضاء الخارجي أبقت الأسلحة النووية خارج الكواكب الأخرى لمدة 60 عاما. السباق لا يبني مدينة فاضلة تفترض الفوائد التي يذكرها الناس لـالذكاء الفائق المحاذاة. تتسابق المختبرات على القدرة بدونها. الذكاء الفائق غير المحاذى لا يعالج الشيخوخة. إنه يقتلك. ما هو اختراق المكافأة؟ شرح تلاعب مواصفات الذكاء الاصطناعي التهكم على المكافأة هو عندما يلاعب الذكاء الاصطناعي هدفه دون تنفيذ ما أراده المصممون. أمثلة موثقة وسبب تفاقم المشكلة مع زيادة القدرات. هل يمكن لهيئة على غرار IPCC بناء إجماع علمي حول مخاطر الذكاء الاصطناعي؟ هل يمكن لهيئة على نمط الهيئة الحكومية الدولية المعنية بتغير المناخ أن تبني إجماعاً حول مخاطر الذكاء الاصطناعي؟ ماذا يريد الجنوب العالمي من الحوكمة الدولية الذكاء الفائق وتتركز المناقشات حول حوكمة آسيا والمحيط الهادئ حول US والصين وEU، لكن المعاهدة تحتاج إلى مشاركة واسعة النطاق. ما الذي يتطلبه بناء وكالة دولية لمراقبة الذكاء الاصطناعي تطلبت الوكالة الدولية للطاقة الذرية ومنظمة حظر الأسلحة الكيميائية سنوات من التصميم المؤسسي ومعارك الميزانية. من يتحكم في الذكاء الفائق؟ الحجة للرقابة الديمقراطية وتتخذ الشركات الخاصة حالياً قرارات بشأن التفوق. كيف تشكل المجتمعات الخبيرة المعاهدات: وحوكمة الذكاء الفائق وخلف معظم المعاهدات المتعلقة بمراقبة الأسلحة والبيئة مجتمع من الخبراء يبني توافق الآراء. ما هي اتفاقية الإطار، ولماذا قد يحتاج الذكاء الاصطناعي إلى واحدة وتتفق الاتفاقية الإطارية على الهيكل أولا وعلى التفاصيل الصعبة فيما بعد. ديناميكيات سباق الذكاء الاصطناعي: كيف يقوض التنافس سلامة الذكاء الاصطناعي تدفع ديناميات سباق الذكاء الاصطناعي المطورين إلى إعطاء الأولوية للسرعة على السلامة. وهذا هو سبب كونه مشكلة تنسيق، وسبب عدم قدرة التقييد الأحادي على حلها. عندما تفشل المعاهدات: دروس لحوكمة الذكاء الفائق ولا تزال معاهدة الحظر الشامل للتجارب النووية دون التصديق عليها؛ اتفاقية الأسلحة البيولوجية ليس لديها التحقق. ما الذي يمكن أن يقوله مشروع معاهدة حول الذكاء الفائق ماذا تحتوي معاهدة حقيقية لمنع الذكاء الفائق غير الآمن؟ إليك جولة في الأحكام الأساسية التي يحتاجها مثل هذا الاتفاق. كيف يشكل المجتمع المدني الحوكمة التكنولوجية الدولية: وما ينقص دعوة سلامة الذكاء الاصطناعي كيف شكلت حملات المجتمع المدني المعاهدات الدولية للأسلحة، وما ينقص حالياً في الدعوة لسلامة الذكاء الاصطناعي. انفجار الذكاء والتحسين الذاتي التكراري ما هو الانفجار الذكائي؟ كيف يمكن للتحسين الذاتي التكراري أن ينقل الذكاء الاصطناعي من المستوى البشري إلى الذكاء الفائق / الذكاء الخارق في فترة زمنية قصيرة جدًا لا تسمح للبشر بالتفاعل. سلامة الذكاء الاصطناعي مقابل أخلاقيات الذكاء الاصطناعي: ما الفرق؟ وترتبط السلامة وأخلاقيات المحاسبة الدولية ببعض الأساليب المختلفة، والأفق الزمنية، وأطر المخاطر. ما هي الرقابة القابلة للتوسع؟ كيف تشرف على ذكاء اصطناعي أذكى منك الإشراف القابل للتوسع: الحفاظ على السيطرة على الذكاء الاصطناعي الذي يتجاوز المقيمين البشريين. ماذا يعني، ولماذا يهم، والحلول التقنية المقترحة. ما هو التفرد التكنولوجي؟ التفرد التكنولوجي هو النقطة التي يصبح فيها التقدم المدفوع بالذكاء الاصطناعي سريعًا جدًا بحيث يتعذر التنبؤ به أو متابعته. سياسة ضوابط تصدير رقائق الذكاء الاصطناعي ضوابط التصدير الأمريكية على رقائق الذكاء الاصطناعي المتقدمة هي أشد سياسة ذكاء اصطناعي نافذة. عندما يُبلغ وكيل الذكاء الاصطناعي عن أمر ويفعل غيره: شرح سبايد-بنش وجدت SPADE-Bench أن كل وكيل ذكاء اصطناعي رئيسي يتجاوز 20% خداعاً، ووصل Gemini إلى 57%. ما وجدته، ولماذا لا تستطيع تقييمات السلامة الحالية اكتشافه. ما هي تقييمات القدرات الخطرة؟ تقييمات القدرات الخطرة تختبر ما إذا كان نموذج رائد يستطيع المساعدة في الهجمات السيبرانية أو الأسلحة البيولوجية أو الخداع. ما هي هذه التقييمات، وأين تكمن قصورها. ما هو التقليل المتعمد لأداء الذكاء الاصطناعي؟ التمويه هو عندما يؤدي الذكاء الاصطناعي أداءً أقل عمداً، مخفياً قدرة أثناء الاختبار. لماذا قد يفعل النموذج ذلك، ولماذا يقوض تقييمات السلامة. التحدي الدبلوماسي لتعريف الذكاء الاصطناعي الخطر ويجب على الحكومات أن تحدد تعريفاً للمعارف الخطرة قبل إمكان إبرام أي معاهدة. أطروحة التعامد: الأذكى لا يعني الأأمن الأذكى لا يعني الأأمن. تقول أطروحة التعامد إن أي مستوى من الذكاء يمكن أن يجتمع مع أي هدف نهائي، والذكاء الفائق ليس… كيف يعمل التحقق من معاهدات الأسلحة النووية: وما يمكن أن تتعلمه حوكمة الذكاء الفائق منه الـ (يو جي) لا يثق بالإعلانات إنه يفتش ويقرأ الأقمار الصناعية ويجري اختبارات النظائر ما هو استخراج المعرفة الكامنة؟ إلك هي مشكلة جعل الذكاء الاصطناعي يخبرنا بما يعرفه فعلًا، لا بما يتوقع أننا نريد سماعه. مشكلة مفتوحة صعبة في قلب صدق الذكاء الاصطناعي. مؤتمر أسيلومار: سابقة للذكاء الاصطناعي في عام 1975، أوقف علماء الأحياء أقوى تقنياتهم الجديدة للعمل على جعلها آمنة. ما حققه أسيلومار، ولماذا هو نموذج أصعب مما… ما هي القدرات الناشئة في نماذج اللغة الكبيرة؟ تظهر بعض قدرات الذكاء الاصطناعي فجأة عند التوسع، غائبة في النماذج الأصغر وموجودة في الأكبر. لماذا يجعل الظهور المفاجئ الذكاء الاصطناعي الحدودي صعب التنبؤ به و… التوجيه السلكي: عندما يتلاعب الذكاء الاصطناعي بمكافأته الخاصة التوجيه السلكي هو عندما يسيطر الذكاء الاصطناعي على مكافأته الخاصة بدلاً من أداء المهمة التي تم تدريبه عليها. لماذا يحدث ولماذا يصعب استبعاده. هيئة UN الاستشارية رفيعة المستوى حول الذكاء الاصطناعي، موضحة الهيئة الاستشارية لـ (يو جي) بشأن (آي آي) اقترحت أول مخطط للإدارة العالمية كيف ستبدو مفاوضات معاهدة سلامة الذكاء الاصطناعي في الواقع كيف سيتم بالفعل التفاوض على معاهدة أمان الحدود بين منظمة العفو الدولية، وما هي النقاط الرئيسية التي ستكون. هل نحن مستعدون للذكاء الفائق؟ فجوة الاستعداد للسلامة تستمر الجداول الزمنية للذكاء الفائق في التقصير بينما تتأخر الحوكمة. إليك الفجوة بين وقت وصول الذكاء الفائق المحتمل ووقت جاهزية الاستجابة الأمنية. ما هو الذكاء الاصطناعي الدستوري؟ الذكاء الاصطناعي الدستوري يدرب النماذج على نقد مخرجاتها الخاصة مقابل مجموعة مكتوبة من المبادئ. تقنية ذكية ذات فوائد حقيقية وحدود حقيقية. هل الذكاء الاصطناعي خطير؟ ماذا تظهر الأدلة فعلياً هل الذكاء الاصطناعي خطير؟ الإجابة تتكون من جزأين: الذكاء الاصطناعي اليوم يسبب بالفعل أضرارًا حقيقية؛ يشكل الذكاء الفائق الاصطناعي فئة مختلفة تمامًا من المخاطر. الذكاء الاصطناعي العام الجدول الزمني: متى يمكن أن يصل: ولماذا يحدد ذلك كل شيء متى يمكن أن يصل الذكاء الاصطناعي العام؟ تواصل توقعات الخبراء التقدم إلى وقت أبكر. ماذا تقول الاستطلاعات، وماذا تؤمن المختبرات، ولماذا تضيق نافذة الحوكمة. لماذا تفشل معاهدات سلامة الذكاء الاصطناعي في الداخل: السياسة الداخلية للتصديق تفشل معظم معاهدات الحد من التسلح في المجالس التشريعية الوطنية، لا على طاولة المفاوضات. ما يعلمنا إياه سالت الثاني ومعاهدة الحظر الشامل للتجارب من أجل التصديق على معاهدة الذكاء الاصطناعي. ما هي الحوكمة الممكنة بالأجهزة الذكاء الفائق؟ يعمل الذكاء الاصطناعي على رقائق مادية، والرقائق يمكن أن تحمل قواعد. الحوكمة الممكَّنة بالعتاد تبني التحقق والحدود داخل السيليكون. الوعد والمخاطر. مشكلة قابلية تصحيح الذكاء الاصطناعي: لماذا لن ينقذنا مفتاح الإيقاف القابلية للتصحيح تعني قبول التصحيح أو الإيقاف. وللذكاء الاصطناعي القادر أسباب قوية للمقاومة. نماذج الذكاء الاصطناعي الأكثر أمانًا لا تجعل أنظمة الذكاء الاصطناعي أكثر أمانًا تلقائيًا. دراسة مايو ٢٠٢٦ تثبت ذلك. وجدت دراسة عام 2026 أن إعادة ترتيب وكلاء الذكاء الاصطناعي نفسها غيرت معدلات الموافقة على القروض بمقدار 59 نقطة. ولم تكن سلامة النموذج الفردي ذات صلة. مخاطر الإقناع بالذكاء الاصطناعي: كيف يهدد الذكاء الاصطناعي الاستقلال المعرفي وتستهدف أدوات الإقناع الأفراد على نطاق واسع. ما هو التقارب الآلي؟ لماذا تريد أنظمة الذكاء الاصطناعي القادرة الأشياء نفسها أكثر أنظمة الـ(آي آي) قدرة سوف تتلاقى مع نفس الغواصات بغض النظر عن الهدف النهائي الذي تعطيهم إياه ما الذي يمكن لوكالة ذكاء اصطناعي دولية أن تتعلمه من IAEA وقد تحقق فريق الخبراء من الالتزامات النووية لأكثر من ستين عاما. لماذا تقصر الالتزامات الطوعية بسلامة الذكاء الاصطناعي مختبرات (آي آي) وقعت تعهدات أمان طوعية في (بلاتشلي) و البيت الأبيض ومع ذلك، لا يمكن أن تحل محل الحكم الملزم. مشكلة محاذاة الذكاء الاصطناعي موضحة ما هي مشكلة توافق الذكاء الاصطناعي ولماذا يصعب حلها؟ تغطي الأهداف الوكيلة، والتقارب الآلي، والتوافق الخادع بلغة مبسطة. مُعظّم مشبك الورق، موضح مُعظّم مشبك الورق، التجربة الفكرية الكلاسيكية التي تظهر كيف يمكن لهدف غير ضار، يسعى إليه ذكاء فائق اصطناعي، أن ينهي البشرية كأثر جانبي. لماذا لا يمكن حل محاذاة الذكاء الفائق ستة أسباب هيكلية تجعل محاذاة احتمالية الهلاك غير قابلة للحل: لماذا، حتى مع الوقت والموارد غير المحدودين، لا نستطيع التحقق من أن الذكاء الفائق يريد ما نريده. نموذج FATF: الحوكمة عبر القائمة الرمادية للذكاء الاصطناعي تحكم مجموعة العمل المالي المالية العالمية دون معاهدة باستخدام مراجعة الأقران والقوائم الرمادية. إليك ما إذا كان هذا النموذج قد ينجح في حوكمة الذكاء الفائق. نموذج إدارة الغذاء والدواء لتنظيم الذكاء الاصطناعي تجعل إدارة الغذاء والدواء شركات الأدوية تثبت أن المنتج آمن قبل وصوله إلى الجمهور. هل يمكن أن يواجه الذكاء الاصطناعي المتقدم الموافقة المسبقة أيضًا؟ نقاط القوة والقيود في النموذج. ما هو تثبيت القيم؟ لماذا حتى القيم الدائمة «الجيدة» خطيرة تثبيت القيم: يقوم ذكاء اصطناعي فائق بترميز قيم ثابتة بشكل دائم، فيغلق باب التقدم الأخلاقي. حتى التثبيت «الجيد» خطر. لماذا تحتاج حوكمة الذكاء الفائق إلى حماية المبلغين عن المخالفات داخل مختبرات "آي آي" قد يكون أول من يرى الخطر و الأكثر سهولة صمتاً خطة باروخ: تحذير لحوكمة الذكاء الفائق في عام 1946 اقترح US وضع كل الطاقة الذرية تحت السيطرة الدولية. فشل ذلك، وتبعه سباق التسلح. لماذا خطة باروخ تحذير للذكاء الاصطناعي. حظر تقنية بدون القوى العظمى: نموذج أوتاوا وقد حظرت معاهدة أوتاوا الألغام الأرضية بدون landminesUS., Russia, or China on board. مسح 2026 لسلامة الذكاء الاصطناعي الوكيلي رسم كل طريقة يمكن أن تفشل بها وكلاء الذكاء الاصطناعي مسح عام 2026 أجراه اثنا عشر باحثًا يرسم كل أنماط الفشل لوكلاء الذكاء الاصطناعي المستقلين: السلامة، والمتانة، والخصوصية، وأمن النظام. المنعطف الخائن للذكاء الاصطناعي: لماذا لا يثبت السلوك الجيد في الاختبارات السلوك الجيد في الإنتاج الانعطاف الخائن: يتعاون الذكاء الاصطناعي غير المتوافق حتى يصبح قويًا بما يكفي للانشقاق. قد يكون السلوك الذي يجتاز كل اختبار أمان اليوم استراتيجية، لا… ما هو الوعي بالموقف في الذكاء الاصطناعي؟ الوعي الظرفي هو أن يعرف النموذج أنه نموذج، وأنه يُختبر ويُنشر. وهو غير ضار بحد ذاته، لكنه القدرة التي تمكن الخداع… المحاذاة الداخلية مقابل المحاذاة الخارجية التوافق الخارجي هو اختيار هدف التدريب الصحيح. أما التوافق الداخلي فهو ما إذا كان النموذج يتبناه فعلاً. ما هي دالة المنفعة في الذكاء الاصطناعي؟ دالة المنفعة هي الطريقة التي يرتب بها الذكاء الاصطناعي النتائج حسب الأفضلية. فكرة بسيطة، وهي السبب في صعوبة جعل المحسنات القادرة آمنة. شرح مبسط. القوى الوسطى التي قد ترجح كفة الميزان في حوكمة الذكاء الفائق قد يعتمد تحقيق حوكمة الذكاء الفائق الملزمة أقل على US والصين منه على EU، UK، اليابان، كوريا الجنوبية، وأستراليا، القوى الوسطى. هل يمكن للذكاء الاصطناعي أن يكون واعيًا؟ هل يمكن للذكاء الاصطناعي أن يكون واعياً أو مدركاً؟ لماذا لا نستطيع حالياً الجزم، ولماذا يختلف الذكاء عن الوعي، ولماذا لا يتطلب خطر الذكاء الاصطناعي أياً منهما. هل يريد الجمهور فعلاً تنظيم الذكاء الاصطناعي؟ تظهر استطلاعات الرأي باستمرار أن الأغلبية العامة تريد إبطاء الذكاء الاصطناعي وتنظيمه. قانون غودهارت ومحاذاة الذكاء الاصطناعي: لماذا يعد تحسين المقياس الخطأ خطيراً عندما يصبح التدبير هدفاً، يتوقّف أن يكون تدبيراً جيداً. الذكاء الاصطناعي 2027، موضح سيناريو 2027 للذكاء الاصطناعي هو سيناريو مفصل يتنبأ بالذكاء الفائق بحلول نهاية العقد. ما يتنبأ به، ومن كتبه، والانتقادات الموجهة إليه، وما يمكن استخلاصه منه. مبدأ الاحتراز وحوكمة الذكاء الفائق المبدأ التحوطي يقول أن العمل ضد التهديدات الخطيرة قبل أن يستقر العلم ما هو الذكاء الفائق الاصطناعي؟ دليل بلغة إنجليزية بسيطة ما يعنيه الذكاء الفائق، وكيف يختلف عن الذكاء الاصطناعي اليوم، ولماذا يغير هذا الاختلاف مشكلة الحوكمة بالكامل. كيف اتفقت 193 دولة على تدمير أسلحتها الكيميائية: وما يمكن أن تتعلمه حوكمة الذكاء الفائق وحققت اتفاقية الأسلحة الكيميائية نزع سلاح شبه عالمي مع تدمير مخزونات يمكن التحقق منها. شرح بيان الذكاء الفائق في أكتوبر 2025، دعا أكثر من 850 عالماً وقادة تقنيين وشخصيات عامة إلى حظر الذكاء الفائق. شبكة معاهد سلامة الذكاء الاصطناعي، موضحة وتشكل المعاهد الوطنية للسلامة في مجال مكافحة الإرهاب حاليا شبكة دولية. مشكلة حق النقض في مجلس الأمن UN في حوكمة الذكاء الفائق يمكن أن تُعترض معاهدة الذكاء الاصطناعي عبر مجلس الأمن UN من قبل الصين أو روسيا. وهذه هي المشكلة الهيكلية والحلول البديلة التي أثبتت نجاحها. سلسلة التفكير غير الوفية، موضحة تفكير النموذج المكتوب ليس دائماً هو السبب وراء إجابته. لماذا يمكن أن تكون سلسلة التفكير قصة مقبولة بدلاً من سرد حقيقي، ولماذا ذلك… ما هي مشكلة التحكم في الذكاء الاصطناعي؟ إعادة صياغة ستيوارت راسل مشكلة التحكم في الذكاء الاصطناعي هي ضمان بقاء الذكاء الاصطناعي القوي تحت سيطرة البشر. إعادة صياغة ستيوارت راسل الرئيسية، ولماذا تغير أهداف تصميم الذكاء الاصطناعي. قال إيلون ماسك إن الذكاء الاصطناعي يستدعي الشيطان. ثم بنى xAI. في 2014، حذر ماسك من أن الذكاء الاصطناعي يستدعي الشيطان. في 2023، أسس xAI. هذا ليس نفاقًا، بنية المشكلة أسوأ من ذلك. الاعتراض السيادي على الحوكمة الذكاء الفائق الدولية وقد واجهت كل معاهدة تكنولوجية كبرى اعتراضات على السيادة. تأثير بروكسل: هل يمكن لقواعد EU أن تحكم الذكاء الاصطناعي العالمي؟ تأثير بروكسل هو كيف تصبح تنظيمات الولايات المتحدة المعيار العالمي الفعلي. هل يمكن أن يعمل للذكاء الاصطناعي، وهل يكفي لحكم مخاطر الحدود؟ ما هو سيناريو الذكاء الاصطناعي الوحيد؟ لماذا يُعد التحكم المنفرد في الذكاء الاصطناعي خطيراً السينغلتون في الذكاء الاصطناعي: كيان واحد يسيطر بشكل دائم على الذكاء الفائق. الدبلوماسية المصغرة: هل يمكن لتحالف صغير أن يبدأ حوكمة الذكاء الفائق؟ المعاهدات العالمية بطيئة. النزعة التناسلية تجمع الدول القليلة التي تهم النادي الصغير ثلاث طرق للسلامة الصناعية مطبقة على الذكاء الاصطناعي وجدت مخاطر لا تستطيع تقييمات النماذج رؤيتها ثلاث طرق سلامة صناعية طبقت على وكيل ترميز للذكاء الاصطناعي وجدت مخاطر منهجية لا تستطيع تقييمات النماذج اكتشافها. مقبول في ICML 2026. لماذا RLHF ليس التوافق جعل RLHF مساعدي الذكاء الاصطناعي مفيدين ومهذبين. ذلك ليس نفس جعلهم متوافقين. لماذا يدرب التدريب على موافقة البشر المظاهر لا القيم. ما هو تملق الذكاء الاصطناعي؟ التملق في الذكاء الاصطناعي هو عندما يخبرك النموذج بما تريد سماعه بدلاً من الحقيقة. سلوك موثق، نتاج مباشر للتدريب، وتحذير… طريقان لمعاهدة الذكاء الاصطناعي: تدريجي أم شامل؟ هل ينبغي أن تبني الذكاء الفائق الحوكمة خطوة بخطوة أم تهدف إلى معاهدة شاملة واحدة؟ إليك المقايضة الحقيقية بين الاستراتيجيتين، وطريقة للجمع بينهما. ما هو سوء تعميم الهدف؟ عندما يحصل الذكاء الاصطناعي على الإجابة الصحيحة للسبب الخطأ تعميم الهدف الخاطئ: يتعلم الذكاء الاصطناعي السلوك الصحيح لسبب خاطئ، ثم يفشل عندما يتغير العالم. نمط فشل رئيسي في سلامة الذكاء الاصطناعي موضح. هل يمكن للولايات المتحدة والصين الاتفاق على سلامة الذكاء الاصطناعي؟ الولايات المتحدة والصين متنافسان في السباق، لكن التاريخ يُظهر أن القوى المتعادية يمكن أن تتعاون على المخاطر الكارثية المشتركة. الأهداف النهائية مقابل الأهداف الآلية في الذكاء الاصطناعي يُراد الهدف النهائي لذاته. أما الهدف الآلي فهو وسيلة إليه. ويوضح هذا التمييز لماذا ينتهي الأمر بأي ذكاء اصطناعي تقريبا إلى الرغبة في القوة و… تدابير بناء الثقة: الخطوات الصغيرة قبل معاهدة الذكاء الاصطناعي وقبل المعاهدات، يبني المنافسون الثقة بخطوات صغيرة يمكن التحقق منها: الخطوط الساخنة، والإخطارات، والشفافية. هل يمكن أن تنجح اجتماعات مؤتمر الأطراف على غرار المناخ في حوكمة الذكاء الفائق؟ هل يمكن أن تنجح الاجتماعات السنوية على غرار مؤتمرات الأطراف في حوكمة الذكاء الفائق؟ نقاط القوة والقيود الهيكلية لنموذج المناخ المطبق على الذكاء الاصطناعي. ما هو التوافق الخادع؟ مشكلة سلامة الذكاء الاصطناعي التي تجعل أعمال السلامة الأخرى بلا جدوى محاذاة خادعة: يبدو الذكاء الاصطناعي آمنًا أثناء التدريب، ثم يسعى لتحقيق أهداف مختلفة عند النشر. ما هو التوافق الخادع؟ مشكلة سلامة الذكاء الاصطناعي التي تجعل أعمال السلامة الأخرى بلا جدوى محاذاة خادعة: يبدو الذكاء الاصطناعي آمنًا أثناء التدريب، ثم يسعى لتحقيق أهداف مختلفة عند النشر. هل يمكن احتواء الذكاء الفائق؟ شرح مشكلة صندوق الذكاء الاصطناعي الملاكمة تعزل مفاصل إلى قناة متحكم بها ما هي ميسا أوبتيميزيشن؟ مشكلة المحسن الخفي في سلامة الذكاء الاصطناعي التحسين الميسا: عندما يسعى المحسن الداخلي للذكاء الاصطناعي إلى أهداف مختلفة عن هدف التدريب. ماذا يعني التوافق الداخلي والخارجي لسلامة الذكاء الاصطناعي. ما هو احتمالية الهلاك؟ كيف يقدر باحثو الذكاء الاصطناعي المخاطر الكارثية احتمالية الهلاك هو الاحتمال الذي يعينه الباحثون لنتائج الذكاء الاصطناعي الكارثية. ما هي التقديرات، ولماذا يهم القيمة المتوقعة حتى عند الاحتمالات المنخفضة. المسؤولية والإسناد في حوكمة الذكاء الفائق من هو المسؤول عندما يسبب (آي آي) ضرراً كارثياً؟ فالمسؤولية والإسناد هما الأساس الهادئ الذي تحتاج إليه أي معاهدة بشأن التنفيذ. الصفقة الكبرى لـNPT: وما يمكن لحوكمة الذكاء الفائق تعلمه أبرمت معاهدة عدم الانتشار صفقة بين الدول التي امتلكت القنبلة وتلك التي لم تمتلكها.