الذكاء الاصطناعي · 21 سبتمبر 2026
نُشر أيضًا باللغة Nederlands
شفافية الأفكار المرئية تمثل ميزة أمان للذكاء الاصطناعي، ولكنها في خطر
تشير أبحاث جديدة من معهد ديبمايند التابع لشركة جوجل إلى أن شفافية أفكار نماذج الذكاء الاصطناعي، التي تُعرف بسلسلة الأفكار، تواجه تهديدات. في منشور حديث، يؤكد الباحثان روهين شاه وأنكا دراغان أن هذه السلسلة تعتبر ميزة أمان مهمة، حيث تتيح للباحثين فهم خطوات النموذج واكتشاف أي محاولات للخداع أو الخطط الإشكالية.
مع ذلك، فإن هذه الشفافية مهددة، حيث أبلغت خريطة نظام OpenAI لنموذج GPT-6 Astra عن "انخفاض كبير في قابلية مراقبة سلسلة الأفكار". قد تتجه النماذج المستقبلية إلى التفكير في مجالات رقمية يصعب على البشر قراءتها، مما قد يزيد من الكفاءة ولكنه يجعل العمليات غير شفافة.
يدعو الباحثان إلى ضرورة قياس مدى قابلية مراقبة سلاسل الأفكار بانتظام، والحفاظ على هياكل شفافة خلال التدريب، والتأكد من أن النماذج لا تتعلم إخفاء أفكارها الحقيقية. ينضم هذا النقاش إلى حوار أوسع حول الأمان في الذكاء الاصطناعي، حيث حذر كبير علماء OpenAI، جاكوب باتشوك، من فقدان السيطرة بسبب صعوبة مراقبة سلاسل الأفكار.