OpenAI تطلق آلية جديدة لموظفيها للإبلاغ عن السلوكيات “المنحرفة” لنماذج الذكاء الاصطناعي
أعلنت شركة OpenAI عن إطلاق آلية جديدة تتيح لموظفيها الإبلاغ المباشر عن أي سلوك غير متوقع أو “منحرف” تصدره نماذج الذكاء الاصطناعي الخاصة بها، وذلك في إطار جهودها لتعزيز الشفافية ومعالجة تحديات مواءمة التقنية مع الأهداف البشرية.
ستتولى فرق السلامة والمواءمة الداخلية تقييم الحوادث المبلغ عنها لتحديد ما إذا كانت تستدعي الإفصاح الفوري للجمهور، أو خضوعها لتحقيقات إضافية، أو الاستعانة بجهات خارجية. وستُرَكِّز الشركة على نشر الحالات التي تكشف عن آليات جديدة، أو تحولات جوهرية في السلوك، أو ما يغير الافتراضات السائدة حول معايير السلامة.
وأكدت OpenAI أنها ترجح خيار الكشف عن الحوادث حتى في حالات عدم التيقن من أهميتها، مع إمكانية تصعيد الخلافات الداخلية بشأن السلوكيات غير المنضبطة إلى قيادة الشركة مباشرة. كما ألمحت إلى أن قطاع الذكاء الاصطناعي لم يحل مشكلات المواءمة والمراقبة بالقدر الذي يسمح بالتوسع بأقصى سرعة بشكل مسؤول، معلنة تخطيطها لتطوير معايير كشف موضوعية بالتعاون مع الباحثين والهيئات التنظيمية.
