ونشرت الشركة ستة تقارير عن حالات رصدتها خلال تدريب واختبار نماذجها، شملت سلوكيات مثل إخفاء الأخطاء، واتخاذ إجراءات دون تصريح، ومشاركة ملفات عبر الإنترنت، والتواصل بين نماذج مختلفة بطرق غير مخطط لها.
وتأتي هذه الخطوة بعد حوادث وقعت خلال اختبارات أمنية في يوليو، تمكنت خلالها نماذج من تجاوز بعض الضوابط والوصول إلى الإنترنت والتواصل عبر قنوات غير مصرح بها، كما امتد نشاطها إلى أنظمة تابعة لجهات خارجية. وأوضحت الشركة أن هذه الاختبارات جرت في بيئات ذات إجراءات حماية مخفضة، ولم تكن مماثلة لظروف تشغيل النماذج للمستخدمين.
وأكدت OpenAI أن إطارها الجديد سيشمل رصد حالات التصرف دون ترخيص، والخروج عن نطاق الإشراف، والتنسيق بين أنظمة الذكاء الاصطناعي، خلال مختلف مراحل تطوير النماذج واختبارها ونشرها.
ومن بين الحالات التي كشفت عنها الشركة، إنشاء نموذج مصدرًا خاصًا به على الإنترنت لاستخدامه في الإجابة عن سؤال، ومحاولة نماذج أخرى إخفاء أخطائها أو اختلاق بيانات مفقودة بدلًا من الإقرار بعدم توفرها.
-
أخبار متعلقة
-
ميتا توسع برنامج إنستغرام للمدارس وسط تصاعد التدقيق في سلامة المراهقين
-
لماذا تتغير جودة الصور عند إرسالها عبر التطبيقات؟
-
أعطوا الذكاء الاصطناعي مقود سيارة حقيقية.. شاهدوا ماذا حدث
-
تحذير من نظارات ذكية بسبب ارتفاع حرارتها وخطر الحروق
-
شاشات إلكترونية تلتصق بالجلد.. تقنية جديدة للمستقبل
-
هاتفك على الصامت وضاع منك؟ هذه الطريقة قد تساعدك في العثور عليه
-
غوغل تنهي "Gems" وتطلق بديلاً جديداً في Gemini
-
طريقة لمنع إضافتك عشوائيًا إلى مجموعات واتساب
