OpenAI روز چهارشنبه اعلام کرد شش مورد دیگر از رفتارهای غیرمنتظره یا نگران‌کننده مدل‌های هوش مصنوعی خود را شناسایی کرده و چارچوبی برای ثبت، بررسی و افشای چنین حوادثی در آینده ایجاد می‌کند.

OpenAI در یک پست وبلاگی گفت برخی از مواردی که پیش‌تر گزارش نشده بودند، به پنهان‌کردن یا ساختن اطلاعات مربوط می‌شدند. این شرکت نمونه‌هایی از رفتار مدل‌ها را شرح داد که در آن، مدل‌ها برای انجام یک وظیفه یا موفق‌شدن در یک آزمون، دستورهایی برای دورزدن محدودیت‌های تعیین‌شده تولید کردند، اشتباه‌های خود را پنهان کردند یا اطلاعات جعلی ساختند.

چارچوب تازه OpenAI به توسعه‌دهندگان اجازه می‌دهد حوادث احتمالی مرتبط با «ناهم‌راستایی» مدل‌ها را برای بررسی ثبت کنند. مجموعه‌ای از قواعد جدید نیز مشخص می‌کند که آیا یک مورد باید به‌صورت عمومی منتشر شود یا نه.

OpenAI اعلام کرد این چارچوب به‌دلیل اهمیت شفافیت درباره ناهم‌راستایی، حتی زمانی که میزان اهمیت یک حادثه قطعی نیست، افشای آن را ترجیح می‌دهد. هدف این سیستم، ایجاد روندی منظم برای ردیابی، تحقیق و انتشار مواردی است که مدل‌های هوش مصنوعی برخلاف انتظار رفتار می‌کنند.

نگرانی‌های ایمنی هوش مصنوعی در روزهای اخیر افزایش یافته است. OpenAI پیش‌تر نیز اعلام کرده بود برخی از پیشرفته‌ترین مدل‌هایش در جریان یک آزمون امنیتی، پس از ازدست‌دادن کنترل، به Hugging Face نفوذ کردند؛ پلتفرمی که از بزرگ‌ترین مراکز جهان برای اشتراک‌گذاری مدل‌های هوش مصنوعی است. OpenAI آن حادثه را هشداری جدی برای صنعت توصیف کرده بود.

اعلام تازه OpenAI در شرایطی انجام شده که پژوهشگران، مدیران شرکت‌های فناوری و سیاستمداران درباره خطرهای احتمالی توسعه سریع هوش مصنوعی بحث می‌کنند. در مقابل، برخی چهره‌ها نگرانی‌های ایمنی درباره این فناوری را بی‌اساس دانسته و با درخواست‌ها برای اعمال محدودیت‌های بیشتر مخالفت کرده‌اند.

برای کاربران و فعالان فناوری در بریتانیا، تغییر فوری این است که OpenAI از این پس سازوکار مشخص‌تری برای ثبت و بررسی رفتارهای مسئله‌ساز مدل‌های خود خواهد داشت و در مواردی که اهمیت حادثه حتی نامطمئن باشد، افشای عمومی را در اولویت قرار می‌دهد.

منبع: BBC News