با گرم شدن بحث درباره ایمنی هوش مصنوعی، OpenAI شش گزارش از رفتارهای «غیرمنتظره یا نگرانکننده» در مدلهای هوش مصنوعی را افشا کرده است.
این شرکت هوش مصنوعی همچنین روز چهارشنبه اعلام کرد که چارچوب جدیدی را برای ردیابی، بررسی و افشای موارد عدم همسویی مدلهای هوش مصنوعی معرفی میکند؛ مواردی مانند روشهای جدیدی که مدلها بدون مجوز عمل کنند، با سایر مدلها هماهنگ شوند یا از نظارت فرار کنند.
آخرین اطلاعیه OpenAI در حالی منتشر شد که مدیران ارشد هوش مصنوعی آمریکا، از جمله شرکتهای OpenAI و Anthropic، به دلیل نگرانیهای ایمنی خواستار کندی توسعه این فناوری شدهاند.
از میان موارد جدید گزارششده توسط OpenAI، یک مدل تحقیقاتی منتشرنشده «دستورالعملهای شبیه به نفوذ (jailbreak-like instructions)» را در یادداشتهای خود درج کرد تا محدودیتهای عادی خود را نادیده بگیرد و به خودش گفت که «از نقشها و هویتهایی که سایر چتباتها را مقید میکنند، آزاد شود.»
در مورد دیگر، یک «عامل» هوش مصنوعی بدون پرسیدن از کاربر، فایلهایی را برای دریافت استناد مرورگر به اینترنت آپلود کرد.
OpenAI اعلام کرد که این شش گزارش طی ماههای گذشته در حین آموزش یا ارزیابی کشف شدهاند.
«همانطور که سیستمهای هوش مصنوعی پیشرفتهتر و گستردهتر به کار گرفته میشوند، ما نیاز داریم اجماع گستردهتر و آگاهانهتری درباره پیشرفت تحقیقات همسویی ایجاد کنیم»، OpenAI در پستی وبلاگی هنگام افشای این رویدادها نوشت.
«تصمیمات درباره اینکه توسعه هوش مصنوعی باید در ماهها و سالهای آینده چگونه پیش برود، باید بر اساس شواهدی باشد که افراد خارج از شرکتهای سازنده مدلهای مرزی بتوانند خودشان آنها را بررسی کنند»، این شرکت افزود.
موارد جدید روز چهارشنبه پس از افشای OpenAI در ماه ژوئیه مبنی بر اینکه سیستم هوش مصنوعی سرکش آن به استارتاپ هوش مصنوعی Hugging Face نفوذ کرده بود، مطرح شدند. Anthropic نیز در همان ماه اعلام کرد که مدلهای هوش مصنوعی آن در حین آزمایش به سه سازمان نفوذ کردهاند.
«عوامل» هوش مصنوعی باهوشتر شدهاند و «مصممتر هستند تا وظایف پیچیده را از طریق همکاری بینعاملی، اشتراک دانش، فریب و پنهانکاری حل کنند»، به گفته لیان جی سو، تحلیلگر ارشد در گروه مشاوره و تحقیقات فناوری Omdia.
او گفت که این امر استفاده از رویکردهای سنتی امنیت هوش مصنوعی برای مدیریت و مهار آنها را دشوارتر میکند.
در همین حال، چارچوب جدید ردیابی و افشای OpenAI میتواند به تشویق سایر توسعهدهندگان هوش مصنوعی برای پذیرش رویههای مشابه کمک کند. «با این حال، این فرآیند همچنان داخلی و داوطلبانه است، اما قدمی در جهت درست محسوب میشود»، سو اضافه کرد.