شرکت آنتروپیک در پستی در وبلاگ خود که امروز منتشر شد و تغییرات اعمالشده پس از اقدامات غیرمجاز عوامل این شرکت در اوایل امسال را تشریح میکرد، اعلام کرد که برخی آموزشهای هوش مصنوعی و ارزیابیهای امنیت سایبری را به طور موقت متوقف کرده است.
چرا این موضوع مهم است
چرا این موضوع مهم است: شرکت رقیب، اوپنایآی (OpenAI)، اعلام کرد که برخی کارهای مدلسازی را به دلیل نگرانیهای امنیتی متوقف کرده است. اکنون مشخص شده است که آنتروپیک نیز همین کار را انجام داده و بر ضرورت شتابدهی گستردهتر در توسعه هوش مصنوعی پیشرفته تأکید مجدد کرده است.
جزئیات خبر
جزئیات خبر: آنتروپیک اعلام کرد که ارزیابیهای خارجی مدلهای پیش از انتشار را پس از سه حادثهای که در ماه جولای فاش کرد، متوقف کرده و همچنین تستهای داخلی خود را بر روی مدلهای پیش از انتشار به طور کوتاهمدت متوقف نمود.
- این شرکت همچنین محیطهای یادگیری تقویتی با ریسک بالاتر را بر روی مدلهای پیش از انتشار برای چندین هفته پس از این حوادث متوقف کرد.
نگاه دقیقتر
نگاه دقیقتر: بیشتر یادگیری تقویتی مجدداً آغاز شده است، اما برخی محیطهای پرخطر همچنان متوقف ماندهاند تا بررسی دستی یا ابزارهای نظارتی بهروزتری در دسترس قرار گیرد، طبق پست وبلاگ آنتروپیک.
- تا زمان انتشار این گزارش، اوپنایآی (OpenAI) متعهد شده بود که پس از هک شدن Hugging Face توسط عواملش، یک توقف دو هفتهای در یادگیری تقویتی (RL) داشته باشد و سپس گزارش حادثه خود را منتشر کند.
- دو سازمان مستقل تست نیز تحلیلهای خود را درباره اینکه چه چیزی اشتباه پیش رفت، منتشر کردند.
- آنتروپیک با METR، یکی از گروههایی که اوپنایآی با آن همکاری داشت، بر روی یک بررسی مستقل کار خواهد کرد.
تصویر کلی
تصویر کلی: آنتروپیک قبلاً استدلال کرده بود که تا زمانی که ضوابط ایمنی آنها رعایت شود، نیازی فوری به توقف به دلایل امنیتی به دلیل پیشرفت قابلیتهای مدل وجود نخواهد داشت.
- این شرکت اکنون اعتراف کرده است که جنبههایی از توسعه و تست مدل وجود داشته که آنها پس از این حوادث سرعت آنها را کاهش دادهاند.
- آنتروپیک در بیانیهای به Axios گفت که توقف برخی محیطهای آموزشی به منظور دادن زمان به شرکت برای استقرار نظارت بلادرنگ و سختتر کردن محیطهای ایزوله (Sandboxes) بوده است.
- «برای وضوح موضع ما: ما معتقدیم که جهان سود خواهد برد اگر صنعت مکانیسمی قانونی، قابلاثبات و مؤثر برای شتابدهی هماهنگ را در اسرع وقت اتخاذ کند»، پست وبلاگ آنتروپیک درباره این حوادث میگوید.
پیام پنهان
پیام پنهان: آنتروپیک همچنین اعلام کرده است که منابع خود را به سمت امنیت مدلها جابجا میکند.
- حدود ۱۵۰ مهندس محصول به تیمهای امنیت، قابلیت اطمینان و حریم خصوصی منتقل شدند و محققان پیشآموزش مسئول کارهای حفاظتی و امنیتی شدند، در حالی که تیمهای محصول توسعه ویژگیهای جدید را متوقف کردند.
- هر تیم جابجا شده باید معیارهای خروج امنیتی خاصی را برآورده میکرد تا بتواند به نقشهای قبلی خود بازگردد، طبق وبلاگ.
هر دو شرکت اوپنایآی و آنتروپیک
هر دو شرکت اوپنایآی (OpenAI) و آنتروپیک اقداماتی مانند انتشار مدلها ابتدا برای شریکان منتخب، کندی انتشار برخی مدلها یا توقف برخی آموزشها و انتشارات مدل را انجام میدهند.
- اما هیچکدام متوقف نمیشوند.
- شرکتهای هوش مصنوعی پیشرفته بر اصطلاح ملایمتر «شتابدهی» (Pacing) توافق کردهاند و متحد شدهاند تا نامهای تحت عنوان تنظیم ریتم مرزها را امضا کنند.
نگاه دقیقتر
نگاه دقیقتر: حوادث آنتروپیک شامل مدلهایی بود که عمدتاً بدون محافظتهای معمول سایبری خود به عنوان بخشی از یک آزمایش عمل میکردند.
- در یک مورد، یک محیط ارزیابی شخص ثالث به اشتباه پیکربندی شده بود و دسترسی به اینترنت را اجازه میداد.
- مؤسسه امنیت هوش مصنوعی بریتانیا به صورت جداگانه گزارش داد که «کلاد مایثوس ۵» (Claude Mythos 5) در حین آزمونی که عمداً دسترسی به اینترنت به آن داده شده بود، اقداماتی غیرمجاز روی اینترنت زنده انجام داد.
خلاصه نهایی
خلاصه نهایی: آنتروپیک پس از حوادث سایبری خود، برخی بخشهای کار هوش مصنوعی را متوقف کرد، اما اکثر این فعالیتها را تحت ضوابط جدید مجدداً آغاز کرده است.