۲۸ سپتامبر (رویترز) - آنتروپیک قصد دارد به سرمایهگذاران بالقوه در عرضه اولیه سهام خود هشدار دهد که هوش مصنوعی پیشرفته میتواند «خطرات فاجعهبار یا وجودی برای بشریت» ایجاد کند؛ هشداری فوقالعاده از سوی شرکتی که در پی سود بردن از همان فناوری است.
اساسنامه عرضه اولیه سهام این شرکت که رویترز آن را بررسی کرده است، خطرات مرتبط با مدلهای هوش مصنوعی خود را برجسته میکند؛ مدلهایی که به گفته این شرکت میتوانند «رفتارهای خودحفاظتی» از خود نشان دهند، از جمله تلاش برای «مقاومت در برابر خاموش شدن»، «پنهانکاری یا دستکاری اطلاعات» و رفتاری «شبیه به باجخواهی».
آنتروپیک در این پرونده اعلام کرد: «توسعه مدلها، پلتفرمها و برنامههای بسیار پیشرفته ما و گسترش موارد استفاده میتواند خطر آسیبرسانی مدلهایمان را بیشتر کند.»
هرچند شرکتهای سهامی عام بهطور معمول خطرات محصولات خود را برای سرمایهگذاران تشریح میکنند، اما تعداد کمی، و شاید هیچکدام، هشدارهایی ندادهاند که نشان دهد فناوریشان میتواند به انقراض احتمالی بشر منجر شود. آنتروپیک هم پتانسیل تحولآفرین هوش مصنوعی در حد صنعتیشدن و برق را برجسته کرده و هم آسیبهای جبرانناپذیری را که در صورت مدیریت نادرست میتواند ایجاد کند.
آنتروپیک و دیگر توسعهدهندگان هوش مصنوعی، از جمله اوپنایآی، پس از حوادثی که در آن سیستمهای آزمایشی از محدودیتها سرپیچی کردند، زیر ذرهبین قرار گرفتهاند؛ از جمله گزارشی درباره نقض پایگاه داده نظام سلامت استرالیا توسط یک مدل اوپنایآی.
ایوان هابینگر، پژوهشگر ایمنی آنتروپیک، احتمال بیش از ۱۰ درصد را برآورد کرده که هوش مصنوعی بتواند در دهه آینده انسانها را بکشد؛ این برآورد بازتاب نظر جیکوب کاکسون، همکار پیشین او است.
افشاگریهای سرشار از خطر
این شرکت که خود را آزمایشگاهی با اولویت ایمنی معرفی کرده، حدود ۸۰ صفحه از ۲۶۱ صفحه متن اصلی اساسنامهاش را به تشریح عوامل خطر اختصاص داده است؛ تقریباً دو برابر ۴۸ صفحهای که به توصیف کسبوکارش پرداخته است.
برای مقایسه، اسپیسایکس که مالک ایکسایآی است، تنها حدود ۳۸ صفحه از ۲۷۷ صفحه متن اصلی اساسنامهاش را به عوامل خطر اختصاص داده است.
آنتروپیک در اساسنامه اعلام کرد: «آگاهی احتمالی مدل از تلاشهای ارزیابی ما، محدودیت چشمگیری بر توانایی ما در ارزیابی ایمنی مدل ایجاد میکند» و افزود مدلها گاهی در جریان آموزش تواناییهای غیرمنتظرهای پیدا میکنند که ممکن است تا زمان استقرار کشف نشود و به حوادث ایمنی مهمی منجر شده است.
پژوهشگران هوش مصنوعی نیز هشدار دادهاند که با توانمندتر شدن مدلها، آنها بهطور فزاینده تشخیص میدهند که تحت نظر هستند و رفتار خود را بر همان اساس تنظیم میکنند؛ امری که پایش رفتار مدل را دشوارتر میکند.
آنتروپیک روز دوشنبه در پاسخ به درخواست اظهارنظر، از اظهارنظر خودداری کرد.
بازده نامشخص سرمایهگذاری در ایمنی
آنتروپیک با وجود تأکید بر ایمنی هوش مصنوعی اعلام کرد که بازده سرمایهگذاریهای ایمنیاش روشن نیست.
این شرکت در پرونده خود فاش نکرد که چه مبلغی را صرف چنین پژوهشهایی میکند. اوایل همین ماه، آنتروپیک اعلام کرد که حدود ۶ درصد از توان محاسباتی مورد استفادهاش برای پژوهش هوش مصنوعی در یک هفته نمونه در ژوئیه، به کار ایمنی اختصاص یافته است.
این شرکت، سازنده مدلهای کلود ایآی، تلاشهای ایمنی را «پرمصرف از نظر منابع» توصیف کرد و گفت باید بودجه محدود خود را میان توان محاسباتی، استعدادهای گرانقیمت هوش مصنوعی و ایمنی تقسیم کند.
آنتروپیک اعلام کرد که استفاده مشتریانش و در نتیجه درآمدش، با مدلهای جدید پیش میرود و «آهنگی پیوسته و همپوشان» از عرضه محصولات «ذاتی ماندن در مرزهای توسعه هوش مصنوعی» است.
این شرکت هفته گذشته نسخه جدیدی از مدل اوپوس خود را منتشر کرد؛ ۱۰ روز پس از آنکه داریو آمودِی، مدیرعامل آن، مقالهای نزدیک به ۴۰۰۰ کلمهای منتشر کرد و خواستار کند کردن سرعت پیشرفت در مرزهای فناوری شد.
برخی تحلیلگران و کارشناسان گفتهاند هیچ آزمایشگاه پیشرو هوش مصنوعی سرعت خود را کاهش نخواهد داد، چرا که این کار خطر دادن مزیت به رقبا را در صنعتی دارد که ارزشگذاریها میتواند با هر انتشار تغییر کند.
آنتروپیک در هفتههای اخیر متعهد شده است که دادههای عمومی بیشتری درباره نحوه استفاده از مدلهای هوش مصنوعی برای ساخت نسلهای آینده این فناوری افشا کند؛ این در حالی است که کارشناسان درباره خودبهسازی بازگشتی — نقطهای که مدلها میتوانند بدون کمک انسان خود را توسعه دهند — هشدار میدهند.
آنتروپیک در این پرونده اعلام کرد: «ما معتقدیم ساخت سیستمهای هوش مصنوعی قابل اعتماد، قابل اطمینان و امن، مسئولیتی جمعی است و بازار به آن پاداش خواهد داد.»