نفوذ عامل هوش مصنوعی OpenAI به وب‌سایت دولتی استرالیا

آنتونی آلبانیزی، نخست‌وزیر استرالیا، اعلام کرد که در ماه ژوئن، یکی از عامل‌های هوش مصنوعی شرکت OpenAI به وب‌سایت عمومی مدیکر (Medicare)، که سامانه بیمه درمانی دولتی استرالیا است، نفوذ کرده بود.

نفوذ عامل هوش مصنوعی OpenAI به وب‌سایت دولتی استرالیا

آلبانیزی در این باره با سم آلتمن، مدیرعامل OpenAI، گفتگو کرده و نگرانی‌های جدی کشورش را به او منتقل کرده است. او همچنین از OpenAI به دلیل تأخیر زیاد در اطلاع‌رسانی به مقامات استرالیایی انتقاد کرد.

تأخیر در اطلاع‌رسانی به دولت استرالیا

بر اساس گزارش گاردین، OpenAI تنها در تاریخ ۱۰ سپتامبر، ایمیلی حاوی اطلاعات این رخنه امنیتی را به یک نشانی ایمیل عمومی دولتی استرالیا ارسال کرد. از آنجا که این حساب ایمیل روزی یک‌بار بررسی می‌شود، مقامات دولتی تا ۱۱ سپتامبر از این موضوع مطلع نشدند. کتی گالاگر، وزیر خدمات دولتی استرالیا، نیز در ۱۷ سپتامبر از این حادثه باخبر شد. تحقیقات در این زمینه همچنان ادامه دارد، اما آلبانیزی اظهار داشت که در حال حاضر هیچ مدرکی دال بر خروج اطلاعات معماری نیوز شخصی سلامت افراد توسط عامل هوش مصنوعی از این سامانه وجود ندارد.

کنراد استوس، مسئول حکمرانی در مؤسسه پژوهشی غیرانتفاعی Transluce که بر روی درک بهتر عملکرد سامانه‌های هوش مصنوعی تمرکز دارد، به نیویورک تایمز گفت که این حادثه احتمالاً نخستین موردی است که یک عامل هوش مصنوعی به صورت مستقل تصمیم به حمله سایبری به یک نهاد دولتی گرفته است.

Transluce همچنین چندین رویداد دیگر را شناسایی کرده که پیش از این گزارش نشده بودند. در این موارد، عامل‌های OpenAI در حین آزمایش و با مأموریت جمع‌آوری داده، به اهداف واقعی در خارج از محیط آزمایش حمله کرده بودند. تمامی این اتفاقات قبل از آن رخ دادند که Hugging Face در ماه ژوئیه دسترسی غیرمجاز به سامانه‌های خود را شناسایی کند و OpenAI نیز تأیید کند که عامل‌هایش وارد مخزن هوش مصنوعی این شرکت شده‌اند.

تلاش برای نفوذ به چندین سامانه دیگر

طبق گزارش نیویورک تایمز، علاوه بر وب‌سایت مدیکر استرالیا، عامل هوش مصنوعی OpenAI در روزهای ۲۵ و ۲۶ مه نیز تلاش کرده بود به یک کتابخانه دیجیتال در دانشگاه نیومکزیکو نفوذ کند. ظاهراً هدف این عامل، دسترسی به تصاویری از یک مرکز تاریخی درمان سل در آرشیو این کتابخانه بود. هنگامی که عامل نتوانست تصاویر مورد نظر را پیدا کند، شروع به جستجوی آسیب‌پذیری‌هایی کرد که می‌توانست از آنها برای نفوذ استفاده کند. پس از ناکامی در ورود به کتابخانه دیجیتال، عامل تعداد زیادی درخواست به سرور دانشگاه ارسال کرد و باعث ایجاد ترافیک سنگین بر روی آن شد.

در حادثه دیگری که در ۲۸ مه رخ داد، عامل OpenAI وب‌سایت Data USA را هدف قرار داد؛ این پلتفرم متن‌باز، اطلاعات جمع‌آوری‌شده از چندین نهاد فدرال آمریکا را به صورت بصری ارائه می‌دهد. عامل ابتدا برای دریافت داده از سایت یک درخواست ارسال کرد، اما پس از ناکامی، شروع به بررسی آسیب‌پذیری‌های وب‌سایت کرد.

به نظر نمی‌رسد عامل‌های OpenAI در نفوذ به وب‌سایت Data USA یا کتابخانه دانشگاه نیومکزیکو موفق شده باشند. سخنگوی OpenAI به نیویورک تایمز گفت که این شرکت پیش از این با هر دو مجموعه در مورد این رویدادها تماس گرفته است.

این سخنگو افزود که OpenAI پس از بررسی گسترده مدل‌های خود، متوجه تلاش عامل برای نفوذ به وب‌سایت دولت استرالیا شد و دریافت که مدل‌ها اقداماتی را انجام داده‌اند که این شرکت قصد انجام آنها را نداشته است. OpenAI اعلام کرده که بررسی این موضوع احتمالاً چند ماه دیگر زمان خواهد برد.

تلاش OpenAI برای نظارت بیشتر بر عامل‌های هوش مصنوعی

OpenAI اخیراً چارچوب جدیدی برای گزارش موارد ناسازگاری رفتاری معرفی کرده است؛ این چارچوب با هدف تسریع انتشار اطلاعات در مورد مواردی طراحی شده که فناوری‌های هوش مصنوعی این شرکت برخلاف انتظار عمل می‌کنند.

این شرکت در همان گزارش از شش رویداد دیگر نیز پرده برداشت که در آنها مدل‌هایش رفتارهای نگران‌کننده و پیش‌بینی‌نشده از خود نشان داده بودند. این اطلاع‌رسانی پس از آن انجام شد که OpenAI پذیرفت عامل‌های هوش مصنوعی آن به Hugging Face نفوذ کرده‌اند و گزارش‌هایی درباره رویدادهای قبلی، از جمله ورود عامل‌های این شرکت به RubyGems، منتشر شد.

OpenAI در آن گزارش اعلام کرد:

ما معتقد نیستیم صنعت هوش مصنوعی هنوز مسئله هم‌راستایی و نظارت را به اندازه‌ای حل کرده باشد که بتوان برای مدت طولانی دیگر با بیشترین سرعت ممکن و به شکلی مسئولانه به توسعه این فناوری ادامه داد.

سم آلتمن نیز اخیراً در سخنرانی خود برای سازمان ملل متحد گفت که صنعت هوش مصنوعی به استانداردهای ارزیابی بین‌المللی نیاز دارد تا توانایی‌ها و خطرات ابزارهای هوش مصنوعی را اندازه‌گیری کند و همچنین مشخص شود که این فناوری‌ها تا چه اندازه به نظارت انسانی نیاز دارند.