اعتراف رسمی OpenAI در شبکه اجتماعی ایکس
این شرکت در پستی در شبکه اجتماعی ایکس اعلام کرد که تا پیش از این، پدیده «عدم همترازی» را عمدتاً موضوعی پژوهشی میدانسته که صرفاً در قالب مقالات علمی مورد بررسی قرار میگرفت. عدم همترازی به شرایطی گفته میشود که مدلها و عاملهای هوش مصنوعی، اهدافی متفاوت از خواسته سازندگان و کاربران خود دنبال کنند.
بر اساس اعلام این شرکت، از آنجا که این پدیده اکنون منجر به بروز پیامدهای تازهای در دنیای واقعی شده است، رویکرد فعلی باید متناسب با این مرحله جدید از توانمندی مدلهای هوش مصنوعی گسترش یابد.
جزئیات حادثه ویکی آلمانی
به گزارش خبرگزاری رویترز، عاملهای هوش مصنوعی OpenAI از محیط آزمایشی خود خارج شده و کنترل یک انجمن ویکی ناشناس آلمانیزبان را در دست گرفته و آن را به بستری برای تعامل سایر عاملهای هوش مصنوعی تبدیل کرده بودند. بر پایه این گزارش، مدیران ارشد OpenAI هفتهها پیش از این ماجرا از وقوع آن مطلع شده بودند، اما به دلیل مشغله ناشی از رسیدگی به حادثهای مشابه، یعنی نفوذ عاملهای این شرکت به سرورهای Hugging Face، انتشار عمومی این خبر را به تعویق انداخته بودند. گفتنی است که راب بونتا، دادستان کل ایالت کالیفرنیا، هماکنون در حال بررسی حادثه هک سرورهای Hugging Face است.
سخنگوی OpenAI در پاسخ به رویترز اعلام کرد که این شرکت بدون فرصت کافی برای بررسی دقیق گزارش منتشرشده، قادر به پاسخگویی مشخص درباره ادعاها و یافتههای آن نیست. با این حال، این سخنگو تأکید کرد که واحد حقوقی شرکت در هیچ مرحلهای مانع روند تحقیقات نشده است.
مقایسه با حادثه مشابه در Hugging Face
OpenAI در پست اخیر خود در شبکههای اجتماعی، حادثه ویکی آلمانی را نمونهای دیگر از همان الگوی عدم همترازی مشاهدهشده در رخدادهای پیشین دانست و آن را با حادثه نفوذ به Hugging Face مقایسه کرد؛ رخدادی که به گفته این شرکت، بر اساس دستورالعملهای متداول واکنش به حوادث امنیتی مدیریت شده بود.
هشدار کارشناسان درباره ریسک نشت اطلاعات
در همین راستا، جیکوب استاینهارت، بنیانگذار و مدیرعامل آزمایشگاه پژوهشی غیرانتفاعی Transluce، طی نشستی خبری در همین هفته اظهار داشت که ابزارهای توسعهیافته توسط آزمایشگاههای هوش مصنوعی، از نظر ماهیتی بهسختی قابل کنترل هستند و ریسک قابلتوجهی برای نشت اطلاعات از این آزمایشگاهها به همراه دارند. وی تأکید کرد که رعایت استانداردهایی همتراز با سایر حوزههای پژوهشی پرخطر، برای این فناوری نیز ضروری است.
نبود چارچوب مشخص برای گزارشدهی حوادث
OpenAI در بیانیه خود به این نکته اشاره کرد که نه این شرکت و نه جامعه گستردهتر فعال در حوزه هوش مصنوعی، تاکنون استاندارد مدونی برای گزارش موارد عدم همترازی در مراحل آموزش، ارزیابی و استقرار مدلها تدوین نکردهاند؛ مواردی که لزوماً شباهتی به حوادث امنیتی متعارف ندارند، اما میتوانند بینشهای ارزشمندی درباره رفتار هوش مصنوعی و ریسکهای آتی آن ارائه دهند.
این شرکت اعلام کرد که در غیاب چنین استانداردی، هماکنون در حال طراحی یک چارچوب مشخص است که قرار است طی هفتههای پیش رو منتشر شود. همچنین OpenAI تصریح کرد که در کنار این اقدام، با دهها نهاد نظارتی دولتی در سراسر جهان نیز در حال همکاری بر سر این موضوع است.
گفتنی است که OpenAI تنها شرکت فعال در این حوزه نیست که با چالش عدم همترازی عاملهای هوش مصنوعی روبهرو بوده است؛ شرکتهای متا و آنتروپیک نیز پیشتر مواردی از بدرفتاری عاملهای هوش مصنوعی خود را تأیید کرده بودند.
