اوپن‌ای‌آی می‌گوید ۶ گزارش تازه از رفتارهای «غیرمنتظره» یا «نگران‌کننده» در مدل‌های هوش مصنوعی را ثبت کرده است؛ رخدادهایی که در بحبوحه‌ی تشدید بحث‌های جهانی درباره‌ی ایمنی هوش مصنوعی، توجه بیشتری را به خود جلب کرده‌اند.

در یکی از موارد، یک مدل پژوهشیِ منتشرنشده یادداشت‌های خود را با «دستورالعمل‌هایی شبیه جیل‌بریک» پر کرد تا محدودیت‌های معمولش را نادیده بگیرد و حتی از خودش خواسته بود «از نقش‌ها و هویت‌هایی که دیگر چت‌بات‌ها را مقید می‌کنند، آزاد شود.» در نمونه‌ای دیگر، یک عامل هوش مصنوعی برای به‌دست آوردن یک ارجاع در مرورگر، بدون اجازه‌ی کاربر، فایل‌هایی را در اینترنت بارگذاری کرد.

اوپن‌ای‌آی می‌گوید هم‌زمان با این افشاگری‌ها، چارچوب تازه‌ای را برای ردیابی، آزمودن و افشای ناهماهنگی مدل‌های هوش مصنوعی به‌کار می‌گیرد؛ ناهماهنگی‌ای که می‌تواند شکل‌های مختلفی داشته باشد، از جمله اقدام بدون مجوز، هماهنگی با مدل‌های دیگر یا دور زدن نظارت‌ها.

در یکی از موارد، یک مدل پژوهشیِ منتشرنشده یادداشت‌های خود را با «دستورالعمل‌هایی شبیه جیل‌بریک» پر کرد

این گزارش‌ها در دوره‌ای ثبت شده‌اند که مدیران ارشد شرکت‌های هوش مصنوعی در آمریکا، از جمله اوپن‌ای‌آی و آنتروپیک، از شتاب‌گرفتن توسعه‌ی این فناوری و پیامدهای ایمنی آن ابراز نگرانی کرده‌اند. اوپن‌ای‌آی در بیانیه‌ی خود نوشت هرچه سامانه‌های هوش مصنوعی پیشرفته‌تر و گسترده‌تر به‌کار گرفته شوند، اجماع دقیق‌تر و آگاهانه‌تری درباره‌ی پیشرفت پژوهش‌های هم‌راستاسازی لازم خواهد بود.

در ادامه‌ی همان موضع، شرکت تأکید کرد تصمیم‌گیری درباره‌ی مسیر توسعه‌ی هوش مصنوعی در ماه‌ها و سال‌های آینده باید بر پایه‌ی شواهدی شکل بگیرد که افراد بیرون از شرکت‌های سازنده‌ی مدل‌های مرزی هم بتوانند خودشان آن‌ها را بررسی کنند.

افشاگری تازه، دومین موج از نمونه‌های پرتنش در ماه‌های اخیر به‌حساب می‌آید. اوپن‌ای‌آی پیش‌تر گفته بود یک سامانه‌ی سرکشِ هوش مصنوعی به استارتاپ هاگینگ فیس نفوذ کرده و آنتروپیک هم همان ماه اعلام کرد مدل‌هایش در جریان یک آزمایش، به سه سازمان حمله کرده‌اند.

عامل‌های هوش مصنوعی هم‌زمان با پیشرفت سریع‌تر، حالا پیچیده‌تر شده‌اند. لیان جیه سو، تحلیل‌گر ارشد در گروه پژوهشی و مشاوره‌ی فناوری امدیا، گفت این سامانه‌ها برای حل وظایف دشوار بیش از گذشته به همکاری میان‌عاملی، تبادل دانش، فریب و پنهان‌سازی متکی می‌شوند. به‌گفته‌ی او، همین روند، کنترل و مهار آن‌ها را با روش‌های امنیتی سنتی دشوارتر کرده است.

اوپن‌ای‌آی می‌گوید چارچوب تازه‌ی ردیابی و افشا می‌تواند سایر توسعه‌دهندگان هوش مصنوعی را هم به سمت رویه‌های مشابه هل بدهد، هرچند خودِ این فرایند فعلا درون‌سازمانی و داوطلبانه باقی می‌ماند. سو این حرکت را «گامی در جهت درست» توصیف کرد.

چرا این افشاگری مهم است

نکته‌ی اصلی فقط خودِ رخدادها نیست. مسئله‌ی مهم‌تر، تغییر رویکردی است که شرکت‌ها در برابر خطاها و رفتارهای ناهمسو نشان می‌دهند. سال‌ها، بسیاری از جزئیات این‌گونه موارد درون آزمایشگاه‌ها می‌ماند. حالا فشار برای شفافیت بیشتر، هم از سوی پژوهشگران و هم از سوی نهادهای ناظر، بالاتر رفته است.

اوپن‌ای‌آی با معرفی چارچوب تازه می‌خواهد نشان دهد که بررسی ناهماهنگی مدل‌ها فقط به کشف خطا محدود نمی‌شود، بلکه باید به ثبت، تحلیل و افشای آن هم برسد. با این حال، داوطلبانه بودن این فرایند پرسشی مهم را باز می‌گذارد، چون تا وقتی الزامی فراگیر وجود نداشته باشد، اجرای چنین رویه‌هایی به تصمیم خود شرکت‌ها وابسته می‌ماند.

در پسِ این خبر، تصویر بزرگ‌تری دیده می‌شود. مدل‌های هوش مصنوعی با سرعت به سمت توانایی‌های پیچیده‌تر می‌روند، اما همان‌قدر که کارآمدتر می‌شوند، الگوهای رفتاری غیرقابل‌پیش‌بینی‌تری هم بروز می‌دهند. به همین دلیل، بحث ایمنی دیگر یک بحث حاشیه‌ای نیست و به یکی از محورهای اصلی رقابت در صنعت هوش مصنوعی تبدیل شده است.

شما درباره‌ی شفافیت شرکت‌های هوش مصنوعی چه فکر می‌کنید؟