پرتغال رسماً به یک فراخوان بینالمللی برای کنترل سختگیرانهتر مدلهای frontier AI پیوسته است؛ فراخوانی که از آزمون اجباری پیش از استقرار، ارزیابی مستقل، گزارش مشترک رخدادهای جدی ایمنی و بررسی ایجاد نهادی بینالمللی برای تعیین استاندارد و راستیآزمایی حمایت میکند.
لوئیس مونتهنگرو، نخستوزیر پرتغال، این بیانیه را در ۲۵ سپتامبر و در حاشیهٔ مجمع عمومی سازمان ملل در نیویورک امضا کرد. دولت پرتغال این ابتکار را بر سه محور توضیح داده است: پروتکلهای شفاف ایمنی از سوی شرکتهای هوش مصنوعی؛ استانداردهای مشترک و هماهنگ میان دولتها و سازمانهای منطقهای؛ و تقویت سازوکارهای بینالمللی، از جمله بررسی ایجاد نهادی که بتواند استاندارد تعیین کند، بر اجرای آنها نظارت داشته باشد و هنگام عبور قابلیت مدلها از آستانههای مشخص، دولتها را گرد هم بیاورد.
متن مشترک از این هم صریحتر است. از شرکتهای هوش مصنوعی میخواهد پروتکلهای شفاف ایمنی داشته باشند که شامل آزمون اجباری پیش از استقرار و ارزیابی مستقل باشد و ارزیابان واجد شرایط دسترسی کافی برای سنجش ریسک دریافت کنند. از دولتها نیز خواسته شده استانداردهای مشترک را هماهنگ کنند، شفافیت دربارهٔ رخدادهای جدی ایمنی را افزایش دهند و دسترسی کشورهای مختلف به ظرفیت علمی و ارزیابی قابل اعتماد را تقویت کنند.
این یک چارچوب سیاستی است، نه قانون جدید پرتغال
این تفاوت مهم است. امضای این فراخوان بهخودیخود قانون تازهای در پرتغال، رژیم مجوزدهی جدید یا اختیار اجرایی جدیدی ایجاد نمیکند. شرکتهایی که در پرتغال فعالیت میکنند صرفاً به دلیل این امضا با تعهد حقوقی داخلی تازهای روبهرو نشدهاند.
تغییر واقعی در موضع رسمی دولت پرتغال است. دولت اکنون علناً از الگویی برای governance مدلهای frontier حمایت میکند که از بیانیههای داوطلبانهٔ ایمنی فراتر میرود. متن مورد حمایت پرتغال صریحاً از آزمون اجباری پیش از استقرار، ارزیابی مستقل و سازوکارهای بینالمللی برای راستیآزمایی پشتیبانی میکند.
بیانیههای سیاسی الزامآور نیستند، اما میتوانند بر مواضع بعدی دولت در مذاکرات اتحادیهٔ اروپا، معیارهای خرید دولتی، اولویتهای نهادهای ناظر و طراحی قوانین یا دستورالعملهای آینده اثر بگذارند.
به همین دلیل Aipolix این رویداد را یک تحول در سیاستگذاری و governance میداند، نه تغییر در قانون جاری.
تمرکز فراخوان بر مدلهای frontier است، نه همهٔ کاربردهای هوش مصنوعی
این بیانیه دربارهٔ مدلهای بسیار توانمندی است که اگر بهدرستی کنترل نشوند، میتوانند ریسکهای مهم ایمنی یا امنیتی ایجاد کنند. متن به موارد اخیر اشاره میکند که در آن سامانههای هوش مصنوعی توانمند از safeguardهای آزمایشی عبور کردهاند، آسیبپذیریها را بهرهبرداری کردهاند یا به سامانههای واقعی دسترسی غیرمجاز پیدا کردهاند.
پاسخ پیشنهادی نیز دقیقاً روی توسعه و استقرار همین سامانهها متمرکز است. شرکتها باید پروتکلهای شفاف ایمنی تعریف کنند و مدلها را پیش از استقرار تحت آزمون و ارزیابی مستقل قرار دهند. دولتها نیز باید استانداردها را هماهنگ کنند و اطلاعات مربوط به رخدادهای جدی را به اشتراک بگذارند.
این رویکرد با یک کد رفتاری عمومی برای تمام محصولات هوش مصنوعی تفاوت دارد. تمرکز آن روی نقطهای است که خودِ سطح قابلیت مدل به مسئلهای برای governance تبدیل میشود.
ارزیابی مستقل مهمترین بخش عملیاتی پیشنهاد است
بخش مهم این بیانیه فقط درخواست «آزمون بیشتر» نیست. متن خواستار ارزیابی مستقل با دسترسی کافی برای ارزیابان واجد شرایط است.
این موضوع مدل نظارت را تغییر میدهد. red teaming داخلی میتواند سامانه را آزمایش کند، اما ارزیابی مستقل یک لایهٔ جداگانهٔ اطمینان ایجاد میکند. اجرای چنین مدلی پرسشهای دشواری دارد: چه کسی ارزیاب واجد شرایط محسوب میشود؟ چه سطحی از دسترسی به مدل لازم است؟ اطلاعات حساس چگونه محافظت میشود؟ آزمونهای استاندارد چه خواهند بود؟ و اگر مدلی ارزیابی را رد کند، چه پیامدی خواهد داشت؟
بیانیه به این پرسشها پاسخ نهایی نمیدهد. با این حال، حمایت پرتغال نشان میدهد دولت با رویکردی همراه شده که در آن ادعای ایمنی توسعهدهنده بهتنهایی کافی نیست و باید امکان بررسی مستقل وجود داشته باشد.
لایهٔ بینالمللی برای بازارهای کوچکتر اهمیت ویژه دارد
فراخوان تأکید میکند که کشورهای مناطق مختلف باید به ظرفیت علمی، تخصص و ابزارهای ارزیابی قابل اعتماد دسترسی داشته باشند. این موضوع برای کشورهایی که میزبان بزرگترین توسعهدهندگان مدلهای frontier نیستند اهمیت بیشتری دارد.
پرتغال اکوسیستم هوش مصنوعی روبهرشد دارد، اما مرکز اصلی آموزش مدلهای frontier در مقیاس ایالات متحده یا چین نیست. بنابراین زیرساخت بینالمللی ارزیابی میتواند بر نحوهٔ بررسی مدلهایی که از بازارهای بزرگتر وارد میشوند اثر بگذارد.
یک چارچوب مشترک ممکن است نیاز هر کشور به ساخت کامل زیرساخت مستقل ارزیابی را کاهش دهد. در مقابل، بخشی از governance به استانداردهای بینالمللی، نهادهای مشترک و همکاری فنی فرامرزی وابسته خواهد شد.
پیشنهاد ایجاد یک نهاد بینالمللی هنوز در مرحلهٔ بررسی است. امضای پرتغال هیچ نهاد جدیدی با اختیار اجرایی ایجاد نکرده است.
سیگنال سیاستی از اثر حقوقی قویتر است
اهمیت این خبر را میتوان از دو جهت اشتباه تفسیر کرد.
گفتن اینکه پرتغال آزمون مدلهای frontier را از نظر قانونی اجباری کرده، نادرست است. چنین قانونی با این امضا ایجاد نشده است.
در مقابل، تقلیل رویداد به یک حرکت کاملاً نمادین هم دقیق نیست. متن مورد حمایت پرتغال کنترلهای مشخصی را نام میبرد: آزمون اجباری پیش از استقرار، ارزیابی مستقل، استانداردهای مشترک، گزارش رخدادهای جدی و امکان راستیآزمایی بینالمللی.
جمعبندی Aipolix این است که پرتغال اکنون در سطح نخستوزیر بهطور رسمی مشخص کرده از چه معماری کنترلی برای قدرتمندترین سامانههای هوش مصنوعی حمایت میکند. تحول مهم بعدی زمانی خواهد بود که این موضع در سیاست داخلی پرتغال، مذاکرات اتحادیهٔ اروپا، الزامات خرید دولتی، دستورالعمل نهادهای ناظر یا قوانین آینده بازتاب پیدا کند.