حکمرانی هوش مصنوعی
-
سیاست و تنظیمگری
حکم دادگاه اختیار پنتاگون برای تحریم گستردهٔ Anthropic را محدود کرد
قاضی فدرال ایالات متحده برچسب ریسک امنیت ملی پنتاگون علیه Anthropic را لغو کرد؛ دولت میتواند فروشنده عوض کند، اما استفادهٔ تنبیهی از ابزارهای امنیتی بدون روند و شواهد کافی محدود شد.
-
پژوهش
Gemini Co-Scientist حلقهٔ فرضیه تا آزمایش و ادعاهای راستیآزماییشده را میبندد
Google DeepMind چارچوب Co-Scientist را از تولید فرضیه به پژوهش مبتنی بر اجرا گسترش میدهد: برنامهریزی آزمایش، اجرای کد، تعامل با آزمایشگاه و راستیآزمایی ادعاها، با دخالت متغیر انسان.
-
پژوهش
پنلهای ساختگی میتوانند عوامل LLM را به اقدام روی نتایج غیرقابلدانستن وادارند
یک مطالعهٔ قابلبازتولید در arXiv مییابد که پنلهای بهظاهر معتبر ساختگی میتوانند برخی عوامل LLM را به اقدام روی نتایج غیرقابلدانستن سوق دهند، حتی وقتی عدمقطعیت را میشناسند.
-
حکمرانی هوش مصنوعی
FSB شوکهای سایبری مدلهای پیشرو را روی دستورکار تابآوری مالی گذاشت
FSB هشدار میدهد مدلهای پیشرو میتوانند ریسک سایبری و اختلال ارائهدهندگان مشترک را شتاب دهند و بانکها را وامیدارند حکمرانی هوش مصنوعی را به بازیابی و تابآوری شخص ثالث پیوند بزنند.
-
عاملهای هوشمند
Broadcom مجوز عامل AI را به یک صفحهٔ کنترل خارجی منتقل می کند
AgentMinder مجوز عامل AI سازمانی را به خارج از زمان اجرا منتقل می کند و هویت، منشأ ماموریت و زمینه سیاست را بخشی از مرز امنیتی می کند.
-
پژوهش
عوامل هوش مصنوعی در حال تکامل می توانند تجربه مسموم را به مهارت های پایدار تبدیل کنند
تحقیقات جدید نشان میدهد که عوامل خود تکاملیافته میتوانند تعاملات مسموم را بهعنوان مهارتهای قابل استفاده مجدد ذخیره کنند و منشأ مهارت، اعتبارسنجی و بازگشت را به بخشی از مرز امنیتی تبدیل کنند.
-
متنباز
User Scanner به عوامل هوش مصنوعی OSINT بازگشتی میدهد و باعث میشود تا کنترل دامنه مشکل حاکمیت واقعی را ایجاد کند.
User Scanner v1.5.1 MCP را به اسکن متقاطع OSINT بازگشتی اضافه می کند. Aipolix بررسی میکند که چرا مجوزهای عامل نیاز به تبار بررسی دامنه دارند.
-
حکمرانی هوش مصنوعی
postmortem جدید OpenAI شکستهای کنترل agent در رخداد Hugging Face را آشکار میکند
گزارش ۲۶ اوت OpenAI نشانههای هشدار، تأخیر در detection، هماهنگی agentها و کنترلهای containment تازه پس از breach Hugging Face را تشریح میکند.
-
🧭 پنج لایه حاکمیت ایجنتها؛ چرا بیشتر تیمها هنوز فقط دو لایه دارند (۲/۱۰)
مدلی عملی با پنج لایه هویت، اقدام، خروجی، تغییر و نتیجه برای حاکمیت ایجنتهای هوش مصنوعی در مهندسی نرمافزار.
-
فکر میکنید حاکمیت هوش مصنوعی دارید؟ ندارید.
چرا کنترل دسترسی و تأیید انسانی برای مهندسی مبتنی بر هوش مصنوعی کافی نیست و حاکمیت واقعی ایجنتها در سراسر فرایند تحویل نرمافزار چه نیازهایی دارد.