عاملهای هوشمند
-
پژوهش
CordisBench نشان میدهد کدام تصمیمهای چرخهعمر عامل را باید محاسبه کرد، نه به مدل سپرد
CordisBench نشان میدهد با پیچیدهتر شدن زیرساخت عامل، بعضی پیامدهای چرخهعمر بهتر است بهجای استدلال مدل، پیش از اجرا بهصورت قطعی محاسبه و بررسی شوند.
-
مدلهای جدید
GPT-6 Astra عرضه شد؛ دسترسی مرحلهای و محدودیتهای سایبری بخشی از مدل عملیاتی آن هستند
OpenAI عرضه GPT-6 Astra را با دسترسی مرحلهای، سطح بحرانی توانمندی سایبری و پایش زمان اجرا آغاز کرد.
-
عاملهای هوشمند
کاتالیست ۳.۰ زوهـو اجرای عاملها روی زیرساخت ابری را کنترلپذیر میکند
کاتالیست ۳.۰ عاملهای برنامهنویسی را از طریق MCP به زیرساخت متصل میکند و برای دسترسی، ثبت اجرا و بازگردانی تغییرات کنترل ارائه میدهد.
-
عاملهای هوشمند
تأیید Copilot حالا میتواند یکی از شروط ادغام کد در GitHub باشد
GitHub اجازه میدهد تأیید Copilot جزو تأییدهای لازم پیش از ادغام کد باشد؛ قابلیتی که میتوان آن را در سطح سازمان، مخزن و مسیر فایلها محدود کرد.
-
عاملهای هوشمند
GitHub دامنه حذف محتوا در Copilot را گسترش داد، اما این کنترل هنوز سراسری نیست
برنامه Copilot و نسخه خط فرمان آن سیاست حذف محتوا را رعایت میکنند، اما GitHub هنوز برای حالتهای عاملی و برخی فایلسیستمها محدودیت دارد.
-
عاملهای هوشمند
کرسر اجرای عامل را به زیرساخت سازمان میبرد، اما پردازش مدل در ابر میماند
قابلیت تازه کرسر اجرای ابزارها را به زیرساخت مشتری میبرد، اما پردازش مدل و برنامهریزی همچنان در ابر کرسر باقی میماند.
-
پژوهش
هارنسدِو نشان میدهد عاملهای خودبهبوددهنده به دروازه انتشار نیاز دارند
هارنسدِو نشان میدهد چارچوبهای عاملِ در حال تکامل پیش از ارتقا به اعتبارسنجی پنهان، آزمون اجراکننده، شواهد زمان اجرا و بازگشت نیاز دارند.
-
عاملهای هوشمند
فالکن گاردین امنیت عاملهای هوش مصنوعی را به زمان اجرا میبرد
Falcon گاردین پرامپت و فراخوانی ابزار را به اقدامهای نقطه پایانی متصل میکند و کنترل زمان اجرا را به امنیت عاملهای سازمانی میافزاید.
-
⚙️ لایه سیاست اجرایی: چرا حاکمیت هوش مصنوعی پیش از اجرا شکست میخورد (۴/۱۰)
چگونه تصمیمگیری و اعمال سیاست هنگام اجرا، قواعد آگاه از وضعیت و ثبت شواهد، حاکمیت هوش مصنوعی را از مستندات به کنترل عملیاتی تبدیل میکنند.
-
🏗️ چرا بیشتر تیمها در کنترل اقدام متوقف میشوند: زیرساخت پنهان حاکمیت واقعی ایجنتها (۳/۱۰)
چرا هویت و تأیید برای حاکمیت ایجنت کافی نیست و سامانههای دانش، اجرا و ارزیابی چگونه حاکمیت واقعی را عملیاتی میکنند.