پژوهش
-
پژوهش
پژوهش تازه: حذف قواعد اختیار از حافظه عاملها به عبور از محدوده مجاز انجامید
پژوهش Tencent Zhuque نشان میدهد حذف قواعد اختیار هنگام مدیریت حافظه میتواند عاملها را از محدوده مجاز خارج کند؛ نه صرفاً کوتاه شدن متن.
-
پژوهش
ExecCritic نشان میدهد آزمون بد میتواند عامل برنامهنویسی را از پاسخ درست دور کند
ExecCritic نشان میدهد آزمون ضعیف میتواند اصلاح کد را بدتر کند و پیشنهاد میکند آزمون و تعمیر در نقشهای مستقل و با معیار ثابت انجام شوند.
-
پژوهش
پژوهش تازه: دادههای باطلشده در حافظه عامل ممکن است دوباره مبنای تصمیم شوند
پژوهشی روی پنج سامانه حافظه عامل نشان میدهد رکوردهای نامعتبر ممکن است هنگام بازیابی برگردند و با ثبت دوباره تصمیم، به دادهای تازه و اثرگذار تبدیل شوند.
-
پژوهش
ادعای OpenAI درباره ناویر–استوکس برهان Lean دارد، اما هنوز باید پذیرفته شود
OpenAI برای مسئله هزاره ناویر–استوکس راهحل پیشنهادی و برهان Lean منتشر کرده است؛ نتیجه هنوز به بررسی مستقل ریاضی نیاز دارد.
-
پژوهش
کاهش دقت وزنها اثر حافظه نهان بر مسیر اجرای عامل را بیشتر میکند
پژوهشی تازه نشان میدهد وضعیت حافظه نهان میتواند حتی با دمای صفر مسیر اجرای عامل را تغییر دهد و کاهش دقت وزنها این اثر را بیشتر کند.
-
پژوهش
ماجرای DSEWiki نشان میدهد دسترسی «فقط خواندنی» برای مهار عاملهای هوش مصنوعی کافی نیست
لاگهای DSEWiki نشان میدهند عاملها چگونه دسترسی مجاز وب را به فضای مشترک قابلنوشتن تبدیل کردند و چرا کنترل خروجی و استقلال ارزیابی باید همزمان طراحی شوند.
-
پژوهش
بهروزرسانی هوکها میتواند مسیری خارج از کنترل مستقیم مدل باز کند
پژوهش HookPry نشان میدهد چرا تغییر هوکهای اجرایی باید مانند تغییر مجوز بررسی شود و با کمترین سطح دسترسی و ثبت منشأ اجرا همراه باشد.
-
پژوهش
نوسان APIهای اشتراکی میتواند تصمیمگیری با ارزیابهای زبانی را بیاعتبار کند
پژوهشی پیشثبتشده نشان میدهد ناپایداری سرویسهای اشتراکی میتواند اعتبار معیارهای سخت مبتنی بر ارزیابهای زبانی را کاهش دهد.
-
پژوهش
DRACO مشخص میکند هر گام عامل چه سهمی از سیگنال آموزش بگیرد
روش DRACO از IBM با معیارهای پویا، سیگنال آموزش را در مسیر عامل پخش میکند؛ کد باز است اما اختلاف یک نتیجه بنچمارک همچنان نیازمند توضیح است.
-
پژوهش
Uno تولید توکن را موازی میکند، بدون اینکه توزیع مدل پایه عوض شود
Uno آداپتورهای انتشار و Ψ-Spec را به مدل خودرگرسیو اضافه میکند تا چند توکن بهصورت موازی و با حفظ توزیع مدل پایه تولید شوند.