قابلیتهای جدید و نوآوریهای فنی
-
متنباز
FreeToken مدلهای عظیم MoE را روی GPUهای مصرفی اجرا میکند
FreeToken با اجرای تطبیقی CPU-GPU و caching معنایی، مدلهای MoE از 35B تا 753B را روی سختافزار مصرفی و workstation سرو میکند.
-
مدلهای جدید
Qwen3.8-Max رقابت مدلهای متنباز برای کدنویسی را جدیتر میکند
تیم Qwen میگوید Qwen3.8-Max سطح تازهای برای کدنویسی و کار مشترک ایجاد کرده و برای نخستین بار وزنهای یک مدل Qwen-Max را باز میکند.
-
زیرساخت و تراشه
NVIDIA شتابدهنده Groq 3 LPX را برای inference سریعتر agentها وارد تولید کرد
NVIDIA شتابدهنده Groq 3 LPX را در پلتفرم Vera Rubin وارد تولید کرده تا decode latency در workloadهای agent پرمصرف از نظر token را هدف بگیرد.
-
پژوهش
Inherent عامل 27B Faraday را برای بازتولید پژوهش آموزش میدهد
Faraday از Inherent با Replica و coding agentها نتایج علمی را بازتولید میکند، اما caveatهای benchmark مقایسه مستقیم مدلها را محدود میکند.
-
زیرساخت و تراشه
Waymo تراشه ۵ نانومتری سفارشی پشت پشته محاسباتی رباتاکسی خود را معرفی کرد
Waymo یک ASIC سفارشی ۵ نانومتری برای پردازش حسگرهای رباتاکسی معرفی کرده و معماری edge AI ترکیبی خود را آشکار کرده است.
-
مدلهای جدید
Ant Ling شش checkpoint از Ling 3.0 را برای آموزش LLM سفارشی باز کرد
Ant Ling شش checkpoint پایه Ling 3.0 را در دو اندازه و سه مرحله آموزشی برای ادامه pretraining و ساخت LLMهای تخصصی منتشر کرده است.