Together AI ظرفیت inference را با NVIDIA B300 روی IBM Cloud گسترش میدهد
Together AI در حال توسعه زیرساخت inference سازمانی با یک کلاستر اختصاصی NVIDIA B300 روی IBM Cloud و شبکه Spectrum-X است.
Together AI در حال توسعه زیرساخت inference سازمانی با یک کلاستر اختصاصی NVIDIA B300 روی IBM Cloud و شبکه Spectrum-X است.
Amazon Bedrock استنتاج جغرافیایی Claude Opus 5، Sonnet 5 و Haiku 4.5 را میان بمبئی و حیدرآباد فراهم کرده است.
Docker Cloud Sandboxes امکان انتقال coding agentهای طولانیمدت میان محیط محلی و microVM ابری مدیریتشده را با قیمتگذاری مصرفی فراهم میکند.
دور سری D تکِوِر با ۵۸۰ میلیون دلار، این شرکت پرتغالیریشه را ۶.۴ میلیارد دلار ارزشگذاری میکند؛ تحلیل Aipolix از مقیاس صنعتی و استقلال فناوری.
Colibrì 1.11.0 پشتیبانی مستقیم از DeepSeek V4.1 Flash را اضافه کرده و نشان میدهد خواندن مرحلهای وزنها از دیسک، محدودیت ظرفیت را به هزینه I/O و تأخیر تبدیل میکند.
پژوهش Emerald AI با شاخص PFI نشان میدهد کارهای آموزش مدل زیر محدودیت توان GPU رفتار یکسانی ندارند و زمانبندی هدفمند میتواند مفید باشد.
Red Hat AI 3.5 با EvalHub پایدار و کنترلهای تازه برای هویت و منابع عرضه شده، اما بخشی از امکانات پایش هنوز در مرحله آزمایشی است.
Arm AI Portal با اتصال MCP، مدلهای بهینهشده و راهنمای استقرار روی سختافزار Arm را مستقیماً در دسترس عاملهای کدنویسی قرار میدهد.
نسخه 0.2.0 پروژه SwarmLLM استنتاج مدل را با WebGPU و WebRTC میان چند مرورگر تقسیم میکند و محدودیت حافظه را با تأخیر شبکه و اعتماد به اعضا مبادله میکند.
پژوهشی تازه نشان میدهد وضعیت حافظه نهان میتواند حتی با دمای صفر مسیر اجرای عامل را تغییر دهد و کاهش دقت وزنها این اثر را بیشتر کند.