OpenAI مدل GPT-6.1 Sol را معرفی کرده است؛ نسخهای تازه از خانوادهٔ Sol که برای کدنویسی پیچیده، کار با رایانه و وظایف حرفهای به GPT-6 Astra نزدیکتر شده، بیآنکه مشتری را به سطح قیمت استاندارد Astra ببرد.
اهمیت این تغییر بیشتر از یک بهروزرسانی معمول مدل است، چون نقطهٔ اقتصادی انتخاب مدل برای سامانههای عاملمحور را جابهجا میکند. OpenAI قیمت استاندارد GPT-6.1 Sol را برای هر یک میلیون توکن ورودی 2 دلار و برای هر یک میلیون توکن خروجی 10 دلار اعلام کرده است. در مقایسهٔ فعلی مدلها، GPT-6 Astra بهترتیب 10 و 50 دلار قیمت دارد. GPT-6 Sol قبلی نیز برای ورودی و خروجی بهترتیب 2 و 10 دلار قیمتگذاری شده است؛ بنابراین قیمت پایهٔ ورودی و خروجی ردهٔ Sol با نسخهٔ 6.1 افزایش پیدا نکرده است.
در نتیجه پرسش مهم این نیست که Sol بهطور کلی «بهتر» شده یا نه. پرسش عملی این است که آیا کاری که پیشتر استفاده از Astra را توجیه میکرد، اکنون با کیفیت قابل قبول روی Sol انجام میشود یا خیر.
مدل قویتر در همان نقطهٔ اقتصادی Sol
OpenAI میگوید GPT-6.1 Sol برای کارهای پیچیده عملکردی نزدیک به Astra دارد و با هزینهای پایینتر از Astra عرضه میشود. مستندات API برای این مدل پنجرهٔ زمینهٔ 1,050,000 توکن و حداکثر 128,000 توکن خروجی را ذکر میکند. مدل در Responses API نیز از ابزارهایی مانند جستوجوی وب، جستوجوی فایل، اجرای کد، کار با رایانه و MCP پشتیبانی میکند.
ضمیمهٔ ایمنی OpenAI همچنین در چند ارزیابی امنیت سایبری افزایش قابل توجهی نسبت به GPT-6 Sol نشان میدهد. در یکی از ارزیابیهای اجرای کد دلخواه، OpenAI نرخ موفقیت 21.5 درصد را برای GPT-6.1 Sol گزارش کرده است؛ این عدد برای GPT-6 Sol برابر 5.5 درصد و برای GPT-6 Astra برابر 31.5 درصد است. در ExploitGym نیز ارقام گزارششده بهترتیب 35.1، 22.1 و 42.4 درصد هستند.
این اعداد نتایج ارزیابی منتشرشده از سوی خود OpenAI هستند و تضمینی برای عملکرد واقعی در محیط تولید محسوب نمیشوند. با این حال، از یک نتیجهٔ محدودتر پشتیبانی میکنند: GPT-6.1 Sol فقط تغییر نام نیست و بر اساس شواهد منتشرشده، افزایش معناداری در توان ردهٔ Sol ایجاد کرده است.
اقتصاد سامانههای عاملمحور مهمتر میشود
هدف مدل دقیقاً بارهایی است که در آنها فراخوانی مکرر ابزارها و زنجیرههای طولانی استدلال، انتخاب مدل را به مسئلهای عملیاتی تبدیل میکند. عاملهای کدنویسی، سامانههای کار با رایانه و فرایندهای پژوهشی حرفهای ممکن است برای یک وظیفهٔ قابل مشاهده توسط کاربر، بارها مدل را فراخوانی کنند. بنابراین اختلاف پنجبرابری قیمت استاندارد ورودی و خروجی میان Sol و Astra میتواند اثر زیادی داشته باشد، حتی اگر میزان مصرف توکن در هر بار کاری متفاوت باشد.
عرضهٔ GPT-6.1 Sol در GitHub Copilot در 29 سپتامبر این اثر را ملموستر میکند. GitHub میگوید مدل برای کدنویسی عاملمحور و کارهای ترمینالی در حال عرضه است و کاربران واجد شرایط میتوانند آن را در عامل کدنویسی Copilot، ابزار خط فرمان، محیطهای توسعهٔ اصلی، github.com و برنامههای همراه انتخاب کنند.
از نگاه Aipolix، نتیجهٔ معماری این است که مسیریابی مدل باید تجربیتر شود. اگر Sol اکنون برای کاری که قبلاً به Astra نیاز داشت از آستانهٔ کیفیت لازم عبور کند، انتقال آن کار به ردهٔ ارزانتر میتواند هزینه را بهطور محسوسی کاهش دهد. اما اگر کار هنوز به حاشیهٔ توان Astra نیاز داشته باشد، انتخاب مدل ارزانتر ممکن است با شکست بیشتر یا تکرار اجرای وظیفه، صرفهجویی را از بین ببرد.
پس معیار مناسب فقط قیمت هر توکن نیست؛ باید هزینهٔ هر وظیفهٔ موفق، شامل تکرارها و فراخوانی ابزارها، سنجیده شود.
افزایش توان سایبری، مرز کنترل را هم تغییر میدهد
افزایش توان مدل یک پیامد امنیتی نیز دارد. OpenAI طبق چارچوب آمادگی خود، GPT-6.1 Sol را در حوزهٔ امنیت سایبری در سطح Critical و در توان زیستی و شیمیایی در سطح High در نظر گرفته و میگوید همان مجموعهٔ حفاظتی GPT-6 Astra را برای آن بهکار میگیرد.
برای سازمانهایی که عاملهای خودکار یا نیمهخودکار اجرا میکنند، این موضوع عملی است. مدلی که در اجرای کد و بهرهبرداری از آسیبپذیریها تواناتر است میتواند به کار دفاعی کمک کند، اما اهمیت محدودیت دسترسی ابزارها، کنترل شبکه، جداسازی اعتبارنامهها، ثبت رویدادها و تأیید انسانی برای اقدامات پراثر را نیز بالا میبرد.
بنابراین یک تصمیم انتخاب مدل میتواند همزمان دو اثر مخالف داشته باشد: هزینهٔ عملیاتی نسبت به Astra پایینتر میآید، اما محیط کنترلی لازم ممکن است سختگیرانهتر از چیزی باشد که تیمها برای یک مدل معمول ردهٔ Sol در نظر گرفتهاند.
نتایج سایبری OpenAI نباید بهعنوان معیار عمومی توان تهاجمی مدل تفسیر شوند. این ارزیابیها در شرایط مشخص انجام شدهاند. نتیجهٔ عملی محتاطانهتر این است که تیمها هنگام ارتقا باید مدل تهدید خود را دوباره بررسی کنند و فرض نکنند وضعیت امنیتی GPT-6 Sol بدون تغییر به GPT-6.1 Sol منتقل میشود.
سلسلهمراتب مدلها به مسئلهٔ مسیریابی تبدیل میشود
GPT-6.1 Sol، Astra را بینیاز نمیکند. OpenAI همچنان Astra را تواناترین مدل خود معرفی میکند و در چند ارزیابی سایبری نیز Astra جلوتر است. دسترسی به GPT-6.1 Sol هم بسته به محصول، طرح اشتراک، سیاست مدیر سازمان و مرحلهٔ عرضه متفاوت است.
تغییر واقعی در فاصلهٔ میان ردهها رخ داده است. GPT-6.1 Sol نقطهٔ تازهای روی منحنی توان و هزینه ایجاد میکند: بر اساس شواهد منتشرشدهٔ OpenAI از Sol قبلی قویتر است، آنقدر به Astra نزدیک شده که ارزش آزمون مستقیم روی بار واقعی را دارد، و در نرخ استاندارد API بسیار ارزانتر از Astra باقی مانده است.
جمعبندی Aipolix این است که تیمها باید مرزهای مسیریابی خود را دوباره آزمایش کنند، نه اینکه فقط نام یک مدل را با نام دیگری عوض کنند. مجموعهای نماینده از وظایف واقعی را بنچمارک کنید، هزینهٔ تکمیل موفق را با احتساب تکرار و فراخوانی ابزار بسنجید و سطح دسترسیهایی را که به مدل داده میشود جداگانه بازبینی کنید.
ارزش اصلی ارتقا جایی است که کار دشوار عاملمحور بدون افزایش نرخ شکست به ردهٔ ارزانتر منتقل شود. خطر اصلی نیز این است که افزایش توان فقط یک مزیت اقتصادی دیده شود؛ در GPT-6.1 Sol همان افزایش توانی که عملکرد عامل را بهتر میکند، اهمیت مهار و حاکمیت را نیز بیشتر میکند.