کسب‌وکار

OpenAI قیمت API مدل GPT-5.6 Sol را برای سه ماه کاهش داد

OpenAI قیمت GPT-5.6 Sol را برای یک دوره تبلیغاتی سه‌ماهه کاهش داده و در نتیجه اقتصاد استفاده production از مدل پرچم‌دارش تغییر محسوسی کرده است. شرکت در ۲۱ اوت به مطلب معرفی GPT-5.6 اضافه کرد که قیمت API و credit مدل Sol بیش از ۲۰ درصد کاهش یافته است. Reuters این تغییر را مستقلاً گزارش کرد و Amazon Web Services نیز نرخ‌های جدید Bedrock را منتشر کرد و گفت این قیمت تبلیغاتی حداقل تا ۲۱ نوامبر ۲۰۲۶ برقرار خواهد بود.

در Amazon Bedrock اکنون GPT-5.6 Sol برای هر یک میلیون token ورودی ۴ دلار و برای خروجی ۲۰ دلار هزینه دارد. نرخ قبلی ۵ دلار برای ورودی و ۳۰ دلار برای خروجی بود. یعنی ورودی ۲۰ درصد و خروجی ۳۳.۳ درصد ارزان‌تر شده است. این تفاوت مهم است، زیرا بسیاری از workloadهای reasoning، coding و agent خروجی زیادی تولید می‌کنند، از plan و code گرفته تا نتیجه ساخت‌یافته و پاسخ‌های چندمرحله‌ای.

این تغییر پس از قیمت‌گذاری مجدد خانواده GPT-5.6 در ۳۰ ژوئیه انجام شده است. آن زمان Terra از ۲.۵۰ به ۲ دلار برای ورودی و از ۱۵ به ۱۲ دلار برای خروجی رسید و Luna نیز به ۰.۲۰ دلار ورودی و ۱.۲۰ دلار خروجی کاهش یافت. قیمت Sol در آن مرحله ثابت مانده بود. بنابراین تغییر ۲۱ اوت را می‌توان تکمیل یک چرخه وسیع‌تر کاهش قیمت در کل خانواده دانست.

برای مدیران مهندسی، نتیجه عملی این است که فرض‌های model routing باید دوباره بررسی شوند. تیمی که قبلاً به دلیل خروجی ۳۰ دلاری بیشتر traffic را از Sol دور می‌کرد، ممکن است با نرخ ۲۰ دلاری به break-even متفاوتی برسد. راه درست فرستادن همه workloadها به مدل پرچم‌دار نیست، بلکه اجرای دوباره evaluation بر اساس success rate، retry، latency، مصرف token و escalation انسانی است.

سیستم‌های agent به این محاسبه حساس‌ترند. یک درخواست کاربر می‌تواند planning، انتخاب ابزار، نتیجه ابزار، validation، retry و synthesis نهایی ایجاد کند. اگر چند subagent درگیر باشند، token خروجی به سرعت افزایش می‌یابد. کاهش یک‌سومی قیمت خروجی Sol بنابراین روی automation چندمرحله‌ای اثر بیشتری از یک chat ساده دارد. معیار مناسب باید هزینه هر task موفق باشد، نه هزینه هر API call.

این تخفیف تصمیم‌های معماری fallback را نیز تغییر می‌دهد. بعضی سیستم‌ها به‌طور پیش‌فرض از مدل ارزان‌تر استفاده می‌کنند و موارد سخت را به frontier model می‌فرستند. با Sol ارزان‌تر می‌توان آستانه escalation را پایین آورد یا آن را زودتر برای planning استفاده کرد. با این حال موقتی بودن تخفیف یعنی routing باید قابل تنظیم باقی بماند تا پایان promotion باعث redesign اضطراری نشود.

تیم‌های procurement و finance باید دقیقاً به همین موقتی بودن توجه کنند. OpenAI دوره را سه ماه توصیف کرده و AWS حداقل تا ۲۱ نوامبر را اعلام کرده است. هیچ‌کدام دائمی بودن نرخ را تضمین نمی‌کنند. forecastهای بعد از این تاریخ باید سناریویی با نرخ قبلی ۵ دلار ورودی و ۳۰ دلار خروجی یا فرض محافظه‌کارانه مشابه داشته باشند.

این حرکت یک سیگنال رقابتی نیز هست. Reuters کاهش قیمت را در زمینه رقابت شدیدتر با Anthropic و توسعه‌دهندگان چینی قرار داده است. رقابت frontier اکنون فقط capability نیست و قیمت، latency، context و tool use نیز اهمیت دارند. برای خریداران، این وضعیت قدرت بیشتری برای مقایسه providerها بر اساس هزینه کار تکمیل‌شده ایجاد می‌کند.

جزئیات عملیاتی دیگری نیز فراتر از قیمت پایه وجود دارد. مستندات OpenAI همچنان Sol را مدل frontier برای کار حرفه‌ای پیچیده معرفی می‌کنند و requestهای context بسیار بزرگ می‌توانند رفتار قیمت‌گذاری متفاوتی داشته باشند. بنابراین تیم‌ها باید هزینه را با distribution واقعی prompt، caching و tool usage خود محاسبه کنند.

برای product teamها، نرخ پایین‌تر می‌تواند featureهایی را که قبلاً از نظر هزینه مرزی بودند عملی کند. code review با کیفیت بالا، synthesis سند، support escalation پیچیده و background analysis عمیق‌تر می‌توانند توجیه اقتصادی بهتری پیدا کنند. اما قیمت به‌تنهایی نباید rollout را فعال کند و quality، latency، safety و failure mode همچنان باید ارزیابی شوند.

تیم governance نیز باید درگیر باشد، زیرا inference ارزان‌تر معمولاً adoption را بالا می‌برد. تعداد workflowها، کاربران یا autonomous stepهایی که به مدل دسترسی دارند ممکن است بیشتر شود و در نتیجه exposure داده و حجم اجرای ابزار افزایش یابد. policyهای access، logging، retention و approval باید همراه adoption رشد کنند.

گام عملی مناسب، benchmark کنترل‌شده با قیمت‌های جدید است. هزینه هر task موفق را میان Sol، Terra و مدل‌های رقیب اندازه بگیرید، retry و escalation را حساب کنید و workloadهای input-heavy و output-heavy را جدا کنید. در agentها تمام tokenهای subagent و orchestration را نیز وارد محاسبه کنید.

عدم قطعیت اصلی بعد از نوامبر است. OpenAI ممکن است promotion را تمدید کند، دائمی کند، ساختار دیگری جایگزین کند یا به نرخ بالاتر برگردد. تا روشن شدن آن، سازمان‌ها می‌توانند از تخفیف استفاده کنند بدون اینکه unit economics بلندمدت را به آن وابسته کنند. واقعیت فوری این است که اجرای یکی از مدل‌های frontier مهم، به‌خصوص برای کارهای پرخروجی، به شکل محسوسی ارزان‌تر شده است.

تاریخ انتشار: