OpenAI پیشنمایش حالت inference جدیدی با نام Ultrafast را آغاز کرده که برای کاربردهای حساس به latency طراحی شده است.
به گفته شرکت، GPT-5.4 Mini در این حالت میتواند به سرعتی تا ۱۰۰۰ توکن در ثانیه برسد؛ موضوعی که میتواند تجربه محصولات کدنویسی، صوتی و تعاملی را تغییر دهد.