OpenAI پیش‌نمایش حالت inference جدیدی با نام Ultrafast را آغاز کرده که برای کاربردهای حساس به latency طراحی شده است.

به گفته شرکت، GPT-5.4 Mini در این حالت می‌تواند به سرعتی تا ۱۰۰۰ توکن در ثانیه برسد؛ موضوعی که می‌تواند تجربه محصولات کدنویسی، صوتی و تعاملی را تغییر دهد.

منبع

OpenAI — Previewing Ultrafast mode