OpenAI teste le mode Ultrafast pour l'IA en temps réel
OpenAI teste un nouveau mode d'inférence Ultrafast destiné aux applications sensibles à la latence.
GPT-5.4 Mini pourrait atteindre jusqu'à 1 000 tokens par seconde, selon l'entreprise.
Source
Publié: