Разработчикам ИИ долгое время приходилось выбирать между скоростью и интеллектом: модели работали медленно и требовали больших вычислений. OpenAI представила режим Ultrafast для GPT-5.6 Sol, который решает эту дилемму, выдавая до 750 токенов в секунду без потери качества.
Ultrafast — это новый уровень обслуживания API от OpenAI. Он ускоряет работу модели GPT-5.6 Sol до 14 раз. Модель выдаёт до 750 выходных токенов в секунду. Главное, что при этом нет компромиссов в качестве ответов. Новый режим работает на базе технологий Cerebras и сейчас доступен выборочной группе клиентов, но со временем список будет расширяться. GPT-5.6 Sol — это один из трёх вариантов семейства GPT-5.6 (наряду с Terra и Luna). Каждая из этих моделей балансирует между возможностями, скоростью и стоимостью.
Cerebras провела собственные тесты режима Ultrafast на бенчмарке Humanity's Last Exam (HLE), который состоит из 2500 вопросов уровня PhD. GPT-5.6 Sol в режиме Ultrafast ответил на все вопросы за 11 часов 11 минут. Для сравнения, Claude Fable 5 потребовалось 78 часов 27 минут для достижения тех же выводов с сопоставимой точностью — почти в 7 раз дольше. По данным Cerebras, скорость Ultrafast для GPT-5.6 Sol также в 11 раз выше, чем у Fable 5, и в 5 раз выше, чем у Opus 4.8 в режиме Fast.
Режим Ultrafast призван устранить давнюю дилемму между мощностью и скоростью моделей. Это открывает им путь в критически важные приложения, где каждая секунда на счету. Однако пока доступ к нему ограничен, а заявленные цифры скорости предоставлены Cerebras — независимых тестов еще нет.