
OpenAI представляет предварительную версию нового способа запуска своей самой мощной модели GPT-5.6 на значительно более высоких скоростях. Компания заявляет, что ее новый тарифный план Ultrafast позволяет запустить GPT-5.6 Sol в 14 раз быстрее по сравнению со стандартной обработкой.
Режим Ultrafast сначала задействуется через API OpenAI и работает на базе оборудования Cerebras. Он способен генерировать до 750 токенов вывода в секунду, потенциально выводя производительность передового уровня в рабочие процессы, где задержка имеет такое же значение, как и интеллектуальные возможности модели.
Компания OpenAI представила GPT-5.6 Sol в июне наряду со сбалансированной моделью Terra и ориентированной на скорость Luna. Полное семейство стало широко доступно в июле, в том числе через ChatGPT, Codex и API.
Компания рассчитывает, что Ultrafast обеспечит поддержку задач в реальном времени или близких к продакшену, включая голосовое сопровождение, службу поддержки клиентов, коммерцию, агентские системы для разработчиков, финансовые исследования и реагирование на инциденты безопасности.
По словам представителей OpenAI, собственные разработчики компании использовали ее для анализа логов и трасс во время инцидентов, а также для сжатия исследовательских циклов, которые раньше выполнялись за ночь, до нескольких итераций в течение рабочего дня.
Доступ по-прежнему ограничен узким кругом клиентов, пока OpenAI оценивает, как возросшая скорость меняет продукты в реальных условиях и расширяет пропускную способность.
Предприятия могут вступить в лист ожидания Ultrafast, поделившись информацией о своих рабочих нагрузках, требованиях к задержкам, ожидаемом использовании и другими деталями.