Согласно отчету CoinWorld:
OpenAI выпустила новый режим под названием Ultrafast, который ориентирован на более высокую скорость отклика модели. Компания утверждает, что этот режим позволяет GPT 5.6 Sol работать с производительностью в 14 раз выше стандартной скорости обработки, достигая максимальной скорости вывода до 750 токенов в секунду, и в настоящее время доступен в виде предварительного просмотра для ограниченного числа клиентов.
Это обновление нацелено на потребности бизнеса в обработке AI в реальном времени. OpenAI заявляет, что ранее, чтобы получить отклик, близкий к реальному времени, обычно приходилось использовать более мелкие модели или выбирать системы, оптимизированные для конкретных задач. Направление Ultrafast заключается в том, чтобы увеличить объем эффективной работы, выполняемой за единицу времени, не полагаясь исключительно на маленькие модели.
Увеличение скорости вывода
По словам OpenAI, основное преимущество Ultrafast заключается в значительном сокращении времени ожидания генерации.
TechCrunch упоминает, что конкуренты, такие как Anthropic, ранее также запускали ускоренные режимы. Например, продукт Claude также предлагает быстрый режим, но показатели скорости, объявленные OpenAI, выше.
Для рабочих процессов бизнеса
OpenAI нацелила применение Ultrafast на различные бизнес-задачи, включая реагирование на события, обслуживание и поддержку клиентов, анализ финансовых рынков и электронную коммерцию. Эти сценарии обычно более чувствительны к задержкам, и время отклика модели напрямую влияет на эффективность человеческого взаимодействия и производительность автоматизированных процессов.
С точки зрения позиционирования продукта, Ultrafast не является отдельной новой моделью, а представляет собой способ высокоскоростной работы вокруг GPT 5.6 Sol. Для корпоративных клиентов это означает возможность более непосредственного внедрения AI в процессы реального времени, сохраняя при этом мощные возможности модели.
Поддерживается Cerebras
OpenAI заявляет, что Ultrafast поддерживается в сотрудничестве с компанией Cerebras, производителем чипов. Первые предварительные права на доступ в настоящее время открыты только для небольшой группы клиентов, и в дальнейшем доступ будет постепенно расширяться по мере увеличения вычислительных мощностей.
Это также демонстрирует, что конкуренция среди больших моделей выходит за рамки параметров и возможностей, расширяясь на скорость отклика, эффективность развертывания и совместимость базовых вычислительных мощностей. Для AI-продуктов, ориентированных на рынок бизнеса, скорость становится ключевым показателем наряду с качеством модели.
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.





























