OpenAI запустила режим Ultrafast для GPT-5.6 Sol со скоростью генерации 750 токенов в секунду

OpenAI открыла доступ к режиму Ultrafast для модели GPT-5.6 Sol. Вычисления работают на базе нейронных процессоров Cerebras. Скорость генерации достигает 750 выходных токенов в секунду. Это в 14 раз быстрее стандартного вывода. Патч кода объемом 2000 токенов модель формирует за 2,7 секунды. Полный лимит ответа в 128 тысяч токенов генерируется менее чем за три минуты.
Сверхнизкая задержка меняет подход к проектированию систем. Объемные аналитические исследования теперь выполняются в формате интерактивной сессии. Режим ориентирован на near-production задачи. Среди них голосовые агенты реального времени, финансовый ресёрч, автоматизация техподдержки и быстрое реагирование на угрозы безопасности.
Сейчас доступ выдается в закрытом режиме. Инженеры OpenAI вручную отбирают корпоративные проекты. Главный критерий — наличие рабочих сценариев, где критична задержка ответа. Вычислительные мощности кластеров пока жестко ограничены.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад