Пока все спорят о качестве ответов, ребята из OpenAI ударили по самому больному месту нейронок — времени ожидания. Новая модель Spark выдает безумную тысячу токенов в секунду. Это стало возможным благодаря железу от Cerebras — их чип размером с целую кремниевую пластину заменяет гору обычных видеокарт.
По бенчмаркам модель сопоставима с версией Codex-5.3-low, но работает почти мгновенно. Из минусов — нейронка не понимает картинки и ограничена 128к токенами контекста. На мой взгляд, это идеальный инструмент для написания кода в реальном времени, когда задержка в пару секунд только мешает потоку мысли. GPT-5.3-Codex-Spark уже доступен для подписчиков Pro. ⚡️












