OpenAI GPT-5.6 Sol Ultrafast模式预览上线 每秒750 tokens但仅限精选客户
OpenAI于2026年8月13日推出GPT-5.6 Sol Ultrafast模式预览,借助Cerebras硬件实现最高每秒750 tokens输出,速度为标准模式的14倍。该模式目前仅向精选API客户开放,聚焦实时低延迟代理任务,早期测
OpenAI于2026年8月13日推出GPT-5.6 Sol Ultrafast模式预览,借助Cerebras硬件实现最高每秒750 tokens输出,速度为标准模式的14倍。该模式目前仅向精选API客户开放,聚焦实时低延迟代理任务,早期测
SGLang Diffusion 将 SGLang 的顶尖性能扩展至扩散模型的图像和视频生成,支持主流开源模型如 Wan、Hunyuan、Qwen-Image、Qwen-Image-Edit 和 Flux。通过 OpenAI 兼容 API、