OpenAI 近日宣布推出一项针对其高性能 AI 模型 GPT-5.6 Sol 的全新功能——Ultrafast(超高速)模式。该模式以预览形式上线,处理速度较标准模式提升 14 倍,最高可实现每秒输出 750 个词元(Token),为实时性要求严苛的业务场景提供了突破性解决方案。
据 OpenAI 介绍,此前用户若需提升模型响应速度,往往需在性能与速度间权衡,例如选择更小规模或专用性更强的模型。而 Ultrafast 模式通过技术优化打破了这一限制,在保持模型核心能力的同时显著提升效率,使“单位时间内完成更多高价值任务”成为可能。这一突破得益于与芯片制造商 Cerebras 的合作,后者为该模式提供了底层算力支持。
目前,Ultrafast 模式已确定首批应用场景,涵盖金融安全分析、事故应急响应、客服语音交互、电商商品咨询及实时科研实验等领域。例如,在金融领域,分析师可借助超高速输出快速捕捉市场动态;在电商场景中,系统能即时响应消费者关于库存或产品细节的查询,提升用户体验。
该功能目前处于有限预览阶段,仅向特定客户开放。OpenAI 表示,早期测试将重点验证速度提升在实际业务中的价值,并观察模型能否与用户操作节奏同步。公司未透露全面推广的时间表,但强调将持续优化技术,以满足更多行业对实时 AI 的需求。






















