一句话看懂:OpenAI于2026年8月正式发布GPT-5.6 Sol“超快”模式,输出速度最高可达每秒750 token,整体处理速度提升至标准模式的14倍。关键在于借助Cerebras晶圆级硬件架构解决数据传输瓶颈,大模型竞争正从参数规模转向推理效率。
事件核心:发生了什么
OpenAI在2026年8月正式推出GPT-5.6 Sol“超快”模式,此前该版本于7月面向部分客户进行内部预览。根据官方公布的数据,这个模式没有切换成更小或更低性能的模型,而是依靠Cerebras的晶圆级引擎架构实现速度大幅提升,输出速度最高可达750 tokens/秒,整体处理速度比标准模式快14倍。
这项技术突破的关键在于Cerebras晶圆级引擎的44GB片上静态随机存取存储器,有效解决了传统GPU系统中数据传输带来的性能瓶颈。测试数据显示,该系统处理“终极人类考试”中的全部2500道题



