谷歌和 OpenAI 今天都传达了同样的信息:人工智能现在足够快,足以让那些使用人工智能代理的人感到印象深刻,两家公司都宣布了超快的模型。
这两款产品的构建方式不同,目前您手中实际上只有一款。

Google 发布了 Gemini 3.7 Flash,这是针对软件编码和自主业务工作流程进行调整的最新型号。 OpenAI 开放了 GPT-5.6 Sol Ultrafast 的有限预览,这是一个新的服务层,能够以每秒高达 750 个输出令牌的速度运行其最强大的模型。
今天,我们将介绍 Gemini 3.7 Flash,这是我们迄今为止最智能的编码和代理模型。
该模型为软件工程、Web 开发和复杂的知识工作带来了巨大的收益。
现在到今年年底,Gemini 3.7 Flash 已经上市...... pic.twitter.com/RSCBDipjKn
——谷歌 (@Google) 2026 年 8 月 13 日
Gemini 3.7 Flash 是通用型号。它需要多达一百万个输入令牌(大约 750,000 个单词)并返回 64,000 个,处理文本、图像、视频、音频和 PDF,并且它可以调用工具并控制计算机。谷歌将其定位为自主系统的廉价大脑,可以在更少的人工帮助下规划任务并完成多步骤工作。
该模型不会为了速度而牺牲质量。它的能力更强,效率更高,能够在 2 分 13 秒内完成我们的测试编码任务,而最新的 Flash 模型需要 5 分钟多。两者之间的质量差距也很明显。
OpenAI 的 Ultrafast 并不是一个新模型。它是 GPT-5.6 Sol——与 OpenAI 相同的模型,在发布前使用 AI 红队来强化抵御即时注入攻击——在更快的轨道上,由芯片制造商 Cerebras 提供支持。它比 GPT-5.6 Sol 自己的标准速度快约 14 倍。
预览超快模式:GPT-5.6 Sol,速度高达 14 倍。
首先在 OpenAI API 中向选定的一组客户推出,随着容量的增长,可以扩大对更多企业的访问范围。 pic.twitter.com/a5dleofiDJ
- OpenAI (@OpenAI) 2026 年 8 月 13 日
Cerebras 的晶圆级芯片每秒生成多达 750 个令牌,大约 560 个单词,速度足以让语音代理可以在通话中思考。
重要的数字
Google 自己的基准表将 Gemini 3.7 Flash 在 18 个测试类别中的 11 个类别中领先于 Claude Sonnet 5、GPT-5.6 Terra 和其他类别,其中包括 Code Arena 网络开发得分 1,588 Elo 以及在企业工作流程 AutomationBench 上的 30.4%。这都是基于谷歌的方法论,因此将领先视为该公司的声明。
与任何 Gemini Flash 一样,该型号也很便宜。到年底,每百万个输入代币的价格为 75 美分,每百万个输出代币的价格为 3.75 美元,这是 Gemini 3.6 Flash 原始价格的一半。该首发价格将于 12 月 31 日到期,然后翻倍至 1.50 美元和 7.50 美元,这对于 Google 型号来说仍然很便宜。
除客户报价外,OpenAI 尚未公布 Ultrafast 的正面得分。 Jane Street AI 工程师 John Crepezzi 在 OpenAI 的声明中表示,Cerebras 的速度“支持使用模型的不同方式”。 Podium 产品负责人 Courtland Lykins 称其“在我们的语音堆栈中非常宝贵”,并称其速度“完全改变了通话体验”。该级别目前仅限邀请。
随着实验室从“谁最聪明”转向“谁对特工来说足够快”,速度的推动落地。谷歌的时机很明确。其旗舰产品 Gemini 3.5 Pro 仍然下落不明,发布日期也没有给出,此时距离 3.6 Flash 发布三周,以及 DeepMind 领导层改组几天后,Demis Hassabis 被换成了副手 Koray Kavukcuoglu。与此同时,OpenAI 正在租用 Cerebras 的速度,而不是等待自己的堆栈。
Gemini 3.7 Flash 现已在 160 多个国家/地区上线; GPT-5.6 Sol Ultrafast 仍然仅限邀请。