你知道吗,OpenAI前两天发了个新东西,叫Ultrafast,就是给它们的旗舰模型GPT-5.6 Sol用的。听着挺唬人,其实就是让它干活快一点——快到什么程度呢?每秒能吐750个token,比普通模式快14倍。我一开始没太当回事,后来一想,这数字有点意思。
你想象一下,以前你问ChatGPT一个问题,它得在那儿琢磨半天,一个字一个字往外蹦。现在你要是开了Ultrafast,它几乎是瞬间就给你整段整段地往外倒。OpenAI自己也说了,以前想要实时速度,你就得用个小模型,现在不用了,大模型也能这么快。
他们想干嘛呢?主要盯的是企业客户。你想想,客服、金融分析、电商这些场景,谁受得了慢吞吞的AI?一个客户在线等着呢,你这边模型转半天才回一句,体验太差了。所以OpenAI这回算是踩准了点。
不过有意思的是,这玩意儿现在只给一小部分客户用,说是预览版。而且它背后靠的是跟芯片公司Cerebras的合作——说白了,快不是白快的,是拿硬件堆出来的。
我好奇的是,这会不会变成一种常态?以后所有模型都往快了赶,慢的反而没人用了。就像以前我们等网页加载,现在谁等得了三秒?反正我是觉得,这速度一上来,回不去了。