智谱GLM-5.3-FlashX:提速5倍,但是定价涨2.5倍(智谱GLM-5.3模型API上线) ypxx.net

9月18日,智谱上线GLM-5.3-FlashX,推理速度较前代提速5倍、定价涨至2.5倍。国产大模型竞争从拼参数转向拼效率,铠盒AIBOX以7×24独立运行与智能调度,让AI越用越省。

亲历:智谱新模型提速5倍涨价2.5倍,我的AI工具到底该怎么选

作为一个天天用 AI 写稿、做表格的人,昨晚刷到智谱 GLM-5.3-FlashX 上线的消息,我盯着那组数字看了好久。

推理速度 200 tokens/s,是前代的 5 倍;定价,涨到 2.5 倍。

说实话,我第一反应不是「贵了」,而是「终于快了」。用过慢模型的人都知道,等回复的那几秒有多煎熬——尤其是赶稿的时候,恨不得它一秒出完。现在真做到了,贵一点,我认。


但冷静下来,我又算了一笔账。

这半年,国产模型像走马灯一样换。今天这家快、明天那家便宜,过两天又冒出一个「又快又便宜」的。我要是天天盯着各家的峰谷定价去切换,别干活了,光算账就够了。

更麻烦的是记忆。我在 A 家模型上攒下的对话习惯、常写的模板、客户的口味,换到 B 家就全没了。换一次,

重来一次。

所以最近我换了个思路:不再把自己绑在某个模型上,而是把「记忆」和「调度」留在本地。

具体就是搞了台本地常驻的设备,白天设任务、夜里自动跑,云端那些强模型只当外脑,按需调——哪家便宜用哪家、哪家快用哪家,不锁任何单一订阅。我的文件、记忆全锁在本地,不上传云端,7×24 照转,越用越省。


再说个让我挺有感触的细节。

智谱这次敢涨价,是因为它那 10 万张国产芯片的推理集群,一上线就被打满了。需求真的装不下。以前天天听人说「国产卡不行」,现在国产卡扛起了海外都在抢的模型,还扛得挺稳。这件事本身,比「涨不涨价」更值得高兴。


说回智谱这次涨价。我觉得它释放的信号比涨多少更重要:国产大模型,终于开始卷「效率」而不是只卷「参数」了。

对行业是洗牌,对咱普通用户,其实是好事。因为卷到最后,一定是又快又便宜的那个赢。

你怎么看这波涨价?评论区聊聊。