
4月的AI圈迎来一场“军备竞赛”高潮。过去一周,海内外多个大模型厂商密集发布新版模型,阿里、智谱、阶跃星辰、谷歌等轮番登场,在“深水区”展开新一轮技术角力。
从升级方向看,多模态能力提升、智能体(Agent)协同、Token成本降低、端侧部署增强成为四大核心战场。

阿里无疑是这场发布潮中最“忙”的选手。3月30日推出的全模态大模型Qwen3.5-Omni,在215项音频、音视频评测任务中取得SOTA(最佳表现),支持256K超长上下文和10小时以上音频输入,实测可1分钟看完50分钟《老友记》并输出带时间戳的细粒度描述。
紧接着4月1日发布Wan2.7-Image图像生成模型,填补国产高质量视觉生成空白。4月2日又推出Qwen3.6-Plus,主打Agent与编程能力,在Code Arena编程榜单上斩获全球第二,成为该榜排名最高的中国大模型。
调用量也创下纪录——Qwen3.6-Plus单日Token调用量突破1.4万亿,打破OpenRouter平台全球纪录。
智谱将目光投向“视觉编程”新赛道。4月2日发布的GLM-5V-Turbo,成为首个原生多模态Coding基座模型,可直接理解设计稿、网页截图并生成可运行代码,实现“所见即所得”的AI编程体验。
模型深度适配Agent与OpenClaw场景,在多模态工具调用方面新增画框、截图、读网页等能力,让Agent的“感知-行动”链路延伸至视觉交互。
阶跃星辰则走了一条“降本增效”路线。4月2日上线的Step 3.5 Flash 2603版本,新增低推理模式,在默认推理模式下Token消耗降低14%,切换到低推理模式后更暴降56%。
这一优化正是针对Agent场景中大量高频但复杂度不高的任务,让开发者不必每次请求都付出“深度思考”的代价。

谷歌也不甘落后,4月2日凌晨发布Gemma 4系列开源模型。31B版本用不到十分之一的参数量(31亿对比397亿)在Arena排行榜上与Qwen 3.5等巨无霸掰手腕。
Gemma 4在AIME数学竞赛题中准确率达89.2%,较上一代翻四倍多。更重要的是,谷歌这次换用Apache 2.0开源协议,彻底放下了姿态。
从实验室到真实商业场景,AI的渗透正在加速。万联证券指出,Qwen3.6-Plus日调用量的突破和豆包大模型日均Token使用量突破120万亿,彰显了AI应用产业化进程的加速。
当多模态让AI“看懂”世界、Agent让AI“动手”干活、低成本让开发者“用得”起,这场技术升级的终点,或许正是AI从“玩具”变为“工具”的质变时刻。















