MiniMax即将发布新版模型,继续在性价比路线上发力。智谱AI的GLM-4.7-Flash模型服务性能得到改善,但算力与并发限制仍是用户痛点。

模型动态

MiniMax预告M2.2模型即将发布,并推广其编程套餐。

官方账号发布“M2.1 slays. M2.2 levels up. #soon”,暗示M2.2模型即将推出。 同时,官方在多条推文中推广其10美元的“coding plan”编程套餐,强调与clawdbot结合可提供高性价比的24/7个人智能服务。

GLM-4.7-Flash模型API速度显著提升。

用户实测发现,GLM-4.7-Flash在openrouter上的API速度从约10 token/s提升至约30 token/s,推测是服务端增加了算力。 用户同时指出,该速度仍不满足高并发需求,且官方API的并发数限制(付费版为3)仍是瓶颈。