匿名模型“牛来”身份揭晓,免费使用量超DeepSeek一倍

前沿科技
分享至
评论

过去一周,一款代号Ox Alpha的匿名在海外开发者社区迅速走红。8月20日,该模型以“隐身模型”身份低调上线OpenRouter平台,提供方为匿名第三方。由于“Ox”意为“牛”,恰逢电影《牛来》走红,国内开发者将其称为 “牛来”大模型

匿名模型“牛来”身份揭晓,免费使用量超DeepSeek一倍

8月26日,智谱正式确认Ox Alpha为其GLM系列新版本,当晚即上线并开源GLM-5.3-Flash(320B-A18B)。据外媒报道,智谱在回应其询问时证实了该消息。这是GLM-5系列首个原生多模态模型,总参数量3200亿,激活参数仅180亿。模型权重随后上传至Hugging Face平台,供开发者下载部署。

GLM-5.3-Flash的走红首先体现在调用量上。OpenRouter官方榜单显示,Ox Alpha过去7天处理量达11.6万亿Token,与DeepSeek-V4-Flash-0731在周榜中分列第一和第二。在开源AI编程工具OpenCode上,累计处理量约24万亿Token,独立用户超31万,终结了DeepSeek连续56天的榜首纪录。从8月20日匿名上线至26日,六天内全球开发者累计调用62万亿Token,单周占据OpenRouter平台近20%的Token流量。

模型性能同样突出。独立研究员从软件工程基准DeepSWE中抽取10项真实任务测试,Ox Alpha完成8项,通过率80%;同一组任务中,Claude Fable 5为65%,GPT-5.6 Sol仅52%。在全球权威Artificial Analysis Intelligence Index中,GLM-5.3-Flash获得57分,与Anthropic旗舰模型Claude Opus 4.8得分持平。

定价方面,GLM-5.3-Flash价格仅为GLM-5.3的十分之一,限时折扣期内进一步降至二十分之一,约为Claude Opus 4.8的四十分之一。模型支持约100万Token上下文窗口,可处理文本、图像和视频输入。智谱提供一周免费使用期,OpenCode为其准备了每日100万亿Token的调用容量。

此次模型服务的全部推理流量由10万张国产芯片承载,这是智谱首次在大规模真实流量中尝试用国产芯片集群提供服务。智谱表示,硬件效率和单Token成本已达到与主流英伟达GPU相当的水平。

THE END

数码评测