本周,中国AI领域传出了重大消息,大模达智谱于周三发布并开源了其新一代旗舰大模型GLM-5.2。型何该模型采用MoE稀疏混合专家架构,时能斯克参数总数达到744B,级杰激活参数约40B,别马不用支持1M tokens的预计长上下文处理能力。在Artificial Analysis的明年综合榜单上,GLM-5.2取得了51分的那久优异成绩,排名领先,中国表现与Claude Opus 4.8相当,大模达并成为全球开源模型的型何第一。
GLM-5.2发布后,时能斯克以及Anthropic的级杰先进模型遭遇美国出口管制禁令,中美大模型的别马不用“追赶时间表”在社交媒体上引发了激烈讨论,包括全球首富马斯克和智谱创始人唐杰的参与。
6月18日,一名用户在X平台上向独立AI研究员Teortaxes提问:“中国大模型何时能够达到Anthropic的Fable级别能力?”Fable 5是迄今为止Anthropic最强的公开模型,因其出色的长任务处理和代码能力备受关注。
Teortaxes预计中国模型在11-12月能够达到完整的Fable级别,而马斯克的评估则更为保守,认为可能在明年一季度能赶上。马斯克指出,尽管基准测试的追赶相对简单,若以“真实实用性”衡量,明年Q1的追赶已足够引人注目。唐杰则表示“不会那么久”,显示出对技术迭代速度的信心。
据智谱透露,GLM-5.2是其迄今最强的开源模型,主要通过将1M token上下文从“纸面参数”转变为“生产可用”,以及在长程Coding方面进行改进,实现了重要进展。
北京大学特聘研究员张有鱼表示,GLM-5.2发布标志着国产模型在编程领域的关键突破。凭借其优越的性能和性价比,GLM-5.2在编程场景中具有显著优势,有望形成智谱、OpenAI和Anthropic的新三足鼎立局面。
尽管存在深度数理逻辑推理等领域的技术短板,GLM-5.2在许多实际开发场景中已足以作为海外模型的替代方案。
此外,中国AI大模型在成本方面的优势越来越受到全球关注。用户Hassan指出,GLM-5.2在开发成本上仅为0.06美元,而Opus 4.8的成本为0.49美元,低至六分之一,同时效率更高。这一现象促使越来越多企业转向成本更低的AI模型,包括多家中国大模型。
知名财经博客zerohedge评论称,当业界意识到中美大模型间“10%的智能差距”对应着“90%的成本优势”时,全球资本将重新审视近年来对AI领域的巨额投资配置。
总之,随着大模型竞赛重心从“参数与高墙”转向“实用、开源与性价比”,以智谱GLM-5.2为代表的中国方案正在重新塑造全球AI竞争的规则。
本文转载自“财联社”APP,作者:潇湘;官网编辑:宋芝萦。