2026-06-25 12:47 天天模拟器
3月底,智谱公司正式发布了GLM-5.1大模型,其编程能力评分达到45.3分,官网宣称比全球最强的Opus 4.6仅低了2.6分。
前几日,GLM-5.1大模型正式开源,并受到了广大开发者的热烈欢迎。如今最新排名已经揭晓——在全球权威AI评测平台LMArena上,经过百万用户参与的盲测更新了Code Arena专项榜单,GLM-5.1荣登全球开源模型榜首,并在全球所有模型中位列第三。
除了在榜单上表现亮眼,据智谱方面介绍,GLM-5.1不仅延续了上一代模型在开源SOTA编码能力上的优势,还在长程任务Long-Horizon Task领域实现了突破。具体内容包括:
·从零开始构建Linux桌面,仅需8小时就完成。
·经过655次迭代,成功打破了向量数据库的优化瓶颈。
·通过1000轮工具调用,优化了真实机器学习模型的负载表现。
值得一提的是,在METR榜单的同等评估标准下,GLM-5.1是唯一一款能实现8小时级持续工作的开源模型,同时也是全球范围内除Claude Opus 4.6之外,少数具备这一能力模型之一。
此前智谱曾指出,GLM-5.1大幅提升了代码能力,特别是在完成长程任务方面取得了显著进步。
来源:快科技
