首頁LBank 新聞中心
中國的 Z.AI 推出 GLM-5.3,稱其為頂尖開源權重程式碼模型
china-z-ai-glm-5-3-top-open-weight-coding-model
中國的 Z.AI 推出 GLM-5.3,稱其為頂尖開源權重程式碼模型
中國實驗室表示,這次發布在程式碼基準測試上優於同等規模的開放模型。該部落格自身的數據顯示,它仍落後於封閉式前沿模型,且至少不如一個開放競爭對手。
2026-08-14 來源:decrypt.co

簡要

  • 智譜AI(現稱Z.ai)於週四透過其GLM編碼計畫和ZCode發布了GLM-5.3。
  • 該實驗室稱其為「最具能力的開源編碼模型」。
  • GLM-5.3是一個7430億參數的模型,透過在GLM-5.2基礎上進行後訓練擴展而建成。

中國人工智慧實驗室Z.ai於週四發布了GLM-5.3,這是一個大型編碼模型,被宣傳為市場上最強大的開源權重編碼器。該模型現已透過GLM編碼計畫訂閱和ZCode上線,API存取和可下載權重將在安全審查後發布。

「對GLM-5.3而言,我們所做的只是後訓練擴展,」該公司在其發布文章中寫道。「透過GLM-5.2,我們建立了基礎架構...在過去的一個月裡,我們不斷在此基礎架構上擴展:更多的環境、更多樣的任務,以及投入更多運算資源進行訓練。」

萬花筒:OpenAI何時會發布GPT-6?點擊進行預測。

該團隊更注重詞元效率,而非純粹的性能主導。GLM-5.3擁有7430億個參數,並且每個任務消耗的詞元數量遠少於其前身。參數是模型在處理資訊時所能處理的「調整鈕」數量,而詞元是模型能夠消耗或生成的資訊基本單位。

Z.ai表示,GLM-5.3在其內部的Z.ai Code Bench測試中,以最大努力達到34.5%的成績,每個任務約消耗75,000個輸出詞元,而GLM-5.2的成績為23.4%,消耗96,000個詞元。針對閉源模型,該部落格指出GLM-5.3在詞元經濟性上擊敗了Claude Opus 4.8,但「仍落後於Claude Fable 5,後者以最大努力達到39.5%」。

在編碼方面,GLM-5.3表現非常出色,在最相關的基準測試中擊敗了同為中國模型的Kimi K3。

在Terminal Bench 3.0(一項在真實Linux環境中自主shell/工具使用的測試)上,GLM-5.3得分28.3,略低於閉源模型Fable 5(33.7)和GPT-5.6 Sol(34.6)。在DeepSWE v1.1(一項用於端到端修復真實GitHub問題的基準測試)上,開源競爭對手Kimi K3(67.5)和Fable 5(69.7)均擊敗了GLM-5.3的66.9。

這種模式大致可以歸結為:GLM-5.3超越了其自身的前身和一些開源同行,但閉源的美國模型仍然在主要的編碼排行榜上領先。

網路安全結果顯示了另一項重要飛躍。GLM-5.3在CyberGym中以84.5%領先,並在漏洞利用基準測試中,表現較GLM-5.2翻了一倍多。Z.ai表示,該模型在269個開源專案中標記了2,436個漏洞,其中1,097個屬於中高嚴重性。

「GLM-5.3將代理式編碼提升到一個新的水平,相較GLM-5.2帶來了顯著的改進,同時以更少的輸出詞元實現了更好的結果,」Z.ai在X上發布。「GLM-5.3現已透過GLM編碼計畫和ZCode提供。API存取和開源權重將在嚴格的安全評估後分階段發布。」

GLM-5.3 takes agentic coding to the next level, delivering a dramatic improvement over GLM-5.2 while achieving better results with fewer output tokens. pic.twitter.com/KGc6ZR7GHv

— Z.ai (@Zai_org) August 14, 2026

在價格方面,與美國頂尖模型之間的差距體現在其開源權重的吸引力。Z.ai的GLM編碼計畫以點數配額運行(離峰時段調用費用減半),Zhipu的API定價約為美國頂尖模型每詞元費率的十分之一——GLM-5.2的官方費率為每百萬詞元輸入1.40美元/輸出4.40美元。這與GPT-5.3-Codex的1.75美元/14美元以及Anthropic頂級產品之一的Claude Opus 4.8形成了對比。

Z.ai是一家位於北京的實驗室,被列入美國實體清單,這意味著美國公司不能向其出口受管制技術。儘管如此,GLM仍是一個極受歡迎的模型,而且中國的開源權重模型在OpenRouter的詞元使用量方面已經超越了美國模型。

根據發布文章,GLM-5.3的權重預計將在大約兩週後公開發布——「開源權重」的標籤適用於即將推出的內容,而非目前可下載的內容。