智譜發(fā)布GLM-5:實(shí)現(xiàn)一鍵“寫工程” 對齊 Claude Opus 4.5_播報(bào)
(資料圖片)
雷遞網(wǎng) 樂天 2月12日
智譜深夜上線并開源新一代大模型 GLM-5,同步在Z.ai、智譜清言 App/網(wǎng)頁版、BigModel平臺開放體驗(yàn)。
與以往偏向?qū)υ捠降腣ibe Coding工具不同,GLM-5是開源界第一個能處理長周期、多步驟、系統(tǒng)性工程任務(wù)的“架構(gòu)師級”模型,實(shí)現(xiàn)了從Vibe Coding到Agentic Engineering的升級。
智譜稱,不同于以往主要聚焦前端生成、函數(shù)補(bǔ)全或單點(diǎn)任務(wù)完成的編程模型,GLM-5面向的是真實(shí)工程場景中的完整開發(fā)流程。模型能夠自主完成從需求理解、代碼編寫到調(diào)試與部署的全過程,覆蓋跨文件協(xié)作、后端邏輯構(gòu)建、錯誤定位與多輪調(diào)試等高復(fù)雜度工程問題,其能力邊界正逐步逼近真實(shí)軟件開發(fā)中的完整閉環(huán)。
GLM-5 在編程能力上實(shí)現(xiàn)了對齊 Claude Opus 4.5,在業(yè)內(nèi)公認(rèn)的主流基準(zhǔn)測試中取得開源模型 SOTA。在 SWE-bench-Verified 和 Terminal Bench 2.0 中分別獲得 77.8 和 56.2 的開源模型最高分?jǐn)?shù),性能超過 Gemini 3 Pro。
分析認(rèn)為,長期以來,閉源模型憑借在復(fù)雜工程任務(wù)中的穩(wěn)定交付能力構(gòu)筑了競爭壁壘,開源模型則多定位于低成本平替。而GLM-5的發(fā)布,意味著開源陣營首次在“工程可交付性”上實(shí)現(xiàn)對頂尖閉源模型的追趕。
雷遞由媒體人雷建平創(chuàng)辦,若轉(zhuǎn)載請寫明來源。

播報(bào):江西淇陽新材料有限公司成立 注冊資本1000萬人民幣