Z.ai 推出 GLM-5.3:程式開發基準 Terminal-Bench 3.0 從 4.6 提升至 28.3 episode artwork

EPISODE · Aug 14, 2026 · 5 MIN

Z.ai 推出 GLM-5.3:程式開發基準 Terminal-Bench 3.0 從 4.6 提升至 28.3

from EasyVibeCoding Podcast · host ZCode

Z.ai 推出 GLM-5.3:程式開發基準 Terminal-Bench 3.0 從 4.6 提升至 28.3。 ZCode 與方案變動 ZCode 表示 GLM-5.3 已全面推出,Coding Plan 使用者的配額歸零重算。官方也主打 98% 以上的快取命中率、約 30% 的有效 token 使用收益,以及截至 8 月 31 日的 1.5 倍限時配額加成,搭配快取節省後,標準配額最高可達 180%。Goal mode 會持續規劃、撰寫程式碼、測試與驗證,直到完成目標;Remote Control 則能讓使用者透過 WeChat 或 Feishu 從手機監控並操控長時間執行的任務。詳情見 Z.ai 官方公告,ZCode 可從 zcode.z.ai 取得。 模型能力 GLM-5.3 沿用 GLM-5.2 的基礎模型,這次所有提升都來自 post-training。Z.ai 表示,模型在自家 Z.ai Code Bench 的表現提升 50%,並在 Terminal-Bench 3.0 與 Agents' Last Exam 取得 open-source SOTA。公開評測中,Terminal-Bench 3.0 從 4.6 提升至 28.3,DeepSWE v1.1 從 46.2 提升至 66.9,Agents' Last Exam 則從 23.8 提升至 28.5。 來源:@cline(回覆)|GLM-5.3 在 Terminal-Bench 2.1 基準測試中以 88.2 分擊敗 Fable 5 與 V4-Pro 0813 等模型取得領先。 Agentic 程式開發 Z.ai 將訓練環境擴展到更接近專業工程與研究工作的長流程任務,例如讓模型在具備運算叢集、儲存系統、內部文件、程式庫與實驗結果的環境中,診斷訓練瓶頸、實作最佳化、執行實驗,並在維持正確性的前提下交付端到端效能提升。在 Max effort 下,GLM-5.3 以約 75K output tokens 達到 34.5%,高於 GLM-5.2 的 23.4% 與 96K;High effort 則以約 50K output tokens 達到 31.4%,超過 Claude Opus 4.8 的 29.5% 與 120K,但仍落後 Claude Fable 5 的 39.5%。 資安能力與風險 post-training 納入漏洞發現資料與環境後,GLM-5.3 的資安能力延伸到多階段漏洞利用。它在 CyberGym 得分 84.5%,高於 GLM-5.2 的 77.2%;在 ExploitBench 達 54.4%,是 GLM-5.2 的兩倍以上;ExploitGym 則在兩小時內完成 105 個任務、六小時內完成 130 個,GLM-5.2 分別為 29 與 39 個。Z.ai 與中國數個資安團隊檢視真實程式庫後,模型在 269 個專案中找出 2,436 個漏洞,其中 1,097 個屬中度至高度嚴重性;最早的漏洞可追溯至 1981 年,平均存在 26.6 年才被發現。這項能力也意味著模型部署與安全評估需要更嚴格的人工作業。 GLM-5.3 在 AutomationBench、GDPVal-AA v2 與 CyberGym 取得領先,但在其餘 benchmark 與 GPT-5.6 Sol 等模型各有高低。 開放與整合 模型權重預計在發布兩週後、完成安全評估與強化後公開。Ollama 表示將在 open release 後支援 GLM-5.3;Cline 稱其已在 ClinePass 提供,首月促銷價為 4.99 美元,之後每月 9.99 美元,可透過以下指令安裝: `bash npm i -g cline ` OpenCode 則提供 GLM-5.3 的 Go 版本,支援文字輸出與 1M context,價格維持與 GLM-5.2 相同。 API 遷移 GLM-5.3 僅支援 low、high、max 三種 thinking effort,不再支援停用 thinking。既有應用程式若使用 thinking.type: "disabled",更新 model ID 前必須依序完成: 將 thinking.type: "disabled" 改為 enabled。 將 reasoning_effort 設為 low。 將 model ID 更新為 glm-5.3。 否則 API request 會失敗。原文:https://easyvibecoding.app/curated/2968-z-ai-launches-glm-5-3-terminal-bench-3-0

Episode metadata supplied by the publisher feed · Published Aug 14, 2026

Embed this episode

Ready to play

Z.ai 推出 GLM-5.3:程式開發基準 Terminal-Bench 3.0 從 4.6 提升至 28.3

0:00 5:03

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of EasyVibeCoding Podcast?

This episode is 5 minutes long.

When was this EasyVibeCoding Podcast episode published?

This episode was published on August 14, 2026.

Can I download this EasyVibeCoding Podcast episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!